Gemini 3.6 Flash Family

Gemini 3.6 Flash Family

Google · コーディング

Gemini 3.6 Flash Family は、本番環境の AI エージェントモデルを拡張するために作られた Google の低遅延・省トークンシリーズだ。構成は3段階に分かれる。Gemini 3.6 Flash はより少ないトークンで高品質なコーディングと知識作業をこなし、Gemini 3.5 Flash-Lite は超高速・高スループットの処理を担い、制限付きの Gemini 3.5 Flash Cyber は CodeMender エージェントを通じてソフトウェアの脆弱性を見つけて修正する。なぜ3つなのか。1つのサイズでエージェントのパイプライン全体をまかなえることは、ほとんどないからだ。何時間も動き続け、何度もツールを呼ぶエージェントを組むなら、このファミリーは1トークンあたりの定価ではなく、完了したタスクごとのコストを削ることを狙っている。

Gemini 3.6 Flash Family の画面プレビュー

Gemini 3.6 Flash Family について

Gemini 3.6 Flash Family とは

Gemini 3.6 Flash Family は、Google が2026年7月21日に発表した3つのモデル群で、いずれも本番エージェントに必要な効率へ調整されている。遅延はより低く、出力トークンはより少なく、負荷時でも性能が安定する。Gemini 3.6 Flash は主力で、コーディング、知識作業、マルチモーダル処理を1回でこなす。Gemini 3.5 Flash-Lite は生の知能を速度と価格に振り替え、Gemini 3.5 Flash Cyber はサイバーセキュリティ特化型で、政府と信頼できるパートナー向けに CodeMender 内だけで動く。3つの仕事。3つのモデルだ。

このファミリーが生まれたのは、エージェントの請求額がすぐ膨らむからだ。1つのエージェントタスクには何十もの推論ステップとツール呼び出しが含まれ得るので、無駄なトークンはすべて倍々に効いてくる。Google によれば、3.6 Flash は Artificial Analysis Index で 3.5 Flash より出力トークンを約17%少なく使う省トークンモデルで、一部のコーディングテストでは削減幅が65%に達する。出力価格も100万トークンあたり9ドルから7.50ドルへ下げた。

明らかな限界は、これらが Flash 層のモデルだという点だ。効率的ではある。だが初期のベンチマークとコミュニティの議論を見る限り、生の推論能力が跳ね上がったわけではなく、旗艦の Gemini 3.5 Pro は発表時点でまだ出ていなかった。可能な限り深い推論が要るタスクなら、このラインナップだけでは答えにならない。さらに Flash Cyber は限定的なパイロットに閉じたままで、大半の開発者は触れない。

はじめかた

  1. Google AI Studio、Gemini アプリ、または GitHub Copilot のようなパートナーツールで API キーを取得する。
  2. gemini-3.6-flash や gemini-3.5-flash-lite といった短い名前で、Gemini API からモデルを呼ぶ。
  3. Flash-Lite では思考レベルを選び、タスクに応じて遅延と出力品質を交換する。
  4. エージェントが画面をクリックする必要があるなら、組み込みのクライアント側ツールである computer use を有効にする。
  5. 1トークンあたりの価格ではなく、完了したタスクごとの総コストを測り、そこからモデル層と思考レベルを調整する。

AIツール情報

Gemini 3.6 Flash Familyの料金、対応プラットフォーム、性能を簡単に確認できます。

無料プランはい
有料プラン$0.30 - $7.50 per 1M tokens
プラットフォームWeb, API
開発元Google
カテゴリコーディング
リリース日Jul 2026
最終更新Jul 2026
サイト訪問数8.8M
サイト世界ランキング8.7K
API提供状況はい

こんな人におすすめ

このツールが最も力を発揮するユーザー、タスク、シーン。

ユーザー

  • 本番エージェントを組む開発者:トークンが少なくツールループが短いおかげで、完了タスクあたりのコストが下がる。仕事ごとにモデル層を調整する手間を惜しまないなら向く。
  • 推論コストを見張るスタートアップ:検索、翻訳、文書解析といった大量処理を、100万トークンあたり0.30/2.50ドルの Flash-Lite で回せる。
  • 政府やパートナー組織のセキュリティチーム:CodeMender 内の Flash Cyber で脆弱性を検出する。アクセスはパイロットに限られる。

タスク

  • 多段階のコーディングエージェント:3.6 Flash に、不要な変更を減らし実行ループを短くしてコードを編集させる。
  • 高スループットのバッチ処理:文書抽出、分類、翻訳を Flash-Lite で毎秒350出力トークンのペースで流す。
  • computer use のフロー:Gemini API に搭載された組み込みのクライアント側ツールで、ブラウザやアプリの画面を操作する。

シーン

  • 何時間も動き、毎ステップでツールを呼ぶエージェントを拡張する場面。トークンの節約が積み上がる。
  • ピークの推論よりもスループットと価格が重視される、大量の文書群の処理。
  • CodeMender を使った管理されたパイロットで、コードのセキュリティ問題をレビューする場面。

主な機能

省トークンの出力

3.6 Flash の目玉は、同じ仕事をより少ないトークンでこなすことだ。Google によれば、Artificial Analysis Index で 3.5 Flash より出力トークンを約17%少なく使い、一部の DeepSWE コーディングテストでは削減幅が65%に達する。ステップは減る。ツール呼び出しも減る。だから節約は1トークンあたりの行だけでなく、タスク全体の請求に表れる。長いエージェント実行では、この差が速く積み上がる。

3つの層、1つのラインナップ

このファミリーは格ではなく仕事で分かれる。3.6 Flash は要求の厳しいコーディングと知識作業を担い、Flash-Lite は安価な大量処理を回し、Flash Cyber はセキュリティの隙間を埋める。品質の基準を超える中で最も安い層を選べばいい。すべてを1つのモデルでまかなうより、判断がすっきりする。

組み込みの computer use

モデルが人と同じように画面を操作できる computer use は、今や Gemini API と Gemini Enterprise のクライアント側ツールだ。Google の報告では、3.6 Flash は OSWorld-Verified で83%を記録し、3.5 Flash の78.4%から伸びた。クリックし、入力し、移動する必要のあるエージェントにとって、自作の配管は減る。つなぎのコードも減る。壊れる箇所も減る。

Flash-Lite の柔軟な思考レベル

Flash-Lite では推論を上げ下げできる。単純なタスクは最下段で速度とコストを取り、サブタスクが多段階の分解を要するときは引き上げる。売りは速度だ。Google は毎秒350出力トークンを計測している。Flash-Lite はテキスト、画像、音声、動画の入力にも対応し、コンテキストウィンドウは最大100万トークンに達する。

マルチモーダル入力と長いコンテキスト

3.6 Flash も 3.5 Flash-Lite も、テキスト、画像、音声、動画を受け付け、コンテキストは最大100万トークン、出力は64Kトークン。文書解析、グラフ分析、レシートの翻訳を、細かく刻まずに済ませられる。Google によれば、Hebbia や Harvey のような顧客はデータ抽出や報告書の起草といったマルチモーダルタスクで成果を得た。ベンダー側の説明なので、証明ではなく信号として受け止めたい。

CodeMender セキュリティエージェント

Flash Cyber は、サイバーセキュリティに特化したモデルと、Google のコードセキュリティエージェントである CodeMender を組み合わせ、ソフトウェアの脆弱性を見つけて直す。Google によれば、この組み合わせは V8 エンジンで55件の問題を発見し、うち10件は未知だった。狭く管理されたツールだ。平均的な開発者が今日つなげるものではない。Google は意図的に扉を閉ざしている。

メリットとデメリット

メリット

  • 出力トークンが少なくツールループが短いおかげで完了タスクあたりのコストが下がる。1トークンあたりの単価が安いだけではない。
  • Flash-Lite は毎秒350出力トークンに達し、高スループットのバッチ処理に向く。
  • computer use が組み込みツールとして搭載され、画面自動化の自作が減る。
  • 100万トークンのコンテキストと64Kの出力ウィンドウで、大きな文書を1回で扱える。
  • マルチモーダル入力がテキスト、画像、音声、動画を別パイプラインなしで処理する。
  • computer use が組み込みツールになったので、画面自動化のつなぎコードのほとんどを省ける。
  • 3つの層で、どこでも払い過ぎるのではなく、仕事ごとにモデルコストを合わせられる。

デメリット

  • 初期のベンチマークは、このファミリーが生の推論の跳躍ではなく効率に優れることを示す。最も難しいタスクは依然としてより大きなモデルを要するかもしれない。
  • Flash Cyber は政府と信頼できるパートナー向けの限定的なパイロットに閉じており、大半の開発者は使えない。
  • Flash-Lite の1トークンあたりの価格は、3.1 Flash-Lite より実際に上がった。節約は速度とタスク効率から来るもので、入力単価からではない。

よくある質問

Google が2026年7月21日に発表した3つのモデル群だ。Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、制限付きの Gemini 3.5 Flash Cyber からなる。いずれも低遅延、トークン使用量の削減、本番エージェントを動かすときの安定した性能へ調整されている。それが売り込みのすべてだ。

関連コンテンツ

Gemini 3.6 Flash Familyに関連するツール、スキル、記事を探す。

Gemini 3.6 Flash Familyの代替ツール

Forefront

Forefront

Forefront · コーディング

ForefrontはオープンソースAIで構築するためのウェブプラットフォームだ。主要なオープンソース言語モデルを自分のデータで微調整し、性能を評価し、API経由で実行したり、エクスポートして自分でホストしたりできる。クローズドなプラットフォームの手軽さを求めつつ、モデルとデータの所有権にはこだわる開発者が対象だ。

無料 / $0 - $99/mo詳細を見る
Startkit

Startkit

StartKit.AI · コーディング

Startkitは、AI SaaSとAIラッパー製品を作るためのボイラープレートだ。面倒な部分をあらかじめ配線済みにしたAIスタートアップボイラープレートと考えればいい。認証、StripeとLemon Squeezyの決済、利用制限、トランザクションメール、そしてOpenAI、Anthropic、Groq、Llamaと通信するAI APIスターターキットが含まれる。リポジトリをクローンして価格を設定し、ユーザーが実際にお金を払う部分に取りかかれる。ReactとTailwind上のNext.jsで作られているため、ボイラープレートコードの多くはすでに見慣れたものだ。

有料 / $99 - $499 one-time詳細を見る
Testim

Testim

Tricentis · コーディング

Testimは、Web・モバイル・Salesforceアプリ向けにエンドツーエンドテストを構築して実行するAIテスト自動化プラットフォームだ。機械学習を頼りに、インターフェースが変わってもテストを安定させ、チームが壊れたセレクターの修正に費やす時間を減らす。今日から使い始められる自動テストツールとしては悪くない。ブラウザで操作を録画してテストを作り、より細かい制御が必要なときはJavaScriptを足す。忙しいQAチームにとって堅実な選択肢である。

無料 / Custom pricing on request詳細を見る