要約: Google は 2026 年 7 月 21 日に Gemini 3.6 Flash をリリースしました。これは 3.5 Flash より高速かつトークン効率に優れ、エージェント的なコーディング、コンピュータ使用、マルチモーダルタスクで卓越しながらコストを削減します。Gemini 3.5 Flash はフロンティア級の持続的性能で依然として強力で、新しい 3.5 Flash-Lite は大規模・低レイテンシのワークロードにおいて最良のコストパフォーマンスを提供します。
大半の本番ユースケースには 3.6 Flash、複雑なコーディングエージェントには 3.5 Flash、スケールには Lite を選びましょう。Cometapi.com 経由で効率よくアクセスすれば、価格最適化・高いレート制限・シームレスな統合が可能です。
重要なポイント
- Gemini 3.6 Flash は効率面で先行(全体で出力トークンを 17%削減、コーディングの一部タスクで最大 65%)、速度、OSWorld-Verified(83.0%)や DeepSWE(49%)などのエージェント系ベンチマークで優秀。
- Gemini 3.5 Flash はコーディングと推論で強力なフロンティア性能を発揮する一方、トークン使用量が多く、出力コストがやや高い。
- Gemini 3.5 Flash-Lite は高スループットタスク向けの予算王者で、Terminal-Bench や長文脈で従来の Lite モデルから大幅な向上。
- すべてのモデルが 1M トークンのコンテキストウィンドウを共有。キャッシュにより高ボリュームユーザーの価格が優遇。
- Cometapi の推奨: Cometapi.com を活用して Google Gemini モデルに統合アクセス。コスト削減、モニタリング、エンタープライズ機能を備え、本番スケールに最適でベンダーロックインを回避。
クイック比較: Gemini 3.6 Flash vs 3.5 Flash vs 3.5 Flash Lite
| 次元 | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.5 Flash-Lite | Gemini 3.1 Pro Preview |
|---|---|---|---|---|
| ステータス | 安定版 / GA | 安定版 | 安定版 / GA | プレビュー |
| 最適な役割 | エージェント、コーディング、マルチモーダル推論の主力 | これまでの Flash の主力 | 高スループット・低レイテンシ・低コストタスク | より深い推論のベースライン |
| モデル ID | gemini-3.6-flash | gemini-3.5-flash | gemini-3.5-flash-lite | gemini-3.1-pro-preview |
| 入力タイプ | Text, image, video, audio, PDF | Text, image, video, audio, PDF | Text, image, video, audio, PDF | Text, image, video, audio, PDF |
| 公式標準入力価格 | $1.50/M | $1.50/M | $0.30/M | $2/M(プロンプト 200K まで);200K 超で $4/M |
| 公式標準出力価格 | $7.50/M | $9.00/M | $2.50/M | $12/M(プロンプト 200K まで);200K 超で $18/M |
| トークン効率 | Google(Artificial Analysis 引用)比で 3.5 Flash より出力 17%削減 | ベースライン | 低コスト・高スループットに最適化 | Flash の効率モデルとしての位置付けではない |
| コーディング指標 | DeepSWE 49%、MLE Bench 63.9% | DeepSWE 37%、MLE Bench 49.7% | Terminal-Bench 2.1 で 54%(3.1 Flash-Lite の 31% に対し) | より強い推論層だがプレビュー |
| コンピュータ使用の指標 | OSWorld-Verified 83.0% | OSWorld-Verified 78.4% | 旧 Lite モデル比でエージェント性能の大幅向上を Google が報告 | 対応面・ツール可用性に依存 |
| 推奨 | 3.5 Flash からの移行に向けたデフォルトのテスト候補 | 回帰が通るまでフォールバックとして維持 | 単純なボリュームタスクで使用 | Flash で足りないタスクに使用 |
Gemini Flash モデルの進化: 3.5 から 3.6 へ
Google の Flash シリーズは優先します 速度と効率を、強力な推論を維持しながら。2026 年初頭にリリースされた Gemini 3.5 Flash は、1M コンテキストウィンドウとバランスの取れた能力で高い基準を打ち立てました。しかし、エージェント的ワークフローでのトークン効率と精度の改善余地が指摘されました。
Gemini 3.6 Flash とは?
Gemini 3.6 Flash は、効率的な Flash シリーズ に属する Google の最新・高速マルチモーダル大規模言語モデル(LLM)です。現実世界のエージェントワークフロー、コーディング、ナレッジタスク、マルチモーダル用途における主要な「ワークホース」として位置付けられ、Gemini 3.5 Flash のフィードバックを直接取り込んでいます。
2026 年 7 月 21 日にリリースされた 3.6 Flash は、速度と低コストに最適化された持続的なフロンティア級知性を重視します。テキスト・画像・動画・音声・PDF 入力をサポートし、1,048,576 トークン(1M)の巨大なコンテキストウィンドウと最大 65,536 出力トークンに対応。関数呼び出し、コード実行、コンピュータ使用(組み込みプレビュー)、構造化出力、思考モード、キャッシング、Google Search/Maps によるグラウンディングなどを備えます。
Gemini 3.6 Flash(モデル ID: gemini-3.6-flash)は、次の点で直接的な進化版です。
- 3.5 Flash を基盤にしつつ出力トークンを削減(Artificial Analysis Index によると 17% 減、DeepSWE のような特定ベンチマークでは最大 65%)。
- ナレッジカットオフが 2026 年 3 月に更新。
- デフォルトの思考レベルは「中」。
- コーディング、ナレッジワーク、空間/マルチモーダル推論、多段エージェントに最適化。
Gemini 3.5 Flash とは?
Gemini 3.5 Flash は(2026 年 7 月以前の)従来のフラッグシップ Flash モデルです。エージェント性とコーディング性能で強力でしたが、効率と特定機能では 3.6 Flash に追い越されました。価格は $1.50/$9.00 で、1M コンテキストなどは同等です。
Gemini 3.5 Flash Lite とは?
Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)は 3.5 シリーズ中で最速かつ最もコスト効率に優れたモデルで、ドキュメント処理、分類、抽出、サブエージェントパイプラインなどの高スループット・低レイテンシタスクに最適化されています。3.6 Flash と同日の 2026 年 7 月 21 日にローンチされました。
Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)の狙い所は異なります。
- 3.5 ファミリーで最速(約 350 出力トークン/秒)。
- 低レイテンシ・高スループットタスク向けに最小限のデフォルト思考レベル。
- コーディング、長文脈、エージェント性能で 3.1 Flash-Lite から大幅改善。
詳細機能比較
3 モデルは核となる強みを共有しますが、最適化の方向性が異なります。
共有機能:
- コンテキストウィンドウ: 1M トークン
- 最大出力: 64k トークン
- マルチモーダル入力: テキスト、画像、音声、動画、PDF/ドキュメント
- 出力: テキスト(構造化出力サポートあり)
- ツール: 関数呼び出し、コンピュータ使用(エージェントタスク向け組み込み)、コード実行、検索グラウンディング
差別化点:
- 3.6 Flash: 指示追従が優れ、実行ループを削減、不要な編集を減らしつつコード品質を向上。複雑な多段ワークフローに強い。
- 3.5 Flash: 万能型だが置換が進行中。出力トークンとコストが高め。
- 3.5 Flash-Lite: 速度と低コストに最適化。並列サブエージェント実行、抽出、分類、JSON 解析で優秀。思考レベル(最小/中/高)を調整可能。
価格内訳とコスト効率
本番スケールでは価格が重要な決定要因です。
| モデル | 入力 ($$/1M) | 出力 ($$/1M) | 備考 |
|---|---|---|---|
| Gemini 3.6 Flash | 1.50 | 7.50 | 出力コスト低 + 3.5 Flash 比でトークン削減 |
| Gemini 3.5 Flash | 1.50 | 9.00 | 出力使用量が多い |
| Gemini 3.5 Flash-Lite | 0.30 | 2.50 | ボリューム用途に最適。バッチ/フレックス割引可 |
実コスト例: 100k 入力 + 20k 出力トークンを要するタスクの場合:
- 3.6 Flash: 約 ~$0.30(さらに効率向上の恩恵)
- 3.5 Flash: 生成トークンが多いため高め
- Flash-Lite: 約 ~$0.08 — 1 日数百万コールに最適
CometAPI の利点: CometAPI は競争力のあるプロキシ価格、統合請求、Google 直接のレート制限回避を提供。切替は 1 行だけ: ベース URL を https://api.cometapi.com/v1 に変更し、CometAPI キーを使用。複数モデルのテストやフォールバックルーティングに最適。
ベンチマークの詳細分析
ツール使用、エージェント性、コンピュータ使用
これらは Flash の強みです:
- ネイティブのツール呼び出し、関数呼び出し、コンピュータ使用(画面理解、UI 操作)
- 3.6 Flash: OSWorld-Verified 83.0%(3.5 比 +4.6%)、Terminal-Bench 78.0%。不要な編集/ループが少ない。
- 3.5 Flash: 強力なベースライン(Terminal-Bench 76.2%、OSWorld 78.4%)。
- Lite: 軽量なエージェントタスクで堅実(例: Terminal-Bench 54%、旧 Lite の 31%)。
コーディングとソフトウェアエンジニアリング
- SWE-Bench Pro: 3.6 Flash 58.7% > 3.5 Flash 55.1% > Lite 約 54.2%
- DeepSWE v1.1: 3.6 は 49%、3.5 は 37%(トークンを大幅削減)
- MLE-Bench: 3.6 は 63.9%、3.5 は 49.7%
- 3.6 Flash は、不要な修正が少ない、より本番指向のコードを生成。
推論と知識ベンチマーク
- GPQA Diamond、Humanity’s Last Exam、MMMU-Pro などで、3.6 Flash は効率を維持しつつフロンティア級スコアを維持/改善。
- GDPval-AA(エージェント型ナレッジワーク): 3.6 Flash 1421 > 3.5 1349
| メトリクス/ベンチマーク | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| 価格(入力/出力、1M あたり) | $1.50 / $7.50 | $1.50 / $9.00 | $0.30 / $2.50 |
| コンテキストウィンドウ | 1M tokens | 1M tokens | 1M tokens |
| SWE-Bench Pro | 58.7% | 55.1% | 約 54.2% |
| DeepSWE v1.1 | 49% | 37% | 低い |
| Terminal-Bench 2.1 | 78.0% | 76.2% | 54% |
| OSWorld-Verified(Computer Use) | 83.0% | 78.4% | 74.0% |
| MLE-Bench | 63.9% | 49.7% | N/A |
| トークン効率(出力) | 3.5 比で 17% 減 | ベースライン | 最高スループット |
| 最適用途 | 本番エージェント、コーディング | 持続的フロンティアタスク | 高ボリュームな単純エージェント |
(データは 2026 年 7 月時点。更新の可能性あり。キャッシュ済み入力は約 90% の割引。)
ユースケースと選定ガイド
実運用でのパフォーマンスとコミュニティの声
開発者からは、3.6 Flash がエージェントフローでの実行ループや幻覚を減らすとの報告。エンタープライズは Vertex AI で安全かつスケーラブルに導入。コミュニティは、純粋なベンチマークリーダー(例: Claude)よりも実務ワークフローでの強みを指摘。
サイバー/セキュリティ向け: 関連する 3.5 Flash Cyber バリアントがパイロット提供中。
推奨ルーティング方針
| ワークロード | まず使うモデル | エスカレーション先 | 理由 |
|---|---|---|---|
| コーディングエージェント、リポジトリ改修、テスト修復 | Gemini 3.6 Flash | Pro 級モデルまたは別のコーディングモデル | 3.5 Flash より強いコーディング性能と少ない改訂ループ |
| PDF、チャート、表、書き起こしの分析 | Gemini 3.6 Flash | 高重要度の統合には Pro 級モデル | マルチモーダル/ナレッジワークが向上 |
| 分類、ルーティング、タグ付け | Gemini 3.5 Flash-Lite | 低信頼時に Gemini 3.6 Flash | 予測可能タスクで Lite は安価かつ高速 |
| カスタマーサポートの下書き | Gemini 3.5 Flash-Lite または Gemini 3.6 Flash | 根拠付け(グラウンディング)込みの Gemini 3.6 Flash | 複雑性と証拠要件に応じて選択 |
| 検索グラウンディング研究アシスタント | Gemini 3.6 Flash | 最終統合でより深い推論モデル | エージェント推論とツール使用に優れる |
| 既存の 3.5 Flash 本番フロー | 3.5 Flash をフォールバック、3.6 でシャドーテスト | 回帰が通過したら Gemini 3.6 Flash | 動作のドリフトを回避 |
Gemini 3.6 Flash は Gemini 3.5 Flash を置き換えられるか?
結論
はい。Gemini 3.6 Flash は多くの新規・既存の本番ワークロード、特にコーディングエージェント、マルチモーダル推論、ドキュメント処理、ツール集中の自動化で 3.5 Flash を置き換えられます。ただし、盲目的に置換するのではなく、移行ベンチマークを実施すべきです。
Gemini 3.6 Flash に移行すべきタイミング
以下を含むワークロードなら 3.6 Flash を優先的なアップグレード経路に:
- コードの検査・編集・テスト・改訂を行うコーディングエージェント
- 推論ターンを減らすことでレイテンシとコストを抑える多段ツール使用
- チャート、表、PDF、書き起こし、混在メディアを含むドキュメント解析
- 最大 1M 入力トークンまでの長文脈分析
- 取得情報に対するより強い推論が必要な検索グラウンディングアシスタント
- 画面推論が重要な UI/コンピュータ使用タスク
- 初回回答の品質向上で人手レビューを削減したいビジネスワークフロー
もし現行の Gemini 3.5 Flash ワークフローで再試行、追加の誘導プロンプト、Pro モデルへのエスカレーションが頻発するなら、Gemini 3.6 Flash は特にテスト価値があります。より少し高性能な Flash モデルが、ループ削減により総コストを下げることがあります。
一時的に Gemini 3.5 Flash を維持すべき場合
以下に該当する場合、移行テスト完了まで 3.5 Flash を本番で維持:
- 出力が監査対象で、安定性が必須
- 厳密なスタイル、JSON 形状、フォーマット挙動に依存
- 新しい API サーフェスで無視/拒否されうる生成パラメータに依存
- モデル/ロールのプレフィルパターンに依存
- ワークロードが単純で、Gemini 3.5 Flash が既に安定稼働
- 思考トークン、キャッシュ入力、ツール出力、再試行まで含む総コストを比較していない
推奨移行戦略
全トラフィックを一度に切り替えないこと:
- 本番を代表する 100〜500 プロンプトでオフラインベンチマークを実施。
- 合格率、出力トークン、レイテンシ、ツール呼び出し、再試行率、人手レビュー率を比較。
- 対応 API サーフェスを厳密にテスト: Gemini ネイティブ、OpenAI 互換チャット、Interactions API、プロバイダ固有ルーティング。
- シャドートラフィックまたは本番 5% から開始。
- 成功タスクあたりコストが低いワークロードのみ段階的に拡大。
- 十分な本番データが揃うまで Gemini 3.5 Flash をフォールバックとして維持。
CometAPI ユーザーにとっては、1 つの API ゲートウェイの裏で複数モデルを評価できるため容易です。モデル ID でルーティングし、品質を比較し、フォールバック経路を維持しながら、各 pr のためにアプリケーションを書き換える必要がありません
Gemini 3.6 Flash vs 3.5 Flash vs 3.5 Flash Lite: 選び方
CometAPI は 1 つの API キーで 500+ モデルに統合アクセスを提供し、一般的なテキストワークフローに OpenAI 互換のベース URL を用意しています。実利は利便性だけでなく、ルーティング制御です。
Gemini 3.6 Flash は、単独ではなく実タスク構成でテストすべきです。本番スタックの一例:
- コーディング、マルチモーダル分析、複雑なエージェントには Gemini 3.6 Flash
- 低コスト抽出、ルーティング、サブエージェントタスクには Gemini 3.5 Flash-Lite
- 移行中の一時フォールバックとして Gemini 3.5 Flash
- エスカレーション時は Gemini 3.1 Pro Preview などのより深い推論モデル
- GPT、Claude、DeepSeek、Qwen、Kimi、GLM など Google 以外のモデルでタスク別比較
CometAPI の役割は、この比較とルーティング層の運用を容易にすることです。特定プロバイダのインターフェースにアプリケーションを固定する代わりに、単一ゲートウェイから制御された A/B テストとモデルフォールバックを運用できます。
実用評価チェックリスト
Gemini 3.5 Flash を 3.6 Flash に置き換える前に評価すべき項目:
| テスト領域 | 測定項目 |
|---|---|
| 出力品質 | 人手スコア、ルーブリックスコア、事実正確性、引用の品質 |
| コーディング | 合格率、コンパイル失敗、ユニットテスト合格率、不要な編集 |
| ツール使用 | ツールコール数、誤ツール率、繰り返しツールループ |
| トークン効率 | 入力トークン、可視出力トークン、思考/出力トークン |
| レイテンシ | 初期トークンまでの時間、総完了時間、ツールループ時間 |
| コスト | 公式コスト、CometAPI コスト、キャッシュ入力の節約、再試行コスト |
| マルチモーダル | チャート精度、PDF 抽出、スクリーンショット解釈 |
| JSON と構造 | スキーマ妥当性、欠落フィールド、余分なフィールド |
| 移行互換性 | 非対応パラメータ、モデル/ロールターン、API 固有の変更 |
| フォールバックの挙動 | Flash-Lite、3.5 Flash、Pro、他プロバイダを使う条件 |
将来の見通し
Google は 3.5 Pro をテスト中で、Gemini 4 の事前学習を進行中。エージェント効率への注力が継続見込み。公式チャネルおよび CometAPI を通じて早期アクセス情報を確認してください。
結論: ニーズに合ったモデルの選定
Gemini 3.6 Flash は、多くの知的で本番適性の高いアプリケーションのデフォルト選択肢としての地位を確立し、3.5 Flash-Lite は比類ないコストと速度で大規模 AI を実用化します。3.5 Flash から 3.6 への移行で、効率と品質の即時向上が期待できます。
今日から CometAPI を使って、Gemini 3.6 Flash や 3.5 Flash-Lite(および数百の他モデル)に単一で開発者フレンドリーな API からアクセスしましょう。統合の摩擦を減らし、コストを最適化し、スタックの将来性を確保します。Cometapi.com でサインアップしてキーを発行し、リスクなく試してみてください。