Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →

什麼是 Gemini 3.6 Flash?

CometAPI
AnnaJul 23, 2026
什麼是 Gemini 3.6 Flash?

TLDR: Gemini 3.6 Flash 是 Google 於 2026 年 7 月推出的生產級 Flash 模型,面向程式開發、知識工作、多模態分析與代理式工作流程。它保留了 Gemini 3.5 Flash 的 1,048,576-token 輸入視窗與 65,536-token 輸出上限,但據 Google 報告,在程式設計、電腦操作、知識工作與 Token 效率方面有更佳表現,且輸出 token 價格更低。

Gemini 3.6 Flash 應視為複雜程式開發、多模態推理與多步代理的首選 Flash 模型。僅在需要輸出延續性或尚未完成遷移測試時保留使用 Gemini 3.5 Flash。對於高吞吐的抽取、路由、分類等可預測任務,若極致成本優先,使用 Gemini 3.5 Flash-Lite。

關鍵要點

  • Gemini 3.6 Flash 以 gemini-3.6-flash 一般可用;Google 的 Gemini API 文件顯示其最新更新為 2026 年 7 月。
  • Gemini 3.6 Flash 針對程式設計、知識工作、多模態分析、電腦操作任務與多步代理式工作流程。
  • Google 報告 顯示,相較 Gemini 3.5 Flash,在 DeepSWE、MLE Bench、OSWorld-Verified 與 GDPval-AA v2 上表現更佳;在 Artificial Analysis Index 上輸出 token 減少 17%,在 DeepSWE 相關程式評測中輸出 token 最多可減少 65%。
  • 官方 Gemini API Standard 定價 為每百萬輸入 token $1.50、每百萬輸出 token $7.50;相較之下,Gemini 3.5 Flash 為 $1.50/$9.00。Gemini 3.6 Flash 的 Batch 與 Flex 定價為 $0.75/M 輸入、$3.75/M 輸出;Priority 為 $2.70/M 輸入、$13.50/M 輸出。CometAPI 的 Gemini 3.6 Flash 模型頁面標示 $1.20/M 輸入與 $6.00/M 輸出,較當時 Google 官方 Standard 付費層定價低 20%。
  • Gemini 3.6 Flash 可在許多新上線的生產工作負載中取代 Gemini 3.5 Flash,但遷移應包含提示、工具呼叫、參數、延遲、成本與回歸測試。
  • Gemini 3.5 Pro 並未包含於此次發佈;Google 表示仍在與合作夥伴測試,準備就緒後將廣泛發布。

Gemini 3.6 Flash 是什麼?

Gemini 3.6 Flash 是面向 AI 代理、程式工具、文件流程、檢索支撐型助理與多模態自動化的新預設 Flash 階級模型。Google 於 2026 年 7 月 21 日與 Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber 同步發布,並以生產代理經濟學為框架:更高的 Token 效率、更低延遲、更少工具循環與更低的每次成功任務成本。

最重要的變化不是名稱,而是品質與經濟性:Google 表示,Gemini 3.6 Flash 在 Artificial Analysis Index 上輸出 token 比 Gemini 3.5 Flash 減少 17%,在 DeepSWE 類程式工作中輸出 token 最多可減少 65%,同時將 Standard 輸出定價自 $9.00/M 降至 $7.50/M。

核心能力:

  • 多模態輸入:文字、影像、影片、音訊、PDF
  • 上下文視窗:100 萬輸入 token、64k 輸出 token
  • 工具使用:原生函式呼叫、將搜尋作為工具、電腦使用以進行代理式 UI 自動化
  • 最適用於:日常任務、代理式程式開發、高階推理、長上下文理解、生產就緒的程式碼生成

不同於追求最大智能的「Pro」模型,Flash 變體強調速度、規模與成本效益,同時在特定領域提供前沿級表現。Gemini 3.6 Flash 透過降低輸出冗長與提升精準度進一步改進。

知識截止:已更新至 2026 年 3 月(相較先前版本的 2025 年 1 月)。

模型卡 提到一個重要架構細節:Gemini 3.6 Flash 基於 Gemini 3.5 Flash。這使其更像針對生產的聚焦升級,而非全新家族。Google 似乎將重點放在開發者在真實代理工作流程中遇到的問題:輸出 token 過多、不必要的工具呼叫、在診斷任務中進行不需要的修改、程式碼修訂循環、圖表解讀、文件工作與類 UI 的多模態推理。

為何 Google 現在發布 Gemini 3.6 Flash?

發布背後的最新消息

Google 在 7 月 21 日的公告同時完成三件事:

  1. 推出更強大的工作主力模型 Gemini 3.6 Flash。
  2. 推出 Gemini 3.5 Flash-Lite,作為 3.5 級別中速度最快、成本最低、適合高吞吐工作流程的模型。
  3. 在 CodeMender 中推出 Gemini 3.5 Flash Cyber(限量存取)以用於資安防禦場景。

同一公告也釐清了 Gemini 3.5 Pro 的狀態:仍與合作夥伴測試中,準備就緒後將廣泛推出。Google 也表示 Gemini 4 的預訓練已開始。

這些脈絡很重要。Gemini 3.6 Flash 不是 Pro 的替代品。它對應的是另一個生產問題:當模型反覆呼叫工具、跨越長上下文進行推理、並多次重試時,許多 AI 系統變得過於昂貴、冗長且不可靠。若能透過更快、更高效的 Flash 模型減少完成常見任務所需的 token、輪次與重試次數,帶來的即時影響可能比延後的旗艦更大。

發布的重點是每個成功任務的成本

AI 團隊常以 token 價格比較模型,這雖有用,但不完整。代理式工作負載會引入額外成本變數:

  • 模型需要多少推理步驟?
  • 呼叫多少次工具?
  • 多常進行不必要的編輯?
  • 失敗並需要重試的頻率?
  • 輸出中有多少 token 用於解釋而非解決問題?
  • 流量需要多常升級到更昂貴的模型?

Gemini 3.6 Flash 的意義在於,Google 將其定位於這些運營變數,而不僅是標題級的基準分數。如果模型能將輸出 token 減少 17%、避免不必要的編輯循環、並在首次嘗試就產出更正確的程式碼,實際節省可能超出價格表所顯示。

基準表現與比較

Google 與第三方評估突顯了 3.6 Flash 的均衡改進。它未必在每個前沿排行榜名列前茅,但在實務應用下的效率調整表現上表現出色。

選定基準(Gemini 3.6 Flash vs. 3.5 Flash):

  • DeepSWE(Datacurve-多步軟體工程):49% vs. 37%(精準度顯著提升、較少循環/編輯);在部分案例中(如從 276k 降至 97k token)使用 token 最多減少 65%。
  • MLE-Bench(ML 研究):63.9% vs. 49.7%
  • OSWorld-Verified(電腦操作):83.0% vs. 78.4%(內建電腦操作現為標準)
  • GDPval-AA v2(知識工作):1421 vs. 1349
  • Artificial Analysis Intelligence Index:約 50(穩健,雖落後於部分領先者如部分 Claude 變體約 ~60);Token 效率突出。
  • 其他:在 Terminal-Bench、長上下文(如 GDM-MRCR v2)、SWE-Bench Pro,以及文件剖析與圖表分析等多模態任務上均有改進。

比較表:Gemini 3.6 Flash vs. 主要競品(約略,基於 2026 年 7 月資料)

功能/模型Gemini 3.6 FlashGemini 3.5 FlashGPT-5.6 Luna (est.)Grok 4.5Claude Sonnet 5
輸出 Token 效率卓越(提升 17%)良好強勁良好
程式設計(DeepSWE)49%37%67%54%54%
電腦操作(OSWorld)83%78.4%72.6%-81.2%
知識工作(Elo)14211349158415351607
輸出價格($/1M)$7.50$9.00$6.00$6.00$10-15
最適用於高效率代理一般代理高智能推理創意

其他說明:

  • SWE-Bench Pro:58.7%(對比 3.5 Flash 的 55.1%)。
  • Terminal-Bench 2.1:78.0%(對比 76.2%)。
  • 該模型在代理式與多模態情境中表現突出,同時維持 Flash 階級的速度。

獨立測試(如 Artificial Analysis、Reddit 討論)指出其速度與效率表現強勁,但在某些設定下相較某些極致優化對手可能消耗更多 token。真實世界回饋稱讚其在文件分析、報告撰寫與多模態任務上的表現(如客戶 Hebbia 與 Harvey)。

什麼是 Gemini 3.6 Flash?

相較於 Gemini 3.5 Flash 有哪些新變化?

1. 更好的 Token 效率

Gemini 3.6 Flash 被設計為使用比 Gemini 3.5 Flash 更少的輸出 token。Google 引述在 Artificial Analysis Index 上輸出 token 減少 17%,在部分 DeepSWE 程式工作負載中最多可減少 65%。

這很重要,因為輸出 token 通常比輸入 token 更昂貴。在官方 Gemini API Standard 定價中,Gemini 3.6 Flash 的輸入維持 $1.50/M,但輸出降為 $7.50/M;Gemini 3.5 Flash 輸出為 $9.00/M。當較低的輸出單價與更少的輸出 token 相結合,每個完成的代理任務成本可明顯下降。

2. 更強的程式能力與更少不必要的編輯

Google Cloud 的 Gemini Enterprise Agent Platform 文件 指出,Gemini 3.6 Flash 在建置、原型與 IDE 代理環境中的程式碼生成,編譯失敗與修訂率更低。它也降低了「動作偏置」,更能在唯讀診斷任務中避免未經請求的編輯。

  • 工作流程改進:更少推理步驟、對話輪次與工具呼叫,減少執行循環失控;在修改前更傾向先產出診斷腳本,提高準確性。
  • 程式碼生成:更高品質、可投產的程式碼,減少不必要的編輯與除錯循環。
  • 電腦操作:OSWorld-Verified 由 78.4% 提升至 83.0%;原生支援用戶端工具。

3. 品質改進與速度

代理式增強:更少推理步驟/工具呼叫;內建電腦使用;對多代理編排與迭代工作流程支援更強。

速度與可靠性:針對高量生產延遲做最佳化;可與 Google Slides 等工具整合,從文件/PDF 生成可編輯簡報。

安全性:增強的防護以防止 C

4. 更低的輸出價格

Google 將官方 Standard 輸出定價自 Gemini 3.5 Flash 的 $9.00/M 降至 Gemini 3.6 Flash 的 $7.50/M。輸入定價維持 $1.50/M。

即便不考慮 Token 效率提升,這也是直接的價格改善。

5. 遷移與參數變更

部分行為可能與較早的 Gemini 模型不同。Google Cloud 的 Agent Platform 頁面列出了可能的非相容變更:某些介面不支援自訂 temperature、top-K 與 top-P;frequency 與 presence penalty 的自訂值可能導致錯誤;在某些 API 中,以 model 角色結尾的請求不被支援。

遷移教訓很簡單:不要只更換模型字串。檢視你實際使用的 API 介面,移除不支援的生成參數,重新測試多輪狀態處理,並檢查工具呼叫行為。

Gemini 3.6 Flash 能取代 Gemini 3.5 Flash 嗎?

是的,對多數生產情境而言。Google 已實質將 3.6 Flash 定位為新的預設主力,3.5 Flash 在許多介面中可能轉為汰舊或相容用途。

切換理由:

  • 成本節省:由於定價 + 效率降低每次任務的費用。
  • 更好輸出:在程式、代理與知識任務上的品質指標提升。
  • 前瞻性:內建電腦使用與新整合能力。

何時維持 3.5 或考慮替代方案:

  • 對延遲極度敏感的高吞吐任務(可考慮成本/速度更優的 3.5 Flash-Lite)。
  • 需要最大原始智能(等待 3.5 Pro 或使用更大型模型)。
  • 特定相容性需求。

對多數在 Cometapi 上構建代理、應用或自動化的開發者,透過代理切換至 3.6 Flash 相對直接,建議儘速遷移以獲取投資報酬。

如何存取 Gemini 3.6 Flash

  1. Google AI Studio / Gemini API:在 aistudio.google.com 取得免費 API 金鑰。使用模型 gemini-3.6-flash。可搭配官方 SDK(Python、JS 等)快速上手。
  2. Vertex AI / Google Cloud:企業級選項,提供更高配額、檢索支撐與安全性。
  3. Gemini App 與整合:可在 Android Studio、GitHub Copilot(含切換)、Google Slides 等使用。
  4. 透過 Cometapi(推薦簡化上手):Cometapi 提供相容於 OpenAI 的統一代理,涵蓋 Gemini 3.6 Flash 與其他模型。優勢包括更高速率限制、簡化驗證、多供應商切換與更少管理負擔。適合在不受單一供應商限制下擴展應用。參閱 Cometapi.com 的設定指南與與 Google 分層相輔的定價。

範例 Python 呼叫(官方或透過代理):

import google.generativeai as genai
genai.configure(api_key="YOUR_KEY")
model = genai.GenerativeModel('gemini-3.6-flash')
response = model.generate_content("Your prompt here")

先在 AI Studio 測試,再整合進系統。快取與批次 API 可進一步最佳化成本。

結論與建議

Gemini 3.6 Flash 是一個務實且高價值的升級,針對真實世界需求精煉了 Google 的 Flash 系列。其智能、效率與可用性的組合,使其成為 2026 年 AI 開發的首選之一。

CometAPI 建議:透過 Cometapi 整合以獲得更流暢的體驗——統一 API、更佳配額、輕鬆在模型間進行 A/B 測試。無論你在打造代理、處理文件或驅動應用,立即開始嘗試 3.6 Flash,以降低成本並提升效能。

常見問題

什麼是 Gemini 3.6 Flash?

Gemini 3.6 Flash 是 Google 於 2026 年 7 月發布的穩定 Flash 模型,面向程式設計、知識工作、多模態推理與代理式工作流程。它基於 Gemini 3.5 Flash,但在 Token 效率、程式行為、電腦操作效能與知識工作基準上有所改進。

Gemini 3.6 Flash 的價格是多少?

Google 官方 Gemini API Standard 付費層為每百萬輸入 token $1.50、每百萬輸出 token $7.50。Batch 與 Flex 為 $0.75/M 輸入、$3.75/M 輸出;Priority 為 $2.70/M 輸入、$13.50/M 輸出。CometAPI 的模型頁顯示當時為 $1.20/M 輸入與 $6.00/M 輸出。

Gemini 3.6 Flash 是否比 Gemini 3.5 Flash 更便宜?

就輸出 token 而言是的。兩者在 Google 的 Standard 付費層輸入均為 $1.50/M,但 Gemini 3.6 Flash 的輸出為 $7.50/M,而 Gemini 3.5 Flash 為 $9.00/M。Google 並報告在許多任務上輸出 token 更少,進一步降低總成本。

Gemini 3.6 Flash 可以取代 Gemini 3.5 Flash 嗎?

對許多工作負載而言可以。它更適合作為程式代理、多模態分析與複雜工具工作流程的預設候選。不過,生產用戶在取代 3.5 Flash 前,應先進行基準測試,尤其在依賴穩定輸出風格、嚴格 JSON 格式或舊有生成參數時。

主要基準改進有哪些?

Google 報告 Gemini 3.6 Flash 在 DeepSWE(49% vs 37%)、MLE Bench(63.9% vs 49.7%)、OSWorld-Verified(83.0% vs 78.4%)與 GDPval-AA v2(1421 vs 1349)上表現優於 Gemini 3.5 Flash;並在 Artificial Analysis Index 上輸出 token 減少 17%。

如何透過 CometAPI 存取 Gemini 3.6 Flash?

建立 CometAPI 金鑰,使用 https://api.cometapi.com/v1 以相容 OpenAI 的方式呼叫,並在你的控制台中將模型設為 gemini-3.6-flash(若可用)。若需使用 Gemini 原生功能,請參考 CometAPI 的 Gemini 3.6 Flash 模型頁文件所述的供應商原生路徑。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多