Gemini 3.6 Flash 的技術規格
| 項目 | Gemini 3.6 Flash |
|---|---|
| 提供方 | Google DeepMind |
| 模型 ID | gemini-3.6-flash |
| 模型家族 | Gemini 3.x |
| 可用性 | 全面可用(GA) |
| 輸入類型 | Text, Image, Video, Audio, PDF |
| 輸出類型 | Text |
| 上下文視窗 | 1,048,576 tokens |
| 最大輸出 | 65,536 tokens |
| 思考 | 支援(medium / high) |
| Function calling | Yes |
| Code execution | Yes |
| File Search | Yes |
| URL Context | Yes |
| Search Grounding | Yes |
| Computer Use | Preview |
| Structured Output | Yes |
| Caching | Supported |
來源:Google Gemini API 文件。
什麼是 Gemini 3.6 Flash?
Gemini 3.6 Flash 是 Google 最新、可投入生產環境的 Flash 模型,旨在在維持 Flash 系列所知名的低延遲與成本效率的同時,提供前沿級智慧表現。它針對程式設計、多模態理解、推理與代理式工作流程進行了最佳化。
與 Gemini 3.5 Flash 相比,該模型在程式碼生成品質、推理準確度、工具使用與 Token 效率方面都有提升,並支援龐大的 1 million-token 上下文視窗。Google 將其定位為開發者建立 AI 代理與複雜自動化系統的預設主力模型。
Gemini 3.6 Flash 的主要特性
- 支援 1M-token 長上下文處理。
- 原生支援多模態輸入,包括文字、圖片、影片、音訊與 PDF 文件。
- 在程式碼生成與軟體工程任務上有顯著提升。
- 內建支援 Function Calling、File Search、URL Context、Search Grounding 與 Computer Use。
- 比 Gemini 3.5 Flash 更具 Token 效率,在維持更高品質的同時降低推理成本。
- 為多步驟 AI 代理與自動化工作流程而設計。
基準測試表現
Google 報告指出,Gemini 3.6 Flash 在程式設計、推理與多模態表現上優於 Gemini 3.5 Flash,同時使用顯著更少的輸出 Token。官方強調其在內部的程式設計與代理相關基準上表現更佳,並表示在某些軟體工程評測(如 DeepSWE)上可將輸出 Token 使用量最多降低至 65%,從而降低整體推理成本。Google 尚未釋出本次版本的完整公開基準表(例如 MMLU、GPQA、SWE-bench Verified)。

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| 面向 | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| 發布 | 2026 年 7 月 21 日(GA) | 2026 年較早時期 | 約 2026 年 2 月(預覽) |
| 定位 | 高效率的代理、程式、與多模態主力 | 先前的代理向 Flash 模型 | 進階 Pro 等級的深度推理 |
| 價格(每 1M tokens) | 輸入:$1.50輸出:$7.50 | 輸入:$1.50輸出:$9.00 | 更高(例如:約 $2 輸入 / $12 輸出) |
| Token 效率 | 較 3.5 Flash 輸出 Token 減少 17%;步驟/工具呼叫更少 | 基準 | 在代理式工作流程上效率較低 |
| 速度 | 高(Flash 系列) | 高 | 較 Flash 模型慢 |
| 上下文視窗 | 1M tokens | 1M tokens | 可能類似 |
| 強項 | 程式設計、知識型工作、多模態(圖表/文件)、Computer Use、代理式效率 | 代理/程式設計平衡良好 | 在複雜問題上具有更深的推理能力 |
快速摘要
- 3.6 Flash → 目前多數使用者的最佳整體選擇:比 3.5 Flash 更快、每個任務更便宜、更高效,並在許多實務/代理相關基準上勝過 3.1 Pro。
- 3.5 Flash → 穩健的前代;仍具能力但正逐步被 3.6 Flash 取代(輸出 Token 成本更高、效率較低)。
- 3.1 Pro → 在部分深度推理情境更強,但更慢、更昂貴,且在速度、效率與多數真實世界/代理任務上普遍落後於新版 Flash 模型。
侷限
- 不直接支援圖片生成。
- 不支援音訊生成。
- Computer Use 仍處於 Preview 階段。
- 部分舊版生成參數(
temperature、top_p、top_k)已自新 API 介面中移除。 - 透過最新的 Gemini Interactions API 可獲得最佳效能。
如何存取 Gemini 3.6 Flash API
步驟 1:取得 API 存取權限
登入 cometAPI。若您尚非使用者,請先註冊。登入您的 CometAPI console。取得介面的存取憑證 API key。在個人中心的 API token 中點選「Add Token」,取得 token key:sk-xxxxx 並提交。

步驟 2:向 Gemini 3.6 Flash API 發送請求
選取 “ gemini-3.6-flash" "gemini-3.6-flash-thinking” 端點以發送 API 請求並設定請求本文。請求方法與請求本文可於我們的網站 API 文件取得。我們的網站也提供 Apifox 測試以便您使用。將 <YOUR_API_KEY> 替換為您帳戶中的實際 CometAPI key。base url 為 Gemini Generating Content
將您的問題或請求插入 content 欄位——模型將回應此內容。處理 API 回應以取得生成的答案。
步驟 3:處理回應
API 會回傳結構化的候選回應,包括生成文字、引用來源、安全性中繼資料,以及可選的工具輸出。