Gemini 3.6 Flash 的技術規格
| 項目 | Gemini 3.6 Flash |
|---|---|
| 提供者 | Google DeepMind |
| 模型 ID | gemini-3.6-flash |
| 模型家族 | Gemini 3.x |
| 可用性 | 正式可用(GA) |
| 輸入類型 | Text, Image, Video, Audio, PDF |
| 輸出類型 | Text |
| 上下文視窗 | 1,048,576 tokens |
| 最大輸出 | 65,536 tokens |
| 思考 | 支援(中/高) |
| Function calling | Yes |
| Code execution | Yes |
| File Search | Yes |
| URL Context | Yes |
| Search Grounding | Yes |
| Computer Use | Preview |
| Structured Output | Yes |
| Caching | Supported |
來源:Google Gemini API documentation.
什麼是 Gemini 3.6 Flash?
Gemini 3.6 Flash 是 Google 最新的生產可用 Flash 模型,在保持 Flash 系列低延遲與高性價比的同時,提供前沿等級的智慧能力。它針對程式設計、多模態理解、推理與代理式工作流程進行了最佳化。
相較於 Gemini 3.5 Flash,此模型在程式碼生成品質、推理準確度、工具使用與 Token 效率方面都有提升,並支援高達 100 萬 Token 的上下文視窗。Google 將其定位為開發者打造 AI 代理與複雜自動化系統的預設主力模型。
Gemini 3.6 Flash 的主要特性
- 支援 1M-token 的長上下文處理。
- 原生支援多模態輸入:文字、影像、影片、音訊與 PDF 文件。
- 在程式碼生成與軟體工程任務上有顯著提升。
- 內建支援 Function Calling、File Search、URL Context、Search Grounding 與 Computer Use。
- 相比 Gemini 3.5 Flash 更具 Token 效率,在保持更高品質的同時降低推理成本。
- 為多步驟 AI 代理與自主工作流程而設計。
基準表現
Google 表示,Gemini 3.6 Flash 在程式設計、推理與多模態能力上較 Gemini 3.5 Flash 更強,同時顯著減少輸出 Token 使用量。官方著重強調其在內部的程式與代理式基準上有更佳表現,並稱該模型在某些軟體工程評估(如 DeepSWE)中可將輸出 Token 使用量最多降低 65%,從而減少整體推理成本。對於本次版本,Google 尚未公布完整的公共基準表(例如 MMLU、GPQA、SWE-bench Verified)。

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| 面向 | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| 發佈 | July 21, 2026 (GA) | Earlier 2026 | ~Feb 2026 (Preview) |
| 定位 | 面向代理、程式、多模態的高效主力 | 先前的代理式 Flash 模型 | 更高階 Pro 等級的推理 |
| 定價(每 1M tokens) | 輸入:$1.50輸出:$7.50 | 輸入:$1.50輸出:$9.00 | 更高(例如,~$2 輸入 / $12 輸出) |
| Token 效率 | 相較 3.5 Flash 輸出 Token 減少 17%;步驟/工具呼叫更少 | 基準 | 在代理式工作流程中效率較低 |
| 速度 | 高(Flash 系列) | 高 | 較 Flash 模型更慢 |
| 上下文視窗 | 1M tokens | 1M tokens | 可能相近 |
| 優勢 | 程式設計、知識型工作、多模態(圖表/文件)、Computer Use、代理式效率 | 良好的代理/程式平衡 | 對複雜問題的更深層推理 |
快速總結
- 3.6 Flash → 目前大多數使用者的最佳整體選擇:更快、每個任務成本更低、比 3.5 Flash 更高效,並在許多實務/代理式基準上優於 3.1 Pro。
- 3.5 Flash → 穩健的前代產品;仍具能力但正被 3.6 Flash 取代(輸出 Token 成本更高、效率較低)。
- 3.1 Pro → 在某些深度推理場景更強,但更慢、更昂貴,且在速度、效率與多數真實世界/代理式任務中普遍落後於新一代 Flash 模型。
限制
- 不直接支援影像生成。
- 不支援音訊生成。
- Computer Use 仍為預覽。
- 部分舊版生成參數(
temperature、top_p、top_k)已從新的 API 介面移除。 - 最佳效能可透過最新的 Gemini Interactions API 達成。
如何存取 Gemini 3.6 Flash API
步驟 1:取得 API 存取權限
登入 cometAPI。若您尚未成為我們的使用者,請先註冊。登入您的 CometAPI console。取得介面的存取憑證 API key。在個人中心的 API token 點擊「Add Token」,取得 token key:sk-xxxxx 並提交。

步驟 2:向 Gemini 3.6 Flash API 發送請求
選擇 “ gemini-3.6-flash" "gemini-3.6-flash-thinking” 端點發送 API 請求,並設定請求主體。請求方法與請求主體可從我們網站的 API 文件獲得。我們的網站也提供 Apifox 測試以方便使用。將 <YOUR_API_KEY> 替換為您帳號中的實際 CometAPI 金鑰。基底 URL 為 Gemini Generating Content
將您的問題或需求填入 content 欄位——模型將對此做出回應。處理 API 回應以取得生成的答案。
步驟 3:處理回應
API 會回傳具結構的候選回應,包含生成文字、引用、安全性中繼資料,以及可選的工具輸出。