Google 在 2026 年 7 月 21 日發布 Gemini 3.6 Flash,這是一款以 Gemini 3.5 Flash 為基礎改進的正式版模型。3.6 Flash 主要改善輸出 Token、工具呼叫次數與任務時間,同時把 API output 單價從每百萬 Token 9 美元降到 7.5 美元。
Google I/O 原訂 6 月推出的 Gemini 3.5 Pro,截至 8 月仍在合作夥伴測試;Google 同時確認 Gemini 4 已開始預訓練。這不等於 3.5 Pro 已被取消,不過它確實錯過原本公開的發布時間,而且 Google 沒有再給新的日期。
Gemini 3.6 Flash 是什麼
Gemini 3.6 Flash 是 Gemini 3 系列的多模態 reasoning 模型,定位是大量 Agent 任務使用的主力模型(workhorse)。模型接受文字、圖片、影片、音訊與 PDF,輸出為文字;input context 上限是 1,048,576 tokens,單次最多輸出 65,536 tokens。
Google DeepMind 的 model card 寫明它以 Gemini 3.5 Flash 為基礎,沒有另行公開架構與訓練資料細節,而是連回 3.5 Flash 的說明。因此,名稱中的 3.6 比較接近同一家族的效率與能力更新,不能解讀成 Google 已經把第四代模型提前拿出來。
| 項目 | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| 狀態 | GA | GA | GA |
| API model ID | gemini-3.6-flash | gemini-3.5-flash | gemini-3.5-flash-lite |
| Input context | 1M | 1M | 1M |
| Max output | 64K | 64K | 64K |
| Input/Output 單價 | $1.50/$7.50 | $1.50/$9.00 | $0.30/$2.50 |
| 預設 thinking level | medium | medium | minimal |
| 主要用途 | Agent、coding、多模態工作 | Agent、coding、多模態工作 | 大量抽取、分類與子 Agent |
Token 效率與任務時間
Google 引用 Artificial Analysis 的測量結果,表示 3.6 Flash 完成相同評測時,輸出 Token 比 3.5 Flash 少 17%。它也會減少多步驟工作中的 reasoning steps、對話輪次與 tool calls,降低 Agent 在同一個問題裡反覆執行的情況。
Artificial Analysis 的獨立整理提供了另一個角度:兩款模型在 Intelligence Index 都是 50 分,3.6 Flash 並沒有把綜合智力分數往上推;但是平均完成任務時間從 2.7 分鐘縮短到 1.3 分鐘,平均成本從 0.59 美元降到 0.50 美元。這些數字來自發布前測試,實際結果仍會隨 prompt、工具與 reasoning level 改變。
換句話說,3.6 Flash 的主要進步是更快把工作做完,不是每一種能力都跳到新的等級。即使兩者在 Artificial Analysis Intelligence Index 同分,Agent 每一步的輸出變短、工具呼叫次數變少,長流程累積的延遲與帳單仍可能明顯下降。
| 評測 | Gemini 3.6 Flash | Gemini 3.5 Flash | 差異 |
|---|---|---|---|
| DeepSWE v1.1 | 49% | 37% | 長時間程式開發提升 |
| MLE-Bench | 63.9% | 49.7% | 機器學習工程提升 |
| OSWorld-Verified | 83.0% | 78.4% | Computer Use 提升 |
| GDPval-AA v2 | 1421 | 1349 | 知識工作提升 |
| AA Intelligence Index | 50 | 50 | 綜合分數持平 |
前四項是 Google 公開的模型評測,最後一項來自 Artificial Analysis。不同評測的執行框架、工具與 reasoning 設定並不一致,適合用來判斷改善方向,不宜合併成固定的跨模型排名。
API 價格與相容性變更
Gemini 3.6 Flash 的 Standard API 每百萬 input tokens 為 1.5 美元,與 3.5 Flash 相同;output 從 9 美元降到 7.5 美元,降幅約 16.7%。Batch 與 Flex inference 都是 0.75/3.75 美元,適合不要求立即回應的批次工作。
Google AI Studio 與 Gemini API 提供免費額度,不過免費層的內容可能用於改善 Google 產品;付費層則標示不會拿來做這項用途。費用與資料處理方式並不相同,正式服務不能只看每百萬 Token 的單價。
既有程式切換模型時,把 model ID 改成 gemini-3.6-flash 只是其中一步。Google 的 migration guide 還列出以下相容性調整:
- 移除
temperature、top_p與top_k等已棄用 sampling 參數。 - 以
thinking_level取代thinking_budget,3.6 Flash 預設是medium。 - 多輪對話使用 server-side
previous_interaction_id,不能預先填入 model turn。 - 檢查 function calling 的
call_id、工具名稱與多模態 payload 格式。
Google 的 migration guide 指出,在其人工評估中,3.6 Flash 的功能程式碼較好,但舊模型的 UI layout 與 styling 更受偏好。前端工作可以在 prompt 裡提供 design system、間距、色彩與 responsive 規則,不要只要求「做得好看」。
Gemini 3.5 Pro 還會發布嗎
截至本文更新時,答案是官方仍打算發布,但已經延期,而且沒有新的公開日期。
Google 在 5 月 19 日的 I/O 公告寫著 Gemini 3.5 Pro 正在測試,預計「下個月」推出,也就是 2026 年 6 月。到了 7 月 21 日發布 3.6 Flash 時,措辭改成正在與合作夥伴測試,準備完成後會廣泛開放;文章結尾仍寫著期待很快發布 3.5 Pro。Google DeepMind 現行的 Gemini 產品頁也保留「3.5 Pro coming soon」。
能確認的是它錯過原訂時程,不能確認的是延期原因。Google 沒有公開說明訓練是否重做、安全評估是否卡關、算力是否轉移,或最終規格是否改變。這些可能性都不能從「仍在測試」推回去當成已發生的事。
Google 同時發布 3.6 Flash,也不代表 Flash 已取代 Pro。兩條產品線解決的問題不同:Flash 重視速度、成本與大量 Agent 執行,Pro 則預期負責更複雜的推理與高難度工作。在 Google 公布的部分 coding 與 Agent 評測中,3.6 Flash 已高於 3.1 Pro,因此部分工作不必等待 3.5 Pro 才能測試新版模型。
Gemini 4 已開始預訓練代表什麼
Alphabet CEO Sundar Pichai 在 7 月 22 日的財報電話會議確認,Google 已開始 Gemini 4 的 pre-training,並稱它是公司至今最具企圖的預訓練工作。這是 foundation model 建立基礎能力的階段,後面通常還有 post-training、安全測試、產品整合與部署。
預訓練是什麼
預訓練是大型語言模型最早、也很耗算力的訓練階段。模型會讀取大量文字、程式碼、圖片等資料,反覆練習預測下一個 Token,從中建立語言、知識、推理與多模態理解的基礎能力。這時得到的是 foundation model,還不是一般使用者在 Gemini app 裡接觸到的完整聊天產品。
- 預訓練:從大量資料建立模型的基礎能力。
- Post-training:使用指令資料、人工回饋與強化學習,改善回答、工具使用與安全行為。
- 安全評估與產品測試:檢查危險能力、可靠性、速度與執行成本。
- 部署發布:把通過測試的模型接入 Gemini app、API 與企業產品。
因此「開始預訓練」不等於模型已經完成,也不表示幾週內就會上市。Google 尚未公布 Gemini 4 的參數量、架構、context、benchmark、價格或發布時間,甚至沒有確認第一個公開版本會叫 Pro 還是 Flash。
大型模型研發可能交錯進行。目前公開資訊只能確認 3.5 Pro 的 partner testing 與 Gemini 4 的預訓練同時進行,Google 沒有說明兩者是否共用團隊或算力。因此,公開日期不能直接當成模型開始訓練的日期。

目前能確認的是 3.5 Pro 錯過原訂時程但仍在測試,Gemini 4 已開始預訓練;這些資訊不足以判定 3.5 Pro 已取消或被取代。
同期公布的 Flash-Lite 與 Flash Cyber
Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite 是同一天 GA 的低價模型,主打大量搜尋、文件處理、翻譯、分類與子 Agent。Standard API 是每百萬 Token 0.3/2.5 美元,Artificial Analysis 在發布前測得約每秒 350 個 output tokens。它的綜合 Intelligence Index 從 3.1 Flash-Lite 的 25 提高到 36,不過平均單次任務成本也從 0.04 美元增至 0.09 美元,不能只看「Lite」就假設新版本一定更便宜。
Gemini 3.5 Flash Cyber
Flash Cyber 是以 3.5 Flash 微調的資安模型,搭配 CodeMender 讓多個 Agent 尋找、驗證與修補漏洞,再整合成一份報告。因為能力同時能用於防禦與攻擊,Google 目前只規劃向政府與可信任合作夥伴提供 limited-access pilot,不是一般開發者能從 Gemini API 直接選用的公開模型。
Gemini 3.6 Flash 從哪裡使用
一般使用者可以直接從 Gemini app 使用 3.6 Flash,不需要處理 API 參數。開發者則能在 Google AI Studio、Gemini API 與 Android Studio 指定模型;程式開發與 Agent 工作也能從 Google Antigravity 使用。企業入口包含 Gemini Enterprise app 與 Gemini Enterprise Agent Platform。
| 入口 | 適合用途 | 計費方式 |
|---|---|---|
| Gemini app | 一般問答、文件、圖片與日常工作 | 依 Gemini 帳號方案與用量限制 |
| Google AI Studio | 測試 prompt、建立 API prototype | 提供免費額度,也能升級付費層 |
| Gemini API | 自建 Agent、後端與批次流程 | 依 Token 與推論層級計費 |
| Google Antigravity | 讀取 codebase、程式修改與長時間 Agent | 依產品方案與額度 |
| Gemini Enterprise | 企業 Agent、治理與正式部署 | 依企業合約 |
如果是第一次接觸 AI Studio,可以參考 Google AI Studio 免費模型教學 了解 API key 與免費額度的基本操作。文章示範的是 Gemma 4,但 AI Studio 的專案與金鑰概念相同,實際呼叫時要改用 gemini-3.6-flash。
常見問答
Google 已經取消 Gemini 3.5 Pro 嗎
沒有取消公告。Google 仍表示 Gemini 3.5 Pro 正在與合作夥伴測試,準備完成後會廣泛推出,官方模型頁也保留 coming soon 標示。不過它已錯過原訂 2026 年 6 月的發布時間,目前沒有新的日期。
為什麼 3.6 Flash 比 3.5 Pro 更早發布
3.6 Flash 是建立在 3.5 Flash 上的同產品線更新,不必等待 3.5 Pro 完成。官方確認 3.5 Pro 測試與 Gemini 4 預訓練正在平行進行,版本小數也不是整個 Gemini 家族共用的發布順序。
Gemini 3.6 Flash 可以免費使用嗎
可以。Gemini app 已提供 3.6 Flash,Google AI Studio 與 Gemini API 也有免費額度。免費 API 層的內容可能用於改善 Google 產品,付費層則標示不會用於這項用途;兩者的 rate limit 也不同。
Gemini 3.6 Flash 能生成圖片嗎
模型可以讀取圖片、影片與 PDF,但 API 規格的輸出只有文字,不是 Nano Banana 這類圖片生成模型。Gemini app 內看到的圖片功能可能由其他 Gemini 影像模型處理,不能只看聊天介面就認定 3.6 Flash 直接輸出圖片。
Gemini 4 什麼時候發布
Google 只確認已開始預訓練,沒有公布日期。預訓練完成後仍可能經過 post-training、安全評估、合作夥伴測試與產品部署,因此目前無法從這則消息推算上市月份。
參考來源
- Google:Gemini 3.6 Flash、3.5 Flash-Lite 與 3.5 Flash Cyber 公告
- Google I/O 2026 公告整理
- Alphabet Q2 2026 財報電話會議談話
- Google DeepMind:Gemini 3.6 Flash model card
- Google DeepMind:Gemini 模型頁
- Gemini API 最新模型與 migration guide
- Gemini Developer API 價格
- Artificial Analysis:Gemini 3.6 Flash 與 3.5 Flash-Lite 測試
- Ars Technica:Gemini 3.6 Flash 與延後的 3.5 Pro