Google 在 2026 年 7 月 21 日發布 Gemini 3.6 Flash,這是一款以 Gemini 3.5 Flash 為基礎改進的正式版模型。3.6 Flash 主要改善輸出 Token、工具呼叫次數與任務時間,同時把 API output 單價從每百萬 Token 9 美元降到 7.5 美元。

Google I/O 原訂 6 月推出的 Gemini 3.5 Pro,截至 8 月仍在合作夥伴測試;Google 同時確認 Gemini 4 已開始預訓練。這不等於 3.5 Pro 已被取消,不過它確實錯過原本公開的發布時間,而且 Google 沒有再給新的日期。

Gemini 3.6 Flash 是什麼

Gemini 3.6 Flash 是 Gemini 3 系列的多模態 reasoning 模型,定位是大量 Agent 任務使用的主力模型(workhorse)。模型接受文字、圖片、影片、音訊與 PDF,輸出為文字;input context 上限是 1,048,576 tokens,單次最多輸出 65,536 tokens。

Google DeepMind 的 model card 寫明它以 Gemini 3.5 Flash 為基礎,沒有另行公開架構與訓練資料細節,而是連回 3.5 Flash 的說明。因此,名稱中的 3.6 比較接近同一家族的效率與能力更新,不能解讀成 Google 已經把第四代模型提前拿出來。

項目Gemini 3.6 FlashGemini 3.5 FlashGemini 3.5 Flash-Lite
狀態GAGAGA
API model IDgemini-3.6-flashgemini-3.5-flashgemini-3.5-flash-lite
Input context1M1M1M
Max output64K64K64K
Input/Output 單價$1.50/$7.50$1.50/$9.00$0.30/$2.50
預設 thinking levelmediummediumminimal
主要用途Agent、coding、多模態工作Agent、coding、多模態工作大量抽取、分類與子 Agent
3.6 Flash 降低輸出價格;Flash-Lite 則是高流量工作的低價版本。


Sponsored Links

Token 效率與任務時間

Google 引用 Artificial Analysis 的測量結果,表示 3.6 Flash 完成相同評測時,輸出 Token 比 3.5 Flash 少 17%。它也會減少多步驟工作中的 reasoning steps、對話輪次與 tool calls,降低 Agent 在同一個問題裡反覆執行的情況。

Artificial Analysis 的獨立整理提供了另一個角度:兩款模型在 Intelligence Index 都是 50 分,3.6 Flash 並沒有把綜合智力分數往上推;但是平均完成任務時間從 2.7 分鐘縮短到 1.3 分鐘,平均成本從 0.59 美元降到 0.50 美元。這些數字來自發布前測試,實際結果仍會隨 prompt、工具與 reasoning level 改變。

換句話說,3.6 Flash 的主要進步是更快把工作做完,不是每一種能力都跳到新的等級。即使兩者在 Artificial Analysis Intelligence Index 同分,Agent 每一步的輸出變短、工具呼叫次數變少,長流程累積的延遲與帳單仍可能明顯下降。

評測Gemini 3.6 FlashGemini 3.5 Flash差異
DeepSWE v1.149%37%長時間程式開發提升
MLE-Bench63.9%49.7%機器學習工程提升
OSWorld-Verified83.0%78.4%Computer Use 提升
GDPval-AA v214211349知識工作提升
AA Intelligence Index5050綜合分數持平
在這組評測中,3.6 Flash 的提升集中在 Agent 與工作型任務,綜合指數則同分。

前四項是 Google 公開的模型評測,最後一項來自 Artificial Analysis。不同評測的執行框架、工具與 reasoning 設定並不一致,適合用來判斷改善方向,不宜合併成固定的跨模型排名。

API 價格與相容性變更

Gemini 3.6 Flash 的 Standard API 每百萬 input tokens 為 1.5 美元,與 3.5 Flash 相同;output 從 9 美元降到 7.5 美元,降幅約 16.7%。Batch 與 Flex inference 都是 0.75/3.75 美元,適合不要求立即回應的批次工作。

Google AI Studio 與 Gemini API 提供免費額度,不過免費層的內容可能用於改善 Google 產品;付費層則標示不會拿來做這項用途。費用與資料處理方式並不相同,正式服務不能只看每百萬 Token 的單價。

既有程式切換模型時,把 model ID 改成 gemini-3.6-flash 只是其中一步。Google 的 migration guide 還列出以下相容性調整:

  • 移除 temperaturetop_ptop_k 等已棄用 sampling 參數。
  • thinking_level 取代 thinking_budget,3.6 Flash 預設是 medium
  • 多輪對話使用 server-side previous_interaction_id,不能預先填入 model turn。
  • 檢查 function calling 的 call_id、工具名稱與多模態 payload 格式。

Google 的 migration guide 指出,在其人工評估中,3.6 Flash 的功能程式碼較好,但舊模型的 UI layout 與 styling 更受偏好。前端工作可以在 prompt 裡提供 design system、間距、色彩與 responsive 規則,不要只要求「做得好看」。

Gemini 3.5 Pro 還會發布嗎

截至本文更新時,答案是官方仍打算發布,但已經延期,而且沒有新的公開日期

Google 在 5 月 19 日的 I/O 公告寫著 Gemini 3.5 Pro 正在測試,預計「下個月」推出,也就是 2026 年 6 月。到了 7 月 21 日發布 3.6 Flash 時,措辭改成正在與合作夥伴測試,準備完成後會廣泛開放;文章結尾仍寫著期待很快發布 3.5 Pro。Google DeepMind 現行的 Gemini 產品頁也保留「3.5 Pro coming soon」。

能確認的是它錯過原訂時程,不能確認的是延期原因。Google 沒有公開說明訓練是否重做、安全評估是否卡關、算力是否轉移,或最終規格是否改變。這些可能性都不能從「仍在測試」推回去當成已發生的事。

Google 同時發布 3.6 Flash,也不代表 Flash 已取代 Pro。兩條產品線解決的問題不同:Flash 重視速度、成本與大量 Agent 執行,Pro 則預期負責更複雜的推理與高難度工作。在 Google 公布的部分 coding 與 Agent 評測中,3.6 Flash 已高於 3.1 Pro,因此部分工作不必等待 3.5 Pro 才能測試新版模型。

Gemini 4 已開始預訓練代表什麼

Alphabet CEO Sundar Pichai 在 7 月 22 日的財報電話會議確認,Google 已開始 Gemini 4 的 pre-training,並稱它是公司至今最具企圖的預訓練工作。這是 foundation model 建立基礎能力的階段,後面通常還有 post-training、安全測試、產品整合與部署。

預訓練是什麼

預訓練是大型語言模型最早、也很耗算力的訓練階段。模型會讀取大量文字、程式碼、圖片等資料,反覆練習預測下一個 Token,從中建立語言、知識、推理與多模態理解的基礎能力。這時得到的是 foundation model,還不是一般使用者在 Gemini app 裡接觸到的完整聊天產品。

  1. 預訓練:從大量資料建立模型的基礎能力。
  2. Post-training:使用指令資料、人工回饋與強化學習,改善回答、工具使用與安全行為。
  3. 安全評估與產品測試:檢查危險能力、可靠性、速度與執行成本。
  4. 部署發布:把通過測試的模型接入 Gemini app、API 與企業產品。

因此「開始預訓練」不等於模型已經完成,也不表示幾週內就會上市。Google 尚未公布 Gemini 4 的參數量、架構、context、benchmark、價格或發布時間,甚至沒有確認第一個公開版本會叫 Pro 還是 Flash。

大型模型研發可能交錯進行。目前公開資訊只能確認 3.5 Pro 的 partner testing 與 Gemini 4 的預訓練同時進行,Google 沒有說明兩者是否共用團隊或算力。因此,公開日期不能直接當成模型開始訓練的日期。

Gemini 3.5 Flash、3.5 Pro、3.6 Flash 與 Gemini 4 在 2026 年的發布、合作夥伴測試及預訓練交錯時間線
3.5 Pro 測試與 Gemini 4 預訓練同時進行,不能據此判定前者已取消。

目前能確認的是 3.5 Pro 錯過原訂時程但仍在測試,Gemini 4 已開始預訓練;這些資訊不足以判定 3.5 Pro 已取消或被取代。

同期公布的 Flash-Lite 與 Flash Cyber

Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 是同一天 GA 的低價模型,主打大量搜尋、文件處理、翻譯、分類與子 Agent。Standard API 是每百萬 Token 0.3/2.5 美元,Artificial Analysis 在發布前測得約每秒 350 個 output tokens。它的綜合 Intelligence Index 從 3.1 Flash-Lite 的 25 提高到 36,不過平均單次任務成本也從 0.04 美元增至 0.09 美元,不能只看「Lite」就假設新版本一定更便宜。

Gemini 3.5 Flash Cyber

Flash Cyber 是以 3.5 Flash 微調的資安模型,搭配 CodeMender 讓多個 Agent 尋找、驗證與修補漏洞,再整合成一份報告。因為能力同時能用於防禦與攻擊,Google 目前只規劃向政府與可信任合作夥伴提供 limited-access pilot,不是一般開發者能從 Gemini API 直接選用的公開模型。

Gemini 3.6 Flash 從哪裡使用

一般使用者可以直接從 Gemini app 使用 3.6 Flash,不需要處理 API 參數。開發者則能在 Google AI Studio、Gemini API 與 Android Studio 指定模型;程式開發與 Agent 工作也能從 Google Antigravity 使用。企業入口包含 Gemini Enterprise app 與 Gemini Enterprise Agent Platform。

入口適合用途計費方式
Gemini app一般問答、文件、圖片與日常工作依 Gemini 帳號方案與用量限制
Google AI Studio測試 prompt、建立 API prototype提供免費額度,也能升級付費層
Gemini API自建 Agent、後端與批次流程依 Token 與推論層級計費
Google Antigravity讀取 codebase、程式修改與長時間 Agent依產品方案與額度
Gemini Enterprise企業 Agent、治理與正式部署依企業合約
Gemini app 使用者不必處理 model ID 與 Token 定價;API 開發者需要。

如果是第一次接觸 AI Studio,可以參考 Google AI Studio 免費模型教學 了解 API key 與免費額度的基本操作。文章示範的是 Gemma 4,但 AI Studio 的專案與金鑰概念相同,實際呼叫時要改用 gemini-3.6-flash

常見問答

Google 已經取消 Gemini 3.5 Pro 嗎

沒有取消公告。Google 仍表示 Gemini 3.5 Pro 正在與合作夥伴測試,準備完成後會廣泛推出,官方模型頁也保留 coming soon 標示。不過它已錯過原訂 2026 年 6 月的發布時間,目前沒有新的日期。

為什麼 3.6 Flash 比 3.5 Pro 更早發布

3.6 Flash 是建立在 3.5 Flash 上的同產品線更新,不必等待 3.5 Pro 完成。官方確認 3.5 Pro 測試與 Gemini 4 預訓練正在平行進行,版本小數也不是整個 Gemini 家族共用的發布順序。

Gemini 3.6 Flash 可以免費使用嗎

可以。Gemini app 已提供 3.6 Flash,Google AI Studio 與 Gemini API 也有免費額度。免費 API 層的內容可能用於改善 Google 產品,付費層則標示不會用於這項用途;兩者的 rate limit 也不同。

Gemini 3.6 Flash 能生成圖片嗎

模型可以讀取圖片、影片與 PDF,但 API 規格的輸出只有文字,不是 Nano Banana 這類圖片生成模型。Gemini app 內看到的圖片功能可能由其他 Gemini 影像模型處理,不能只看聊天介面就認定 3.6 Flash 直接輸出圖片。

Gemini 4 什麼時候發布

Google 只確認已開始預訓練,沒有公布日期。預訓練完成後仍可能經過 post-training、安全評估、合作夥伴測試與產品部署,因此目前無法從這則消息推算上市月份。

參考來源


Sponsored Links