Google 發表 Gemini 3.8 Flash,六週內第三次更新 Flash 模型。DeepSWE v1.1 從 65.3% 提高到 73.7%,補上 3.7 Flash 在長時間 coding 的落差;Standard API 年底前仍是每百萬輸入/輸出 token 0.75/3.75 美元,但複雜任務可能因更多 thinking 與工具呼叫而增加實際成本。本文整理規格、價格、跨模型評測、3.7 升級建議、API 遷移清單,並提供官方方法改寫的提示詞與 thinking 設定。
Gemini 3.8 Flash 發表|DeepSWE 73.7%,附官方建議與提示詞範本
Claude Fable 5.1 發表|Cache 降價 75%、Agent 更強,附官方建議提示詞
Anthropic 發表 Claude Fable 5.1,延續百萬 token context 與 $10/$50 單價,cache read 則降價 75%。新模型強化長時間 coding、研究與 Agent 工作,Claude Code 資安分類器誤判介入減少約 60%。本文整理 Fable 5.1 與 Fable 5、Opus 5 的價格、benchmark、方案可用性及 API breaking changes,並提供官方建議的局部編輯與進度回報提示詞,改善整檔重寫和長時間無更新的使用體驗。
OpenAI Jalapeño 實測|吞吐/瓦最高 1.9 倍,延遲最多低 3.6 倍
OpenAI 公布首款自研 LLM 推論晶片 Jalapeño 的第一批 InferenceX 實測:三個開放權重模型的峰值吞吐/瓦是比較系統的 1.5 至 1.9 倍,端到端延遲低 1.7 至 3.6 倍。本文整理它與 Broadcom、Celestica 的分工、prefill 與 decode 的設計背景、各模型測試條件、SemiAnalysis 揭露的限制、2026 年底部署時程,以及 ChatGPT、Codex、API 使用者現在能與不能期待的變化。
GPT-5.6 Sol 降價|Input 降 20%、Output 降 33%,優惠至少到 11 月
OpenAI 再度調降 GPT-5.6 API 價格,這次輪到旗艦階層 Sol:每百萬 input tokens 從 5 美元降為 4 美元,output 從 30 美元降為 20 美元,降幅分別是 20% 與 33%,促銷價至少維持到 2026 年 11 月 21 日。本文整理 Standard API 計費項目、長 context 加價、與 Terra/Luna 的最新價差,以及 API、Codex 和 ChatGPT 使用者各自會受到什麼影響。
Gemini 3.7 Flash 發表|三週再升級、DeepSWE 65.3%,Standard API 半價
Google 發布 Gemini 3.7 Flash,距離 3.6 Flash 只有三週,主打程式開發、網頁與多步驟 Agent。DeepSWE v1.1 從 49% 提高到 65.3%,但仍略低於 GPT-5.6 Luna。本文整理模型規格、Thinking Level、Standard API 半價,以及與 GPT-5.6 Terra/Luna、Claude Sonnet 5/Haiku 4.5 的能力比較。
Meta Muse Image 發布|生圖會搜尋與自我修正,Muse Video 預覽原生聲音
Meta 推出 Muse Image 圖片生成模型,能使用搜尋與程式工具、投入更多推論運算自我修正,並支援精準編輯、多張參考圖與圖片文字。本文整理 Muse Image 在 Meta AI、Instagram、WhatsApp 的使用方式、免費額度、Content Seal 隱形浮水印與 Instagram 照片爭議,也說明仍在預覽的 Muse Video 如何原生生成影片聲音,以及它與 Muse Spark、Muse Glimmer、Emu、Movie Gen 的差別。
Grok 4.6 發表|500K context、Agent 長任務,不到三年進入第四代
Grok 4.6 是 SpaceXAI 最新的程式開發與 Agent 模型,支援 500K context、圖片輸入與長時間工具操作。這篇整理 xAI 創立、Grok-0 到 Grok 4 的歷史,釐清砍掉重練與快速跳代的原因,也比較 Grok、ChatGPT、Claude 的產品差異,說明免費版、SuperGrok、Grok Build、API 價格、Private Chat、資料訓練設定與 benchmark 表現。
Claude 新增隱形浮水印|文章複製、抄寫後仍可被偵測
Anthropic 為配合 EU AI Act Article 50,開始替 Claude 新模型的輸出加入機器可讀標記。支援模型產生的所有文字都會帶有嵌入式隱形浮水印,複製貼上後仍可能保留;支援的 SVG、PNG、JPG 等檔案則加入 C2PA 簽章 metadata。這項變更不只限於歐盟,也涵蓋 Claude、Claude Code、API 與雲端平台。本文整理適用範圍、與 Google SynthID 的差異、偵測限制,以及 Claude Code 使用者需要注意的地方。
Gemini 3.6 Flash 發表|Google 開始預訓練 Gemini 4,3.5 Pro 還會發布嗎?
Google 發布 Gemini 3.6 Flash,主打更少輸出 Token、更短 Agent 任務時間與較低輸出價格;同時確認 Gemini 4 已開始預訓練。原訂 6 月登場的 Gemini 3.5 Pro 至今仍在合作夥伴測試。本文整理 3.6 Flash 規格、價格、效能與使用入口,並從官方時間線說明 3.5 Pro 是否取消、為何 3.6 先發布,以及 Gemini 4 預訓練代表什麼。
GPT-5.6 Luna 降價 80%|與 nano 同價,mini 失去價格優勢
OpenAI 在 2026 年 7 月 30 日調降 GPT-5.6 的 API 價格,Luna 降 80%、Terra 降 20%,Sol 維持原價。降完之後 Luna 的 input 單價與 GPT-5.4 nano 相同,output 還更低一點,能力卻是完全不同的等級。這篇整理降價幅度與生效範圍、OpenAI 給的降價理由與能不能當成長期價格、mini 與 nano 剩下的使用情境,以及 Codex 與 API 兩種使用方式各自該怎麼調整模型選擇。