OpenAI 在 2026 年 9 月 22 日推出 GPT-6 Sol 與 Luna,分別面向複雜程式開發與 Agent 工作,以及聚焦、高流量任務。兩款模型已列入 OpenAI API,並向 Codex、ChatGPT Work 分批開放,一般 Chat 對話尚未提供。本文對照 GPT-5.6 現價,整理 Sol 每百萬輸入/輸出 tokens 為 US$2/US$10、Luna 為 US$0.10/US$0.50,並說明 Codex credits、長輸入加價和使用限制。
GPT-6 Sol、Luna 9 月 22 日推出|API 價格與 Codex 使用方式
Claude Opus 5.5 發表|API 降價 20%、輸出快逾 30%
Anthropic 發表 Claude Opus 5.5,API 單價降至每百萬 input 4 美元、output 20 美元,標準輸出速度比 Opus 5 快逾 30%,典型工作總成本低約 40%,多項官方評測超過 Fable 5.1。本文整理手機版、Claude Code 與 API 使用方式、訂閱方案用量、1M context、Fast Mode、Medium effort、固定 thinking、API breaking changes 與自動換模型機制。
Jev 是什麼?TypeSafe System One 決策模型|功能、價格、用法與限制
Jev 是 TypeSafe AI 的 System One 雲端決策模型,能把文字或 JSON 狀態轉成 Choice、Score、Noul 等結構化答案。本文說明 TypeSafe、Vercel、Cloudflare、Netlify 與 OpenRouter 的使用方式,並以 Agent 路由、瀏覽器操作、郵件分類與 RAG 實例整理價格、限制、繁體中文和本機部署問題,也說明三種問題型別如何配合信心門檻控制自動化。
GPT Image 2.5 發布|生成延遲最多減半,畫質提升、修圖更精準
GPT Image 2.5 正式發布,OpenAI 表示相較 Images 2.0,生成延遲最多降低 50%,並改善光影、材質細節、參考主體保留與複雜構圖。新版也加強局部修改和多輪編輯一致性,ChatGPT 新增草圖、圖片評論與模板等操作方式。本文整理 ChatGPT、Codex 與 API 的使用入口、Flare 和 Sunburst 的定位差異,並展示 Codex 內建 ImageGen 製作的 GIF 動畫成品,說明如何指定修改範圍、保留既有畫面,以及實際製作仍會遇到的限制。
GPT-6 Astra 發表|能操作軟體、Standard API 輸入每百萬 tokens 10 美元
GPT-6 Astra 是 OpenAI 新一代旗艦模型,主打程式開發、瀏覽器操作與多步驟 Agent 工作。本文整理 ChatGPT、Codex 與 API 的分批開放方式、百萬 token context、Standard API 每百萬輸入 US$10 與輸出 US$50 的價格,並用具體試算說明長輸入加價。針對日常使用,補上 Codex 任務交辦範例、反覆確認與過度測試的處理方式,以及成果驗收、升級取捨與 Critical 資安監控限制,協助判斷 Astra 是否能減少工作中的人工接手。
全球 AI 服務 9/3 接連故障|Claude、ChatGPT、Codex、Grok、Cursor 相繼異常
2026 年 9 月 3 日,Claude、Grok、ChatGPT、Codex 與 Cursor 在數小時內接連公告異常,Gemini 也出現零星使用者回報,但沒有 Google 官方事故。本文以台灣時間整理各平台受影響範圍、恢復進度與來源,並記錄實際使用 Opus、Fable 工作到一半時遇到 500、529,以及先看到 Sonnet 修復、之後才出現多模型事故報告的經過,同時區分官方事故與未確認回報。
Gemini 3.8 Flash 發表|DeepSWE 73.7%,附官方建議與提示詞範本
Google 發表 Gemini 3.8 Flash,六週內第三次更新 Flash 模型。DeepSWE v1.1 從 65.3% 提高到 73.7%,補上 3.7 Flash 在長時間 coding 的落差;Standard API 年底前仍是每百萬輸入/輸出 token 0.75/3.75 美元,但複雜任務可能因更多 thinking 與工具呼叫而增加實際成本。本文整理規格、價格、跨模型評測、3.7 升級建議、API 遷移清單,並提供官方方法改寫的提示詞與 thinking 設定。
Claude Fable 5.1 發表|Cache 降價 75%、Agent 更強,附官方建議提示詞
Anthropic 發表 Claude Fable 5.1,延續百萬 token context 與 $10/$50 單價,cache read 則降價 75%。新模型強化長時間 coding、研究與 Agent 工作,Claude Code 資安分類器誤判介入減少約 60%。本文整理 Fable 5.1 與 Fable 5、Opus 5 的價格、benchmark、方案可用性及 API breaking changes,並提供官方建議的局部編輯與進度回報提示詞,改善整檔重寫和長時間無更新的使用體驗。
OpenAI Jalapeño 實測|吞吐/瓦最高 1.9 倍,延遲最多低 3.6 倍
OpenAI 公布首款自研 LLM 推論晶片 Jalapeño 的第一批 InferenceX 實測:三個開放權重模型的峰值吞吐/瓦是比較系統的 1.5 至 1.9 倍,端到端延遲低 1.7 至 3.6 倍。本文整理它與 Broadcom、Celestica 的分工、prefill 與 decode 的設計背景、各模型測試條件、SemiAnalysis 揭露的限制、2026 年底部署時程,以及 ChatGPT、Codex、API 使用者現在能與不能期待的變化。
GPT-5.6 Sol 降價|Input 降 20%、Output 降 33%,優惠至少到 11 月
OpenAI 再度調降 GPT-5.6 API 價格,這次輪到旗艦階層 Sol:每百萬 input tokens 從 5 美元降為 4 美元,output 從 30 美元降為 20 美元,降幅分別是 20% 與 33%,促銷價至少維持到 2026 年 11 月 21 日。本文整理 Standard API 計費項目、長 context 加價、與 Terra/Luna 的最新價差,以及 API、Codex 和 ChatGPT 使用者各自會受到什麼影響。