Anthropic 在 2026 年 9 月 28 日發表 Claude Sonnet 5.5。這次不是降低 API 單價:每百萬 input/output token 仍是 2/10 美元;官方宣稱新版輸出速度比 Sonnet 5 快逾 30%,而且多數工作所需的 token 更少,單項任務成本最多可降 30%。這是 Anthropic 的測試結果,實際節省幅度會隨任務與 effort 設定改變。

手機版 Claude 的模型選單已出現 Sonnet 5.5,提供一般使用者直接切換的入口;是否看得到選項,仍要以帳號與工作區設定為準。

Claude Sonnet 5.5 是什麼

先看一段由 Sonnet 5.5 使用網頁動畫做的自我介紹。

Claude 是 Anthropic 開發的 AI 助理與模型系列,可以閱讀文件與圖片、寫程式、整理資料,也能在允許的工具環境執行多步驟工作。Claude App 是網頁、桌面與手機上的對話產品;Claude Code 是在終端機及開發環境工作的 coding agent。Sonnet 是其中兼顧速度、能力與用量的模型,5.5 版接替 6 月推出的 Sonnet 5,成為 Claude 5.5 家族繼 Opus 5.5 後的第二款模型。

官方把 Sonnet 5.5 放在範圍明確的日常工作,例如修正程式錯誤、製作文件、簡報、試算表與介面設計;Opus 5.5 仍偏向需要長時間判斷的複雜、開放式任務。兩者不是單純「能力高低」或「速度快慢」的替換關係:任務越明確、執行越頻繁,Sonnet 的效率優勢越值得試;需求不清、需要持續權衡與查核時,先考慮 Opus。Anthropic 預告 Haiku 5.5 之後才會加入;目前手機版選單中的 Haiku 仍是 4.5。

模型目前定位選用時機
Fable 5.1最困難的挑戰更高強度的長時間推理與 Agent 工作
Opus 5.5複雜工作與日常任務範圍開放、需要持續判斷的工作
Sonnet 5.5較簡單任務的高效率選擇明確的 coding、文件與設計任務
Haiku 4.5快速回答低延遲的簡短問題
模型定位依 Anthropic 發表文與目前手機版選單整理;實際表現仍取決於任務。

Claude App 與 Claude Code 怎麼用 Sonnet 5.5

這一節給使用 Claude 現成產品與訂閱方案的讀者,不需要設定 API。Anthropic 表示 Sonnet 5.5 已在 Claude 各平台推出;在網頁、桌面或手機 App,點送出鍵旁的模型名稱,從選單選 Sonnet 5.5。Claude Code 可輸入 /model 切換。發表文沒有逐一公布 Free、Pro、Max、Team 與 Enterprise 的 Sonnet 5.5 配額或預設模型;具體選項仍受帳號方案、逐步開放與工作區管理員設定影響。免費帳號不能因 App 可選到 Sonnet 5.5,就推定也可使用 Claude Code。

Claude 手機 App 模型選單顯示 Fable 5.1、Opus 5.5、Sonnet 5.5 與 Haiku 4.5,Sonnet 5.5 已被選取
此帳號已可選取 Sonnet 5.5;畫面未顯示 effort。

Effort 預設與調整

Anthropic 的發表文說明,Sonnet 5.5 在 Claude App 與 Claude Code 預設 Medium effort,直接使用 Claude Platform API 則預設 High。Effort 控制回答時投入的思考量:Low、Medium 通常較快、消耗較少 token;High 以上會花更多時間與用量查核,適合較複雜的工作。它不是固定的品質排名,也不保證調到最高就一定比較正確。

App 可在模型選單的「Effort」調整,同一段對話從下一次回覆生效;Claude Code 則可用 /effort medium 作為日常檔位,遇到跨檔案重構或複雜推理再提高。Anthropic 沒有在這次 Sonnet 5.5 發表文宣布額外提高五小時額度或另送一張免費重置券;9 月 Opus 5.5 的用量與重置券活動不要直接當成 Sonnet 5.5 的新活動。已取得的券及可用額度,仍以帳號頁面顯示為準。

安全機制可能改用 Sonnet 5 回答

Sonnet 5.5 是首款加入較高風險資安請求切換機制的 Sonnet。若對話觸發相關防護,Claude 可能顯示通知,改由 Sonnet 5 回答,模型選單也會停留在 Sonnet 5;一般修 bug、檢查自己的程式碼不在官方所述的主要影響範圍。若不希望自動切換,可到 Settings → Capabilities 關閉「Switch models when a message is flagged」;Claude Code 的位置是 Config → MODEL & OUTPUT。關閉後,符合條件的請求會暫停,而不是保證由 Sonnet 5.5 繼續處理。

速度與能力比 Sonnet 5 改進多少

以下數據來自 Anthropic 公布的測試,並非獨立實測。官方宣稱 Sonnet 5.5 的輸出速度比 Sonnet 5 快逾 30%,且在多數工作中以更少的 token 完成任務。對訂閱者,體感可能是等待時間縮短、同樣用量能完成更多工作;但方案額度如何計算,不能直接用「快 30%」或「每任務省 30%」換算成固定可多問幾次。

Anthropic 官方評測比較:Terminal-Bench 4.0 的 Sonnet 5.5 與 Sonnet 5 分別為 70.6% 與 10.3%;CursorBench 4.0 分別為 55.5% 與 34.1%
兩項 coding agent 評測數據均由 Anthropic 公布。

Anthropic 的 完整官方評測 涵蓋 coding agent、知識工作、多學科推理、電腦操作與圖表辨識,Sonnet 5.5 在列出的八項都高於 Sonnet 5。表中是各模型在官方所列設定下的結果,不代表三款模型都使用相同 effort。

評測Sonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.070.6%10.3%66.4%(Xhigh)
FrontierCode 1.1(Main)52.1%(Xhigh)/46.2%(Max)42.4%54.4%
CursorBench 4.055.5%34.1%57.8%
GDPval-AA v2.11844 Elo1449 Elo1846 Elo
AA-Briefcase v1.11811 Elo1359 Elo1822 Elo
Humanity’s Last Exam(有工具)64.5%54.9%67.7%
OSWorld 2.1(partial)80.1%57.0%81.8%
Chartography(無工具)61.6%15.6%64.4%

這次 Sonnet 5.5 相較 6 月 30 日發表的 Sonnet 5,各項成績有大幅進步,甚至 Terminal-Bench 4.0 的成績還超越 Opus 5.5。這項評測聚焦命令列中的多步驟任務:Sonnet 5.5 得到 70.6%,Opus 5.5 在 Xhigh effort 下得到 66.4%。這不表示 Sonnet 5.5 整體能力更強;Anthropic 將它定位於範圍明確的工作,因此這類題目可能較能發揮它的長處。Anthropic 也指出,Opus 5.5 的評測啟用了正式安全防護,部分題目觸發防護時會交由較舊模型處理,可能拉低分數。不過,官方沒有逐題分析這 4.2 個百分點的差距,無法確認哪個因素是主因。

CursorBench 測真實開發工作階段中的跨檔案修改,Sonnet 5.5 的 55.5% 也高於 Sonnet 5 的 34.1%。GDPval-AA 測跨職業知識工作,AA-Briefcase 測較長時間的知識工作,兩者採 Elo 分數,不能當成答對百分比。Sonnet 5.5 在這兩項分別得到 1844 與 1811,接近 Opus 5.5 的 1846 與 1822;圖表辨識的 Chartography 則從 Sonnet 5 的 15.6% 升至 61.6%。

官方的分數與每任務成本曲線顯示,Sonnet 5.5 在 Medium effort 的 Terminal-Bench,以及 Low effort 的 CursorBench,分數都高於 Sonnet 5 的最佳成績,單題成本不到後者的一成。這是指定評測流程的任務成本,不代表 API 每 token 單價降到十分之一。

這八項均為 Anthropic 公布的結果。Terminal-Bench 的 Opus 5.5 分數採 Xhigh effort;FrontierCode 中 Sonnet 5.5 的 Xhigh 反而高於 Max,官方註明 Max 在部分題目做了超出範圍的修改或逾時。GDPval-AA 與 AA-Briefcase 的 Sonnet 5.5 分數來自發表前版本,當時結構化輸出曾有錯誤,Anthropic 表示問題已修正。不同工具、測試流程與 effort 都會影響結果,不能把分數差直接換算成日常工作的成功率;官方也表示,複雜且開放式的長時間任務仍以 Opus 5.5 較強。

One-shot 太陽系互動展示

這個 太陽系模擬器互動網站 是在 Sonnet 5.5 的 Extra effort 設定下,以單次提示完成的。作品包含八大行星、月球與哈雷彗星;太陽表面流動、行星光暈、土星環、銀河、小行星帶與偶爾劃過的流星,則構成畫面特效。這是該次作品的設定與成果,不代表 Sonnet 5.5 的預設 effort,也不等於每次 one-shot 都能產出相同品質。

手機若需要更大的操作畫面,可 另開完整的太陽系模擬器。

當時使用的完整提示詞是:「做一個模擬太陽系可以互動的網頁,還要重視漂亮的特效、手機與電腦都有好體驗」。

電腦上可拖曳旋轉視角、用滾輪縮放,點選天體查看直徑、公轉週期、溫度、距太陽的距離與光行時間;手機上則可單指旋轉、雙指縮放,從下方天體列切換觀看對象。時間控制支援暫停、倒轉與最高每秒 10 年,作品說明以 2061 年哈雷彗星接近太陽、拖出兩條尾巴作為觀看例子。網站稱行星位置依 JPL 公布的軌道要素計算,距離與大小則為方便觀看而壓縮;這是模擬器自身的說明,天文計算精度尚未獨立驗證。

同一段提示詞也交給 Extra effort 的 Opus 5.5 製作 另一版互動太陽系。Opus 版本使用 NASA 影像製作的地球與月球紋理,放大地球時可看見更細緻的地表、雲層與夜間燈光;銀河背景與整體光影也更豐富。不過,它沒有做出 Sonnet 版本的哈雷彗星。兩者是作品差異,不代表模型能力排名;Opus 版本也收錄在 Opus 5.5 介紹文章。

Sonnet 5.5 的 API 價格與六款模型比較

以下是開發者直接呼叫 Anthropic 或 OpenAI API 的標準文字 token 費率,與 Claude App、Claude Code 或 ChatGPT 的訂閱費及用量限制分開計算。Sonnet 5.5 的 input、output 單價與 Sonnet 5 相同;與 Opus 5/5.5、GPT-6 Sol、GPT-5.6 Terra 同框比較,可看出各模型的價格位置。Anthropic 所說的「最多省 30%」是特定測試的每項任務總成本,不是 Sonnet 5.5 的逐 token 單價下降。

Sonnet 5、Sonnet 5.5、Opus 5、Opus 5.5、GPT-6 Sol 與 GPT-5.6 Terra 的標準 API 每百萬 tokens 價格比較;柱高為 input,括號標示 output 美元單價
Sonnet 5.5 單價持平,Opus 5.5 較前代降價。
模型Input/百萬 tokensOutput/百萬 tokens快取讀取/百萬 tokens
Sonnet 52 美元10 美元0.20 美元
Sonnet 5.52 美元 (約新台幣 64 元)10 美元 (約新台幣 318 元)0.20 美元
Opus 55 美元25 美元0.50 美元
Opus 5.54 美元 (約新台幣 127 元)20 美元 (約新台幣 636 元)0.20 美元
GPT-6 Sol2 美元 (約新台幣 64 元)10 美元 (約新台幣 318 元)0.20 美元
GPT-5.6 Terra2 美元 (約新台幣 64 元)12 美元 (約新台幣 382 元)0.20 美元
美元單價皆為標準 API 費率;OpenAI 數字適用於 input 不超過 272K tokens 的請求。Anthropic 的「快取讀取」與 OpenAI 的「cached input」計費機制不同,表中只並列單價,不表示快取行為相同。

Sonnet 5.5 與 GPT-6 Sol 的標準 input/output 都是每百萬 tokens 2/10 美元;GPT-5.6 Terra 的 input 同為 2 美元,output 則是 12 美元。Opus 5.5 相較 Opus 5,input、output 各降 20%,快取讀取由 0.50 降至 0.20 美元。這些單價不能代表完成同一任務的總費用或模型能力排名。GPT-6 Sol 與 GPT-5.6 Terra 若單次請求的 input 超過 272K tokens,官方對整筆請求按 input 2 倍、output 1.5 倍計價;Batch、Fast Mode 等也有不同費率。

Sonnet 5.5 的模型 ID 是 claude-sonnet-5-5,context window 為 100 萬 tokens、單次最多輸出 12.8 萬 tokens;Message Batches API 的 30 萬 output tokens 仍需指定 beta header。一般 API 的 5 分鐘/1 小時快取寫入價分別是每百萬 tokens 2.50/4 美元,Batch API 對 input、output token 另有 50% 折扣。這些是開發者價格與上限,不等於 App 一次對話一定可送滿 100 萬 tokens。

API 從 Sonnet 5 升級的注意事項

這一節只給直接組 Claude Messages API 請求、維護 SDK 或自建 Agent 的開發者。單純在 Claude App 選模型或在 Claude Code 執行 /model,不需要手動修改下面的 request 參數。除了把模型 ID 換成 claude-sonnet-5-5,至少要檢查四處相容性:

  • 原本關閉 thinking:Sonnet 5 的 thinking: {"type":"disabled"} 在 5.5 會回傳 400;若目的是不要先花時間思考,改用 between_tools。它只支援 Low、Medium、High effort,不能和 xhigh、Max 合用。
  • 原本強制呼叫工具:tool_choice 指定 any 或 tool 會回傳 400;改用 auto,需要驗證工具參數時依平台支援情況使用 strict tool,並在程式端處理模型不呼叫工具的分支。
  • 原本使用電腦操作工具:Claude API 與 Google Cloud 的舊版 computer_20251124 工具不能直接沿用,應換成官方新 toolset。工具間的進度文字也可能改放在 thinking block;若自建介面會串流顯示這段文字,需調整解析方式。
  • 原本會修改舊對話內容:Sonnet 5.5 的 thinking block 與模型及對話綁定;自建流程若回頭改 system prompt、工具定義或早期訊息,再重送舊 thinking block,部分帳號會得到 400。優先維持對話歷史只追加不改寫,並依遷移文件處理跨模型或跨帳號的 thinking block。

Sonnet 5.5 沿用 Sonnet 5 的 tokenizer,同一段文字不會因換版就重新膨脹成更多 token;但模型實際會思考、呼叫工具及輸出多少內容仍可能不同。升級前應用自己的代表性任務核對結果與成本,不能把官方「最多省 30%」當成所有工作負載的固定預算。

參考來源


Sponsored Links

發佈留言