一張 Claude Code 中 Claude Sonnet 5.5 的標題卡,標題為「Claude Code 中的 Claude Sonnet 5.5」,副標題為「同一個模型,兩家供應商,兩種預設值」,說明文字為「預設 effort:在 Claude API 上為 high,在 Claude Code 中為 medium。」,並附上三張卡片,分別寫著 v2.1.284、2026 年 9 月 28 日、每 100 萬個 token 2 美元 / 10 美元,以及「sonnet 別名在其中一家供應商上已經變更」。
Guides & Insights

Claude Code 中的 Claude Sonnet 5.5:別名在某家供應商上移動了,而預設值則下移了

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

本週讓Claude Sonnet 5.5重新回到雷達上的那則第三方簡報指出,它「已在各地上線,包括 Platform 和 Claude Code」。前半句是供應商自己 9 月 28 日的說法,而且確實無誤:Claude Sonnet 5.5已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Goog​le Cloud 和 Microsoft Foundry 推出,每百萬個 token 為 2 美元與 10 美元,與Claude Sonnet 5相比維持不變。後半句只有在「Claude Code」指的是單一供應商時才成立。同一個下午推出的 Claude Code 版本 v2.1.284,把 sonnet別名指向Claude Sonnet 5.5(在 Anthro​pic API 上)——卻讓它仍停留在Claude Sonnet 4.6(在 AWS 上的 Claude Platform),而Claude Sonnet 4.5則在 Amazon Bedrock 和 Goog​le Cloud 上。對 Bedrock 部署執行 /model sonnet,你不會得到新模型。還有第二件事變了,而且幾乎沒有人寫下來:在 Claude API 上,Claude Sonnet 5.5一開始就是high 的投入程度;在 Claude Code 中則一開始是 medium。這兩項事實都有文件記載,對任何考慮本週是否切換的人來說都是關鍵,而且兩者都藏在那句「模型已在各地上線」的話底下。

v2.1.284 究竟改變了什麼

Claude Code 的變更日誌條目只有一行,而其中重要的半句是個限定語:「新增 Claude Sonnet 5.5(claude-sonnet-5-5),現為 Anthropic API 上的預設 Sonnet 模型——1M 上下文,每百萬 token $2/$10,快取讀取每百萬 token $0.20。」該版本於 9 月 28 日 17:11 UTC 發布至 npm,這是帶時間戳記的發布日期,而非版本號。模型設定文件載有變更日誌所沒有的對應表。

• sonnet 別名 — Claude Sonnet 5.5 在 Anthropic API 上;Claude Sonnet 4.6 在 AWS 上的 Claude Platform;Claude Sonnet 4.5 在 Amazon Bedrock 與 Google Cloud 的 Agent Platform 上;Claude Sonnet 4.5 在 Microsoft Foundry 上。

• opus 別名 — Claude Opus 5.5 於 Ant​hropic API、AWS 上的 Claude Platform、Amazon Bedrock 及 Goo​gle Cloud;Claude Opus 4.6 於 Microsoft Foundry。

• 預設模型 — 在 Pro、Max、Team、Enterprise 及 Ant​hropic API 上為 Claude Opus 5.5,在 Microsoft Foundry 上則為 Claude Sonnet 4.5。自 9 月 22 日的 v2.1.280 起便一直是 Opus 5.5;在那之前,Pro 和 Team Standard 上是 Claude Sonnet 5。

• sonnet[1m]——在 sonnet 已解析為 Claude Sonnet 5.5 或 Claude Sonnet 5 的情況下沒有效果,因為兩者都原生具備 1M 個 token 的上下文視窗。這個後綴並不是在此模型上取得長上下文的方式;模型本身就已經具備了。

把第一行與第三行放在一起讀,實際後果範圍雖窄,卻很明確。在 Ant​hropic API 上,升級 Claude Code 就是整個遷移流程——sonnet會自動為你切換。在 Bedrock、Goo​gle Cloud 以及 AWS 上的 Claude Platform,模型雖有提供,但別名並不會跟著移動,而文件對於變通做法寫得很明白:當某個別名解析到較舊的模型時,只要完整寫出較新模型的名稱,或設定 ANTHROPIC_DEFAULT_SONNET_MODEL,就能取用這些較新的模型。所以「Sonnet 5.5 已在 Claude Code 上线」這句話講的是一個預設值,而預設值因供應商而異。

預設投入程度在每個介面上都是不同的層級

這是會改變你的帳單、而不是模型字串的部分,而且它分散在兩個彼此未交互參照的頁面上。Claude API 的 effort 文件指出,Claude Sonnet 5.5支援全部五個等級,而且high在該處是預設值。Claude Code 模型設定頁面說明了工作階段的解析順序——明確選擇(CLAUDE_CODE_EFFORT_LEVEL 變數、--effort,或 /effort),接著是你已儲存的設定,然後是模型本身的預設值——並將該模型預設值列為:「high在所有支援 effort 的模型上,除了 Opus 5.5 和 Sonnet 5.5 預設為 medium,Opus 4.7 預設為 xhigh。」

兩個預設值,一個模型,一級之差。在獨立指數上,這一級價值約六點智力分數,以及大約多完成 84% 的任務。Anthropic 自家對Claude Sonnet 5.5 的指引——從high 開始,除非工作負載具代理性或對延遲敏感;而代理式編程與多步驟工具使用則從medium 開始——是為 API 介面而寫的,在那裡high 是你什麼都不做就會得到的預設值。Claude Code 已經朝另一個方向替你做了這個決定。

它是否做出了正確的抉擇,確實取決於工作負載,而廠商支持中等的論點是站得住腳的:模型的投入程度等級已明確依據Claude Sonnet 5重新校準,而遷移說明指出,應重新執行一次投入程度掃描,而不是沿用既有設定。但「重新校準」是一體兩面的,而下一節正是它見真章的地方。

The Claude Code model-configuration documentation page, showing the per-provider resolution table: the sonnet alias resolves to Claude Sonnet 5.5 on the Anthropic API, Claude Sonnet 4.6 on Claude Platform on AWS, and Claude Sonnet 4.5 on Amazon Bedrock and Google Cloud's Agent Platform; the opus alias resolves to Claude Opus 5.5 on the first four providers and Claude Opus 4.6 on Microsoft Foundry.

梯子的成本,經衡量

Artificial Analysis 已對Claude Sonnet 5.5在 Intelligence Index v4.3.2 的每一個層級進行測量,這是一套包含十項評估的套件,而每個層級的成本,是價目表無法向您顯示的數字。以下所有數字均為該評估機構的數字,於 2026 年 9 月 30 日讀取自模型頁面自身的資料;供應商費率則是 Anthropic 的。

• 低 — 指數 35.84,每項任務 $0.41;首個區塊耗時 1.04 秒。

中等,Claude Code 的預設值 — $0.59 時為 40.74;首個區塊耗時 1.34 秒。

• 高,Claude API 的預設值 —— 以 $1.08 達到 46.74;首個區塊耗時 16.6 秒。

• Xhigh — 51.85,價格為 $2.74;首個區塊耗時 39.7 秒。

• Max — 55.98,價格為 $7.60;首個區塊耗時 378.8 秒。

現在把Claude Sonnet 5自家的階梯放在它旁邊,因為那是大多數讀者會遷移過來的模型。它的各階讀數為 24.26、28.05、31.66、34.38 與 38.16,每項任務成本分別為 $0.51、$1.00、$1.79、$2.87 與 $5.09。Claude Sonnet 5.5在 Claude Code 的預設medium設定下得分 40.74 —— 高於Claude Sonnet 5在任何投入程度下的最佳成績 —— 花費 $0.59,對比 $5.09。在同一套測試中,這相當於每完成一項任務便宜 8.7 倍;而這是 Anthropic「成本不到十分之一」說法的獨立驗證版本,該說法是廠商在 Terminal-Bench 的 Medium 投入程度下提出的。方向相同、倍數略小,而且這是實測結果,而非廠商提供的表格。改為降到low,排序就會翻轉:35.84 低於Claude Sonnet 5的天花板,而這才是這項節省幅度誠實的下限。

在兩種模型上都不便宜的那一階,就是最頂端的那一階。在最大投入下,Claude Sonnet 5.5每項索引任務花費 $7.60,對比Claude Sonnet 5的 $5.09——大約多了 49%,而非更少。這並不與廠商的數字相矛盾。這是同一條曲線從另一端解讀的結果,而若投入程度設定是被沿用而非清除,這正是遷移後會落到的位置。

您儲存的努力程度設定可能不會跟著您

還有第三個設定正在發揮作用,而它正是最有可能默默出錯的那一個。Claude Code 會依模型分別儲存 effort,存放於你的使用者設定中的 modelSettings 底下,因此每個模型都會保有自己的等級。較舊的形式——單一的頂層 effortLevel 鍵,也就是在依模型儲存功能出現之前 /effort 所寫入的內容——對較新的模型則有不同的處理方式。文件指出,該鍵「在 Opus 5、Fable 5.1 及更早的模型上,會繼續套用在先前套用的地方,而 Opus 5.5 及之後發布的模型則會從各自的預設值開始,直到你為它們選擇等級為止。」

Claude Sonnet 5.5比Claude Opus 5.5晚推出——9 月 28 日對上 9 月 22 日——因此它落在第二個群組。一年前把全域的effortLevel: "high"設定好、以維持Claude Sonnet 5銳利度的團隊,在新模型上不會拿到high。他們拿到的是medium,也就是 Claude Code 的預設值,而工作階段中沒有任何地方說明這件事。同一頁也指出,max只適用於目前的工作階段,除非是透過環境變數設定;而專案、本機或受管理的effortLevel鍵,或用--settings傳入的設定,則會套用到每一個模型。如果你想要的是一套能挺過模型發布的努力程度政策,那就該用這種形式來寫。

有一個相鄰的變更值得點名,因為它共用同一個版本號:Ultracode 在 effort 滑桿中的切換開關是 Claude Code 的設定,而不是模型的 effort 等級;此外,若要保持在 xhigh 以外的等級開啟,或關閉它(使用 /effort ultracode off),需要 v2.1.284——也就是搭載新 Sonnet 的同一個組建。Ultracode 不是 effort 等級,也不應被解讀為其中之一,但如果你曾針對舊行為撰寫指令碼,那就是它變更的版本。

等待是思考預算,而不是詞元速率

上面這些延遲數據是整頁中最具實務參考價值的部分,因為它們顛覆了一般人的直覺。Claude Sonnet 5.5的輸出速度並不會隨著投入程度提高而下降,反而會隨之上升,從低投入時每秒 85 個 token,到最高投入時每秒 137 個。真正暴增的是第一個 token 出現之前得等待的時間——低投入時 1.0 秒,中投入 1.3 秒,高投入 16.6 秒,xhigh 39.7 秒,max 則要 378.8 秒。模型在最高階時並不是每個 token 都跑得比較慢。它是在開始之前思考得更久,而在最高階時,這代表每項任務前面都有超過六分鐘的沉默。

這重新界定了這個設定的用途。中檔與其說是品質上的妥協,不如說是模型唯一能表現得像對話工具的一檔;最高檔是披著互動介面外衣的批次操作。若串流用戶端把這個落差藏起來,會讓高檔在示範中看起來沒問題,在終端機裡卻感覺像壞了。多數團隊實際會採用的分法,是任何有人在看的任務用低檔,無人看管的工作用高檔——這與供應商自己的建議相去不遠,只是他們是從延遲而非成本的角度得出這個結論。

當今真正可路由的比較

如果這個階梯的重點是中等才是價值所在,那麼有趣的問題就是:還有什麼也位於它附近。Claude Opus 5.5在自身 Claude Code 預設的中等下,在同一套測試中每項任務得分 51.24,成本為每項任務 $1.34。Claude Sonnet 5.5在高下得分 46.74,成本為每項任務 $1.08。兩者相差約四點五個指數點,而每項任務成本約高出四分之一,且Claude Opus 5.5在其預設之上的每一級也都明顯領先。

一則可用性說明,明白說出而非暗示:Claude Sonnet 5.5並不在 OrcaRouter 的型錄中。它未列於公開模型清單,而且這個代稱的每一種拼法都回傳找不到,因此這裡的任何內容都不應被解讀為通往它的途徑。可路由的是你原本要遷移離開的模型,以及位階高於它的模型。anthropic/claude-sonnet-5自 2026 年 6 月 30 日起已在平台上,採用 Anthropic 自家的每百萬詞元 $2.00 與 $10.00 定價,快取讀取 $0.20、快取寫入 $2.50,並透過/v1/messages、/v1/chat/completions 與 /v1/responses 提供服務。anthropic/claude-opus-5.5自 9 月 22 日起已在該平台上,定價為 $4.00 與 $20.00,透過 Anthropic 相容端點與 chat-completions 端點提供服務。

這樣的組合,正是讓投入程度掃描(effort sweep)能以低成本執行的原因。比較的兩邊——維持舊設定的現行模型,以及在新生模型預設值被拿來權衡的那一級距上的較大手足——都只需一組憑證就能回應,不必再簽第二份合約,除了模型字串之外也不必更動任何程式碼,而服務目錄則直接沿用供應商的定價,不額外加價。它唯一做不到的,就是直接為你提供 Claude Sonnet 5.5 本身;而在這點改變之前,本文建議最誠實的版本,就是在 Anthropic 自家的 API 上評估那個級距,並在那些替代方案已經可及的地方評估它們。

The OrcaRouter model page for anthropic/claude-sonnet-5, showing a 1M-token context window, up to 128K output tokens, input at $2.00 and output at $10.00 per 1M tokens with a $0.20 cache read and $2.50 cache write, a listing dated Jun 30, 2026, and tiles reading AA Coding 71.5 and AA Intelligence 38.2.The Artificial Analysis model page for Claude Sonnet 5.5, labelled Adaptive Reasoning, Max Effort, Default Fallback, released September 2026. It shows an Intelligence Index of 56, class ranks of #3 of 216 on intelligence and #98 of 216 on cost, $2.00 input and $10.00 output per 1M tokens with a 90% cache discount, a $7.60 average cost per Intelligence Index task, 410M tokens generated against a median of 88M, 137 tokens per second, 1M-token context window, and text and image input.

本週該做什麼

三件事,依照你略過它們之後會開始燒錢的順序排列。在你假定升級已經生效之前,先確認你的 Claude Code 工作階段實際上是對哪個供應商執行,因為在 Bedrock、Google Cloud 和 AWS 上的 Claude Platform,sonnet 這個別名仍然指向 Claude Sonnet 4.5 或 Claude Sonnet 4.6,必須完整寫出模型名稱。檢查你儲存的 effort 是歸屬於每個模型各自的 modelSettings 項目,還是舊版的頂層鍵,因為只有前者會跟著你套用到 Claude Opus 5.5 之後才發布的模型上。而當你重新執行廠商要求的掃描時,要往上掃也要往下掃:在 Claude Code 預設值下,Claude Sonnet 5.5 的表現勝過 Claude Sonnet 5 的最佳結果,成本卻不到九分之一,這表示現在有趣的問題不再是該不該往下調,而是你負擔得起往上調多少。

懸而未決的問題是 Claude Haiku 5.5,Anthropic 表示它將在未來幾週加入這個家族,並位居這款模型之下。如果 Claude Opus 5.5的模式成立,它會先在 Anthropic API 上推出,再逐步向外擴展到其他供應商,延遲時間以 Claude Code 的發布次數計算,而非以天數計。這個延遲正是值得關注的重點,因為前面關於別名與預設值的所有內容,其實都是它造成的結果。

本文中的比較3

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新