
Claude Code 中的 Claude Sonnet 5.5:別名在某家供應商上移動了,而預設值則下移了
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 934 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 194 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1167 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
本週讓Claude Sonnet 5.5重新回到雷達上的那則第三方簡報指出,它「已在各地上線,包括 Platform 和 Claude Code」。前半句是供應商自己 9 月 28 日的說法,而且確實無誤:Claude Sonnet 5.5已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 推出,每百萬個 token 為 2 美元與 10 美元,與Claude Sonnet 5相比維持不變。後半句只有在「Claude Code」指的是單一供應商時才成立。同一個下午推出的 Claude Code 版本 v2.1.284,把 sonnet別名指向Claude Sonnet 5.5(在 Anthropic API 上)——卻讓它仍停留在Claude Sonnet 4.6(在 AWS 上的 Claude Platform),而Claude Sonnet 4.5則在 Amazon Bedrock 和 Google Cloud 上。對 Bedrock 部署執行 /model sonnet,你不會得到新模型。還有第二件事變了,而且幾乎沒有人寫下來:在 Claude API 上,Claude Sonnet 5.5一開始就是high 的投入程度;在 Claude Code 中則一開始是 medium。這兩項事實都有文件記載,對任何考慮本週是否切換的人來說都是關鍵,而且兩者都藏在那句「模型已在各地上線」的話底下。
v2.1.284 究竟改變了什麼
Claude Code 的變更日誌條目只有一行,而其中重要的半句是個限定語:「新增 Claude Sonnet 5.5(claude-sonnet-5-5),現為 Anthropic API 上的預設 Sonnet 模型——1M 上下文,每百萬 token $2/$10,快取讀取每百萬 token $0.20。」該版本於 9 月 28 日 17:11 UTC 發布至 npm,這是帶時間戳記的發布日期,而非版本號。模型設定文件載有變更日誌所沒有的對應表。
• sonnet 別名 — Claude Sonnet 5.5 在 Anthropic API 上;Claude Sonnet 4.6 在 AWS 上的 Claude Platform;Claude Sonnet 4.5 在 Amazon Bedrock 與 Google Cloud 的 Agent Platform 上;Claude Sonnet 4.5 在 Microsoft Foundry 上。
• opus 別名 — Claude Opus 5.5 於 Anthropic API、AWS 上的 Claude Platform、Amazon Bedrock 及 Google Cloud;Claude Opus 4.6 於 Microsoft Foundry。
• 預設模型 — 在 Pro、Max、Team、Enterprise 及 Anthropic API 上為 Claude Opus 5.5,在 Microsoft Foundry 上則為 Claude Sonnet 4.5。自 9 月 22 日的 v2.1.280 起便一直是 Opus 5.5;在那之前,Pro 和 Team Standard 上是 Claude Sonnet 5。
• sonnet[1m]——在 sonnet 已解析為 Claude Sonnet 5.5 或 Claude Sonnet 5 的情況下沒有效果,因為兩者都原生具備 1M 個 token 的上下文視窗。這個後綴並不是在此模型上取得長上下文的方式;模型本身就已經具備了。
把第一行與第三行放在一起讀,實際後果範圍雖窄,卻很明確。在 Anthropic API 上,升級 Claude Code 就是整個遷移流程——sonnet會自動為你切換。在 Bedrock、Google Cloud 以及 AWS 上的 Claude Platform,模型雖有提供,但別名並不會跟著移動,而文件對於變通做法寫得很明白:當某個別名解析到較舊的模型時,只要完整寫出較新模型的名稱,或設定 ANTHROPIC_DEFAULT_SONNET_MODEL,就能取用這些較新的模型。所以「Sonnet 5.5 已在 Claude Code 上线」這句話講的是一個預設值,而預設值因供應商而異。
預設投入程度在每個介面上都是不同的層級
這是會改變你的帳單、而不是模型字串的部分,而且它分散在兩個彼此未交互參照的頁面上。Claude API 的 effort 文件指出,Claude Sonnet 5.5支援全部五個等級,而且high在該處是預設值。Claude Code 模型設定頁面說明了工作階段的解析順序——明確選擇(CLAUDE_CODE_EFFORT_LEVEL 變數、--effort,或 /effort),接著是你已儲存的設定,然後是模型本身的預設值——並將該模型預設值列為:「high在所有支援 effort 的模型上,除了 Opus 5.5 和 Sonnet 5.5 預設為 medium,Opus 4.7 預設為 xhigh。」
兩個預設值,一個模型,一級之差。在獨立指數上,這一級價值約六點智力分數,以及大約多完成 84% 的任務。Anthropic 自家對Claude Sonnet 5.5 的指引——從high 開始,除非工作負載具代理性或對延遲敏感;而代理式編程與多步驟工具使用則從medium 開始——是為 API 介面而寫的,在那裡high 是你什麼都不做就會得到的預設值。Claude Code 已經朝另一個方向替你做了這個決定。
它是否做出了正確的抉擇,確實取決於工作負載,而廠商支持中等的論點是站得住腳的:模型的投入程度等級已明確依據Claude Sonnet 5重新校準,而遷移說明指出,應重新執行一次投入程度掃描,而不是沿用既有設定。但「重新校準」是一體兩面的,而下一節正是它見真章的地方。

梯子的成本,經衡量
Artificial Analysis 已對Claude Sonnet 5.5在 Intelligence Index v4.3.2 的每一個層級進行測量,這是一套包含十項評估的套件,而每個層級的成本,是價目表無法向您顯示的數字。以下所有數字均為該評估機構的數字,於 2026 年 9 月 30 日讀取自模型頁面自身的資料;供應商費率則是 Anthropic 的。
• 低 — 指數 35.84,每項任務 $0.41;首個區塊耗時 1.04 秒。
中等,Claude Code 的預設值 — $0.59 時為 40.74;首個區塊耗時 1.34 秒。
• 高,Claude API 的預設值 —— 以 $1.08 達到 46.74;首個區塊耗時 16.6 秒。
• Xhigh — 51.85,價格為 $2.74;首個區塊耗時 39.7 秒。
• Max — 55.98,價格為 $7.60;首個區塊耗時 378.8 秒。
現在把Claude Sonnet 5自家的階梯放在它旁邊,因為那是大多數讀者會遷移過來的模型。它的各階讀數為 24.26、28.05、31.66、34.38 與 38.16,每項任務成本分別為 $0.51、$1.00、$1.79、$2.87 與 $5.09。Claude Sonnet 5.5在 Claude Code 的預設medium設定下得分 40.74 —— 高於Claude Sonnet 5在任何投入程度下的最佳成績 —— 花費 $0.59,對比 $5.09。在同一套測試中,這相當於每完成一項任務便宜 8.7 倍;而這是 Anthropic「成本不到十分之一」說法的獨立驗證版本,該說法是廠商在 Terminal-Bench 的 Medium 投入程度下提出的。方向相同、倍數略小,而且這是實測結果,而非廠商提供的表格。改為降到low,排序就會翻轉:35.84 低於Claude Sonnet 5的天花板,而這才是這項節省幅度誠實的下限。
在兩種模型上都不便宜的那一階,就是最頂端的那一階。在最大投入下,Claude Sonnet 5.5每項索引任務花費 $7.60,對比Claude Sonnet 5的 $5.09——大約多了 49%,而非更少。這並不與廠商的數字相矛盾。這是同一條曲線從另一端解讀的結果,而若投入程度設定是被沿用而非清除,這正是遷移後會落到的位置。
您儲存的努力程度設定可能不會跟著您
還有第三個設定正在發揮作用,而它正是最有可能默默出錯的那一個。Claude Code 會依模型分別儲存 effort,存放於你的使用者設定中的 modelSettings 底下,因此每個模型都會保有自己的等級。較舊的形式——單一的頂層 effortLevel 鍵,也就是在依模型儲存功能出現之前 /effort 所寫入的內容——對較新的模型則有不同的處理方式。文件指出,該鍵「在 Opus 5、Fable 5.1 及更早的模型上,會繼續套用在先前套用的地方,而 Opus 5.5 及之後發布的模型則會從各自的預設值開始,直到你為它們選擇等級為止。」
Claude Sonnet 5.5比Claude Opus 5.5晚推出——9 月 28 日對上 9 月 22 日——因此它落在第二個群組。一年前把全域的effortLevel: "high"設定好、以維持Claude Sonnet 5銳利度的團隊,在新模型上不會拿到high。他們拿到的是medium,也就是 Claude Code 的預設值,而工作階段中沒有任何地方說明這件事。同一頁也指出,max只適用於目前的工作階段,除非是透過環境變數設定;而專案、本機或受管理的effortLevel鍵,或用--settings傳入的設定,則會套用到每一個模型。如果你想要的是一套能挺過模型發布的努力程度政策,那就該用這種形式來寫。
有一個相鄰的變更值得點名,因為它共用同一個版本號:Ultracode 在 effort 滑桿中的切換開關是 Claude Code 的設定,而不是模型的 effort 等級;此外,若要保持在 xhigh 以外的等級開啟,或關閉它(使用 /effort ultracode off),需要 v2.1.284——也就是搭載新 Sonnet 的同一個組建。Ultracode 不是 effort 等級,也不應被解讀為其中之一,但如果你曾針對舊行為撰寫指令碼,那就是它變更的版本。
等待是思考預算,而不是詞元速率
上面這些延遲數據是整頁中最具實務參考價值的部分,因為它們顛覆了一般人的直覺。Claude Sonnet 5.5的輸出速度並不會隨著投入程度提高而下降,反而會隨之上升,從低投入時每秒 85 個 token,到最高投入時每秒 137 個。真正暴增的是第一個 token 出現之前得等待的時間——低投入時 1.0 秒,中投入 1.3 秒,高投入 16.6 秒,xhigh 39.7 秒,max 則要 378.8 秒。模型在最高階時並不是每個 token 都跑得比較慢。它是在開始之前思考得更久,而在最高階時,這代表每項任務前面都有超過六分鐘的沉默。
這重新界定了這個設定的用途。中檔與其說是品質上的妥協,不如說是模型唯一能表現得像對話工具的一檔;最高檔是披著互動介面外衣的批次操作。若串流用戶端把這個落差藏起來,會讓高檔在示範中看起來沒問題,在終端機裡卻感覺像壞了。多數團隊實際會採用的分法,是任何有人在看的任務用低檔,無人看管的工作用高檔——這與供應商自己的建議相去不遠,只是他們是從延遲而非成本的角度得出這個結論。
當今真正可路由的比較
如果這個階梯的重點是中等才是價值所在,那麼有趣的問題就是:還有什麼也位於它附近。Claude Opus 5.5在自身 Claude Code 預設的中等下,在同一套測試中每項任務得分 51.24,成本為每項任務 $1.34。Claude Sonnet 5.5在高下得分 46.74,成本為每項任務 $1.08。兩者相差約四點五個指數點,而每項任務成本約高出四分之一,且Claude Opus 5.5在其預設之上的每一級也都明顯領先。
一則可用性說明,明白說出而非暗示:Claude Sonnet 5.5並不在 OrcaRouter 的型錄中。它未列於公開模型清單,而且這個代稱的每一種拼法都回傳找不到,因此這裡的任何內容都不應被解讀為通往它的途徑。可路由的是你原本要遷移離開的模型,以及位階高於它的模型。anthropic/claude-sonnet-5自 2026 年 6 月 30 日起已在平台上,採用 Anthropic 自家的每百萬詞元 $2.00 與 $10.00 定價,快取讀取 $0.20、快取寫入 $2.50,並透過/v1/messages、/v1/chat/completions 與 /v1/responses 提供服務。anthropic/claude-opus-5.5自 9 月 22 日起已在該平台上,定價為 $4.00 與 $20.00,透過 Anthropic 相容端點與 chat-completions 端點提供服務。
這樣的組合,正是讓投入程度掃描(effort sweep)能以低成本執行的原因。比較的兩邊——維持舊設定的現行模型,以及在新生模型預設值被拿來權衡的那一級距上的較大手足——都只需一組憑證就能回應,不必再簽第二份合約,除了模型字串之外也不必更動任何程式碼,而服務目錄則直接沿用供應商的定價,不額外加價。它唯一做不到的,就是直接為你提供 Claude Sonnet 5.5 本身;而在這點改變之前,本文建議最誠實的版本,就是在 Anthropic 自家的 API 上評估那個級距,並在那些替代方案已經可及的地方評估它們。


本週該做什麼
三件事,依照你略過它們之後會開始燒錢的順序排列。在你假定升級已經生效之前,先確認你的 Claude Code 工作階段實際上是對哪個供應商執行,因為在 Bedrock、Google Cloud 和 AWS 上的 Claude Platform,sonnet 這個別名仍然指向 Claude Sonnet 4.5 或 Claude Sonnet 4.6,必須完整寫出模型名稱。檢查你儲存的 effort 是歸屬於每個模型各自的 modelSettings 項目,還是舊版的頂層鍵,因為只有前者會跟著你套用到 Claude Opus 5.5 之後才發布的模型上。而當你重新執行廠商要求的掃描時,要往上掃也要往下掃:在 Claude Code 預設值下,Claude Sonnet 5.5 的表現勝過 Claude Sonnet 5 的最佳結果,成本卻不到九分之一,這表示現在有趣的問題不再是該不該往下調,而是你負擔得起往上調多少。
懸而未決的問題是 Claude Haiku 5.5,Anthropic 表示它將在未來幾週加入這個家族,並位居這款模型之下。如果 Claude Opus 5.5的模式成立,它會先在 Anthropic API 上推出,再逐步向外擴展到其他供應商,延遲時間以 Claude Code 的發布次數計算,而非以天數計。這個延遲正是值得關注的重點,因為前面關於別名與預設值的所有內容,其實都是它造成的結果。
本文中的比較3
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
