
Claude Code 中的 Claude Sonnet 5.5:别名在一个提供商上发生变动,默认版本则下调了
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 934 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens · 194 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 1167 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- xAISpaceXAI: Grok 4.62026-08-1244智能77代码
本周让 Claude Sonnet 5.5重新回到视野的那份第三方简报称,它"已在所有地方上线,包括平台和 Claude Code"。前半句是厂商自己 9 月 28 日的说法,而且经得起核实:Claude Sonnet 5.5已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上线,价格为每百万 token 2 美元和 10 美元,与 Claude Sonnet 5持平。后半句只有在"Claude Code"指的是某一家提供商时才成立。同一天下午发布的 Claude Code 版本 v2.1.284,把 sonnet别名在 Anthropic API 上指向 Claude Sonnet 5.5——而在 AWS 上的 Claude Platform 上仍指向 Claude Sonnet 4.6,在 Amazon Bedrock 和 Google Cloud 上仍指向 Claude Sonnet 4.5。在 Bedrock 部署上运行 /model sonnet,你拿到的并不是新模型。还有第二件事发生了变化,却几乎没人记录下来:在 Claude API 上,Claude Sonnet 5.5以 high档起步;而在 Claude Code 中,它以 medium档起步。这两个事实都有文档记载,对任何要在本周决定是否切换的人来说都至关重要,而它们都藏在那句"模型已在所有地方上线"的话底下。
v2.1.284 实际上改动了什么
Claude Code 的更新日志只有一行,而其中重要的那一半是一个限定说明:“新增 Claude Sonnet 5.5(claude-sonnet-5-5),现已成为 Anthropic API 上默认的 Sonnet 模型——100 万上下文,每百万 token 2 美元/10 美元,缓存读取每百万 token 0.20 美元。”该构建于 UTC 时间 9 月 28 日 17:11 发布到 npm,这更像是带时间戳的发布日期,而非版本号。模型配置文档中载有更新日志所没有的那张解析表。
• sonnet 别名 — Claude Sonnet 5.5(Anthropic API);Claude Sonnet 4.6(AWS 上的 Claude Platform);Claude Sonnet 4.5(Amazon Bedrock 和 Google Cloud 的 Agent Platform);Claude Sonnet 4.5(Microsoft Foundry)。
• opus 别名 — Claude Opus 5.5 适用于 Anthropic API、AWS 上的 Claude Platform、Amazon Bedrock 和 Google Cloud;Claude Opus 4.6 适用于 Microsoft Foundry。
• 默认模型——Claude Opus 5.5,适用于 Pro、Max、Team、Enterprise 以及 Anthropic API;在 Microsoft Foundry 上则为 Claude Sonnet 4.5。自 9 月 22 日发布的 v2.1.280 起,默认模型一直是 Opus 5.5;在此之前,Pro 和 Team Standard 上的默认模型是 Claude Sonnet 5。
• sonnet[1m] — 在 sonnet已解析为 Claude Sonnet 5.5或 Claude Sonnet 5的情况下不产生任何效果,因为两者都原生支持 1M token 的上下文窗口。在该模型上,这个后缀并不是获得长上下文的方式;模型本身已经具备。
把第一行和第三行放在一起读,实际的结论虽然范围不大,却相当尖锐。在 Anthropic API 上,升级 Claude Code 就是迁移的全部——sonnet会自动为你切换。而在 Bedrock、Google Cloud 和 AWS 上的 Claude Platform 上,模型虽然已经提供,但别名并不会随之迁移,文档也明确说明了变通办法:当某个别名解析到较旧的模型时,可以通过写出新模型的完整名称,或设置 ANTHROPIC_DEFAULT_SONNET_MODEL来访问更新的模型。所以,"Sonnet 5.5 已在 Claude Code 中上线"这句话说的是默认值,而默认值是按提供商而定的。
默认的投入程度在每个界面上都处于不同的档位
这一部分改变的是你的账单,而不是你的模型字符串,而且它分散在两个互不交叉引用的页面上。Claude Sonnet 5.5支持全部五个级别,并且high在那里是默认值。Claude Code 的模型配置页面说明了会话的解析顺序——显式选择(CLAUDE_CODE_EFFORT_LEVEL 变量、--effort,或 /effort),然后是你保存的设置,然后是模型自身的默认值——接着给出的模型默认值是:“high在所有支持 effort 的模型上,只是 Opus 5.5 和 Sonnet 5.5 默认为 medium,Opus 4.7 默认为 xhigh。”
两个默认值,同一个模型,相隔一档。在独立指数上,这一档大约相当于六个智能点,而每完成一个任务的费用要高出约 84%。Claude Sonnet 5.5从 high开始,除非工作负载属于智能体式或对延迟敏感;而对于智能体编码和多步工具调用,则从 medium开始——是针对 API 层面写的,在那里,high是你什么都不做就能得到的。Claude Code 已经替你在相反方向上做出了这个选择。
这个决定是否明智,确实取决于具体的工作负载,而厂商支持medium的理由也站得住脚:该模型的努力级别是针对Claude Sonnet 5明确重新校准的,且迁移说明建议重新跑一遍 effort sweep,而不是把原有设置直接沿用过来。但“重新校准”是把双刃剑,下一节就要说到它究竟落在哪一边。

阶梯的效果,以实测衡量
Artificial Analysis 已在 Claude Sonnet 5.5Intelligence Index v4.3.2 的每一档上完成测量,该指数是一套包含十项评估的评测集,而每一档的成本,正是费率卡无法向你展示的数字。下文所有数字均出自该评测机构,读取自模型页面自身于 2026 年 9 月 30 日的数据;供应商费率则来自 Anthropic。
• 低 — 指数 35.84,每任务 $0.41;首个数据块用时 1.04 秒。
• 中等,Claude Code 的默认档位 —— 40.74,$0.59;首个分块耗时 1.34 秒。
• 高,Claude API 默认值 —— 46.74,成本 $1.08;首个数据块耗时 16.6 秒。
• Xhigh — 51.85,价格为 $2.74;首个数据块用时 39.7 秒。
Max — 55.98,单价 $7.60;首个分块用时 378.8 秒。
现在把 Claude Sonnet 5自己的阶梯摆在旁边,因为大多数读者会是从这个模型迁移过来的。它的各级读数为 24.26、28.05、31.66、34.38 和 38.16,每项任务成本分别为 $0.51、$1.00、$1.79、$2.87 和 $5.09。Claude Sonnet 5.5在 Claude Code 的默认设置 中等 下得分为 40.74——高于 Claude Sonnet 5在任何 effort 级别下的最佳成绩——成本为 $0.59,而后者为 $5.09。在同一测试套件上,每完成一项任务的成本低了 8.7 倍,这也是对 Anthropic“成本不到十分之一”说法的独立验证;该说法是厂商基于 Terminal-Bench 在 Medium effort 下的结果提出的。方向一致,倍数略小,而且这是实测结果,而非厂商提供的表格。若改降到 低,排序则会反转:35.84 低于 Claude Sonnet 5的上限,而这是节省幅度诚实可信的下限。
在两种模型上都不便宜的那个档位,就是最高档。在最高强度下,Claude Sonnet 5.5每个索引任务要花 7.60 美元,而Claude Sonnet 5的 5.09 美元——大约高出 49%,而不是更低。这并不与供应商的数字相矛盾。这是同一条曲线从另一端读取的结果,而且如果强度设置被沿用而不是被清除,迁移就会落在那里。
你保存的投入程度设置可能不会跟随你
还有第三个设置在起作用,而它是最有可能在悄无声息中出错的那一个。Claude Code 会按模型分别保存 effort,存放在用户设置中的 modelSettings 下,因此每个模型都保有自己的级别。较旧的形式——即单个顶层的 effortLevel 键,也就是在按模型保存出现之前 /effort 所写入的内容——对于较新的模型则另有不同的处理方式。文档说,该键“会继续在 Opus 5、Fable 5.1 及更早的模型上于其原先生效之处生效,而 Opus 5.5 及在其之后发布的模型则从各自的默认值开始,直到你为它们选定一个级别。”
Claude Sonnet 5.5的发布时间晚于Claude Opus 5.5——9 月 28 日对 9 月 22 日——因此它属于第二类。如果某个团队一年前设置了全局的 effortLevel: "high",以让 Claude Sonnet 5 保持敏锐,那么在新模型上他们并不会得到 high。他们得到的是 medium,也就是 Claude Code 的默认值,而会话中没有任何内容说明这一点。同一页面还指出,max 仅适用于当前会话,除非通过环境变量设置;而项目级、本地或托管的 effortLevel 键,或者通过 --settings 传入的键,则适用于所有模型。如果你想要一套能在模型发布后依然延续的 effort 策略,那就应该以这种形式来编写它。
有一个相邻变更值得点出,因为它共享同一个版本号:Ultracode 开关位于努力程度滑块中,是 Claude Code 设置而非模型努力程度级别,并且要在除 xhigh 以外的级别保持开启,或用 /effort ultracode off 将其关闭,需要 v2.1.284 —— 也就是搭载新 Sonnet 的同一构建版本。Ultracode 不是努力程度级别,也不应被当作一个级别来解读,但如果你曾围绕旧行为编写脚本,那就是它发生变化的版本。
等待是思考预算,而不是token速率
上面的延迟数据是这一页上最具运营参考价值的内容,因为它们颠覆了通常的直觉。在Claude Sonnet 5.5上,输出速度并不会随着努力程度的提高而下降;恰恰相反,它会随之上升,从低努力时的每秒 85 个 token 提升到最高时的 137 个。真正呈爆炸式增长的是第一个 token 出现之前的等待时间——低为 1.0 秒,中为 1.3 秒,高为 16.6 秒,极高为 39.7 秒,最高为 378.8 秒。在阶梯顶端,模型并非每个 token 更慢。它是在开始之前思考得更久,而在最高一档,这意味着每个任务开始前都有超过六分钟的沉默。
这重新界定了该设置项的用途。medium与其说是一种质量上的妥协,不如说是模型表现得像对话工具的唯一档位;max则是披着交互界面外衣的批处理操作。流式客户端若掩盖这一差距,会让high在演示中看起来没问题,而在终端里用起来却像坏了一样。大多数团队最终会采用的实用划分方式,是让任何有人类实时观看的任务走低档位,而让无人值守运行的工作走高档位——这与供应商自己的建议相当接近,只不过是从延迟而非成本的角度得出的。
如今真正可路由的对比
如果这个阶梯的意义在于 medium才是价值所在,那么有趣的问题是,还有什么也位于它附近。Claude Opus 5.5在自身 Claude Code 默认设置medium下,在同一套测试中得分为 51.24,每任务成本为 1.34 美元。Claude Sonnet 5.5在high下得分为 46.74,成本为 1.08 美元。两者相差 4.5 个指数点,而每任务成本约高出四分之一,并且Claude Opus 5.5在高于其默认值的每一档也都明显领先。
有一条可用性说明,在此明说而非暗示:Claude Sonnet 5.5不在 OrcaRouter 目录中。它不在公开模型列表中,而且该 slug 的任何拼写形式都会返回 not-found,因此此处的任何内容都不应被理解为通往它的路由。真正可路由的,是你要迁移离开的那个模型,以及位于它之上的那个模型。anthropic/claude-sonnet-5自 2026 年 6 月 30 日起便已在该平台上,价格为 Anthropic 自家的每百万 token $2.00 和 $10.00,缓存读取 $0.20、缓存写入 $2.50,并通过 /v1/messages、/v1/chat/completions 和 /v1/responses 提供服务。anthropic/claude-opus-5.5自 9 月 22 日起就在那里,价格为 $4.00 和 $20.00,通过 Anthropic 兼容端点和 chat-completions 端点提供服务。
正是这一组合,让 effort 扫描跑起来成本低廉。比较的两侧——以旧设置运行的现有模型,以及新模型默认值所对标的那一档上更大的同门模型——都用同一份凭据作答,无需第二份合同,除了模型字符串之外也无需改动任何代码;而目录直接透传提供商的标价,不额外加价。它唯一不会做的事,就是为你提供 Claude Sonnet 5.5本身;在这一点改变之前,本文建议最诚实的版本是:在 Anthropic 自家的 API 上评估那一档模型,而在替代方案已经可及的地方评估它们。


本周做什么
有三件事,按跳过它们会让你损失金钱的顺序排列。在假定升级已经生效之前,先确认你的 Claude Code 会话实际运行在哪个提供商上,因为在 Bedrock、Google Cloud 和 Claude Platform on AWS 上,sonnet 别名仍然指向 Claude Sonnet 4.5 或 Claude Sonnet 4.6,必须完整写出模型名称。检查你保存的 effort 是每个模型单独的 modelSettings 条目,还是旧的顶层键,因为只有前者会跟随你应用到 Claude Opus 5.5 之后发布的模型上。当厂商要求你重新运行扫描时,既要向下扫,也要向上扫:在 Claude Code 的默认设置下,Claude Sonnet 5.5 以不到九分之一的成本击败了 Claude Sonnet 5 的最佳结果,这意味着有意思的问题已不再是该不该往下走,而是你能负担得起往上走多远。
悬而未决的问题是Claude Haiku 5.5,Anthropic 表示它将在未来几周内加入该系列,并位于该模型之下。如果来自Claude Opus 5.5的模式成立,它会首先登陆 Anthropic API,然后向外扩展到其他提供商,延迟以 Claude Code 的发布次数而非天数来衡量。这个延迟才是值得关注的地方,因为上文关于别名和默认值的一切,实际上都是它带来的结果。
本文中的对比3
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
