一张用于 Claude Code 中 Claude Sonnet 5.5 的标题卡,标题为“Claude Code 中的 Claude Sonnet 5.5”,副标题为“同一模型,两家提供商,两种默认值”,说明文字为“默认 effort:在 Claude API 上为 high,在 Claude Code 中为 medium。”,另有三张卡片,分别写着 v2.1.284、2026 年 9 月 28 日、每 100 万 tokens 2 美元 / 10 美元,以及“sonnet 别名已在一家提供商上迁移”。
Guides & Insights

Claude Code 中的 Claude Sonnet 5.5:别名在一个提供商上发生变动,默认版本则下调了

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

本周让 Claude Sonnet 5.5重新回到视野的那份第三方简报称,它"已在所有地方上线,包括平台和 Claude Code"。前半句是厂商自己 9 月 28 日的说法,而且经得起核实:Claude Sonnet 5.5已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Goog​le Cloud 和 Microsoft Foundry 上线,价格为每百万 token 2 美元和 10 美元,与 Claude Sonnet 5持平。后半句只有在"Claude Code"指的是某一家提供商时才成立。同一天下午发布的 Claude Code 版本 v2.1.284,把 sonnet别名在 Anthropic API 上指向 Claude Sonnet 5.5——而在 AWS 上的 Claude Platform 上仍指向 Claude Sonnet 4.6,在 Amazon Bedrock 和 Goog​le Cloud 上仍指向 Claude Sonnet 4.5。在 Bedrock 部署上运行 /model sonnet,你拿到的并不是新模型。还有第二件事发生了变化,却几乎没人记录下来:在 Claude API 上,Claude Sonnet 5.5以 high档起步;而在 Claude Code 中,它以 medium档起步。这两个事实都有文档记载,对任何要在本周决定是否切换的人来说都至关重要,而它们都藏在那句"模型已在所有地方上线"的话底下。

v2.1.284 实际上改动了什么

Claude Code 的更新日志只有一行,而其中重要的那一半是一个限定说明:“新增 Claude Sonnet 5.5(claude-sonnet-5-5),现已成为 Ant​hropic API 上默认的 Sonnet 模型——100 万上下文,每百万 token 2 美元/10 美元,缓存读取每百万 token 0.20 美元。”该构建于 UTC 时间 9 月 28 日 17:11 发布到 npm,这更像是带时间戳的发布日期,而非版本号。模型配置文档中载有更新日志所没有的那张解析表。

• sonnet 别名 — Claude Sonnet 5.5(Anthropic API);Claude Sonnet 4.6(AWS 上的 Claude Platform);Claude Sonnet 4.5(Amazon Bedrock 和 Google Cloud 的 Agent Platform);Claude Sonnet 4.5(Microsoft Foundry)。

• opus 别名 — Claude Opus 5.5 适用于 Anthropic API、AWS 上的 Claude Platform、Amazon Bedrock 和 Google Cloud;Claude Opus 4.6 适用于 Microsoft Foundry。

• 默认模型——Claude Opus 5.5,适用于 Pro、Max、Team、Enterprise 以及 Ant​hropic API;在 Microsoft Foundry 上则为 Claude Sonnet 4.5。自 9 月 22 日发布的 v2.1.280 起,默认模型一直是 Opus 5.5;在此之前,Pro 和 Team Standard 上的默认模型是 Claude Sonnet 5。

• sonnet[1m] — 在 sonnet已解析为 Claude Sonnet 5.5或 Claude Sonnet 5的情况下不产生任何效果,因为两者都原生支持 1M token 的上下文窗口。在该模型上,这个后缀并不是获得长上下文的方式;模型本身已经具备。

把第一行和第三行放在一起读,实际的结论虽然范围不大,却相当尖锐。在 Ant​hropic API 上,升级 Claude Code 就是迁移的全部——sonnet会自动为你切换。而在 Bedrock、Goo​gle Cloud 和 AWS 上的 Claude Platform 上,模型虽然已经提供,但别名并不会随之迁移,文档也明确说明了变通办法:当某个别名解析到较旧的模型时,可以通过写出新模型的完整名称,或设置 ANTHROPIC_DEFAULT_SONNET_MODEL来访问更新的模型。所以,"Sonnet 5.5 已在 Claude Code 中上线"这句话说的是默认值,而默认值是按提供商而定的。

默认的投入程度在每个界面上都处于不同的档位

这一部分改变的是你的账单,而不是你的模型字符串,而且它分散在两个互不交叉引用的页面上。Claude Sonnet 5.5支持全部五个级别,并且high在那里是默认值。Claude Code 的模型配置页面说明了会话的解析顺序——显式选择(CLAUDE_CODE_EFFORT_LEVEL 变量、--effort,或 /effort),然后是你保存的设置,然后是模型自身的默认值——接着给出的模型默认值是:“high在所有支持 effort 的模型上,只是 Opus 5.5 和 Sonnet 5.5 默认为 medium,Opus 4.7 默认为 xhigh。”

两个默认值,同一个模型,相隔一档。在独立指数上,这一档大约相当于六个智能点,而每完成一个任务的费用要高出约 84%。Claude Sonnet 5.5从 high开始,除非工作负载属于智能体式或对延迟敏感;而对于智能体编码和多步工具调用,则从 medium开始——是针对 API 层面写的,在那里,high是你什么都不做就能得到的。Claude Code 已经替你在相反方向上做出了这个选择。

这个决定是否明智,确实取决于具体的工作负载,而厂商支持medium的理由也站得住脚:该模型的努力级别是针对Claude Sonnet 5明确重新校准的,且迁移说明建议重新跑一遍 effort sweep,而不是把原有设置直接沿用过来。但“重新校准”是把双刃剑,下一节就要说到它究竟落在哪一边。

The Claude Code model-configuration documentation page, showing the per-provider resolution table: the sonnet alias resolves to Claude Sonnet 5.5 on the Anthropic API, Claude Sonnet 4.6 on Claude Platform on AWS, and Claude Sonnet 4.5 on Amazon Bedrock and Google Cloud's Agent Platform; the opus alias resolves to Claude Opus 5.5 on the first four providers and Claude Opus 4.6 on Microsoft Foundry.

阶梯的效果,以实测衡量

Artificial Analysis 已在 Claude Sonnet 5.5Intelligence Index v4.3.2 的每一档上完成测量,该指数是一套包含十项评估的评测集,而每一档的成本,正是费率卡无法向你展示的数字。下文所有数字均出自该评测机构,读取自模型页面自身于 2026 年 9 月 30 日的数据;供应商费率则来自 Ant​hropic。

• 低 — 指数 35.84,每任务 $0.41;首个数据块用时 1.04 秒。

• 中等,Claude Code 的默认档位 —— 40.74,$0.59;首个分块耗时 1.34 秒。

• 高,Claude API 默认值 —— 46.74,成本 $1.08;首个数据块耗时 16.6 秒。

• Xhigh — 51.85,价格为 $2.74;首个数据块用时 39.7 秒。

Max — 55.98,单价 $7.60;首个分块用时 378.8 秒。

现在把 Claude Sonnet 5自己的阶梯摆在旁边,因为大多数读者会是从这个模型迁移过来的。它的各级读数为 24.26、28.05、31.66、34.38 和 38.16,每项任务成本分别为 $0.51、$1.00、$1.79、$2.87 和 $5.09。Claude Sonnet 5.5在 Claude Code 的默认设置 中等 下得分为 40.74——高于 Claude Sonnet 5在任何 effort 级别下的最佳成绩——成本为 $0.59,而后者为 $5.09。在同一测试套件上,每完成一项任务的成本低了 8.7 倍,这也是对 Anthropic“成本不到十分之一”说法的独立验证;该说法是厂商基于 Terminal-Bench 在 Medium effort 下的结果提出的。方向一致,倍数略小,而且这是实测结果,而非厂商提供的表格。若改降到 低,排序则会反转:35.84 低于 Claude Sonnet 5的上限,而这是节省幅度诚实可信的下限。

在两种模型上都不便宜的那个档位,就是最高档。在最高强度下,Claude Sonnet 5.5每个索引任务要花 7.60 美元,而Claude Sonnet 5的 5.09 美元——大约高出 49%,而不是更低。这并不与供应商的数字相矛盾。这是同一条曲线从另一端读取的结果,而且如果强度设置被沿用而不是被清除,迁移就会落在那里。

你保存的投入程度设置可能不会跟随你

还有第三个设置在起作用,而它是最有可能在悄无声息中出错的那一个。Claude Code 会按模型分别保存 effort,存放在用户设置中的 modelSettings 下,因此每个模型都保有自己的级别。较旧的形式——即单个顶层的 effortLevel 键,也就是在按模型保存出现之前 /effort 所写入的内容——对于较新的模型则另有不同的处理方式。文档说,该键“会继续在 Opus 5、Fable 5.1 及更早的模型上于其原先生效之处生效,而 Opus 5.5 及在其之后发布的模型则从各自的默认值开始,直到你为它们选定一个级别。”

Claude Sonnet 5.5的发布时间晚于Claude Opus 5.5——9 月 28 日对 9 月 22 日——因此它属于第二类。如果某个团队一年前设置了全局的 effortLevel: "high",以让 Claude Sonnet 5 保持敏锐,那么在新模型上他们并不会得到 high。他们得到的是 medium,也就是 Claude Code 的默认值,而会话中没有任何内容说明这一点。同一页面还指出,max 仅适用于当前会话,除非通过环境变量设置;而项目级、本地或托管的 effortLevel 键,或者通过 --settings 传入的键,则适用于所有模型。如果你想要一套能在模型发布后依然延续的 effort 策略,那就应该以这种形式来编写它。

有一个相邻变更值得点出,因为它共享同一个版本号:Ultracode 开关位于努力程度滑块中,是 Claude Code 设置而非模型努力程度级别,并且要在除 xhigh 以外的级别保持开启,或用 /effort ultracode off 将其关闭,需要 v2.1.284 —— 也就是搭载新 Sonnet 的同一构建版本。Ultracode 不是努力程度级别,也不应被当作一个级别来解读,但如果你曾围绕旧行为编写脚本,那就是它发生变化的版本。

等待是思考预算,而不是token速率

上面的延迟数据是这一页上最具运营参考价值的内容,因为它们颠覆了通常的直觉。在Claude Sonnet 5.5上,输出速度并不会随着努力程度的提高而下降;恰恰相反,它会随之上升,从低努力时的每秒 85 个 token 提升到最高时的 137 个。真正呈爆炸式增长的是第一个 token 出现之前的等待时间——低为 1.0 秒,中为 1.3 秒,高为 16.6 秒,极高为 39.7 秒,最高为 378.8 秒。在阶梯顶端,模型并非每个 token 更慢。它是在开始之前思考得更久,而在最高一档,这意味着每个任务开始前都有超过六分钟的沉默。

这重新界定了该设置项的用途。medium与其说是一种质量上的妥协,不如说是模型表现得像对话工具的唯一档位;max则是披着交互界面外衣的批处理操作。流式客户端若掩盖这一差距,会让high在演示中看起来没问题,而在终端里用起来却像坏了一样。大多数团队最终会采用的实用划分方式,是让任何有人类实时观看的任务走低档位,而让无人值守运行的工作走高档位——这与供应商自己的建议相当接近,只不过是从延迟而非成本的角度得出的。

如今真正可路由的对比

如果这个阶梯的意义在于 medium才是价值所在,那么有趣的问题是,还有什么也位于它附近。Claude Opus 5.5在自身 Claude Code 默认设置medium下,在同一套测试中得分为 51.24,每任务成本为 1.34 美元。Claude Sonnet 5.5在high下得分为 46.74,成本为 1.08 美元。两者相差 4.5 个指数点,而每任务成本约高出四分之一,并且Claude Opus 5.5在高于其默认值的每一档也都明显领先。

有一条可用性说明,在此明说而非暗示:Claude Sonnet 5.5不在 OrcaRouter 目录中。它不在公开模型列表中,而且该 slug 的任何拼写形式都会返回 not-found,因此此处的任何内容都不应被理解为通往它的路由。真正可路由的,是你要迁移离开的那个模型,以及位于它之上的那个模型。anthropic/claude-sonnet-5自 2026 年 6 月 30 日起便已在该平台上,价格为 Ant​hropic 自家的每百万 token $2.00 和 $10.00,缓存读取 $0.20、缓存写入 $2.50,并通过 /v1/messages、/v1/chat/completions 和 /v1/responses 提供服务。anthropic/claude-opus-5.5自 9 月 22 日起就在那里,价格为 $4.00 和 $20.00,通过 Ant​hropic 兼容端点和 chat-completions 端点提供服务。

正是这一组合,让 effort 扫描跑起来成本低廉。比较的两侧——以旧设置运行的现有模型,以及新模型默认值所对标的那一档上更大的同门模型——都用同一份凭据作答,无需第二份合同,除了模型字符串之外也无需改动任何代码;而目录直接透传提供商的标价,不额外加价。它唯一不会做的事,就是为你提供 Claude Sonnet 5.5本身;在这一点改变之前,本文建议最诚实的版本是:在 Ant​hropic 自家的 API 上评估那一档模型,而在替代方案已经可及的地方评估它们。

The OrcaRouter model page for anthropic/claude-sonnet-5, showing a 1M-token context window, up to 128K output tokens, input at $2.00 and output at $10.00 per 1M tokens with a $0.20 cache read and $2.50 cache write, a listing dated Jun 30, 2026, and tiles reading AA Coding 71.5 and AA Intelligence 38.2.The Artificial Analysis model page for Claude Sonnet 5.5, labelled Adaptive Reasoning, Max Effort, Default Fallback, released September 2026. It shows an Intelligence Index of 56, class ranks of #3 of 216 on intelligence and #98 of 216 on cost, $2.00 input and $10.00 output per 1M tokens with a 90% cache discount, a $7.60 average cost per Intelligence Index task, 410M tokens generated against a median of 88M, 137 tokens per second, 1M-token context window, and text and image input.

本周做什么

有三件事,按跳过它们会让你损失金钱的顺序排列。在假定升级已经生效之前,先确认你的 Claude Code 会话实际运行在哪个提供商上,因为在 Bedrock、Google Cloud 和 Claude Platform on AWS 上,sonnet 别名仍然指向 Claude Sonnet 4.5 或 Claude Sonnet 4.6,必须完整写出模型名称。检查你保存的 effort 是每个模型单独的 modelSettings 条目,还是旧的顶层键,因为只有前者会跟随你应用到 Claude Opus 5.5 之后发布的模型上。当厂商要求你重新运行扫描时,既要向下扫,也要向上扫:在 Claude Code 的默认设置下,Claude Sonnet 5.5 以不到九分之一的成本击败了 Claude Sonnet 5 的最佳结果,这意味着有意思的问题已不再是该不该往下走,而是你能负担得起往上走多远。

悬而未决的问题是Claude Haiku 5.5,Ant​hropic 表示它将在未来几周内加入该系列,并位于该模型之下。如果来自Claude Opus 5.5的模式成立,它会首先登陆 Ant​hropic API,然后向外扩展到其他提供商,延迟以 Claude Code 的发布次数而非天数来衡量。这个延迟才是值得关注的地方,因为上文关于别名和默认值的一切,实际上都是它带来的结果。

本文中的对比3

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新