Claude Sonnet 5 评测:接近Opus性能,Sonnet价格?

Claude Sonnet 5 评测:接近Opus性能,Sonnet价格?

作者

Fengya Tian

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Anthropic 的 Sonnet 系列一直属于“快速且实惠”的层级——当你觉得旗舰款 Opus 性能过剩时就会选择它。Claude Sonnet 5 改变了这一局面。这是首次,一款 Sonnet 级别的模型在编码和智能体工作方面接近 Opus 级的质量,同时保持 Sonnet 级的价格。

这份评测回答了很多团队真正在问的问题:Sonnet 5 是否足够优秀,能否用作你的默认模型,以及在哪些场景下仍值得为 Opus 4.8 付费?我们将涵盖真正的新功能、实际成本(包括大多数文章略过的令牌数量陷阱)、它与 Opus 4.8 及其前代 Sonnet 4.6 的对比,以及哪些人现在就应该切换。

快速裁决

考虑一下Claude Sonnet 5,如果你…

- 运行高容量生产工作负载,并希望以较低的每token成本获得Opus的大部分质量

- 构建编码代理或开发者工具——这是Anthropic在编码和代理工作方面迄今为止最大的Sonnet飞跃

- 需要大上下文窗口:标准定价下支持100万token,无长上下文附加费

- 正在从 Sonnet 4.6 升级,需要更强的指令遵循能力以及高分辨率视觉功能

如果你……,请暂缓(或继续使用 Opus 4.8)

- 进行最前沿的推理或长期自主工作,其中每一个质量点都至关重要

- 将token预算根据字节调整——Sonnet 5的新分词器对相同文本计数大约多出30%的token。

- 依赖 temperature/top_p 调优 — 非默认采样值现在被API拒绝

什么是Claude Sonnet 5?

Anthropic 提供三个模型层级:Haiku(快速且廉价)、Sonnet(平衡型)和 Opus(旗舰型)。Claude Sonnet 5 是当前的 Sonnet 层级模型——模型 ID 为 `claude-sonnet-5`——并且它今天通过 Claude API 全面可用。它介于 Haiku 4.5 和 Opus 4.8 之间,Anthropic 将其定位为 Sonnet 层级中速度与智能的最佳平衡。

这一代最引人注目的是上限的提升幅度。在编程和智能体任务上,Sonnet 5达到了以往Opus级别的质量——所以真正的决策不再是“选择Sonnet还是Opus?”,而是“哪些任务足够困难,仍然需要Opus?”

Claude Sonnet 5 有什么新功能?

接近Opus级别的编码和智能体质量。 标题所述的变化。Sonnet 5在编码和工具使用/智能体工作流方面相比Sonnet 4.6有显著改进,对于大多数开发者实际从事的工作,它缩小了与Opus 4.8之间的大部分差距。

默认启用自适应思维,外加`xhigh`努力级别。 Sonnet 5 默认运行自适应思维,除非你禁用它。它是首款支持`xhigh`努力级别的Sonnet层级模型——这是编码和代理任务的理想选择——除了低、中、高和最大级别之外。

100万token的上下文,128K输出,无溢价。在标准定价下提供完整的100万token上下文窗口,每次响应最多可输出128K tokens。

高分辨率视觉。 Sonnet 5 是首个具有高分辨率图像输入的 Sonnet 级别模型——长边可达 2576 像素(相比之前的 1568 像素)——这有助于处理截图、文件和图表。

新的分词器(需注意的要点)。 Sonnet 5 采用了新的分词器,与 Sonnet 4.6 相比,对同一文本产生的 token 数量大约多出 30%。每个 token 的价格未变,但您的实际成本和上下文窗口的数值计算会发生改变——在假设两者等同之前,请重新评估。

定价:实际成本

标准定价为每百万输入词元$3,每百万输出词元$15——与Sonnet 4.6价格相同,且远低于Opus 4.8的$5/$25。目前还有一个优惠折扣:每百万词元$2/$10,有效期至2026年8月31日,因此早期采用者获得了真正的成本优惠。

有一个需要注意的地方:由于新的分词器对同一文本的词元计数增加了约30%,因此原本在Sonnet 4.6上花费特定金额的工作负载,即便每词元费率相同,在Sonnet 5上也未必费用相同。努力级别也会影响支出——更高的努力度(xhigh或max)意味着更多的思考词元。请通过针对`claude-sonnet-5`调用`count_tokens`来进行预算,而不是重复使用旧的估算值。

评分

以下评分是我们根据Anthropic公开发布的模型能力和行为说明所做的编辑评估——而非独立的第三方基准测试结果。待公开基准数据发布后,我们将重新评估这些评分。

- 编程: 9/10

- 智能代理/工具使用: 9/10

- 推理(最难的任务): 8/10 — Opus 4.8 仍领先于此

- 速度/日常生产力: 9/10

- 成本效益: 9/10

- 上下文与长文档: 9/10

总体评分:~8.7/10 — 一个优秀的默认模型,Opus 4.8 被保留用于难度范围的最顶端。

优点

- 接近Opus的编程和代理质量,但定价为Sonnet级别——每个token比Opus 4.8更便宜

- `xhigh` 努力加上自适应思维可以精细控制成本/质量的权衡。

- 1M-token上下文为标准,无长上下文附加费

- 首款 Sonnet 级别的高分辨率视觉模型(2576px)

- 相对于 Sonnet 4.6,在指令遵循和编码方面有明显提升。

缺点

- 新的分词器使得token计数相比4.6版本增加了约30%——你必须重新制定成本和上下文预算。

非默认的 temperature/top_p/top_k 值被拒绝(HTTP 400)— 改为通过提示词来引导行为。

- 手动思考预算(`budget_tokens`)已消失——只有自适应思考和努力

- 在最难的推理和最长周期的自主工作方面仍然落后于 Opus 4.8

- 从4.6迁移需要对提示词进行一些重新调整——Sonnet 5更严格地遵循指令。

Claude Sonnet 5 对比

对比 Claude Opus 4.8. Opus 4.8($5 / $25)仍是 Anthropic 最强大的模型——适合最难推理和长周期自主运行的任务。但 Sonnet 5 现在以更低的单 token 成本,缩小了与 Opus 在编码和智能体能力上的大部分差距。实用原则:默认使用 Sonnet 5,仅在任务难度处于你的最高区间时才升级到 Opus 4.8。

对比 Claude Sonnet 4.6同样是 $3/$15 的标价,但 Sonnet 5 在编码和智能代理工作方面实现了真正的能力跃升,新增了 `xhigh` 努力模式和高分辨率视觉,并默认切换为自适应思考。其代价是新的分词器(多出约 30% 的 tokens)和更严格的采样参数规则。对于大多数使用 4.6 的团队来说,升级是值得的——只需先重新评估你的成本基线。

此评测聚焦于 Claude 系列。如果您想将 Sonnet 5 与其他提供商的模型进行比较——或者跨所有模型进行路由——请参阅下面的 OrcaRouter 部分。

谁应该使用Claude Sonnet 5?

- 高容量生产应用 — 大规模聊天、提取、总结和分类,在这些场景中Opus过于强大,而Haiku又不够智能

- 编码代理与开发者工具 — 编码/代理的跃迁加上 `xhigh` 的努力使其成为IDE助手和自主编码的强大默认选项

— 长上下文与 RAG 工作负载 — 标准 100 万 token,无高级版

- 从 Sonnet 4.6 升级的团队 想要以相同标价获得更高质量

谁应该继续使用Opus 4.8?

- 前沿推理、深度研究和长周期自主智能体,其中最后几个质量点证明了更高成本的合理性。

- 工作负载已针对Opus行为进行优化,切换风险大于节省的成本。

Claude Sonnet 5 值得吗?

对于大多数团队而言,是的。Sonnet 5 是新的合理默认选择:在人们实际执行的工作——编程、智能体、日常生产——上提供接近Opus的质量,却以Sonnet的价格,并附带持续到2026年8月的首发折扣。将Opus 4.8保留用于最困难的任务,这样你就能两全其美,而无需在日常工作上支付过高费用。

最终裁决

Claude Sonnet 5 是目前 Anthropic 产品线中性价比最高的模型——我们的评分为 ~8.7/10。它不会让 Opus 4.8 退役,但确实使 Opus 成为专用工具而非默认选择。如果你正在使用 Sonnet 4.6,建议升级(先重新检查你的 token 成本)。如果你所有任务都用 Opus,请将常规工作迁移到 Sonnet 5,并将 Opus 保留用于难题。

通过 OrcaRouter 使用 Claude Sonnet 5

因为明智的做法是“默认使用Sonnet 5,最困难的任务用Opus 4.8”,你在生产环境中很可能需要不止一个模型——也可能需要来自其他提供商的模型。这就是OrcaRouter消除的摩擦。

OrcaRouter 为您提供一个兼容 OpenAI 的端点,可调用 Sonnet 5、Opus 4.8 及其他领先模型——具备智能路由、自动故障转移和零令牌加价功能。将成本低、数量大的任务路由到 Sonnet 5,将复杂推理升级到 Opus 4.8,并随时准备好备用模型,无需在每次更换模型时重写您的集成代码。

常见问题

Claude Sonnet 5 现在可用了吗?

是的。今天它已通过Claude API普遍可用,使用的模型ID是`claude-sonnet-5`。

Claude Sonnet 5 多少钱?

每百万输入标记3美元,每百万输出标记15美元,并有截至2026年8月31日的优惠价2美元/10美元。

Sonnet 5 是否比 Sonnet 4.6 更好?

是的——特别是在编码和代理工作方面——它增加了`xhigh`精力和高分辨率视觉。请注意,迁移时新的分词器(令牌数增加约30%)和更严格的采样参数规则。

Claude Sonnet 5 vs Opus 4.8 — 我该用哪个?

大多数工作默认使用 Sonnet 5;对于最困难的推理和长期自主任务,则升级到 Opus 4.8。

什么是上下文窗口?

1M个tokens,每次响应最多128K个输出tokens,按标准定价。

Sonnet 5是否支持扩展思维?

它使用自适应思考(默认开启),努力级别从低到最高,包括新的xhigh。手动设置`budget_tokens`不再支持。

如果我从4.6切换,我的成本会改变吗?

可能。新的分词器对相同的文本计数大约多30%的令牌,尽管每个令牌的价格相同,所以用count_tokens重新测量。

我可以通过OrcaRouter使用Claude Sonnet 5吗?

是的——通过一个兼容OpenAI的端点调用Claude Sonnet 5(以及Opus 4.8,加上来自其他提供商的模型),并具备路由和自动故障转移功能。


准备好将Claude Sonnet 5投入生产了吗?几分钟内即可启动——创建您的OrcaRouter账户并通过一个兼容OpenAI的端点调用Sonnet 5、Opus 4.8以及所有其他模型。优惠定价窗口开放至2026年8月31日——现在是开始的好时机。



© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube