
Claude Sonnet 5 评测:接近Opus性能,Sonnet价格?
- anthropic新Anthropic: Claude Opus 52026-07-2461智能78代码
- google新Google: Gemini 3.6 Flash2026-07-2150智能69代码
- google新Google: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- meta新Meta: Muse Spark 1.12026-07-1651智能71代码
- kimi新MoonshotAI: Kimi K32026-07-1557智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0951智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0955智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0959智能77代码
- grokxAI: Grok 4.52026-07-0854智能72代码
- tencentTencent: Hy32026-07-0641智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3053智能72代码
- klingKling: Kling 3.0 Turbo2026-06-1757智能52代码57数学
- z-aiZ.ai: GLM 5.22026-06-1651智能69代码60数学
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242智能61代码61数学
- anthropicAnthropic: Claude Fable 52026-06-0960智能77代码
- qwenQwen: Qwen3.7 Plus2026-06-0139智能56代码59数学
- minimaxMiniMax: MiniMax M32026-05-3144智能59代码59数学
- AnthropicAnthropic: Claude Opus 4.82026-05-2856智能74代码68数学
Anthropic 的 Sonnet 系列一直属于“快速且实惠”的层级——当你觉得旗舰款 Opus 性能过剩时就会选择它。Claude Sonnet 5 改变了这一局面。这是首次,一款 Sonnet 级别的模型在编码和智能体工作方面接近 Opus 级的质量,同时保持 Sonnet 级的价格。
这份评测回答了很多团队真正在问的问题:Sonnet 5 是否足够优秀,能否用作你的默认模型,以及在哪些场景下仍值得为 Opus 4.8 付费?我们将涵盖真正的新功能、实际成本(包括大多数文章略过的令牌数量陷阱)、它与 Opus 4.8 及其前代 Sonnet 4.6 的对比,以及哪些人现在就应该切换。
快速裁决
考虑一下Claude Sonnet 5,如果你…
- 运行高容量生产工作负载,并希望以较低的每token成本获得Opus的大部分质量
- 构建编码代理或开发者工具——这是Anthropic在编码和代理工作方面迄今为止最大的Sonnet飞跃
- 需要大上下文窗口:标准定价下支持100万token,无长上下文附加费
- 正在从 Sonnet 4.6 升级,需要更强的指令遵循能力以及高分辨率视觉功能
如果你……,请暂缓(或继续使用 Opus 4.8)
- 进行最前沿的推理或长期自主工作,其中每一个质量点都至关重要
- 将token预算根据字节调整——Sonnet 5的新分词器对相同文本计数大约多出30%的token。
- 依赖 temperature/top_p 调优 — 非默认采样值现在被API拒绝
什么是Claude Sonnet 5?
Anthropic 提供三个模型层级:Haiku(快速且廉价)、Sonnet(平衡型)和 Opus(旗舰型)。Claude Sonnet 5 是当前的 Sonnet 层级模型——模型 ID 为 `claude-sonnet-5`——并且它今天通过 Claude API 全面可用。它介于 Haiku 4.5 和 Opus 4.8 之间,Anthropic 将其定位为 Sonnet 层级中速度与智能的最佳平衡。
这一代最引人注目的是上限的提升幅度。在编程和智能体任务上,Sonnet 5达到了以往Opus级别的质量——所以真正的决策不再是“选择Sonnet还是Opus?”,而是“哪些任务足够困难,仍然需要Opus?”
Claude Sonnet 5 有什么新功能?

接近Opus级别的编码和智能体质量。 标题所述的变化。Sonnet 5在编码和工具使用/智能体工作流方面相比Sonnet 4.6有显著改进,对于大多数开发者实际从事的工作,它缩小了与Opus 4.8之间的大部分差距。
默认启用自适应思维,外加`xhigh`努力级别。 Sonnet 5 默认运行自适应思维,除非你禁用它。它是首款支持`xhigh`努力级别的Sonnet层级模型——这是编码和代理任务的理想选择——除了低、中、高和最大级别之外。
100万token的上下文,128K输出,无溢价。在标准定价下提供完整的100万token上下文窗口,每次响应最多可输出128K tokens。
高分辨率视觉。 Sonnet 5 是首个具有高分辨率图像输入的 Sonnet 级别模型——长边可达 2576 像素(相比之前的 1568 像素)——这有助于处理截图、文件和图表。
新的分词器(需注意的要点)。 Sonnet 5 采用了新的分词器,与 Sonnet 4.6 相比,对同一文本产生的 token 数量大约多出 30%。每个 token 的价格未变,但您的实际成本和上下文窗口的数值计算会发生改变——在假设两者等同之前,请重新评估。

定价:实际成本

标准定价为每百万输入词元$3,每百万输出词元$15——与Sonnet 4.6价格相同,且远低于Opus 4.8的$5/$25。目前还有一个优惠折扣:每百万词元$2/$10,有效期至2026年8月31日,因此早期采用者获得了真正的成本优惠。
有一个需要注意的地方:由于新的分词器对同一文本的词元计数增加了约30%,因此原本在Sonnet 4.6上花费特定金额的工作负载,即便每词元费率相同,在Sonnet 5上也未必费用相同。努力级别也会影响支出——更高的努力度(xhigh或max)意味着更多的思考词元。请通过针对`claude-sonnet-5`调用`count_tokens`来进行预算,而不是重复使用旧的估算值。
评分
以下评分是我们根据Anthropic公开发布的模型能力和行为说明所做的编辑评估——而非独立的第三方基准测试结果。待公开基准数据发布后,我们将重新评估这些评分。

- 编程: 9/10
- 智能代理/工具使用: 9/10
- 推理(最难的任务): 8/10 — Opus 4.8 仍领先于此
- 速度/日常生产力: 9/10
- 成本效益: 9/10
- 上下文与长文档: 9/10
总体评分:~8.7/10 — 一个优秀的默认模型,Opus 4.8 被保留用于难度范围的最顶端。
优点
- 接近Opus的编程和代理质量,但定价为Sonnet级别——每个token比Opus 4.8更便宜
- `xhigh` 努力加上自适应思维可以精细控制成本/质量的权衡。
- 1M-token上下文为标准,无长上下文附加费
- 首款 Sonnet 级别的高分辨率视觉模型(2576px)
- 相对于 Sonnet 4.6,在指令遵循和编码方面有明显提升。
缺点
- 新的分词器使得token计数相比4.6版本增加了约30%——你必须重新制定成本和上下文预算。
非默认的 temperature/top_p/top_k 值被拒绝(HTTP 400)— 改为通过提示词来引导行为。
- 手动思考预算(`budget_tokens`)已消失——只有自适应思考和努力
- 在最难的推理和最长周期的自主工作方面仍然落后于 Opus 4.8
- 从4.6迁移需要对提示词进行一些重新调整——Sonnet 5更严格地遵循指令。
Claude Sonnet 5 对比

对比 Claude Opus 4.8. Opus 4.8($5 / $25)仍是 Anthropic 最强大的模型——适合最难推理和长周期自主运行的任务。但 Sonnet 5 现在以更低的单 token 成本,缩小了与 Opus 在编码和智能体能力上的大部分差距。实用原则:默认使用 Sonnet 5,仅在任务难度处于你的最高区间时才升级到 Opus 4.8。
对比 Claude Sonnet 4.6。同样是 $3/$15 的标价,但 Sonnet 5 在编码和智能代理工作方面实现了真正的能力跃升,新增了 `xhigh` 努力模式和高分辨率视觉,并默认切换为自适应思考。其代价是新的分词器(多出约 30% 的 tokens)和更严格的采样参数规则。对于大多数使用 4.6 的团队来说,升级是值得的——只需先重新评估你的成本基线。
此评测聚焦于 Claude 系列。如果您想将 Sonnet 5 与其他提供商的模型进行比较——或者跨所有模型进行路由——请参阅下面的 OrcaRouter 部分。
谁应该使用Claude Sonnet 5?
- 高容量生产应用 — 大规模聊天、提取、总结和分类,在这些场景中Opus过于强大,而Haiku又不够智能
- 编码代理与开发者工具 — 编码/代理的跃迁加上 `xhigh` 的努力使其成为IDE助手和自主编码的强大默认选项
— 长上下文与 RAG 工作负载 — 标准 100 万 token,无高级版
- 从 Sonnet 4.6 升级的团队 想要以相同标价获得更高质量
谁应该继续使用Opus 4.8?
- 前沿推理、深度研究和长周期自主智能体,其中最后几个质量点证明了更高成本的合理性。
- 工作负载已针对Opus行为进行优化,切换风险大于节省的成本。
Claude Sonnet 5 值得吗?
对于大多数团队而言,是的。Sonnet 5 是新的合理默认选择:在人们实际执行的工作——编程、智能体、日常生产——上提供接近Opus的质量,却以Sonnet的价格,并附带持续到2026年8月的首发折扣。将Opus 4.8保留用于最困难的任务,这样你就能两全其美,而无需在日常工作上支付过高费用。
最终裁决
Claude Sonnet 5 是目前 Anthropic 产品线中性价比最高的模型——我们的评分为 ~8.7/10。它不会让 Opus 4.8 退役,但确实使 Opus 成为专用工具而非默认选择。如果你正在使用 Sonnet 4.6,建议升级(先重新检查你的 token 成本)。如果你所有任务都用 Opus,请将常规工作迁移到 Sonnet 5,并将 Opus 保留用于难题。
通过 OrcaRouter 使用 Claude Sonnet 5
因为明智的做法是“默认使用Sonnet 5,最困难的任务用Opus 4.8”,你在生产环境中很可能需要不止一个模型——也可能需要来自其他提供商的模型。这就是OrcaRouter消除的摩擦。

OrcaRouter 为您提供一个兼容 OpenAI 的端点,可调用 Sonnet 5、Opus 4.8 及其他领先模型——具备智能路由、自动故障转移和零令牌加价功能。将成本低、数量大的任务路由到 Sonnet 5,将复杂推理升级到 Opus 4.8,并随时准备好备用模型,无需在每次更换模型时重写您的集成代码。

常见问题
Claude Sonnet 5 现在可用了吗?
是的。今天它已通过Claude API普遍可用,使用的模型ID是`claude-sonnet-5`。
Claude Sonnet 5 多少钱?
每百万输入标记3美元,每百万输出标记15美元,并有截至2026年8月31日的优惠价2美元/10美元。
Sonnet 5 是否比 Sonnet 4.6 更好?
是的——特别是在编码和代理工作方面——它增加了`xhigh`精力和高分辨率视觉。请注意,迁移时新的分词器(令牌数增加约30%)和更严格的采样参数规则。
Claude Sonnet 5 vs Opus 4.8 — 我该用哪个?
大多数工作默认使用 Sonnet 5;对于最困难的推理和长期自主任务,则升级到 Opus 4.8。
什么是上下文窗口?
1M个tokens,每次响应最多128K个输出tokens,按标准定价。
Sonnet 5是否支持扩展思维?
它使用自适应思考(默认开启),努力级别从低到最高,包括新的xhigh。手动设置`budget_tokens`不再支持。
如果我从4.6切换,我的成本会改变吗?
可能。新的分词器对相同的文本计数大约多30%的令牌,尽管每个令牌的价格相同,所以用count_tokens重新测量。
我可以通过OrcaRouter使用Claude Sonnet 5吗?
是的——通过一个兼容OpenAI的端点调用Claude Sonnet 5(以及Opus 4.8,加上来自其他提供商的模型),并具备路由和自动故障转移功能。
准备好将Claude Sonnet 5投入生产了吗?几分钟内即可启动——创建您的OrcaRouter账户并通过一个兼容OpenAI的端点调用Sonnet 5、Opus 4.8以及所有其他模型。优惠定价窗口开放至2026年8月31日——现在是开始的好时机。
