为“美国的小模型如今成了更便宜的那一个”生成的主视觉卡片,徽标为“价格下限”,眉题为“2026 年 10 月 7 日”,副标题为“Claude Haiku 5.5 的 $0.10 和 $0.50 对阵 DeepSeek V4 Flash——直至 100,000 个 token。”四个小标签分别写着“输入 $0.10 对 $0.15”、“输出 $0.50 对 $0.60”、“100K 档位”和“高峰时段”。下方两张卡片标注为“低于 100,000 个 TOKEN”(“Anthropic 在两项计价上都更便宜”)与“高于此值”(“DeepSeek 便宜三到四倍”)。页脚写着“各厂商公布的价格表日期为 2026 年 10 月 8 日。”OrcaRouter 标志合成于右下角。
Guides & Insights

Claude Haiku 5.5 对阵 DeepSeek V4 Flash:Anthropic 刚刚击穿了价格底线

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

两年来,市场的低价档位有着一个人尽皆知的格局:美国实验室收费更高,中国实验室收费更低,而你据此选择自己的阵营。Claude Haiku 5.5在 2026 年 10 月 7 日打破了这一格局,其发布价格为每百万输入 token 0.10 美元、每百万输出 token 0.50 美元——这低于DeepSeek V4 Flash已公布的价格,而这款模型自入夏以来一直是低价的参照标杆。

这个优势比听起来更有限,而其中的原因比新闻标题更值得关注。Ant​hropic 的费率仅适用于不超过 100,000 个 token 的提示词。超过后,价格会变为 $0.50 和 $2.50,是 Dee​pSeek 价格的数倍。而 Dee​pSeek 自己的费率卡有一种没人效仿的形态:它在工作日的两个时段会翻倍。两家供应商,对“便宜”的含义有着两种截然不同的理解。

每个供应商实际发布的内容

每百万个 token,以美元计。Anthropic 的数据来自 Anthropic 的定价文档;DeepSeek 的数据来自 DeepSeek 自己的“模型与定价”页面,该页面是该模型的权威价目表。

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• 输入 — Claude Haiku 5.5 100,000 tokens 以内 $0.10,超出后 $0.50。DeepSeek V4 Flash 非高峰时段 $0.15,高峰时段 $0.30。

• 输出 — Claude Haiku 5.5:100,000 个 token 以内为 $0.50,超出部分为 $2.50。DeepSeek V4 Flash:非高峰时段 $0.60,高峰时段 $1.20。

• 缓存输入 — Claude Haiku 5.5 在最高 100,000 个 token 内为 $0.01,超出部分为 $0.05。DeepSeek V4 Flash 非高峰时段为 $0.003,高峰时段为 $0.006,便宜了三分之二以上。

• 高峰时段——An​hropic 没有;费率随提示长度变化,除此之外别无其他。Dee​pSeek 在 UTC 周一至周五 01:00 至 04:00 之间费率翻倍,06:00 至 10:00 之间再次翻倍,中国法定节假日除外。

• 上下文与输出——Claude Haiku 5.5 为 100 万 token 和最高 128,000 输出;DeepSeek V4 Flash 为 100 万 token 和最高 384,000 输出。

• 模态 — Claude Haiku 5.5 支持文本和图像;DeepSeek V4 Flash 仅支持文本,视觉能力由同系列的兄弟模型承担,而非此模型本身。

• 独立评分——Artificial Analysis 智能指数 v4.3.2 显示,Claude Haiku 5.5(Max)得分为 43.40,在 182 个模型中位列第二;DeepSeek V4 Flash 0731(Max)得分为 34.33,在 117 个模型中位列第十。

• 速度——同一来源测得 Claude Haiku 5.5 为每秒 241.9 个输出 token,DeepSeek V4 Flash 为 222.0 个,在各自榜单上位列第二快。

跨界就是故事的全部

让两张卡对齐到同一个请求上,比较结果就会反转两次。

在 100,000 个 token 以下,Anthropic 在两项计量上都更便宜,而且在真正重要的价签上也更便宜:输入 $0.10 对 $0.15,输出 $0.50 对 $0.60。这是 Anthropic 的小模型首次在同等条件下低于 DeepSeek Flash 的费率,也正是发布帖开篇点出的事实。

超过 100,000 个 token 时,情况会急剧逆转。Anthropic 的 0.50 美元输入价格是 DeepSeek 非高峰费率的三倍以上,而 2.50 美元的输出价格则是其四倍以上。一个经常组装 150,000 token 提示的检索或长文档管道,根本不会成为 Claude Haiku 5.5 的客户;它只会是它已经在使用的模型的客户。

而在 Dee​pSeek 的两个工作日时间窗里,第二个比较则从另一个方向收窄,因为 Dee​pSeek 自己的费率翻倍,而 Ant​hropic 的费率保持不变。抽象地说,两家厂商的定价结构都谈不上更好。一个按你发送多少来定价,另一个按你何时发送来定价,而这两者中只有一项是在请求时你能控制的。

完成的任务需要多少成本,这是唯一公平的数字

标价费率按 token 计,而这两个模型在完成同一项工作时输出的 token 数量并不相同。Anthropic 的发布算术正是在这里变得令人不安。

Artificial Analysis 将 Claude Haiku 5.5 (Max) 定为每项 Intelligence Index 任务 0.21 美元,将 DeepSeek V4 Flash 0731 (Max) 定为每项任务 0.22 美元。输入费率只有十分之一、窗口更大,再加上 26 分的 Intelligence Index 差距——43.40 对 34.33——但完成一项任务的实测成本,却与那款本应被它压价的模型相差不到一美分。

原因就在同一页上。评估 Index 时,Claude Haiku 5.5 生成了 4.4 亿个输出 token,而中位数是 1 亿,评估者称其非常啰嗦。DeepSeek V4 Flash 生成了 2.4 亿个,而中位数是 1.4 亿,也被称为非常啰嗦。两个模型都进行长时间的思考,都把思考计为输出,而输出是决定账单的计量表。输入成本削减 90% 是真的,但它被计在账单较小的那一半上。

还有第二个更不易察觉的影响。Anthropic 自己的文档称,Claude Haiku 5.5 使用与 Claude 4.7 及更高版本共享的较新分词器,因此同一段文本在它上面计得的 token 数比在 Claude Haiku 4.5 上多约 30%。费率降至原来的十分之一;token 数量却完全没有下降,而且在同一段文本上反而上升了。

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

DeepSeek 这个名字背后的模型也变了

任何仅凭几个月前的基准测试表来比较这两者的人,在这么做之前都应该知道这一点。

DeepSeek 的定价页面现在将 deepseek-flash 列为模型名称,背后由 DeepSeek-V4.1-Flash 支持,并声明旧版 deepseek-v4-flash 标识符仍被接受,但“相应模型已退役”——使用旧名称的请求由较新的模型处理,并按 Flash 价格计费。换句话说,该标识符保留了其名称、价格和在产品阵容中的位置,但其底层的权重已经更换。

这不是批评,而是一则警告:基准表所标注的日期究竟是什么。本文引用的 Artificial Analysis 条目对应的是 DeepSeek V4 Flash 在 Max 配置下的 0731 版本,这也是该榜单所测量的模型,它并不自动等同于如今任何沿用同一 id 的东西。相比之下,Anthropic 的 Claude Haiku 5.5 是一个固定 id,既无日期后缀,也无别名,其在指数中的位置标注的是它自己发布的那一周。

两个模型,一个接口

这种比较之所以容易自己得出结论,而无须依赖规格表,是因为两边都可以从同一个地方调用——不过有一个例外值得说明。

DeepSeek V4 Flash 今天已在 OrcaRouter 目录中上线,而且自动故障转移就位于其底层,因此本次对比中的 DeepSeek 这一路,今早我们就能直接调用,而不只是读到相关介绍。有一点值得说明,而不是留给你自己去发现:我们为该模型列出的费率是每百万 token 输入 $0.22、输出 $0.66,高于 DeepSeek 的非高峰价目,低于其高峰价目。请以 DeepSeek 的页面而非我们的页面作为高峰与非高峰结构的权威依据,而把我们的数字当作一个混合后的单一数值,用于启动计量运行。Claude Sonnet 5.5 和 Claude Opus 5.5 同样已在目录中。因此,在 DeepSeek Flash 一路与 Claude 一路之间做 A/B 对比,只需一个密钥和一个 SDK,而如果升级逻辑属于路由而非应用层,路由 DSL 会把它们组合成一次调用。

Claude Haiku 5.5 尚未进入产品目录。这不是模棱两可的说法——它意味着在这次对比中,Anthropic 这一方目前只能直接通过 Anthropic 获取,而 DeepSeek 那一方则不必如此。如果你希望今天就让 DeepSeek 产品线中的低价档位与你其余技术栈共用同一个密钥,那部分已经上线可用。

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

该选哪一个

如果你的调用都很短——分类、抽取、路由、摘要、子智能体轮次——并且不超过 100,000 token,那么 Claude Haiku 5.5 如今在两项计费指标上都更便宜,在独立评测榜上也更强,结论很明确。它也是这两者中唯一能接受图像的那个。

如果你的调用很长,如果你重新发送一个大的共享前缀,或者如果你可以安排时间,那么这笔账就会倒向另一边,而且差距悬殊:Dee​pSeek 在非高峰时段的缓存输入价格为 $0.003,比 Ant​hropic 的 $0.01 低一个数量级;其输出上限是后者的三倍;其非高峰折扣是一个调度问题,而不是产品限制。

这次发布实际定下的,比“Ant​hropic 现在很便宜”要更窄。它确定的是:在短提示场景下,美国实验室的定价会低于中国实验室;而大多数生产流量正处在短提示场景。超过 100,000 个 token 的部分,仍然属于另一个模型的市场。