
Claude Haiku 5.5:Anthropic 称最便宜的一档即将推出,数周前曾有泄露称其已死
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77代码
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0345智能76代码
在 9 月的约两周时间里,追踪该厂商路线图的人普遍持有这样的工作假设:最便宜的 Claude 层级将被淘汰。这则泄密——X 上一个以发布该厂商路线图爆料而闻名的账号所发的帖子——称 5.5 代将重组产品阵容:Claude Fable、Claude Opus 和 Claude Sonnet 都会推出 5.5 版本,Fable 将迁移到新的预训练底座,Haiku 产品线将退出。公司从未证实其中任何一点。随后,在 2026 年 9 月 22 日,随着Claude Opus 5.5的发布,公司用一句话说出了相反的意思:“Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周内推出。” Claude Haiku 5.5因此已被宣布、未定日期、尚未发布——而它之所以存在,正是因为关于它的传闻是错的。当前正在发布的小模型,Claude Haiku 4.5,仍然是你今天会调用的模型。
以下是哪些属于确凿的既定事实、哪些属于推测、哪些目前无人知晓。这一区分在这里比平常更为重要,因为关于 Haiku 5.5 流传的大部分说法,都是从它之上那一层级外推而来的。
实际上确认了什么,又是由谁确认的?
已确认的集合很小,而且值得让它保持很小。

• 这则公告——Anthropic 自己为 Claude Opus 5.5 发布的发布帖中写道:“Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周内跟进。”这就是全部的直接证据。它不过是别人发布帖里的一句话,而非 Haiku 5.5 的公告。
• 承诺的范围——同一篇帖子称,这两款模型将拥有与 Claude Opus 5 一样的“在性能、效率和安全性方面的诸多相同改进”。那是一份类别清单,而非规格说明。没有基准测试,没有价格,没有上下文窗口,没有模型 ID,没有日期。
• 层级定位——Haiku 是 Anthropic 当前三个层级中最快、最便宜的一档,位于 Sonnet 和 Opus 之下。自该系列推出以来,这一点一直如此,且并无争议。
• 时间线——“未来几周”,这将最早可能的到达时间定在2026年9月下旬或10月,而对最晚时间只字未提。
目前流传的其他一切内容,要么是泄密者的说法——Anthropic 并未认可这些说法,而公告在核心要点上与之相矛盾——要么是从 Claude Opus 5.5 推断出来的。两者都应视为未经证实。

具体而言,这个谣言,以及它为何看似可信
退出声明并不愚蠢。它确有真实依据,而理解它,能让你对 Anthropic 的小型层级一直受到的待遇有所了解。
Claude Haiku 4.5 于 2025 年 10 月 15 日发布,定价为每百万输入 token 1 美元、每百万输出 token 5 美元,上下文窗口为 200K token,输出上限为 64K。它是该系列中速度最快的模型,价格也远低于其他模型,定位是在编程和智能体任务上媲美上一代 Sonnet,而成本大约只有后者的三分之一。
随后,这一层级归于沉寂。从 2025 年 10 月的 Haiku 4.5 到 2026 年 9 月 Opus 5.5 发布——十一个月里——Claude 的其他每个层级都至少更新了两次。Opus 依次走过 4.5、4.6、4.7、4.8、5、5.5。Sonnet 经历了 4.5、4.6、5。Fable 则作为一个全新的顶级层级登场。Haiku 却纹丝未动。在同一时间段内,Anthropic 对 Haiku 4.5 的退役承诺顺延为“不早于 2026 年 10 月 15 日”——截至本文撰写时,这个日期距今约三周。
一个曾经大约每六个月更新一次的层级,出现了长达十一个月的空档,再加上退场倒计时即将走完,这恰恰是一条产品线在走向终结时呈现出的样子。这就是那次泄露所传达的判断。这个判断合情合理。但它同样是错的,而且更正来自厂商,而不是来自第二个泄密者。
Haiku 5.5 几乎必然将从 Claude Opus 5.5 继承的内容
本节内容为推断。之所以如此标注,是因为Anthropic未确认其中任何一点,而且与上一层级进行类比是唯一可用的信号来源。
Anthropic 关于“许多相同的改进”的承诺提供了一个起点清单。Claude Opus 5.5 发布时带有四项特性,读者可以将其与当前的小模型进行对照核查:
• 价格方向——Claude Opus 5.5 每百万输入 $4 / 输出 $20,低于 Claude Opus 5 的 $5 / $25,缓存读取费用从 $0.50 降至 $0.20。旗舰型号降价 20%,让较小档位也相应降价显得合理。这并不是承诺,公告中也没有任何内容表明这一点。
• 自适应思考 — Claude Opus 5.5 不接受 thinking: {"type": "disabled"}或固定的 budget_tokens;两者都会返回 400。思考始终开启,由 effort 来控制。如今的 Claude Haiku 4.5 则恰恰相反:它使用旧版的手动 {"type": "enabled", "budget_tokens": N}形式,而且完全没有 effort 参数。
• 上下文窗口——Claude Opus 5.5 保持 100 万 token 的上下文,最大输出 128K。Claude Haiku 4.5 则是 20 万,输出 64K。跃升至 100 万,是唯一最能改变小尺寸层级擅长什么的改动,也是谁都不该假定会发生的那一项。
• 安全保障措施 — Claude Opus 5.5 可在更广泛的类别范围内返回一个 拒绝停止原因,其中生物学类请求会路由至 Claude Opus 5,而大多数网络安全类请求则路由至 Claude Opus 4.8。小型层级究竟是继承相同的分类器,还是采用更轻量的一组,目前尚不清楚。
如果你正基于“Haiku 5.5 是更便宜、上下文窗口更小的 Claude Opus 5.5”这一假设来规划迁移,那你就是在依据一个类比做规划。这个类比是现有最好的,但它并不是证据。
为什么档位比旗舰更重要
旗舰发布获得报道,小型模型获得流量,这是一种值得指出的错配。
Claude Haiku 4.5 正是运行在那些模型调用每天发生数十万次、而每 token 价格就是整个产品决策的地方的模型:分类、提取、路由、摘要、级联中的低成本首轮处理,以及替昂贵模型读取文件、使其不必亲自处理的子代理。Anthropic 自己对它的定位是:拥有接近前沿智能的最快模型,而延迟表现也印证了这一点——独立测量显示,其输出速度约为每秒 86 个 token,首 token 时间为 0.65 秒,这两项指标都快于其价格区间内非推理模型的中位数。
相比之下,Haiku 4.5 并非前沿模型,也不假装自己是。其独立的 Artificial Analysis Intelligence Index 得分为 15,在该榜单的 61 个模型中排名第 28 位,并被标记为估计值。正是这个数字让 5.5 的这次更新变得有趣,而不是例行公事:如果小模型档位能取得类似 Claude Opus 5.5 那样的能力跃升,它就会改变高吞吐量工作的性价比底线,而许多生产管线恰恰建立在这一底线之上。
对于今天的读者来说,实际的问题不是要不要等,而是等待要付出什么代价。如果你正在基于 Haiku 4.5 构建,十一个月的间隔已经回答了该层级是否足够稳定、值得依赖——厂商刚刚已经告诉你了。如果你为了 Haiku 5.5 而推迟迁移,那你是在为一个没有公布日期、也没有公布规格的模型而拖延,这比先基于现有版本发布、等新版本落地后再迁移的处境更糟。
将你拥有的小规格与它上面的那些规格并排运行

Haiku 更新之所以值得从路由视角而非模型评测视角来关注,原因在于真正有意思的决策很少是"用哪个模型",而是"哪一次调用该用哪个模型"。把简单的 80% 交给小模型、其余逐步升级的级联方案,是标准成本打法,而它只有在两个层级都能从同一处、用同一套凭证访问时才成立。
Claude Haiku 4.5 已上线 OrcaRouter,采用 Anthropic 的标价,Claude Opus 5 和 Claude Sonnet 5 也是如此——三者共用一个 API 密钥,且0% 加价,也就是说按提供商的标价原样透传,而非加价。当供应商降价时,这一降价当天就会在我们这边生效;对于你调用上百万次的层级,这比调用一百次的层级重要得多。具体到级联场景,路由 DSL让你能把各个层级组合成一次调用,使升级逻辑存在于路由中,而不是在你的应用里,而自动故障转移意味着某个提供商的一个糟糕下午不会把整条流水线一起拖垮。
两点坦诚的说明。Claude Opus 5.5 本身并不在 OrcaRouter 上——最新的档位并不总是最新的路由,我们宁愿把这一点讲明,也不愿让人产生相反的暗示。而 Haiku 5.5 完全无法路由,因为它尚不存在。如今可调用的模型,就是上面列出的这些。
注意事项(按顺序)
当 Haiku 5.5 真的到来时,四个事实将解答几乎所有悬而未决的问题,而它们会以可预测的顺序出现。
• 模型 ID 和上下文窗口,来自 Anthropic 的模型概览页面——形如 claude-haiku-5-5的无日期 ID 将符合 4.6 代及之后的命名惯例,而 100 万 token 的上下文窗口则会是最大亮点。
• 价目表。这一档位存在的全部理由就在于它的价格。高于 $1/$5 的数字会是重新定位;等于或低于它的数字则是直接的提升。
• 思考是否仅支持自适应模式。如果 Haiku 5.5 拒绝 budget_tokens,就像 Claude Opus 5.5 那样,那么对于当前所有设置了该参数的集成来说,这都是一个破坏性变更,而且这类问题只有实际运行时才会暴露出来。
• 独立评分。从历史来看,该层级的厂商基准相比独立评测机构测得的结果一向更为宽松,因此首次进入 Artificial Analysis 排名比发布时的成绩表更有价值。
在这些出现之前,准确的说法是那个乏味的版本:Anthropic 表示 Claude Haiku 5.5 将在未来几周推出,但没有说明它是什么,而那条称它已被取消的泄露消息是错的。最后这一点才是新闻。其余的都只是时间表。
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
