为文章生成的主视觉标题卡,顶部是一枚琥珀色胶囊徽章,上书“OPENCODE GO 全新上线”,引题是“ANTHROPIC,2026 年 10 月 7 日”,标题“Claude Haiku 5.5 登陆 10 美元编程套餐”位于副标题“降价 90%,$15 额度按用量计量,超过 100,000 token 后费率跳升 5 倍”之上,另有一行四枚描边标签,分别写着“输入 $0.10”“输出 $0.50”“3,850 次请求 / 5 小时”和“每月 $15 额度”,下方是两张圆角卡片——“砍掉了什么”写着“对于不超过 100,000 token 的提示词,输入从 $1.00 降至 $0.10,输出从 $5.00 降至 $0.50”,以及以浅琥珀色描边的“套餐如何计量”,写着“10 美元套餐每月 $15 的 token 额度,按 Anthropic 标价计费”——页脚一行为“Anthropic 定价与 OpenCode Go 文档,读取于 2026 年 10 月 8 日。”OrcaRouter 标志合成在右下角。
Guides & Insights

OpenCode 中的 Claude Haiku 5.5:每月 10 美元究竟能换来什么

作者

Gideon Frost

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

Ant​hropic 于 Claude Haiku 5.52026 年 10 月 7 日发布,不到一天就被列入 OpenCode 的 Go 与 Zen 目录——这些编码智能体订阅按月计量美元额度,而非按 token 计费。第二个上架才是值得停下来细看的地方,因为 OpenCode 为 Claude Haiku 5公布的额度并不是该模型的折扣。它是一台按 Ant​hropic 自家标价设定的预算计量表,而其背后的每一个数字都能对照公布它的那两个页面来核实。如果你还在犹豫该用什么来替代 Claude Haiku 4.5,那么决定因素是额度,而不是标价。

The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.

Anthropic 在10月7日公开发表了什么

厂商并没有悄无声息地发布这款产品。Anthropic 的新闻中心发布了带日期的公告、附有基准测试表的产品页面、系统卡、定价表,以及六条具名的客户评价。既没有可供查验的代码仓库,也没有权重发布,因为根本没有什么可发布的:Artificial Analysis 将 Claude Haiku 5.5记录为专有模型,参数数量未予披露。任何把这描述为泄露或未公布模型的人,都是在阅读一个并不存在的代码仓库。

Anthropic 自己的定位是走量型模型,而非前沿模型:

• 定位——"我们迄今为止发布过的、最便宜、最快且能力最强的小模型",面向摘要、上下文压缩、数据库查询与分类等场景,并被宣传为一款子代理,可在编码工作中与 Claude Opus 5.5 和 Claude Sonnet 5.5 配合使用。

• 价格——对于不超过 100,000 个令牌的提示,每百万输入令牌 $0.10,每百万输出令牌 $0.50;超过此数量则为 $0.50 和 $2.50。缓存读取 $0.01 / $0.05,缓存写入 $0.125 / $0.625。

• 上下文与输出——100 万 token 的窗口,最大输出 128,000 token,与更大的 5.5 级模型相同的规格,却在最便宜的档位上复现。

• Effort(努力程度)—— 首个具备可调努力设置的 Haiku 级模型,范围从 Low 到 Max,默认 medium。Anthropic 会公布每种设置下的准确率-成本曲线,而非单一数值。

• 基准测试,由厂商自行报告,未经独立复现 —— GDPval-AA v2.1 为 1620,对比 Claude Haiku 4.5 的 735;AA-Briefcase v1.1 为 1578,对比 614;OSWorld 2.1 为 72.4%,对比 15.7%;Humanity's Last Exam 无工具时为 45.9%、有工具时为 57.4%,对比 10.2% 和 18.7%;Terminal-Bench 4.0 为 39.2%,对比 0.0%;Chartography 为 46.4%,对比 6.4%。

• 厂商自己给出的上限——Anthropic 对其 Terminal-Bench 图表的评论称,Claude Sonnet 5.5 和 Claude Opus 5.5“在复杂的智能体编程任务中仍是更好的选择”。同一篇文章中的客户引述来自早期访问合作伙伴,描述的是他们自己的评估,而非审计:Asana 报告延迟降低超过 30%,每个智能体轮次的推理速度最高提升至 2.5 倍;HubSpot 为三次运行的平均值 92.8%;AlphaSense 在约每周 800 万次调用的工作负载上,400 次查询中取得 0.84 对 0.76 的成绩;Box 在延迟约为一半的情况下高出 11 个百分点;Cognition 的 FrontierCode 得分为 66.2,Haiku 5.5 作为辅助搭档。

Generated two-column scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 — Anthropic's own harness'. The left column, 'Claude Haiku 5.5', reads GDPval-AA v2.1: 1620, AA-Briefcase v1.1: 1578, OSWorld 2.1: 72.4%, Humanity's Last Exam: 45.9%, Terminal-Bench 4.0: 39.2%, Chartography: 46.4%. The right column, 'Claude Haiku 4.5', reads GDPval-AA v2.1: 735, AA-Briefcase v1.1: 614, OSWorld 2.1: 15.7%, Humanity's Last Exam: 10.2%, Terminal-Bench 4.0: 0.0%, Chartography: 6.4%. A footer line reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.' The OrcaRouter logo is composited in the bottom-right corner.

Anthropic 还借这次发布调整了两项相邻的价格:Claude Sonnet 5.5 的缓存读取费用减半至每百万 token 0.10 美元,公司称这使 Sonnet 5.5 在大多数智能体任务上便宜约 20%;同时为 Claude Max 和 Team 订阅者新增每月 API 额度。这两项变化都属于更高一档的调整,而且对于已经统一采用 Sonnet 的团队来说,它们的重要性都超过任何正在挑选小型模型的人。

补贴是一美元,而不是折扣。

这里是公告推文没有提到的那部分。OpenCode 的 Go 文档指出,“使用限额以月度美元金额定义”,两种套餐的 token 定价相同,并且每个模型的额度按固定时间表递减:每五小时为月度限额的 20%,每周 50%,每月 100%。该文档还公布了它为此模型假设的每请求 token 配置——1,100 个输入 token、55,000 个缓存 token、240 个输出 token。

把那些按 Ant​hropic 的标价和公布的请求数算一遍,就不再像是任意分摊了:

• 按标价计算的每请求成本 — 1,100 个输入(按 $0.10/M)加上 55,000 次缓存读取(按 $0.01/M)再加上 240 个输出(按 $0.50/M),总计为 $0.00078。

• 每月请求数——15 美元除以 0.00078 美元等于 19,230,这正是文档中给出的数字。40 美元套餐的 60 美元额度折算下来是 76,923,而文档中给出的是 76,920。

• 减量方案——19,230 的 20% 是 3,846,标示为每五小时 3,850;50% 是 9,615,标示为每周 9,620。Go Plus 也遵循相同算法,对应 15,380 和 38,460。

• 换算成美元意味着什么——在 10 美元套餐中,该额度价值 15 美元的按 Anthropic 定价的 token,在 40 美元套餐中则价值 60 美元。因此,如果你把全部额度都花在Claude Haiku 5.5上,而不花在其他任何地方,10 美元的订阅每月最多只能购买价值 15 美元的此模型 token。

这才是解读 Go 页面上“New”徽章的诚实方式。订阅很便宜,模型也很便宜,而这两个事实彼此独立:额度是按供应商自身费率计量的预算,因此该套餐限制的是你可以花多少钱,而不是模型的成本有多低。重度用户会触及上限,并直接向 Anthropic 付费——或者自行路由该模型。

Generated single-column card titled 'The $15 allowance, at Anthropic's list price', with six rows reading 'Go plan: $10 per month', 'Claude Haiku 5.5 allowance: $15', 'Cost per request: $0.00078', 'Requests per 5 hours: 3,850', 'Requests per month: 19,230' and 'Above 100,000 tokens: 5x input', over the footer line 'Allowance figures per OpenCode Go documentation; token prices per Anthropic, both read October 8, 2026. Arithmetic is ours.' The OrcaRouter logo is composited in the bottom-right corner.

百分之九十、百分之七十五,以及五倍悬崖

Anthropic 的头条消息是,Claude Haiku 5.5的成本比Claude Haiku 4.5低约 90%,适用于最多 100,000 个 token 的提示词;并且平均而言,它“现在的运行成本降低了约 75%”。这两个数字都出自厂商。它们也都没错,而两者之间的差距正是全部定价风险所在。

在该区间内——输入 $0.10、输出 $0.50,相比之下 Haiku 4.5 则是统一的 $1 和 $5。Anthropic 表示,对其上一代 Haiku 模型的请求中约有 90% 落在这个区间内,90% 这个数字正来源于此。

• 在该档位之上——同一请求的计费为输入 $0.50、输出 $2.50,输入费用上涨了五倍。这仍只是 Haiku 4.5 费率的一半,但远未达到 90% 的降幅。

• 综合口径——75%这个数字是 Anthropic 基于真实流量组合做出的自身估算,并非价目表,它才是应当写进预测里的数字。

• 分词器——与 Claude 4.7 及更高版本共用的这款较新分词器,按照 Ant​hropic 自家文档的说法,对同一段文本会多产生约 30% 的 token,因此按 token 削减并不能一比一地转化为更低的账单。

effort 调节旋钮会放大这一切。因为默认值是 medium,而已发布的曲线最高到 Max,同一个提示词的成本可能高出数倍,具体取决于大多数调用方从未设置的一个参数——而 OpenCode 的请求估算假设在一种隐含设置下采用固定的 token 配置。如果你的提示词接近 100,000 个 token、运行一个有使用上限的子代理,或者你拨动 effort 调节旋钮,那么 90% 这个宣传数字就不是你会看到的数字。

独立委员会就比分达成一致,并指出自身计算有误。

Artificial Analysis 给 Claude Haiku 5.5在其 Intelligence Index v4.3.2 上打出 43 分,测试采用的是该模型的 Max 配置,而榜单中位数为 13;同时测得每秒输出 241.9 个 token,同类模型的中位数为 110.9。同一页面还指出,每项 Intelligence Index 任务的成本为 0.21 美元,并报告该模型在评估期间生成了 4.4 亿个输出 token,而中位数为 1 亿——将其描述为“非常啰嗦”。

冗长程度正是这两个榜单相互作用的地方。上面的配额计算是按 token 计费的,因此一个推理冗长的模型消耗预算的速度会比请求数量所暗示的更快,而 OpenCode 每请求 55,000 个缓存 token 的画像,是一种关于提示缓存的假设,订阅用户未必能复现这一点。Artificial Analysis 页面上的两处披露,比它的标题数字更有价值:43 是 Max 配置下的成绩,而非你什么都不做时得到的 effort 设置;并且该页面明确注明,Claude Haiku 5.5“在更长上下文输入上的定价高出 5 倍,而这一点目前并未反映”在其成本数据中。长上下文的悬崖是真实存在的,而这家独立榜单已经告诉你,它自己的数字里还没有体现这一点。

A screenshot of Anthropic's own Claude Haiku 5.5 product page, showing the date 'OCTOBER 7, 2026' above the heading 'Claude Haiku 5.5', the site sections 'Pricing', 'Performance', 'Safety' and 'Further updates', a 'MODEL ID' field reading 'claude-haiku-5-5', and the top navigation 'Research', 'Policy Commitments', 'Learn' and 'News'.

大多数买家都会跳过的留存条款

OpenCode 的 Go 文档包含一个按模型划分的隐私表,而这就是 Claude Haiku 5.与大多数目录不同之处。供应商自己的说法是零保留,但有例外。该 Go 表中的大多数模型显示“0 天”。这一个显示“30 天”,并注明根据 Anthropic 的数据政策,请求会保留 30 天——与其对 GPT-6 Luna 和 GPT-5.6 Luna 的处理相同,与列表中占大多数的零天行相反。

对于一个编码智能体来说,这意味着提示词、文件路径和粘贴的源代码可能会在上游供应商那里停留一个月,而其所用套餐的营销话术却是零保留。这并不是回避该模型的理由;而是去读那一行条款、而不是只看横幅的理由。与此同时,Ant​hropic 的发布材料中没有任何内容会改变 API 一侧的立场:Claude API 一直提供零数据保留,而对于直接集成,起约束作用的正是模型卡中的保留条款。

哪些是已确认的,哪些不是

已确认的部分既庞大又具体,对于这么新的模型来说这很不寻常。尚未确认的部分则范围更窄,值得明确指出而非一笔带过:

• 已确认——该模型确实存在,仅通过 API 提供,ID 为 claude-haiku-5-5,于 10 月 7 日在 Claude API 以及 Amazon Web Services、Google Cloud 和 Microsoft Azure 上线,价格如上所述,拥有 100 万 token 的上下文窗口、可调节的投入力度,并发布了系统卡。

• 已确认——两个第三方平台在同一天便将其列出,并附有模型 ID、端点与计量配额。

• 未获证实——我们找不到任何独立基准测试复现过该厂商给出的表格。Anthropic 发布博文中的每一个准确率数字都出自 Anthropic 自家的测试框架,而每一条客户评价都来自合作伙伴自我报告的早期测试。

• 未经证实——没有权重、没有代码仓库、没有检查点,也没有许可证可供查看。该模型是闭源的,任何关于其架构或规模的断言都只是推测。

• 尚未确认——平台的请求估算是否在除其假定 token 配置之外的任何情况下仍成立,以及 5 倍长上下文定价是否会(或何时会)体现在独立榜单的成本数字中。

把它与你已经称之为的东西并排运行

这次发布真正带来的实际问题,不是“Haiku 5.5 好不好”——厂商的表格说它好,而 Ant​hropic 之外没人验证过。而是“账单是多少,以及当廉价档位并非这次特定调用的正确档位时,会发生什么”。这两半都是路由问题。

在成本方面,计费表是 token 账单,而不是价签:输入削减 90%,加上大 30% 的分词器,再加上冗长的推理模型,再加上长上下文五倍的跃升,意味着你预测的数字和你支付的数字会分道扬镳,除非你测量自己的提示长度分布。一个在超过 100,000 个 token 后贵 5 倍的模型会奖励压缩——而 Haiku 5.5 本身就被宣传为压缩模型,这是个值得注意的循环。

关于风险,一个尚未经验证的层级,恰恰正是不能把生产路径押在它上面的理由。Claude Haiku 4.5 已按 Anthropic 的标价在 OrcaRouter 上提供,加价 0%,因此旧层级无需新合同,而从新模型回退到已知模型的路线只是一次配置变更,而不是重写。effort 参数是按调用生效的,这意味着同一个端点可以在低 effort 下跑摘要、在高 effort 下跑高难度抽取,而无需维护两套集成——路由 DSL正是为这种决策形态而存在的,而自动故障转移让你能在尚未获得独立数据之前,就把一个刚发布几天的模型放到真实流量前面。目前还不成立的是那件显而易见的事:Claude Haiku 5.5今天并不在我们的路由上,如果你想本周就用上它,你要么直接调用 Anthropic,要么走那个宣布它的平台。

谁应该行动:那些用量属于摘要、分类、压缩和子代理工作的团队——这里适用 90% 区间,而分词器的 30% 是你能消化的算术。谁应该等待:任何提示词经常超过 100,000 个 token 的人,任何在决定采用前需要独立基准测试的人,以及任何其代码不能待在 30 天保留窗口内的人。发布是真的,定价是真的。证明仍然来自供应商。

本文中的对比1

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新