一张生成的主视觉标题卡,带有徽标“已在 GitHub Copilot 中正式可用 - 2026 年 10 月 7 日”,配有肩题“模型可用性报告”,标题为“GitHub Copilot 中的 Claude Haiku 5.5”,副标题为“每 token 成本比它所取代的 Haiku 便宜十倍——直到单次请求超过 100,000 个 token”,还有三个标签,分别写着“每百万 $0.10 / $0.50”、“1 AI 积分 = $0.01”和“Pro:每月 1,500 积分”,以及三张卡片,分别写着“短层级:低于 100K token”、“长层级:所有费率均为 5 倍”和“尚未加入我们的目录:Claude Haiku 4.5 是”。
Guides & Insights

Claude Haiku 5.5 现已登陆 GitHub Copilot:最便宜的 Anthropic 模型在额度预算内成本几何

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

Claude Haiku 5.5 于 2026 年 10 月 7 日出现在 GitHub Copilot 的模型选择器中——与厂商发布它的同一天——而宣布这一消息的更新日志条目,把大部分篇幅都花在了各种接入界面上。Visual Studio Code、Visual Studio、Copilot CLI、GitHub Copilot 云代理、Copilot 应用、github.com、iOS 和 Android 上的 GitHub Mobile、JetBrains 系列 IDE、Xcode、Eclipse。如果你管着预算,真正要紧的那句话反倒更短:该模型“在按用量计费的模式下,按提供商标价”计费。在 Copilot 内部,这意味着 AI 点数,而 Claude Haiku 5.5 的费率足够低,以至于点数算术成了这次发布中有意思的部分,而不是事后才想起的补充。本文就来算这笔账,把 GitHub 真正展示出来的东西与它仅仅声称的东西区分开,并覆盖厂商自家文档中两处例外条款——发布报道大多略过了它们。

GitHub 发布了什么,以及向谁发布

这条条目的标题很直白,就叫《Claude Haiku 5.5 现已登陆 GitHub Copilot》,发布于太平洋时间 10 月 7 日 13:12。Copilot Pro、Pro+、Max、Business 和 Enterprise 订阅用户均可使用——也就是说,所有付费档位都能用,而值得注意的是,免费档不在此列;在免费档中,模型选择仍由系统自动完成,而非由用户自行选择。此次推送是逐步进行的,因此你编辑器里的选择器可能比更新日志晚上几天;这一点在条目中已写明,而不是留给你自己去发现。

GitHub 自己对这一模型用途的界定值得仔细阅读,因为它比供应商的界定更狭窄:

• 快速、高吞吐量的工作 — 子代理、快速编辑和终端任务,用 GitHub 自己的话说 • 定位不是替代选择器中的大型模型,而是作为它们下方的廉价层级 • 根据 GitHub 的支持模型参考,已全面可用,其中将 Claude Haiku 5.5 列为全面可用,状态为 GA • 同一参考中还列有一行标记为 TBD 的 IDE 版本,这正是从编辑器端看推出过程显得渐进的实际原因 • 按使用量计费,采用提供商列表价格,而非 Copilot 专属加价img src="2.png"> p>周边更新日志的日期提供了单个模型页面无法给出的节奏背景。Claude Sonnet 5.5 于 9 月 28 日登陆 Copilot,Claude Opus 5.5 于 9 月 22 日,Claude Fable 5.1 于 9 月 1 日。Anthropic 大约每两到四周发布一次 Copilot 集成,而 GitHub 每次都在几天内完成整合。这种节奏也是为什么这件事有时间限制:GitHub 在 9 月中旬发布了针对“部分 GitHub Copilot 模型”的弃用通知,时间为 10 月中旬,随后在 10 月 2 日发布后续确认移除。如果你的团队在 Copilot 配置中固定了某个模型,那么现在最容易出问题的就是这个固定项,而不是价格。

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

将费率卡作为信用账本解读

Claude Haiku 5.5 按两个层级计费,切换依据是请求大小,而不是你选择的任何设置。以下全部是官方价目表,所有价格均按每百万计:

• 输入为 100,000 tokens 或以下时 — 输入 $0.10,缓存输入 $0.01,缓存写入 $0.125,输出 $0.50 • 输入超过 100,000 tokens 时 — 输入 $0.50,缓存输入 $0.05,缓存写入 $0.625,输出 $2.50 • Claude Haiku 4.5,作为对比 — 输入 $1.00,缓存输入 $0.10,缓存写入 $1.25,输出 $5.00 • 更高一档的 Claude Sonnet 5.5 — 输入 $2.00,缓存输入 $0.10,缓存写入 $2.50,输出 $10.00 • 在 Anthropic 模型上,缓存写入是在缓存输入之外另行单独计费的 — 而这一计费项并非选择器中的每家供应商都有 img src="3.png"> p>把这几行放在一起看,会得出两点。第一,Claude Haiku 5.5 的短上下文档位在输入和输出上都恰好比 Claude Haiku 4.5 便宜十倍,在输入上则大约比 Claude Sonnet 5.5 便宜二十倍——这正是它适合放在子代理位置上的全部原因:在那里,一大批小型调用会把你每次调用的花费成倍放大。第二,长上下文档位在每一项费率上都恰好是短上下文档位的五倍,而且分界线同样是 100,000 tokens。一个 99,000 tokens 的请求和一个 101,000 tokens 的请求,在越过这条线的那些 tokens 上相差的并不是 2%,而是在所有这些 tokens 上都相差五倍。这个阶梯直接继承自 Anthropic 的标价,而 Copilot 的额度体系并不会把它抹平。

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

现在来说点数。Copilot 基于用量的计费按每点数 0.01 美元的公开费率将模型使用量转换为 AI 点数,每个套餐每月都包含一定额度:

• Copilot Pro,每月 10 美元——1,500 额度,标注为 1,000 基础额度加 500 灵活额度 • Copilot Pro+,每月 39 美元——7,000 额度,标注为 3,900 基础额度加 3,100 灵活额度 • Copilot Max,每月 100 美元——20,000 额度,标注为 10,000 基础额度加 10,000 灵活额度 • Copilot Business,每席位每月 19 美元——每位用户 1,900 额度 • Copilot Enterprise,每席位每月 39 美元——每位用户 3,900 额度 • 组织与企业额度池在各席位之间共享,而非按用户割裂 • 超出额度池的使用按每额度 0.01 美元计费——同一换算,适用于超额部分 • 代码补全与下一次编辑建议完全不在额度计费范围内,在付费方案中保持不限量p>把两者放在一起,这次发布的全貌就变得具体了。以一个中等规模的智能体步骤为例——40,000 个输入 token,2,000 个输出 token,无缓存。在 Claude Haiku 5.5 的短档价位下,就是 40,000 乘以每百万 0.10 美元,加上 2,000 乘以每百万 0.50 美元,合计 0.005 美元,按文档给出的换算即半个额度。同样的调用若按 Claude Haiku 4.5 的费率计算,则为 0.05 美元,即五个额度。这里的算术是我们自己算的,不是 GitHub 的,但输入数据全部来自公开的费率表,而结论并不微妙:Pro 订阅用户的 1,500 额度池在新 Haiku 上大约能容纳 3,000 次此类调用,而在旧版上大约只能容纳 300 次。订阅不变,额度池的续航却延长了十倍。

这就是诚实的价值主张,同时也伴随着一个坦诚的提醒:额度池是以积分而非美元计价的,因此只要费率卡有变动,套餐的实际上限就会随之变化。如果你的流量分散在三个模型上,那么单个模型降价十倍并不会让额度池扩大十倍。

GitHub声称该模型能做什么,以及它尚未展示什么

更新日志中只有一条性能声明,而它在报道中承担的分量已经超出了其所能承受的范围。GitHub 写道,在早期测试中,Claude Haiku 5.5“在许多编码任务上比肩 Claude Sonnet 5”,同时使用的“token 和步骤显著更少”。

按顺序读那些限定词。这是早期测试。是 GitHub 在自己的任务上做的测试,而且 GitHub 正是销售该集成的一方。没有点名任何评测框架,没有公布任务集,句子的两半都没有配任何数字,而“许多”并不是一个数字。这个说法很可能属实——在 2026 年,一个小模型在狭窄的、工具形态的编码任务上比肩一个大模型,是可能出现的结果——但就目前发布的形式而言,它是厂商的断言,每次被转述时都应该被如此标注。“更少的 token 和步骤”这一半比另一半更经得起时间考验,因为它说的是效率而非能力,而在 Haiku 价格档位上的效率,一周之内就会体现在你自己的使用遥测数据里。能力那一半要想放进幻灯片,得先有第三方评测框架。

Anthropic 自己提供的数据与 GitHub 的数据是各自独立的说法,并带有同样的来源问题。Anthropic 表示,Claude Haiku 5.5 的平均运行成本大约低 75%,并且此前发送给 Haiku 级模型的请求中,大约 90% 的输入低于 100,000 个 token,而该模型在这一区间“尤其具有性价比”。两者都是厂商在描述自家产品的经济性。它们与公布的价目表一致——短上下文档位大幅降价,长上下文档位降幅较小——并且它们作为厂商指导信息有用,而不是作为经过测量的结果。

开启它是由管理员决定的,默认是开启的

更新日志中,Copilot Business 和 Enterprise 买家需要读两遍的部分是访问控制段落。管理员通过 Copilot 设置中的模型策略来管理模型访问权限,而 GitHub 文档记载的默认行为是:除非管理员关闭了全局默认设置或明确禁用了该特定模型,否则新模型会自动启用。默认设置是宽松的;限制需要选择退出。

随之而来有两个后果。如果你的组织有严格的模型治理,Claude Haiku 5.5 可能已经可以被你的开发者选择,而没有任何人以明确名称批准过它。而如果你的组织反而已经禁用了全局默认设置,那么无论变更日志怎么说,该模型都不会出现在你那里——这很可能是任何 Copilot 模型发布后第一周最常见的支持问题的解释。在调试选择器中缺失的条目之前,请先检查模型策略。

Anthropic 的文档指出了两项例外,而发布帖子并未指出。

这两点均出自 Anthropic 的平台文档,而非任何新闻报道;并且二者影响的是你能构建什么,而不是你要支付多少费用:

• Priority Tier 在 Claude Haiku 5.5 上不可用——Anthropic 的服务层级文档已将该模型列入明确的排除名单,与之并列的还有 Claude Sonnet 5.5、Claude Opus 5.5、Claude Fable 5 和 Mythos 系列。如果你假定能在廉价层级上获得预置吞吐量,那么这一假设在这里并不成立。• 标准定价下完整的 100 万 token 上下文窗口被授予“Claude 4.6 及之后的模型(Claude Haiku 5.5 除外)”——这个括号是 Anthropic 自己加的,而 Claude Haiku 5.5 正是被单独剔除在外的唯一一款现行模型。该窗口在模型的规格行中仍标为 1M,最大输出为 128,000 token;这项豁免意味着,你不应把笼统的长上下文定价保证视作适用于该模型。• 分词器变了。Anthropic 表示,Claude 4.7 及之后的模型使用更新的分词器,同一段文本会产生约多 30% 的 token,这意味着每 token 的价格与你每页文本的价格朝相反方向变动。Claude Haiku 5.5 的规格行把“最快”列为其定位,自适应思考默认为中,知识截止日期为 2026 年 6 月,模型 ID 为 claude-haiku-5-5。

对于 GitHub 让该模型瞄准的子代理和快速编辑工作负载来说,这些都不是致命缺陷。它们决定了你是引用发布帖还是引用文档,而后者才是能在负载测试中经得起考验的东西。

如果你宁愿将其路由,也不愿切换工具

从你自己的技术栈中调用 Claude Haiku 5.5,而不只是通过聊天加编辑器的订阅来使用,是有合理理由的:你可以直接获得短档的原始费率,中间不经过额度换算,而且路由决策也留在你自己的代码里。可用性方面,直说就是:Anthropic 通过 Claude Platform 以及 Amazon Bedrock、Vertex AI 和 Microsoft Azure 销售该模型——而它目前还未上架我们的目录。OrcaRouter 目前提供 Claude Haiku 4.5、Claude Sonnet 5.5、Claude Opus 5.5 和 Claude Fable 5.1,整个目录刚过 200 款模型,而 Claude Haiku 5.5 并不在其中。就现阶段而言,要使用这个模型本身,请直接联系 Anthropic 或上述三家云服务商。

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

我们真正契合的,是围绕它的那一层。OrcaRouter 以零加价透传供应商的目录价,因此当厂商调整某个模型的定价——就像 Anthropic 对这款模型所做的那样——新费率当天就在我们这边生效,而不是等到一个计费周期之后。自动故障转移意味着一次出错的经济型调用会落到可用的路由上,而不是让请求失败;对于要发起成千上万次小调用的子代理集群来说,这比单个交互式会话重要得多。而路由 DSL 的存在,恰恰就是为了应对这次发布所带来的那类决策形态:把短小、高频的工作交给阈值以下最便宜的模型,把长上下文的工作交给阈值以上最便宜的模型,全部经由一个端点、一张账单完成,而不是把这种拆分硬编码进两套集成里。如果 Haiku 5.5 出现在目录中,它会直接套用这套策略,无需改动代码。

在下一次冲刺之前,这个该怎么处理?

狭义地看,Anthropic 目前最便宜的模型现在可在每一个付费 Copilot 档位中选用,而且按 token 计算,其成本大约只有在短档位上被它取代的 Haiku 的十分之一。如果你的团队正通过 Copilot 运行子智能体或终端形态的自动化,那么切换模型只是一项设置改动,却会对每月额度能撑多久产生巨大而立竿见影的影响。

最先值得核查的两件事,恰恰是公告里藏起来没说清的那两件。先看你请求大小的第95百分位:如果它高于 100,000 个 token,那你实际计费所处的档位就是第二档,所谓的十倍对比其实只有五倍。再看你所在组织的模型策略是否开启了全局默认——对于 Business 和 Enterprise 席位,就是这一个设置,决定了你的开发者到底能不能用上这次发布的功能。

以零加价透传提供商标价