
Claude Haiku 5.5 现已登陆 GitHub Copilot:最便宜的 Anthropic 模型在额度预算内成本几何
- Orca新Orca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 每百万 tokens · 71 tok/s
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
Claude Haiku 5.5 于 2026 年 10 月 7 日出现在 GitHub Copilot 的模型选择器中——与厂商发布它的同一天——而宣布这一消息的更新日志条目,把大部分篇幅都花在了各种接入界面上。Visual Studio Code、Visual Studio、Copilot CLI、GitHub Copilot 云代理、Copilot 应用、github.com、iOS 和 Android 上的 GitHub Mobile、JetBrains 系列 IDE、Xcode、Eclipse。如果你管着预算,真正要紧的那句话反倒更短:该模型“在按用量计费的模式下,按提供商标价”计费。在 Copilot 内部,这意味着 AI 点数,而 Claude Haiku 5.5 的费率足够低,以至于点数算术成了这次发布中有意思的部分,而不是事后才想起的补充。本文就来算这笔账,把 GitHub 真正展示出来的东西与它仅仅声称的东西区分开,并覆盖厂商自家文档中两处例外条款——发布报道大多略过了它们。
GitHub 发布了什么,以及向谁发布
这条条目的标题很直白,就叫《Claude Haiku 5.5 现已登陆 GitHub Copilot》,发布于太平洋时间 10 月 7 日 13:12。Copilot Pro、Pro+、Max、Business 和 Enterprise 订阅用户均可使用——也就是说,所有付费档位都能用,而值得注意的是,免费档不在此列;在免费档中,模型选择仍由系统自动完成,而非由用户自行选择。此次推送是逐步进行的,因此你编辑器里的选择器可能比更新日志晚上几天;这一点在条目中已写明,而不是留给你自己去发现。
GitHub 自己对这一模型用途的界定值得仔细阅读,因为它比供应商的界定更狭窄:
• 快速、高吞吐量的工作 — 子代理、快速编辑和终端任务,用 GitHub 自己的话说 • 定位不是替代选择器中的大型模型,而是作为它们下方的廉价层级 • 根据 GitHub 的支持模型参考,已全面可用,其中将 Claude Haiku 5.5 列为全面可用,状态为 GA • 同一参考中还列有一行标记为 TBD 的 IDE 版本,这正是从编辑器端看推出过程显得渐进的实际原因 • 按使用量计费,采用提供商列表价格,而非 Copilot 专属加价img src="2.png"> p>周边更新日志的日期提供了单个模型页面无法给出的节奏背景。Claude Sonnet 5.5 于 9 月 28 日登陆 Copilot,Claude Opus 5.5 于 9 月 22 日,Claude Fable 5.1 于 9 月 1 日。Anthropic 大约每两到四周发布一次 Copilot 集成,而 GitHub 每次都在几天内完成整合。这种节奏也是为什么这件事有时间限制:GitHub 在 9 月中旬发布了针对“部分 GitHub Copilot 模型”的弃用通知,时间为 10 月中旬,随后在 10 月 2 日发布后续确认移除。如果你的团队在 Copilot 配置中固定了某个模型,那么现在最容易出问题的就是这个固定项,而不是价格。

将费率卡作为信用账本解读
Claude Haiku 5.5 按两个层级计费,切换依据是请求大小,而不是你选择的任何设置。以下全部是官方价目表,所有价格均按每百万计:
• 输入为 100,000 tokens 或以下时 — 输入 $0.10,缓存输入 $0.01,缓存写入 $0.125,输出 $0.50 • 输入超过 100,000 tokens 时 — 输入 $0.50,缓存输入 $0.05,缓存写入 $0.625,输出 $2.50 • Claude Haiku 4.5,作为对比 — 输入 $1.00,缓存输入 $0.10,缓存写入 $1.25,输出 $5.00 • 更高一档的 Claude Sonnet 5.5 — 输入 $2.00,缓存输入 $0.10,缓存写入 $2.50,输出 $10.00 • 在 Anthropic 模型上,缓存写入是在缓存输入之外另行单独计费的 — 而这一计费项并非选择器中的每家供应商都有 img src="3.png"> p>把这几行放在一起看,会得出两点。第一,Claude Haiku 5.5 的短上下文档位在输入和输出上都恰好比 Claude Haiku 4.5 便宜十倍,在输入上则大约比 Claude Sonnet 5.5 便宜二十倍——这正是它适合放在子代理位置上的全部原因:在那里,一大批小型调用会把你每次调用的花费成倍放大。第二,长上下文档位在每一项费率上都恰好是短上下文档位的五倍,而且分界线同样是 100,000 tokens。一个 99,000 tokens 的请求和一个 101,000 tokens 的请求,在越过这条线的那些 tokens 上相差的并不是 2%,而是在所有这些 tokens 上都相差五倍。这个阶梯直接继承自 Anthropic 的标价,而 Copilot 的额度体系并不会把它抹平。

现在来说点数。Copilot 基于用量的计费按每点数 0.01 美元的公开费率将模型使用量转换为 AI 点数,每个套餐每月都包含一定额度:
• Copilot Pro,每月 10 美元——1,500 额度,标注为 1,000 基础额度加 500 灵活额度 • Copilot Pro+,每月 39 美元——7,000 额度,标注为 3,900 基础额度加 3,100 灵活额度 • Copilot Max,每月 100 美元——20,000 额度,标注为 10,000 基础额度加 10,000 灵活额度 • Copilot Business,每席位每月 19 美元——每位用户 1,900 额度 • Copilot Enterprise,每席位每月 39 美元——每位用户 3,900 额度 • 组织与企业额度池在各席位之间共享,而非按用户割裂 • 超出额度池的使用按每额度 0.01 美元计费——同一换算,适用于超额部分 • 代码补全与下一次编辑建议完全不在额度计费范围内,在付费方案中保持不限量p>把两者放在一起,这次发布的全貌就变得具体了。以一个中等规模的智能体步骤为例——40,000 个输入 token,2,000 个输出 token,无缓存。在 Claude Haiku 5.5 的短档价位下,就是 40,000 乘以每百万 0.10 美元,加上 2,000 乘以每百万 0.50 美元,合计 0.005 美元,按文档给出的换算即半个额度。同样的调用若按 Claude Haiku 4.5 的费率计算,则为 0.05 美元,即五个额度。这里的算术是我们自己算的,不是 GitHub 的,但输入数据全部来自公开的费率表,而结论并不微妙:Pro 订阅用户的 1,500 额度池在新 Haiku 上大约能容纳 3,000 次此类调用,而在旧版上大约只能容纳 300 次。订阅不变,额度池的续航却延长了十倍。
这就是诚实的价值主张,同时也伴随着一个坦诚的提醒:额度池是以积分而非美元计价的,因此只要费率卡有变动,套餐的实际上限就会随之变化。如果你的流量分散在三个模型上,那么单个模型降价十倍并不会让额度池扩大十倍。
GitHub声称该模型能做什么,以及它尚未展示什么
更新日志中只有一条性能声明,而它在报道中承担的分量已经超出了其所能承受的范围。GitHub 写道,在早期测试中,Claude Haiku 5.5“在许多编码任务上比肩 Claude Sonnet 5”,同时使用的“token 和步骤显著更少”。
按顺序读那些限定词。这是早期测试。是 GitHub 在自己的任务上做的测试,而且 GitHub 正是销售该集成的一方。没有点名任何评测框架,没有公布任务集,句子的两半都没有配任何数字,而“许多”并不是一个数字。这个说法很可能属实——在 2026 年,一个小模型在狭窄的、工具形态的编码任务上比肩一个大模型,是可能出现的结果——但就目前发布的形式而言,它是厂商的断言,每次被转述时都应该被如此标注。“更少的 token 和步骤”这一半比另一半更经得起时间考验,因为它说的是效率而非能力,而在 Haiku 价格档位上的效率,一周之内就会体现在你自己的使用遥测数据里。能力那一半要想放进幻灯片,得先有第三方评测框架。
Anthropic 自己提供的数据与 GitHub 的数据是各自独立的说法,并带有同样的来源问题。Anthropic 表示,Claude Haiku 5.5 的平均运行成本大约低 75%,并且此前发送给 Haiku 级模型的请求中,大约 90% 的输入低于 100,000 个 token,而该模型在这一区间“尤其具有性价比”。两者都是厂商在描述自家产品的经济性。它们与公布的价目表一致——短上下文档位大幅降价,长上下文档位降幅较小——并且它们作为厂商指导信息有用,而不是作为经过测量的结果。
开启它是由管理员决定的,默认是开启的
更新日志中,Copilot Business 和 Enterprise 买家需要读两遍的部分是访问控制段落。管理员通过 Copilot 设置中的模型策略来管理模型访问权限,而 GitHub 文档记载的默认行为是:除非管理员关闭了全局默认设置或明确禁用了该特定模型,否则新模型会自动启用。默认设置是宽松的;限制需要选择退出。
随之而来有两个后果。如果你的组织有严格的模型治理,Claude Haiku 5.5 可能已经可以被你的开发者选择,而没有任何人以明确名称批准过它。而如果你的组织反而已经禁用了全局默认设置,那么无论变更日志怎么说,该模型都不会出现在你那里——这很可能是任何 Copilot 模型发布后第一周最常见的支持问题的解释。在调试选择器中缺失的条目之前,请先检查模型策略。
Anthropic 的文档指出了两项例外,而发布帖子并未指出。
这两点均出自 Anthropic 的平台文档,而非任何新闻报道;并且二者影响的是你能构建什么,而不是你要支付多少费用:
• Priority Tier 在 Claude Haiku 5.5 上不可用——Anthropic 的服务层级文档已将该模型列入明确的排除名单,与之并列的还有 Claude Sonnet 5.5、Claude Opus 5.5、Claude Fable 5 和 Mythos 系列。如果你假定能在廉价层级上获得预置吞吐量,那么这一假设在这里并不成立。• 标准定价下完整的 100 万 token 上下文窗口被授予“Claude 4.6 及之后的模型(Claude Haiku 5.5 除外)”——这个括号是 Anthropic 自己加的,而 Claude Haiku 5.5 正是被单独剔除在外的唯一一款现行模型。该窗口在模型的规格行中仍标为 1M,最大输出为 128,000 token;这项豁免意味着,你不应把笼统的长上下文定价保证视作适用于该模型。• 分词器变了。Anthropic 表示,Claude 4.7 及之后的模型使用更新的分词器,同一段文本会产生约多 30% 的 token,这意味着每 token 的价格与你每页文本的价格朝相反方向变动。Claude Haiku 5.5 的规格行把“最快”列为其定位,自适应思考默认为中,知识截止日期为 2026 年 6 月,模型 ID 为 claude-haiku-5-5。
对于 GitHub 让该模型瞄准的子代理和快速编辑工作负载来说,这些都不是致命缺陷。它们决定了你是引用发布帖还是引用文档,而后者才是能在负载测试中经得起考验的东西。
如果你宁愿将其路由,也不愿切换工具
从你自己的技术栈中调用 Claude Haiku 5.5,而不只是通过聊天加编辑器的订阅来使用,是有合理理由的:你可以直接获得短档的原始费率,中间不经过额度换算,而且路由决策也留在你自己的代码里。可用性方面,直说就是:Anthropic 通过 Claude Platform 以及 Amazon Bedrock、Vertex AI 和 Microsoft Azure 销售该模型——而它目前还未上架我们的目录。OrcaRouter 目前提供 Claude Haiku 4.5、Claude Sonnet 5.5、Claude Opus 5.5 和 Claude Fable 5.1,整个目录刚过 200 款模型,而 Claude Haiku 5.5 并不在其中。就现阶段而言,要使用这个模型本身,请直接联系 Anthropic 或上述三家云服务商。

我们真正契合的,是围绕它的那一层。OrcaRouter 以零加价透传供应商的目录价,因此当厂商调整某个模型的定价——就像 Anthropic 对这款模型所做的那样——新费率当天就在我们这边生效,而不是等到一个计费周期之后。自动故障转移意味着一次出错的经济型调用会落到可用的路由上,而不是让请求失败;对于要发起成千上万次小调用的子代理集群来说,这比单个交互式会话重要得多。而路由 DSL 的存在,恰恰就是为了应对这次发布所带来的那类决策形态:把短小、高频的工作交给阈值以下最便宜的模型,把长上下文的工作交给阈值以上最便宜的模型,全部经由一个端点、一张账单完成,而不是把这种拆分硬编码进两套集成里。如果 Haiku 5.5 出现在目录中,它会直接套用这套策略,无需改动代码。
在下一次冲刺之前,这个该怎么处理?
狭义地看,Anthropic 目前最便宜的模型现在可在每一个付费 Copilot 档位中选用,而且按 token 计算,其成本大约只有在短档位上被它取代的 Haiku 的十分之一。如果你的团队正通过 Copilot 运行子智能体或终端形态的自动化,那么切换模型只是一项设置改动,却会对每月额度能撑多久产生巨大而立竿见影的影响。
最先值得核查的两件事,恰恰是公告里藏起来没说清的那两件。先看你请求大小的第95百分位:如果它高于 100,000 个 token,那你实际计费所处的档位就是第二档,所谓的十倍对比其实只有五倍。再看你所在组织的模型策略是否开启了全局默认——对于 Business 和 Enterprise 席位,就是这一个设置,决定了你的开发者到底能不能用上这次发布的功能。
