Claude Opus 5.5 定价的标题卡,展示主要费率:每百万输入 token 4.00 美元、每百万输出 token 20.00 美元,以及每百万缓存读取 token 0.20 美元。
Guides & Insights

Claude Opus 5.5 定价:完整价目表、缓存行,以及一项任务究竟要花多少钱

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Claude Opus 5.5的挂牌价为每百万输入 token 4.00 美元,每百万输出 token 20.00 美元,相比Claude Opus 5一直沿用的 5.00 美元/25.00 美元统一下调 20%,缓存读取价格则下降 60%,降至每百万 0.20 美元。这些均为 Ant​hropic 公布的价格,取自 Ant​hropic 自己的定价文档,日期为2026 年 9 月 24 日,即该模型发布两天后。价目表只是其中简单的部分。Ant​hropic 还表示,该模型在典型工作负载下的运行成本“约低 40%”,而这个数字并不在价目表上——它是厂商基于每 token 降价、再叠加模型完成同样工作所耗 token 与轮次更少这一假设所作出的定性描述。本页将二者分开呈现:你今天就能在价目表上核实的每一项费率,以及你无法核实的那一个数字背后的算术。Claude Fable 5.1——即其上一档 10 美元/50 美元的层级——则作为 Ant​hropic 自己所做的对比贯穿全文。

完整费率卡,每一行都与 Anthropic 发布的一致

本节中的所有内容均读取自 Anthropic 于 platform.claude.com 和 claude.com 上发布的定价文档,读取时间为 2026年9月24日。此处内容均非转载自其他文稿。

输入 — 每百万 token 4.00 美元(Anthropic 公布的价格)。

输出 — 每百万 token 收费 $20.00。思考 token 按输出 token 计费,且 Claude Opus 5.5 的自适应思考始终开启,无法禁用。

缓存读取 — 每百万个 token 0.20 美元。Ant​hropic 将其记录为基础输入价格的 0.05 倍,这是其针对该模型单独开列的脚注例外条款。

5 分钟缓存写入 — 每百万 token 收费 $5.00,这是 Anthropic 对表中每款模型统一采用的 1.25 倍基础输入倍率。

1 小时缓存写入 — 每百万 token 8.00 美元,即标准的基准输入价格 2 倍乘数。

Batch API — 双向五折:每百万输入 $2.00、输出 $10.00。Ant​hropic 直接公布折扣后的数字,而不用你自己去减半。

快速模式 — 每百万 token 输入 $8.00、输出 $40.00,恰好是标准价格的两倍。Ant​hropic 的文档将该页面标题定为“Fast mode (research preview)”。

仅限美国境内推理—— 对输入、输出、缓存写入缓存读取施加 1.1 倍乘数,当inference_geo: "us" 被设置时。全局路由(默认)使用标准定价。

上下文与输出上限 —— 在标准定价下提供 100 万 token 的上下文和 128K 的同步输出,且不收取长上下文附加费。Anthropic 表示,90 万 token 的请求与 9 千 token 的请求按相同的每 token 费率计费。在 Batch API 上,输出上限可提升至 300K,前提是使用 output-300k-2026-03-24 beta 标头。

Ant​hropic 还表示,缓存乘数“可与其他定价调整项叠加,例如 Batch API 折扣和数据驻留”——因此,一个经过批处理、缓存且锁定在美国的请求会将这三者相乘,这种算术是复合叠加,而不是相互替代。

以下是两个模型——读者实际上在同一张表上权衡成本的情况:

Claude Opus 5 — 输入 $5.00,输出 $25.00,缓存读取 $0.50,5 分钟缓存写入 $6.25,1 小时缓存写入 $10.00,Batch 模式下为 $2.50/$12.50(Anthropic 公布的价格,读取于 2026-09-24)。

Claude Fable 5.1 — 输入 $10.00,输出 $50.00,缓存读取 $0.25,5 分钟缓存写入 $12.50,1 小时写入 $20.00,在 Batch 上为 $5.00/$25.00(Ant​hropic 公布的价格,查阅于 2026-09-24)。

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

缓存行才是真正决定智能体账单的地方

发布报道把缓存读取当作一个脚注。对于任何会重新发送大前缀的工作负载来说——而大多数编码和智能体工作负载都是如此——它是价格表上最大的单一杠杆。

Anthropic 自己的脚注对这些比率给出了异常明确的说明:在大多数 Claude 模型上,缓存命中和刷新的费用是基础输入价格的 0.1 倍,在 Claude Fable 5.1 上是 0.025 倍,而在 Claude Opus 5.5 上是 0.05 倍。因此,Claude Opus 5.5 的缓存比率比标准比率差一倍,也比 Claude Fable 5.1 的差一倍。

以美元计算,它终究会胜出,而这一点值得牢记于心:当基础利率高出两倍半时,更优的倍数并不能在美元上取胜。

• Claude Fable 5.1 —— 10.00 美元基准价的 2.5%,即0.25 美元/每百万缓存 token。

• Claude Opus 5.5 — 4.00 美元基准价的 5% 为 $0.20/每百万缓存 token。

• Claude Opus 5 — 5.00 美元基准价的 10% 为$0.50/百万缓存 token。

写入操作也存在同样的倒挂。Claude Fable 5.1 将一百万 token 写入 5 分钟缓存收费 $12.50,写入 1 小时窗口收费 $20.00;Claude Opus 5.5 则分别收费 $5.00 和 $8.00。缓存读取是唯一一项 Claude Opus 5.5 尽管比率居中、却在绝对金额上胜过两个同系列模型的地方。

两条规则决定了写入究竟是否值得付费。Anthropic 的文档指出,5 分钟的写入成本为基础输入价格的 1.25 倍,因此一次缓存读取即可回本;而 1 小时的写入成本为基础输入价格的 2 倍,需要两次读取才能回本。此外,缓存与生成它的前缀相绑定:Anthropic 指出,在快速与标准速度之间切换会使缓存失效,因为不同速度的请求不共享缓存前缀。更换模型、努力程度或工具定义也会产生同样的效果。一个更便宜的模型,如果在每次切换时都强制重写前缀,其成本可能高于它所取代的那款昂贵模型。

一个长智能体循环的实际代价究竟有多大

假设一个运行 40 轮的编程代理,每轮都会重新发送 120,000 个 token 的前缀——系统提示、工具模式、文件树——并且每轮从工具结果中新增 1,000 个新的输入 token,每轮产生 800 个输出 token。这里的要点在于替换:把这四个数字中的任意一个改成符合你自己流量的数值,下面的计算仍然成立。

关于 Claude Opus 5.5:

• 缓存写入,一次性 — 120,000 个 token,每百万 $5.00 = $0.60

• 缓存读取,39 轮 — 4,680,000 个 token,每百万 $0.20 = $0.94

• 新输入,40 轮 — 40,000 个 token,按每百万 $4.00 计算 = $0.16

• 输出,40 轮 — 32,000 tokens,按每百万 $20.00 计算 = $0.64

会话总计 — $2.34,其中缓存读取约占 40%。

在 Claude Opus 5 上,相同的 token 数量:缓存写入 $0.75、缓存读取 $2.34、全新输入 $0.20 和输出 $0.80—— $4.09

在 Claude Fable 5.1 上,相同的 token 数量:缓存写入 $1.50、缓存读取 $1.17、全新输入 $0.40、输出 $1.60 —— $4.67

相同的 token 数量、相同的轮次,无需任何效率方面的假设:Claude Opus 5.5 比 Claude Opus 5 低 43%,比 Claude Fable 5.1 低 50%。而在与 Claude Opus 5 相比的 1.75 美元差额中,有 1.40 美元——即节省额的八成——完全来自缓存读取这一项,而不是那个备受关注的输入单价。

现在来跑相反的情形:一次单次调用,20,000 个输入 token、8,000 个输出 token,无缓存。Claude Opus 5.5 的输入费用为 $0.08,输出费用为 $0.16——合计 $0.24。Claude Opus 5 则是 $0.10 加 $0.20——$0.30。这正好就是那 20% 的标价下调,一个点都不多。

所以,仅凭费率卡本身就能带来 20% 到 43% 之间的降幅,具体取决于你的账单中有多少来自缓存读取。任何高于这一区间的说法,都来自 token 计数,而非价格。

Anthropic“运行成本大约便宜 40%”的说法从何而来

Anthropic 的发布材料称,Claude Opus 5.5“在提供服务时所需的算力少于 Opus 5”,并且其测试显示,在默认设置下,它“在典型工作负载上的成本将比 Opus 5 低 40%”。Anthropic 给出的拆解是:该模型“每 token 成本低于 Opus 5,且每项任务使用的 token 更少,两者相抵后净成本下降 40%”。

按其实质来标注它:这是厂商对 Anthropic 所选工作负载平均值的描述,不是经过审计的结果,也不是价格表上公布的费率。可验证的那一半是前半部分——输入和输出优惠 20%,缓存读取优惠 60%,这两项今天都能在价格表上查到。后半部分取决于模型在你的工作负载上消耗更少的 token 和更少的轮次,而这只有实际运行才能核实。

Ant​hropic 为 token 那一半提供的证据,是一组发布时的客户声明。以下所有内容均由厂商发布,描述了厂商及其客户所选择的工作负载:

Box —— 该模型“使用的 token 量只有 Opus 5 的三分之一”,且回答“篇幅缩短 40% 却不失准确性”。

Kiro — 它“在调用次数减少约40%、token用量仅为一半的情况下,解决的问题比Opus 5还多。”

Factory — 它在高强度模式下与 Opus 5 不相上下,同时输出 token 数减少了 20% 到 25%。

GitHub——它"在我们测量的结果中使用的 token 和步骤数属于最少的之一",并且在 VS Code 中"以不到一半的步骤解决了比 Opus 5 更多的终端任务"。

并购分析,一个完整示例——两家虚构的人力资源软件公司,每个模型都要构建一份 Excel 模型和一份高管演示文稿。Anthropic 报告称,Claude Opus 5.5 用 63 分钟完成,而 Claude Opus 5 用了 93 分钟,且“制作成本降低了 50%”。厂商自述,n=1。

独立的反向参照在这里很重要,因为它指向的是相反的方向。Artificial Analysis 在最大努力档位下测得 Claude Opus 5.5 为 每个 Intelligence Index 任务约 119,000 个输出 token,而 Claude Opus 5 在最大努力档位下约为 73,000——token 数量是上升,而非下降。它对这一配置的总结是:Claude Opus 5.5“在每任务成本上与 Opus 5 持平,尽管输出 token 是其 1.6 倍”,其公布的每 Intelligence Index 任务成本为 5.98 美元。这是一项在最大努力档位下进行的独立测量,它并不与 Anthropic 的说法相矛盾——它是努力档位标尺的另一端。

这就引出了一个限制条件,它支配着本节的每一个数字。Anthropic 表示,除非另有说明,其所有 Claude Opus 5.5 结果都使用自适应思考,且处于最大努力。Claude Opus 5.5 默认使用中等努力;Claude Opus 5 默认使用,而同名的级别在两个模型之间并不代表相同的思考预算。因此,一张以最大努力运行的厂商表格,和一张在启用默认回退的情况下以最大努力运行的独立表格,并不是同一种配置,而两者也都不是读者实际会部署的默认设置。在你不一定会使用的设置下、针对一组精选工作负载测得的 40% 平均值,只是一个初步假设——而不是一条预算线。

Fast mode 是研究预览版,而非正式层级

Claude Opus 5.5 上的快速模式为每百万输入 token 8.00 美元,每百万输出 token 40.00 美元——正好是标准定价的两倍——输出 token 速度最高可提升至 2.5 倍。它不会缩短首个 token 的生成时间;提升体现在输出速度上,并且在流式传输时最为明显。

把剩下的说清楚,因为很容易把它当成一个层级来预算,但它并不是。Anthropic 将快速模式标记为研究预览。访问需要通过客户经理或等待名单申请。它需要在请求中指定fast-mode-2026-02-01 beta 标头,以及speed: "fast"。它仅在 Claude API 上可用——不适用于 Amazon Bedrock、Google Cloud、Microsoft Foundry 或 Claude Platform on AWS。它无法与 Batch API 或 Priority Tier 承诺组合使用。它可以与提示缓存和数据驻留乘数叠加,因此美国固定的快速模式缓存请求在 2x 的基础上支付 1.1x。而在快速和标准速度之间切换工作负载会使提示缓存失效,这在长时间代理循环中可能比速度节省的成本更高。

Claude Opus 5 和 Claude Opus 4.8 也支持快速模式,价格为 $10.00/$50.00。Claude Opus 4.7 则会直接拒绝该参数。

决定账单的计费单位是每项已完成任务的成本

以上每一项费率都是每 token 的价格。没有人会直接购买 token。每 token 的价格只有在乘以一项任务所消耗的 token 数,以及完成任务所需的尝试次数之后,才会变成真正的成本。

算一下前面那个轻缓存示例的账。按每次尝试 $0.24 计算,第一次尝试就完成任务的模型成本为 $0.24。同一任务用竞品按每次尝试 $0.30 计算,成本为 $0.30——所以更便宜的模型看起来有 20% 的优势。现在让更便宜的模型每完成一项任务需要 1.2 次尝试,这对智能体工作来说已经是相当宽松的成功率:1.2 × $0.24 是 $0.288,而单次尝试的替代方案是 $0.30。节省没有了。若需要三次尝试,成本就是 $0.72,而那个按 token 计算看起来便宜 20% 的模型,每完成一项工作的成本反而高出 140%。

这正是为什么 Anthropic 自己对效率的说法——更少的 token、更少的调用、更少的步骤——是以正确的单位来表述的。这也是为什么在你亲自复现之前,它们中的任何一条都不该被当成一项预算。检验是机械式的:单次通过的价格,乘以每个已完成任务所需的通过次数,用你自己的流量来测量。这两个数字都得由你自己得出,而且没有哪家供应商会针对你的工作负载公布第二个数字。

如果你想找一个来自供应商之外的单一参照点,Artificial Analysis 将 Claude Opus 5.5 在其最大努力配置下的成本定为每项 Intelligence Index 任务 5.98 美元——这是一个独立数据,且所对应的设置大多数生产流量都不会使用,因此更适合将其视为上限,而非预测。

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

标价不包含的项目

驻留。仅限美国境内的推理在每个 token 类别上均为 1.1 倍,包括缓存读取和写入。它可与快速模式以及 Batch 折扣叠加使用。

工具定义。Anthropic 会公布每种模型的工具使用系统提示开销:声明工具会给每个 Claude Opus 5.5 请求增加 286 个 token。按每百万 4.00 美元计算虽不算多,但它是按请求计费的,而智能体循环会发出大量请求。

缓存失效。在模型、effort、工具定义或速度发生变更后重写的前缀,按写入费率计费——在 Claude Opus 5.5 上为每百万 $5.00 或 $8.00——而非 $0.20 的读取费率。

它下方的那个模型。Claude Sonnet 5 的输入价格为每百万 2.00 美元、输出价格为每百万 10.00 美元,Anthropic 的定价脚注确认这已是标准价格,而非发布时所称的推广价。Claude Opus 5.5 在输入与输出两个方向上都恰好是 Sonnet 5 的 2 倍。

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

按 Anthropic 的标价调用 Claude Opus 5.5

Claude Opus 5.5 已上线 OrcaRouter,anthropic/claude-opus-5.5每百万输入 $4.00、输出 $20.00——即 Anthropic 自家的标价,按 0% 加价原样传递。这种原样传递值得在定价页上明确说明:因为供应商费率是实时转发的,而非缓存在表格里,所以厂商费率调整当天就在这里生效,无需等待同步窗口。如果 Anthropic 改动这份价目表,你调用时依据的数字也会随之变动。

同一个密钥即可访问本页所对比的各档模型 —— anthropic/claude-opus-5定价为 $5.00/$25.00,以及 anthropic/claude-fable-5.1定价为 $10.00/$50.00 —— 与 Claude 系列的其他成员以及 200 多个其他模型一起,因此,要检验更低的每 token 费率在你自己的调用次数下是否依然成立,无需另签一份合同,也无需改动代码。 自动故障转移则适用于这样的情况:你想在生产路径上运行一个不熟悉的模型,却不想把整条路径押在它身上。

关于这个页面讲的是什么,两行话就能回答:价目表是输入 $4.00、输出 $20.00、缓存读取每百万 $0.20,而 20% 的降价是真实存在的,今天就能验证。40% 是 Anthropic 在其自行挑选的各类工作负载上的平均值。在按第二个数字做预算之前,先拿你自己的一个 agent 循环实际跑一遍。

本文中的对比3

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新