为一篇关于模型定价的技术博客主图创作的编辑风格扁平矢量插画:浅色背景上有一颗大型圆角模型芯片,一角夹着价格标签,三条令牌流从中流入一个圆形价格仪表,仪表旁边有一小叠缓存块。深蓝与青色配色,干净现代的SaaS美学,无任何可读文字。
Guides & Insights

Claude Opus 5 API 定价:每 100 万 Tokens 收费 5 美元 / 25 美元,缓存 0.50 美元,以及它的真实成本

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Claude Opus 5 每百万输入 token 收费 5.00 美元,每百万输出 token 收费 25.00 美元在 Claude Opus 5 API 上——该模型在 OrcaRouter 目录中的费率相同,检查日期为 2026-08-18,零加价。这使得它的价格是 Claude Fable 5 的一半,与 Claude Opus 4.8 的价格完全相同,而预算时应以 Claude Opus 5 模型实时页面上的费率卡为准。关键杠杆比宣传标题更重要:通过提示缓存,复用输入按每百万 0.50 美元计费;批量处理降至 2.50 / 12.50 美元;其快速模式测试版为 10 / 50 美元。本页面是该模型的定价参考——包含精确的费率卡、一次请求的实际成本、价格与同类产品的对比、何时不该选择它,以及如何通过一个与 OpenAI 兼容的端点使用自己的密钥调用它。

价格为每百万令牌(输入/输出)的费率,截至2026年8月18日。美元数据读取自 Anthropic 发布的 API 费率,并与 OrcaRouter 模型页面上 Claude Opus 5 的数据进行了交叉核对;缓存、批量及快速模式费率由 Anthropic 公布。价格会变动——构建前请务必核实。

今天已核实的确切价格

以下是Claude Opus 5的完整费率卡,验证于2026-08-18:

Price card titled 'Claude Opus 5 — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $25.00 and Cache read $0.50. Rows below list cache write 5-minute TTL $6.25, cache write 1-hour TTL $10.00, batch $2.50 input / $12.50 output, fast mode $10 / $50, context window 1M tokens and max output 128K. Footer: reused input costs one tenth of fresh input.

输入 — 缓存未命中时,每 1M tokens 收费 $5.00。

输出 — 每100万token收费25.00美元。

提示词缓存写入 — 每1M 6.25美元(5分钟TTL),每1M 10.00美元(1小时TTL)。

提示缓存读取 — 每 1M tokens 仅需 $0.50,对您重新发送的任何输入提供 90% 折扣。

Batch API — 输入 $2.50 / 输出 $12.50,统一五折,异步。

快速模式 — $10 输入 / $50 输出,需支付 2 倍溢价以获得最高约 2.5 倍的输出速度,Anthropic 测试版。

上下文窗口 — 1M tokens,最多128K输出。

OrcaRouter 以不加价的方式传递提供商费率,因此目录上的数字就是您实际支付的数字。在实时模型页面上,卡片显示每 1M $5.00 / $25.00,缓存读取 $0.500,缓存写入 $10.00(1 小时 TTL 费率),并带有 Vision、Tools、JSON 和 Reasoning 徽章。

改变有效价格的杠杆

基本费率只是起点。三个调节因素会改变Opus 5的实际成本:

提示缓存复用的上下文按每百万令牌 $0.50 计费,而不是全新的 $5。在 Opus 5 上,最小可缓存前缀已降至约 512 个令牌,因此即使是一个不大的稳定系统提示词也符合条件。对于每轮都会重新发送大段前缀的智能体或聊天应用来说,缓存是账单上最大的杠杆——而且由于 Anthropic 按 API 密钥来管理缓存,保持使用同一个密钥(一个渠道)才能确保持续命中缓存。

Batch — Anthropic 的批量 API 异步运行任务,结果通常在 24 小时内可用,价格恰好为一半:$2.50 / $12.50。它可以与提示缓存叠加使用,适用于评测、批量分类以及对延迟不敏感的离线生成。

快速模式——10美元/50美元,输出吞吐量最高可提升约2.5倍,适用于对延迟敏感的高输出量工作。它不能与 batch API 结合使用,是 Anthropic 的第一方测试版;通过路由器的标准透传费率为基础价 5 美元/25 美元。

一次请求的实际成本

按token计费的价格比较抽象,因此这里以今日费率给出计算示例:

单次聊天调用,50K 输入 + 20K 输出 — $0.25 + $0.50 = $0.75

1M输入 + 1M输出 — $5 + $25 = $30

Agentic 轮次,200K 缓存上下文 + 20K 新输入 + 30K 输出 — $0.10 + $0.10 + $0.75 = $0.95。相同轮次在冷缓存下 — 220K 新输入,价格为 $1.10 — 总计 $1.85。缓存几乎将其减半。

一个 10M token 月,按 70% 输入 / 30% 输出划分,其中 80% 的输入来自缓存:1.4M 新输入($7.00)+ 5.6M 缓存($2.80)+ 3M 输出($75)≈ $85。未缓存时,同样的月份为$110

两个注意事项会提高实际费率。Opus 5 是一个推理模型——自适应推理默认开启,推理令牌按输出计费,每百万个 25 美元。在高强度设置下,困难的提示词可能会将很大一部分输出预算花在推理上,因此处理困难任务时的实际输出成本远高于粗略估算。此外,Anthropic 当前的 tokenizer(分词器)比上一代更冗长,因此同样的英文文本比在较老的 Claude 模型上要花费更多的令牌(和更多的钱)。对于简单的调用,请降低强度设置,并尽可能限制输出。

Opus 5 定价与同类产品的对比

Comparison table card titled 'USD per 1M tokens — published list prices', verified 2026-08-18, with an input/output column pair per model: Claude Opus 5 $5.00/$25.00 highlighted with a 'THIS PAGE' tag; Claude Opus 4.8 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Sonnet 5 $3.00/$15.00 (intro $2.00/$10.00 through Aug 31); GPT-5.6 Sol $5.00/$30.00; GPT-5.6 Terra $2.00/$12.00; Gemini 3.6 Flash $1.50/$7.50; Kimi K3 $3.00/$15.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Opus 5 is half the price of Claude Fable 5, the same price as Claude Opus 4.8, and 20% cheaper on output than GPT-5.6 Sol.

根据2026-08-18公布的建议零售价:

Claude Opus 4.8 — $5 / $25。与上一代价格相同。Opus 5 作为新模型也维持相同价格,升级非常容易。

Claude Fable 5 — $10 / $50。Opus 5 的价格是 Anthropic 顶级产品的一半,并拥有相同的 100 万 token 上下文窗口。

Claude Sonnet 5——标准定价为 $3 / $15(2026 年 8 月 31 日前入门价为 $2 / $10)。Sonnet 级别在输入和输出上便宜 40%——当你不需要 Opus 级别的推理时,这是自然的默认选择。

GPT-5.6 Sol — $5 / $30。相同输入价格,Opus 5 输出更便宜。

GPT-5.6 Terra — $2 / $12。适用于高容量非前沿工作的中间批量层级。

Gemini 3.6 Flash — $1.50 / $7.50。一款面向廉价、快速、多模态流量的 Flash 级模型。

Kimi K3 — $3 / $15。一款开放权重的旗舰模型,价格约为 Opus 的一半。

DeepSeek V4 Pro — 非高峰时段 $0.44 / $0.88(高峰时段翻倍)。这款便宜的开源权重旗舰,完全是另一个价格体系。

坦诚地说:Opus 5 并不是一个廉价的模型——它是定价仅为顶级型号(Claude Fable 5)一半的旗舰产品,且与上一代的价格完全一致。它的优势在于长上下文单价和硬推理单价,而非绝对费率。如果你的流量是短提示词和简单任务,那么 3 美元的 Sonnet 或 0.44 美元的 DeepSeek 模型会是更便宜的选择。

当 Opus 5 是错误选择时

四种情况下,这个价格不是你想要的:

简短、简单的提示。在约 20K token 以下且无需深度推理时,为 Opus 付出的溢价就白白浪费了。Claude Sonnet 5 的价格为 $3 / $15(推广期内为 $2 / $10),能以低 40% 的成本处理大批量档位,而 Gemini Flash 或 DeepSeek 级别的模型成本又要低得多。

推理密集型负载。因为推理按输出计费,在高推理强度下,高难度提示词的费用可能远超标称的输出价格。如果你的工作负载包含大量困难调用,请在正式投入前先测量实际输出的 token 数量——实际费率可能会让你意外。

以每 Token 价格作为唯一目标。如果前沿基准分数或 1M 上下文不是硬性要求,那么更便宜的旗舰模型(GPT-5.6 Terra、DeepSeek V4 Pro)或 Flash 级模型(Gemini 3.6 Flash)能大幅降低大多数简单流量的每 Token 费率。

严格的延迟预算。 Opus 5 是一个大型思考模型——在 OrcaRouter 为期 7 天的测量中,p50 首 Token 延迟约为 7 秒。对于需要亚秒级 TTFT 的实时聊天场景,无论价格如何,它都不是合适的模型。

如何在 OrcaRouter 上调用它?

Screenshot of the OrcaRouter model page for Claude Opus 5 (model ID anthropic/claude-opus-5): a New Featured badge, Vision/Tools/JSON/Reasoning capability badges, 1M token context and 128K max output, input $5.00 and output $25.00 per 1M tokens, cache read $0.500 and cache write $10.00, p50 TTFT 7.06s, the /v1/chat/completions and /v1/messages endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

Claude Opus 5 托管在 OrcaRouter 上,模型 ID 为anthropic/claude-opus-5,通过 OpenAI 兼容端点api.orcarouter.ai/v1 提供服务,按提供商原价计费,零加价。如果你已有 OpenAI 客户端,迁移只需修改 base-URL 和模型 ID——不需要其他任何改动。同一个密钥和端点支持 200 多个模型,因此 Opus 5 与 Claude Sonnet 5、Claude Haiku 4.5、GPT-5.6 系列、Gemini 家族以及你想拿来与之对比的开放权重模型并列可用;你可以按难度路由,而无需逐个重新集成。

在定价页面上,值得单独列出的 OrcaRouter 两大特性。BYOK:使用你自己的 Anthropic 密钥,Anthropic 按自身费率直接向你计费——OrcaRouter 每个 token 额外收取 $0,并保留你的服务商速率限制和余额。Guardrails:PII 屏蔽和内容策略在计费前运行,因此被拦截的请求会返回干净的 400 错误,且绝不会被计费;Agent Firewall 会在工具和 MCP 调用执行前对其进行分级评估。

定价页面上重要的诚实说明:我们负责路由模型,并不设定它的价格。$5 / $25 这个数字是 Anthropic 费率的直接转传,Anthropic 调整费率时,页面标价也会随之变化——这正是本页带有日期戳的原因。如果你直接调用 Anthropic,拿到的也是同样的费率;如果你想要一个端点覆盖整个模型系列,OrcaRouter 就是为这种单密钥、零加价的路由而存在。

来源和日期

上述所有价格均已于 2026-08-18 核实。Claude 的数据取自 Anthropic 公布的 API 定价,并与 OrcaRouter 上 Claude Opus 5 的模型页面进行了交叉核对(同一日核验)。GPT-5.6 降价后的价格为 OpenAI 公布的费率;Gemini、Kimi 和 DeepSeek 的数据为 OrcaRouter 目录中的当前条目,其中 DeepSeek V4 Pro 显示的是其非高峰时段价格(高峰时段价格翻倍)。自 Opus 5 于 2026 年 7 月 24 日发布以来,Anthropic 的价格一直保持稳定,但价格也会变动——如果你找到任何更早的“Opus 5 定价”页面,请以页面上标注的核实日期为准。以上数字截至今日有效。

以上每个价格均为Claude Opus 5 模型页面上的实时费率—已于 2026-08-18 验证,零加价,可直接配合您自己的密钥使用。

本文中的对比4

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

providers@orcarouter.ai

加入我们的社区

Discordsupport@orcarouter.aiXGitHubYouTube