
Claude Opus 5 API 定价:每 100 万 Tokens 收费 5 美元 / 25 美元,缓存 0.50 美元,以及它的真实成本
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百万 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75代码
- obsidian新Qwen3.8 27B2026-08-1552智能68代码
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69代码
- grok新SpaceXAI: Grok 4.62026-08-1261智能77代码
- metaMeta: Muse Spark 1.22026-08-0557智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
Claude Opus 5 每百万输入 token 收费 5.00 美元,每百万输出 token 收费 25.00 美元在 Claude Opus 5 API 上——该模型在 OrcaRouter 目录中的费率相同,检查日期为 2026-08-18,零加价。这使得它的价格是 Claude Fable 5 的一半,与 Claude Opus 4.8 的价格完全相同,而预算时应以 Claude Opus 5 模型实时页面上的费率卡为准。关键杠杆比宣传标题更重要:通过提示缓存,复用输入按每百万 0.50 美元计费;批量处理降至 2.50 / 12.50 美元;其快速模式测试版为 10 / 50 美元。本页面是该模型的定价参考——包含精确的费率卡、一次请求的实际成本、价格与同类产品的对比、何时不该选择它,以及如何通过一个与 OpenAI 兼容的端点使用自己的密钥调用它。
价格为每百万令牌(输入/输出)的费率,截至2026年8月18日。美元数据读取自 Anthropic 发布的 API 费率,并与 OrcaRouter 模型页面上 Claude Opus 5 的数据进行了交叉核对;缓存、批量及快速模式费率由 Anthropic 公布。价格会变动——构建前请务必核实。
今天已核实的确切价格
以下是Claude Opus 5的完整费率卡,验证于2026-08-18:

• 输入 — 缓存未命中时,每 1M tokens 收费 $5.00。
• 输出 — 每100万token收费25.00美元。
• 提示词缓存写入 — 每1M 6.25美元(5分钟TTL),每1M 10.00美元(1小时TTL)。
• 提示缓存读取 — 每 1M tokens 仅需 $0.50,对您重新发送的任何输入提供 90% 折扣。
• Batch API — 输入 $2.50 / 输出 $12.50,统一五折,异步。
• 快速模式 — $10 输入 / $50 输出,需支付 2 倍溢价以获得最高约 2.5 倍的输出速度,Anthropic 测试版。
• 上下文窗口 — 1M tokens,最多128K输出。
OrcaRouter 以不加价的方式传递提供商费率,因此目录上的数字就是您实际支付的数字。在实时模型页面上,卡片显示每 1M $5.00 / $25.00,缓存读取 $0.500,缓存写入 $10.00(1 小时 TTL 费率),并带有 Vision、Tools、JSON 和 Reasoning 徽章。
改变有效价格的杠杆
基本费率只是起点。三个调节因素会改变Opus 5的实际成本:
• 提示缓存复用的上下文按每百万令牌 $0.50 计费,而不是全新的 $5。在 Opus 5 上,最小可缓存前缀已降至约 512 个令牌,因此即使是一个不大的稳定系统提示词也符合条件。对于每轮都会重新发送大段前缀的智能体或聊天应用来说,缓存是账单上最大的杠杆——而且由于 Anthropic 按 API 密钥来管理缓存,保持使用同一个密钥(一个渠道)才能确保持续命中缓存。
• Batch — Anthropic 的批量 API 异步运行任务,结果通常在 24 小时内可用,价格恰好为一半:$2.50 / $12.50。它可以与提示缓存叠加使用,适用于评测、批量分类以及对延迟不敏感的离线生成。
• 快速模式——10美元/50美元,输出吞吐量最高可提升约2.5倍,适用于对延迟敏感的高输出量工作。它不能与 batch API 结合使用,是 Anthropic 的第一方测试版;通过路由器的标准透传费率为基础价 5 美元/25 美元。
一次请求的实际成本
按token计费的价格比较抽象,因此这里以今日费率给出计算示例:
• 单次聊天调用,50K 输入 + 20K 输出 — $0.25 + $0.50 = $0.75。
• 1M输入 + 1M输出 — $5 + $25 = $30。
• Agentic 轮次,200K 缓存上下文 + 20K 新输入 + 30K 输出 — $0.10 + $0.10 + $0.75 = $0.95。相同轮次在冷缓存下 — 220K 新输入,价格为 $1.10 — 总计 $1.85。缓存几乎将其减半。
• 一个 10M token 月,按 70% 输入 / 30% 输出划分,其中 80% 的输入来自缓存:1.4M 新输入($7.00)+ 5.6M 缓存($2.80)+ 3M 输出($75)≈ $85。未缓存时,同样的月份为$110。
两个注意事项会提高实际费率。Opus 5 是一个推理模型——自适应推理默认开启,推理令牌按输出计费,每百万个 25 美元。在高强度设置下,困难的提示词可能会将很大一部分输出预算花在推理上,因此处理困难任务时的实际输出成本远高于粗略估算。此外,Anthropic 当前的 tokenizer(分词器)比上一代更冗长,因此同样的英文文本比在较老的 Claude 模型上要花费更多的令牌(和更多的钱)。对于简单的调用,请降低强度设置,并尽可能限制输出。
Opus 5 定价与同类产品的对比

根据2026-08-18公布的建议零售价:
• Claude Opus 4.8 — $5 / $25。与上一代价格相同。Opus 5 作为新模型也维持相同价格,升级非常容易。
• Claude Fable 5 — $10 / $50。Opus 5 的价格是 Anthropic 顶级产品的一半,并拥有相同的 100 万 token 上下文窗口。
• Claude Sonnet 5——标准定价为 $3 / $15(2026 年 8 月 31 日前入门价为 $2 / $10)。Sonnet 级别在输入和输出上便宜 40%——当你不需要 Opus 级别的推理时,这是自然的默认选择。
• GPT-5.6 Sol — $5 / $30。相同输入价格,Opus 5 输出更便宜。
• GPT-5.6 Terra — $2 / $12。适用于高容量非前沿工作的中间批量层级。
• Gemini 3.6 Flash — $1.50 / $7.50。一款面向廉价、快速、多模态流量的 Flash 级模型。
• Kimi K3 — $3 / $15。一款开放权重的旗舰模型,价格约为 Opus 的一半。
• DeepSeek V4 Pro — 非高峰时段 $0.44 / $0.88(高峰时段翻倍)。这款便宜的开源权重旗舰,完全是另一个价格体系。
坦诚地说:Opus 5 并不是一个廉价的模型——它是定价仅为顶级型号(Claude Fable 5)一半的旗舰产品,且与上一代的价格完全一致。它的优势在于长上下文单价和硬推理单价,而非绝对费率。如果你的流量是短提示词和简单任务,那么 3 美元的 Sonnet 或 0.44 美元的 DeepSeek 模型会是更便宜的选择。
当 Opus 5 是错误选择时
四种情况下,这个价格不是你想要的:
简短、简单的提示。在约 20K token 以下且无需深度推理时,为 Opus 付出的溢价就白白浪费了。Claude Sonnet 5 的价格为 $3 / $15(推广期内为 $2 / $10),能以低 40% 的成本处理大批量档位,而 Gemini Flash 或 DeepSeek 级别的模型成本又要低得多。
推理密集型负载。因为推理按输出计费,在高推理强度下,高难度提示词的费用可能远超标称的输出价格。如果你的工作负载包含大量困难调用,请在正式投入前先测量实际输出的 token 数量——实际费率可能会让你意外。
以每 Token 价格作为唯一目标。如果前沿基准分数或 1M 上下文不是硬性要求,那么更便宜的旗舰模型(GPT-5.6 Terra、DeepSeek V4 Pro)或 Flash 级模型(Gemini 3.6 Flash)能大幅降低大多数简单流量的每 Token 费率。
严格的延迟预算。 Opus 5 是一个大型思考模型——在 OrcaRouter 为期 7 天的测量中,p50 首 Token 延迟约为 7 秒。对于需要亚秒级 TTFT 的实时聊天场景,无论价格如何,它都不是合适的模型。
如何在 OrcaRouter 上调用它?

Claude Opus 5 托管在 OrcaRouter 上,模型 ID 为anthropic/claude-opus-5,通过 OpenAI 兼容端点api.orcarouter.ai/v1 提供服务,按提供商原价计费,零加价。如果你已有 OpenAI 客户端,迁移只需修改 base-URL 和模型 ID——不需要其他任何改动。同一个密钥和端点支持 200 多个模型,因此 Opus 5 与 Claude Sonnet 5、Claude Haiku 4.5、GPT-5.6 系列、Gemini 家族以及你想拿来与之对比的开放权重模型并列可用;你可以按难度路由,而无需逐个重新集成。
在定价页面上,值得单独列出的 OrcaRouter 两大特性。BYOK:使用你自己的 Anthropic 密钥,Anthropic 按自身费率直接向你计费——OrcaRouter 每个 token 额外收取 $0,并保留你的服务商速率限制和余额。Guardrails:PII 屏蔽和内容策略在计费前运行,因此被拦截的请求会返回干净的 400 错误,且绝不会被计费;Agent Firewall 会在工具和 MCP 调用执行前对其进行分级评估。
定价页面上重要的诚实说明:我们负责路由模型,并不设定它的价格。$5 / $25 这个数字是 Anthropic 费率的直接转传,Anthropic 调整费率时,页面标价也会随之变化——这正是本页带有日期戳的原因。如果你直接调用 Anthropic,拿到的也是同样的费率;如果你想要一个端点覆盖整个模型系列,OrcaRouter 就是为这种单密钥、零加价的路由而存在。
来源和日期
上述所有价格均已于 2026-08-18 核实。Claude 的数据取自 Anthropic 公布的 API 定价,并与 OrcaRouter 上 Claude Opus 5 的模型页面进行了交叉核对(同一日核验)。GPT-5.6 降价后的价格为 OpenAI 公布的费率;Gemini、Kimi 和 DeepSeek 的数据为 OrcaRouter 目录中的当前条目,其中 DeepSeek V4 Pro 显示的是其非高峰时段价格(高峰时段价格翻倍)。自 Opus 5 于 2026 年 7 月 24 日发布以来,Anthropic 的价格一直保持稳定,但价格也会变动——如果你找到任何更早的“Opus 5 定价”页面,请以页面上标注的核实日期为准。以上数字截至今日有效。
以上每个价格均为Claude Opus 5 模型页面上的实时费率—已于 2026-08-18 验证,零加价,可直接配合您自己的密钥使用。
本文中的对比4
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
