
Claude Opus 5 API 定價:每 100 萬個 Token 5 美元 / 25 美元,快取 0.50 美元,以及其實際成本
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75程式
- obsidian新Qwen3.8 27B2026-08-1552智能68程式
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grok新SpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
Claude Opus 5 的費用為每百萬個輸入 token 5.00 美元、每百萬個輸出 token 25.00 美元,在 Claude Opus 5 API 上——此費率與該模型在 OrcaRouter 目錄上的價格相同(查閱日期:2026-08-18),零加價。這使其價格僅為 Claude Fable 5 的一半,也正好等於 Claude Opus 4.8 的費用;而線上 Claude Opus 5 模型頁面上的費率表,才是你編列預算時應參考的依據。這些調節選項比表面價格更為關鍵:透過 prompt 快取重複使用的輸入 token,每百萬個收費 0.50 美元;批次價格降至 2.50 / 12.50 美元;fast-mode beta 則為 10 / 50 美元。本頁面是該模型的定價參考——包含確切的費率表、一次請求的實際成本、價格與市場上其他模型的比較、何時不該選擇它,以及如何用自己的金鑰透過單一 OpenAI 相容端點呼叫它。
價格以每百萬個代幣(輸入/輸出)計算,自 2026-08-18 起生效。美元數字取自 Anthropic 公布的 API 費率,並與 OrcaRouter 的 Claude Opus 5 模型頁面交叉核對;快取、批次與快速模式的費率則由 Anthropic 公布。價格會變動——建置前請先確認。
確切價格,今日已驗證
以下是 Claude Opus 5 的完整費率表,已於 2026-08-18 驗證:

• 輸入 — 每 1M tokens(快取未命中時)收費 $5.00。
• 輸出 — 每 1M tokens 需 $25.00。
• 提示詞快取寫入 — 每 1M 以 5 分鐘 TTL 計價 $6.25,以 1 小時 TTL 計價 $10.00。
• 提示詞快取讀取 — 每 1M tokens 僅需 $0.50,您重新傳送的任何輸入皆可享 90% 折扣。
• Batch API — 輸入 $2.50 / 輸出 $12.50,一律 50% 折扣,非同步。
• 快速模式 — 輸入 $10 / 輸出 $50,以2倍溢價換取最高約2.5倍的輸出速度,Anthropic beta。
• 上下文窗口 — 1M tokens,最多 128K 輸出。
OrcaRouter 會直接轉傳供應商費率,不加任何加成,因此目錄上顯示的金額就是您實際支付的金額。在即時模型頁面上,卡片顯示每 1M 次 $5.00 / $25.00,快取讀取 $0.500,快取寫入 $10.00(1 小時 TTL 費率),並帶有 Vision、Tools、JSON 和 Reasoning 徽章。
改變有效價格的槓桿
基本費率僅是起點。三個調整因素會改變 Opus 5 的實際成本:
• 提示詞快取 — 重複使用的上下文每百萬個 token 計費 0.50 美元,而不是未快取的 5 美元。在 Opus 5 上,可快取的最小前綴長度降至約 512 個 token,因此即使是中等規模的穩定系統提示詞也符合資格。對於任何每一輪都會重新發送大型前綴的代理或聊天應用,快取是帳單上影響最大的單一因素——而且由於 Anthropic 以 API 金鑰作為快取的鍵,維持使用同一個金鑰(同一個管道)才能確保持續命中快取。
• 批量 — Anthropic 的批量 API 以非同步方式執行任務,結果通常可在 24 小時內取得,價格正好是一半:$2.50 / $12.50。可與提示快取(prompt caching)搭配使用,適用於不在乎延遲的評估、批量分類和離線生成。
• 快速模式 — 費用為 $10 / $50,可提供最高約 2.5 倍的輸出吞吐量,適合對延遲敏感的高輸出工作。此模式無法與批次 API 搭配使用,且為 Anthropic 第一方測試版;透過路由器轉傳的標準費率即為基礎價格 $5 / $25。
一個請求的實際成本
每個 token 的價格過於抽象,因此這裡提供按今日費率計算的實際範例。
• 單次聊天調用,50K 輸入 + 20K 輸出 — $0.25 + $0.50 = $0.75。
• 1M 輸入 + 1M 輸出 — $5 + $25 = $30。
• Agentic 回合:200K 快取上下文 + 20K 新輸入 + 30K 輸出 — $0.10 + $0.10 + $0.75 = $0.95。相同回合若為冷快取 — 220K 新輸入,費用 $1.10 — 總計 $1.85。快取幾乎讓費用減半。
• 一個 10M token 的月份,以 70% 輸入 / 30% 輸出拆分,其中 80% 的輸入由快取提供:1.4M 新鮮輸入($7.00)+ 5.6M 快取輸入($2.80)+ 3M 輸出($75)≈ $85。未使用快取時,同一個月是 $110。
有兩點注意事項會提高實際費率。Opus 5 是一款思考模型——自適應思考預設為開啟,而思考 token 以每百萬個 25 美元的價格計為輸出。在高努力程度設定下,艱難的提示詞可能會將輸出預算的很大一部分花在推理上,因此在困難任務上的實際輸出成本遠高於粗略估算。此外,Anthropic 目前的 tokenizer 比前一代更為冗長,因此相同的英文文字在較舊的 Claude 模型上會花費更多 token(以及更多金錢)。對於簡單的呼叫,請調低努力程度設定,並在可行的情況下限制輸出。
Opus 5 定價與同類產品的比較

對照2026-08-18公布的目錄價格:
• Claude Opus 4.8 — $5 / $25。與前一代價格相同。Opus 5 新版模型費用不變,升級起來非常容易。
• Claude Fable 5 — $10 / $50。Opus 5 的價格是 Anthropic 頂級方案的一半,且具有相同的 1M token 上下文。
• Claude Sonnet 5 — 標準價格 $3 / $15(首發優惠 $2 / $10,至 2026 年 8 月 31 日止)。Sonnet 等級的輸入和輸出價格便宜 40% — 當你不需要 Opus 等級的推理能力時,這是最自然的預設選擇。
• GPT-5.6 Sol — $5 / $30。輸入價格相同,Opus 5 的輸出更便宜。
• GPT-5.6 Terra — $2 / $12。適用於大量非前沿工作的中階容量方案。
• Gemini 3.6 Flash — $1.50 / $7.50。一款 Flash 級模型,專為低成本、快速、多模態流量設計。
• Kimi K3 — $3 / $15。一個開放權重的旗艦模型,價格約為 Opus 的一半。
• DeepSeek V4 Pro——離峰時段 $0.44 / $0.88(尖峰時段翻倍)。平價開放權重旗艦,完全是另一個價格宇宙。
坦白說:Opus 5 並非便宜的模型——它是定價為頂級產品(Claude Fable 5)一半的旗艦款,價格正好與前一代相同。它勝在長上下文與困難推理的單位價格,而非絕對費率。如果你的流量是短提示詞和簡單任務,3 美元的 Sonnet 或 0.44 美元的 DeepSeek 模型才是更划算的選擇。
當 Opus 5 是錯誤的選擇時
有四種情況,這個價格不是您想要的。
簡短、簡單的提示。 在約 20K tokens 以下且無需深度推理時,Opus 的高階費用就浪費了。Claude Sonnet 5 以 $3 / $15(或透過入門方案取得 $2 / $10)處理大量層級,成本低 40%,而 Gemini Flash 或 DeepSeek 等級的模型費用又低得多。
推理密集型用量。 由於思考會以輸出(token)計費,困難的提示詞在高強度設定下的成本可能遠高於名義輸出價格。如果您的工作負載中有大量困難的調用,請在投入前先測量實際輸出的 token 數量——實際有效費率可能會讓您大吃一驚。
僅以每個 token 的價格為唯一目標。若前沿基準分數或 1M 上下文並非硬性要求,較便宜的旗艦模型(GPT-5.6 Terra、DeepSeek V4 Pro)或 Flash 級模型(Gemini 3.6 Flash)能為大部分簡單流量提供遠更低的每 token 費率。
嚴格的延遲預算。 Opus 5 是一個大型思考模型 — 在 OrcaRouter 的 7 天測量中,p50 首次輸出 token 時間約為 7 秒。對於需要次秒級 TTFT 的即時聊天情境,無論價格如何,它都不是正確的模型。
如何在OrcaRouter上呼叫它

Claude Opus 5 託管於 OrcaRouter,模型 ID 為 anthropic/claude-opus-5,可透過 OpenAI 相容端點 api.orcarouter.ai/v1 存取,以供應商原價提供、零加價。若您已有 OpenAI 用戶端,遷移僅需變更 base-URL 與模型 ID,無需其他調整。同一個金鑰與端點可承載 200 多個模型,因此 Opus 5 與 Claude Sonnet 5、Claude Haiku 4.5、GPT-5.6 各版本、Gemini 系列,以及您想與之比較的開放權重模型並列。您可以依難度分流,不必逐一重新整合。
在定價頁面上,有兩個 OrcaRouter 的特點值得一提。BYOK:攜帶您自己的 Anthropic 金鑰,Anthropic 會以自身費率直接向您收費 — OrcaRouter 每 token 加收 $0,並讓您的供應商速率限制與額度完整保留。Guardrails:PII Shield 與內容政策在計費之前執行,因此被封鎖的請求會回傳乾淨的 400 回應,且絕不會被收費;Agent Firewall 則會在工具和 MCP 呼叫執行之前先進行評估。
定價頁面上重要的誠實說明:我們路由模型,但不設定其價格。$5 / $25 這個數字是 Anthropic 的價格直接轉傳,當 Anthropic 變更價格時,列表也會隨之更新——這正是此頁面標註日期戳的原因。如果你直接呼叫 Anthropic,也會得到相同的費率;OrcaRouter 的存在是為了提供單一金鑰、零加價的路由,讓你在整個模型系列中只需要一個端點。
來源與日期
以上所有價格均於 2026-08-18 驗證。Claude 的數字取自 Anthropic 公布的 API 定價,並與 OrcaRouter 的 Claude Opus 5 模型頁面交叉核對(同日查核)。GPT-5.6 降價後的價格為 OpenAI 公布的費率;Gemini、Kimi 和 DeepSeek 的數字則是 OrcaRouter 目錄目前的列表,其中 DeepSeek V4 Pro 顯示的是離峰費率(尖峰時段加倍)。Anthropic 的價格自 Opus 5 於 2026 年 7 月 24 日推出以來一直維持穩定,但仍會變動——任何你找到的較早「Opus 5 定價」頁面,請以查核日期為準。這裡的數字截至今日仍為最新。
以上每個價格均為Claude Opus 5 模型頁面上的即時費率 — 已於 2026-08-18 以零加價驗證,可直接搭配您自己的金鑰使用。
本文中的比較4
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
