
Claude Opus 5 API:如何呼叫、費用多少,以及何時大材小用
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75程式
- obsidian新Qwen3.8 27B2026-08-1552智能68程式
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grok新SpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.
兩個端點,一個模型
大多數針對 Claude Opus 5 API 的教學只展示原生的 Anthropic 呼叫,然後就到此為止。實際上存在兩種方言,兩者都能到達相同的權重。
• Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.
• OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.
• 雲端模型。在 Amazon Bedrock 上,ID 是 anthropic.claude-opus-5;在 Google Vertex AI 和 Microsoft Foundry 上,它保留第一方 ID claude-opus-5。這些路徑適用於已採用特定雲端供應商的團隊;而 OpenAI 相容的路線才是能保持程式碼可攜性的選擇。
模型並不在乎你使用哪種方言。不同的是圍繞調用的一切——計費、金鑰、速率限制、故障轉移,以及在不更改程式碼的情況下,你能觸及多少其他模型。
你會得到什麼——以及破壞舊程式碼的兩件事
Claude Opus 5 是 Anthropic 以推理能力為重的旗艦模型:1M token 的上下文視窗(最大值即為預設值)、128K 的輸出上限、2026 年 5 月的知識截止日期,以及支援文字、影像與檔案輸入並輸出文字。在獨立的 Artificial Analysis 排行榜上,其測得AA Coding 78.0,在 132 個模型中排名第 1,以及AA Intelligence 63.1,在 134 個模型中排名第 2;截至 2026 年 7 月 24 日,GPQA Diamond 為 93.2,Humanity's Last Exam 得分為 54.9。Anthropic 自家發布的宣稱——約為 Opus 4.8 在 Frontier-Bench 上的兩倍——屬供應商自行執行,未經獨立重現。

思考功能預設為開啟。適應性思考會決定每次呼叫的推理量,由 output_config.effort 參數控制,該參數接受 low 到 max 之間的值,預設為 high。對於程式撰寫和代理迴圈,xhigh 是建議的起點;low 和 medium 在 Opus 5 上確實比先前模型更強大,因此它們適合實際工作負載,而非僅供測試的呼叫。推理 token 會計入您的輸出費用。
Claude Opus 4.8 的兩項破壞性變更,會影響任何複製舊請求主體的人:
• 過小的 max_tokens 設定現在會導致截斷。由於思考模式預設為開啟,max_tokens若設定為接近預期答案長度的大小,會先被推理過程消耗掉。若將 4.8 工作負載原封不動地遷移過來,請預期回應會被截斷,直到您調高上限或調低 effort。
• 取樣參數會被拒絕。 temperature、top_p 和 top_k在任何非預設值下皆會回傳 400 錯誤,助理預填(assistant prefill)也是如此。控制輸出時請使用effort,而不是 temperature。
• 停用思考功能有所限制。 thinking: {"type": "disabled"} 僅在 effort 為 high 或以下時才接受;將其與 xhigh 或 max 搭配則會回傳 400。降低成本的合理作法是調低 effort,而不是關閉思考功能。
實際要花多少錢
Claude Opus 5 的定價為$5 每百萬輸入 tokens 和 $25 每百萬輸出——定價與 Claude Opus 4.8 相同,這是本次發布中低調的好消息。快取讀取收費為$0.50 每百萬(提示快取需要至少 512 token 的前綴,並支援 5 分鐘和 1 小時的 TTL)。研究預覽版快速模式以每秒最多 2.5 倍的輸出 tokens 速度運行同一模型,價格為$10 / $50,而 Batch API 以半價非同步返回結果。

一個具體的帳單:一個 100K token 的請求產生 20K 輸出 token,收費為:輸入 $0.50、輸出 $0.50 — 合計 $1.00(未使用快取)。若該 100K 提示詞在下一次呼叫時命中快取,輸入部分的費用會降至約 $0.05,因此整個往返只需 $0.55 的費用。這套快取計費邏輯,正是 Opus 在長篇且重複的上下文情境下能否用得起,抑或完全用不起的關鍵差異。
為了提供規模參考,上方和下方的等級為:Claude Fable 5是 Anthropic 最強大的模型,價格為 $10 / $50;Claude Sonnet 5的價格是 $3 / $15(含$2 / $10的初期定價,至2026年8月31日);Claude Haiku 4.5的價格是 $1 / $5。在 OrcaRouter 上,這些模型每一個都以廠商標價直通,且不收取每個 token 的加價,因此上述比較也就是您實際支付的金額。
單一端點的情況
如果你正在閱讀 Claude Opus 5 API 指南,你大概已經有整合方案和金鑰了,真正的問題是:當你嘗試下一個模型時,是否還想要第二個整合方案和第二組金鑰。OrcaRouter 的答案,是在 200+ 個模型 前面提供一個 OpenAI 相容的端點:相同的用戶端、相同的 base URL,每個模型只需換一個 model id——anthropic/claude-opus-5 是今天的選擇;當工作負載不再需要 Opus 等級時,可以換成更便宜的模型;新前沿模型一推出就能立刻採用,全程不需要改任何程式碼。

經濟層面是最誠實的部分。OrcaRouter 的加價是每個 token $0——你支付各家供應商公布的費率,因此 Claude Opus 5 維持在 Anthropic 的 $5 / $25 定價,而供應商宣布降價的當天,該價格在我們這邊也會同步生效。自帶金鑰是首要選項:提供你現有的 Anthropic API 金鑰,保留自己的速率限制與額度,供應商直接向你收費。防護措施——即 PII 防護盾與內容政策——會在請求計費之前執行,而非之後。模型頁面anthropic/claude-opus-5顯示即時價格、100 萬 token 的上下文,以及目前的吞吐量數據,而路由 DSL 會構成故障轉移機制,讓較便宜的模型在 Opus 5 出錯時,或當你的流量型態允許時,接手回應。
在Opus 5是錯誤答案的情況下
最優秀並不等於最適合你的工作負載,而這款 $5 / $25 的旗艦產品在三個方面有所不足。
• 大量、低風險的呼叫。一個每月處理 1000 萬個輸入 token 的摘要或分類管線,其成本在 Claude Opus 5 上為 $50,而在 Claude Haiku 4.5 上為 $10——相同的端點、相同的金鑰,只差一個 id。Haiku 不是 Opus,但對於路由、擷取和格式化而言,它已經夠接近,讓 5 倍的價差難以合理化。
• 長時間的代理迴圈。 Opus 5 無需提示即會自行驗證自己的工作,因此一個為舊模型調校的「再次檢查你的答案」指令,現在會觸發過度驗證並耗費推理令牌。在 xhigh 和 max effort 下,思考預算會按設計增加。如果你的代理不需要前沿推理,以 $3 / $15 提供的 Claude Sonnet 5 是大多數生產團隊應該作為起點的預設選擇,而 effort 調整鈕就是你向下調校的地方。
• 當模型不是我們的。 OrcaRouter 負責路由與計費;Anthropic 負責運行模型權重。端點、零加成、故障轉移與護欄是我們的,但推論品質與安全行為則屬於 Anthropic;使用 BYOK 時,款項直接流向他們。這就是協議的直白說明:無論如何,你都按供應商費率付費,問題只在於——一個端點涵蓋 200+ 個模型,究竟值不值得。
底線
如果你沒有其他整合方式,請用原生 Messages 端點呼叫 Claude Opus 5 API;如果想要一個用戶端處理所有事情,就用 OpenAI 相容端點。當任務困難、上下文很長,而且輸出價值為每百萬個 token 25 美元時,它是正確的模型;當任務是例行公事時,它就是錯誤的模型。最乾淨的設定是能讓你改變主意的設定:一個端點、你自己的金鑰、$0 加成,以及一個當工作量改變時可以替換的模型 ID。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
