
Claude Opus 5 API:呼び出し方、料金、そして過剰になるケース
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 53 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 58 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 372 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.
2つのエンドポイント、1つのモデル
Claude Opus 5 APIのほとんどのチュートリアルは、ネイティブのAnthropic呼び出しのみを紹介して、そこで止まっています。実際には2つの方言があり、どちらも同じ重みに到達します。
• Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.
• OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.
• クラウドモデル。Amazon BedrockではIDはanthropic.claude-opus-5、Google Vertex AIとMicrosoft FoundryではファーストパーティIDのclaude-opus-5を使用します。これらのパスは、すでに特定のクラウドプロバイダーを利用しているチーム向けです。コードの移植性を保つのはOpenAI互換ルートです。
モデルは、どの方言を使うかは気にしません。異なるのは、呼び出しを取り巻くすべてのもの、つまり請求、キー、レート制限、フェイルオーバー、そしてコードを変更せずに到達できる他のモデルの数です。
得られるもの — そして古いコードを壊す2つのこと
Claude Opus 5 は、Anthropic の推論重視のフラッグシップモデルであり、1Mトークンのコンテキストウィンドウ(最大値がデフォルトでもある)、128Kトークンの出力上限、2026年5月時点の知識カットオフ、テキスト・画像・ファイルの入力とテキスト出力を備えている。独立した Artificial Analysis リーダーボードでは、以下のスコアを記録した:AA Coding 78.0(132件中1位)、およびAA Intelligence 63.1(134件中2位)、GPQA Diamond は93.2、Humanity's Last Exam は54.9(2026年7月24日時点)。Anthropic 自身のローンチ時の主張(Frontier-Bench における Opus 4.8 の約2倍)はベンダーが実行したものであり、独立には再現されていない。

思考は デフォルトでオン。アダプティブ思考は、各呼び出しでどれだけ推論するかを決定し、output_config.effortパラメータによって制御されます。このパラメータはlowからmaxまでを受け付け、デフォルトはhighです。コーディングおよびエージェンティックループでは、xhighが推奨される出発点です。lowとmediumは、従来モデルよりもOpus 5で真に強力であり、おもちゃの呼び出しではなく実際のワークロードに使用できます。推論トークンは出力の請求にカウントされます。
Claude Opus 4.8 の2つの破壊的変更は、古いリクエストボディをコピーする人に影響します。
• タイトなmax_tokensは、現在では出力を切り詰めます。思考がデフォルトで実行されるため、max_tokensが期待される回答の長さに合わせて設定されていると、最初に推論によって消費されます。4.8のワークロードをそのまま移行する場合、上限を引き上げるか労力を減らすまで、出力の切断が予想されます。
• サンプリングパラメータは拒否されます。 temperature、top_p、および top_kがデフォルト以外の値の場合、400エラーを返します。アシスタントプレフィルも同様です。出力を制御するにはeffortを使用し、temperatureは使用しません。
• thinkingの無効化には上限があります。 thinking: {"type": "disabled"}が受け入れられるのは effort が high 以下の場合のみです。それを xhigh または max と組み合わせると400が返ります。コストを削減する賢明な方法は、effortを下げることであり、thinkingをオフにすることではありません。
実際にかかる費用
Claude Opus 5 の価格は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドル — これはClaude Opus 4.8と同じ価格であり、今回のリリースのひそかな良い知らせです。キャッシュ読み取りの料金は100万トークンあたり0.50ドル(プロンプトキャッシングには512トークン以上のプレフィックスが必要で、5分と1時間のTTLをサポート)。研究プレビューの高速モードは、同じモデルを出力トークン毎秒最大2.5倍の速度で実行でき、価格は10ドル / 50ドルです。また、Batch APIは非同期で結果を返し、半額です。

具体的な請求書の例:100Kトークンのリクエストで20Kトークンの出力が生成されると、課金は入力$0.50、出力$0.50で、合計$1.00(キャッシュなし)。次の呼び出しでその100Kプロンプトがキャッシュから提供されれば、入力側は約$0.05に下がり、$0.55の往復コストになります。このキャッシュ計算こそが、長く繰り返されるコンテキストでOpusが手頃になるか、そもそも手頃にならないかの分かれ目です。
参考までに、上位と下位の層は: Claude Fable 5はAnthropicの最も高性能なモデルで、価格は$10 / $50; Claude Sonnet 5は$3 / $15($2 / $10という2026年8月31日までの導入価格); Claude Haiku 4.5は$1 / $5。OrcaRouterでは、これらはすべてトークンごとのマークアップなしでベンダーのリスト価格のまま適用されるため、上記の比較は実際に支払う金額そのものです。
単一エンドポイントの場合
Claude Opus 5 APIガイドを読んでいるなら、おそらくすでにインテグレーションとキーを持っているでしょう。本当の問いは、次に試すモデル用に2つ目のインテグレーションと2つ目のキーが必要かどうかです。OrcaRouterは、200以上のモデルの前に置く1つのOpenAI互換エンドポイントでその問いに答えます。同じクライアント、同じベースURL、モデルごとに異なるモデルID — anthropic/claude-opus-5を今日は使い、ワークロードがOpus級の価値を生まなくなったらより安価なモデルに、新しいフロンティアモデルがリリースされたその週にはそれに切り替える。すべてコード変更なしで。

経済面は正直なところです。OrcaRouterが上乗せするのはトークンあたり$0であり、あなたは各プロバイダーの公開料金を支払うので、Claude Opus 5はAnthropicの$5 / $25のままであり、ベンダーの値下げは発表当日に当社側でも反映されます。キーの持ち込みは第一級のオプションです。既存のAnthropic APIキーを渡し、自分のレート制限とクレジットを維持し、プロバイダーが直接請求します。ガードレール(PIIシールドとコンテンツポリシー)は、リクエストが課金される前に適用され、後からではありません。モデルページ(anthropic/claude-opus-5)には、ライブ価格、100万トークンのコンテキスト、現在のスループット数値が表示されます。また、ルーティングDSLはフェイルオーバーを構成するため、Opus 5がエラーを起こした場合や、トラフィックの形状が許す場合には、より安価なモデルが応答します。
Opus 5が不正解の場合
最高であることは、あなたのワークロードに適していることと同じではなく、$5 / $25 のフラッグシップが劣る点は3つあります。
• 高頻度・低リスクのコール。月間1000万入力トークンを処理する要約または分類パイプラインのコストは、Claude Opus 5では$50である一方、Claude Haiku 4.5では$10—同じエンドポイント、同じキー、IDを1つ変えるだけです。HaikuはOpusではありませんが、ルーティング、抽出、フォーマットのような用途では、5倍のコスト差を正当化するのが難しいほど十分に近い性能です。
• 長いエージェントループ。Opus 5 は促されなくても自身の作業を検証するため、古いモデル向けに調整された「自分の答えを再確認して」という指示は、過剰検証を引き起こし、推論トークンを浪費します。xhigh および max effort では、思考予算は設計上増加します。エージェントがフロンティア推論を必要としない場合、$3 / $15 の Claude Sonnet 5 がほとんどのプロダクションチームにとって最初に使用すべきデフォルトであり、努力量ダイヤルで下げる調整をします。
• モデルが当社のものではない場合。OrcaRouterはルーティングと課金を行い、Anthropicはウェイトを実行します。エンドポイント、ゼロマークアップ、フェイルオーバー、ガードレールは当社のものですが、推論品質と安全性の動作はAnthropicのものであり、BYOKの場合は料金は直接Anthropicに支払われます。これが明確に述べられた契約内容です。どちらにしてもプロバイダー料金を支払うことになり、問題は200以上のモデルに対して1つのエンドポイントが価値があるかどうかです。
結論
他の統合手段がない場合は、ネイティブのMessagesエンドポイントでClaude Opus 5 APIを呼び出し、すべてを1つのクライアントで処理したい場合は、OpenAI互換エンドポイントを使用してください。このモデルは、タスクが難しく、コンテキストが長く、出力が100万トークンあたり25ドルの価値がある場合に適したモデルです。逆に、タスクが日常的な場合は不適切です。最もクリーンなセットアップは、考えを変更できるものです。つまり、1つのエンドポイント、自分のキー、$0のマークアップ、そしてワークロードが変わった日に交換できるモデルIDを備えた構成です。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
