
Claude Opus 5 API:呼び出し方、料金、そして過剰になるケース
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianNEWQwen3.8 27B2026-08-1552知能68コーディング
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.
2つのエンドポイント、1つのモデル
Claude Opus 5 APIのほとんどのチュートリアルは、ネイティブのAnthropic呼び出しのみを紹介して、そこで止まっています。実際には2つの方言があり、どちらも同じ重みに到達します。
• Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.
• OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.
• クラウドモデル。Amazon BedrockではIDはanthropic.claude-opus-5、Google Vertex AIとMicrosoft FoundryではファーストパーティIDのclaude-opus-5を使用します。これらのパスは、すでに特定のクラウドプロバイダーを利用しているチーム向けです。コードの移植性を保つのはOpenAI互換ルートです。
モデルは、どの方言を使うかは気にしません。異なるのは、呼び出しを取り巻くすべてのもの、つまり請求、キー、レート制限、フェイルオーバー、そしてコードを変更せずに到達できる他のモデルの数です。
得られるもの — そして古いコードを壊す2つのこと
Claude Opus 5 は、Anthropic の推論重視のフラッグシップモデルであり、1Mトークンのコンテキストウィンドウ(最大値がデフォルトでもある)、128Kトークンの出力上限、2026年5月時点の知識カットオフ、テキスト・画像・ファイルの入力とテキスト出力を備えている。独立した Artificial Analysis リーダーボードでは、以下のスコアを記録した:AA Coding 78.0(132件中1位)、およびAA Intelligence 63.1(134件中2位)、GPQA Diamond は93.2、Humanity's Last Exam は54.9(2026年7月24日時点)。Anthropic 自身のローンチ時の主張(Frontier-Bench における Opus 4.8 の約2倍)はベンダーが実行したものであり、独立には再現されていない。

思考は デフォルトでオン。アダプティブ思考は、各呼び出しでどれだけ推論するかを決定し、output_config.effortパラメータによって制御されます。このパラメータはlowからmaxまでを受け付け、デフォルトはhighです。コーディングおよびエージェンティックループでは、xhighが推奨される出発点です。lowとmediumは、従来モデルよりもOpus 5で真に強力であり、おもちゃの呼び出しではなく実際のワークロードに使用できます。推論トークンは出力の請求にカウントされます。
Claude Opus 4.8 の2つの破壊的変更は、古いリクエストボディをコピーする人に影響します。
• タイトなmax_tokensは、現在では出力を切り詰めます。思考がデフォルトで実行されるため、max_tokensが期待される回答の長さに合わせて設定されていると、最初に推論によって消費されます。4.8のワークロードをそのまま移行する場合、上限を引き上げるか労力を減らすまで、出力の切断が予想されます。
• サンプリングパラメータは拒否されます。 temperature、top_p、および top_kがデフォルト以外の値の場合、400エラーを返します。アシスタントプレフィルも同様です。出力を制御するにはeffortを使用し、temperatureは使用しません。
• thinkingの無効化には上限があります。 thinking: {"type": "disabled"}が受け入れられるのは effort が high 以下の場合のみです。それを xhigh または max と組み合わせると400が返ります。コストを削減する賢明な方法は、effortを下げることであり、thinkingをオフにすることではありません。
実際にかかる費用
Claude Opus 5 の価格は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドル — これはClaude Opus 4.8と同じ価格であり、今回のリリースのひそかな良い知らせです。キャッシュ読み取りの料金は100万トークンあたり0.50ドル(プロンプトキャッシングには512トークン以上のプレフィックスが必要で、5分と1時間のTTLをサポート)。研究プレビューの高速モードは、同じモデルを出力トークン毎秒最大2.5倍の速度で実行でき、価格は10ドル / 50ドルです。また、Batch APIは非同期で結果を返し、半額です。

具体的な請求書の例:100Kトークンのリクエストで20Kトークンの出力が生成されると、課金は入力$0.50、出力$0.50で、合計$1.00(キャッシュなし)。次の呼び出しでその100Kプロンプトがキャッシュから提供されれば、入力側は約$0.05に下がり、$0.55の往復コストになります。このキャッシュ計算こそが、長く繰り返されるコンテキストでOpusが手頃になるか、そもそも手頃にならないかの分かれ目です。
参考までに、上位と下位の層は: Claude Fable 5はAnthropicの最も高性能なモデルで、価格は$10 / $50; Claude Sonnet 5は$3 / $15($2 / $10という2026年8月31日までの導入価格); Claude Haiku 4.5は$1 / $5。OrcaRouterでは、これらはすべてトークンごとのマークアップなしでベンダーのリスト価格のまま適用されるため、上記の比較は実際に支払う金額そのものです。
単一エンドポイントの場合
Claude Opus 5 APIガイドを読んでいるなら、おそらくすでにインテグレーションとキーを持っているでしょう。本当の問いは、次に試すモデル用に2つ目のインテグレーションと2つ目のキーが必要かどうかです。OrcaRouterは、200以上のモデルの前に置く1つのOpenAI互換エンドポイントでその問いに答えます。同じクライアント、同じベースURL、モデルごとに異なるモデルID — anthropic/claude-opus-5を今日は使い、ワークロードがOpus級の価値を生まなくなったらより安価なモデルに、新しいフロンティアモデルがリリースされたその週にはそれに切り替える。すべてコード変更なしで。

経済面は正直なところです。OrcaRouterが上乗せするのはトークンあたり$0であり、あなたは各プロバイダーの公開料金を支払うので、Claude Opus 5はAnthropicの$5 / $25のままであり、ベンダーの値下げは発表当日に当社側でも反映されます。キーの持ち込みは第一級のオプションです。既存のAnthropic APIキーを渡し、自分のレート制限とクレジットを維持し、プロバイダーが直接請求します。ガードレール(PIIシールドとコンテンツポリシー)は、リクエストが課金される前に適用され、後からではありません。モデルページ(anthropic/claude-opus-5)には、ライブ価格、100万トークンのコンテキスト、現在のスループット数値が表示されます。また、ルーティングDSLはフェイルオーバーを構成するため、Opus 5がエラーを起こした場合や、トラフィックの形状が許す場合には、より安価なモデルが応答します。
Opus 5が不正解の場合
最高であることは、あなたのワークロードに適していることと同じではなく、$5 / $25 のフラッグシップが劣る点は3つあります。
• 高頻度・低リスクのコール。月間1000万入力トークンを処理する要約または分類パイプラインのコストは、Claude Opus 5では$50である一方、Claude Haiku 4.5では$10—同じエンドポイント、同じキー、IDを1つ変えるだけです。HaikuはOpusではありませんが、ルーティング、抽出、フォーマットのような用途では、5倍のコスト差を正当化するのが難しいほど十分に近い性能です。
• 長いエージェントループ。Opus 5 は促されなくても自身の作業を検証するため、古いモデル向けに調整された「自分の答えを再確認して」という指示は、過剰検証を引き起こし、推論トークンを浪費します。xhigh および max effort では、思考予算は設計上増加します。エージェントがフロンティア推論を必要としない場合、$3 / $15 の Claude Sonnet 5 がほとんどのプロダクションチームにとって最初に使用すべきデフォルトであり、努力量ダイヤルで下げる調整をします。
• モデルが当社のものではない場合。OrcaRouterはルーティングと課金を行い、Anthropicはウェイトを実行します。エンドポイント、ゼロマークアップ、フェイルオーバー、ガードレールは当社のものですが、推論品質と安全性の動作はAnthropicのものであり、BYOKの場合は料金は直接Anthropicに支払われます。これが明確に述べられた契約内容です。どちらにしてもプロバイダー料金を支払うことになり、問題は200以上のモデルに対して1つのエンドポイントが価値があるかどうかです。
結論
他の統合手段がない場合は、ネイティブのMessagesエンドポイントでClaude Opus 5 APIを呼び出し、すべてを1つのクライアントで処理したい場合は、OpenAI互換エンドポイントを使用してください。このモデルは、タスクが難しく、コンテキストが長く、出力が100万トークンあたり25ドルの価値がある場合に適したモデルです。逆に、タスクが日常的な場合は不適切です。最もクリーンなセットアップは、考えを変更できるものです。つまり、1つのエンドポイント、自分のキー、$0のマークアップ、そしてワークロードが変わった日に交換できるモデルIDを備えた構成です。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
