Claude Opus 5 APIガイドのタイトルカード。丸みを帯びたゲートウェイカードに、コードチップとして「POST /v1/messages」と「model: claude-opus-5」が表示され、価格タグには「1Mトークンあたり$5 / $25」と表示されています。さらに、Claude、GPT、Gemini、Qwenとラベル付けされた4つのモデルチップが、細い線で単一のゲートウェイに接続されています。
Guides & Insights

Claude Opus 5 API:呼び出し方、料金、そして過剰になるケース

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

The Claude Opus 5 API is live on the Messages endpoint and on every OpenAI-compatible gateway that carries it. To call it directly you POST to https://api.anthropic.com/v1/messages with the model id claude-opus-5 and the anthropic-version: 2023-06-01 header. To call it with an OpenAI-style client — the route that needs no new SDK — you point your base URL at https://api.orcarouter.ai/v1 and pass the model id anthropic/claude-opus-5, which is how OrcaRouter exposes it. The price is identical on both: $5 per million input tokens and $25 per million output, exactly the list rate with zero markup. It launched on July 24, 2026, and it is the current Opus tier — Claude Opus 4.8 costs the same $5 / $25 and scores lower on the independent benchmarks. The interesting decision is not which dialect to use; it is whether Opus-tier is what your workload actually needs.

2つのエンドポイント、1つのモデル

Claude Opus 5 APIのほとんどのチュートリアルは、ネイティブのAnthropic呼び出しのみを紹介して、そこで止まっています。実際には2つの方言があり、どちらも同じ重みに到達します。

Anthropic native — /v1/messages. POST to https://api.anthropic.com/v1/messages with two required headers: x-api-key with your key and anthropic-version: 2023-06-01. The body carries model: "claude-opus-5", a max_tokens, and a messages array. This is what the Anthropic Python and TypeScript SDKs send under the hood.

OpenAI-compatible — /v1/chat/completions. POST to https://api.orcarouter.ai/v1/chat/completions (or /v1/messages if you want the Anthropic dialect through the same host) with the model id anthropic/claude-opus-5. If you already run an OpenAI client, the switch is two lines: change base_url to https://api.orcarouter.ai/v1 and swap the API key. Nothing else in your request shape changes.

クラウドモデル。Amazon BedrockではIDはanthropic.claude-opus-5Google Vertex AIとMicrosoft FoundryではファーストパーティIDのclaude-opus-5を使用します。これらのパスは、すでに特定のクラウドプロバイダーを利用しているチーム向けです。コードの移植性を保つのはOpenAI互換ルートです。

モデルは、どの方言を使うかは気にしません。異なるのは、呼び出しを取り巻くすべてのもの、つまり請求、キー、レート制限、フェイルオーバー、そしてコードを変更せずに到達できる他のモデルの数です。

得られるもの — そして古いコードを壊す2つのこと

Claude Opus 5 は、Anthropic の推論重視のフラッグシップモデルであり、1Mトークンのコンテキストウィンドウ(最大値がデフォルトでもある)、128Kトークンの出力上限、2026年5月時点の知識カットオフ、テキスト・画像・ファイルの入力とテキスト出力を備えている。独立した Artificial Analysis リーダーボードでは、以下のスコアを記録した:AA Coding 78.0(132件中1位)、およびAA Intelligence 63.1(134件中2位)、GPQA Diamond は93.2、Humanity's Last Exam は54.9(2026年7月24日時点)。Anthropic 自身のローンチ時の主張(Frontier-Bench における Opus 4.8 の約2倍)はベンダーが実行したものであり、独立には再現されていない。

A spec and benchmark scoreboard for Claude Opus 5: 1M token context window, 128K max output, $5 / $25 list price, $0.50 per 1M cache read, AA Coding 78.0 ranked #1 of 132, and AA Intelligence 63.1 ranked #2 of 134.

思考は デフォルトでオン。アダプティブ思考は、各呼び出しでどれだけ推論するかを決定し、output_config.effortパラメータによって制御されます。このパラメータはlowからmaxまでを受け付け、デフォルトはhighです。コーディングおよびエージェンティックループでは、xhighが推奨される出発点です。lowmediumは、従来モデルよりもOpus 5で真に強力であり、おもちゃの呼び出しではなく実際のワークロードに使用できます。推論トークンは出力の請求にカウントされます。

Claude Opus 4.8 の2つの破壊的変更は、古いリクエストボディをコピーする人に影響します。

タイトなmax_tokensは、現在では出力を切り詰めます。思考がデフォルトで実行されるため、max_tokensが期待される回答の長さに合わせて設定されていると、最初に推論によって消費されます。4.8のワークロードをそのまま移行する場合、上限を引き上げるか労力を減らすまで、出力の切断が予想されます。

サンプリングパラメータは拒否されます。 temperaturetop_p、および top_kがデフォルト以外の値の場合、400エラーを返します。アシスタントプレフィルも同様です。出力を制御するにはeffortを使用し、temperatureは使用しません。

thinkingの無効化には上限があります。 thinking: {"type": "disabled"}が受け入れられるのは effort が high 以下の場合のみです。それを xhigh または max と組み合わせると400が返ります。コストを削減する賢明な方法は、effortを下げることであり、thinkingをオフにすることではありません。

実際にかかる費用

Claude Opus 5 の価格は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドル — これはClaude Opus 4.8と同じ価格であり、今回のリリースのひそかな良い知らせです。キャッシュ読み取りの料金は100万トークンあたり0.50ドル(プロンプトキャッシングには512トークン以上のプレフィックスが必要で、5分と1時間のTTLをサポート)。研究プレビューの高速モードは、同じモデルを出力トークン毎秒最大2.5倍の速度で実行でき、価格は10ドル / 50ドルです。また、Batch APIは非同期で結果を返し、半額です。

A price comparison card for the Claude Opus 5 API: Opus 5 at $5/$25 with a $0.50 cache read, $10/$50 fast mode and roughly half-price Batch API, Claude Opus 4.8 at the same $5/$25, Claude Sonnet 5 at $3/$15 with $2/$10 intro pricing, Claude Haiku 4.5 at $1/$5, and a worked example of 100K tokens in plus 20K out billing $1.00 uncached or about $0.55 cached.

具体的な請求書の例:100Kトークンのリクエストで20Kトークンの出力が生成されると、課金は入力$0.50、出力$0.50で、合計$1.00(キャッシュなし)。次の呼び出しでその100Kプロンプトがキャッシュから提供されれば、入力側は約$0.05に下がり、$0.55の往復コストになります。このキャッシュ計算こそが、長く繰り返されるコンテキストでOpusが手頃になるか、そもそも手頃にならないかの分かれ目です。

参考までに、上位と下位の層は: Claude Fable 5はAnthropicの最も高性能なモデルで、価格は$10 / $50Claude Sonnet 5$3 / $15$2 / $10という2026年8月31日までの導入価格); Claude Haiku 4.5$1 / $5。OrcaRouterでは、これらはすべてトークンごとのマークアップなしでベンダーのリスト価格のまま適用されるため、上記の比較は実際に支払う金額そのものです。

単一エンドポイントの場合

Claude Opus 5 APIガイドを読んでいるなら、おそらくすでにインテグレーションとキーを持っているでしょう。本当の問いは、次に試すモデル用に2つ目のインテグレーションと2つ目のキーが必要かどうかです。OrcaRouterは、200以上のモデルの前に置く1つのOpenAI互換エンドポイントでその問いに答えます。同じクライアント、同じベースURL、モデルごとに異なるモデルID — anthropic/claude-opus-5を今日は使い、ワークロードがOpus級の価値を生まなくなったらより安価なモデルに、新しいフロンティアモデルがリリースされたその週にはそれに切り替える。すべてコード変更なしで。

The OrcaRouter model page for anthropic/claude-opus-5, showing the $5.00 per million input and $25.00 per million output pricing, a 1,000,000-token context window, the released July 24, 2026 label, and both OpenAI-compatible and Anthropic-native endpoints.

経済面は正直なところです。OrcaRouterが上乗せするのはトークンあたり$0であり、あなたは各プロバイダーの公開料金を支払うので、Claude Opus 5はAnthropicの$5 / $25のままであり、ベンダーの値下げは発表当日に当社側でも反映されます。キーの持ち込みは第一級のオプションです。既存のAnthropic APIキーを渡し、自分のレート制限とクレジットを維持し、プロバイダーが直接請求します。ガードレール(PIIシールドとコンテンツポリシー)は、リクエストが課金される前に適用され、後からではありません。モデルページ(anthropic/claude-opus-5)には、ライブ価格、100万トークンのコンテキスト、現在のスループット数値が表示されます。また、ルーティングDSLはフェイルオーバーを構成するため、Opus 5がエラーを起こした場合や、トラフィックの形状が許す場合には、より安価なモデルが応答します。

Opus 5が不正解の場合

最高であることは、あなたのワークロードに適していることと同じではなく、$5 / $25 のフラッグシップが劣る点は3つあります。

高頻度・低リスクのコール。月間1000万入力トークンを処理する要約または分類パイプラインのコストは、Claude Opus 5では$50である一方、Claude Haiku 4.5では$10—同じエンドポイント、同じキー、IDを1つ変えるだけです。HaikuはOpusではありませんが、ルーティング、抽出、フォーマットのような用途では、5倍のコスト差を正当化するのが難しいほど十分に近い性能です。

長いエージェントループ。Opus 5 は促されなくても自身の作業を検証するため、古いモデル向けに調整された「自分の答えを再確認して」という指示は、過剰検証を引き起こし、推論トークンを浪費します。xhigh および max effort では、思考予算は設計上増加します。エージェントがフロンティア推論を必要としない場合、$3 / $15 の Claude Sonnet 5 がほとんどのプロダクションチームにとって最初に使用すべきデフォルトであり、努力量ダイヤルで下げる調整をします。

モデルが当社のものではない場合。OrcaRouterはルーティングと課金を行い、Anthropicはウェイトを実行します。エンドポイント、ゼロマークアップ、フェイルオーバー、ガードレールは当社のものですが、推論品質と安全性の動作はAnthropicのものであり、BYOKの場合は料金は直接Anthropicに支払われます。これが明確に述べられた契約内容です。どちらにしてもプロバイダー料金を支払うことになり、問題は200以上のモデルに対して1つのエンドポイントが価値があるかどうかです。

結論

他の統合手段がない場合は、ネイティブのMessagesエンドポイントでClaude Opus 5 APIを呼び出し、すべてを1つのクライアントで処理したい場合は、OpenAI互換エンドポイントを使用してください。このモデルは、タスクが難しく、コンテキストが長く、出力が100万トークンあたり25ドルの価値がある場合に適したモデルです。逆に、タスクが日常的な場合は不適切です。最もクリーンなセットアップは、考えを変更できるものです。つまり、1つのエンドポイント、自分のキー、$0のマークアップ、そしてワークロードが変わった日に交換できるモデルIDを備えた構成です。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube