テクノロジーブログのヒーロー向け、モデル価格設定をテーマにしたエディトリアルフラットベクターイラストレーション:明るい背景に大きな角丸のモデルチップ、その角に価格タグがクリップされ、そこから3本のトークンストリームが流れ出て円形の価格ゲージに注ぎ込む。ゲージの横には小さなキャッシュブロックのスタック。深い青とシアンのパレット、クリーンでモダンなSaaS美学、読解可能なテキストは一切なし。
Guides & Insights

Claude Opus 5 APIの料金:100万トークンあたり$5 / $25、キャッシュは$0.50、そして実際にかかるコストとは

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Claude Opus 5は、入力トークン100万件あたり5.00ドル、出力トークン100万件あたり25.00ドルですこれはClaude Opus 5 APIでの料金です。OrcaRouterディレクトリに掲載されている同モデルの料金(2026-08-18確認、マークアップなし)と同じレートです。つまり、Claude Fable 5の半額であり、Claude Opus 4.8とまったく同じコストです。予算を組む際の基準となるのは、公開中のClaude Opus 5モデルページにある料金表です。見出しの数字よりも重要なのは価格調整の仕組みです。プロンプトキャッシュによる入力トークン再利用は100万件あたり0.50ドル、バッチ処理では2.50ドル/12.50ドルに下がり、高速モードのベータ版は10ドル/50ドルです。このページは、このモデルの料金に関するリファレンスです。正確な料金表、リクエストの実際のコスト、他モデルとの価格比較、このモデルを選ぶべきでないケース、そして独自のAPIキーを使って1つのOpenAI互換エンドポイントから呼び出す方法をまとめています。

価格は100万トークンあたり(入力/出力)で、2026年8月18日時点のものです。ドル表示の数値は、Anthropicが公開しているAPI料金から読み取り、Claude Opus 5のOrcaRouterモデルページと照合しています。キャッシュ、バッチ、高速モードの料金はAnthropicが発表したものです。価格は変動します。構築する前に確認してください。

本日確認済みの正確な価格

これは、2026-08-18に確認されたClaude Opus 5の完全な料金表です:

Price card titled 'Claude Opus 5 — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $25.00 and Cache read $0.50. Rows below list cache write 5-minute TTL $6.25, cache write 1-hour TTL $10.00, batch $2.50 input / $12.50 output, fast mode $10 / $50, context window 1M tokens and max output 128K. Footer: reused input costs one tenth of fresh input.

入力 — キャッシュミス時、1Mトークンあたり$5.00.

出力 — 100万トークンあたり$25.00。

プロンプトキャッシュ書き込み — 5分TTLでは1Mあたり$6.25、1時間TTLでは1Mあたり$10.00。

プロンプトキャッシュ読み取り — 1Mトークンあたり$0.50、再送信する入力は90%割引。

Batch API — 入力 $2.50 / 出力 $12.50、一律50%オフ、非同期。

高速モード — 入力$10 / 出力$50、最大で約2.5倍の出力速度に対して2倍のプレミアム、Anthropic beta。

コンテキストウィンドウ — 1Mトークン、最大128K出力。

OrcaRouter はプロバイダーのレートをマークアップなしでそのまま通すので、ディレクトリに記載されている金額がそのまま支払額になります。ライブモデルページでは、カードに $5.00 / $25.00(1Mあたり)、キャッシュリード $0.500、キャッシュライト $10.00(1時間TTLレート)と表示され、Vision・Tools・JSON・Reasoning のバッジが付いています。

実効価格を変えるレバー

基本レートは単なる出発点にすぎません。3つの調整要素が、Opus 5の実際のコストを左右します:

Prompt caching — 再利用されたコンテキストは、新規の5ドルではなく、100万トークンあたり0.50ドルで課金されます。Opus 5ではキャッシュ可能な最小プレフィックスがおよそ512トークンに短縮されたため、控えめで安定したシステムプロンプトでも対象になります。毎ターン大きなプレフィックスを再送信するエージェントやチャットにとって、キャッシングは請求額に対する最大のてこです。また、AnthropicはAPIキーごとにキャッシュを管理するため、1つのキー(1つのチャネル)を使い続けることがキャッシュヒットを維持する鍵です。

バッチ — AnthropicのバッチAPIはジョブを非同期で実行し、結果は通常24時間以内に利用可能で、価格はちょうど半額の$2.50/$12.50です。プロンプトキャッシングと併用でき、レイテンシーが問題にならない評価(evals)、一括分類、オフライン生成に適しています。

高速モード — 最大約2.5倍の出力スループットを実現し、レイテンシが重要な高負荷作業に役立ちます。バッチAPIとは併用できず、Anthropicのファーストパーティベータです。ルーターからの標準的なパススルーレートは基本の$5/$25です。

リクエストの実際のコスト

トークン単価は抽象的でわかりにくいので、本日のレートでの具体的な計算例を示します:

1回のチャット呼び出し、50K入力 + 20K出力 — $0.25 + $0.50 = $0.75

1M入力 + 1M出力 — $5 + $25 = $30

Agentic turn、200Kキャッシュコンテキスト + 20K新規入力 + 30K出力 — $0.10 + $0.10 + $0.75 = $0.95。同じターンをコールドキャッシュで行う場合 — 220K新規入力で$1.10 — 合計は$1.85。キャッシュによりほぼ半減します。

入力70%・出力30%の10Mトークン月で、入力の80%がキャッシュから提供される場合: 1.4M新規入力($7.00) + 5.6Mキャッシュ入力($2.80) + 3M出力($75) ≈ $85。キャッシュなしの場合、同じ月は$110

2つの注意点により、実効レートは上昇します。{{1}}Opus 5は思考モデルであり、アダプティブ思考がデフォルトで有効になっています。思考トークンは出力として100万トークンあたり25ドルで課金されます。{{/1}}高い努力設定の難しいプロンプトでは、出力予算の大部分を推論に費やす可能性があるため、難しい作業における実効出力コストは単純な見積もりをはるかに上回ります。{{2}}さらに、Anthropicの現在のトークナイザーは前世代よりも冗長なため、同じ英語テキストは古いClaudeモデルよりも多くのトークンを消費し(コストも高くなります)。{{/2}}簡単な呼び出しでは努力設定を下げ、可能な場合は出力を上限に抑えてください。

Opus 5の価格設定を競合他社と比較

Comparison table card titled 'USD per 1M tokens — published list prices', verified 2026-08-18, with an input/output column pair per model: Claude Opus 5 $5.00/$25.00 highlighted with a 'THIS PAGE' tag; Claude Opus 4.8 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Sonnet 5 $3.00/$15.00 (intro $2.00/$10.00 through Aug 31); GPT-5.6 Sol $5.00/$30.00; GPT-5.6 Terra $2.00/$12.00; Gemini 3.6 Flash $1.50/$7.50; Kimi K3 $3.00/$15.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Opus 5 is half the price of Claude Fable 5, the same price as Claude Opus 4.8, and 20% cheaper on output than GPT-5.6 Sol.

2026-08-18に公表されたリスト価格に照らして読み取った値:

Claude Opus 4.8 — $5 / $25。前世代と同じ価格です。新しいモデルの Opus 5 も同じ価格なので、アップグレードしやすいケースです。

Claude Fable 5 — $10 / $50。Opus 5はAnthropicの最上位モデルの半額で、同じ1Mトークンのコンテキストを備えています。

Claude Sonnet 5 — 標準価格は$3/$15(2026年8月31日までの特別価格は$2/$10)。Sonnetティアは入力・出力とも40%安く、Opusレベルの推論が不要な場合の自然なデフォルトです。

GPT-5.6 Sol — $5 / $30。入力価格は同じで、Opus 5では出力がより安価です。

GPT-5.6 Terra — $2 / $12。高ボリュームのノンフロンティア業務向けのボリューム中間ティア。

Gemini 3.6 Flash — $1.50 / $7.50。安価で高速、マルチモーダルなトラフィック向けのFlash層モデルです。

Kimi K3 — $3 / $15。オープンウェイトのフラッグシップで、Opusの料金のおよそ半分です。

DeepSeek V4 Pro — オフピーク時は$0.44 / $0.88(ピーク時間帯は2倍)。安価なオープンウェイトのフラッグシップであり、価格の次元がまったく違う世界だ。

正直に言うと、Opus 5は安価なモデルではありません。最上位モデル(Claude Fable 5)の半額で、前世代とちょうど同じ価格のフラグシップです。長文コンテキストあたりのコストと高難度推論あたりのコストでは優れていますが、絶対的な料金で優れているわけではありません。トラフィックが短いプロンプトと単純なタスク中心なら、$3のSonnetや$0.44のDeepSeekモデルの方が安い選択です。

Opus 5が不適切な場合

この価格がご希望の価格ではない4つのケース:

短くシンプルなプロンプト。約2万トークン未満で深い推論を必要としない場合、Opusのプレミアムは無駄になります。Claude Sonnet 5は$3/$15(または導入期間中は$2/$10)でボリューム層を40%安く処理でき、Gemini FlashやDeepSeekクラスのモデルはさらにずっと安価です。

推論負荷の高いボリューム。思考は出力として請求されるため、高努力設定の難しいプロンプトは、名目上の出力トークン数をはるかに超えるコストになることがあります。ワークロードが多くの難しい呼び出しを含む場合は、コミットする前に実際の出力トークンを測定してください。実効レートには驚かされるかもしれません。

トークン単価を唯一の目標とする。 フロンティアベンチマークスコアや1Mコンテキストが必須条件でないなら、より安価なフラグシップ(GPT-5.6 Terra、DeepSeek V4 Pro)やFlashグレードのモデル(Gemini 3.6 Flash)は、簡単なトラフィックの大半に対してはるかに低いトークン単価を実現します。

厳格なレイテンシ予算。 Opus 5 は大規模な思考モデルで、OrcaRouter の 7 日間の測定では、p50 の Time-to-First-Token は約 7 秒です。サブ秒の TTFT が重要となるリアルタイムチャットでは、価格に関係なく不適切なモデルです。

OrcaRouterでの呼び出し方

Screenshot of the OrcaRouter model page for Claude Opus 5 (model ID anthropic/claude-opus-5): a New Featured badge, Vision/Tools/JSON/Reasoning capability badges, 1M token context and 128K max output, input $5.00 and output $25.00 per 1M tokens, cache read $0.500 and cache write $10.00, p50 TTFT 7.06s, the /v1/chat/completions and /v1/messages endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

Claude Opus 5 は OrcaRouter 上でモデル ID anthropic/claude-opus-5 としてホストされており、OpenAI 互換エンドポイント api.orcarouter.ai/v1 を通じて、プロバイダー料金・マークアップなしで提供されます。すでに OpenAI クライアントをお持ちの場合、移行はベース URL とモデル ID の変更だけです。同じキーとエンドポイントで 200 以上のモデルを利用できるため、Opus 5 は Claude Sonnet 5、Claude Haiku 4.5、GPT-5.6 ティア、Gemini ファミリー、そして比較したいオープンウェイトモデルの隣に並んでおり、それぞれを再統合する代わりに難易度に応じてルーティングできます。

価格ページで紹介する価値のある OrcaRouter の 2 つの特徴。 BYOK: お手持ちの Anthropic キーを使用でき、Anthropic が独自料金で直接請求します。OrcaRouter はトークンあたり $0 を追加し、プロバイダーのレート制限とクレジットをそのまま維持します。 Guardrails: PII Shield とコンテンツポリシーは課金前に実行されるため、ブロックされたリクエストはクリーンな 400 を返し、課金されることはありません。また、Agent Firewall はツールと MCP コールを実行前に評価します。

価格ページにとって重要な正直な注意書き:当社はモデルをルーティングするだけで、価格を設定するわけではありません。$5 / $25という数字はAnthropicの料金をそのまま転用したものであり、Anthropicがそれを変更すると、リストも追随します。まさにそのため、このページには日付が記載されています。Anthropicを直接呼び出しても同じ料金です。OrcaRouterは、モデルライン全体で単一のエンドポイントが必要な場合に、単一キー・マークアップなしのルートを提供します。

出典と日付

上記のすべての価格は2026年8月18日に検証されました。Claudeの数値はAnthropicが公開しているAPI価格から読み取ったもので、同日に確認したClaude Opus 5のOrcaRouterモデルページとも照合済みです。GPT-5.6の値下げ後価格はOpenAIの公表レートです。Gemini、Kimi、DeepSeekの数値は現在のOrcaRouterディレクトリの掲載情報で、DeepSeek V4 Proはオフピーク時のレートで表示されています(ピーク時間帯は2倍になります)。Anthropicの価格はOpus 5が2026年7月24日にリリースされて以来安定していますが、変動することもあります。過去の「Opus 5価格」ページを見つけた場合は、確認した日付を添えて扱ってください。ここに記載の数値は本日時点のものです。

上記のすべての価格は、Claude Opus 5 モデルページのライブレートであり、2026-08-18にゼロマークアップで検証済み、お客様ご自身のキーですぐにご利用いただけます。

この記事で比較したモデル4

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube