
Claude Opus 5.5の料金:完全な料金表、キャッシュ料金の行、そしてタスクに実際にかかるコスト
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 177 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1323 tok/s
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
Claude Opus 5.5の価格は入力100万トークンあたり$4.00、出力100万トークンあたり$20.00。これは、$5.00/$25.00から一律20%の引き下げであり、その水準をClaude Opus 5が維持してきたものだ。キャッシュ読み取りは60%減の100万あたり$0.20となる。これらはAnthropicが公表した価格で、2026年9月24日にAnthropic自身の価格ドキュメントから読み取ったものだ。モデルの出荷から2日後のことである。表示価格は簡単な部分にすぎない。Anthropicはまた、このモデルは典型的なワークロードで「実行コストが約40%少ない」とも述べており、その数字は価格表には載っていない——単価の引き下げに、同じ仕事を終えるのに使うトークン数とターン数が減るという前提を組み合わせた、ベンダーによる性格づけである。本ページはその2つを切り分ける。今日価格表で検証できるすべての料金と、検証できない数字の裏にある算術だ。 Claude Fable 5.1、その上位にあたる$10/$50のティアは、Anthropic自身が行う比較として全体を通じて登場する。
完全な料金表、Anthropicが公表しているとおりの1行1行まで
このセクションの内容はすべて、platform.claude.comとclaude.comにあるAnthropicの料金ドキュメントから読み取ったものです。2026年9月24日ここにある内容は、別の記事から引き継いだものではありません。
• 入力 — 100万トークンあたり$4.00(Anthropicの公表レート)。
• 出力 — 100万トークンあたり$20.00。思考トークンは出力トークンとして課金され、Claude Opus 5.5の適応的思考は常に有効で、無効にすることはできません。
• キャッシュ読み取り — 100万トークンあたり$0.20。Anthropicはこれをベース入力価格の0.05倍と明記しており、このモデル向けの独自の脚注による例外規定としています。
• 5分間のキャッシュ書き込み — 100万トークンあたり5.00ドル。Anthropicがこの表のすべてのモデルに適用する標準の基本入力1.25倍の乗数です。
• 1時間キャッシュ書き込み — 100万トークンあたり8.00ドル、標準のベース入力2倍の乗数です。
• Batch API — 双方向とも50%オフ:入力100万あたり$2.00、出力は$10.00。Anthropicは、自分で半額に計算させるのではなく、割引後の数値をそのまま公表しています。
• Fast mode — 入力$8.00、出力$40.00(100万あたり)、標準のちょうど2倍。Anthropicのドキュメントでは、このページのタイトルは「Fast mode (research preview)」となっています。
• 米国限定の推論 — 入力、出力、キャッシュ書き込みおよびキャッシュ読み取りに1.1倍の乗数が適用されます(inference_geo: "us"が設定されている場合)。デフォルトであるグローバルルーティングでは、標準価格が適用されます。
• コンテキストと出力上限 — 標準価格でコンテキスト100万トークン、同期出力128K。長コンテキストに対する追加料金はかかりません。Anthropicは、90万トークンのリクエストが9千トークンのものと同じトークン単価で課金されると述べています。Batch APIでは、output-300k-2026-03-24ベータヘッダー
Anthropicはまた、キャッシュの乗数は「Batch APIの割引やデータレジデンシーといった他の料金修飾要因と積み重なる」とも述べている — つまり、バッチ化され、キャッシュされ、米国に固定されたリクエストは3つすべてを掛け合わせ、その計算は置き換わるのではなく複合する。
2つのモデルの読者が同じシート上で実際にコストを比較検討している内容は、次のとおりです:
• Claude Opus 5 — 入力 $5.00、出力 $25.00、キャッシュ読み取り $0.50、5分間のキャッシュ書き込み $6.25、1時間の書き込み $10.00、Batch では $2.50/$12.50(Anthropic の公開料金、2026-09-24 時点)。
• Claude Fable 5.1 — 入力$10.00、出力$50.00、キャッシュ読み取り$0.25、5分間のキャッシュ書き込み$12.50、1時間の書き込み$20.00、Batchでは$5.00/$25.00(Anthropicの公開料金、2026-09-24時点)。

エージェントの請求額が実際に決まるのは、キャッシュラインだ
ローンチ時の報道では、キャッシュ読み取りは脚注扱いだ。大きなプレフィックスを再送信するあらゆるワークロード——つまりコーディングやエージェントのワークロードの大半——にとって、これは価格表の中で最大の単一のレバーである。
Anthropic自身の脚注は、その比率について異例なほど明示している。キャッシュヒットとリフレッシュのコストは、ほとんどのClaudeモデルではベース入力価格の0.1倍、Claude Fable 5.1では0.025倍、そしてClaude Opus 5.5では0.05倍だ。つまり、Claude Opus 5.5のキャッシュ比率は標準の2倍悪く、Claude Fable 5.1の2倍悪いということになる。
ドル換算では結局のところ勝っている。そしてここが肝に銘じる価値のある部分だ:基準率が2.5倍高いとき、より優れた倍率はドルでは勝てない。
• Claude Fable 5.1 — $10.00のベースの2.5%は$0.25キャッシュされたトークン100万件あたり
• Claude Opus 5.5 — 4.00ドルの基本料金の5%は$0.20(100万キャッシュトークンあたり)です。
• Claude Opus 5 — $5.00のベースの10%は$0.50(100万キャッシュ済みトークンあたり)。
書き込み側でも同じ逆転が成り立つ。Claude Fable 5.1 は100万トークンを5分間キャッシュに書き込むのに $12.50、1時間のウィンドウには $20.00 を課金する。Claude Opus 5.5 はそれぞれ $5.00 と $8.00 だ。キャッシュ読み取りは、中間の比率でありながら、絶対額で Claude Opus 5.5 が兄弟2モデルを上回る唯一の項目である。
書き込みにそもそも費用を払う価値があるかどうかは、2つのルールで決まる。Anthropicのドキュメントによると、5分の書き込みはベース入力の1.25倍のコストがかかるため、キャッシュ読み取り1回で元が取れる。一方、1時間の書き込みはベース入力の2倍のコストがかかり、元を取るには2回の読み取りが必要だ。そして、キャッシュはそれを作り出したプレフィックスに紐づく。Anthropicは、高速と標準の速度を切り替えるとキャッシュが無効になると指摘している。速度の異なるリクエストはキャッシュ済みプレフィックスを共有しないためだ。モデル、エフォートレベル、ツール定義を変更しても同じ効果がある。切り替えのたびにプレフィックスの書き直しを強いる安価なモデルは、それが置き換えた高価なモデルよりもコストが高くなることがある。
長いエージェントループが実際にかかるコスト
40ターンのコーディングエージェントを考えよう。これは毎ターン、120,000トークンのプレフィックス——システムプロンプト、ツールスキーマ、ファイルツリー——を再送信し、ツール結果から毎ターン1,000の新規入力トークンを追加し、毎ターン800の出力トークンを生成する。ここで肝心なのは代入だ。これら4つの数値を自分のトラフィックに合わせて変えても、以下の計算はそのまま成り立つ。
Claude Opus 5.5について:
• キャッシュ書き込み、1回 — 120,000トークン、100万トークンあたり$5.00 = $0.60
• キャッシュ読み取り、39ターン — 4,680,000トークン、100万あたり$0.20 = $0.94
• 新規入力、40ターン — 40,000トークン、100万あたり$4.00 = $0.16
• 出力、40ターン — 32,000トークン、100万トークンあたり$20.00 = $0.64
• セッション合計 — $2.34、うちキャッシュ読み取りが約40%。
Claude Opus 5では、同一のトークン数で:キャッシュ書き込みが$0.75、キャッシュ読み取りが$2.34、新規入力が$0.20、出力が$0.80 — $4.09。
Claude Fable 5.1では、同一のトークン数で:キャッシュ書き込みが$1.50、キャッシュ読み取りが$1.17、新規入力が$0.40、出力が$1.60 — $4.67。
同じトークン数、同じターン数、効率性の主張は一切不要 — Claude Opus 5.5 は Claude Opus 5 を43%下回り、Claude Fable 5.1 を50%下回ります。そして Claude Opus 5 との $1.75 の差額のうち $1.40 — つまり節約額の80% — はキャッシュ読み取りの行だけで生じており、見出しの入力単価によるものではありません。
では、逆のパターンを実行します。20,000入力トークンと8,000出力の単発呼び出しで、キャッシュなしです。Claude Opus 5.5は入力$0.08+出力$0.16で$0.24。Claude Opus 5は$0.10+$0.20で$0.30。これはまさに表示価格の20%カットであり、それ以上ではありません。
つまり、料金表だけで、請求額のうちどれだけがキャッシュ読み取りかによって、20%から43%の間のどこかの効果をもたらします。その範囲を超える主張は、価格ではなくトークン数から来ているものです。
Anthropicの「実行コストが約40%安い」はどこから来たのか
Anthropicの発表資料は、Claude Opus 5.5について「Opus 5よりも提供に必要な計算資源が少ない」と述べており、同社のテストでは、デフォルト設定で「一般的なワークロードにおいてOpus 5より40%低コストになる」ことが示されている。Anthropicが示す内訳は、このモデルが「Opus 5よりトークンあたりのコストが低く、タスクあたりのトークン使用量も少ないため、差し引きでコストが40%削減される」というものだ。
それを正しく呼ぼう:Anthropic が選んだワークロード全体の平均についてのベンダーによる特徴づけであり、監査済みの結果ではなく、価格表に掲載された料率でもない。検証可能なのは前半だ — 入力と出力が20%オフ、キャッシュ読み取りが60%オフで、どちらも今日の価格表で確認できる。後半は、モデルがあなたのワークロードでより少ないトークン数とより少ないターン数で済むかどうかにかかっており、それは実行してみなければ確認できない。
Anthropicがトークン側について提示している証拠は、ローンチ時の顧客声明の一式です。以下はすべてベンダーが公開したもので、ベンダーとその顧客が選んだワークロードを説明しています:
• Box — このモデルは「Opus 5が使ったトークンの3分の1しか使わず」、回答は「精度を損なうことなく40%簡潔」だった。
• Kiro — 「Opus 5 よりも多くの問題を解決しつつ、呼び出し回数は約40%少なく、トークン使用量は半分で済んだ」
• Factory — 「高エフォート設定でOpus 5と同等の性能を、出力トークンを20~25%削減しながら実現しました」
• GitHub — 私たちが計測した中で最も少ないトークン数とステップ数で使用され、VS Code では「Opus 5 よりも半分未満のステップで、より多くのターミナルタスクを解決した」
• 合併分析、実例1件 — 架空のHRソフトウェア企業2社を対象に、各モデルがExcelモデルと経営層向けプレゼンテーションを作成。Anthropicの報告によると、Claude Opus 5.5は63分で完了し、Claude Opus 5の93分に対して「制作コストは50%低かった」。ベンダー報告、n=1。
ここでは独立した対抗指標が重要になる。なぜなら、それは逆方向を指しているからだ。Artificial Analysis は Claude Opus 5.5 を最大エフォートで測定し、Intelligence Index のタスクあたりおよそ 119,000 出力トークンだったのに対し、最大エフォートの Claude Opus 5 はおよそ 73,000 トークンであり、トークン数は増えており、減ってはいない。この構成についての同社の要約は、Claude Opus 5.5 は「出力トークンが 1.6 倍であるにもかかわらず、タスクあたりのコストは Opus 5 と同水準」であり、公表コストは Intelligence Index のタスクあたり 5.98 ドルだというものだ。これは最大エフォートにおける独立した測定であり、Anthropic の主張と矛盾するものではない。エフォート尺度のもう一方の端なのだ。
ここで、このセクションのあらゆる数値を左右する注意点が浮かび上がります。Anthropic は、特に断りのない限り、同社の Claude Opus 5.5 のすべての結果は、適応的思考を最大エフォートで使用すると述べています。Claude Opus 5.5 のデフォルトは中エフォートです。Claude Opus 5 のデフォルトは高でした。そして、同じ名前のレベルでも、2 つのモデル間で同じ思考予算ではありません。したがって、最大エフォートで実行されたベンダーの表と、デフォルトのフォールバックを有効にして最大エフォートで実行された独立した表は同じ構成ではなく、読者が実際にデプロイするであろうデフォルト設定でもありません。選ばれた一連のワークロードで測定された 40% の平均は、あなたが使わないかもしれない設定でのものであり、出発点となる仮説であって、予算項目ではありません。
Fast modeは研究プレビューであり、ティアではありません。
Claude Opus 5.5 の Fast モードは、入力100万トークンあたり $8.00、出力100万トークンあたり $40.00 — 標準価格のちょうど2倍 — で、1秒あたりの出力トークン数が最大2.5倍になります。初回トークンまでの時間は改善されません。効果があるのは出力速度であり、ストリーミングで最も顕著に現れます。
残りは率直に言おう。これはティアではないのに、ティアとして予算計上するのはたやすいからだ。Anthropicは高速モードをリサーチプレビューと位置づけている。アクセスはアカウントマネージャーまたはウェイトリストを通じて申請する。必要なのはfast-mode-2026-02-01ベータヘッダーと、リクエストでのspeed: "fast"指定だ。利用できるのはClaude APIのみ — Amazon Bedrock、Google Cloud、Microsoft Foundry、AWS上のClaude Platformでは使えない。Batch APIやPriority Tierのコミットメントとは併用できない。プロンプトキャッシュやデータレジデンシーの乗数とは積み重なるため、米国にピン留めした高速モードのキャッシュ済みリクエストは2倍に加えて1.1倍を支払うことになる。そして、ワークロードを高速と標準の間で切り替えるとプロンプトキャッシュが無効化され、長いエージェントループでは速度による節約分を上回るコストがかかることがある。
Claude Opus 5とClaude Opus 4.8も高速モードをサポートしており、料金は$10.00/$50.00です。Claude Opus 4.7はこのパラメータを完全に拒否します。
請求額を決める単位は、完了したタスクあたりのコストです
レートはすべてトークンあたりの価格です。トークンを買う人はいません。トークンあたりの価格がコストになるのは、タスクが消費するトークン数と、完了までに要する試行回数を掛け合わせたときだけです。
先ほどのキャッシュ軽量の例で計算してみよう。1パスあたり$0.24なら、タスクを一発で完了するモデルのコストは$0.24だ。同じタスクを競合モデルで1パス$0.30なら$0.30——つまり安いモデルのほうが20%有利に見える。ここで、安いモデルのほうが完了タスクあたり1.2パス必要だとしよう。エージェント作業としては寛大な成功率だ。1.2 × $0.24は$0.288で、単一パスの代替案の$0.30と比べられる。節約分は消える。3パスなら$0.72で、トークンあたり20%安く見えていたモデルは、完了した仕事あたり140%高くつく。
だからこそ、Anthropic自身の効率性に関する主張——より少ないトークン、より少ない呼び出し、より少ないステップ——は正しい単位で語られている。また、自分で再現するまでは、それらのどれも予算項目として受け取るべきではない理由でもある。確認は機械的だ。1パスあたりの価格に、完成したタスク1件あたりのパス数を掛け、それを自分のトラフィックで測定する。どちらの数値も自分で出すものであり、あなたのワークロードについて2つ目の数値を公表しているベンダーはどちらもない。
ベンダー外部の単一の参照点が欲しいなら、Artificial Analysisは、最大努力構成におけるClaude Opus 5.5をIntelligence Indexタスクあたり5.98ドルとしている——これは、ほとんどの本番トラフィックが使わない設定における独立した数値であり、予測というよりも上限として役立つものだ。

ヘッドライン料金に含まれない回線
• レジデンシー米国限定の推論は、キャッシュの読み取りと書き込みを含むすべてのトークンカテゴリで1.1倍です。高速モードやBatch割引と併用できます。
• ツール定義。Anthropicはモデルごとのツール使用システムプロンプトのオーバーヘッドを公開しています。ツールを宣言すると、Claude Opus 5.5のリクエストごとに286トークンが追加されます。100万あたり$4.00なら小さな額ですが、これはリクエストごとに課金され、エージェントループは大量のリクエストを発生させます。
• キャッシュの無効化。モデル、エフォート、ツール定義、または速度の変更後に書き換えられたプレフィックスには、読み取りレートの$0.20ではなく、書き込みレート(Claude Opus 5.5では100万トークンあたり$5.00または$8.00)が適用されます。
• その下のモデル。Claude Sonnet 5は入力が100万トークンあたり$2.00、出力が$10.00で、Anthropicの価格に関する脚注は、これが発表時の導入価格ではなく、現在の標準価格であることを確認している。Claude Opus 5.5は、入力・出力の両方向でSonnet 5のちょうど2倍だ。

Anthropicの定価でClaude Opus 5.5を呼び出す
Claude Opus 5.5 は OrcaRouter で anthropic/claude-opus-5.5、入力 $4.00/出力 $20.00(100万トークンあたり)でご利用いただけます — Anthropic 自身の定価を 0% のマークアップでそのまま通した価格です。このパススルーは、料金ページで正確に明記する価値があります。プロバイダーの料金はテーブルにキャッシュされるのではなくそのまま転送されるため、ベンダーの料金改定は公開されたその日にここでも反映され、同期ウィンドウを待つ必要はありません。Anthropic がこの料金表を動かせば、あなたが参照する価格もそれに追随します。
同じキーが、このページが比較している各ティアにもそのまま届きます — anthropic/claude-opus-5 は $5.00/$25.00、anthropic/claude-fable-5.1 は $10.00/$50.00 — Claude のラインナップの残りや200 以上の他のモデルと並んでいます。そのため、より安いトークン単価が実際の自分のパス数に触れても持ちこたえるかどうかを試すのに、2 つ目の契約もコード変更も必要ありません。自動フェイルオーバーは、慣れないモデルを本番パスで動かしたいものの、そのパスをそのモデルに賭けたくないという場合に備えたものです。
このページの要点を2行で言うと、料金表は入力$4.00、出力$20.00、100万キャッシュ読み取りあたり$0.20で、20%カットは現実であり、今日検証可能です。40%のほうは、Anthropicが選んだワークロード全体の平均です。2つ目の数字を前提に予算を組む前に、自分のエージェントループを1つこれに通してみてください。
この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
