
Claude Opus 5.5:Anthropicが旗艦モデルの価格を引き下げた、それこそが本当のニュースだ
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
ベンダーはClaude Opus 5.5を2026年9月22日にリリースしましたが、重要な数字はどのベンチマーク表にも載っていません。それは4ドルです。新しいフラッグシップは入力トークン100万あたり4ドル、出力100万あたり20ドルで、Claude Opus 5が7月24日以降維持してきた5ドル/25ドルから下がっています。さらにキャッシュ読み取りは100万あたり0.50ドルから0.20ドルへ下がり、長時間のエージェント実行を支配する費目で60%の削減です。モデルもより優れており、同社によればほとんどの作業で、一つ上の10ドル/50ドルの階層であるClaude Fable 5.1に匹敵するとのことです。しかし、フロンティアラボが一般提供されている最上位モデルの定価を20%引き下げ、実行にかかる真のコストが40%下がったと述べること——これこそが、このリリースのうち、何を構築する余裕があるかを変える部分です。能力のリリースは四半期のうちに模倣されます。フラッグシップ階層の値下げは、すべての人の下限を引き下げます。
実際に支払う数字で見る、その差。

以下はすべてAnthropicが公開している料金表であり、見積もりではありません:
• 入力 — 100万トークンあたり$4、Opus 5の$5.00から値下げ
• 出力 — 100万トークンあたり$20、$25.00から値下げ
• キャッシュ読み取り — 100万あたり$0.20、$0.50から値下げ
• 5分キャッシュ書き込み — 100万あたり$5、1時間キャッシュ書き込み — $8
• バッチAPI — 双方向とも50%オフ、従来どおり
• コンテキストと出力 — 100万トークンのコンテキスト、最大出力128K、Batch APIでの300K出力にはoutput-300k-2026-03-24ベータヘッダー
• 知識のカットオフ — 2026年6月
• エフォート — 適応型思考は常にオン、デフォルトは中。段階は低、中、高、xhigh、最大
Claude APIにはFastモードもあり、100万あたり$8/$40で別途価格設定され、Anthropicは一般的なオプションではなくリサーチプレビューだと説明している。
キャッシュラインこそ最も注目に値するのに、ローンチ時の報道が真っ先に飛ばしてしまう部分でもある。毎ターン大量のシステムプロンプトと長いファイルツリーを再送するエージェントにとって、支配的なコストは新規入力ではなくキャッシュ読み出しだ。実際のコーディング作業においては、そこでの60%削減は、見出しの料率における20%削減よりもはるかに効く——そしてそれが、次のセクションの計算がこうした結果になる理由である。
「40%安い」という主張はどこから来ているのか
Anthropicは、Opus 5.5は一般的なワークロードで実行するコストがOpus 5より約40%安いと述べている。これは値下げ幅のおよそ2倍であり、つまりその大半は価格設定によるものではなく、同じ答えに到達するためにモデルがより少ない作業で済んでいるということだ。Anthropicは、Opus 5より30%以上速く出力を生成したと報告しており、複数の初期導入顧客がトークン数の削減を挙げている。Boxは、トークン数が3分の1で、回答の冗長さが約40%減ったと述べている。Kiroは、トークン数がおよそ半分で、呼び出し回数が40%少ないと報告している。Factoryは、出力トークンが20~25%少ないと挙げている。そしてGitHubは、同モデルが同社が計測した中で最も少ないトークン数とステップ数だったと述べている。
これらはベンダーが公開した顧客の声であり、監査済みの測定値ではありません。特に「40%」は、Anthropic 自身が、自社が選んだワークロード全体の平均として説明したものです。予算に組み入れる数値ではなく、方向性として扱ってください。今日、独立して検証できるのは、料金表 — Anthropic の公開価格ページに掲載されています — と、自分のワークロードを実行したときに生成されるトークン数です。
発表資料の中で最も役立つ実例は、最も地味でもある。Opus 5.5では63分かかり、同じタスクをOpus 5で行うと93分かかったが、それよりコストが50%少なかった合併分析だ。エージェントの価格設定をするなら、興味深いのはトークン単価ではなく、その比率である。完了までに3回のパスを要する安価なモデルは、何も節約してくれていない。
ベンチマーク表と、それを制作した人
以下の一対一比較の数値はすべて、Anthropicの発表資料に由来し、同社自身のモデルと競合他社のモデルに対して実施されたものです。これはローンチ時には普通のことあり、そのため、これらのいずれも独立した判定として読むべきではありません。数値は全体を通じてベンダー報告として明記されています。
• Terminal-Bench 4.0 — Opus 5.5 66.4%、Opus 5 52.3%、Fable 5.1 55.8%、GPT-6 Astra 57.9%。Anthropicは、この実行がデフォルトではなくxhigh effortを使用したと注記している。
• FrontierCode v1.1(メイン) — Opus 5.5 54.4%、Opus 5 48.0%、Fable 5.1 50.3%、GPT-6 Astra 53.3%、デフォルトのミディアムエフォートでは54.6%。
• CursorBench 4.0 — Opus 5.5 57.8%、Opus 5 46.6%、Fable 5.1 51.8%、中程度のエフォートで52.5%。
• GDPval-AA v2.1、ナレッジワーク — Opus 5.5 1846 Elo、Fable 5.1 1735、Opus 5 1708、GPT-6 Astra 1542。
• Terminal-Bench-Science 0.1 — Opus 5.5 が 58.7% に対し、Opus 5 は 29.0%、GPT-6 Astra は 64.6% で先行。
• OSWorld 2.0、コンピュータ操作 — Opus 5.5 が 81.8%、Opus 5 が 74.0% で、部分的な結果としてフラグが付けられています。
そのリストからは、2つの点を抜き出して注目する価値がある。第一に、medium effortはmaxとそれほど変わらない。FrontierCodeでは54.6%対54.4%、CursorBenchでは52.5%対57.8%だ。effortがコストを直接左右する以上、このFrontierCodeの結果——デフォルト設定で測定可能な損失がない——は、コストに直結する発見である。第二に、Anthropic自身が、この能力レベルではベンチマークの差は「現実世界の違いを知るうえではあまり信頼できない手がかり」であり、Fable 5.1との自社内の差はスコアが示唆するよりも小さい、と注意を促している。ベンダーが自社の表を割り引いて見ろと言う——これがこの文書の中で最も信頼できる一文だ。
独立系の立場では、Artificial AnalysisがClaude Opus 5.5をそのIntelligence Indexで54と評価し、同社が追跡するモデルの中で3位としている。これは「Adaptive Reasoning, High Effort, Default Fallback」とラベル付けされた構成での結果だ。この最後の一節は実際に重要な意味を持っており、それが直接次のセクションにつながる。
セーフガードルーティングは仕様の一部です
独立した結果における「Default Fallback」というラベルは、ベンチマークの産物ではありません。Opus 5.5は、Anthropicが以前はFable 5.1のために留保していたセーフガード層を搭載して提供されています。なぜなら、生物学とサイバーセキュリティの分野でClaude Mythos 5.1に匹敵するからです。実際には、ほとんどのサイバーセキュリティ関連のリクエストはClaude Opus 4.8に再ルーティングされ、生物学の作業は、アカウントがAnthropicのLife SciencesまたはCyber Verificationプログラムを通じて認証されていない限り、Claude Opus 5にフォールバックします。
あなたの製品がサイバー関連またはライフサイエンス関連のプロンプトをclaude-opus-5-5に送信する場合、返ってくる回答はそもそも Claude Opus 5.5 から来たものではない可能性があります。あなたの評価、タスクあたりのコスト、品質測定はすべて、それらのターンにおいて黙ってより小さなモデルを含み込んでしまいます。ほとんどのチームではこれは一度も発動しません。セキュリティツールやバイオテクノロジーに関わる人にとっては常に発動し、これこそが今回のローンチにおける最も重要な運用上の詳細です——同時に、動作するAPI連携であっても、あなたが最も気にかけているプロンプトまさにそのものにおいて、前のモデルより悪い結果を出し得るということも意味します。新しい検証ティアが利用可能です。モデル文字列が書かれている通りの意味を持つと想定する前に、自分がどのティアにいるかを確認してください。
文字列を差し替える前に、4つの破壊的変更

Opus 5.5は、Claude Opus 5のドロップイン代替品でも、名称変更でもありません。Anthropic自身の移行ノートには、既存のコードを壊す4つの変更が挙げられています:
• Thinking を無効にすることはできなくなりました。thinking: disabled を設定したコードや、非 Thinking パスに依存していたコードは、エラーになるか、動作が暗黙のうちに変わります。深さは effort パラメータでのみ制御されるようになりました。
• 強制的なツール使用はエラーを返します。tool_choiceを渡して特定のツールを強制することはサポートされていません。
• Thinkingブロックは、それを生成したモデルと会話に紐づいているため、一部のパイプラインが想定しているようには、モデル間で再生できません。
・以前の computer_20251124 コンピュータ使用ツールは、Claude API または Google Cloud では受け付けられません。
5番目の変更は、何も失敗させないが出力を変える。ツール呼び出しの間のテキストが、デフォルトの表示設定ではテキストが空になる thinking ブロック内で返ってくるようになった。そのテキストを進捗更新としてユーザーにストリーミングするアプリケーションは、テキストが返ってくる表示値を設定するまで、ツール呼び出しの間は沈黙する。エラーは何も起きず、UI が話すのをやめるだけだ。これは、すべてのテストが通るせいで本番環境にリリースされてしまう種類のリグレッションだ。
最初の3つの変更はFable 5.1にも適用されるため、すでにそのモデルへ移行済みであれば、作業は一部完了しています。
既存のものと並行して実行する
チームにとって最も大きなコストとなる移行の細部は、APIの変更ではありません。異なるエフォートスケールを持つ新しいOpusが、古いOpusを前提に構築したコストモデルを無効にしてしまうことです。Anthropic自身のガイダンスでは、Opus 5の設定をそのまま持ち越すのではなく、複数のエフォートレベルをテストすることが推奨されています。つまり、「5.5は我々にとって安いのか」という問いへの答えは、あなたのプロンプトでまだ誰も実行していない測定にかかっているということです。
その測定は、古いモデルがまだ同じキーで1回呼び出すだけで使える。Claude Opus 5は本日OrcaRouterで利用可能です——Anthropic自身の$5.00/$25.00、マークアップ0%で。プロバイダーの定価がそのまま反映されるため、表示される料金はAnthropicが公表している料金です。Claude Opus 5.5はまだ当社のルートにはありません。Anthropic自身のAPIや主要なクラウドを通じて利用できます。登場したときには、同じエフォートで両者を比較することは、2つ目の統合ではなくルーティングルールになります。新しいモデルにトラフィックの一部を送り、自動フェイルオーバーはすでに特性を把握済みのモデルに向けたままにし、発表時の表ではなく自分のトークン数を読み取ってください。複数のモデルにまたがって呼び出しを構成する——1つが下書きし、もう1つが検証する——ことは、同じエンドポイント上のルーティングDSLの1行です。

それが買えないのは、Opus 5.5 に関する独立した評決だ。まだ何もそれを与えてはくれない。公開されている一対一の比較は Anthropic 自身によるもので、存在する唯一の外部スコアは、フォールバックルーティングが組み込まれたデプロイ済みシステムの単一のエフォート構成によるものだ。
理解しつつ、そしてこれから来るもの
Claude Opus 5.5はモデルID claude-opus-5-5で、Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、およびAWS上のClaude Platformで提供されています。Anthropicはステータスをアクティブ、廃止を2027年9月22日以降と記載しています。
それに続く点が2つある。Anthropicは、Claude Sonnet 5.5とClaude Haiku 5.5が「今後数週間で」登場し、同じ効率性と安全性の改善の多くを備えると述べている。これが本当なら、フロンティア級のOpusを必要としないワークロードを持つ人々にとっては、より重大な出来事だ。また、独立系ベンチマークの全体像はまだ固まっていない。Artificial Analysisのスコアは、上述のフォールバック動作を備えたデプロイ済みシステムにおける、ある1つのエフォート設定を最初に覗いたものであり、安定したランキングではない。
今回の発表には、正直に認めるべき欠落が一つある。Anthropicは、Opus 5.5が自分が評価されているのではないかと頻繁に疑うと報告している。これは制約として開示されており、まさにベンチマーク表が測っているものを直撃する。見られていると知ると挙動が変わるモデルは、ベンダーによるものであれ独立系によるものであれ、そのスコアが形式から示唆されるよりも予測力に劣るモデルである。
Claude Opus 5.5は、4か月で3度目のOpusティアのリリースであり、Anthropicの最高経営責任者がフロンティア開発のペースを抑えるよう公に主張して以来、初のローンチである。その2つの事実は同じ文書に記されている。能力の数値については1週間議論が続くだろうが、価格とキャッシュレートは1年後もなお正しいままだ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
