
Claude Opus 5.5 vs Claude Sonnet 5:価格は半分、インデックス20ポイント差、そして5か月の盲点
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 177 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1323 tok/s
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
結論だけ知りたいなら、既定では Claude Sonnet 5 を実行し、タスクが失敗したら Claude Opus 5.5 にエスカレートする。安い方のモデルは本当に半額であり、本当に能力クラスが異なるからだ。その背景にある2つの数字は 38 と 58 ——同じ評価者、同じ構成ファミリーにおける Artificial Analysis Intelligence Index での Sonnet 5 と Opus 5.5 のスコアだ。このインデックスにおける20ポイントの差はタイブレークではなく、現在構築できるあらゆる Claude 対 Claude の対戦の中で最大の隔たりである:Claude Opus 5.5 は210モデル中1位にランクされ、Claude Sonnet 5 は54位であり、両者の価格差は100万入力トークンあたり2ドルである。
それは簡単な半分だ。難しい半分は、選択的にエスカレーションするにはどのタスクが失敗するのかを知る必要があるという点、そして2つのモデルが2026年1月以降の世界について、どの評価でもエラーとして表面化しない形で食い違っているという点だ。
文脈の中で見る20ポイント差

Artificial Analysisは各モデルを1つの公開構成で実行しており、これら2つは「Adaptive Reasoning, Max Effort」というファミリーラベルを共有しているため、比較が異例なほどクリーンになります:
• インテリジェンス指数 — Claude Opus 5.5 は58、210中第1位 対 Claude Sonnet 5 は38、第54位
• 価格 — Claude Opus 5.5 は100万トークンあたり入力 $4.00 / 出力 $20.00 に対し、Claude Sonnet 5 は $2.00 / $10.00
• 出力速度 — Claude Sonnet 5 は毎秒79.3トークン、Claude Opus 5.5 はボードにまだ未掲載
• 初回トークンまでの時間 — Claude Sonnet 5 150.02秒 対 ボードの中央値3.83秒
• デフォルトのエフォート — Claude Opus 5.5 中 対 Claude Sonnet 5 高
• 知識カットオフ — Claude Opus 5.5 は2026年6月、Claude Sonnet 5 は2026年1月
• コンテキストと出力 — 両方とも 1M コンテキスト、最大出力 128K
順位の列こそ、腰を据えて向き合う価値がある部分だ。指数20ポイントは、リーダーボード上の4位分ではない。49位分だ。210モデルが並ぶボードでは、Opus 5.5とSonnet 5は価格差のある隣同士ではない——別の帯に属しており、100万トークンあたり2ドルの差は、バッジではなく実際の能力の一段の向上を買っている。今週の報道を「Anthropicがより安いOpusを出した」と読み、Sonnet層がそれを吸収したと思った人は、その順位ペアを見るべきだ。Anthropic自身の価格ページは今でもClaude Sonnet 5を現行製品として掲載しており、独立系ボード上でのその位置は動いていない。
この比較を公正に保つ注意点が2つある。どちらのスコアも最大努力設定で実行されたもので、どちらのモデルも出荷時のデフォルトは最大ではない — Sonnet 5のデフォルトはhigh、Opus 5.5はmedium。そして速度の行は、Sonnet 5に有利な形で話を複雑にする。毎秒79.3トークン、初回トークンまで150秒というのは、実際に測定されたレイテンシプロファイルであり、この2つのうちボード上に存在するのはこれだけだ。Opus 5.5の速度とレイテンシはArtificial Analysisによって公表されていない。つまり、この対決における「より高速」という主張は、現時点では測定値ではなくベンダー提供の資料に基づいている。
Sonnet 5の価格を変える脚注
過去1か月でClaude Sonnet 5に関して最も具体的に明らかになったのは、ほとんどの報道が飛ばした一文だ。このモデルが2026年6月30日に登場したとき、その$2 / $10の料金は8月31日までの導入価格として発表され、9月1日付で$3 / $15への値上げが予定されていた。Anthropicの現在の料金ページでは、脚注に$2/$10の料金は「現在は標準価格である」と記され、値上げは「行われない」と書かれている。
それは2つの理由で重要です。明白な理由は、発表された後に取り消された50%の値上げが、今ではそれを前提に計画を立てられるコスト項目になったことです — Sonnet 5 は、有効期限をモデル化しなければならないプロモーション価格ではありません。あまり明白でない理由は、エスカレーションの計算を確定させることです。Sonnet 5 が恒久的に $2/$10、Opus 5.5 が $4/$20 であれば、2つのティア間の比率は入力・出力の両方向でちょうど2倍であり、安定しています。たとえば、トラフィックの5分の1を Opus 5.5 に送るエスカレーションルールなら、コストは一度計算すれば再計算せずに済みます。
バッチ料金とキャッシュ料金は連動して動く。だからこそ表全体の比較が役に立つ。Sonnet 5はバッチで$1.00 / $5.00、Opus 5.5は$2.00 / $10.00で、両者ともキャッシュ読み取りは100万あたり$0.20を請求する。この最後の数字は紛れもなく同額だ — Opus 5.5はキャッシュ読み取りを$0.50から$0.20に引き下げ、Sonnet 5はすでにその水準だった。ワークロードが、新しい出力を生成するよりも、大きなキャッシュ済みコンテキストを再読み取りすることが中心なら、安いモデルの価格上の優位性は、見出しの比率が示唆するよりもはるかに小さい。なぜなら、両者が一致している唯一の行こそ、最も多く支出する行だからだ。
カットオフは、静かに故障する部分です。

Claude Opus 5.5 の知識カットオフは2026年6月です。Claude Sonnet 5 は2026年1月。つまり5か月の差があり、これはこの比較において、自らを明かさない唯一の側面です。ある出来事を知らないモデルは、その事柄について遅くなったり精度が落ちたりする形で現れるのではなく——あなたのエラーハンドリングが捉えられるような形では現れません。それはすでに先へ進んでしまった世界から自信たっぷりに答えるのであり、その失敗は拒否ではなく、もっともらしい誤った回答のように見えます。
ワークロードによっては、これは無関係だ:規約が安定しているコードベースのリファクタリング、あなたが提供した文書の要約、構造化データの変換。他のワークロードでは、指標の20点や価格に関係なく、それだけで失格になる。2026年後半にリリースされたソフトウェアに触れるもの、最近の出来事について質問に答えるもの、1月以降に変更されたAPIやライブラリのバージョンに依存するものはすべて — これらのタスクはOpus 5.5にエスカレーションできず、そこから始めなければならない。その5か月は品質の違いではなく、スコープの制約であり、それは評価ではなくルーティングルールに入れるべきものだ。
両モデルは残りの枠を共有しているため、カットオフをどこまで回避できるかには限界がある。どちらも1Mトークンのコンテキストを受け取り、最大128Kを返し、どちらもオフにできない適応型思考を実行し、深さを指定できるのは effort パラメータだけである。Sonnet 5 により長い文書を渡して補う、という構成は存在しない。
分割の実行
この組み合わせの実践的な形は、デフォルトと例外である。そして例外は「難しいタスク」以外の何かによって定義されなければならない。通用するパターンは、難易度ではなくタスククラスによるものである:Sonnet 5は、そのカットオフが無関係でレイテンシプロファイルが許容できる大量の作業に、Opus 5.5は、最新のもの、長期的なもの、または失敗した試行のコストがトークンの差を上回るものに。
それは書き換えではなくルーティング設定であり、単一のエンドポイントがその存在価値を発揮する場面です。Claude Sonnet 5 は OrcaRouter 上で Anthropic 自身の $2.00 / $10.00、そして Claude Opus 5.5 は同所で $4.00 / $20.00 — プロバイダーの定価が 0% のマークアップでそのまま渡されるため、エスカレーション ルールにおけるコスト比は Anthropic が公開しているコスト比そのものであり、マークアップ層がそれを動かすことはありません。両方とも 1 つのキーの背後にあるため、エスカレーション パスは 2 つ目の統合ではなくルールの編集となり、自動フェイルオーバーによって障害が発生したプライマリがリクエストを道連れにすることはなく、しきい値を決める比較は 2 つのベンダー表から再構成するのではなく、自社のトラフィック内で実行できるものです。

誰が動くべきで、誰が待つべきか
すでに Claude Sonnet 5 を使っていてそれが機能しているなら、それを置き換える理由は弱い。このモデルは半額で、その料金は現在恒久的であり、インデックスの差はそれが失敗しているタスクでのみ問題になる。その上に Claude Opus 5.5 を追加する理由は強い。ただし、トリガーを名指しできる場合に限る — そしてそのトリガーは通常、カットオフの失敗か、Sonnet 5 の最大努力の実行でもまだ間違えるタスクのどちらかだ。
もし最初のClaudeモデルを選んでいるなら、その答えは価格比が示すほど均衡したものではない。20ポイントのインデックス差と、トークン量が2倍になる代わりに得られる5か月分余分な知識というトレードオフは、多くの本番ワークロードが少数の呼び出しでは受け入れるが、すべての呼び出しで受け入れるものはほとんどない。どちらの方向にせよ避けるべき誤りは、両者を互換的に扱い、コストだけで切り替えることだ。なぜなら、その後に続く失敗は、より悪い回答ではない——1月に終わった世界についての自信に満ちた回答なのだから。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
