Claude Opus 5.5 vs Claude Sonnet 5 の生成タイトルカード。サブタイトルは「半額の価格、20インデックスポイント、5か月の盲点」、3つのフラットラインアイコン(積み重ねデータベースのマーク、上昇する棒グラフ、時計付きカレンダー)、フッター行は「インデックスは最大努力時の Artificial Analysis によるもの、価格は Anthropic によるもの」。実際の OrcaRouter ロゴが右下に合成されている。
Guides & Insights

Claude Opus 5.5 vs Claude Sonnet 5:価格は半分、インデックス20ポイント差、そして5か月の盲点

著者

Elias Hawthorne

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

結論だけ知りたいなら、既定では Claude Sonnet 5 を実行し、タスクが失敗したら Claude Opus 5.5 にエスカレートする。安い方のモデルは本当に半額であり、本当に能力クラスが異なるからだ。その背景にある2つの数字は 38 と 58 ——同じ評価者、同じ構成ファミリーにおける Artificial Analysis Intelligence Index での Sonnet 5 と Opus 5.5 のスコアだ。このインデックスにおける20ポイントの差はタイブレークではなく、現在構築できるあらゆる Claude 対 Claude の対戦の中で最大の隔たりである:Claude Opus 5.5 は210モデル中1位にランクされ、Claude Sonnet 5 は54位であり、両者の価格差は100万入力トークンあたり2ドルである。

それは簡単な半分だ。難しい半分は、選択的にエスカレーションするにはどのタスクが失敗するのかを知る必要があるという点、そして2つのモデルが2026年1月以降の世界について、どの評価でもエラーとして表面化しない形で食い違っているという点だ。

文脈の中で見る20ポイント差

A two-column scoreboard comparing Claude Opus 5.5 and Claude Sonnet 5 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 38, ranked #54), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), default effort (medium against high), knowledge cutoff (Jun 2026 against Jan 2026), output speed (not yet published against 79.3 tokens per second) and cache read ($0.20 per million on both). The footer reads 'Index and speed figures per Artificial Analysis at max effort; prices, effort defaults and cutoffs per Anthropic.'

Artificial Analysisは各モデルを1つの公開構成で実行しており、これら2つは「Adaptive Reasoning, Max Effort」というファミリーラベルを共有しているため、比較が異例なほどクリーンになります:

• インテリジェンス指数 — Claude Opus 5.5 は58、210中第1位 対 Claude Sonnet 5 は38、第54位

• 価格 — Claude Opus 5.5 は100万トークンあたり入力 $4.00 / 出力 $20.00 に対し、Claude Sonnet 5 は $2.00 / $10.00

• 出力速度 — Claude Sonnet 5 は毎秒79.3トークン、Claude Opus 5.5 はボードにまだ未掲載

• 初回トークンまでの時間 — Claude Sonnet 5 150.02秒 対 ボードの中央値3.83秒

• デフォルトのエフォート — Claude Opus 5.5 対 Claude Sonnet 5

• 知識カットオフ — Claude Opus 5.5 は2026年6月、Claude Sonnet 5 は2026年1月

• コンテキストと出力 — 両方とも 1M コンテキスト、最大出力 128K

順位の列こそ、腰を据えて向き合う価値がある部分だ。指数20ポイントは、リーダーボード上の4位分ではない。49位分だ。210モデルが並ぶボードでは、Opus 5.5とSonnet 5は価格差のある隣同士ではない——別の帯に属しており、100万トークンあたり2ドルの差は、バッジではなく実際の能力の一段の向上を買っている。今週の報道を「Anthropicがより安いOpusを出した」と読み、Sonnet層がそれを吸収したと思った人は、その順位ペアを見るべきだ。Anthropic自身の価格ページは今でもClaude Sonnet 5を現行製品として掲載しており、独立系ボード上でのその位置は動いていない。

この比較を公正に保つ注意点が2つある。どちらのスコアも最大努力設定で実行されたもので、どちらのモデルも出荷時のデフォルトは最大ではない — Sonnet 5のデフォルトはhigh、Opus 5.5はmedium。そして速度の行は、Sonnet 5に有利な形で話を複雑にする。毎秒79.3トークン、初回トークンまで150秒というのは、実際に測定されたレイテンシプロファイルであり、この2つのうちボード上に存在するのはこれだけだ。Opus 5.5の速度とレイテンシはArtificial Analysisによって公表されていない。つまり、この対決における「より高速」という主張は、現時点では測定値ではなくベンダー提供の資料に基づいている。

Sonnet 5の価格を変える脚注

過去1か月でClaude Sonnet 5に関して最も具体的に明らかになったのは、ほとんどの報道が飛ばした一文だ。このモデルが2026年6月30日に登場したとき、その$2 / $10の料金は8月31日までの導入価格として発表され、9月1日付で$3 / $15への値上げが予定されていた。Anthropicの現在の料金ページでは、脚注に$2/$10の料金は「現在は標準価格である」と記され、値上げは「行われない」と書かれている。

それは2つの理由で重要です。明白な理由は、発表された後に取り消された50%の値上げが、今ではそれを前提に計画を立てられるコスト項目になったことです — Sonnet 5 は、有効期限をモデル化しなければならないプロモーション価格ではありません。あまり明白でない理由は、エスカレーションの計算を確定させることです。Sonnet 5 が恒久的に $2/$10、Opus 5.5 が $4/$20 であれば、2つのティア間の比率は入力・出力の両方向でちょうど2倍であり、安定しています。たとえば、トラフィックの5分の1を Opus 5.5 に送るエスカレーションルールなら、コストは一度計算すれば再計算せずに済みます。

バッチ料金とキャッシュ料金は連動して動く。だからこそ表全体の比較が役に立つ。Sonnet 5はバッチで$1.00 / $5.00、Opus 5.5は$2.00 / $10.00で、両者ともキャッシュ読み取りは100万あたり$0.20を請求する。この最後の数字は紛れもなく同額だ — Opus 5.5はキャッシュ読み取りを$0.50から$0.20に引き下げ、Sonnet 5はすでにその水準だった。ワークロードが、新しい出力を生成するよりも、大きなキャッシュ済みコンテキストを再読み取りすることが中心なら、安いモデルの価格上の優位性は、見出しの比率が示唆するよりもはるかに小さい。なぜなら、両者が一致している唯一の行こそ、最も多く支出する行だからだ。

カットオフは、静かに故障する部分です。

A generated two-card graphic titled 'Knowledge cutoffs, five months apart', showing Claude Sonnet 5 with a knowledge cutoff of January 2026 against Claude Opus 5.5 with a cutoff of June 2026, separated by a marker reading '5 months of coverage'. The footer reads 'Cutoff dates per Anthropic's Claude model documentation, current as of September 2026.'

Claude Opus 5.5 の知識カットオフは2026年6月です。Claude Sonnet 5 は2026年1月。つまり5か月の差があり、これはこの比較において、自らを明かさない唯一の側面です。ある出来事を知らないモデルは、その事柄について遅くなったり精度が落ちたりする形で現れるのではなく——あなたのエラーハンドリングが捉えられるような形では現れません。それはすでに先へ進んでしまった世界から自信たっぷりに答えるのであり、その失敗は拒否ではなく、もっともらしい誤った回答のように見えます。

ワークロードによっては、これは無関係だ:規約が安定しているコードベースのリファクタリング、あなたが提供した文書の要約、構造化データの変換。他のワークロードでは、指標の20点や価格に関係なく、それだけで失格になる。2026年後半にリリースされたソフトウェアに触れるもの、最近の出来事について質問に答えるもの、1月以降に変更されたAPIやライブラリのバージョンに依存するものはすべて — これらのタスクはOpus 5.5にエスカレーションできず、そこから始めなければならない。その5か月は品質の違いではなく、スコープの制約であり、それは評価ではなくルーティングルールに入れるべきものだ。

両モデルは残りの枠を共有しているため、カットオフをどこまで回避できるかには限界がある。どちらも1Mトークンのコンテキストを受け取り、最大128Kを返し、どちらもオフにできない適応型思考を実行し、深さを指定できるのは effort パラメータだけである。Sonnet 5 により長い文書を渡して補う、という構成は存在しない。

分割の実行

この組み合わせの実践的な形は、デフォルトと例外である。そして例外は「難しいタスク」以外の何かによって定義されなければならない。通用するパターンは、難易度ではなくタスククラスによるものである:Sonnet 5は、そのカットオフが無関係でレイテンシプロファイルが許容できる大量の作業に、Opus 5.5は、最新のもの、長期的なもの、または失敗した試行のコストがトークンの差を上回るものに。

それは書き換えではなくルーティング設定であり、単一のエンドポイントがその存在価値を発揮する場面です。Claude Sonnet 5 は OrcaRouter 上で Anthropic 自身の $2.00 / $10.00、そして Claude Opus 5.5 は同所で $4.00 / $20.00 — プロバイダーの定価が 0% のマークアップでそのまま渡されるため、エスカレーション ルールにおけるコスト比は Anthropic が公開しているコスト比そのものであり、マークアップ層がそれを動かすことはありません。両方とも 1 つのキーの背後にあるため、エスカレーション パスは 2 つ目の統合ではなくルールの編集となり、自動フェイルオーバーによって障害が発生したプライマリがリクエストを道連れにすることはなく、しきい値を決める比較は 2 つのベンダー表から再構成するのではなく、自社のトラフィック内で実行できるものです。

A screenshot of OrcaRouter's own model page for anthropic/claude-sonnet-5, headed 'Claude Sonnet 5' and credited to Anthropic, showing $2.00 input and $10.00 output per 1M tokens, a 1M-token context and a PERFORMANCE panel with 79.3 output tokens per second, a 150.02s time to first token and 55M output tokens over 7 days.

誰が動くべきで、誰が待つべきか

すでに Claude Sonnet 5 を使っていてそれが機能しているなら、それを置き換える理由は弱い。このモデルは半額で、その料金は現在恒久的であり、インデックスの差はそれが失敗しているタスクでのみ問題になる。その上に Claude Opus 5.5 を追加する理由は強い。ただし、トリガーを名指しできる場合に限る — そしてそのトリガーは通常、カットオフの失敗か、Sonnet 5 の最大努力の実行でもまだ間違えるタスクのどちらかだ。

もし最初のClaudeモデルを選んでいるなら、その答えは価格比が示すほど均衡したものではない。20ポイントのインデックス差と、トークン量が2倍になる代わりに得られる5か月分余分な知識というトレードオフは、多くの本番ワークロードが少数の呼び出しでは受け入れるが、すべての呼び出しで受け入れるものはほとんどない。どちらの方向にせよ避けるべき誤りは、両者を互換的に扱い、コストだけで切り替えることだ。なぜなら、その後に続く失敗は、より悪い回答ではない——1月に終わった世界についての自信に満ちた回答なのだから。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新