Claude Opus 5.5 vs GPT-6 Sol の生成されたタイトルカード。サブタイトルは「コンテキストが長くなるまでは半額」で、2つのフラットなラインアイコン(ドキュメントとクラウド)があり、フッター行には「Index は最大エフォート時の Artificial Analysis による。価格は各ベンダーによる。」と記されている。本物の OrcaRouter ロゴが右下に合成されている。
Guides & Insights

Claude Opus 5.5 対 GPT-6 Sol:価格は半分、ただしコンテキストが長くなるまで

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

AnthropicOpenAIは同じ日の午後に、競合するフラッグシップを投入した。 Claude Opus 5.5は2026年9月22日に、入力100万トークンあたり4ドル、出力100万トークンあたり20ドルで提供開始され、Claude Opus 5から両ラインとも20%の値下げとなった。 GPT-6 Solは同じ日に、入力2ドル、出力10ドルで登場し、GPT-5.6 Solからのちょうど50%の値下げだった。OpenAIはこれを販促ではなく恒久的なものだと説明した。この2文だけを読めば、勝負は始まる前から決まっているように見える。OpenAIのモデルは半額で、半額は半額だからだ。だが両社の料金表の残りを読むと、その差はほとんど消える。どちらのベンダーが何かを変えたからではなく、両モデルが同じ種類のリクエストに追加料金を課しており、それがSolの優位性をAnthropicの優位性よりもはるかに大きく削るからだ。

2つの料金表、どちらにもステップがある

272,000入力トークン未満では、これが現在のフロンティアにおける最も単純な比較です:

• 入力 — GPT-6 Sol 100万あたり2.00ドル 対 Claude Opus 5.5 4.00ドル

• 出力 — GPT-6 Sol 100万あたり$10.00 対 Claude Opus 5.5 $20.00

• キャッシュ済み入力 — GPT-6 Sol は、Claude Opus 5.5 の100万トークンあたり $0.20 に対し、キャッシュ部分でおよそ90%オフ。ベース入力に対する5%の倍率

• コンテキストと出力 — Artificial Analysis による測定で GPT-6 Sol は 872K、他では 1M と主張、最大出力 128K 対 Claude Opus 5.5 の 1M と 128K

• 知識カットオフ — Claude Opus 5.5 は2026年6月 対 GPT-6 Sol は同様の基準では明記されていない

272,000入力トークンを超えると、両側で算定が変わり、しかも同じ額だけではない。GPT-6 Solはリクエスト全体を——超過分ではなく、呼び出し全体を——再価格設定し、入力レートはおよそ2倍、出力レートは1.5倍となって、入力$4.00、出力$15.00近くに落ち着く。Claude Opus 5.5の料金表にはロングコンテキストの段階がない。Anthropicは1Mトークンの全ウィンドウにわたって$4.00と$20.00を請求し、900Kトークンのリクエストは9Kトークンのものと同じトークン単価になると述べている。

これらを合わせて考えると、順位は意外なところで逆転する。長コンテキストの呼び出しでは、入力料金は両モデルともおよそ$4に収束する——Solの入力における半額優位は完全に消える——一方で、出力は2倍の差から約$15対$20へと縮まり、50%ではなく25%の優位となる。Solは依然として安い。しかし、もはや意思決定における唯一の数値になるほど安くはない。その理由は、2つの追加料金の形が異なるからだ。Anthropicのモデルは、たまたまより高い定額料金を課し、OpenAIのモデルは、両社がこうしたモデルの用途として売り込んでいるまさにエージェント型、リポジトリ読解、文書セットのワークロードに最も厳しくのしかかるペナルティを課している。

A generated graphic titled 'Two rate cards, one step each', with a subtitle reading 'Above 272,000 input tokens the input rates converge and the output gap narrows to about a quarter.' Two panels compare per-million-token input and output rates: below 272,000 input tokens Claude Opus 5.5 is $4.00 / $20.00 against GPT-6 Sol at $2.00 / $10.00, and above 272,000 input tokens Claude Opus 5.5 stays at $4.00 / $20.00 while GPT-6 Sol moves to approximately $4.00 / $15.00 because the whole call reprices. The footer reads 'Per-million-token rates. Sol's step per OpenAI; Opus 5.5 bills its full 1M window at one rate per Anthropic.'

独立したスコア、それは唯一の同条件での比較

A two-column scoreboard comparing Claude Opus 5.5 and GPT-6 Sol across six shared rows: Intelligence Index (58, ranked #1 of 210, against 48, ranked #18), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), output speed (not yet published against 113.3 tokens per second), time to first token (not yet published against 142.74s), knowledge cutoff (Jun 2026 against not stated in the same terms) and long-context step (none against the whole call repriced above 272K). The footer reads 'Index, speed and latency figures per Artificial Analysis at max effort; prices and the 272K step per the vendors.'

どちらのローンチ表にも相手の新モデルは含まれていない——どちらも同日リリースが登場する前に書かれたものだ——そのため、ベンダー資料ではこの2つをまったく順位付けできない。Artificial Analysis なら可能だ。すべてのモデルを1つの公開構成で実行しているからである:

• インテリジェンス指数 — Claude Opus 5.5 は 58、210 中 1 位 対 GPT-6 Sol は 48、18 位

• 構成ラベル — どちらも最大エフォートでスコア評価。Claude Opus 5.5 にはさらに「Default Fallback」というラベルが付与されています

• 出力速度 — GPT-6 Sol 113.3 トークン/秒、未公開の Claude Opus 5.5 との比較で 38 位

• 初回トークンまでの時間 — GPT-6 Sol 142.74秒 対 リーダーボード中央値の3.83秒;Claude Opus 5.5 はまだ公開されていない

• 価格 — GPT-6 Sol は100万トークンあたり $2.00 / $10.00、Claude Opus 5.5 は $4.00 / $20.00

インデックス10ポイント・順位17位という差は、現在のClaude対OpenAIのどの組み合わせよりも最大の開きであり、今月2度目にして安価なモデルに有利に働いた——同じパターンは、以前の比較でGPT-6 SolがClaude Opus 5と対戦し、60%低いコストで3ポイント差で敗れたときにも見られた。速度の行は逆方向に作用し、見た目以上に重要だ。毎秒113.3トークンは、GPT-6 Astraフラッグシップが出す値のおよそ2倍で、このグループでは最速の数値である。初回トークン142秒と合わせると、長く考えてから素早く書くモデルという像になり、対話的な用途には不向きだが、長時間の無人実行には妥当な選択だ。

両方の数値には、ベンダー各社の数値と同じ但し書きが付く。つまり、これらは最大エフォート時の測定値であり、どちらのモデルも出荷時のデフォルトが最大エフォートではない。Claude Opus 5.5 のデフォルトはmediumで、エフォート尺度は low から max まで続く。GPT-6 Sol は none から max まで続く尺度を公開している。最大エフォートの指標は、上限を比較するには公平な方法であり、請求額を予測するには誤解を招く方法だ。

切り替えると何が壊れるのか、双方向で

ここでの移行の摩擦は非対称であり、どちらの移行の前にも知っておく価値がある。

Claude Opus 5.5 は Claude Opus 5 のドロップイン代替ではありません。思考は無効化できなくなったため、思考なしのパスを設定していたコードはエラーになるか、動作が通知なしに変わります。ツールの強制使用はエラーを返します。思考ブロックはそれを生成したモデルと会話に結び付いているため、モデルをまたいで再生できません。古いcomputer_20251124 コンピュータ使用ツールは Claude API または Google Cloud では受け入れられません。これとは別に、ツール呼び出し間のテキストは、デフォルトの表示設定では空になる思考ブロックの内部で返されるようになったため、そのテキストを進捗としてストリーミングするアプリケーションは、呼び出し間で何もスローせずに単に沈黙します。

GPT-6 Solのエフォートスケールは、両者の中でより柔軟な方だ。会話の途中で変更してもプロンプトキャッシュが無効化されないため、同じコンテキストに対して安価な初回パスと高コストなリトライを行うことは、キャッシュを壊すものではなく、サポートされたパターンとなる。これは、単一セッション内で段階的な推論を走らせるあらゆる人にとって真のエンジニアリング上の利点であり、どの価格表にも現れない、Solを支持する最も強力な論拠だ。

両方を実行して、自分の数字で判断する

この対決について正直な立場は、ベンダーの比較表では決着をつけられず、独立系の指標が決めるのは上限だけだというものだ。残るのはワークロードの問題――あなたのコンテキストが実際にどれだけ長く動くのか、失敗した試行にどれだけコストがかかるのか――であり、それはプレスリリースから論じるものではなく、あなた自身のトラフィックで測定できるものだ。

両モデルとも、OrcaRouter からプロバイダーの定価・マークアップ0%でルーティングできます:GPT-6 Sol は OpenAI の $2.00 / $10.00、Claude Opus 5.5 は Anthropic の $4.00 / $20.00 です。パススルーは正確で、価格はベンダーが動かしたその日に追随するため、ステージングで計測した比率がそのまま本番で支払う比率になり、再計算すべきマークアップ層はありません。1つのキーで両方をカバーするので、272K 未満の呼び出しを Sol に、ロングコンテキストの呼び出しをあなたの評価で勝った方のモデルに送るというルーティングルールは、2つ目の統合ではなく設定変更で済みます — そして 自動フェイルオーバーがあれば、どちらか側の当日ローンチは、パイプライン全体を賭ける対象ではなく、トラフィックの一部を流せるものになります。

A screenshot of OrcaRouter's own model page for openai/gpt-6-sol, headed 'GPT-6 Sol' and credited to OpenAI, showing a 1M-token context, 128K max output, and a stat strip reading INPUT $2.00 and OUTPUT $10.00 per 1M tokens with a 2.25s p50 time to first token and 4.8M tokens of traffic over 7 days.

請求書と接触しても生き残る、このバージョン

GPT-6 Sol はあらゆる項目で、あらゆる構成で、より安価なモデルであり、それは争いの余地がない。生き残らないのは、「半額」が計画の基準にすべき数字だという前提だ。長いコンテキストの呼び出しでは、入力料率はおよそ $4 で並び、出力の差は4分の1まで縮まる。これはローンチページが説明している判断とは別の判断だ。それを10ポイントの指数差、17ランク、計測された142秒の初回トークンと天秤にかければ、ほとんどのワークロードでは使い分けは自ずと決まる — Sol は短・中コンテキストにおける大量処理のデフォルトとし、コンテキストが長くなる場合や、再試行がトークン差以上のコストになるほどタスクが難しい場合は Claude Opus 5.5 だ。避ける価値のある誤りは、見出しの料率だけでこのどちらかを選ぶことだ。なぜなら、両モデルが作られたケースを決めるのは、各料金表の2番目の数字だからだ。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新