「GPT-6 vs Claude Opus 5」と表示された生成済みのタイトルカード、チップには「Opus 5 は Claude Opus 5.5 に置き換え(2026年9月22日)」、もうひとつのチップには「GPT-6 Sol は GPT-6.1 Sol に置き換え(2026年9月29日)」、フッターには「両モデルとも引き続きルーティング対象。指数値は Artificial Analysis による。」と表示されている。OrcaRouter のロゴが右下隅に合成されている。
Guides & Insights

GPT-6 vs Claude Opus 5:この対決の両者はいずれも、すでに置き換えられている

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

まず知っておくべき最も役立つこと:GPT-6 対 Claude Opus 5は、この対決の両者とも、それぞれのベンダーの現行モデルより一世代遅れているということだ。Claude Opus 5は2026年7月24日にリリースされ、9月22日にClaude Opus 5.5に置き換えられた。GPT-6 Solは9月22日にリリースされ、9月29日にGPT-6.1 Solに置き換えられた。新規の仕事でどちらを選ぶためにこの比較を検索したのなら、あなたは各ベンダーがすでに追い越した2つのモデルを比べていることになる — そして、この記事の正直な内容は、どちらが勝つかではなく、この旧ペアが依然として正しい選択となるのはどんな時かについてだ。

その2つのモデルが実際に何であるか

Claude Opus 5はAnthropicのフラッグシップモデルでした。100万トークンのコンテキストウィンドウ、最大128,000トークンの出力、テキスト・画像・ファイルの入力に対応し、価格は入力100万トークンあたり$5.00、出力100万トークンあたり$25.00、キャッシュ入力は$0.50、キャッシュ書き込みは$10.00です。anthropic/claude-opus-5という単一のIDを持つ単一のモデルです。

GPT-6 Solは3モデル世代のミドルティアです —GPT-6 Astraがその上、GPT-6 Lunaがその下に位置し、100万トークン超の同一コンテキスト(カタログではOpenAI側が1,050,000、Opus 5が1,000,000)と同じ128,000トークンの出力上限、同じテキスト/画像/ファイル入力を備えています。価格は$2.00 / $10.00で、キャッシュ入力レートは$0.20、キャッシュ書き込みレートは$2.50です。その料金表には、Anthropicの料金表にはない段階が1つあります。272,000入力トークンを超えるリクエストは、リクエスト全体が$4.00 / $15.00に再計算されます。

それは短い側では、Sol に有利なトークンあたり2.5倍の価格差であり、その差はキャッシュにも当てはまる——Sol のキャッシュ入力割引は90%、Opus 5 は98%で、これにより差は解消されるのではなく、100万トークンあたり0.20ドル対0.50ドルに縮まる。長いコンテキストのワークロードでは、その差は解消されるのではなく半減する。

• 入力 — GPT-6 Sol 100万トークンあたり$2.00 対 Claude Opus 5 $5.00
• 出力 — GPT-6 Sol 100万トークンあたり$10.00 対 Claude Opus 5 $25.00
• キャッシュ入力 — GPT-6 Sol 100万トークンあたり$0.20 対 Claude Opus 5 $0.50
• キャッシュ書き込み — GPT-6 Sol 100万トークンあたり$2.50 対 Claude Opus 5 $10.00
• 272K 超の入力 — GPT-6 Sol はリクエスト全体を $4.00 / $15.00 に再価格設定します。Opus 5 のカードには同等の段階はありません
• コンテキストと出力 — 入力 1,050,000・出力 128,000 対 入力 1,000,000・出力 128,000

独立したボード、そこではギャップが価格よりも大きい

価格ではGPT-6 Solが2.5倍有利だ。リーダーボードではClaude Opus 5が、価格差から示唆される以上に優勢で、これはよくある安価モデル優位の話とは正反対である。

• AA Intelligence Index — Claude Opus 5 50.8、11位;GPT-6 Sol 47.6、14位
• AA Coding Index — Claude Opus 5 78.0、そのボードで2位;GPT-6 Sol 60.0
• GPQA Diamond — Claude Opus 5 93.2
• Humanity's Last Exam — Claude Opus 5 54.9 対 GPT-6 Sol 47.9
• Terminal-Bench 2.1 — Claude Opus 5 89.1
• Terminal-Bench 4.0 — Claude Opus 5 49.0 対 GPT-6 Sol 43.9
• τ-bench 銀行業務 — Claude Opus 5 42.1
• SciCode — Claude Opus 5 56.4 対 GPT-6 Sol 57.6
• 長文脈リコール — Claude Opus 5 79.3 対 GPT-6 Sol 83.7

2つの行は逆方向に伸びており、それらは名指しする価値がある。なぜなら、集計値はそれらを覆い隠してしまうからだ。GPT-6 SolはOpus 5を長文脈リコールで4.4ポイント上回り、SciCodeでは1.2ポイント差でわずかに優る。だから正直な実像は「Opus 5がすべてにおいて優れている」ではない——Opus 5はコーディングとエージェント系のボードで決定的に先行しており(24ポイントのCoding Indexリードは別次元の結果だ)、一方でSolは長いウィンドウにわたる検索の行を保持し、2つの科学コード指標のうち一方では並んでいる、ということだ。

どちらの数値も他のどこかで引用される前に、方法論上の注意点を一つ。Artificial Analysis は、2つのモデルページが同じ日に同じインデックス改訂版に対して表示されることを保証しておらず、またピアグループを分割している — オープンウェイトモデルは同じサイズクラスの他のオープンウェイトモデルと、プロプライエタリモデルはプロプライエタリの価格帯を横断してランク付けされる。ここにある両モデルはプロプライエタリなので、2つの数値はその線の同じ側から来ているが、1ポイント未満の差は管理された測定としてではなく方向性として扱ってほしい。この記事のすべてのベンダー数値は、ベンダーが自社モデルを自社の前身モデルに対してベンチマークしたものであり、そのように明記されている。

2つの置き換えが変えたもの

Claude Opus 5.5は9月22日に$4.00 / $20.00で登場した——Opus 5より両方の料金体系で安く、$0.20のキャッシュ入力レートはSolと同水準——そして同じIntelligence指標で57.6を記録している。これは20%少ないコストでOpus 5を6.8ポイント上回る。新規構築でOpus 5を選ぶ根拠があるとするなら、古いチェックポイントに留まるために6.8インデックスポイントと100万トークンあたり$1.00/$5.00を支払う価値がなぜあるのかを説明しなければならない。

GPT-6.1 Solは9月29日に、GPT-6 Solと同じ$2.00 / $10.00で登場し、インデックスでは51.8を記録してSolの47.6を上回り、$0.10のキャッシュ入力レートによってキャッシュ読み取りが半減する。同じ価格で、より良いスコアとより良いキャッシュ経済性を備えている。GPT-6 Solをあえて選ぶ唯一の論拠は、Opus 5にも当てはまる同じ論拠だ。つまり、それに対してベースラインを取った回帰スイートがあり、モデルを変更するとすでに信頼している比較が無効になってしまうという点である。

チームが古いほうのペアを使い続ける、もう一つ静かな理由がある。それはベンチマークの話ではない。これらはどちらも、最も長い本番運用の実績を持つチェックポイントだ。Opus 5 は7月24日から、GPT-6 Sol は9月22日から呼び出し可能で、独立評価者による両者の測定は、単一の測定値ではなく傾向を示すのに十分な期間続いている。当社独自のルーティングデータにおける Sol の直近7日間のトラフィックは約210万トークン、Opus 5 は約2300万トークンになる。これらは累計ではなく移動ウィンドウであり、読み取りのたびに変動する。だが、後継がリリースされた後も Opus 5 が本番で実際の仕事をこなし続けていることを思い出させてくれる。

レイテンシーとコストの形——まさにここが、Solが元を取る場面です。

• 初回トークンまでの時間の中央値 — GPT-6 Sol 6,785 ms 対 Claude Opus 5 4,652 ms
• 出力速度の中央値 — GPT-6 Sol 179.6 トークン/秒 対 Claude Opus 5 82.2 トークン/秒
• 当社側で観測された7日間のトラフィック — GPT-6 Sol 約210万トークン、Claude Opus 5 約2,300万トークン

Sol は最初のトークンをおよそ 2.1 秒後に返すが、その後は Opus 5 の 2 倍以上の速度でストリーミングする。長い生成——出力が数十ではなく数千トークンになるような実行——では、2 番目の数値が支配的であり、より早く終わる安価なモデルは、その料金表が示唆する以上の価値がある。短くレイテンシに敏感な呼び出しでは、ユーザーが体感するのは最初のトークンの数値だ。

これらはどちらも、当社独自のルーティングによるサービング測定値であり、直近7日間のローリングウィンドウで取得されたもので、読み取りごとに変動します。2つのモデルの傾向を比較するには有用ですが、サービスレベル期待値として引用するためのものではありません。

A generated two-column comparison scoreboard titled "GPT-6 Sol vs Claude Opus 5 — the scoreboard". The left column, GPT-6 Sol, reads Input $2.00, Output $10.00, AA Intelligence 47.6, AA Coding 60.0, Long-context recall 83.7, Output speed 180 tok/s. The right column, Claude Opus 5, reads Input $5.00, Output $25.00, AA Intelligence 50.8, AA Coding 78.0, Long-context recall 79.3, Output speed 82 tok/s. A footer line reads "Index figures per Artificial Analysis; serving figures are a rolling seven-day window from OrcaRouter." The OrcaRouter logo is composited in the bottom-right corner.

移行が未決定の間にペアを稼働させる

この比較にそもそも答える価値があるのは、どちらの置き換えもドロップインで済む決断ではないからだ。もしあなたの評価が Claude Opus 5 に対して構築されているなら、Opus 5.5 への移行はアップグレードではなく再ベースライン化だ。GPT-6 Sol に対する GPT-6.1 Sol についても同じことが言える。その期間に役立つのは、他人のリーダーボードから選ぶのではなく、自分のトラフィック上で両世代を並行して走らせることだ。

4つのモデルはすべてOrcaRouterの同じカタログに揃っています——Claude Opus 5、Claude Opus 5.5、GPT-6 Sol、GPT-6.1 Solは、200以上のモデルの手前に立つ単一のAPIを通じて呼び出せ、プロバイダーの定価は0%のマークアップでそのまま適用されるため、ベンダーの値下げは次の照合時ではなく当日にここへ反映されます——つまりこの比較は調達の話ではなくルーティングの話になります。ルーティングDSLを使えば、リクエストサイズやシェアで分割できます。本番トラフィックの一部を新しいチェックポイントへ送り、自社の評価でベースラインと比較し、数値が安定していればその割合を広げ、安定するまでは旧モデルをフォールバックとして残しておけます。プロバイダー間の自動フェイルオーバーは、移行の途中でルートが劣化するケースをカバーします。これは、移行を途中で放棄させてしまう典型的な障害モードです。

Screenshot of the OrcaRouter model page for anthropic/claude-opus-5, showing the Anthropic vendor label, a 2026-07-24 catalogue release date, a 1M-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $5.00 per million input, $25.00 per million output, a 4.65 s median time to first token, a 10.00 s p95, and 23.0M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-sol, showing the OpenAI vendor label, a 2026-09-22 catalogue release date, a 1,050,000-token context window (shown as 1.05M-token context in the model blurb), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $2.00 per million input, $10.00 per million output, a 6.79 s median time to first token, a 10.00 s p95, and 2.1M tokens routed in seven days.

どちらもすでに取って代わられていることを踏まえると、誰がどちらを選ぶべきでしょうか

新しく何かを始めるなら、どちらでもない。Claude Opus 5.5 は Claude Opus 5 より安価で、スコアは6.8ポイント高い。そして GPT-6.1 Sol は GPT-6 Sol と同価格で、インデックスはより優れ、キャッシュ読み取りは半額になっている。古いほうのペアで始める唯一の理由は、変更できないチェックポイントに強く依存している場合だけだ。

すでにどちらかを運用している場合:判断の対象はリーダーボードではなく、あなたのリグレッションスイートです。Claude Opus 5 は、この2つの中でコーディングおよびエージェント用途において依然として大差をつけて強力なモデルであるため、それ上で安定しているコーディングパイプラインは、GPT-6 ティアへ横滑り的に移行するのではなく、Opus 5.5 と比較すべきです。GPT-6 Sol 上で大量処理を行うコスト重視のパイプラインは、より容易にアップグレードできます — 同じ価格、より良いスコア、より良いキャッシュ — そして、先延ばしにする本当の理由は、まだ評価を再実行していないという一点だけです。

そして、あなたが欲しかった答えが単にこの2つのどちらが勝つかというだけなら、ほぼすべてのボードで Claude Opus 5 が勝ち、価格は2.5倍だ。GPT-6 Sol の主張は、決してより優れていることではなかった。そうではなく、その差額に見合うほど安いということだった——そしてその主張は今、同じ価格でより良いスコアの GPT-6.1 Sol のものだ。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新