
GPT-6 Sol 対 GPT-5.6 Sol:インデックス1ポイント、価格は半分、そして誰も発表しなかったリグレッション
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 610 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 189 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
はい、アップグレードしましょう——ただし、その前に第2段落を読んでください。2026年9月22日にリリースされたGPT-6 Solは、Artificial AnalysisのIntelligence Indexで48を記録しています。2026年7月9日にリリースされたGPT-5.6 Solは47です。1点差です。それに取って代わったモデルはコストが半分です。入力100万あたり$2.00、出力100万あたり$10.00で、$4.00と$20.00に対してです。主要な数字を見る限り、これは現行ラインナップで最も簡単なアップグレード判断であり、価格引き下げは本物で、恒久的で、ベンダーがフラッグシップに対して行った単一の削減としては最大です。
厄介なのは、Artificial Analysis 自身による GPT-6 Sol の評価が、単純なステップアップではなく、向上と後退が混在するものだった点だ。GDPval-AA v2.1 では後退が見られる。さらに、272,000 入力トークンを超える長文コンテキスト向けの再価格設定層があり、入力料金がおよそ2倍、出力料金が5割増しになる——そして 272K は、まさに GPT-5.6 Sol が公表された強みを持つ帯域である。請求額が単純に半減するように見える移行も、長文コンテキストのトラフィックでは、能力面のトレードオフが付いた、ほぼ差し引きゼロに近い結果になり得る。
Indexの1ポイント上昇が実際に意味すること
両モデルは同じボード、バージョン4.3.2で測定されており、これによりGPT-6 Solシリーズ全体で最もクリーンな比較になる——ハーネスの違いも、ベンダー対独立系の不一致もなく、1つのラボが1つのベンダーの2モデルを測定している。
• AAインテリジェンス指数 — GPT-6 Sol 48、212社中18位 対 GPT-5.6 Sol 47、212社中19位
• Indexタスクあたりのコスト — GPT-6 SolはGPT-5.6 Solのおよそ半分
• 出力速度 — GPT-6 Sol 104.4 トークン/秒 対 GPT-5.6 Sol 72.6 トークン/秒
• 初回トークンまでの時間 — GPT-6 Sol 107.18秒 に対し GPT-5.6 Sol はより高速、いずれもボード中央値 3.87秒との比較
• 入力価格 — GPT-6 Sol は100万トークンあたり$2.00 対 GPT-5.6 Sol は100万トークンあたり$4.00
• 出力価格 — GPT-6 Sol 1Mあたり$10.00 対 GPT-5.6 Sol 1Mあたり$20.00
• キャッシュ済み入力 — GPT-6 Sol は GPT-5.6 Sol より約90%割引 100万トークンあたり$0.40
• バッチレート — GPT-6 Sol は未公開、GPT-5.6 Sol は $2.50 / $15.00
• 長コンテキスト枠 — GPT-6 Sol は入力 272K 超で価格が切り替わるのに対し、GPT-5.6 Sol には同等の段階なし
• コンテキストウィンドウ — GPT-6 Sol は AA 調べで 872K、公称 1.05M に対し、GPT-5.6 Sol はおよそ 1.05M~1.1M
• 最大出力 — 両方とも128K
• リリース — GPT-6 Sol 2026-09-22 対 GPT-5.6 Sol 2026-07-09

2つの速度の数値を合わせて見てみよう。GPT-6 Sol は出力の生成が前世代より約44%高速だが、最初のトークンを生成するまでの時間は劇的に遅く、107.18秒で、ボード中央値の3.87秒とは対照的だ。GPT-5.6 Sol もボードの基準では高速なモデルではないが、そこまでの領域にはない。インタラクティブな製品のために GPT-5.6 Sol へ移行した場合、GPT-6 Sol はそのまま置き換えられるものではなく、これはあらゆるベンチマークとは無関係な機能上の後退である。
1行だけは静かに有利だ:GPT-6 Solの標準料金は$2/$10で、GPT-5.6 Solのバッチ料金$2.50/$15を下回っている。旧モデルの割引ティアでさえ、新モデルの定価より高い。これは、今回の値下げが販促的ではなく構造的であることを示す最も強い証拠だ。
回帰が興味深い部分だ
Artificial Analysisは、GPT-6 Solがタスクあたりのコストをほぼ半減させる一方で、改善と後退が混在する結果を生んでいると指摘した。後退が確認された具体的な項目として挙げられているのはGDPval-AA v2.1だ。別途、OpenAIのGPT-5.6 LunaもCoding Agent Indexで後退しており、これは単一モデルにおける孤立した失敗というよりも、この世代に見られるパターンを示唆している。
まさにこれが独立した調査結果であるという理由で、これは真剣に受け止める価値がある。OpenAIの発表資料は、タスクあたりのコストと、同社が選んだベンチマークの行を中心に組み立てられている。Artificial Analysisには売るべき製品がなく、そのハーネスが出力したものを報告している。総合指標では安価でほぼ同等でも、特定のサブタスクでは測定可能なほど劣るモデルは、厳密により優れたモデルではない。それはフロンティア上の別の点なのである。
その実用的な意味はこうだ。あなたのワークロードがGDPval-AAの形を強く帯びている場合——経済的に価値のある知識労働、つまりそのベンチマークが値付けするために作られた種類のタスク——なら、複合スコアの1ポイントの向上はあなたをカバーせず、重要な数字はリグレッションの方だ。あなたのワークロードが一般的なら、タスクあたりコストの半減が重要な数字であり、複合スコアは、測定可能なものを何も犠牲にしていないと言っている。
GPT-5.6 Solが依然として勝る場面
GPT-5.6 Sol には、GPT-6 Sol が同等のものでは匹敵しない、公開済みの長文コンテキスト検索結果がある。MRCR v2、8-needle、256K~512K の範囲で 91.5% だ。これは、GPT-6 Sol の料金表が切り替わる帯域における検索精度の数値である。
2つの事実を並べてみよう。入力トークンが272,000を超えると、GPT-6 Solではリクエスト全体が、入力約4ドル、出力約15ドルに値付けし直される。これは入力ではおおむねGPT-5.6 Solの旧料金と同じで、出力ではその4分の3に当たる。つまり、移行の理由だった50%の節約は、入力で約0%、出力で25%まで縮小する。しかもそれは、GPT-5.6 Solには文書化された強みがあり、GPT-6 Solには公表された対応物がない、まさにそのコンテキスト範囲においてだ。
GPT-5.6 Solのその他の公開されている結果は依然として堅調であり、一部のチームが移行しない理由でもある:
• エージェント最終試験 — GPT-5.6 Sol 53.6
• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0
• SWE-Bench Pro — GPT-5.6 Sol 64.6
• OSWorld 2.0 — GPT-5.6 Sol 62.6
• BrowseComp — GPT-5.6 Sol 90.4
• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo
• HLE — GPT-5.6 Sol 49.5
• MRCR v2、8ニードル — GPT-5.6 Sol 91.5%(256K~512K)
これらはOpenAIが報告したものです。BrowseCompの90.4とMRCRの数値は、置き換えるのが最も難しい2つであることに注意してください。ウェブ調査エージェントと長文脈検索は、公表された数値がある2か月前のモデルのほうが、対応する測定値がない新モデルよりも安全な選択肢となるワークロードです。
GPT-6 Solがもたらす、料金表に載っていないもの
価格設定が本題だが、他に3つのことが変わった。
まず、コンテキストの上限について。GPT-6 SolはArtificial Analysisによって872,000トークンと記載されている一方、OpenAIの資料の別の箇所では1.05Mと主張されており、最大入力は922K。GPT-5.6 Solは情報源に応じて約1.05M~1.1Mに位置する。スペック上では、これは使用可能なウィンドウにおける小さな後退だ — ただし、コストを左右するのは上限ではなく272Kの階層境界であるという但し書き付きで。
第二に、可用性です。GPT-6 SolはAPI、ならびにPlus、Pro、Business、Enterprise、EduのChatGPT WorkとCodexで利用可能です。ただしEnterpriseの管理者が有効化しないと、ユーザーには表示されません。ChatGPT Chatでは利用できません。GPT-5.6 Solはより広範な展開でした。チームのアクセス経路がEnterpriseの管理者を経由している場合、移行は単なるコード変更では済みません。
第三に、新しいフラッグシップの投入は、通常、旧モデルが引退するのではなく、より安価な代替手段になることを意味する。GPT-5.6 Solは$4/$20で、Indexでは47という依然として優れたモデルであり、長いコンテキストの検索作業においては、GPT-6 Solにはない公表された数値を持っている。
見た目よりコストがかからないマイグレーション
この特定のアップグレードが簡単なのは、2つのモデルが同じベンダーで、同じAPI形状で、ランキング上で隣接しているためです。つまり、移行は再アーキテクチャではなくモデル文字列の変更で済み、フォールバック経路はすでにコード内にあります。GPT-5.6 SolはOrcaRouter上でOpenAIの定価にて提供されており、パススルーモデルの下では、OpenAIの価格変更がリセラーとの再交渉を待たずに当日に当社側で反映されます。
本稿執筆時点で、GPT-6 Sol は当社のカタログには含まれていません — OpenAI 自身の API 経由で利用できます。したがって、移行の正直な姿とは、同じキーの背後に GPT-5.6 Sol を従えたルート: 新しいトラフィックは GPT-6 Sol に送り、以前のモデルは設定変更ひとつで切り替えられる状態に保ち、新しいフラッグシップの可用性がまだ落ち着かない期間を自動フェイルオーバーでカバーする、という形です。登場からわずか2日のモデルで、その手前に Enterprise 有効化トグルがあり、272K トークンを超えると経済性が変わる長コンテキスト枠もあるとなれば、前世代をまだ配線したままにしておくことは慎重さではなく、まずい午後で済むか、まずい一週間になるかの違いです。

移行チェックリスト
何よりもまず、実際のコンテキスト分布を測定せよ。リクエストの95パーセンタイルが272,000入力トークンを下回るなら、移行せよ——節約は請求の入力側・出力側の両方で真に50%であり、タスクあたりのコストは半減し、総合指数は何も犠牲にしていないと言っている。無視できない割合のトラフィックがその線を上回るなら、その階層を慎重にモデル化せよ:おおよそ$4/$15で、GPT-5.6 Solの$4/$20に対する優位は出力で25%、入力では皆無であり、それを文書化された長コンテキスト検索結果の喪失と引き換えに支払っている。
最初のトークンで誰かが待たされているかどうかを確認してください。107秒はボードの中央値のおよそ28倍であり、本番環境で最初に表面化する障害モードです。相手側に人間がいるものはすべて GPT-5.6 Sol に留めるか、別のルートに回すべきです。
次に、有効化の経路を確認してください。Enterprise プランでは管理者が GPT-6 Sol をオンにする必要があり、ChatGPT Chat にはまったく含まれていません。社内で移行を告知する前に、ユーザーが実際にそこへ到達できることを確認してください。
最後に、最初の1か月間はご自身の評価で GDPval-AA v2.1 を注視してください。独立系ラボがそこで回帰を発見しており、複合スコアが1ポイント上がっただけでは、あなたの特定のタスクセットが向上したのか悪化したのかは分かりません。切り替える前に、切り替えた後ではなく、両方のモデルであなたの評価を実行してください。

この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
