
GPT-6.1 Sol Pro vs GPT-5.6 Sol Pro:1世代違いで、料金表は半分
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 397 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 195 tok/s
- OrcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- xAISpaceXAI: Grok 4.62026-08-1244知能77コーディング
いったん名前は脇に置き、それぞれがリクエスト内で何に解決されるかを見てください。この対決の決着はそこにつきます。GPT-6.1 Sol Pro は GPT-6.1 Sol — 2026年9月29日リリース — が Responses API で reasoning.mode を pro に設定して動作しているもので、追加の処理に対してモデル自体の入力 $2.00、出力 $10.00(100万トークンあたり)で課金します。GPT-5.6 Sol Pro は同じ構成の1世代前です。GPT-5.6 Sol(2026年7月9日出荷)が reasoning.mode: pro で動作し、追加トークンに対して入力 $4.00、出力 $20.00 で課金します。どちらのベンダーも、どちらのティアについても -pro 識別子を公開していないため、比較すべき pro の料金表も、検討すべき pro の追加料金もありません。実際に比較しているのは、3か月離れた2つの基本料金表であり、その表示価格は2倍異なり、キャッシュ料金は4倍異なります。モードは同一です。その下にあるメーターは違います。
なぜ旧型のProメーターがそもそもこの比較にまだ含まれているのか
GPT-5.6 Sol Pro が前身ではなく同格のものとして繰り返し出てくるのは、OpenAI が GPT-5 時代に Pro を実際に製品として販売しており、それらの識別子が今も独自のプレミアム料金体系とともに価格表に載っているからだ。gpt-5.4-pro と gpt-5.5-pro は、ショートコンテキストで入力100万トークンあたり $30.00、出力100万トークンあたり $180.00、入力トークンが 272,000 を超えると $60.00 と $270.00 に上がる。これらは実在する別々に価格設定された製品であり、「Pro」が高価な語として読まれる理由でもある。GPT-5.6 世代は用語を変えずに仕組みを変えた——pro は、その横に並ぶプレミアムモデルではなく旗艦の一モードになり、旗艦自身の料金で価格設定された。したがって、5.6 時代の pro 構成から 6.1 時代の構成へ移ることの実用的な効果は、「より安い pro モデル」ではない。同じ構成を、より安いベースの上で使うということだ。
• 両者に共通する実体 — モデルと reasoning.mode: "pro" の組み合わせであり、別々に学習されたり別々に価格設定されたデプロイメントではない
• 送信する識別子 — gpt-6.1-sol 対 gpt-5.6-sol、モードは reasoning オブジェクトで渡される
• 標準入力価格 — 100万トークンあたり$2.00($4.00と比較)、つまり新しいティアではproモードの追加トークンのコストが半分になります
• 標準出力価格 — 100万トークンあたり$10.00($20.00に対して)。proモードが膨らませる請求の側面にも同じ半減が適用されます
• キャッシュ済み入力6.1 Solでは100万あたり$0.10、5.6 Solでは$0.40 —— この4倍の差は、まさにproモードが想定するエージェントループで最も大きく響く
• キャッシュ書き込み — 100万トークンあたり$2.50対$5.00、再び半減
• 長いプロンプトの料金改定 — どちらも入力トークンが272,000を超えるとリクエスト全体が再価格設定され、入力とキャッシュのレートは2倍、出力は1.5倍になります
• コンテキストと出力の上限 — 両方とも1,050,000トークン、最大出力トークンは128,000、それぞれ最大入力922,000が明記されています
• 知識のカットオフ — 6.1 Solでは2026年4月30日、5.6 Solでは2026年2月16日
• 推論エフォート — low、medium、high、xhigh、max。6.1 Sol では none と minimal は未サポートで、5.6 Sol では同じ段階に none を加えたものと対比
• Proモードのドキュメント — OpenAIの推論ガイドではgpt-6.1-solが名指しで示されているが、対してGPT-5.6とGPT-6を対象としたファミリーレベルの記載にとどまり、モデルごとの対象一覧は存在しない
そのリストの2行は、残りを全部合わせたより価値があり、しかもどちらも見出し価格ではない。
キャッシュラインは、二つの世代が比較できなくなる場所だ
Proモードのコストは、追加料金としてではなく、量として生じる。OpenAIのドキュメントには、「最終的な回答を生成するために実行されたモデル作業を集約し、それらのトークンを選択したモデルの標準トークン単価で請求する」と記されており、ベンダーはその倍率を公開していない。そのため、Pro構成のコストは、調べても分からない2つの要素、つまりそのモードが自分のタスクでどれだけ余分な作業を行うかと、自分のトークンのコストの関数になり、公開されているのは後者だけである。その軸では、6.1ティアがあらゆる行でちょうど2倍の差をつけて勝ち、キャッシュ入力の行では4倍の差をつけて勝つ。
カスタマーサポートエージェントが毎ターン、固定の指示とツールスキーマのプレフィックスを再生する場合の計算をしてみよう。月に2億入力トークンを送信し、その95%がプレフィックスヒットで、キャッシュされた部分は6.1 Solでは100万トークンあたり$0.10、5.6 Solでは$0.40で課金される——同じプレフィックスに対して$19対$76、pro modeのトークンを1つも数える前の時点で。そこにpro modeを上乗せすると、差は縮まるどころか広がる。このモードの追加の推論は出力側に乗り、100万トークンあたり$10.00対$20.00だからだ。唯一半減しない行は長いプロンプトの再価格設定ルールで、これは両方のティアで同一であり、同じ2×と1.5×の乗数が適用される——つまり定期的に272,000入力トークンを超えるワークロードは、比較の両側で割増を支払う。ただし新しいティアのほうがその割増は小さい。
また、どちらのモデルにも属さず、モードに属する罠もあり、それは素朴なコスト見積もりを痛い目に遭わせる。プロモードがオンのときに reasoning.effort を none に設定すると、静かにフォールバックする代わりにエラーを返す。そして、プロモードが消費する推論トークンは usage オブジェクトの output_tokens_details.reasoning_tokens の下に報告されるが、応答本文には決して現れない。返されたテキストから支出を見積もるクライアントは、プロ構成を毎回必ず過小にカウントする。
上の世代にまだ一理あるところ

安いことは優れていることと同じではない。そして5.6世代には、価格表には表れない3つの利点がある。1つ目は成熟度だ。gpt-5.6-solは2026年7月9日から一般提供されており、その挙動は安定しており、OpenAI自身の非推奨化ページが旧Proメーターを廃止する際に指し示すモデルでもある——つまり、$180-per-millionのそれらのメーターからの移行経路は、6.1ティアではなく5.6ティアに着地する。2つ目はプロモーションだ。OpenAIは、GPT-5.6 Solのプロモーション価格が少なくとも2026年11月21日まで利用可能だと述べている。したがって、$4.00 / $20.00の組み合わせは、定価ではなく、期限の付いた下限である。3つ目は独立した証拠であり、自分で評価を実行できないならこれが最も重要だ——Artificial AnalysisにはGPT-5.6 Solの完全な評価があり、6.1ティアについてはページがまったくない。
その独立した評価は、知能の話ではなくコストの話であり、そこが有用な点だ。中立ボードのIntelligence Indexでは、GPT-5.6 Solは最大推論努力で47を記録し、145モデルのサンプル中13位、Coding Indexは77.4で3位、GPQA Diamondは94.1%。インデックスタスクあたりのコストは約$2.00で、同じ設定のGPT-6 Solの$1.06に対してほぼ2倍であり、その比率が、より新しい層を正当化する論拠のすべてを1つの数字で表している。6.1世代には、2026年9月30日時点で公表された比較可能な数値がない。ボードの6.1 Solスラッグのモデルページは404を返し、その文字列はライブリーダーボードに現れない。したがって、今日の誠実な比較は、測定された5.6世代と、ベンダーが説明する6.1世代との比較であり、どれだけ表を積み上げてもそのギャップは埋まらない。
1 つのキーで両方の構成を実行する
実験のセットアップにほとんどコストがかからない、珍しい比較です。2つのアームの違いはモデル文字列と1つのパラメータだけだからです。OrcaRouter がルーティングする openai/gpt-5.6-sol は OpenAI 自身の定価そのまま、一切の上乗せなし — 入力 $4.00、キャッシュ $0.40、出力 $20.00、ロングプロンプト枠は $8.00 と $30.00 で公表 — そして openai/gpt-6-sol は $2.00 / $0.20 / $10.00、独自の 272K 枠は $4.00 と $15.00 でルーティングされます。マークアップがゼロで、ベンダーの価格表が記載どおりにパススルーされるため、どちらかの枠にプロモーション変更や値下げがあれば、OpenAI が公表した当日にそのルートへ反映されます。第二の契約も、モデルごとの再オンボーディングも不要です。OpenAI 互換のエンドポイント1つと API キー1つでテストの両アームをカバーできるので、作業はタスクセットを選び、usage オブジェクトを読むだけです。

同じ一式の自分自身の難しいリクエストに対して3通りで実行し、reasoning.effort を一定に保って変数が1つだけ動くようにする。標準モードの gpt-5.6-sol、proモードを有効にした gpt-5.6-sol、そして同じ effort の gpt-6.1-sol だ。タスク成功率、実時間レイテンシ、合計請求トークン数を比較し、レスポンス本文ではなく reasoning-token フィールドを読む。pro実行のトークン合計を標準の対応実行と比べたものが、自分のトラフィックにおける倍率になる。これは他人の値とは一致しない。設計意図として、追加の作業量はリクエストの難しさに応じて増えるからだ。6.1の実行は、文字列を1つ変えただけの同じリクエスト本文なので、決定後も回帰テストとして残しておくのにコストはかからない。
結論を出す前に心に留めておくべきことが2つある。6.1の識別子が結果を返すのではなくproパラメータを拒否するなら、それ自体が1つの発見であり、ユーザー向けの何かに触れる前にそれを知ることができたということだ。そして、比較対象としているアームが5.6の構成ではなく現在ルーティング可能なgpt-6-solであるなら、基本レートカードは6.0と6.1で同一であることを思い出してほしい — この2つの違いはキャッシュ入力の行とベンダーが報告するタスク結果であり、一方で5.6と6.1の違いはレートカード全体である。
よくある質問
GPT-5.6 Sol Proは、独自のプレミアム価格を持つ別個のモデルなのか?いいえ——そしてこれこそが、その名前が仕掛ける罠です。OpenAIの価格表には正真正銘のプレミアムなProメーターが載っていますが、それらは以前の世代に属するもので、100万トークンあたり入力$30.00、出力$180.00以上となっています。GPT-5.6ファミリーについて、ベンダーが販売しているのはフラッグシップであり、proはResponses APIにおけるreasoning.modeの値として公開され、そのフラッグシップの通常料金で課金されます。5.6世代の日付が付され、$4.00と$20.00を提示しているproの記載は、フラッグシップの料金表を引用しているのであり、それが第2のメーターが存在しないと見分ける手がかりです。
2つのうち、厳しい低ボリュームのワークロードを載せるべきなのはどちらでしょうか。どちらの答えも無料ではないので、判断の決め手は読める情報ではなく、測定できるものになる。新しいティアは公表されているすべての項目で価格が半分、キャッシュ済み入力なら4分の1だが、そのproモードを裏付ける独立した評価はなく、モデルページにはそのモードについて一切触れられていない。古いティアには確立されたGA実績と完全な第三者評価があり、トークンあたりのコストは2倍だ。あなたのタスクセットを安く実行できるなら、答えは同じ手間で自分のリクエスト上で勝つ方のアームであり、そうでなければ、少なくとも他人の数値と照らし合わせて挙動を確認できるのは古いティアの方だ。
プロモードはモデルが得意なことを変えますか?いいえ。単一の最終回答を返す前に、より多くのモデル作業を実行するため、難しいタスクでの信頼性が向上する可能性がありますが、レイテンシとトークン使用量はどちらも増加します — どちらの場合でも重みは同じです。動かそうとしている指標が、本当に難しい問題でのタスク成功率ではなく、正確さやハルシネーションの数値であるなら、このファミリーに関する独立した証拠が指し示す、より信頼できるレバーはモデル世代とエフォート設定であり、モードではありません。

手短に言えば、そしてこの比較から持ち出す価値がある結論はこうだ:プロモードは不変であり、料金表は可変である。この2つの構成の間で、モードの仕組みについて何も変わっていない——モデル作業の集約も同じ、標準料金での課金も同じ、非公開の乗数も同じ、エフォートと組み合わせようとした場合のエラーも同じ:なし。3か月で変わったのは、その下にあるメーターの公開されている行がすべて半減し、キャッシュ入力の行が4分の1になったことだ。そのため、すでにプロ構成を実行している人にとっては新しいほうのティアが価格面でのデフォルトの選択肢となり、移行する前に第三者による数値を必要とする人にとっては古いほうのティアが根拠面でのデフォルトの選択肢となる。どちらも、その名前を2つの製品として扱う理由にはならない。
テストの両方のアームは1つのOpenAI互換エンドポイントから実行され、ベンダーの価格表は書かれているとおりにそのまま渡され、マークアップは追加されず、プロバイダー間の自動フェイルオーバーが行われます。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
