
GPT-6.1 Sol:OpenAI、置き換え対象モデルと同価格でAstraに迫る性能を提供
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 507 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 194 tok/s
- OrcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1143 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 55 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- xAISpaceXAI: Grok 4.62026-08-1244知能77コーディング
OpenAIは2026年9月29日、DevDay 2026の基調講演でGPT-6.1 Solを発表した。これは1週間前に出荷されたハイエンドなGPT-6 Solティアの刷新版であり、価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルとまったく同じで、ベンダーは、トークンあたりのコストがおよそ5分の1でありながらGPT-6 Astraという10ドル/50ドルのフラッグシップに迫るものだと位置づけている。異例なのは価格ではない。同一価格で1週間後に登場した刷新版が能力の段階的な飛躍を主張していること、そして本稿執筆時点で独立した評価者がまだそれを採点していないことだ。本稿におけるOpenAI由来の能力値はすべてその旨を明記している。他に照合できるものがないからだ。
実際にリリースされたものと、その時期

DevDayの発表としては異例なほど文書化が行き届いており、それ自体が特筆に値する。ほんの数時間のうちにモデルページ、価格表、システムカードの追補、そしてベンダーの公開APIスキーマへのコミット済みエントリが揃った——9月29日17:16 UTCの「Add gpt-6.1-sol model to model enums」というタイトルのコミットで、その親リビジョンにはこの文字列は一度も含まれていなかった。しかしベンダー自身の変更履歴は、依然として9月22日リリースのGPT-6 SolとGPT-6 Lunaで終わっている。6.1 Solのエントリはそこにはまだ書かれておらず、したがってモデルページと発表記事が記録となっている。
その具体的な形はこうです:
• モデルID: gpt-6.1-sol、単一のスナップショットで日付付きのバリアントはなし — 常に最新ビルドが適用されます。
• 提供状況:本日より、ChatGPT Work および Codex の Plus、Pro、Business、Enterprise、Edu ユーザー、ならびに API 経由で利用可能です。コンシューマー向け Chat 製品では明示的に対象外であり、OpenAI はこれを推測に委ねず明言しています。
• コンテキスト: 1,050,000トークン、最大出力128,000、知識カットオフは2026年4月30日。
• 推論制御: low、medium(デフォルト)、high、xhigh、max — 6段階ではなく5段階です。GPT-6.1 Sol と GPT-6 Astra は、GPT-6 Sol と GPT-6 Luna が受け付けるnone effort を受け付けなくなりました。
• モダリティ: 入力はテキストと画像、出力はテキスト。音声入力と動画入力には対応していません。
• ツール: ウェブ検索、ファイル検索、画像生成、コードインタープリター、ホスト型シェル、apply patch、skills、computer use、MCP、ツール検索 — すべて Responses API 経由です。Chat Completions はツールなしの場合にのみ動作します。
• 非対応: ファインチューニング。これはプロンプトで使うモデルであり、トレーニングするモデルではありません。
• 発表済み・未提供: Ultrafast ティア。OpenAI は GPT-6.1 Sol Ultrafast を「今後数日以内に」提供すると述べており、Codex でのトークン生成が最大8倍高速になるとしていますが、価格も日付も示されていません。
2つの行はもう一度読み直す価値がある。5段階のエフォートラダーとは、安易な逃げ道としてnoneを使っていたプロンプトが6.1 Solでは検証に失敗するという意味であり、ベンダーはまさにこのgpt-6-solからの移行ガイダンスを公開している。そしてUltrafastの行も注意深く読む価値がある。同じティアはすでにGPT-6 Astraで広く利用可能となっており、GPT-5.6 Solではプレビュー中だ。つまり6.1 Solは、他のモデル向けに存在するティアへの今後の追加として説明されているのであって、新しいティアではない。
価格設定と、それが実際に響くのはどこか
見出しの料金はGPT-6 Solから変わっていない。入力トークン100万あたり2.00ドル、出力トークン100万あたり10.00ドルで、キャッシュ書き込みは2.50ドルだ。ベンダー自身が発表で示した位置づけは自社のフラッグシップとの比較であり、そこでは$2/$10はGPT-6 Astraの$10/$50の5分の1だ——これは実際に大きな差であり、同時にこの表の中で最も興味深くない数字でもある。なぜならGPT-6 Solはすでに$2/$10だったからだ。
変わったのはキャッシュ入力の行であり、これが予算を左右する。GPT-6.1 Sol は100万トークンあたり0.10ドルでキャッシュされ、GPT-6 Sol の0.20ドルに対して半額、非キャッシュ入力料金の5%にあたる。リクエストをまたいで長いプレフィックスを再利用するものにとって、そのプレフィックスの実効入力コストは、モデルが良くなったうえにちょうど半減したことになり、ターン間でコンテキストを持ち回るエージェントの価格を設定するなら、モデル化すべきはこの数値だ。
ベンダーの料金ページに掲載されている倍率は次のとおりです。
• 標準: $2.00 入力 / $0.10 キャッシュ / $2.50 キャッシュ書き込み / $10.00 出力。
• 高速モード: 標準のちょうど2倍 — $4.00 / $0.20 / $5.00 / $20.00。EUデータレジデンシーではご利用いただけません。
• バッチおよびFlex: 標準の50% — $1.00 / $0.05 / $1.25 / $5.00。
• リージョン処理: 利用可能な場合は10%の割増。このモデルでは米国とEUの両方のデータレジデンシーがサポートされています。
• 長いプロンプト: 272,000入力トークンを超えるものはすべて、リクエスト全体が入力およびキャッシュ料率2倍、出力1.5倍で再価格設定されます — $4.00 / $0.20、出力は$15.00。出力側が2倍ではなく1.5倍になることが、このファミリーの長コンテキスト段階におけるより緩やかなエッジとなっています。
長コンテキストの行こそを基準に設計すべきだ。コンテキストウィンドウは100万トークンだが、価格の区切りは272,000のところにあり、つまり単一リクエストの実質的な上限はウィンドウの判断ではなく予算の判断であって、それを超えてずれ込むドキュメントパイプラインは、超過分ではなくリクエスト全体に対して2倍の料金を払うことになる。
OpenAIが主張していること、そしてまだ誰も測定していないこと
GPT-6.1 Sol についてこれまでに公表された性能数値はすべてベンダー報告によるもので、再現されていません。OpenAIの発表では、5 つの評価における向上について述べられています:
• DeepSWE v1.1(実際のコードベースにおける複雑なソフトウェアエンジニアリング)— 約5分の1のコストでGPT-6 Astraに匹敵し、より低い推論effortでGPT-6 Solの最高スコアを6.4パーセントポイント上回ります。
• GDP.pdf(複雑なPDFに関する専門的な質問)— フォールバックありのClaude Opus 5.5よりも高いスコアを、タスクあたり半分未満のコストで記録し、タスクあたり約5分の1のコストでAstraに迫ります。
• AutomationBench 1.0.6(47のツール、多段階のビジネスワークフロー)— medium effortでClaude Opus 5.5を約3分の1のコストで2.2パーセントポイント上回り、同じ設定のGPT-6 Solから4.8ポイント上昇しています。
• OSWorld 2.0オフラインセット(コンピュータ操作)— 最大effortでGPT-6 Solを半分未満のコストで7ポイント上回り、タスクあたり約7分の1のコストでAstraの2.1ポイント以内に収まっています。
• Terminal-Bench Science 0.1(データ分析、シミュレーション、定理証明)— 最大effortでGPT-6 Solのスコアを2倍以上に引き上げます。タスクあたり平均$5.47で、Opus 5.5の$23.21、Astraの$23.80に対してです。OpenAIは、Astraが68.1%で依然としてこのセットをリードしていると指摘しています。
ここにある2つの数値のうち、ケイパビリティ・スコアではないもののほうがより興味深い。なぜなら、それらはリーダーボードに関する主張ではなく、失敗率に関する主張だからだ。ファクチュアリティ(事実正確性)について、OpenAIは、低い推論エフォートでは、少なくとも1つの事実誤りを含む回答の割合が11.4%から7.7%へ低下したと報告している——約32%の削減である——そして、テストされた各設定を通じてエラー率はAstraの1.9ポイント以内にとどまると述べている。ツール信頼性については、エージェントが検索ツールの故障をユーザーに伝えられなかったケースの割合が2.1%に低下している。これに対し、GPT-6 Solは4.9%、GPT-6 Astraは1.5%、GPT-6 Lunaは28.7%である。
どちらもベンダー自身の注意書きが付いており、しかもそれは異例なほど具体的だ。事実性のデータセットは、ユーザーが以前のモデルの誤りを指摘した匿名化済みの会話であり、ツール開示のタスクは失敗を誘発するために選ばれたものだ。どちらも典型的な利用についての主張ではなく、OpenAIもそう述べている。これらは、測定された事実としてではなく、ベンダーが自社の信頼性への取り組みについて述べたものとして扱うべきだ。
独立した評価は、フラッグシップに準ずるリリースとしては予想よりも薄い。Artificial Analysis — このファミリーの他のモデルが通常引用されるIntelligence Indexの評価者 — には、GPT-6.1 Solのエントリーがありません。そのモデルのURLは404を返し、その文字列はリーダーボードデータのどこにも現れません。リーダーボードデータには、GPT-6 Sol、GPT-6 Astra、GPT-6 Lunaがそれぞれの推論構成にわたって掲載されています。利用可能な最も近い基準は、これが置き換えるモデルです。Artificial AnalysisはGPT-6 Solを評価しており、そのスコアはIntelligence Indexで48最大努力構成では、タスクあたり評価コスト$1.05、実行全体で7700万トークンを生成、毎秒78トークンです。6.1 Solが同等の行を持つまで、能力主張の正直な要約は、OpenAIが大きな一歩だと言っているが、賛成も反対もする数字をまだ誰も公表していないということです。
名前、そして決して届かなかったモデル
GPT-6のラインは3つの階層として読める — 最上位にAstra、その下にSol、最下位にLuna — それに1体のゴーストが加わる。そのゴーストとはGPT-6.1 Astraであり、ウォール・ストリート・ジャーナルが9月28日に報じたところによれば中止され、フロンティア訓練も停止された、計画されていたフラッグシップの刷新版だ。この決定については別の記事で扱ったので、ここで蒸し返すことはしない。このリリースを読むうえで重要なのは、それが残す形である。ミッドティアへの0.1のバージョンアップは、そうでなければフラッグシップに割り当てられていたはずの改善を引き継いでおり、モデルページ自体のポジショニング文句がその意図を率直に述べている — 複雑な作業でAstraに近い性能を、より低コストで。GPT-6.1 Solは先週のSolの反復ではなく、むしろ出荷されることのなかったモデルの代替である。
正直なところ、これが私たちにとってどういう位置づけにあるか
OrcaRouterはまだGPT-6.1 Solをルーティングしていません。公開カタログにその項目はなく、提供できないモデルを提供できるかのように説明するつもりはありません。実際に提供しているのは、それが置き換えるモデルです:OrcaRouterのGPT-6 Solは、同じ$2.00入力/$10.00出力のリスト価格で、両方のコンテキスト階層の行が公開されており、その上にGPT-6 Astra、下にGPT-6 Lunaが並びます。

値下げではなく同価格でのリフレッシュであることが重要な理由はこうです。当社はプロバイダーの定価をマークアップなしでそのまま通しているため、GPT-6.1 Solがカタログに登場したその日には、OpenAIがそれに請求する価格と同じ価格になり、当社側に価格改定の遅延は生じません。また、1つのAPIキーで当社が扱うすべてのプロバイダーにアクセスできるため、ワークロードをそれへ切り替えるのはモデルIDの変更であり、新しい契約ではありません。既存のものと代替品のコストがまったく同じである置き換えでは、これが1行の編集と移行プロジェクトの違いになります。それまでは、スコア未評価のモデルに対して賢明なのは、本番経路から外しておき、プライマリがエラーを起こしたときに実績のある兄弟モデルへフェイルオーバーすることです。これはまた、ベンダーの主張があなたのワークロードで成り立つかどうかを確かめる最も安価な方法でもあります。
今後2週間で注目すべきこと
このリリースが未解決のまま残した疑問に決着をつけるものは3つあり、まだそのどれも出そろっていない。第一に、独立したスコアだ。GPT-6.1 Sol についての Artificial Analysis の1行があれば、発表の中で最大の主張が検証可能なものになり、しかも調達判断を最も動かしそうな数字である。第二に、Ultrafast の価格だ。OpenAI は Codex 向けに最大8倍の生成速度を持つこのティアを「数日中に」提供すると約束しているが、数字の添えられていない提供ティアの発表は製品ではなく約束であり、そのコストを推測する手がかりは Fast モードの標準比2倍という料金だけだ。第三に、11.4%から7.7%への事実性の改善が、OpenAI 製ではない評価ハーネスと接触しても生き残るかどうか——なぜなら、それと検索ツールの開示率こそ、リーダーボード上の一行ではなく本番トラフィックを移す根拠になりうる2つの主張だからだ。

正直にまとめると、GPT-6.1 Sol は実際のリリースであり、実際の価格表、文書化された API サーフェス、そして通常 0.1 の更新が伴うよりも大きなベンダー公表の数値を備えている。価格面の主張は簡単だ。置き換えるモデルと同じコストで、キャッシュされた入力は半分のコストで済む。能力面の主張は、誰か他の人が測定するまでは完全に OpenAI 側のものだ——だからこそ、今スペックシートを読み、1週間後にベンチマークを読むべきなのだ。
GPT-6.1 Sol はまだ当社のルートには含まれていません。対応した際には、モデルカタログの全体に、OpenAI 自身の定価そのままで上乗せなしで掲載され、すでに 1 つの API キーで利用できる 200 以上のモデルと並びます。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
