「最速ティアで提供中」という見出しの生成されたヒーローカード。サブタイトルは「GPT-6.1 Sol UltrafastがAPI、Codex、ChatGPT Workへ展開」で、4つのチップは「1Mトークンあたり$12.00 / $60.00」「Standardの6倍」「最大8倍高速(Astra測定)」「API、Codex、ChatGPT Work」と表示され、その下のフッターには「提供状況と価格はOpenAIのドキュメント(2026年10月8日)による」と表示される。
Guides & Insights

GPT-6.1 Sol UltrafastがAPI、Codex、ChatGPT Workに展開

著者

Elias Hawthorne

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

O​penAIはGPT-6.1 Sol向けにUltrafastモードを展開し始めた——同社が提供する最速のサービスティアであり、Astraに近いSolティアにこれが用意されるのは初めてのことだ。この動きによりGPT-6.1 SolはGPT-6 Astra Ultrafastと同じ枠に入る——APIでも、Codexでも、ChatGPT Workでも。しかも順番待ちリストではなく、公開された料金表とともに登場する。入力トークン100万あたり12.00ドル、出力トークン100万あたり60.00ドルで、標準のGPT-6.1 Solのちょうど6倍だ。うたい文句の速度は「最大8倍」。興味深いのは、そのフレーズが何を測っているのかという点であり、答えはあなたがこれから料金を払おうとしているモデルではない。

開発者向け変更履歴には10月8日付の項目が記載されている:「Responses API の GPT-6.1 Sol に Ultrafast モードを追加。使用するには gpt-6.1-sol を service_tier: "ultrafast" とともに使用すると、生成される出力トークン間の時間を短縮できます。これはすべての API ユーザーが利用可能で、レート制限の対象となり、グローバル処理および米国と EU のデータレジデンシーに対応します。」Ultrafast のドキュメントページには現在「GPT-6 Astra および GPT-6.1 Sol で広く利用可能、GPT-5.6 Sol はプレビューアクセス」と記載されており、ChatGPT 側の速度ページはサブスクリプション部分を裏付けている:Ultrafast は Codex および ChatGPT Work で Pro $500、ならびに対象となる Enterprise および Edu プランで利用できます。

Ultrafastはサービス階層であり、2つ目のモデルではありません

重みに関する変化は何もありません。同じチェックポイント、同じ1,050,000トークンのコンテキストウィンドウ、同じ922,000トークンの最大入力、同じ128,000トークンの出力上限、同じ2026年4月30日の知識カットオフ、同じ回答です。あなたが購入しているのはスケジューリングの優先度です。モデルはトークンをより速く生成し、OpenAI自身の説明は意図的に狭い範囲にとどまっています — このティアは「生成される出力トークン間の時間を短縮する」ものです。モデルが賢くなるわけでも、思考フェーズが短くなるわけでもありません。

その違いが決定のすべてだ。40回連続でツール呼び出しを行うエージェントループでは、各ターンの出力がより早く到着するため、その利得は複利的に増大する。実時間のほとんどを熟考に費やす単一の難しい推論リクエストでは、6倍のコストを払っても、同じスピナーを見ているだけだ。

階層のはしごを、一度、平易な言葉で言うと:

• Batch and Flex — Standardの半額、誰も待っていない作業向けの格安レーン

• Standard — 100万トークンあたり $2.00 入力 / $0.10 キャッシュ済み / $2.50 キャッシュ書き込み / $10.00 出力

• Fast — Standardの2倍、または$4.00 / $0.20 / $5.00 / $20.00。OpenAIは2026年7月30日にPriority処理をFastモードに名称変更しました

• 超高速 — スタンダードの6倍、または $12.00 / $0.60 / $15.00 / $60.00

• 入力トークンが272Kを超える場合 — リクエスト全体が入力料金とキャッシュ料金の2倍、出力の1.5倍で再計算されます。Ultrafast long-contextは$24.00 / $1.20 / $30.00 / $90.00

誰もマーケティングページには載せない算数

8倍の速度のために6倍の価格を払うのは、損な取引ではないし、ただで手に入るものでもない。Ultrafast はトークン単位で課金されるので、Standard では $1.00 かかるジョブが Ultrafast では $6.00 かかり、しかもおよそ8分の1の時間で完了する。節約になるのは請求額ではなく、実時間のほうだ。そのジョブの待ち時間の8分の7を取り除くために、あなたは追加で5ドル払っている。それが安いのか馬鹿げているのかは、反対側で待っている人やパイプラインが1分あたりどれだけの価値があるかによって完全に決まる。

そこから2つの含意が導かれる。そして、見落とされるのはまさにそれらだ:

• インタラクティブな作業は、即座に「イエス」と言えるものだ。開発者がdiffの反映を見守っている、結果を読むまでエージェントが先に進めない——そんなケースでは、レイテンシこそが製品なのだ。40ターンのループで出力が8倍速くなることは、人間の知覚にとってわずかな改善ではない。それは、自分が使うツールとバックグラウンドで走らせるツールの違いなのだ。

• スケジュールされた作業やバッチ処理なら、簡単にノーと言えます。どうせ朝までに終わればいいジョブなら、Ultrafast はただの6倍の請求で、半額の Batch レーンがすぐそこにあるのに使わない手はありません。

キャッシュ済み入力はもう一度見てみる価値がある。それも変動するからだ。Ultrafastでは100万あたり$0.60、Standardでは$0.10で、それでも未キャッシュ入力料金の5%だ。毎ターン大きなシステムプロンプトを再送するプロンプトキャッシュ利用のエージェントは、キャッシュ割引がティアから守ってくれるものではなく、ティアに応じて変動するものだとわかるだろう。

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, alongside the page's notes that regional processing endpoints carry a 10% uplift, that FedRAMP endpoints carry a further 10%, that Priority processing was renamed Fast mode on July 30, 2026, and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

「最大8倍」という数字の根拠

ここは注意深く読むべき箇所です。というのも、ここではロールアウトの見出しとロールアウトのドキュメントが、静かに別々のことを説明しているからです。

OpenAIが公開しているモデル固有の速度測定値は、次の一文だけです。「GPT-6 Astra Ultrafastは、CodexのStandardモードにおいて、GPT-6 Astraよりも最大8倍高速にトークンを生成します」。これはAstraの数値であり、Codexで測定されたものです。GPT-6.1 Solについて、同等の公表された倍率はありません。このモデルのUltrafastについて説明した文書には、生成される出力トークン間の時間を短縮すると書かれており、価格表を指し示していますが、具体的な数値は示していません。ChatGPT側の速度ページもAstraの一文を繰り返すだけで、それ以上は述べていません。

「最大 8 倍高速」を正直に読み解けば、こうなる。これはそのティアの看板となる数字であり、9 月 29 日から Ultrafast に搭載されている兄弟モデルに由来し、どちらのモデルについても独立した第三者によって再現されていないベンダー主張だ。GPT-6.1 Sol についても成り立つ可能性は十分にある——両者は同じサービングスタック上で動いており、そのティアの仕組みも同じだからだ——しかし、OpenAI の外部で Sol バリアントのトークン毎秒の測定値を公表した者は誰もいない。そして、その文では「最大」が実際に効いている。

また、ティアはモデルごとに分けておく価値がある。なぜなら、古い方のティアはまだ未完了の案件だからだ。Ultrafastは2026年8月13日、GPT-5.6 Sol向けに「Standard処理より最大14倍高速」として発表され、一部の顧客向けの限定プレビューとなった。3か月後も、ドキュメントにはGPT-5.6 Solが「プレビューアクセス」を持つと依然として記載されており、Ultrafastの価格表にはちょうど2行——GPT-6 AstraとGPT-6.1 Sol——しか含まれていない。一般提供に到達したこともなく、公開された料金もない14倍という数字は、製品ではなく主張にすぎない。

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the statement that Ultrafast mode for GPT-6 Astra and GPT-6.1 Sol is available to all API users, the recommendation to use WebSockets because network overhead without a persistent connection can reduce the latency gains, the note that Ultrafast has separate rate limits from Standard and Fast modes, the GPT-6.1 Sol rate-limit row reading 1,000,000 / 4,000,000 / 40,000,000 tokens per minute and 5,000 / 20,000 / 200,000 requests per minute, the line that GPT-6.1 Sol supports US and EU data residency and global processing, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

実際にそれをオンにできるのは誰ですか?

API側は広範で、サブスクリプション側は狭く、その違いが人々の不意を突く。

• API — すべての API ユーザーが利用可能(対象: gpt-6.1-sol)。Standard と Fast とは別のレート制限があります。つまり、2つ目の価格だけでなく、2つ目の予算も考慮する必要があるということです。

• GPT-6.1 Sol の超高速レート制限 — Build では毎分 1,000,000 トークン、Launch では 4,000,000、Grow では 40,000,000。OpenAI は 10 月 6 日に利用枠を 5 段階から 3 段階に簡素化したため、これら 3 つの名称は現行の段階であり、旧称ではありません。

• データレジデンシー — GPT-6.1 Sol は米国と EU のデータレジデンシーおよびグローバル処理に対応しており、Fast および Ultrafast でも利用できます。Astra の Ultrafast は EU レジデンシーを取得できないため、ワークロードが EU に固定されている場合、これはそもそも購入できる最初の Ultrafast 構成です。

• Codex と ChatGPT Work — Ultrafast は Pro $500 プラン、および対象となる Enterprise プランと Edu プランでご利用いただけます。Enterprise の管理者はデフォルトでオフになっており、ユーザーごとまたはワークスペースごとに有効にする必要があります。

• Chat — 含まれていません。GPT-6.1 Sol 自体は Work と Codex にあり、コンシューマー向けの Chat サーフェスはこれに含まれません。

• サブスクリプションでの課金方法 — 含まれる使用量はスタンダード料金の8倍で消費され、購入したクレジットまたはEnterpriseの従量課金はスタンダード料金の6倍で請求されます。この設定をオンのままにする前に、どちらの数字も知っておく価値があります。

実装上の細部が1つあるだけで、そのスピードを少しでも体感できるかどうかが決まる。OpenAIのガイダンスはこの点について歯に衣着せぬ言い方だ。WebSocketを使うこと、「特に、短時間に次々と多数のツール呼び出しを行うエージェント型アプリケーションでは」、なぜなら「持続的接続がなければ、ネットワークのオーバーヘッドがレイテンシの短縮効果を損なう可能性がある」からだ。クライアントが呼び出しごとに新しいHTTP接続を開くなら、リクエストごとのオーバーヘッドが、先ほど6倍の料金を払ったそのティアの利点を丸ごと食い尽くしかねない。HTTPでもまだ動く。ただ、そのティアに見合う価値はないかもしれないだけだ。

ルーティングするもの、しないもの

標準ティアのGPT-6.1 SolはOrcaRouter上にopenai/gpt-6.1-solとして、プロバイダー自身の価格である入力$2.00/出力$10.00(100万トークンあたり)、マークアップ0%で提供されています — ベンダーの定価をそのまま通すため、O​penAIが料金を改定すれば、その変更は次回の契約更新時ではなく、料金表に反映されたその日のうちに請求へ反映されます。同じキーと同じエンドポイントが200以上のモデルを担うので、GPT-6.1 Solの呼び出しもClaudeやQ​wenの呼び出しも1つの統合の背後に収まり、自動フェイルオーバーが付いてきて、2つ目の契約は不要です。また、ルーティングDSLは、タスクが複数の視点を必要とするときにモデルを1つの呼び出しへと組み上げます。

Ultrafastはそうしたモデルの一つではなく、そうであるかのように示唆するのは誤解を招きます。これはOpenAIアカウント上のサービスティアのフラグであり、送信するのはservice_tier: "ultrafast"をgpt-6.1-solに送信すると、OpenAIが上記の料金でお客様自身のアカウントに請求します — つまり、これはお客様の直接のOpenAI連携の中で機能します。有効にする場合は、階層型のトラフィックはベンダーキー側に残し、標準ボリュームのトラフィックは当社経由でルーティングしてください。それが誠実な切り分けであり、人間の対応を待たないものにとってはより安価な選択でもあります。

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1M-token context window, 128K maximum output, text, image and file input with text output, vision, tools, JSON and reasoning capabilities, public benchmarks attributed to OpenAI dated 2026-09-29, input price $2.00 and output price $10.00 per 1M tokens, p50 time to first token 6.14 s, a 10.00 s figure, and 313.9M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

今日それをどうするか

Codex または ChatGPT Work のシートを Pro $500 で持っているなら、トグルはすでにそこにあり、試すのに使用量の倍率以外のコストはかかりません — 同じタスクを両方の方法で実行し、実際に回しているループに、8倍の効果が現れるだけのターン数があるか確認してください。API を使っているなら、試す価値のある実験は発表が示唆するより狭い範囲です:レイテンシのうちどれだけがトークン生成で、どれだけがモデルの思考なのかを計測し、Ultrafast を実際に圧縮できる部分に向けてください。

同じリクエストに対して、2倍速の Fast と6倍速の Ultrafast のどちらかを選べるなら、先に登場したのは Fast のほうであり、料金表だけからその挙動を推論できるのも Fast だ。Ultrafast はこのモデルにとって新顔で、誰の独立した測定によっても値付けされておらず、自分のストップウォッチが示すとおりの価値しかない。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新