「3件の投稿の深さ」という見出しが付いた生成されたヒーローカード。サブタイトルは「GPT-6.1 UltrafastはChatGPT内でのみPro $500 — すべてのAPIユーザーに開放」、チップは「Pro $500プラン」「対象のEnterpriseとEdu」「すべてのAPIユーザー」、フッターは「提供状況はOpenAIのドキュメントによる、2026年10月8日」。
Guides & Insights

GPT-6.1 UltrafastはPro限定、たったの$500——そしてその詳細は3投稿分の奥深くに埋もれていた

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

GPT-6.1 Sol Ultrafastは2026年10月8日に登場した。スピード重視のティアが出荷時に備えられることなどめったにないもの——公表された価格を携えて。入力トークン100万あたり$12.00、出力トークン100万あたり$60.00。これはGPT-6.1 Sol——OpenAIが2026年9月29日のDevDay 2026基調講演で発表したモデル——の標準レーンにおける価格のちょうど6倍だ。発表スレッドが冒頭で触れなかったのは、ChatGPTの購読者が実際にどこでこれを有効化できるのかという点であり、その答えは3つ下の投稿にある——$500のProプランだ。この順序は、実際に得られた以上の注目に値する。なぜなら、このロールアウトのAPI側とサブスクリプション側は正反対の形で制限されており、その違いが、Ultrafastが今週試せるものなのか、それともプランを購入しなければならないものなのかを決めるからだ。

モデルについて変わったことは何もありません。GPT-6.1 Sol Ultrafastは同じチェックポイントで、同じ1,050,000トークンのコンテキストウィンドウ、同じ128,000トークンの出力上限、同じ2026年4月30日の知識カットオフ、そしてGPT-6.1 Solと同じ回答です。Ultrafastはサービス階層——あなたがリクエストするスケジューリング優先度——であり、2つ目のモデルではありません。製品のすべてはレイテンシーで、何倍もの価格で販売されており、重要な問いは2つだけです。それをどれだけ得られるか、そして誰がそれを購入できるかです。

記録が実際に語っていること、それが語られている順序で

この話の恨み節バージョンは、O​penAIがゲートを埋もれさせたというものだ。正確なバージョンはより具体的で、O​penAI自身のドキュメントと一行ずつ照合して確認できる。

開発者向け変更履歴には10月8日付の項目が載っている。Responses API で GPT-6.1 Sol の Ultrafast モードを追加するもので、そのリクエストはmodel: "gpt-6.1-sol" に service_tier: "ultrafast" を付けて送信して行う。これは、生成される出力トークン間の時間を短縮すると説明され、レート制限が適用されるすべての API ユーザーが利用可能で、グローバル処理に対応し、米国および EU のデータレジデンシーを備えると記載されている。単独で読めば、それは公表された料金での無制限の提供開始である。

ティアのドキュメントには、Ultrafast が API で最速のサービスティアであり、GPT-6 Astra と GPT-6.1 Sol では広く利用可能で、GPT-5.6 Sol ではプレビューアクセスが提供され、それには WebSockets が推奨されると書かれている。依然としてプランについての言及はない。

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

サブスクリプションの詳細はChatGPT側のスピードページにあり、3つの制限が1段落にまとまっています。UltrafastはCodexとChatGPT Work、Pro $500、および対象となるEnterpriseとEduプランで利用できます。Enterpriseの管理者はデフォルトで無効になっており、ユーザー単位またはワークスペース単位で有効にする必要があります。また、コンシューマー向けのChatサーフェスにはこのティアはまったく提供されていません — GPT-6.1 Sol自体がWorkとCodexにあるため、Chatはそもそも対象外でした。

3つのページを並べてみれば、全体像は明らかだ。APIキーはチケットだ。ChatGPTのサブスクリプションがチケットになるのは、それがO​penAIが販売する中で最も高価なものの場合か、管理者があなたに対して有効にしている場合だけだ。発表の最初の投稿を読んだだけでは、誰もそんなことは推測できないだろう。

なぜゲートが存在するのか、そしてそれは恣意的なものではない

明白な読み方は、OpenAIがファストレーンを使って500ドルプランを売ろうとしているということだ。その下にある仕組みは、より皮肉が少なく、より有用である。Ultrafastは高価なメーターであり、500ドルプランは、8xのメーターが含まれる使用量の範囲内に収まる唯一のコンシューマー向けプランなのだ。

サブスクリプションでは、Ultrafast を使うと、含まれる利用枠は標準レートの8倍で消費される。そのため、Ultrafast の1ターンで、標準の8ターンと同じ利用枠が減る。これはこのティアが何をするかの帰結である。つまり、提供容量を費やすことで実時間を買うのであり、サブスクリプションは固定容量の製品である。8倍の容量消費に対して同じ利用枠を課せば、月額20ドルではプランの採算が崩れる。8倍の利用枠を課せば、このティアは小規模プランでは単純に魅力的でなくなる。どちらの場合でも、このティアが成り立つのは、利用枠がそれを吸収できるほど大きいときである。

APIにはそのような制約はない。従量課金制だからだ。APIでは、UltrafastにはStandardとFastの予算とは別に、独自のレート制限予算が割り当てられ、OpenAIはそれらの制限を、ティアのページに公開されるものではなく組織ごとに設定されるものだと説明している。発表が前面に打ち出さなかった、注意すべき2つ目の点はこれだ。ワークロードをUltrafastに切り替えると、請求額が何倍にもなるだけでなく、ワークロードは別の上限へ移る。そして、組織に付与された範囲を超えてトラフィックを増やすと、そのティア自身の制限が障害モードになる。

2通りの方法でスピードを買う場合の計算

これが数字で見た判断であり、私のトークン数ではなく、あなた自身のトークン数で行う価値のある部分です。1ターンにつき30,000の入力トークンを送信し、1,500の出力トークンを受信するエージェントセッションを、40ターンにわたって考えてみましょう。

• 実行あたりの合計トークン数 — 入力1,200,000、出力60,000。40件のリクエストに分散されており、各リクエストは、OpenAIがリクエスト全体の料金を再計算する272,000トークンのしきい値を余裕をもって下回ります。

• 標準のGPT-6.1 Solでは — 120万トークンが100万トークンあたり$2.00で$2.40、さらに60,000トークンが100万トークンあたり$10.00で$0.60。1回あたり3ドル。

• GPT-6.1 Sol Ultrafast では — 120万で $12.00 なら $14.40、さらに 60,000 で $60.00 なら $3.60。1回あたり18ドル。

• 違い — それ以外は変わらないジョブの生成時間の大半を取り除くために、1回の実行あたり$15.00。

1回あたり15.00ドルというその数字が、サブスクリプションと比較する際の基準です。Proプランを検討する唯一の理由がUltrafastなら、このトークン数で月におよそ33回が、プランの500ドルとAPIのトークン従量メーターが交差する地点です — それを下回れば、同じティアを買うにはメーターのほうが安く、上回ればプランが有利になり始めます。トークン数が変わればこの交差地点も動き、ときに大きく動くので、33をしきい値として扱う前にご自身の数字で計算してください。これは明示されたワークロードに基づく当社の計算であり、公表された損益分岐点ではありません。

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>どんなトークン数でも通用する、構造に関する2つの指摘。

スピードの主張は借用されたもので、それこそ注意深く読むべき唯一の点だ。

Ultrafast は「最大8倍高速」を売り文句にしており、OpenAI がそのフレーズの裏付けとして公表している唯一のモデル固有の測定値は、別のモデルのものだ。そのドキュメントの一文には、GPT-6 Astra Ultrafast は Codex の Standard モードで GPT-6 Astra より最大8倍高速にトークンを生成すると書かれている。これは Codex で測定された Astra の数値だ。GPT-6.1 Sol のティアに関するドキュメントは、トークン間時間を短縮すると説明して料金表を指し示しているが、数値は示していない。また、Sol 版について1秒あたりのトークン数の測定値を公表した独立した第三者もいない。

それは十分に成り立つかもしれない。両モデルは同じサービングスタック上で動作し、ティアの仕組みも同じなので、Astra の倍率は Sol にとって妥当な事前見積もりだ。しかし「最大8倍」はベンダーの上限値であり、再現されておらず、兄弟モデルから取られたものだ——そしてその文の中で「最大」は実際に重要な役割を果たしている。倍率は自分のプロンプトで検証する仮説として扱うべきだ。なぜなら、そのティアのドキュメント自体があなたの代わりにそれを検証してくれることは決してないのだから。

同じ但し書きは、古いティアについて述べるほうがより気軽だ。Ultrafast over GPT-5.6 Sol は2026年8月13日、限定プレビューで「Standard 処理より最大14倍高速」として発表されたが、3か月後もドキュメントには依然としてプレビュー アクセスと記されており、一方で Ultrafast の料金表に載っている行はちょうど2つ——GPT-6 Astra と GPT-6.1 Sol——だけだ。公開価格も一般提供もない14倍という数字は、製品ではなく主張である。そしてこれは、このティア階層のどれほど多くが依然として願望にすぎないかをよく思い知らせる。

$500のプランが実現しないなら

レイテンシ階層を試すために Pro $500 を購入するつもりのない人にとって有用なのは、発表が一括りにしていた2つの事柄を切り分けることだ。その階層は API ですべての API ユーザーが利用できるので、高速レーンはサブスクリプションなしで購入できる — 100万トークンあたり $12.00 と $60.00、独自のレート制限枠を持ち、測定できるほど小さいワークロードで。まずはそこで、自分のプロンプトを使って、標準レーンと比較しながら試すのがよい。

標準レーンとは、こうしたものを一切必要とせずに存在するレーンのことです。OrcaRouter は GPT-6.1 Sol を openai/gpt-6.1-solOpenAI 自身の定価 —— 入力トークン100万あたり $2.00、出力トークン100万あたり $10.00 —— で提供しており、マークアップは 0%、プロバイダーの価格をそのまま透過させるため、ベンダーの価格改定は同日中に当社側にも反映されます。Ultrafast は当社が販売するものではありません。それはお客様自身の OpenAI アカウントで課金されるサービスティアのフラグであり、モデルページにそうでないかのような印象を与えるよりも、はっきりとそう伝えたいと考えています。1 つのキーで得られるのは、標準レーンとカタログのその他のモデル —— 1 つの OpenAI 互換エンドポイントの背後に 200 以上のモデル —— をルーティングする能力、そしてあるプロバイダーが劣化したときにプロバイダー間で自動的にフェイルオーバーする能力です。これは、本番経路の前にレイテンシティアを置こうとしているなら、利用できる中で最も安価な保険となります。

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

そして、あなたがPlusまたはTeamを使っていて、探していた答えが「これをオンにするだけでいいの?」というものなら、答えはノーです。ただし、具体的な条件があります。CodexとChatGPT Workは、$500のPro、または対象となるEnterpriseプランかEduプランで利用でき、Enterpriseの場合は管理者が有効化する必要があります。それ以外はすべてAPI経由でUltrafastに到達し、トークン単位で支払うことになります。

次に見るもの

この展開をゲート付きのものから通常のものへと変える3つの要素があり、しかもその3つはいずれも観測可能だ。GPT-6.1 Sol 向けの Ultrafast レート制限が公開されれば、請求より先にそのティア自体の上限が効くのかどうかという推測が終わる。モデル固有の速度測定——あるいは独立した測定——があれば、借用した Astra の数値を、Sol ティアを評価できる何かに置き換えられる。そして Ultrafast が ChatGPT Plus に到達すれば、容量の計算が変わったということであり、それはゲートがそのティアの恒久的な形ではなく、ローンチ時の希少性だったというシグナルだ。

それまでは、正直な要約は限定的で検証可能だ。GPT-6.1 Solは2026年9月29日にリリースされ、変更はない。2026年10月8日、それは実際の価格を伴うファストレーンを手に入れ、APIユーザーに開放され、ChatGPTでは$500プランの背後にゲートされた——これは3番目ではなく最初の投稿に値する詳細であり、ほとんどの読者にとって、これが明細の一行なのか発注書なのかを決めるものだ。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新