エディトリアル用フラットベクターイラスト。テクノロジーブログのヒーロー画像向けの超高速AI推論をテーマにした作品:明るい背景の上に、柔らかなシアンのグローを放つ濃い青色の角丸モデルチップ、その隣に様式化された稲妻と針が最大を指すスピードメーター、モーションラインを伴う水平のスピードライン上を高速で流れるトークンストリーム、そして小さなストップウォッチ。白い背景に柔らかな青とシアンのグラデーションアクセントと、1つの控えめな暖色系ハイライト。ミニマルなフラットラインアイコン。クリーンでモダンな幾何学的サンセリフ書体。読み取り可能なテキスト、文字、単語、透かし、サードパーティ製ロゴなし。16:9の構図。
Guides & Insights

GPT-5.6 Sol Ultrafast:Ultrafastは標準価格の6倍で提供開始、しかしこのモデルは依然プレビュー版のみ

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

このティアの待ち時間は終わったが、このモデルのそれは終わっていない。2026年9月29日のDevDayで、ベンダーはUltrafastを購入できるものに変えた。月額500ドルの新しいChatGPT Pro 500プランにこれが同梱され、APIは標準料金の6倍となるUltrafastの料金表を公開した——GPT-6 Astraで100万トークンあたり入力60.00ドル/出力300.00ドル——そしてベンダーのCodexドキュメントは、Proティアには5時間の使用制限がまったくなく、その制限はPlusに適用されることを確認している。これらはすべてベンダーの説明であり、ベンダー自身のDevDayまとめ、ヘルプページ、開発者ドキュメントに掲載されている。動いていないのは、このページが扱っているモデルだ。GPT-5.6 Sol Ultrafast2026年8月13日に、Cerebrasによる高速化サービングティアの対象として発表されたGPT-5.6 Solは、標準比最大14倍のスループットと毎秒750出力トークンを実現するが、依然としてプレビューアクセス限定——ベンダーのアカウントチームを通じて手配される——であり、独自の価格は今も公表されていない。ティアは出荷された。Sol版はまだ待っている。

最初にこれを記事にした以降、2つの価格変動が明らかになり、それらは相反する方向を指している。土台となるモデルは安くなった。標準の GPT-5.6 Sol は現在、入力100万トークンあたり $4.00、出力100万トークンあたり $20.00 で請求される——OpenAI のプロモーション料金で、ベンダーによれば少なくとも2026年11月21日までは利用可能だ——8月時点で適用されていた $5.00 / $30.00 ではない。その上に載る高速枠には初めて価格が設定され、しかも安くはない。GPT-6 Astra の Ultrafast は100万トークンあたり $60.00 / $300.00 で請求される。本稿のすべての数値は、2026年9月30日時点で OpenAI が公開している料金表、API リファレンス、Codex の価格ドキュメントに対して再確認した。

Ultrafastモードの正体

Ultrafastは提供ティアであり、新しいモデルではない。OpenAIは2026年8月13日、2026年1月にチップメーカーCerebrasと締結したコンピュート提携の最初の製品としてこれを発表した——この契約は3年間でおよそ100億ドルと報じられている。標準のGPT-5.6 Sol推論はGPUクラスタ上で実行され、その時間の大半をメモリと演算の間で重みを移動させることに費やすのに対し、Ultrafastはモデルの重みをCerebrasのウェハスケールチップ上の44 GBのオンチップSRAMに読み込む。Solほどの規模のモデルは複数のウェハに層状にまたがるため、重みは演算が行われる場所に置かれる。その結果、スループットの上限はメモリ帯域幅ではなくシリコンによって決まる。

ハードウェアを取り巻く状況は、2026年8月18日に前進した。Supernovaイベントで、CerebrasはNexusプラットフォームを基盤とする次世代ラックスケールシステム「CS-4」を発表した。1ラックあたり3つのWafer-Scale Engineチップを搭載し、トークン生成速度は従来のCS-3の最大2倍。Cerebrasによると、10兆パラメータ超のモデルで毎秒1,000トークン以上を実現するという。これらは、まだ一般提供されておらず早期アクセス段階にあるシステムに対するCerebrasの主張である。発表以来、X上の単一の投稿が、CS-4はすでにGPT-5.6 Solを毎秒約1,300トークンで提供していると主張している。方向性はCerebras自身の数値と一致するが、これまでのところ誰も確認していない。これは初期のシグナルとして扱うべきだ。もっともらしいが未検証であり、これに基づいてキャパシティを計画する前に再確認する価値がある。

あなたのコードに関係する重要な点:モデルID、重み、推論動作、出力はすべて標準のGPT-5.6 Solと同一です。OpenAIはUltrafastを品質の階層ではなく「1秒あたりの有用な作業量」と位置づけており、プレビュー版は完全なフラッグシップモデルを実行します。速度は、より安価なモデルへの差し替えによるものではありません。変わるのは、トークンが出力される速さだけです。

Ultrafast と fast mode を混同しないでください。fast mode は標準ハードウェア上で購入できる別個のティアで、出力速度は最大約2.5倍、トークンあたりの料金は2倍、品質は変わりません。2026年7月30日に Priority Processing から名称が変更され、GPT-5.6 Sol では100万トークンあたり入力 $8.00 / 出力 $40.00 です。Ultrafast は別物です。Cerebras のハードウェアを使用し、GPT-5.6 Sol で最大14倍、GPT-6 Astra で最大8倍の速度が出て、料金は Astra では標準料金の6倍、Sol ではまだ価格が設定されていません。現在、この2つの名称は同じモデルピッカー内に並んでおり、これが今回のリリースで最も紛らわしい点であり続けています。

どれだけ速いか — 重要な数字

Speed card titled 'GPT-5.6 Sol Ultrafast — how fast', sourced to the OpenAI announcement of 2026-08-13 with all speed figures vendor-reported. Three highlight cells read Up to 14x max speedup vs standard, 750 output tokens per second max, and 11h 11m for 2,500 HLE questions. Rows list standard GPT-5.6 Sol as the 1x baseline, fast mode up to ~2.5x at 2x price, Claude Fable 5 on the same HLE set at 78h 27m, GDP-Val end-to-end at 5.6x faster, and 'same model, same quality — hardware only'. Footer: 14x is a maximum, not a guarantee, and none of the speed figures are independently verified yet.

見出しの数字は14×だが、それには定義が必要だ。OpenAIによれば、Ultrafastは標準のGPT-5.6 Sol処理と比較して、毎秒最大750出力トークンを生成する。これは出力トークンのスループット数値であり、「すべてが14倍速く動作する」という一律の主張ではない。エンドツーエンドのリクエスト時間には入力処理とモデル自身の推論も含まれるため、14×は最大値として表示されているのである。

• 最大出力スループット — 毎秒最大750出力トークン(OpenAIの発表〈2026-08-13〉による)。

• 標準処理と比較して — 同じ発表によると最大14倍高速。実際の向上幅は入力の長さやタスクの種類によって異なります。

• Humanity's Last Exam の2,500問 — OpenAI/Cerebras の報告によると、GPT-5.6 Sol Ultrafast は11時間11分で完了したのに対し、Claude Fable 5 は78時間27分かかったとされ、精度は同程度。ベンダーによる自己報告であり、しかも比較は2社のハードウェア構成をまたいでいる — これは方向性を示すものとして読み取るべきで、最終的な判定と見なすべきではない。

• GDP-Val、エンドツーエンド — Cerebrasは総合的に5.6倍高速で、測定可能な品質低下はないと報告している。これもベンダーによる報告だ。

• Fast mode と Ultrafast の比較 — Fast mode は出力速度が最大で約2.5倍、価格は2倍の割増、上限は標準料金と同じ約272Kトークンの境界に制限されます。Ultrafast はさらに大きな飛躍です。8月の発表によれば GPT-5.6 Sol で14倍、OpenAI の現行ドキュメントによれば Codex の GPT-6 Astra で最大8倍で、提供開始時のカバレッジでは毎秒最大300出力トークンになります。

• CS-4、次のハードウェア — Cerebrasは、CS-4ラックが10兆パラメータ超のモデルで毎秒1,000トークン以上を生成し、CS-3のトークン生成速度の最大2倍に達すると主張している。未検証のコミュニティレポートでは、CS-4上のGPT-5.6 Solが毎秒約1,300トークンを記録したとされており、同じ方向性を示すが、OpenAIやCerebrasによる確認はまだされていない。

14×を引用する前に、一つ注意点があります。それは、あるベンダーのハードウェアにおける出力スループットの上限であり、8月のローンチに関する独立した比較では、ワークロードのどの部分を測定したかによって、おおむね7×から11×の範囲でした。同じ慎重さはCS-4の速度シグナルにも当てはまります。CS-4上のGPT-5.6 Solについての約1,300トークン/秒という数値は、1件のX投稿から始まったもので、OpenAIもCerebrasもそれを確認していません。これらはすべて、ベンチマークの判定ではなく、ベンダーおよびコミュニティの主張として扱ってください。

Ultrafastの現在のコスト——そして、それが依然としてSolを価格に反映しない理由

Price card titled 'What GPT-5.6 Sol costs today — 2026-08-18', listing published input/output rates per 1M tokens. Three highlight cells read Standard $5.00 / $30.00, Fast mode $10.00 / $60.00, and Ultrafast price TBD in preview. Rows list prompt cache read $0.50, cache write $6.25, long-context over ~272K $10.00 / $45.00, batch API $2.50 / $15.00, and context window ~1.05M with 128K max output. Footer: Ultrafast has no published price as of 2026-08-18 — standard and fast mode are what you can buy today.

2026-09-30時点の価格問題の状況を、率直に記す。Ultrafastには公表された料率がある——GPT-6 Astra向けであり、GPT-6 Astraのみ向けだ。OpenAIの料金ページには現在、Standard、Batch、Flex、Fastと並んでUltrafast列があり、短いコンテキストでは100万トークンあたり入力$60.00 / キャッシュ入力$6.00 / キャッシュ書き込み$75.00 / 出力$300.00、およそ272Kトークンを超えると$120.00 / $12.00 / $150.00 / $450.00に倍増する。これは標準のAstra料率の6倍であり、fastモードが2倍であるのに対して——そして、OpenAIがこのティアに示した初の具体的な数字だ。上のカードは当社自身の2026-08-18スナップショットであり、そのドル金額は二重に置き換えられている。標準料率の引き下げによって、そして今度はこのUltrafast行によって。その表から依然として欠けているのは、GPT-5.6 Sol向けのUltrafast料率だ。Ultrafast列に挙がっているモデルは正確に1つ、gpt-6-astraだけである。このティアには価格が付いているが、このモデルには付いていない。

本日価格設定できるもの、モデルごとに:

• Standard GPT-5.6 Sol — 約272Kトークンまでのプロンプトで、100万トークンあたり入力$4.00 / 出力$20.00。OpenAIはこれを、少なくとも2026年11月21日まで利用可能なプロモーション価格として掲載しています。これが今すぐ呼び出せるベースラインです。

• 高速モード — GPT-5.6 Sol での短コンテキストでは $8.00 / $40.00、およそ 272K トークンを超えると $16.00 / $60.00 に倍増します。標準料金の 2 倍で、出力速度は最大約 2.5 倍、しかも Sol では実際に購入できる中で依然として最速です。

• プロンプトキャッシュ — キャッシュ読み取りは100万トークンあたり$0.40で請求されます(新規入力より90%割引)。キャッシュ書き込みは100万トークンあたり$5.00で請求されます。

• 長コンテキスト階層 — およそ272Kトークンを超える入力は、標準処理で$8.00 / $30.00で課金され、モデルの約1.05Mトークンのウィンドウおよび128Kトークンの最大出力の範囲内です。

• Batch API — ショートコンテキストは $2.00 / $10.00、ロングコンテキストは $4.00 / $15.00、一律50%オフで、ターンアラウンドタイムは約24時間です。

GPT-5.6 Solについて言えば、Astraの数字は入手可能な最良の手がかりであり、それ以上のものではない。OpenAIはUltrafastを基盤モデルの標準料金の6倍で価格設定している。その倍率をSolの$4 / $20に当てはめると、100万あたり$24 / $120になる。それは算術であって、公表された価格ではない — OpenAIはSol Ultrafastの料金について何も述べておらず、8月のプレビューコホートはそもそも階層レートで請求されていなかった。ベンダーがその行を公開するまでは、標準Solの$4 / $20または高速モードの$8 / $40を前提に計画してください。

使い方 — Astraでは広く利用可能、Solではまだリクエストが必要

9月29日にアクセスは二つに分かれ、その分割はこのページが扱うモデルに不利に働いている。Ultrafastは現在、GPT-6 Astraで広く利用可能だ。OpenAIのAPIドキュメントによれば、低いレート制限のもとですべてのAPIユーザーに開放されており、利用枠ティア1~3では毎分50万トークン、ティア4では100万、ティア5では500万となっている。また、新しいPro 500プラン、および対象となるEnterpriseプランとEduプランでChatGPT WorkとCodex内に搭載されており、そこではワークスペース所有者が有効化する必要があり、米国外での推論を必要とするワークスペースではサポートされていない。GPT-5.6 Sol Ultrafastはそれに追随しなかった。同じドキュメントは今も、OpenAIアカウントチームを通じたプレビューアクセスとして説明しており、APIスキーマ内のそのパラメータ自身の説明も依然として「currently available for gpt-5.6-sol」と書かれている——この記述は今やドキュメント全体を先導するどころか、後れを取っている。今日このティアを使いたいなら、Astraで使うべきだ。

インターフェースに関する疑問も決着した。TestingCatalogは2026年9月26日、Standard、Fast、Ultrafastを提供する速度セレクターがResponses API Playgroundで未公開のまま存在していると報じた。その3日後、OpenAIはまさにそのコンシューマー向けバージョンを出荷し、UltrafastはChatGPT WorkとPro 500上のCodexのモデルピッカーで選択肢になった。私たちはその目撃情報を、未公開UIに対するある出版物の解釈として取り上げ、OpenAIはいずれも確認していないと述べた。それは方向性としては正しく、それが示していたロールアウトはDevDayの後ではなくDevDayに到着した。

OpenAIが8月に挙げたプレビューコホートは、コーディング、コマース、金融リサーチ、サポート、その他のインタラクティブなワークロードでした——エージェントが1リクエストあたり多数の呼び出しを行い、応答レイテンシがボトルネックとなるチームです。Jane Street、Rogo、Podiumは、名指しされた早期テスターに含まれていました。ワークロードがシングルターンのチャットであれば、スピードティアの重要度は、40回呼び出しのエージェントループの場合よりずっと低くなります。実務上の答えは今や、どのモデルについて尋ねているかによって変わります。GPT-6 Astraでは今日の午後に service_tier: "ultrafast" を設定できますが、GPT-5.6 Solではまだ設定できません。

今日できること — 実践的な答え

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol Ultrafastがプレビューの扉の向こうにとどまる一方、両フラッグシップモデルはOrcaRouterでプロバイダー料金、トークンあたり$0のマークアップで利用可能です — モデルID openai/gpt-5.6-sol(OpenAI互換エンドポイント api.orcarouter.ai/v1 経由)、そしてその隣にはGPT-6 Astraが標準の$10.00 / $50.00で並んでいます。これはOpenAIが今やUltrafastティアを上に載せたモデルであり、当社はそのティアではルーティングしていません。以下のキャプチャは2026年8月のもので、当時の$5.00 / $30.00のラインを今も示しています。今日のSol料金は$4.00 / $20.00で、これが当社がパススルーしている料金です。このパススルーにより、ベンダーの価格変更が同日中に当社側へ届きます。$4.00入力 / $20.00出力、OpenAIが公表しているのと同じ数字で、トークンあたりのマークアップは上乗せされません。すでにOpenAIクライアントをお持ちなら、移行はベースURLとモデルIDの変更だけです。それ以外は何もありません。同じキーと同じエンドポイントで200以上のモデルを利用できます。つまりSolは自身の兄弟モデルたち — GPT-5.6 Terraは$2.00 / $12.00、GPT-5.6 Lunaは$0.20 / $1.20 — や、比較対象となるオープンウェイトモデルたちの隣に位置し、それぞれを再統合する代わりに難易度でルーティングできます。

スピードのページで触れておく価値のあるOrcaRouter固有の点が2つあります。BYOK:自分のOpenAIキーを持ち込み、OpenAIが自社の料金で直接請求します——OrcaRouterはトークンあたり0ドルを上乗せし、プロバイダーのレート制限とクレジットをそのまま維持します。ガードレール:PII Shieldとコンテンツポリシーは課金前に実行されるため、ブロックされたリクエストはクリーンな400を返し、決して課金されず、Agent Firewallはツール呼び出しとMCP呼び出しを実行前に評価します。Ultrafast自体はGPT-6 Astraで広く利用できますが、ルーティング可能な条件では提供されておらず、Sol向けでもありません——これは標準料金の6倍で請求されるアクセス制御された階層であり、当社はそれを提供していません。もしOpenAIが将来それを標準条件で提供するなら、同じエンドポイントにつなぐのはモデルIDの変更だけです。今日構築した設定はそのまま引き継がれます。

正直な境界線 — Ultrafastが答えではないとき

その半分に決着がついた今となっては、スピードの話が依然として通用しない5つの場面:

「利用可能」は「あなたにとって利用可能」と同じではない。UltrafastはGPT-6 Astraで全APIユーザーに開放されたが、低いレート制限での開放であり、OpenAIのスキーマでは依然としてアクセス制御下にあると記載されており、EUやその他の米国外リージョンでの処理には対応しておらず、Enterpriseワークスペースではオーナーが有効にするまでオフになっている。GPT-5.6 Solでは何も開放されなかった。どちらを前提に設計するにしても、まず自分のアクセスを確認してください。

14× は上限であり、保証ではありません。これは Cerebras ハードウェアにおける出力スループットの天井です。エンドツーエンドのレイテンシには依然として、入力処理、モデルの推論時間、そしてあなた自身のネットワークが含まれます。推論を多く要するプロンプトでは、実時間の大半が思考に費やされることがあり、その場合、見出しに掲げられた高速化は小さくなります。

一方のモデルには価格があり、もう一方にはありません。Astra Ultrafastの料金は公表されています——標準の6倍——そして、GPT-5.6 SolのUltrafast行はどこにもありません。予算は標準Solの$4 / $20、または高速モードの$8 / $40を基準にし、目にする「GPT-5.6 Sol Ultrafastのコスト」の数字は、上記の$24 / $120の外挿を含め、料金表ではなく計算上の数字として扱ってください。

ベンチマークはベンダー報告によるものです。11時間のHLE実行と5.6倍のGDP-Val値は、8月の発表で示されたOpenAI/Cerebrasの数値です。速度向上に関する独立した推定値は、何を測定するかによって約7倍から11倍の範囲にわたります。そのリストにCS-4のシグナルも加えてください。CS-4上のGPT-5.6 Solに関する約1,300トークン/秒という数値は、単一のX投稿に由来し、独立した確認はありません。新しいAstra Ultrafastの数値 — Codexで8倍、価格は6倍 — もまたOpenAI自身によるものです。

そして時間ではなくコストがかかる方の欠点:存在しないボトルネックは解消されない。エージェントが遅い原因が自前のオーケストレーション、ツールのレイテンシー、入力の重いプロンプトにあるなら、出力経路を速くしてもテールが動くのはごくわずかだ。ティアの選択——GPT-5.6 Sol の $4 / $20 対 GPT-5.6 Terra の $2 / $12 対 GPT-5.6 Luna の $0.20 / $1.20——は、どの速度ティアよりも依然として請求額を大きく左右する。

結論から言うと。Ultrafastは、もう読んで知るだけのウェイトリスト枠ではありません。2026年9月29日時点で、OpenAIはこれを販売しています。WorkとCodexでは500ドルのChatGPT Pro 500プランに含まれ、GPT-6 Astra上の全APIユーザーが低いレート制限で利用でき、価格は標準レートの6倍——ショートコンテキスト100万トークンあたり60ドル/300ドルです。GPT-5.6 Sol Ultrafastは、このページが中心に据えていた8月のプレビューのまま動いていません。依然としてアクセス制御下にあり、APIスキーマでもgpt-5.6-solに限定され、価格も未設定のままで、CerebrasのCS-4上でSolについて報告された約1,300トークン/秒という数値も、依然として検証されていないXの投稿1件にすぎません。標準のGPT-5.6 Solは4ドル/20ドルで、OrcaRouterならマークアップ0ドルで今日呼び出せます。GPT-6 Astraは10ドル/50ドルで、Ultrafastの行を手に入れたモデルを呼び出したいならこちらです。

GPT-6 AstraではUltrafastが実際にお金のかかるものになりました — 標準の6倍、または500ドルのPro 500プランにバンドル — 一方、GPT-5.6 Sol Ultrafastはプレビューのままです。完全版のGPT-5.6 SolはOrcaRouterで公開中、100万トークンあたり$4 / $20、マークアップなし、ご自身のキーですぐに利用できます。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新