エディトリアル用フラットベクターイラスト。テクノロジーブログのヒーロー画像向けの超高速AI推論をテーマにした作品:明るい背景の上に、柔らかなシアンのグローを放つ濃い青色の角丸モデルチップ、その隣に様式化された稲妻と針が最大を指すスピードメーター、モーションラインを伴う水平のスピードライン上を高速で流れるトークンストリーム、そして小さなストップウォッチ。白い背景に柔らかな青とシアンのグラデーションアクセントと、1つの控えめな暖色系ハイライト。ミニマルなフラットラインアイコン。クリーンでモダンな幾何学的サンセリフ書体。読み取り可能なテキスト、文字、単語、透かし、サードパーティ製ロゴなし。16:9の構図。
Guides & Insights

GPT-5.6 Sol Ultrafast:14倍の速度、750 Tok/s — CS-4は約1,300と報じられ、価格は未定

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

GPT-5.6 Sol Ultrafast modeは、フラッグシップ向けのハードウェアアクセラレーション対応サービング層です。GPUクラスターの代わりにCerebrasのウェハースケールチップ上で実行される完全なGPT-5.6 Solモデルそのものを使用し、OpenAIが8月に発表したこの層では、標準処理の最大14倍の速度と毎秒最大750出力トークンを実現します。2026-08-18には、Cerebrasがこの層の拡張先となる次世代CS-4システムを発表し、検証されていない初期のレポートによると、CS-4上のGPT-5.6 Solはすでに毎秒約1,300トークンを処理しているとのことです。これは小型化されたモデルでも蒸留でもなく、ハードウェアとスケジューリングが変更されただけで、知能は維持されています。まだ決まっていないのは価格です。2026-08-19時点で、Ultrafastは料金表が公開されていない限定APIプレビューであり、現在実際に予算を組めるのは、公開中のGPT-5.6 Solモデルページの標準層、すなわち入力100万トークンあたり5ドル、出力100万トークンあたり30ドル(マークアップなしのそのままの価格)です。この記事では、このモードの概要、性能数値が実際にどれほど速いか(新しいCS-4ハードウェアとまだ検証されていないものを含む)、コスト(正直な「まだ価格なし」という回答を含む)、そして一般提供開始までの間に何をすべきかを説明します。

Ultrafastモードの正体

Ultrafastはサービング層であり、新しいモデルではありません。OpenAIは2026年8月13日、チップメーカーCerebrasとの2026年1月のコンピューティング提携の最初の成果としてこれを発表しました。この提携は3年間で約100億ドルと報じられています。標準のGPT-5.6 Sol推論はGPUクラスター上で動作し、重みをメモリと計算ユニット間で移動させることに多くの時間を費やしますが、Ultrafastはモデルの重みをCerebrasのウェハースケールチップ上の44GBのオンチップSRAMに読み込みます。Solサイズのモデルは複数のウェハーに層状に広がるため、重みは計算が行われる場所に配置されます。その結果、スループットの上限はメモリ帯域幅ではなくシリコンによって決まります。

ハードウェアを取り巻く状況は、2026年8月18日に前進した。Supernovaイベントで、CerebrasはNexusプラットフォームを基盤とする次世代ラックスケールシステム「CS-4」を発表した。1ラックあたり3つのWafer-Scale Engineチップを搭載し、トークン生成速度は従来のCS-3の最大2倍。Cerebrasによると、10兆パラメータ超のモデルで毎秒1,000トークン以上を実現するという。これらは、まだ一般提供されておらず早期アクセス段階にあるシステムに対するCerebrasの主張である。発表以来、X上の単一の投稿が、CS-4はすでにGPT-5.6 Solを毎秒約1,300トークンで提供していると主張している。方向性はCerebras自身の数値と一致するが、これまでのところ誰も確認していない。これは初期のシグナルとして扱うべきだ。もっともらしいが未検証であり、これに基づいてキャパシティを計画する前に再確認する価値がある。

あなたのコードに関係する重要な点:モデルID、重み、推論動作、出力はすべて標準のGPT-5.6 Solと同一です。OpenAIはUltrafastを品質の階層ではなく「1秒あたりの有用な作業量」と位置づけており、プレビュー版は完全なフラッグシップモデルを実行します。速度は、より安価なモデルへの差し替えによるものではありません。変わるのは、トークンが出力される速さだけです。

Ultrafastを既存のfast modeと混同しないでください。fast modeは、標準ハードウェア上の別途購入可能なティアで、最大でおおよそ2.5倍の出力速度を持ち、トークンあたり2倍の割増料金(100万トークンあたり入力$10 / 出力$60)がかかり、品質の変化はありません。Ultrafastは別物です。Cerebrasハードウェアを使用し、最大14倍、そして今のところ価格は一切ありません。

どれだけ速いか — 重要な数字

Speed card titled 'GPT-5.6 Sol Ultrafast — how fast', sourced to the OpenAI announcement of 2026-08-13 with all speed figures vendor-reported. Three highlight cells read Up to 14x max speedup vs standard, 750 output tokens per second max, and 11h 11m for 2,500 HLE questions. Rows list standard GPT-5.6 Sol as the 1x baseline, fast mode up to ~2.5x at 2x price, Claude Fable 5 on the same HLE set at 78h 27m, GDP-Val end-to-end at 5.6x faster, and 'same model, same quality — hardware only'. Footer: 14x is a maximum, not a guarantee, and none of the speed figures are independently verified yet.

見出しの数字は14×だが、それには定義が必要だ。OpenAIによれば、Ultrafastは標準のGPT-5.6 Sol処理と比較して、毎秒最大750出力トークンを生成する。これは出力トークンのスループット数値であり、「すべてが14倍速く動作する」という一律の主張ではない。エンドツーエンドのリクエスト時間には入力処理とモデル自身の推論も含まれるため、14×は最大値として表示されているのである。

最大出力スループット — OpenAIの発表(2026-08-13)によると、最大で毎秒750出力トークン。

標準処理との比較 — 同発表によると最大14倍高速。実際の向上幅は入力の長さやタスクの種類によって異なります。

Humanity's Last Exam、2,500問 — OpenAI/Cerebrasによると、GPT-5.6 Sol Ultrafastは11時間11分で完了し、Claude Fable 5の78時間27分と比較して同等の精度だという。ベンダー報告であり、比較は2社のハードウェアスタックにまたがるものであるため、方向性を示すものとして捉え、断定とはしないでほしい。

GDP-Val、エンドツーエンド — Cerebrasは、品質の測定可能な損失なしで全体で5.6倍高速であると報告しています。また、ベンダー報告でもあります。

高速モードの基準 — 既存の購入可能な速度段階は、2倍の価格プレミアムで約2.5倍の出力速度が上限です。

• CS-4、次のハードウェア — Cerebrasは、CS-4ラックが10兆パラメータ超のモデルで毎秒1,000トークン以上を生成し、CS-3のトークン生成速度の最大2倍に達すると主張している。未検証のコミュニティレポートでは、CS-4上のGPT-5.6 Solが毎秒約1,300トークンを記録したとされており、同じ方向性を示すが、OpenAIやCerebrasによる確認はまだされていない。

「14倍」という数字を引用する前に、一つ注意点があります。発売に関する独立系の報道は、Claude Fable 5との比較で約11倍の生成速度を挙げていますが、Cerebras自身の数字は、同じ実行における総テスト時間が約7倍であることを示唆しています。この差は、ワークロードのどの部分を測定するかによります。同じ慎重さがCS-4の速度シグナルにも当てはまります。約1,300トークン/秒という数字は、1つのX投稿から始まったものであり、OpenAIもCerebrasも確認していません。これらはすべて、ベンダーまたはコミュニティが今週発表した数字であり、どれもまだ独立に検証されていません。これらを、ベンチマークの判定結果ではなく主張として扱うべきです。

かかる費用 — そして正直なギャップ

Price card titled 'What GPT-5.6 Sol costs today — 2026-08-18', listing published input/output rates per 1M tokens. Three highlight cells read Standard $5.00 / $30.00, Fast mode $10.00 / $60.00, and Ultrafast price TBD in preview. Rows list prompt cache read $0.50, cache write $6.25, long-context over ~272K $10.00 / $45.00, batch API $2.50 / $15.00, and context window ~1.05M with 128K max output. Footer: Ultrafast has no published price as of 2026-08-18 — standard and fast mode are what you can buy today.

2026年8月19日時点の価格に関する状況を率直に述べます:Ultrafastの公表価格は存在しません。OpenAIは価格を発表しておらず、プレビューは公開料金表にも載っていません。初期アクセス枠がバンドルされている、または無料であるという報道は憶測であり、方針ではありません。そしてOpenAIがこのティアの価格を設定するまで、他の場所で見つかる「GPT-5.6 Sol Ultrafast cost」という数字はすべて推測に過ぎません。

今日価格設定できるのは、GPT-5.6 Sol ラインの残りで、2026-08-18 に公開された OpenAI の料金に対して検証済みです:

Standard GPT-5.6 Sol — 入力 $5.00 / 出力 $30.00(1Mトークンあたり)。今すぐ呼び出せるベースラインモデルです。

Fast mode — $10.00 / $60.00、最大約2.5倍の出力速度に対して2倍の割増料金。実際に購入できる速度グレードに最も近いものです。

プロンプトキャッシュ読み取り — 1Mあたり$0.50(新規入力より90%オフ);キャッシュ書き込みは1Mあたり$6.25.

ロングコンテキスト層 — 約272Kトークンを超える入力は、$10.00 / $45.00で課金されます。

Batch API — $2.50 / $15.00、一律50%オフ、ターンアラウンドは約24時間です。

プレミアムの相場観を説明すると:fast modeは先例として、標準料金の2倍で2.5倍の速度を実現している。Ultrafastが同様のカーブを辿るなら、標準の$5/$30をはるかに上回る価格になるだろう。プレビューに関する解説もまさにそれを予想している。Cerebrasのウェハー容量は希少で高価だからだ。しかし、プレミアムが見込まれるからといって、それが価格であるとは限らない。料金表が公開されるまでは、標準のSolまたはfast modeを前提に計画を立てるべきだ。

使い方 — プレビューの現実

アクセスは2つ目の正直なギャップです。Ultrafastは、2026年8月13日に発表されたとおり、OpenAI APIを通じてウェイトリスト方式で選ばれた顧客グループに利用可能であり、OpenAIはアクセスが「容量の拡大に伴い」拡大すると述べています。一般提供の日付は未定です。発表されたプレビューコホートは、コーディング、コマース、金融リサーチ、サポート、その他のインタラクティブなワークロードです。これらのチームのエージェントは、リクエストごとに多数の呼び出しを行い、応答レイテンシがボトルネックとなっています。Jane Street、Rogo、Podiumは、名前が挙がっている初期テスターに含まれています。

この設計が想定する使用パターンは、インシデント対応(障害が発生している最中にログ・トレース・差分を読むこと)、動き続けるデータに対する金融調査や不正検知、リアルタイムのカスタマーサポートと音声(0.5秒の無音が故障と受け取られる)、Eコマースのチェックアウト、そして夜間の調査バッチを対話型セッションに圧縮することです。ワークロードがシングルターンのチャットであれば、14×の差は、40回呼び出すエージェントループの場合よりも重要性がはるかに低くなります。

今日できること — 実践的な答え

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

Ultrafastはプレビュー中ですが、完全版のGPT-5.6 Solは現在すぐに利用可能です。OrcaRouterでは、スタンダードティアがプロバイダー料金で提供され、トークンあたりのマークアップは$0です。モデルIDはopenai/gpt-5.6-solで、OpenAI互換エンドポイントapi.orcarouter.ai/v1からアクセスできます。既にOpenAIクライアントをお持ちの場合、移行はベースURLとモデルIDの変更だけです。他には何も必要ありません。同じキーとエンドポイントで200以上のモデルを利用できるため、SolはGPT-5.6 TerraGPT-5.6 LunaClaude Opus 5、そして比較対象となるオープンウェイトモデルと並んで利用できます。また、各モデルを個別に再統合する代わりに、難易度に応じてルーティングすることも可能です。

スピードページで特筆すべきOrcaRouterの機能が2つあります。BYOK:独自のOpenAIキーを持ち込み、OpenAIが独自のレートで直接請求します。OrcaRouterはトークンあたり$0を追加し、プロバイダーのレート制限とクレジットをそのまま維持します。Guardrails:PIIシールドとコンテンツポリシーは課金前に実行されるため、ブロックされたリクエストはクリーンな400を返し、課金されることはありません。また、Agent Firewallはツール呼び出しとMCP呼び出しを実行前に評価します。Ultrafastがルーティング可能な価格で一般提供(GA)に到達した場合(到達すればの話ですが)、同じエンドポイントへの接続はモデルIDの変更だけで済みます。今日構築したセットアップはそのまま引き継がれます。

正直な境界線 — Ultrafastが答えではないとき

14倍という話が成り立たない4つのポイントがある。だから、確定していない数字を前提にアーキテクチャを設計したり予算を組んだりしてはならない。

14倍は最大値であり、保証値ではありません。これはCerebrasハードウェアにおける出力スループットの上限です。エンドツーエンドのレイテンシには、入力処理、モデルの推論時間、お客様自身のネットワークが依然として含まれます。推論に重きを置いたプロンプトでは、実時間の大半を思考に費やす可能性があり、その場合、見出しとなる高速化効果は縮小します。

Ultrafastには価格もGA日もありません。2026-08-19時点では、Ultrafastを購入することはできません。プレビューアクセスのリクエストのみが可能で、その背後にあるCS-4ハードウェアは一般提供ではなく早期アクセス段階です。予算は標準Sol($5 / $30)または高速モード($10 / $60)を基準に計画し、オンラインで見かけるUltrafastの価格はすべて未検証として扱ってください。

ベンチマークはベンダー報告によるものです。11時間のHLE実行と5.6倍のGDP-Val値は、発表におけるOpenAI/Cerebrasの数値であり、独立した推定値は測定内容に応じておおよそ7倍から11倍の範囲です。そのリストにCS-4の速度シグナルを加えてください。CS-4上のGPT-5.6 Solの約1,300トークン/秒という数値は、単一のX投稿に由来しており、独立した確認はありません。これらのいずれも、まだ独立して検証されていません。

存在しないボトルネックを修正することはありません。 エージェントが遅い原因が、自社のオーケストレーション、ツールのレイテンシ、または入力過多のプロンプトにある場合、出力経路を高速化してもテールはわずかにしか改善されません。ティアの選定 — GPT-5.6 Sol($5 / $30)、GPT-5.6 Terra($2 / $12)、GPT-5.6 Luna($0.20 / $1.20)— は、どの速度ティアよりも請求額に大きく影響します。

結論。GPT-5.6 Sol Ultrafast は、{{1}}OpenAI が旗艦モデル向けにリリースした中で最速のサービングティアです{{/1}}——{{2}}Cerebras ハードウェア上の同じウェイトで、発表ティアではスループット最大14倍、毎秒750出力トークンを実現します{{/2}}。Cerebras の新しい CS-4({{3}}2026-08-18 発表{{/3}})は GPT-5.6 Sol を毎秒約1,300トークンに押し上げると報じられていますが、その数字は{{4}}ただ1件の未検証の X 投稿{{/4}}に基づくものです。2026-08-19 現在、Ultrafast は{{5}}公開価格のないウェイトリストプレビュー{{/5}}です。予算の基準となる数字を探しているなら、正直な答えは{{6}}まだありません{{/6}}。標準の GPT-5.6 Sol($5 / $30)は{{7}}今日利用できるもの{{/7}}です。高速モード($10 / $60)は{{8}}購入可能な速度層{{/8}}であり、OrcaRouter は{{9}}独自キーで $0 マークアップのまま両方を通過させます{{/9}}。今すぐルーティングを構築してください——Ultrafast に価格と日程が決まったとき、{{10}}モデルIDを1つ変更するだけで対応できます{{/10}}。

Ultrafast の価格が決まるまで、フル GPT-5.6 Sol はGPT-5.6 Sol on OrcaRouterで公開中です。100万トークンあたり $5 / $30、マークアップなし、ご自身のキーですぐに利用できます。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube