
GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed:2つの速度ティア、1つ欠けている価格
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 610 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 189 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
2社のベンダーが同じ製品アイデアを3週間違いでリリースし、その両者の違いこそ、それぞれが本当に売っているものを見る最良の方法だ。Xiaomi側は2026年9月22日に登場した。Xiaomi MiMo v2.6 Pro Ultraspeed は MiMo-V2.6-Pro と同じ1.02兆パラメータのチェックポイントで、より高速に提供され、入力トークン100万個あたり$4.35、出力100万個あたり$8.70。標準Proレーンの$0.44と$0.87に対してだ。そのベンダーのGPT-5.6 Sol Ultrafast は、GPT-5.6 Sol に同じ手法を適用したものだ。同一の重み、最大毎秒750出力トークン、標準ティアの最大14倍、Cerebrasのウェハースケールハードウェア上で動作し、8月13日にこのモードが発表されてから6週間経っても、価格はまったく公表されていない。
両者を並べてみれば、その異常性は即座に明らかになる。Xiaomiは、ほとんどのベンチマークを公表するより先に料金表を公表した。OpenAIはベンチマーク、ハードウェアパートナー、顧客名を公表した——それでも、予算を立てる基準となる数字はまだ公表していない。これらのティアのうち片方は今日購入できる。もう片方はAPIスキーマ内の値にすぎない。したがって両者を比較することは、どちらが速いかというよりも、一方のベンダーが価格を示し、もう一方が示していないとき、速度ティアにどれだけの価値があるかという問題なのである。
それぞれが実際に何なのか
どちらも新しいモデルではない。これは両者に共通する前提であり、はっきり言っておく価値がある。なぜなら、どちらの発表も、サービングの変更を能力のリリースとして扱う報道を集めたからだ。
MiMo v2.6 Pro Ultraspeedは、Xiaomiのフラッグシップのサービング構成だ。トークンあたり42Bが活性化される、同じ1.02TパラメータのスパースなMixture-of-Expertsチェックポイント、同じ1Mトークンのコンテキスト、テキスト・画像・動画・音声にわたる同じネイティブなマルチモーダル性、公開リポジトリ上の同じMITライセンスの重みを備えている。Xiaomi自身の資料は、同じ品質で標準のProサービス比最大20倍の出力速度を主張している。同日に同じモデルを扱った第三者カタログの記載では約10倍とされている。両者を整合させる測定結果は誰も公表していない。
GPT-5.6 Sol Ultrafastは、OpenAIの旗艦モデルのサービング構成である。同一のチェックポイント、同一の推論動作、同一の1,050,000トークンのコンテキストウィンドウ、同一の128K最大出力、同一の回答を備える。この高速化はスケジューリングではなくハードウェアによるものだ。モデルの重みは、GPUメモリと演算部の間で往復させるのではなく、Cerebrasのウェハスケールシリコン上のオンチップSRAMに配置されている。そしてこれは、2026年1月のOpenAIとCerebrasのコンピュート提携による最初の製品であり、3年間でおよそ100億ドルと報じられている。
つまり、比較における誠実な軸は知能ではない。それは、ベンダーが何を変えることを選んだのか、その変更にいくら請求したのか、そしてその変更のどこまでをあなたに検証させたのかである。

レートカード(空白のものを含む)
• MiMo v2.6 Pro Ultraspeed — 100万トークンあたり入力$4.35 / 出力$8.70、Xiaomiによる公開。
• MiMo-V2.6-Pro スタンダード — $0.44 / $0.87、Xiaomi の商用カタログに掲載。入力でおよそ 9.9 倍、出力でちょうど 10 倍。
• GPT-5.6 Sol Ultrafast — 2026年9月27日時点で公開された料金表はない。OpenAIの料金ページには依然として Standard、Batch、Flex、Fast の4つのタブがあり、このティアはその中に含まれていない。
• GPT-5.6 Sol standard — 100万トークンあたり$4.00 / $20.00。OpenAIの現在のプロモーション料金で、キャッシュ入力は$0.40、入力が約272Kトークンを超えるとロングコンテキスト段階で$8.00 / $30.00になります。
• OpenAIがこれまでに価格を設定した唯一の同等のプレミアム — ファストモードは$8.00 / $40.00で、標準料金のちょうど2倍、最大約2.5倍の出力速度を実現します。
その最後の行こそ、空欄が重要な理由のすべてだ。Xiaomiの速度ティアは標準レーンの10倍の料金で、10~20倍の速度をうたっており、少なくとも取引として内部的に筋が通っている。比例して多く支払う代わりに比例して待ち時間が減り、賭けているのはウォールクロック時間こそが商品だという点だ。OpenAIの速度ティアは、Fastモードよりも希少なシリコンに対する要求が大きい。したがって、最終的にいくらになるとしても、前例が示すのは割引ではなくプレミアムだ。しかし「前例はプレミアムを示す」は数字ではない。数字が存在するまでは、このティアをUltraSpeedと価格で比較することはまったくできない――比較できるのは、Xiaomiは自らの数字を明言しようとし、OpenAIはそうしなかったという事実だけだ。
数字はどこから来たのか
二つの層には正反対の証拠上の問題があり、折衷するよりも両方を明示する価値がある。
Xiaomiの速度に関する主張は、その大きさにおいて曖昧だが、公表された価格に紐づけられている。20倍はXiaomiが明示していない条件下でのベンダー側の上限であり、10倍はカタログ掲載が典型値として主張することをいとわなかった数値にすぎない。実際の倍率は、明示された同時実行レベルで誰も公には測定していない、広い幅のどこかにある。それに対して、価格は正確であり、重みはMITライセンスの下でダウンロード可能で、技術レポートと強化学習の訓練環境は公開されている——Xiaomiが何をしたのかは精査できるが、それがどれだけ速く動くのかはまだ検証できない。
OpenAIの速度主張は、その規模において具体的だが、購入できる何ものにも結び付いていない。最大毎秒750出力トークン、標準の最大14倍と、率直に述べられている。これはまた出力トークンのスループット値であり、一律のエンドツーエンド倍率ではない。入力処理とモデル自身の推論はその比率では圧縮されないため、同社はこれを最大値と位置付けている。裏付けとなるベンチマークはベンダー報告で、1件はベンダー横断的だ——2,500問のHumanity's Last Examの実行は、Claude Fable 5の78時間27分に対し11時間11分で完了したと報告され、精度は同程度だった。この発表に関する独立報道は、同じ実行についてより控えめな約11倍という生成速度比較を引用した一方、Cerebras自身の数字はテスト総時間について約7倍を示唆している。三者、一つのワークロードの三つの断片、そのいずれにも第三者による再現はない。Cerebrasは別途、GDP-Valで測定可能な品質低下なしにエンドツーエンドで5.6倍を報告しているが、これも再現されていない。
どちらの数値もベンダーによる公称値だ。違いは、Xiaomiの曖昧さは速度についてのもので、OpenAIのそれはコストについてのものだという点にあり、予算を立てる人にとっては、コストのほうが推測しにくい。

今週何が起きたのか、そしてそれがなぜその隔たりを埋めないのか
この比較にそもそもニュースとしての取っ掛かりがあるのは、発表ではなく1つのコミットのためだ。ultrafastの値は2026年8月13日から、OpenAIの公開openai-openapiスキーマに存在していた——モードが発表されたのと同じ日で——その説明ではgpt-5.6-solに限定され、アクセス制御されているとされている。今週動いたコミットはそれより後で、より小さい。2026年9月25日、fe4f7a1がultrafastをさらに2つの列挙に追加した——リクエストレベルのservice-tierパラメータと、エージェントのservice-tierポリシーフィールドだ。そのコミット以前、これら2つのリストはauto、default、flex、priority、fastだった。その後には「Uses the ultrafast service tier.」と説明されたエントリがある。ultrafastをservice_tier列挙(その公開openai-openapi仕様に記載)に追加した——スキーマが「モデルリクエストに使用されるサービスティア」と説明するフィールドであり、エージェントに付随するポリシーフィールドでもある。変更前、そのリストはdefault、flex、priority、fastだった。変更後には「Uses the ultrafast service tier.」と説明されたエントリがある。
この区別は、この報道を読む誰にとっても重要だ。作成されつつあるティアではなく、エージェントが設定されるフィールドに組み込まれるティアであり、つまり最終的には新しいエンドポイントなしで、それに対応するクライアントを書けるようになる。翌日の報道では、Responses API Playground に Fast / Standard / Ultrafast のセレクターが登場し、OpenAI の DevDay カンファレンス後にアクセスが拡大すると見込まれていると述べられている。私たちはそのセレクターを見ておらず、OpenAI もロールアウトに関する注記を公開していないため、その部分は単一情報源である。確認できるのは、追加されたスキーマ項目と、発表から6週間後も料金表が依然として存在しないことだ。
一方、Xiaomiのティアは購入可能になってから5日が経ち、それでも2つのうち請求書に載せられる唯一のものだ。これ自体の未解決の問いは別にある。10倍のプレミアムが維持されるのか、それとも新しいプレミアムティアにおける大半のローンチ価格と同じように振る舞い、ローンチ時の報道が止むと標準レーンへと流れていくのか。Standard Proの$0.44 / $0.87がアンカーであり、アンカーの10倍で始まるティアがそこに落ち着くことはめったにない。
おそらくあなたにはできないでしょうから、それらの中から選ぶこと
不都合な現実は、ほとんどの読者にとってこれは、購入できない一方のティアと、定価ではおそらく買うべきではないもう一方のティアとの比較だという点です。GPT-5.6 Sol Ultrafastは一部の選ばれた顧客向けのウェイトリスト制プレビューであり、キャパシティの拡大に伴って対象を広げていますが、一般提供の期日も価格もありません。MiMo v2.6 Pro Ultraspeedは入手可能で高価であり、特定のタイプの購入者向けに作られています。
ワークロードテストは両者で同じで、プロンプトのサイズではなくリクエストグラフの形に関するものです。単一の長い生成で得られる利得は、見出しの倍率にははるかに及びません。入力処理と推論は同じ比率では高速化しないからです。ユーザーから見える1つの操作の背後にある40ステップのエージェントループでは、満額にはるかに近い利得が得られます。各ラウンドトリップは、人がその間ずっと待たされているレイテンシだからです。あなたのトラフィックが2つ目の形に似ているなら、両方のティアはあなた向けです。1つ目の形に似ているなら、どちらのモデルでも標準レーンが常に正しい選択であり、$0.44 / $0.87の標準MiMo-V2.6-Proレーンは、世界のどこでも1兆パラメータ級モデルを呼び出すための最も安価な方法の1つです。
どちらのティアも変えないのは、あなたが買っているのは品質ではなくレイテンシだということだ。UltraSpeed または Ultrafast を、同一のプロンプトでそれぞれの標準レーンとベンチマークして異なる回答が得られたなら、それは機能ではなく報告に値する発見である——どちらのベンダーの説明にも、重みが変わったとは主張されていない。
これはまた、ルーターがその真価を発揮する場面であり、とりわけあなたには手に入れられないティアにおいてそうだ。GPT-5.6 Sol は OrcaRouter 上でopenai/gpt-5.6-solとして、プロバイダー自身の料金でトークンへのマークアップはゼロ、OpenAI 互換エンドポイントapi.orcarouter.ai/v1経由で提供されている。つまり、フォールバック先となる標準レーンはベース URL を1つ変えるだけで済み、同じキーで200 を超えるモデルが利用できる。これが重要なのは、今日「Ultrafast を使うべきか」に対する正直な答えが「使えない。だからそれまでの間、何にインタラクティブなトラフィックを担わせるかを決めよ」だからだ——そして、ウェイトリストなしでレイテンシを買う方法とは、インタラクティブな呼び出しを、カタログ上で品質基準を満たしつつ実時間が最も短いモデルへルーティングし、夜通しの作業は条件を満たす最も安いレーンに残すことだ。ティアが開放されたとき、それがあなたが切り替えるスイッチだ。当方がホストしていないものも明確に記しておく。OrcaRouter に Xiaomi のモデルは一切ない。したがって MiMo v2.6 Pro Ultraspeed は Xiaomi 自身の API や複数のサードパーティプラットフォームから提供されるものであり、このページはそのルートではない。

それを解決するものは何だろう
3つの測定値。そのどれもまだ存在しない。公開されたUltrafast料金表があれば、これは穴の空いた比較ではなく、本来あるべき比較になる。明示された同時実行レベルにおける独立したレイテンシ分布があれば、Xiaomiの実際の倍率が10×と20×のどちらに近いのか、そして単一ストリームのデモンストレーションではなく負荷時にもそれが維持されるのかがわかる。さらに、どちらか一方のベンダーのベンチマークスイートを独立に再現すれば、両方の数値群を主張欄から外せるだろう。
それまでは、擁護できる解釈は限定的だ。Xiaomiは価格と曖昧な速度を付けた速度ティアを投入し、OpenAIは具体的な速度を付け、価格を付けない速度ティアを投入した。どちらも、価格の基準にしているものと同じモデルであり、どちらも独立に測定されてはいない。今すぐレイテンシが必要で、ワークロードが対話型なら、UltraSpeedは実在し、購入でき、まさに狙う買い手に合わせた価格になっている。今すぐ必要だがワークロードが対話型でないなら、両モデルの標準レーンのほうが安く、実績があり、今日利用できる——そして、みんなが議論しているあのティアは、誰かが数値を公表するときにも、まだそこにあるだろう。
