生成されたヒーローカードは「2つの高速レーン、16日の隔たり」という見出しで、サブタイトルは「GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed」、左パネルには「標準の6倍」「クローズドAPI」「速度倍率はGPT-6 Astraから借用」、右パネルには「おおよそ標準の10倍」「MITライセンスの重み」「合計1.02T / アクティブ42B」、その下のフッターには「ベンダーおよびカタログの数値、2026年9月〜10月。いずれの階層についても独立した測定はなし。」と表示されている。
Engineering & Research

GPT-6.1 Ultrafast 対 Xiaomi MiMo v2.6 Pro Ultraspeed:2つの高速レーン、一方はその代償を明かす

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

フロンティアモデルを購入するための最速の2つの方法は16日違いで販売開始され、そのスピードがどのようにして生み出されたのかを明かしたのは、そのうちの一方だけだった。GPT-6.1 Ultrafastの上に構築されたサービング階層で、GPT-6.1 SolOpenAIが2026年9月29日にリリースし、2026年10月8日にこの階層を追加した — API経由でアクセスするクローズドなフラッグシップであり、Standardの6倍の価格で、重みとリクエストの間で何が起きているかについて公開された説明はない。Xiaomi MiMo v2.6 Pro Ultraspeedは2026年9月22日にリリースされ、MiMo-V2.6-Pro上のスピード階層であり、MiMo-V2.6-ProはMITライセンスのチェックポイントで、その強化学習環境もXiaomiが公開した。どちらもレイテンシを倍数で売っている。だが、顧客が検査できる何かの上に成り立っているのはXiaomiの倍数だけであり、その違いはどちらのスピードの主張よりも意思決定にとって価値がある。

2つのレーンの価格は簡単な部分であり、以下で取り上げます。難しいのは、スピードティアがサービングに関する約束だという点です。そして2つのベンダーは、その約束をまったく異なる開示レベルで果たしています。一方は看板となる数値を兄弟モデルから借用し、もう一方は価格表とともにトレーニングレシピを公開しました。本番ワークロードを高速レーンに投入しようとしているなら、この開示のギャップこそが、あなたが実際に引き受けるリスクなのです。

価格(両側を同じ行に表示)

どちらのティアも標準レーンの倍数として販売されており、その倍数は十分に近いため、両者を分けているのは価格ではありません。

• 標準レーン — GPT-6.1 Sol は100万トークンあたり入力 $2.00 / 出力 $10.00、MiMo-V2.6-Pro は $0.44 / $0.87。

• 高速レーン {{1}}超高速{{/1}}は{{2}}$12{{/2}} / {{3}}$60{{/3}}、一方{{4}}MiMo-V2.6-Pro-UltraSpeed{{/4}}は{{5}}$4.35{{/5}} / {{6}}$8.35{{/6}}。

• 倍率 — OpenAI ティアではどの行も正確に 6 倍、Xiaomi のものでは入力がおよそ 9.9 倍、出力が正確に 10 倍。

• キャッシュ済み入力 — GPT-6.1 Sol は Standard では100万あたり$0.10、Ultrafast では$0.60です。私たちが確認できる MiMo の料金表には、どちらのレーンについてもキャッシュ済み入力の個別項目は公開されていません。

• 長いコンテキスト — GPT-6.1 Sol は、272,000 入力トークンを超えると、リクエスト全体を入力料金とキャッシュ料金の 2 倍、出力料金の 1.5 倍で再計算し、Ultrafast の料金を $24.00 / $1.20 / $30.00 / $90.00 に設定します。MiMo-V2.6-Pro は 1M トークンのコンテキストウィンドウを備えており、同等の公表された価格急変はありません。

• 絶対スプレッド — 2つの高速レーンは入力で2.8倍、出力で6.9倍の開きがあり、これはフロンティアのクローズドモデルとオープンウェイトモデルの間のギャップが、標準レートではなくスピードティアの内部に現れているということだ。

そのブロックの一行要約:Xiaomiははるかに安いモデルにより大きな倍率を課し、OpenAIははるかに高価なモデルにより小さな倍率を課している。出力トークンでは、OpenAIレーンは100万あたり60.00ドル、Xiaomiのレーンは8.70ドルを支払う。どちらのベンダーも速度に対する割引を提供しておらず、どちらもそれを別製品として価格設定している。これは、どちらの場合も標準レーンが依然としてデフォルトであり、高速レーンはワークロードごとに正当化する例外であるという最初の兆候だ。

各ベンダーが速度についてあなたに語るであろうこと

ここが、2つのロールアウトが対称でなくなる地点であり、そしてこれがこのページで最も役に立つ点である。

OpenAIがUltrafastについて公表している数字は、GPT-6 Astra UltrafastがCodexのStandardモードにおけるGPT-6 Astraと比べて最大8倍速くトークンを生成するというものだ。それは別のモデルを、別のクライアントで測定したものであり、上限値として表現されている。GPT-6.1 SolのUltrafastを扱うドキュメントには、この階層が生成される出力トークン間の時間を短縮すると書かれており、料金表を参照するよう示しているが、Sol階層については数値を一切示していない。つまり、この展開に添えられた見出しの数字は、9月29日からUltrafastを利用してきた姉妹モデルから借用したものであり、どちらについても独立した第三者によるトークン毎秒の測定値は公表されていない。同じサービングスタック、同じ仕組みなのだから、そのまま当てはまる可能性は十分にある。しかしそれは、OpenAI自身がこのモデルについて測定したものではない、ベンダーによる上限値なのだ。

X​iaomiの開示は性質が異なり、その違いは、より精密だという点ではない。自社資料は、UltraSpeedが同じ品質で標準のProサービスの出力速度の最大20倍に達すると主張している。同じ日に同じモデルを説明した第三者によるカタログの掲載情報では、約10倍とされている。両方の数字が出回っており、両者は同じ数字ではなく、それらを整合させる測定値を公表した者はいない。これを正直に読めば、「最大20倍」はX​iaomiが明示していない条件下におけるベンダー側の上限であり、「約10倍」はカタログが典型値として主張する用意があったものであり、実際の倍率は、明示された同時実行レベルにおけるリクエストごとのレイテンシ分布を誰かが公表するまで、広い範囲のどこかにとどまる。

つまり、Xiaomi は一致しない2つの数値を示し、OpenAI は別のモデルに属する1つの数値を示している。どちらも、それをもとに予算を組める事実ではなく、実務上の帰結は両者とも同じだ。本番経路として採用する前に、自分のプロンプトでそのティアを測定すること。

本当に重要な非対称性——余分な桁が何をもたらすのか

速度のうたい文句はさておき、この2つのレーンはまったく異なる種類の製品に結びついており、ここで選択は単なる価格比較ではなくなる。

MiMo-V2.6-Proは、Xiaomiが公に説明しているスパースなMixture-of-Experts設計です。総パラメータ数は1.02兆、トークンあたり420億が活性化され、コンテキストウィンドウは100万トークン、テキスト・画像・動画・音声にわたるネイティブなマルチモーダル対応、そして公開されたチェックポイントにはMITライセンスが付されています。リリースバンドルには技術レポートとデプロイメントノートが含まれており、Xiaomiは、ポストトレーニングを検証・再現できるよう、強化学習のトレーニング環境とそのコードをオープンソース化すると述べています。RLの実行も文書化されています — 30ステップ、モデルあたりおよそ75万トラジェクトリ、6日未満で、ProとFlashの実行を合わせた公表支出は約3,474,715ドルです。DeepSWE v1.1において、Xiaomi自身のハーネスでmini-swe-agentをavg@3で用いた場合、同社は、その実行を通じてMiMo-V2.6-Flashが48.8から65.68へ、MiMo-V2.6-Proが58.4から72.57へと向上したと報告しています。これらはベンダーによる報告であり、再現されたものではありません。「Xiaomiのハーネスが72.57と言っている」と「72.57がスコアである」の違いは、主張と事実の違いです。

GPT-6.1 Solはそのいずれも公開していない。パラメータ数も、アーキテクチャに関する注記も、学習費用の数字も、チェックポイントも、読むべきライセンスもない。あるのはモデルカード、コンテキストウィンドウ、2026年4月30日という知識カットオフ、そしてAPIだ。それはフロンティアラボにとって通常の取り決めであり、批判ではない。しかし、ローンチ報道が往々にして飛ばしがちな購入判断に対して、一つの帰結がある。オープンウェイトの路線では、期待外れの高速ティアでも挽回がきく。UltraSpeedがあなたのトラフィックの10倍の価値がないと判明した場合、同じチェックポイントをダウンロードでき、自分で、あるいは別のプロバイダーを通じて提供できる。その代わり移行の手間はかかるが、下振れを限定できる。クローズドの路線では、期待外れの高速ティアは請求書と、引き下げて調整するレート制限予算でしかない。重みを実行することで回避することはできない。実行できる重みが存在しないからだ。

そのMITタグについては一つ注意が必要です。ローンチ時の報道では単純化されてしまうからです。ライセンスが適用されるのは、Xiaomiが公開したチェックポイントです。UltraSpeedはホスト型サービスであり、ホスト型サービスは重みライセンスではなく利用規約によって規定されます。チェックポイントを自分のハードウェアで実行する権利と、誰かによるその高速化されたサービングを再販売する権利は別物であり、ライセンスファイルから得られるのは前者だけです。

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

どちらかの識別子をコピーする前に知っておきたい、2つの命名の罠

このページのタイトルに挙げられているどちらの名称もチェックポイントではありません。しかも、両ベンダーのドキュメントのせいで、この間違いは繰り返されやすくなっています。

• GPT-6.1 Ultrafast — モデルではありません。リクエスト内の識別子は標準モデルと同じままで、ティアはリクエストのフィールドで設定され、結果は同じチェックポイントを異なるスケジュールで実行したものにすぎません。

• MiMo v2.6 Pro Ultraspeed — これも独立した重みのセットではありません。これはMiMo-V2.6-Proチェックポイントを、より高速な経路で提供し、独自の項目として価格設定したものです。

• ベンチマークにとってこれが意味するのは — どちらかのモデルの2つのレーンを同一のプロンプトで比較する場合、期待される結果は、同じ回答が異なる速度で得られることです。同じ入力に対して内容が食い違うのは、報告すべき欠陥であり、あなたが購入した能力ではありません。

• ライセンス確認にとってそれが何を意味するか — Xiaomi の場合は、モデルカードを読んでください。OpenAI の場合は、読むべきものは何もありません。なぜなら、重みは配布されていないからです。

また、各ティアがどのように販売されているかにも、より緩やかな非対称性が表れている。GPT-6.1 Solは米国とEUのデータレジデンシーおよびグローバル処理をサポートしており、Ultrafastの下でも同様なので、欧州での処理に固定されたワークロードには文書化された答えがある。私たちが読めるMiMoの料金表には、レジデンシーについて一切記載がない — Xiaomiはモデルとサービング経路を売っているのであり、コンプライアンス態勢を売っているのではない。規制対象の購入者にとっては、価格が検討される前に、その一行が比較を決めてしまうかもしれない。

各レーンが実際に呼び出し可能な場所

両方のファストレーンは、それぞれのベンダー自身のAPIを通じてアクセスでき、どちらもサードパーティのプラットフォーム上に存在しています。どちらもOrcaRouterには搭載されておらず、比較ページにそうでないかのような印象を与えるのではなく、このことを率直に述べておく価値があります。

OrcaRouter上にあるのは、O​penAIモデルの標準レーンです:openai/gpt-6.1-solO​penAI自身のリスト料金、入力100万トークンあたり$2.00、出力100万トークンあたり$10.00で、マークアップは0%、プロバイダーの価格がそのまま通過するため、ベンダーの価格改定は当日のうちに当社側へ反映されます。Ultrafastはお客様自身のO​penAIアカウントで課金されるサービスティアのフラグであり、X​iaomiのモデルはここには一切ホストされていません。1つのキーで購入できるのは、標準レーンと、1つのO​penAI互換エンドポイントの背後にある200を超える他のモデルであり、プロバイダー間の自動フェイルオーバーを備えています — これは、保護しているワークロードが午前3時にレート制限の上限に気づくようなものである場合に有用な態勢です。

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

どのレーンをどの順番でテストするか

ワークロードが対話型で、生成時間が人の時計に乗るなら、両ティアとも試す価値があり、決め手は価格ではなく、あなたの信頼に付された有効期限になる。オープンウェイトのレーンでは、検証してから離れられる。クローズドのレーンでは、それを提供できる唯一のベンダーとともに検証し、とどまることを求められる。この非対称性は現実だが、無料でもない。MiMo-V2.6-Pro-UltraSpeed はホステッドサービスなので、退出は設定変更ではなく移行であり、移行先のチェックポイントがそのティアのサービング最適化に合致しない可能性がある。

ワークロードがバッチ処理かスケジュール実行であれば、6倍であれ10倍であれ、どちらも間違った購入であり、正直なところ、標準レーンで実行して、その差額を評価に充てるのが正しい判断です。

このページを変えるものは何か:明示された同時実行数レベルにおける、いずれかのティアの出力速度の独立した測定、Xiaomiによる公開されたレジデンシー声明、あるいは購入者が問い合わせる代わりにそれを前提に計画できる、Solティアに関するOpenAIのレート制限値である。それらが存在するまで、この比較は価格表対価格表であり、2社のうち一方が、価格を付けられている対象についてかなり多くを公開しているという状況にすぎない。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新