
Xiaomi MiMo-V3-Flash: 未発表の高速モデルはOpenCodeのOmen Alphaの内部で動作しているのか?
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0259知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0258知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0166知能82コーディング
- AlibabaNEWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.3 Flash2026-08-2658知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianQwen3.8 27B2026-08-1552知能68コーディング
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
Xiaomi MiMo-V3-Flashは、Xiaomiから発表されていない。モデルカードもなく、Hugging Faceのウェイトもなく、価格ページもなく、ローンチ告知もない。この名前が出回っている理由はただ一つだ。2026年9月4日、著名な独立系AIアナリストであるteortaxesTexが、OpenCodeが同日朝にGoサブスクライバー向けに提供を開始した匿名の「ステルスモデル」Omen AlphaはXiaomi MiMo-V3-Flashであると自身が考えていると公に述べたのである。彼の特定は主に、Omen Alphaの可視化された推論トレース内にある、DeepSeek V4 GA期モデルの思考連鎖(チェーン・オブ・ソート)として彼が読み取るものに基づいている。それが正しければ、Xiaomi MiMo-V3-FlashはDeepSeekのオープンなV4ウェイトの上にトレーニングされたXiaomi製の高速ティアということになる。その特定については何も確認されておらず、本稿はそれをまさにそれがそうであるものとして扱う。すなわち、活発な推測ゲームにおける、十分に論証された一つの仮説として。
以下で述べることの基本ルールは次のとおりです。Omen Alpha の発表は確定した事実であり、アナリストの主張はラベル付きの主張にすぎません。V3世代の存在はカンファレンスのプレビューと流出したベンチマークによって裏付けられていますが、どちらもXiaomiによって未確認であることが明確に示されています。Xiaomi MiMo-V3-Flash という名前のモデルが存在するという主張自体は、挙動からの推測であり、Xiaomiの声明ではありません。そしてXiaomiはそのような声明を一切発表していないため、ここではその内容が事実として繰り返されることはありません。
その主張と、その背後にある4つの理由
引き金となったのは、ある開発者による報告だった。OpenCodeでOmen Alphaをテストしていたビルダーが@SPAC89として投稿し、「Omen Alpha High」——すなわち高推論設定のモデル——が、かなり大規模なコーディングタスクを10分足らずで完了させたこと、さらに、それよりはるかに長い数時間に及ぶ実行が進行中であることを書いた。その報告を引用投稿したteortaxesTexは、このモデルはXiaomi MiMo-V3-Flashであると確信していると述べ、その理由を4つ挙げた。いずれも文書による裏付けではなく、動作に基づくものだ。
推論トレース。見えている思考連鎖(CoT)はDeepSeek V4 GA CoTとして読める——彼の特徴的な癖は「hmm」「fine」、そして✓を接頭辞とするチェックリスト項目だ。彼が添付したスクリーンショットには、Omen Alphaが「high」設定でビルド途中の状態と、そのパターンに一致するトレースが写っている。
• 速度。モデルは高速です——それが彼が応答していた観察であり——そしてXiaomiの高速ティアは歴史的に「Flash」という名前を冠してきました。
運営者。DeepSeekはステルスプロモーションを行わない。したがって、たとえ推論がDeepSeek V4 GA由来であっても、Omen Alphaの背後にいるのは、DeepSeek自身ではなくDeepSeekをベースに構築した第三者である。
• クラスタリング。Xiaomi MiMoモデルの出力テキストはDeepSeekのそれとクラスタリングされる——これは彼が、テキストの分布が近接する二つの世代を指す際の簡潔な表現であり、DeepSeekで訓練されたモデルが見せるであろう姿である。彼は、DeepSeekと同様にクラスタリングされる別の例としてStepFunのStep-4を挙げており、StepFunの現行世代については確信がないと述べている。
この伝達者には一文を割く価値がある。同じ事実が両刃の剣となり得るからだ。teortaxesTexは自称DeepSeekフォロワーであり、彼のXプロフィールは2023年から一貫して自分をDeepSeekファンと称している。これは、DeepSeek V4の推論スタイルを一目で見分けられる人物のプロフィールであると同時に、そうしたスタイルを見出したがる傾向のある人物のプロフィールでもある。
Xiaomi のラインナップにおける MiMo-V3-Flash の立ち位置
Xiaomiが本日正式に確認したMiMoモデルは、MiMo-V2.5とMiMo-V2.5-Proで、両方とも2026年4月末にMITライセンスでオープンソース化される。MiMo-V2.5-Proは、1.02兆パラメータのMixture-of-Experts(MoE)モデルで、アクティブパラメータは420億、コンテキストウィンドウは100万トークン。MiMo-V2.5は、310億パラメータの、より小型の汎用兄弟モデルだ。そのファミリーツリーの背後には、MiMo-V2-Flash(2025年12月、3090億パラメータのオープンMoE)とMiMo-V2-Pro(2026年3月)が位置する。そして、この件でMiMo-V2-Proが重要なのは、Xiaomiが自社製品と公表する前に、Hunter Alphaという匿名のコードネームで最初に公開されていたからだ。匿名のフィールドテストはXiaomiにとって例外ではない。それはXiaomiのローンチ方法の一部なのだ。
V3世代は、記録が製品として出荷されたものからレポートへと移り変わる地点にあたります。2026年7月のICMLにおいて、MiMoチームを率いる研究者のLuo Fuli氏は、V3のアーキテクチャを予告しました。その目玉は、Xiaomiが「High Sparse」と呼ぶ設計です。少数のフルアテンション層が「オラクル」として機能し、周辺のスパース層が注目すべきトークンを選択します。そしてそれらのスパース層は、独自のKVキャッシュを持つ代わりに、フルアテンション層のKVキャッシュを共有します。Xiaomiによると、これによりKVキャッシュのメモリは約10分の1に削減され、800億パラメータ規模のモデルでスパース対フル比11:1を検証し、同じスパース比率でハイブリッド・スライディングウィンドウのベースラインがMMLUで約7ポイント低下したのに対し、フルアテンションと同等の品質を達成したといいます。これらは同チームがカンファレンス講演で示した主張であり、第三者による検証結果ではありません。次に、8月21日には、MiMo-V3-Proのものとされるベンチマークのスクリーンショットが流出し、Max For AIによって共有されました。SWE-Bench Proは72.8、GLM 5.3の67.9、Kimi K3の65.8、Claude Opus 5の74.6、GPT-5.6 Sol Maxの75.4と並び、Terminal-Bench 2.0は70.6、τ3-benchは76.4とされています。Xiaomiは何も確認しておらず、V3の存在とリリース時期は依然として未発表です。この記事の論点はより限定的です。V3世代が実際に進行中であることは明らかですが、V3モデルは未だ出荷されていません。まさにそのため、未発表のXiaomi MiMo-V3-Flashがステルスで姿を現せば、それは日常的な出来事ではなくニュースになるのです。
なぜFlash — そしてなぜOpenCode Go — が適合するのか
「Flash」ティアは、Xiaomiが高速かつ低コストなキャパシティを迅速にまく仕組みであり、同社は12月にMiMo-V2-Flashでも同じ手法を取った。また、OpenCode Goは有力な試験運用の場である。同プラットフォームはすでにXiaomiの現行オープンモデルを実行しているからだ。Omen Alphaを5時間あたり11,600リクエストとして掲載している同じGoラインナップには、MiMo-V2.5も30,100リクエストとして掲載されており、これはページ上で最も寛大な許容量の部類に入る。Xiaomiのチームが単一のプラットフォーム上で自社のMiMo-V2.5の隣にV3-Flashを実地試験すれば、マーケティングコストをゼロにしたまま前世代との直接比較ができる。しかも、そのプラットフォームは今月すでに匿名での公開を1件行っている。これは同一性の証拠ではなく、可能性を支持する論拠である。

The product shape points the same way. Omen Alpha at its "high" reasoning setting finishing in under ten minutes matches the behavior you would expect of a fast reasoning tier, and the third-party figures circulating for Omen Alpha — roughly $0.20 per million input tokens and $0.66 per million output, per press reproductions rather than an official rate card — put it at the cheap end of the market beside DeepSeek V4 Flash. A model that behaves like a fast, cheap DeepSeek-generation reasoner is what a "Flash" tier built on DeepSeek V4 would look like. Reported and inferred, again, not confirmed.
DeepSeekとの関連が核心であり——そして最も弱い証拠でもある
そもそもDeepSeek V4 GAがなぜ重要なのか。DeepSeekのV4系は2026年8月にプレビューから一般提供(GA)へ移行し、DeepSeek V4 Proは8月13日にGAビルド0813をMITライセンスのオープンウェイトとしてリリースした。同時に、より安価な兄弟モデルであるDeepSeek V4 Flashも登場した。MITライセンスでのオープンウェイトは、第三者がその上に合法的に構築できることを意味する。そしてコミュニティがそうしたモデルを見抜く一般的な方法は、それが受け継いでいる推論スタイルだ。DeepSeekのGA期のchain-of-thoughtには見分けやすい言語的习惯があり、teortaxesTexがOmen Alphaのトレースに見られるというのは、まさにその習慣である。彼が、そのトレースはDeepSeek V4 GAであり、運営者はXiaomiであると正しく指摘しているなら、Xiaomi MiMo-V3-Flashは、DeepSeekのオープン推論ウェイトの上に構築されたXiaomiの高速ティアということになる。これは合法的ではあるが戦略的に注目に値する選択であり、一見XiaomiのモデルがDeepSeekのように推論する理由をすっきり説明できるものだ。
さて、ここからが難しい部分だ。思考連鎖(chain-of-thought)の類似性は、モデルのフィンガープリントの中でも最も弱い部類に属する。それは構造ではなくスタイルだからだ。今月実際に成立した匿名モデルの特定、すなわち「Ox Alpha は GLM-5.3-Flash である」という判断は、はるかに強固な証拠、つまりトークナイザの一致とビデオエンコーディングのフォレンジックによって確定された。Omen Alpha を Xiaomi に結びつけるような、それに匹敵する強固なフィンガープリントは発表されていない。さらに、コミュニティの有力な解釈は別の方向を指している。開発者らは Omen Alpha のバックエンドリクエストが「zhipu」という名前空間の下で解決されると報告している。一部のテスターは、このモデルが自らを GLM ベースであると識別すると述べている。また、このローンチに関する報道の解釈では、Omen Alpha は、GLM-5.3-Flash と読まれた Ox Alpha のリリースに続く、Zhipu AI による9日間での2回目の匿名リリースであるとされている。その解釈が正しければ、DeepSeek 風の推論は、文体上の偶然の一致か、あるいは Zhipu のモデル自体が DeepSeek の痕跡を用いて訓練されたことを示す兆候かのどちらかであり、Xiaomi の製品ではない。両陣営が同時に正しいということはあり得ない。そして、どちらの陣営も、自らが名指しする研究室からの声明は得ていない。

それを解決するものは何だろう
• Xiaomiによる公式発表か、あるいはウェイトの公開だ。XiaomiはMiMo-V2-Flash以降、MiMoモデルをオープンソース化しており、MiMo-V2.5とMiMo-V2.5-ProはMITライセンスで公開されている。本物のXiaomi MiMo-V3-Flashが確認されるとすれば、GLM-5.3-Flashが確認されたのと同じように、Hugging Face上でウェイトとモデルカードが公開されるのが最も筋が通っている。
• 確固たるフィンガープリント。トークナイザーのマッチングがOx Alphaを特定した証拠であり、Omen AlphaがXiaomiに関連することを示すトークナイザーテストは公開されていない。
• モデル自身の説明。一部のテスターは、Omen Alphaが自らをGLMベースと称したと報告している。モデルの自己申告はデータではあるが、来歴を示すものではない。
• Omen Alphaの独立したベンチマーク。匿名モデルの中立的な評価により、コミュニティは8月にリークされたMiMo-V3-Proの数値と比較できるようになる。
「Goウィンドウ後の公開だ。過去の匿名モデルは、ローンチから数日から数週間後に、開発者が名乗り出たものだ。Omen Alphaを主張する者は、モデルの正確な名前を言い当てるだろう。」
推測が続いている間にすべきこと
実際的な立場は、どちらが正しいかには依存しない。Omen Alpha は月額10ドルのサブスクリプションの背後にある匿名モデルであり、Xiaomi MiMo-V3-Flash はそれに付けられた未確認の名称にすぎない。どちらも、今日の本番パイプラインに賭けるものではない。誰かが名乗りを上げ、その基盤モデルが一般のAPIで利用できるようになったときこそ、ルーティング層がその価値を発揮する瞬間である。OrcaRouter はプロバイダーの定価をマークアップ0%でそのまま通すため、ベンダーが新料金を公開した当日に、その料金が同じAPI上で有効になる。さらに自動フェイルオーバーにより、実トラフィックの一部を実績のない新興モデルに送りつつ、既に信頼しているモデルにフォールバックさせることができる。一方、注目すべき点は単純だ——Omen Alpha を名乗る者が現れるか、Xiaomi MiMo-V3-Flash がモデルカードに登場するかどうか。そのどちらかは必ず起こる。

2026年9月4日現在、Xiaomi MiMo-V3-Flashは、名称であり、 plausibileな製品形状であり、著名なアナリストの仮説に過ぎず、リリースされたモデルではありません。V3世代は、7月にプレビューされ8月にリークされたという点で、確かに実在します。その最初の公の姿が、今まさにコードネーム「Omen Alpha」として現れているのかどうかは、Xiaomiだけが答えられる質問であり、Xiaomiはまだ答えていません。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
