為「Xiaomi MiMo-V3-Flash」一文製作的主視覺標題卡:眉題為「OrcaRouter · 模型雷達 — 洩漏」,標題為「Xiaomi MiMo-V3-Flash」,副標題為「一位分析師表示,OpenCode 的匿名模型 Omen Alpha 就是小米尚未發布的高速模型;小米內部無人證實此事。」左卡標題為「說法」,內容為「teortaxesTex,2026 年 9 月 4 日 — 引用轉發了一則第一手 Omen Alpha 速度測試」,並附一行「Omen Alpha 就是 Xiaomi MiMo-V3-Flash。」右卡標題為「狀態」,內容為「小米尚未公布任何消息 — 沒有權重、沒有模型卡、沒有定價頁面」,並附一行「未經證實 · 僅有推論。」另有四個標籤:「開發者:未證實」、「CoT 風格近似 DeepSeek V4 GA」、「Omen Alpha · 僅限 OpenCode Go」、「高推理 · 速度快」。OrcaRouter 標誌疊加於右下角。
Guides & Insights

Xiaomi MiMo-V3-Flash:未發布的快速模型是否正在 OpenCode 的 Omen Alpha 中運行?

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

小米尚未發布 MiMo-V3-Flash。沒有模型卡、沒有 Hugging Face 權重、沒有定價頁面,也沒有發布文章——這個名稱之所以在流傳,只有一個原因:2026 年 9 月 4 日,知名獨立 AI 分析師 teortaxesTex 公開表示,他認為 OpenCode 當天早上開始向其 Go 訂閱用戶提供的匿名「隱身模型」Omen Alpha,就是小米 MiMo-V3-Flash。他的判斷主要依據 Omen Alpha 可見的推理軌跡中,他所解讀為 DeepSeek V4 GA 時期模型的思維鏈(chain-of-thought)——如果這項判斷成立,那麼小米 MiMo-V3-Flash 就是小米基於 DeepSeek 開源 V4 權重所訓練的快速層級模型。關於該判斷的一切都尚未獲得證實,而本文也僅將其視為事實本身:一場熱烈猜測遊戲中一個論述充分的假說。

以下內容的基本規則:Omen Alpha 的發布是已確認的事實,而分析師的說法是被明確標示的主張。V3 世代的存在有會議預覽和外洩的基準測試作為佐證,但兩者皆被小米明確標示為未經證實。關於名為 Xiaomi MiMo-V3-Flash 的模型是否確實存在的斷言,是從行為推論而來,而非小米的聲明——既然小米沒有發表任何聲明,此處也就不會將任何聲明重述為事實。

這個主張,以及其背後的四個理由

觸發點是一份開發者報告。一位在 OpenCode 中測試 Omen Alpha 的建置者,以 @SPAC89 身分發文,寫道「Omen Alpha High」——也就是該模型在高等推理設定下的版本——在不到十分鐘內完成了一項大型編碼任務,且一個耗時數小時的更長執行正在進行中。teortaxesTex 引述該報告表示,他認為這個模型是 Xiaomi MiMo-V3-Flash,並給出四個理由,全部屬於行為層面而非文件證據:

• 推理蹤跡。可見的思維鏈讀起來像是 DeepSeek V4 GA CoT——他的特徵線索是「hmm」、「fine」,以及帶有 ✓ 前綴的檢查清單項目。他附上的螢幕截圖顯示 Omen Alpha 正在以「high」設定進行建置,其蹤跡與該模式相符。

• 速度。模型很快——這正是他所回應的觀察——而小米的快速等級歷來帶有「Flash」名稱。

• 操作者。DeepSeek 不會進行隱密推廣,因此即使推理能力源於 DeepSeek V4 GA,Omen Alpha 背後的任何一方都是基於 DeepSeek 建構的第三方,而非 DeepSeek 本身。

• 聚類。Xiaomi MiMo 模型的輸出文字與 DeepSeek 的輸出文字呈現聚類——這是他用來指稱兩個輸出文字分佈相近之世代的簡稱,也正是以 DeepSeek 訓練的模型會呈現的樣子。他點名另一個同樣與 DeepSeek 聚類的替代方案:StepFun 的 Step-4,並表示他不確定 StepFun 目前的世代。

傳訊者這個角色本身就值得用一個子句來交代,因為同一事實可以兩面解讀。teortaxesTex 自稱是 DeepSeek 的追隨者——他在 X 上的個人簡介自 2023 年以來便一直自稱是 DeepSeek 粉絲。這樣的身分背景,既代表他能一眼認出 DeepSeek V4 的推理風格,也代表他本來就傾向於認定眼前所見正是這種風格。

一款 MiMo-V3-Flash 在 Xiaomi 的產品線中會落在哪個位置?

小米今日正式確認的 MiMo 機型為 MiMo-V2.5 與 MiMo-V2.5-Pro,兩者皆於 2026 年 4 月底以 MIT 授權開源。MiMo-V2.5-Pro 是一個 1.02 兆參數的混合專家模型,具備 420 億啟用參數與 100 萬 token 的上下文視窗;MiMo-V2.5 則是較小的通用型兄弟款,參數規模為 3100 億。在它們之後的家族序列中,還有 MiMo-V2-Flash(2025 年 12 月,開放原始碼的 3090 億參數 MoE)與 MiMo-V2-Pro(2026 年 3 月)——而 MiMo-V2-Pro 對這個故事之所以重要,是因為它最初是以匿名代號「Hunter Alpha」公開亮相,之後小米才出面認領。匿名實地測試對小米而言並非例外,而是小米推出產品的一環。

V3世代正處於記錄從已出貨產品轉向報告的過渡階段。在2026年7月的ICML上,領導MiMo團隊的研究人員羅福莉預覽了V3的架構。重點是小米稱之為High Sparse的設計:少數全注意力層充當「oracle」(預言機),選出周圍稀疏層應關注的token,而這些稀疏層共享全注意力層的KV快取,而非各自保留。小米表示,這能將KV快取記憶體削減約十倍,並在800億參數規模的模型上驗證了11:1的稀疏對全注意力比例,達到與全注意力相當的品質;而在相同的稀疏度下,混合滑動視窗基線損失了約七個MMLU分數。這些是該團隊在會議演講中自行提出的說法,並非獨立驗證的結果。接著在8月21日,一張據稱是MiMo-V3-Pro的基準測試截圖開始流傳,由Max For AI分享:SWE-Bench Pro 72.8,對比GLM 5.3的67.9、Kimi K3的65.8、Claude Opus 5的74.6以及GPT-5.6 Sol Max的75.4,另外還有Terminal-Bench 2.0的70.6和τ3-bench的76.4。小米尚未證實任何消息,V3的存在與發佈時程也仍未對外公開。本文的重點更為狹隘:V3世代確實已在推進中,但沒有任何V3模型正式出貨——這正是為何一款未對外公開的小米MiMo-V3-Flash悄悄現身會成為新聞,而非例行公事。

為什麼 Flash — 以及為什麼 OpenCode Go — 會適合

Flash 等級是小米布局快速、廉價算力的方式;它在 12 月時就以 MiMo-V2-Flash 做過同樣的事。OpenCode Go 則是一個合理的試驗場,因為它已經運行小米目前的開源模型:同一份 Go 清單中既列出 Omen Alpha 每五小時 11,600 次請求,也列出 MiMo-V2.5 的 30,100 次,是該頁面上最慷慨的配額之一。小米團隊若在單一平台上,將 V3-Flash 與自家的 MiMo-V2.5 並行實測,就能以零行銷成本直接與前一代進行比較,而這個平台本月也已經出現過一次匿名發布。這是支持其合理性的論點,而非身份同一性的證據。

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

{{1}}產品型態的定位是一致的。Omen Alpha 在其「高」推理設定下,能在十分鐘內完成任務,這符合你對快速推理層級的預期;而外界流傳關於 Omen Alpha 的第三方數據——每百萬個輸入 token 約 0.20 美元、每百萬個輸出 token 約 0.66 美元(根據媒體轉載而非官方價目表)——{{2}}使其在市場上與 DeepSeek V4 Flash 同屬低價端。{{3}}一個行為表現如同快速且廉價的 DeepSeek 世代推理模型,正是基於 DeepSeek V4 打造的「Flash」層級應有的樣貌。{{4}}以上皆屬轉述與推測,{{5}}再次強調,並非官方證實。{{6}}

與 DeepSeek 的關聯是關鍵——也是最薄弱的證據。

為什麼 DeepSeek V4 GA 很重要:DeepSeek 的 V4 系列在 2026 年 8 月從預覽版轉為正式發布(GA),當時 DeepSeek V4 Pro 於 8 月 13 日推出 GA build 0813,採用 MIT 授權的開放權重,同時推出的還有更便宜的兄弟產品 DeepSeek V4 Flash。MIT 授權下的開放權重意味著第三方可以合法地以此為基礎進行開發,而社群辨識這類模型的慣用手法,就是看它繼承的推理風格:DeepSeek GA 時代的思維鏈帶有鮮明的語言習慣,而 teortaxesTex 正是宣稱在 Omen Alpha 的軌跡中看到了這些習慣。如果他判斷正確——該軌跡確實是 DeepSeek V4 GA,且操作方確實是 Xiaomi——那麼 Xiaomi MiMo-V3-Flash 就是 Xiaomi 基於 DeepSeek 開放推理權重打造的快速版本,此舉合法但深具戰略意義,同時也完美解釋了為何一個名義上是 Xiaomi 的模型,推理方式卻像 DeepSeek。

現在來談困難的部分。思維鏈相似度是模型指紋中最弱的一類,因為它屬於風格而非結構。本月真正成立的匿名模型識別——將 Ox Alpha 判定為 GLM-5.3-Flash——是靠更硬派的證據定案的:tokenizer 比對與影片編碼鑑識。目前沒有任何同等強度的硬指紋證據被公開,能將 Omen Alpha 指向小米。此外,社群的主流解讀指向另一個方向:開發者回報 Omen Alpha 的後端請求解析到「zhipu」命名空間;部分測試者描述該模型自我標識為 GLM 基礎;而媒體對這次發佈的讀法是,Omen Alpha 是智譜AI在九天內第二次匿名發佈,繼被解讀為 GLM-5.3-Flash 的 Ox Alpha 之後。如果這種解讀正確,帶有 DeepSeek 風格的推理若不是風格上的巧合,就是表示智譜的模型本身在訓練時帶有 DeepSeek 痕跡——但它並非小米的產品。這兩個陣營不可能同時正確,而且雙方都沒有獲得自己所點名實驗室的聲明。

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

什麼能解決這件事?

• 一份 Xiaomi 聲明——或權重。Xiaomi 自 MiMo-V2-Flash 起已開源其 MiMo 模型,MiMo-V2.5 和 MiMo-V2.5-Pro 以 MIT 授權釋出;一個真正的 Xiaomi MiMo-V3-Flash 最可能的確認方式,會像 GLM-5.3-Flash 一樣,在 Hugging Face 上提供權重與模型卡。

• 一個明確的指紋。Tokenizer 匹配是識別 Ox Alpha 的證據;尚未發表將 Omen Alpha 指向 Xiaomi 的 tokenizer 測試。

• 模型自身的說法。部分測試者回報 Omen Alpha 自我描述為基於 GLM。模型的自我陳述屬於資料,但並非來源證明。

• Omen Alpha 的獨立基準測試。對匿名模型的中立評估將讓社群能將其與八月洩漏的 MiMo-V3-Pro 數據進行比較。

• 在 Go 窗口期之後的揭曉。過去匿名模型在發布後數天至數週內即被認領;無論誰認領 Omen Alpha,都將準確地為該模型命名。

在猜測繼續進行時該怎麼做

實際立場並不取決於誰是對的。Omen Alpha 是一個每月 10 美元訂閱背後的匿名模型,而 Xiaomi MiMo-V3-Flash 是附在其上、未經證實的名稱;兩者都不是今天值得押注生產管線的東西。當某個製造者真正站出來,且底層模型進入一般 API 時,那才是路由層證明其價值的時刻:OrcaRouter 以 0% 加價傳遞供應商列表價格,因此廠商一公布新費率,當天就會在同一個 API 上生效;自動故障轉移則讓你能將一部分真實流量導向未經驗證的新進者,並以你已信任的模型作為後備。與此同時,值得關注的事情很簡單——是否有人認領 Omen Alpha,以及 Xiaomi MiMo-V3-Flash 是否會出現在模型卡上?這兩者之一會發生。

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

截至2026年9月4日,Xiaomi MiMo-V3-Flash 僅是一個名稱、一種看似合理的產品型態,以及一位知名分析師的推測——而非已發布的模型。V3 世代確實真實存在,足以在7月搶先預覽、8月遭到外流。至於它是否正以代號 Omen Alpha 進行首次公開亮相,這個問題只有 Xiaomi 能回答,而 Xiaomi 至今尚未給出答案。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

providers@orcarouter.ai

加入我們的社區

Discordsupport@orcarouter.aiXGitHubYouTube