
Xiaomi MiMo-V3-Flash:未發布的快速模型是否正在 OpenCode 的 Omen Alpha 中運行?
- google新Google: Gemini 3.8 Flash2026-09-0259智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0258智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0166智能82程式
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2658智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1860智能75程式
- obsidianQwen3.8 27B2026-08-1552智能68程式
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grokSpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
小米尚未發布 MiMo-V3-Flash。沒有模型卡、沒有 Hugging Face 權重、沒有定價頁面,也沒有發布文章——這個名稱之所以在流傳,只有一個原因:2026 年 9 月 4 日,知名獨立 AI 分析師 teortaxesTex 公開表示,他認為 OpenCode 當天早上開始向其 Go 訂閱用戶提供的匿名「隱身模型」Omen Alpha,就是小米 MiMo-V3-Flash。他的判斷主要依據 Omen Alpha 可見的推理軌跡中,他所解讀為 DeepSeek V4 GA 時期模型的思維鏈(chain-of-thought)——如果這項判斷成立,那麼小米 MiMo-V3-Flash 就是小米基於 DeepSeek 開源 V4 權重所訓練的快速層級模型。關於該判斷的一切都尚未獲得證實,而本文也僅將其視為事實本身:一場熱烈猜測遊戲中一個論述充分的假說。
以下內容的基本規則:Omen Alpha 的發布是已確認的事實,而分析師的說法是被明確標示的主張。V3 世代的存在有會議預覽和外洩的基準測試作為佐證,但兩者皆被小米明確標示為未經證實。關於名為 Xiaomi MiMo-V3-Flash 的模型是否確實存在的斷言,是從行為推論而來,而非小米的聲明——既然小米沒有發表任何聲明,此處也就不會將任何聲明重述為事實。
這個主張,以及其背後的四個理由
觸發點是一份開發者報告。一位在 OpenCode 中測試 Omen Alpha 的建置者,以 @SPAC89 身分發文,寫道「Omen Alpha High」——也就是該模型在高等推理設定下的版本——在不到十分鐘內完成了一項大型編碼任務,且一個耗時數小時的更長執行正在進行中。teortaxesTex 引述該報告表示,他認為這個模型是 Xiaomi MiMo-V3-Flash,並給出四個理由,全部屬於行為層面而非文件證據:
• 推理蹤跡。可見的思維鏈讀起來像是 DeepSeek V4 GA CoT——他的特徵線索是「hmm」、「fine」,以及帶有 ✓ 前綴的檢查清單項目。他附上的螢幕截圖顯示 Omen Alpha 正在以「high」設定進行建置,其蹤跡與該模式相符。
• 速度。模型很快——這正是他所回應的觀察——而小米的快速等級歷來帶有「Flash」名稱。
• 操作者。DeepSeek 不會進行隱密推廣,因此即使推理能力源於 DeepSeek V4 GA,Omen Alpha 背後的任何一方都是基於 DeepSeek 建構的第三方,而非 DeepSeek 本身。
• 聚類。Xiaomi MiMo 模型的輸出文字與 DeepSeek 的輸出文字呈現聚類——這是他用來指稱兩個輸出文字分佈相近之世代的簡稱,也正是以 DeepSeek 訓練的模型會呈現的樣子。他點名另一個同樣與 DeepSeek 聚類的替代方案:StepFun 的 Step-4,並表示他不確定 StepFun 目前的世代。
傳訊者這個角色本身就值得用一個子句來交代,因為同一事實可以兩面解讀。teortaxesTex 自稱是 DeepSeek 的追隨者——他在 X 上的個人簡介自 2023 年以來便一直自稱是 DeepSeek 粉絲。這樣的身分背景,既代表他能一眼認出 DeepSeek V4 的推理風格,也代表他本來就傾向於認定眼前所見正是這種風格。
一款 MiMo-V3-Flash 在 Xiaomi 的產品線中會落在哪個位置?
小米今日正式確認的 MiMo 機型為 MiMo-V2.5 與 MiMo-V2.5-Pro,兩者皆於 2026 年 4 月底以 MIT 授權開源。MiMo-V2.5-Pro 是一個 1.02 兆參數的混合專家模型,具備 420 億啟用參數與 100 萬 token 的上下文視窗;MiMo-V2.5 則是較小的通用型兄弟款,參數規模為 3100 億。在它們之後的家族序列中,還有 MiMo-V2-Flash(2025 年 12 月,開放原始碼的 3090 億參數 MoE)與 MiMo-V2-Pro(2026 年 3 月)——而 MiMo-V2-Pro 對這個故事之所以重要,是因為它最初是以匿名代號「Hunter Alpha」公開亮相,之後小米才出面認領。匿名實地測試對小米而言並非例外,而是小米推出產品的一環。
V3世代正處於記錄從已出貨產品轉向報告的過渡階段。在2026年7月的ICML上,領導MiMo團隊的研究人員羅福莉預覽了V3的架構。重點是小米稱之為High Sparse的設計:少數全注意力層充當「oracle」(預言機),選出周圍稀疏層應關注的token,而這些稀疏層共享全注意力層的KV快取,而非各自保留。小米表示,這能將KV快取記憶體削減約十倍,並在800億參數規模的模型上驗證了11:1的稀疏對全注意力比例,達到與全注意力相當的品質;而在相同的稀疏度下,混合滑動視窗基線損失了約七個MMLU分數。這些是該團隊在會議演講中自行提出的說法,並非獨立驗證的結果。接著在8月21日,一張據稱是MiMo-V3-Pro的基準測試截圖開始流傳,由Max For AI分享:SWE-Bench Pro 72.8,對比GLM 5.3的67.9、Kimi K3的65.8、Claude Opus 5的74.6以及GPT-5.6 Sol Max的75.4,另外還有Terminal-Bench 2.0的70.6和τ3-bench的76.4。小米尚未證實任何消息,V3的存在與發佈時程也仍未對外公開。本文的重點更為狹隘:V3世代確實已在推進中,但沒有任何V3模型正式出貨——這正是為何一款未對外公開的小米MiMo-V3-Flash悄悄現身會成為新聞,而非例行公事。
為什麼 Flash — 以及為什麼 OpenCode Go — 會適合
Flash 等級是小米布局快速、廉價算力的方式;它在 12 月時就以 MiMo-V2-Flash 做過同樣的事。OpenCode Go 則是一個合理的試驗場,因為它已經運行小米目前的開源模型:同一份 Go 清單中既列出 Omen Alpha 每五小時 11,600 次請求,也列出 MiMo-V2.5 的 30,100 次,是該頁面上最慷慨的配額之一。小米團隊若在單一平台上,將 V3-Flash 與自家的 MiMo-V2.5 並行實測,就能以零行銷成本直接與前一代進行比較,而這個平台本月也已經出現過一次匿名發布。這是支持其合理性的論點,而非身份同一性的證據。

{{1}}產品型態的定位是一致的。Omen Alpha 在其「高」推理設定下,能在十分鐘內完成任務,這符合你對快速推理層級的預期;而外界流傳關於 Omen Alpha 的第三方數據——每百萬個輸入 token 約 0.20 美元、每百萬個輸出 token 約 0.66 美元(根據媒體轉載而非官方價目表)——{{2}}使其在市場上與 DeepSeek V4 Flash 同屬低價端。{{3}}一個行為表現如同快速且廉價的 DeepSeek 世代推理模型,正是基於 DeepSeek V4 打造的「Flash」層級應有的樣貌。{{4}}以上皆屬轉述與推測,{{5}}再次強調,並非官方證實。{{6}}
與 DeepSeek 的關聯是關鍵——也是最薄弱的證據。
為什麼 DeepSeek V4 GA 很重要:DeepSeek 的 V4 系列在 2026 年 8 月從預覽版轉為正式發布(GA),當時 DeepSeek V4 Pro 於 8 月 13 日推出 GA build 0813,採用 MIT 授權的開放權重,同時推出的還有更便宜的兄弟產品 DeepSeek V4 Flash。MIT 授權下的開放權重意味著第三方可以合法地以此為基礎進行開發,而社群辨識這類模型的慣用手法,就是看它繼承的推理風格:DeepSeek GA 時代的思維鏈帶有鮮明的語言習慣,而 teortaxesTex 正是宣稱在 Omen Alpha 的軌跡中看到了這些習慣。如果他判斷正確——該軌跡確實是 DeepSeek V4 GA,且操作方確實是 Xiaomi——那麼 Xiaomi MiMo-V3-Flash 就是 Xiaomi 基於 DeepSeek 開放推理權重打造的快速版本,此舉合法但深具戰略意義,同時也完美解釋了為何一個名義上是 Xiaomi 的模型,推理方式卻像 DeepSeek。
現在來談困難的部分。思維鏈相似度是模型指紋中最弱的一類,因為它屬於風格而非結構。本月真正成立的匿名模型識別——將 Ox Alpha 判定為 GLM-5.3-Flash——是靠更硬派的證據定案的:tokenizer 比對與影片編碼鑑識。目前沒有任何同等強度的硬指紋證據被公開,能將 Omen Alpha 指向小米。此外,社群的主流解讀指向另一個方向:開發者回報 Omen Alpha 的後端請求解析到「zhipu」命名空間;部分測試者描述該模型自我標識為 GLM 基礎;而媒體對這次發佈的讀法是,Omen Alpha 是智譜AI在九天內第二次匿名發佈,繼被解讀為 GLM-5.3-Flash 的 Ox Alpha 之後。如果這種解讀正確,帶有 DeepSeek 風格的推理若不是風格上的巧合,就是表示智譜的模型本身在訓練時帶有 DeepSeek 痕跡——但它並非小米的產品。這兩個陣營不可能同時正確,而且雙方都沒有獲得自己所點名實驗室的聲明。

什麼能解決這件事?
• 一份 Xiaomi 聲明——或權重。Xiaomi 自 MiMo-V2-Flash 起已開源其 MiMo 模型,MiMo-V2.5 和 MiMo-V2.5-Pro 以 MIT 授權釋出;一個真正的 Xiaomi MiMo-V3-Flash 最可能的確認方式,會像 GLM-5.3-Flash 一樣,在 Hugging Face 上提供權重與模型卡。
• 一個明確的指紋。Tokenizer 匹配是識別 Ox Alpha 的證據;尚未發表將 Omen Alpha 指向 Xiaomi 的 tokenizer 測試。
• 模型自身的說法。部分測試者回報 Omen Alpha 自我描述為基於 GLM。模型的自我陳述屬於資料,但並非來源證明。
• Omen Alpha 的獨立基準測試。對匿名模型的中立評估將讓社群能將其與八月洩漏的 MiMo-V3-Pro 數據進行比較。
• 在 Go 窗口期之後的揭曉。過去匿名模型在發布後數天至數週內即被認領;無論誰認領 Omen Alpha,都將準確地為該模型命名。
在猜測繼續進行時該怎麼做
實際立場並不取決於誰是對的。Omen Alpha 是一個每月 10 美元訂閱背後的匿名模型,而 Xiaomi MiMo-V3-Flash 是附在其上、未經證實的名稱;兩者都不是今天值得押注生產管線的東西。當某個製造者真正站出來,且底層模型進入一般 API 時,那才是路由層證明其價值的時刻:OrcaRouter 以 0% 加價傳遞供應商列表價格,因此廠商一公布新費率,當天就會在同一個 API 上生效;自動故障轉移則讓你能將一部分真實流量導向未經驗證的新進者,並以你已信任的模型作為後備。與此同時,值得關注的事情很簡單——是否有人認領 Omen Alpha,以及 Xiaomi MiMo-V3-Flash 是否會出現在模型卡上?這兩者之一會發生。

截至2026年9月4日,Xiaomi MiMo-V3-Flash 僅是一個名稱、一種看似合理的產品型態,以及一位知名分析師的推測——而非已發布的模型。V3 世代確實真實存在,足以在7月搶先預覽、8月遭到外流。至於它是否正以代號 Omen Alpha 進行首次公開亮相,這個問題只有 Xiaomi 能回答,而 Xiaomi 至今尚未給出答案。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
