文章《Xiaomi MiMo-V3-Flash》的标题主卡片:眉题为“OrcaRouter · 模型雷达 — 爆料”,标题为“Xiaomi MiMo-V3-Flash”,副标题为“一位分析师称,OpenCode 上的匿名模型 Omen Alpha 就是小米尚未发布的快速模型。小米方面无人证实这一点。”左侧卡片标题为“说法”,内容为“teortaxesTex,2026年9月4日 — 引用发布了一则第一手的 Omen Alpha 速度测试”,并附一行:“Omen Alpha 就是 Xiaomi MiMo-V3-Flash。”右侧卡片标题为“状态”,内容为“小米未公布任何信息 — 没有权重、没有模型卡、没有定价页面”,并附一行:“未经证实 · 仅推理”。另有四个标签:“制造方:未经证实”“思维链显示为 DeepSeek V4 GA”“Omen Alpha · 仅限 OpenCode Go”和“高推理 · 快速”。OrcaRouter 标志合成在右下角。
Guides & Insights

小米 MiMo-V3-Flash:未发布的快速模型是否运行在 OpenCode 的 Omen Alpha 中?

作者

Gideon Frost

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Xiaomi MiMo-V3-Flash 尚未由小米发布。目前没有模型卡,没有 Hugging Face 权重,没有定价页面,也没有发布公告——这个名字之所以在流传,原因只有一个:2026 年 9 月 4 日,知名独立 AI 分析师 teortaxesTex 公开表示,他相信 Omen Alpha——即 OpenCode 当天早上开始向其 Go 订阅用户提供的匿名“隐身模型”——就是 Xiaomi MiMo-V3-Flash。他的判断主要依据他在 Omen Alpha 可见的推理痕迹中解读出的、属于 DeepSeek V4 GA 时代模型的思维链——如果这一判断成立,Xiaomi MiMo-V3-Flash 就将是小米基于 DeepSeek 开放 V4 权重训练的快速档模型。这一识别未获任何证实,本文也仅将其视为它的本来面目:一场活跃猜谜游戏中的一条论证充分的假说。

以下是后续内容的基本规则:Omen Alpha 的发布是已确认的事实,而分析师的陈述则被明确标注为一种主张。V3 世代的存有得到了一场会议预告和一份泄露基准的支持,两者均被明确标注为未经小米确认。所谓名为 Xiaomi MiMo-V3-Flash 的模型是否存在的断言,是基于行为的推断,并非小米的声明——而且由于小米从未发表过任何声明,此处也不会将其作为事实重复。

这一主张及其背后的四个理由

触发点是一份开发者报告。一位在OpenCode中测试Omen Alpha的构建者,以@SPAC89的身份发帖称,“Omen Alpha High”——即处于高推理设置下的该模型——在不到十分钟内完成了一项大型编码任务,并且一个耗时长得多的多小时运行正在进行中。teortaxesTex引用并转发了那份报告,表示他相信该模型是小米MiMo-V3-Flash,并给出了四点理由,且全部基于行为特征而非文档证据:

推理轨迹。可见的思维链读起来正像是 DeepSeek V4 GA CoT——他的破绽是“hmm”“fine”,以及以✓开头的清单项。他附上的截图显示,Omen Alpha 正处于“高”设置下的构建中途,其轨迹与该模式相符。

• 速度。模型很快——这正是他所回应的观察——而小米的高速档位历来冠以“Flash”之名。

运营方。DeepSeek 不会进行隐秘推广,因此即便推理能力源自 DeepSeek V4 GA,Omen Alpha 背后的推手也只是基于 DeepSeek 构建的第三方,而非 DeepSeek 本身。

聚类。小米MiMo模型的输出文本与DeepSeek的聚类在一起——这是他用来表示两代模型文本在分布上十分接近的简写,而这正是一个经过DeepSeek训练的模型会呈现的样子。他还提到另一个同样与DeepSeek聚类的替代方案,即StepFun的Step-4,并表示他不确定StepFun当前这一代的情况。

传信者值得一个条款,因为同一事实有利有弊。{{KEEP}}teortaxesTex{{/KEEP}}自称是 DeepSeek 的追随者——他的 X 个人资料自 2023 年以来一直称自己是 DeepSeek 粉丝。这是一个一眼就能认出 DeepSeek V4 推理风格的人的特征,也是一个倾向于看到这种风格的人的特征。

MiMo-V3-Flash 在小米产品线中会处于什么位置

小米今日官方确认的MiMo模型为MiMo-V2.5和MiMo-V2.5-Pro,两者均于2026年4月底以MIT许可证开源。MiMo-V2.5-Pro是一个拥有1.02万亿参数的混合专家(MoE)模型,具备420亿激活参数和100万token的上下文窗口;MiMo-V2.5则是参数规模较小的通用型姊妹模型,拥有3100亿参数。在它们之前的家族谱系中,还有MiMo-V2-Flash(2025年12月,3090亿参数的开源MoE)和MiMo-V2-Pro(2026年3月)。MiMo-V2-Pro之所以与这件事相关,是因为它最初以匿名代号Hunter Alpha进入公众视野,之后小米才正式认领。匿名实地测试对小米来说并非例外,而是其产品发布方式的一部分。

到了 V3 这一代,纪录的重心从已发布的产品滑向了纸面报告。2026 年 7 月的 ICML 会议上,MiMo 团队负责人、研究员罗福莉预先展示了 V3 的架构。最核心的看点是小米称为 High Sparse(高稀疏)的设计:少量全注意力层充当“预言机”(oracle),为周围的稀疏层挑选应当关注的 token;这些稀疏层不单独保留 KV 缓存,而是与全注意力层共享。小米称,这能将 KV 缓存内存占用降至原来的约十分之一,并在约 800 亿参数规模的模型上验证了 11:1 的稀疏层与全注意力层比例——在该稀疏度下质量可与全注意力持平,而作为对照的混合滑动窗口基线则损失了约 7 个 MMLU 分。这些说法来自该团队在会议演讲中的自述,并非独立的评测结果。随后,8 月 21 日,一张据称是 MiMo-V3-Pro 的基准测试截图开始流传,发布者为 Max For AI:SWE-Bench Pro 72.8,对比 GLM 5.3 的 67.9、Kimi K3 的 65.8、Claude Opus 5 的 74.6 与 GPT-5.6 Sol Max 的 75.4;另有 Terminal-Bench 2.0 的 70.6 与 τ3-bench 的 76.4。小米没有证实其中任何内容,V3 是否存在、何时发布,也均未公开。本文传达的重点则更窄:V3 一代显然已在推进之中,但迄今没有任何 V3 模型发布——这正是为何一款未经公布的小米 MiMo-V3-Flash 若悄然现身,会成为新闻,而非例行事件。

为什么 Flash 会合适——以及为什么 OpenCode Go 也会合适

Flash 层级是小米铺开快速、廉价算力的方式;去年 12 月,小米以 MiMo-V2-Flash 也做了同样的事。OpenCode Go 是一个合理的试验场,因为它已经在运行小米当前的开源模型:同一个 Go 列表中,Omen Alpha 显示为每五小时 11,600 次请求,MiMo-V2.5 则显示为 30,100 次,属于该页面最慷慨的配额之一。小米团队若在一个平台上将 V3-Flash 与自家的 MiMo-V2.5 并排测试,就能以零营销成本直接对比上一代,而这个平台本月已经进行过一次匿名发布。这只能说明有一定合理性,并非身份的证据。

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

产品形态指向同一方向。Omen Alpha在“高”推理设置下不到十分钟即可完成,这符合你对快速推理层级的预期;而流传的Omen Alpha第三方数据——每百万输入token约0.20美元、每百万输出token约0.66美元,来自媒体转载而非官方定价表——使其与DeepSeek V4 Flash一同处于市场低价端。一个行为表现如同快速且廉价的DeepSeek系推理模型的模型,正是基于DeepSeek V4构建的“Flash”层级应有的样貌。以上为转述与推断,再次强调,并非已确认的消息。

与DeepSeek的关联是关键——也是最薄弱的证据

为什么 DeepSeek V4 GA 如此重要:DeepSeek 的 V4 系列在 2026 年 8 月从预览版转为全面可用(GA),当时 DeepSeek V4 Pro 于 8 月 13 日发布了其 GA 构建版本 0813,采用 MIT 许可的开源权重,同时推出的还有价格更低的同门产品 DeepSeek V4 Flash。MIT 许可下的开源权重意味着第三方可以合法地在其基础上进行构建,而社区识别此类模型的惯用方法便是观察它所继承的推理风格:DeepSeek GA 时代的思维链具有可辨识的言语习惯,而 teortaxesTex 表示他在 Omen Alpha 的追踪记录中看到的正是这些习惯。如果他说得对——该追踪记录确实来自 DeepSeek V4 GA,操作方确实是小米——那么 Xiaomi MiMo-V3-Flash 就是小米基于 DeepSeek 开源推理权重打造的快速层级模型。这是一个合法但在战略上值得注意的选择,同时也能完美解释为何一个表面上来自小米的模型,推理风格却与 DeepSeek 如出一辙。

现在是困难的部分。思维链的相似性是最弱的一类模型指纹,因为它属于风格而非结构。本月真正站得住脚的匿名模型识别——将 Ox Alpha 认定为 GLM-5.3-Flash——是基于更硬核的证据:分词器匹配和视频编码取证。目前还没有发布过类似强度的硬指纹,能将 Omen Alpha 指向小米。此外,社区的主流解读指向另一个方向:开发者报告称,Omen Alpha 的后端请求解析在“zhipu”命名空间下;一些测试者称该模型自我标识为基于 GLM;而媒体对这次发布的解读是,Omen Alpha 是智谱 AI 在九天内的第二次匿名发布,紧随其后的是被解读为 GLM-5.3-Flash 的 Ox Alpha 运行。如果这一解读成立,那么带有 DeepSeek 风格的推理要么是风格上的巧合,要么说明智谱的模型本身在训练时带有 DeepSeek 的痕迹——但无论如何,它不是小米的产品。这两派不可能都对,而且两派都没有得到其所指实验室的声明。

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

什么能解决这个问题

• 要么是小米的声明,要么是权重。自MiMo-V2-Flash起,小米就将其MiMo模型开源,MiMo-V2.5和MiMo-V2.5-Pro以MIT许可证发布;真正的小米MiMo-V3-Flash最可能像GLM-5.3-Flash那样,通过Hugging Face上的权重和模型卡获得确认。

• 一个硬性指纹。分词器匹配是识别 Ox Alpha 的证据;将 Omen Alpha 指向 Xiaomi 的分词器测试尚未发布。

• 模型自身的说法。一些测试者报告称 Omen Alpha 自称基于 GLM。模型的自我报告是数据,但并非来源证明。

• Omen Alpha 的独立基准测试。对匿名模型的中立评估将使社区能够将其与八月份泄露的 MiMo-V3-Pro 数字进行比较。

• Go窗口之后的揭示。过去的匿名模型在发布后数天至数周内被认领;认领Omen Alpha的人将准确命名该模型。

猜测继续进行时该做什么

务实的立场并不取决于谁是对的。Omen Alpha 是一个每月 10 美元订阅背后的匿名模型,而 Xiaomi MiMo-V3-Flash 是附在它上面的一个未经证实的名称;这两者都不值得在今天就把生产管线押上去。当某个厂商真正站出来、底层模型也进入常规 API 时,才是路由层物有所值的时刻:OrcaRouter 以 0% 加价透传提供商的列表价格,所以供应商发布新价格的当天,同一 API 上就会生效;而自动故障转移可让你把一小部分真实流量导向未经证实的新模型,并带有回退到你已经信任的模型的保障。与此同时,需要注意的事情很简单:是否有人出来认领 Omen Alpha,以及 Xiaomi MiMo-V3-Flash 是否会有出现在模型卡上的一天?这两件事中总有一件会发生。

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

截至2026年9月4日,Xiaomi MiMo-V3-Flash只是一个名称、一个貌似可行的产品形态,以及一位知名分析师的假设——而非已发布的模型。V3系列已经足够真实,7月得以预览,8月遭到泄露。至于其首次公开亮相是否正在以代号Omen Alpha进行,这个问题只有小米能够回答,而小米尚未给出答案。

本文中的对比2

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

providers@orcarouter.ai

加入我们的社区

Discordsupport@orcarouter.aiXGitHubYouTube