
小米 MiMo-V3-Flash:未发布的快速模型是否运行在 OpenCode 的 Omen Alpha 中?
- google新Google: Gemini 3.8 Flash2026-09-0259智能76代码
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0258智能72代码
- anthropic新Anthropic: Claude Fable 5.12026-09-0166智能82代码
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2658智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1860智能75代码
- obsidianQwen3.8 27B2026-08-1552智能68代码
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69代码
- grokSpaceXAI: Grok 4.62026-08-1261智能77代码
- metaMeta: Muse Spark 1.22026-08-0557智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
Xiaomi MiMo-V3-Flash 尚未由小米发布。目前没有模型卡,没有 Hugging Face 权重,没有定价页面,也没有发布公告——这个名字之所以在流传,原因只有一个:2026 年 9 月 4 日,知名独立 AI 分析师 teortaxesTex 公开表示,他相信 Omen Alpha——即 OpenCode 当天早上开始向其 Go 订阅用户提供的匿名“隐身模型”——就是 Xiaomi MiMo-V3-Flash。他的判断主要依据他在 Omen Alpha 可见的推理痕迹中解读出的、属于 DeepSeek V4 GA 时代模型的思维链——如果这一判断成立,Xiaomi MiMo-V3-Flash 就将是小米基于 DeepSeek 开放 V4 权重训练的快速档模型。这一识别未获任何证实,本文也仅将其视为它的本来面目:一场活跃猜谜游戏中的一条论证充分的假说。
以下是后续内容的基本规则:Omen Alpha 的发布是已确认的事实,而分析师的陈述则被明确标注为一种主张。V3 世代的存有得到了一场会议预告和一份泄露基准的支持,两者均被明确标注为未经小米确认。所谓名为 Xiaomi MiMo-V3-Flash 的模型是否存在的断言,是基于行为的推断,并非小米的声明——而且由于小米从未发表过任何声明,此处也不会将其作为事实重复。
这一主张及其背后的四个理由
触发点是一份开发者报告。一位在OpenCode中测试Omen Alpha的构建者,以@SPAC89的身份发帖称,“Omen Alpha High”——即处于高推理设置下的该模型——在不到十分钟内完成了一项大型编码任务,并且一个耗时长得多的多小时运行正在进行中。teortaxesTex引用并转发了那份报告,表示他相信该模型是小米MiMo-V3-Flash,并给出了四点理由,且全部基于行为特征而非文档证据:
推理轨迹。可见的思维链读起来正像是 DeepSeek V4 GA CoT——他的破绽是“hmm”“fine”,以及以✓开头的清单项。他附上的截图显示,Omen Alpha 正处于“高”设置下的构建中途,其轨迹与该模式相符。
• 速度。模型很快——这正是他所回应的观察——而小米的高速档位历来冠以“Flash”之名。
运营方。DeepSeek 不会进行隐秘推广,因此即便推理能力源自 DeepSeek V4 GA,Omen Alpha 背后的推手也只是基于 DeepSeek 构建的第三方,而非 DeepSeek 本身。
聚类。小米MiMo模型的输出文本与DeepSeek的聚类在一起——这是他用来表示两代模型文本在分布上十分接近的简写,而这正是一个经过DeepSeek训练的模型会呈现的样子。他还提到另一个同样与DeepSeek聚类的替代方案,即StepFun的Step-4,并表示他不确定StepFun当前这一代的情况。
传信者值得一个条款,因为同一事实有利有弊。{{KEEP}}teortaxesTex{{/KEEP}}自称是 DeepSeek 的追随者——他的 X 个人资料自 2023 年以来一直称自己是 DeepSeek 粉丝。这是一个一眼就能认出 DeepSeek V4 推理风格的人的特征,也是一个倾向于看到这种风格的人的特征。
MiMo-V3-Flash 在小米产品线中会处于什么位置
小米今日官方确认的MiMo模型为MiMo-V2.5和MiMo-V2.5-Pro,两者均于2026年4月底以MIT许可证开源。MiMo-V2.5-Pro是一个拥有1.02万亿参数的混合专家(MoE)模型,具备420亿激活参数和100万token的上下文窗口;MiMo-V2.5则是参数规模较小的通用型姊妹模型,拥有3100亿参数。在它们之前的家族谱系中,还有MiMo-V2-Flash(2025年12月,3090亿参数的开源MoE)和MiMo-V2-Pro(2026年3月)。MiMo-V2-Pro之所以与这件事相关,是因为它最初以匿名代号Hunter Alpha进入公众视野,之后小米才正式认领。匿名实地测试对小米来说并非例外,而是其产品发布方式的一部分。
到了 V3 这一代,纪录的重心从已发布的产品滑向了纸面报告。2026 年 7 月的 ICML 会议上,MiMo 团队负责人、研究员罗福莉预先展示了 V3 的架构。最核心的看点是小米称为 High Sparse(高稀疏)的设计:少量全注意力层充当“预言机”(oracle),为周围的稀疏层挑选应当关注的 token;这些稀疏层不单独保留 KV 缓存,而是与全注意力层共享。小米称,这能将 KV 缓存内存占用降至原来的约十分之一,并在约 800 亿参数规模的模型上验证了 11:1 的稀疏层与全注意力层比例——在该稀疏度下质量可与全注意力持平,而作为对照的混合滑动窗口基线则损失了约 7 个 MMLU 分。这些说法来自该团队在会议演讲中的自述,并非独立的评测结果。随后,8 月 21 日,一张据称是 MiMo-V3-Pro 的基准测试截图开始流传,发布者为 Max For AI:SWE-Bench Pro 72.8,对比 GLM 5.3 的 67.9、Kimi K3 的 65.8、Claude Opus 5 的 74.6 与 GPT-5.6 Sol Max 的 75.4;另有 Terminal-Bench 2.0 的 70.6 与 τ3-bench 的 76.4。小米没有证实其中任何内容,V3 是否存在、何时发布,也均未公开。本文传达的重点则更窄:V3 一代显然已在推进之中,但迄今没有任何 V3 模型发布——这正是为何一款未经公布的小米 MiMo-V3-Flash 若悄然现身,会成为新闻,而非例行事件。
为什么 Flash 会合适——以及为什么 OpenCode Go 也会合适
Flash 层级是小米铺开快速、廉价算力的方式;去年 12 月,小米以 MiMo-V2-Flash 也做了同样的事。OpenCode Go 是一个合理的试验场,因为它已经在运行小米当前的开源模型:同一个 Go 列表中,Omen Alpha 显示为每五小时 11,600 次请求,MiMo-V2.5 则显示为 30,100 次,属于该页面最慷慨的配额之一。小米团队若在一个平台上将 V3-Flash 与自家的 MiMo-V2.5 并排测试,就能以零营销成本直接对比上一代,而这个平台本月已经进行过一次匿名发布。这只能说明有一定合理性,并非身份的证据。

产品形态指向同一方向。Omen Alpha在“高”推理设置下不到十分钟即可完成,这符合你对快速推理层级的预期;而流传的Omen Alpha第三方数据——每百万输入token约0.20美元、每百万输出token约0.66美元,来自媒体转载而非官方定价表——使其与DeepSeek V4 Flash一同处于市场低价端。一个行为表现如同快速且廉价的DeepSeek系推理模型的模型,正是基于DeepSeek V4构建的“Flash”层级应有的样貌。以上为转述与推断,再次强调,并非已确认的消息。
与DeepSeek的关联是关键——也是最薄弱的证据
为什么 DeepSeek V4 GA 如此重要:DeepSeek 的 V4 系列在 2026 年 8 月从预览版转为全面可用(GA),当时 DeepSeek V4 Pro 于 8 月 13 日发布了其 GA 构建版本 0813,采用 MIT 许可的开源权重,同时推出的还有价格更低的同门产品 DeepSeek V4 Flash。MIT 许可下的开源权重意味着第三方可以合法地在其基础上进行构建,而社区识别此类模型的惯用方法便是观察它所继承的推理风格:DeepSeek GA 时代的思维链具有可辨识的言语习惯,而 teortaxesTex 表示他在 Omen Alpha 的追踪记录中看到的正是这些习惯。如果他说得对——该追踪记录确实来自 DeepSeek V4 GA,操作方确实是小米——那么 Xiaomi MiMo-V3-Flash 就是小米基于 DeepSeek 开源推理权重打造的快速层级模型。这是一个合法但在战略上值得注意的选择,同时也能完美解释为何一个表面上来自小米的模型,推理风格却与 DeepSeek 如出一辙。
现在是困难的部分。思维链的相似性是最弱的一类模型指纹,因为它属于风格而非结构。本月真正站得住脚的匿名模型识别——将 Ox Alpha 认定为 GLM-5.3-Flash——是基于更硬核的证据:分词器匹配和视频编码取证。目前还没有发布过类似强度的硬指纹,能将 Omen Alpha 指向小米。此外,社区的主流解读指向另一个方向:开发者报告称,Omen Alpha 的后端请求解析在“zhipu”命名空间下;一些测试者称该模型自我标识为基于 GLM;而媒体对这次发布的解读是,Omen Alpha 是智谱 AI 在九天内的第二次匿名发布,紧随其后的是被解读为 GLM-5.3-Flash 的 Ox Alpha 运行。如果这一解读成立,那么带有 DeepSeek 风格的推理要么是风格上的巧合,要么说明智谱的模型本身在训练时带有 DeepSeek 的痕迹——但无论如何,它不是小米的产品。这两派不可能都对,而且两派都没有得到其所指实验室的声明。

什么能解决这个问题
• 要么是小米的声明,要么是权重。自MiMo-V2-Flash起,小米就将其MiMo模型开源,MiMo-V2.5和MiMo-V2.5-Pro以MIT许可证发布;真正的小米MiMo-V3-Flash最可能像GLM-5.3-Flash那样,通过Hugging Face上的权重和模型卡获得确认。
• 一个硬性指纹。分词器匹配是识别 Ox Alpha 的证据;将 Omen Alpha 指向 Xiaomi 的分词器测试尚未发布。
• 模型自身的说法。一些测试者报告称 Omen Alpha 自称基于 GLM。模型的自我报告是数据,但并非来源证明。
• Omen Alpha 的独立基准测试。对匿名模型的中立评估将使社区能够将其与八月份泄露的 MiMo-V3-Pro 数字进行比较。
• Go窗口之后的揭示。过去的匿名模型在发布后数天至数周内被认领;认领Omen Alpha的人将准确命名该模型。
猜测继续进行时该做什么
务实的立场并不取决于谁是对的。Omen Alpha 是一个每月 10 美元订阅背后的匿名模型,而 Xiaomi MiMo-V3-Flash 是附在它上面的一个未经证实的名称;这两者都不值得在今天就把生产管线押上去。当某个厂商真正站出来、底层模型也进入常规 API 时,才是路由层物有所值的时刻:OrcaRouter 以 0% 加价透传提供商的列表价格,所以供应商发布新价格的当天,同一 API 上就会生效;而自动故障转移可让你把一小部分真实流量导向未经证实的新模型,并带有回退到你已经信任的模型的保障。与此同时,需要注意的事情很简单:是否有人出来认领 Omen Alpha,以及 Xiaomi MiMo-V3-Flash 是否会有出现在模型卡上的一天?这两件事中总有一件会发生。

截至2026年9月4日,Xiaomi MiMo-V3-Flash只是一个名称、一个貌似可行的产品形态,以及一位知名分析师的假设——而非已发布的模型。V3系列已经足够真实,7月得以预览,8月遭到泄露。至于其首次公开亮相是否正在以代号Omen Alpha进行,这个问题只有小米能够回答,而小米尚未给出答案。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
