
MiMo-V2.6-Pro 与 MiMo-V2.6:当模型名称不再是模型
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77代码
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0345智能76代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Artificial Analysis 有 MiMo-V2.5 的页面。它没有 MiMo-V2.6 的页面。这种缺失正是这场对比的全部关键:上一代,光秃秃的版本号指向一个你可以下载并调用的检查点。这一代则不是。小米 MiMo-V2.6-Pro 是一个有权重、有价格、有独立测得评分的模型。“MiMo-V2.6”是悬在它上方的一个标签,两者不属于同一类事物——这使得这是一场检查点与名称之间的比较,而不是两个模型之间的比较。
这一点值得精确对待,因为这种差异背后是有价格代价的。Xiaomi MiMo-V2.6-Pro 的标价是每百万输入 token 0.435 美元,每百万输出 token 0.87 美元。Xiaomi MiMo-V2.6-Flash,也就是该标签涵盖的另一个检查点,标价为 0.14 美元和 0.28 美元。如果你因为某个目录、配置文件或采购表只写了“MiMo-V2.6”而再无其他信息,就选错了这两者中的一个,那么在你还没发起一次调用之前,就已经差了三倍。
“MiMo-V2.6”解析后是什么
三件不同的事情,取决于你在哪里读到它。
首先是系列。小米自家的发布材料把 V2.6 这一代描述为包含两个原生全模态检查点——Pro 和 Flash,它们以相互独立的训练运行形式发布。存放这两个检查点的 Hugging Face 合集被直白地命名为 MiMo-V2.6——它目前列出三个条目,把 Pro-UltraSpeed 服务层级也算了进去,而这个合集名称正是最有可能让人只了解到那个光秃秃的版本号、并想当然地以为它命名的是某个模型的地方。
第二种是旗舰型号的简称。在大多数发布报道和大多数简称交流中,“MiMo-V2.6”都指万亿参数级别,因为报道所讨论的正是这款模型。这种解读造成的损害最小,因为它通常指向人们原本所指的模型。
第三个是那个要花钱的:一个目录或配置,其中“MiMo-V2.6”已经坍缩到该供应商恰好提供的那个检查点上。仓库被命名为 MiMo-V2.6-Pro-RL 和 MiMo-V2.6-Flash-RL,而 -RL 后缀是后训练谱系,而不是架在基础模型上的适配器——在你去找与它们配对的非 RL 权重之前,这一点值得知道,因为根本没有。
已不复存在的中端
这种模糊性是新的,原因是产品线的中端消失了。
Artificial Analysis 仍列出一款名为 MiMo-V2.5 的模型,发布于 2026 年 4 月 22 日,在该指数上得分为 25.17,输入 tokens 每百万 0.14 美元、输出每百万 0.28 美元,且开放权重。它排在 MiMo-V2.5-Pro 之下,后者在相同尺度上得分为 26.0,价格为 0.435 美元和 0.87 美元,具备 1M 上下文和 1023B 总参数。那是一个三档的世代:一款廉价的裸名模型、一款旗舰,以及没有任何东西迫使你在这两个极端之间做出选择。
V2.6 这一代有两档任何人都可以调用的层级:顶部的 Pro 和底部的 Flash。两者之间没有中端档位的检查点来承接落在这中间的流量,发布材料中也没有任何一处描述过这样的档位。小米确实在发布权重的同时,一并发布了 MiMo-V2.6-Distill-Qwen-9B 起点和一套 RL 框架,但用于训练工作的蒸馏起点并不等同于面向推理的托管中端档位。
实际上,这意味着本页所描述的那个决定——选 Pro 还是直接用那个光秃秃的名字——本质上是在决定你站在哪一级台阶上。如果你真正想要的是旧的 MiMo-V2.5 档位,那么新一代里最接近的就是 Flash:同样是 $0.14/$0.28 的价格,但附带了高得多的能力宣称。

名称所隐藏的升级
把命名问题搁到一边,底下就有一个清晰、重大且证据充分的事实:这款旗舰在一代之内取得了长足进步,价格却没有改变。
• 指数得分 — MiMo-V2.5-Pro 在 Artificial Analysis 智能指数上得分 26.0,而小米 MiMo-V2.6-Pro 为 46.3,两者均由 Artificial Analysis 测得,而非小米
• 每 token 价格 — 不变:输入 $0.435,输出 $0.87,两代产品均如此
• 每项指数任务成本 — MiMo-V2.5-Pro 为 $0.054,而 MiMo-V2.6-Pro 为 $0.1332,这一增长源于输出冗长,而非费率变化
• 参数量 — 总计 1023B、激活 42B,而对比对象为总计 1.02T、激活 42B
• 上下文 — 1M tokens,不变
• 许可证 — MIT,不变
• 发布日期 — 2026年4月22日,而对比对象为 2026年9月21日
分数才是真正重要的部分,而它恰恰是命名所掩盖的部分。五个月内在价格表未变的情况下提升二十个指数点,是比发布报道所呈现的更大的代际跨越——其中大部分报道都聚焦于“顶级开放权重模型”,而这是一个关于整个领域的说法,而非关于这次升级的说法。如果你还在运行上一代旗舰模型,并犹豫迁移是否值得投入工程,那么这一行就是答案,而且它比营销材料中的任何内容都更有说服力。
这个注意事项与本次发布中小米给出的每一个数字都相关。26.0 和 46.3 都是 Artificial Analysis 的测量值,因此它们彼此之间以及与同一索引版本上的其他模型之间具有可比性。厂商自己的基准测试表——DeepSWE v1.1、Terminal Bench、AutomationBench 以及其他——则不具备这种可比性,不应被用来计算升级增量。把一个实测分数与一个厂商分数混在一起来得出“提升点数”,是本次发布报道中最常见的错误。
为什么名称会成为一个运营问题
一旦标签进入系统,这些就都不是吹毛求疵了。一个模型标识符若解析到两个价格相差 3.1 倍的检查点,就是一场只等触发条件的计费事故,而它有三个必然会出错的位置。配置与环境文件,像 mimo-v2.6 这样的字符串写进去一次后就再也没人回头看。成本表,按 token 计算的估算值被挂到系列名称上,然后被套用到错误的档位。还有评估行,结果被归入某个家族名下,之后却被当作旗舰型号的属性来读取。
还有第四个地方,而且正是它特别坑了这次发布:参数量。Xiaomi MiMo-V2.6-Pro 的文档标注为总计 1.02T、激活 42B,而其 Hugging Face 仓库报告 Safetensors 模型大小为 524B。MiMo-V2.6-Flash 的文档标注约为总计 309B、激活 15B,而其仓库报告为 159B。这两组数字都对不上。如果你的容量规划看的是模型卡,而你的资源预置看的是仓库,你就会对同一个部署得出两种不同的规模估算。
在所有地方都固定写上检查点名称,而不是系列名称。这就是全部的补救办法,它不花一分钱,直到有一天它替你保住了整整一个季度的预算。

这在路由器上如何解析
命名问题本质上是目录问题,而目录恰恰是最容易修正的地方。通过一个 API 密钥以精确标识符来寻址模型,而不是跨多个提供商账户按系列名称来寻址,这意味着你配置中的字符串与计费系统看到的字符串是同一个——而这正是像“MiMo-V2.6”这样的名称所破坏的特性。这也是为什么我们以 0% 加价原样传递提供商的标价,而不是加上我们自己的利润:页面上的价格就是提供商设定的价格,因此一个被你误判的层级对所有人来说都是朝着同一个方向出错,而不是朝着只针对我们的方向出错。
把限制说清楚:我们不托管任何一个 MiMo-V2.6 检查点,所以目前两者都无法通过我们进行路由;而且根据各自的 Hugging Face 仓库,两者均未被任何第三方推理提供商部署。通往两者的途径是 Xiaomi 自己的平台以及收录它的各个目录。但本页所主张的标识符规范适用于你调用的每一个模型,这也是即便对于你尚未路由的模型,路由层仍然值得拥有的原因。
要点总结
如果你来这里是为了比较两个模型,那这种比较无法进行——因为其中有一个并不是模型。Xiaomi MiMo-V2.6-Pro 才是那个检查点:在指数上为 46.3,每百万 token 0.435 美元和 0.87 美元,MIT 权重,1M 上下文,并且是 Artificial Analysis 成本帕累托线上、近免费档位之上唯一的开放权重条目。MiMo-V2.6 则是它上方的标签,也是它旁边的标签,涵盖一个价格只有三分之一、更便宜的检查点,以及一个价格高达十倍、更快的服务层级。
真正值得做的,反而是命名所掩盖的那种比较:这一代旗舰对比上一代只带一个纯版本号的那款。二十个指数点、五个月、费率不变。这个数字才该摆在批准迁移的人面前——而不是那个关于在排行榜上排第一的数字。

