
DeepSeek V4 Pro 对比 MiniMax M3:同样的开放权重玩法,五倍的价格
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77代码
- google新Google: Gemini 3.8 Flash2026-09-0241智能76代码
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72代码
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0340智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69代码
DeepSeek V4 Pro 和 MiniMax M3 都是开放权重推理模型,具备百万 token 上下文,而且都便宜到“预算”一词不再意味着“弱”。但它们的发布看起来再不同不过了:MiniMax M3(MiniMax 的 428B 参数模型,于 2026 年 6 月发布)带着社区许可证和每百万 token 0.30 美元/1.20 美元的价格问世,这一价格低于整个行业;而 DeepSeek V4 Pro(于 2026 年 8 月 13 日发布,非高峰时段 0.66 美元/1.98 美元,高峰时段 1.32 美元/3.96 美元)在六周后到来,采用 MIT 许可的权重,价格略高。转折在于更贵的那个发生了什么:9 月 8 日至 11 日之间,DeepSeek 先是安排 V4 Pro 退役,随后推迟,然后彻底取消了退役,承诺保持计费不变继续提供服务。因此,一个月前看起来还像是“便宜与更便宜”的对决,如今其中一方却有了没人预料到的持久性故事——这让整件事值得重新审视。
以下独立测量数据来自 Artificial Analysis。厂商报告的数据已如此标注。
两个平价开源权重旗舰,指数仅差一分
在 Artificial Analysis Intelligence Index 上,MiniMax M3 得分为 30,在其类别中排名第 16,而 DeepSeek V4 Pro 得分为 36,排名第 7。这两款模型每 token 的成本几乎相同,却存在六分的差距。这就是核心结论:更贵的模型同时也是可量化地更聪明的那个——但只高出六分,而且仅在 V4 Pro 所处的纯文本维度上。MiniMax M3 接受文本、图像和视频输入;V4 Pro 仅支持文本。如果多模态输入是硬性要求,那么比较到此为止——MiniMax M3 是两者中唯一能读取视频的模型。
• 智能指数 — V4 Pro 36(#7/113)对比 MiniMax M3 30(#16/113)
• 价格 — MiniMax M3 每 100 万 $0.30/$1.20,对比 V4 Pro 低峰时段 $0.66/$1.98(高峰时段 $1.32/$3.96)
• 速度 — MiniMax M3 约 103 tokens/秒,对比 V4 Pro 约 81 tokens/秒
• 上下文 — 两者均为 1M tokens
• 参数 — MiniMax M3 总计 428B / 激活 23B,对比 V4 Pro 总计 1.6T / 激活 49B
• 输入 — MiniMax M3 文本/图像/视频 vs V4 Pro 仅文本
• 许可证 — MiniMax 社区许可证 对比 V4 Pro MIT
价格竞赛比价签所显示的更为接近
正面比较,MiniMax M3 的输入价格比 V4 Pro 的错峰费率便宜 2.2 倍,输出价格便宜 1.65 倍。但标价掩盖了缓存和错峰机制。V4 Pro 的错峰时段将其本已很低的价格再砍半,其缓存读取折扣高达约 97%——错峰时每百万缓存 token 约 $0.02。MiniMax M3 的缓存定价则没那么激进。对于复用大型前缀的工作负载——如大段系统提示、长文档、检索语料库——V4 Pro 在错峰缓存窗口中的有效每 token 成本可能低于 MiniMax M3 的标称价格,这与标价排名形成出人意料的反转。在全新 token 工作负载上,MiniMax M3 更便宜;在缓存密集型工作负载上,V4 Pro 可能胜出。
速度方面则呈现出一个类似却相反的情况。MiniMax M3 每秒输出约 103 个 token,而 V4 Pro 为 81 个——是同价位段所有模型中速度最快的,也比若干价格高达其五倍的模型更快。速度优势确实存在,但并不巨大;价格优势更为重要,且这取决于具体的工作负载。
许可证与持久性:九月如何改变了答案
Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINIMAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.
持久性问题——一个月前还是个真问题——成了九月的新闻焦点。DeepSeek 在九月上半月宣布 V4 Pro 将于9月14日退役,随后推迟,接着又在11日取消了这一安排,并公开承诺将继续以不变的计费方式服务该模型,如有变化会提前通知。MiniMax M3 则没有这类戏剧性,因为本来也无人预料会有:它是一款年轻的旗舰,短期内看不到退役安排。但效果是一样的:这场对决的双方如今都有了清晰的路线图,而两周前,其中一方还谈不上这一点。

谁应该选择哪个
如果你的工作负载包含图像或视频输入,那么决策已经明确:MiniMax M3 是两者中唯一能读取它们的那一个,并且价格是同类中最低的。如果你的工作负载仅涉及文本且高度依赖缓存——例如带有大型系统提示词的智能体、长文档 RAG、大型语料库摘要——那么 V4 Pro 的错峰缓存窗口和 MIT 许可证使其成为每次回答成本更优的选择,尤其是它现在已确保会长期保留。如果你的工作负载仅涉及文本且对延迟敏感,MiniMax M3 的 103 tokens/秒和 $0.30/$1.20 使其成为当前最快的低价选项。
通过 OrcaRouter 用一个密钥即可使用这两个模型,提供商的标价以零加价原样传递——所以上面的数字就是你支付的数字——而提供商之间的自动故障转移,恰好实际回答了这场对比无法事先确定的唯一问题:在你的实际负载下,哪个模型的提供商会扛得住。将多模态流量路由到 MiniMax M3、把长上下文文本工作路由到 DeepSeek V4 Pro,只需改动两行路由 DSL,而故障转移意味着任何一方的提供商出现波动都只是一次重试,而不是一次事故。


裁决
这是 DeepSeek V4 Pro 产品线中最接近的一场对决,因为两款模型都很便宜、都采用开放权重,而且都很快。MiniMax M3 在裸价、速度和多模态输入方面胜出。DeepSeek V4 Pro 则在智能水平、许可证清晰度以及——自 9 月 11 日以来的——持久性确定性方面胜出。一句话总结:多模态或对延迟敏感的文本任务交给 MiniMax M3;缓存密集、纯文本或法律敏感型工作负载则交给 DeepSeek V4 Pro。
将多模态流量路由到 MiniMax M3,将长上下文文本工作路由到 DeepSeek V4 Pro:MiniMax M3只需改动两行路由 DSL。
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
