
fal 的 H3 Max 在不到 3 秒内渲染出 5 秒的片段——如今在图像转视频领域排名第一
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2658智能72代码
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百万 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75代码
- obsidian新Qwen3.8 27B2026-08-1552智能68代码
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69代码
- grokSpaceXAI: Grok 4.62026-08-1261智能77代码
- metaMeta: Muse Spark 1.22026-08-0557智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
新款MiniMax H3 Max发布中最令人惊讶的数字并非排行榜名次——尽管那也很引人注目:fal基于MiniMax H3进行后训练的视频模型刚刚在Artificial Analysis的图像转视频排行榜上夺得第一名。真正令人惊讶的是fal自家模型页面上的计时数据:一个5秒的示例片段显示推理时间为2.77秒。这是来自公共API的亚实时生成——整个片段在同等片段的实时播放完成之前就已渲染完毕——也是此次发布之所以能吸引寻常模型发布圈以外关注的原因。MiniMax H3 Max可生成5至15秒、最高768p且带有原生音频的片段,目前该价格享有50%的发布折扣,优惠将于9月1日截止。
为什么“3秒以内”比领奖台更重要
每个视频模型都声称自己某种意义上的“快”,因此有必要精确理解 fal 的这个数字实际说明了什么。2.77 秒来自 fal 模型页面自身五秒片段示例输出的推理计时——这是供应商报告的数字,而非独立测量结果,也尚未在我们其他人能运行的任何地方得到复现。即使带着这一保留意见,这仍是一个惊人的数字,因为五秒视频耗时 2.77 秒,实时因子约为 0.55。一个生成片段比片段播放速度还快的模型,将视频生成从批量任务变成了可以放入循环中的操作:生成、评判、再生成,全部都在一个人原本等待单次渲染的时间内完成。
{{1}}这个权衡与那条推文“速度与质量”的框架所指出的其实是同一件事。0.55x的实时倍率来自fal将后训练与其自家推理栈协同优化——这是fal自己的说法,除排行榜外没有任何独立基准复现过——而且在768p下比在更高分辨率下更容易实现。反方向也没有免费的午餐:MiniMax H3 Max最高只支持768p,因此速度在部分上正取决于这一上限。你购买的是H3系列中速度最快的一档,而分辨率阶梯恰好止步于速度起步之处。{{/1}}
它在版块上的落点位置
Artificial Analysis 的带音频排行榜(数据采集于2026-08-27)将 MiniMax H3 Max 列为图像转视频第一名,Elo 1,204——领先字节跳动的 Dreamina Seedance 2.0 720p(1,191)13分,领先基础版 MiniMax H3(1,184)20分。在文本转视频方面,它以 Elo 1,235 排名第三,处于前几名仅6分之差的冲刺局面:Wan 3.0 为1,240,Gemini Omni Flash 为1,237,MiniMax H3 Max 为1,235,基础版 MiniMax H3 为1,226。这些是来自 Artificial Analysis 自有竞技场的盲测人类偏好 Elo 评分,并非厂商数据;与其他竞技场一样,随着新模型和新投票的出现,它们也会不断变化。

• 图生视频(带音频)——MiniMax H3 Max #1,Elo 1,204。Dreamina Seedance 2.0 720p #2,1,191。MiniMax H3 #3,1,184。
• 文生视频(含音频) — Wan 3.0 #1, 1,240。Gemini Omni Flash #2, 1,237。MiniMax H3 Max #3, 1,235。MiniMax H3 #4, 1,226。
• 采集日期——2026-08-27;随着选票累积,两个榜单都会变动。
发布价格,以及其上的时钟
这个定价有截止日期,这一点是大多数报道会漏掉的。fal 正在对 MiniMax H3 Max 推出 50% 的首发折扣,其模型页面显示该折扣将于 9 月 1 日结束。促销价下,768p 为每秒 0.04 美元,即每分钟 2.40 美元;480p 为每秒 0.025 美元,即每分钟 1.50 美元。折扣期结束后,标准价格分别为 768p 每秒 0.08 美元(每分钟 4.80 美元)和 480p 每秒 0.05 美元(每分钟 3.00 美元)。
把那个和基础版MiniMax H3放在一起对比,促销其实起了很大作用。在同一块Artificial Analysis排行榜上,基础版模型的跟踪价格是每分钟$7.80——但那是2K分辨率的价格。而在MiniMax H3 Max实际竞争的768p分辨率下,基础版MiniMax H3的标价是每秒$0.08,也就是每分钟$4.80——这正好是后训练版本在9月1日之后的标准价格。换句话说:今天标题上$2.40对$7.80的差距,实际上是打了折的768p档位与未打折的2K档位之间的比较。真正干净的对比应该放在768p下,而那里的价格优势会一直持续到折扣结束。

fal实际上改变了什么
fal 将 MiniMax H3 Max 描述为在 MiniMax H3 基础上经后训练而来,以增强指令遵循能力、改善美学效果,并与 fal 的定制推理栈联合优化以获得更高吞吐量——速度正是来源于这一部分。从外部可衡量的,是它的输出规格:时长 5 至 15 秒、带原生音频、最高 768p 的片段,同时配套提供同系列的文生视频和参考图生视频端点。真正要记住的限制是 768p 这个上限。这意味着“Max”是关于排行榜和速度的说法,而不是关于分辨率阶梯:基础版 MiniMax H3 的开源权重同样止步于 768p,而其托管 API 则通过一个仅限 API 的再生成模块达到 2K。由该开源版本派生出的后训练模型,继承了同样的上限。
开放权重问题
fal已表示有意发布MiniMax H3 Max的权重,这将使该后训练模型在两个带音频榜单上成为排名最高的开放权重模型——领先于目前占据该榜首的基础版MiniMax H3。这是否能真正以开放形式落地,仍是悬而未决的问题。基础版MiniMax H3于8月3日以自定义社区许可证形式开放,根据MiniMax自身的条款,该许可证排除了在欧盟、英国、韩国和美国使用该模型及其输出的权限,并要求年收入超过2000万美元的商业用途须事先获得书面授权。如果H3 Max的权重以任何类似条款发布,那么"开放"将带着同样的地域限制——外加一个额外的复杂因素:由第三方构建的后训练模型在许可方面比原始模型处于更灰色地带。
从路由器调用它
就实际用途而言,该系列中可路由的那一半是基础模型。MiniMax H3 今天已在 OrcaRouter 上以供应商列表价提供——768p 每秒 0.08 美元,2K 每秒 0.13 美元——0% 加价,并配备自动故障转移,因此团队无需接入一个才发布几天的供应商端点,即可通过一个 API 调用 H3 系列。MiniMax H3 Max 本身尚未被路由;它只能通过开发者自己的 API 使用。这正是故障转移习惯的适用场景:你可以针对当前排名第一的图生视频模型进行原型开发,而不必将生产路径押在它身上;如果 H3 Max 被某个路由供应商接入,它会当天以列表价出现——包括供应商的促销——而不是通过一个既耗费你的时间又包含他们加价的手工集成。

接下来几周值得关注的内容
三个日期和决策将决定这次首发会成为一个高光时刻还是历史注脚。第一,9月1日:当50%折扣结束时,768p价格翻倍至与基础版持平,"$2.40图生视频领先者"会变成"$4.80图生视频领先者"——对于任何计划持续大批量使用的用户来说,这改变了产品的价值故事。第二,权重:fal是否真的会放出权重,以及采用何种许可证。第三,竞技场:随着投票不断累积,文生视频榜首六分险胜的局面能否保持。这些都还没有定论,而这恰恰说明,一个刚刚以半价登顶排行榜的亚实时模型,只是故事的开端,而非结尾。
