
Vidu Q4 Preview vs Grok Imagine Video:一月领跑 Arena 的模型,如今排名第九
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
三个数字就能勾勒出这场对决,而它们没有一个来自规格表。在 Artificial Analysis 的图生视频榜单上,Vidu Q4 Preview以 1,179 分位列第三,身后积累着 5,543 张选票。Grok Imagine Video 1.5则以 1,098 分排在第九。2026 年 1 月版本的 Grok Imagine Video 依旧在榜,也依旧能以自己之名调用,以 1,072 分位列第十四——而这两个 Grok 条目的定价分别为每分钟 8.40 美元和 4.20 美元,也就是说,较新的那个价格正好翻了一倍,换来的只是多出二十六点 Elo。
Vidu Q4 Preview 是一个构建版本,由生数科技于 2026 年 10 月 7 日发布,作为完整 Q4 模型之前的首次公开预览,包含两种模式:图生视频和参考生视频。Grok Imagine Video 是一个系列,至少在两个榜单上共有三个条目。这项比较真正关乎的是,九个月时间里一个排行榜位次会经历怎样的变化,而 Vidu 的发布正是为说明这一点而到来的。
同一模型的两个版本,Elo 相差二十六
Artificial Analysis,查阅于2026年10月8日,保留音频,图生视频排行榜(AA-Video-I2V v1.0):
• Vidu Q4 Preview — 第 3 名,1,179 ±10,5,543 个样本,2026 年 10 月,$7.20/分钟
• Grok Imagine Video 1.5 — 第9名,1,098 ±8,5,267 个样本,2026年5月,$8.40/分钟
• grok-imagine-video — 第14名,1,072 ±7,14,371 个样本,2026年1月,每分钟 4.20 美元
而在文生视频(AA-Video-T2V v2.0)方面,则是一个独立榜单,采用其自有的评分标准:
• Grok Imagine Video 1.5 — 第11名,1,045 ±9,4,056 个样本,2026年5月,$15.00/分钟
• Grok Imagine Video 1.5 Lite — 第 17-18 位,993 ±10,5,715 个样本,2026 年 8 月,$8.40/分钟
• Vidu Q4 Preview — 不存在
第一组数据中有两点格外突出。Grok Imagine Video 的 1 月版本在所有对比模型中得票最多——14,371 票,几乎是 Vidu Q4 Preview 的 5,543 票的三倍,也几乎是 1.5 版本得票的三倍。当某个模型在 1 月以竞技场领先者身份发布时,到了 10 月,样本量就会呈现这种样子:社区曾对它大量投票,然后便停止了。分数稳定且测量充分,但已不再接近榜首。
第二件事是价格倒挂。Grok Imagine Video 1.5 的每分钟费率是其 1 月前代的两倍,Elo 评分则高出二十六分。二十六分刚好落在两个区间合并后的范围之外——±8 和 ±7——所以这一提升很可能是真实的,但这类幅度的进步通常来自代际更新,而非全新架构,而它却以双倍价格出售。与此同时,Vidu Q4 Preview 比 1.5 版本高出八十一 Elo,定价却低于它,为 7.20 美元对 8.40 美元。这是一个更新的模型在两个维度上都击败了更旧的模型,这本应是常态,却很少如此干净利落地发生。
第三件怪事出现在两个榜单之间。同一个 Grok Imagine Video 1.5,在图像转视频上每分钟 8.40 美元,在文本转视频上却是每分钟 15.00 美元,而且按另一个榜单的尺度,它的得分还更低。如果你计划开展 Grok 工作负载,你选择的输入模态会让费率相差大约百分之八十。

Grok Imagine Video 实际上能为你带来什么
这并不是一个糟糕的模型,本文也不打算假装相反。有两件事是它能做到、而 Vidu Q4 Preview 做不到的:
它接受文本提示词。Vidu Q4 Preview 的产品页面只列出了两种模式——图生视频和参考生视频——其 API 文档也只记录了 /ent/v2/img2video 和 /ent/v2/reference2video,除此之外别无其他。它没有文生视频端点。Grok Imagine Video 1.5 及其 Lite 版本都出现在文生视频榜单上,因此,如果你的流程是从书面提示词开始的,这两个模型中有一个可供你使用,而另一个则根本不行。
它有一个低价档位。在图生视频排行榜上,1 月版本为每分钟 4.20 美元,而同一排行榜上 Vidu Q4 Preview 为 7.20 美元;Lite 档的 8.40 美元位于文生视频排行榜,那是一个有自己评分标准的独立排行榜。如果你要大批量生成,并且能接受第五档的分数,那么 Grok 系列的低端是本文中最便宜的选择——1 月版本以 4.20 美元获得 1,072 Elo,比 Vidu Q4 Preview 低 107,但每分钟也便宜 3.00 美元。

Vidu Q4 Preview 能为你带来什么
Vidu 这一边则是在二者共有的维度上更强的生成模型,并且拥有大得多的参考预算。
• 分辨率 — Vidu Q4 Preview 最高支持 4K 10 位色彩(2K 和 4K),而 Grok Imagine Video 在这些板块中未记录支持 4K
• 片段长度 — Vidu Q4 Preview 的图生视频为 3-16 秒,参考生视频为 1-16 秒,而 Grok Imagine Video 未公布到同样详细的程度
• 参考输入 — Vidu Q4 Preview 最多支持 15 张参考图像和最多 3 段参考音频,而 Grok Imagine Video 尚未公布达到这一水平
• 音频默认开启 — Vidu Q4 Preview 的图生视频端点带有一个 audio 参数,默认值为 true,因此除非你将其禁用,否则声音会随画面一同输出
• 文本生成视频——缺席,而这是这份清单上唯一一条反向而行的
上方的每一个 Vidu 数字都是厂商自己提供的,也应当这样解读。本文中唯一经过独立测量的数字是 Elo,而在这一指标上,Vidu Q4 Preview 比 Grok Imagine Video 1.5 领先八十一分,且票数少一千票。八十一 Elo 大约是合并区间宽度的五倍。它在今天是一个真实的差距,而它的日期是 2026 年 10 月,这意味着这个差距所对应的时刻不同于 Grok 分数所处的时刻。

预览版构建是一个公平的对手吗?
生数科技的表述异常直接:Vidu Q4 Preview 先于完整的 Q4 模型发布,让创作者能在真实项目中使用它,并帮助塑造最终版本。其定价被描述为促销价。最终定价、支持的分辨率、功能可用性及使用条款可能因套餐和地区而异。API 文档中存在一个拼写错误的别名,viduq4-previerw,就挨着正确的{{4}}viduq4-preview{{/4}}{{5}}——这种细节,正式发布的产品通常会清理掉,而预览版往往不会。{{/5}}viduq4-preview——这种细节,正式发布的产品通常会清理掉,而预览版往往不会。
因此,这 81 Elo 是由一个其自家厂商表示并非最终版的构建取得的,价格也是其自家厂商所说的促销价。这两处折让都对 Vidu 有利——模型很可能会改进,价格也很可能会上涨——但它们也意味着这两个数字都不是承诺。任何依据本页做预算的人,都应预计费率会在 Q4 发布时发生变化,并且届时应重新阅读榜单,而不是排名。
如果每隔几周就要更新一次的预览版构建正是问题所在,那这正是自动故障转移存在的意义:一个兼容 OpenAI 的端点,覆盖 200 多个模型,服务商的标价原样透传、不额外加价,因此促销费率结束只是账单条目的一次变更,而不是重新谈判;某条路由不可用时,请求会转而走其他线路,而不是直接失败。坦白说清楚覆盖范围——Vidu Q4 Preview 不是 OrcaRouter 的路由,Grok Imagine Video 也不是。我们确实提供的视频模型,包括 MiniMax H3,与文本模型共用同一个密钥和端点。
狭隘的答案
如果你想要最好的图生视频效果,而你的输入是一帧,那么 Vidu Q4 Preview 比 Grok Imagine Video 的当前版本高出八十一个 Elo,而且实测价格更低,除了价格底线之外,Grok 这边并没有任何强有力的理由。如果你想要表现尚可的最便宜方案,Grok Imagine Video 的 1 月版本以 4.20 美元的价格、1,391 Elo、14,371 票,是一个经过充分实测、投票充分、刻意做便宜的选择,而 Vidu 在这个价位上什么都没有。如果你的输入是一句话,那么这两个家族中,只有 Grok 家族还在场上。
什么会改变这一点:Vidu Q4 的完整发布,它可能新增模式,也可能缩小价格差距;以及 AA-Video-I2V v2.0,其发布时宣称将带来一套全新的分类体系和一个全新的投票池,那会重置本页上的每一个数字,而不是对它做微调。在这两者中任何一个落地之前,值得记住的立场,是样本数量告诉你的那一个——Vidu 的 5,543 张选票只有一天的历史,Grok 一月版本的 14,371 张已有九个月之久,而排行榜是一张照片,不是一份持久的名次。
