一张为 Vidu Q4 Preview 对比 Google Veo 3.1 生成的标题卡,副标题为“三档 Veo,一个 Vidu 版本”,卡片上的标签分别写着“Vidu Q4 Preview — Elo 1,179”“Veo 3.1 — Elo 1,082”和“Veo 3.1 Lite — Elo 1,071”。OrcaRouter 标志位于右下角带内边距的条带中。
Guides & Insights

Vidu Q4 Preview 对比 Google Veo 3.1:Veo 分三档售卖,而档位之间的差距比向上跨档的差距还要小

作者

Elias Hawthorne

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

谷歌的 Veo 3.1分为三个层级。在 Artificial Analysis 的图生视频榜单上,它们的得分分别是 1,082、1,071 和 1,066——整个区间相差十六个 Elo——而它们的每分钟价格却相差五倍,从 4.80 美元到 24.00 美元。Vidu Q4 Preview只是一个模型,而非三个,在同一榜单上得分 1,179,标价为每分钟 7.20 美元。按顺序读这些数字,实际问题就不再是"该选哪个 Veo 层级",而变成了"为什么还要买其中任何一个"——这并不是大多数页面所写的对比,它值得下面给出具体的回答,而不是耸耸肩了事。

Vidu Q4 Preview 于 2026 年 10 月 7 日由 Shengshu Technology 发布,作为其下一代旗舰产品在完整 Q4 版本发布前的首次公开预览,提供两种模式:图生视频和参考生视频。Veo 3.1 自 2026 年 1 月起就已面世,并于 3 月新增 Lite 层级,它既能接受文本提示,也能接受图像。形态不同,版本不同,而在同一个榜单上,它们可以相互衡量。

A generated two-column scoreboard for Vidu Q4 Preview and Google Veo 3.1. Left column rows read 'Image-to-video Elo: 1,179', 'Tiers: one build', 'Text-to-video: none', 'Measured rate: $7.20 per minute', 'Provenance: none stated' and 'Max resolution: 4K'; right column rows read 'Image-to-video Elo: 1,082 / 1,071 / 1,066', 'Tiers: three', 'Text-to-video: yes', 'Measured rate: $24.00 / $9.00 / $4.80 per minute', 'Provenance: SynthID plus C2PA' and 'Max resolution: not stated'. A footer reads 'Elo and rates per Artificial Analysis, 8 October 2026; provenance per Google DeepMind.' The OrcaRouter logo sits in the bottom-right padded strip.

Veo的等级阶梯,从榜单上直接读出

以下所有数据均来自Artificial Analysis,读取于2026年10月8日,音频保留。每个榜单都有各自的Elo量表和各自的投票池,因此这两个区块彼此之间不可比较——只能在各自内部进行比较。

图生视频(AA-Video-I2V v1.0):

• Vidu Q4 Preview — 第 3 名,1,179 ±10,5,543 个样本,2026 年 10 月,$7.20/分钟

• Veo 3.1 — 第 12 名,1,082 ±7,7,040 个样本,2026 年 1 月,$24.00/分钟

• Veo 3.1 Lite — 第15名,1,071 ±8,5,122 个样本,2026年3月,$4.80/分钟

• Veo 3.1 Fast — 第18名,1,066 ±6,14,688 个样本,2026年1月,$9.00/分钟

文本转视频(AA-Video-T2V v2.0):

• Veo 3.1 — 19日至21日,962 ±10,2,998 个样本,2026年1月,24.00 美元/分钟

• Veo 3.1 Fast — 第20名,961 ±10,4,325 个样本,2026年1月,$7.20/分钟

• Veo 3.1 Lite — 22-25日,948 ±10,2,903 个样本,2026年3月,每分钟 4.80 美元

• Vidu Q4 Preview — 未在此看板中显示

这两个区块从不同角度讲述了同一件事。在图生视频上,三档 Veo 都落在一个十六分的区间内,而价格却相差五倍——所以,为 Veo 3.1 比 Veo 3.1 Lite 多付五倍价钱,换来的是十一个 Elo 分,稳稳处在这两个分数各自的 ±7 和 ±8 区间之内。在文生视频上,同样的五倍价格区间内差距为十四分,而这里的排序对低价档更慷慨:Veo 3.1 Fast 以三分之一的价格,仅落后旗舰版一个 Elo 分,而且其分数背后有更多投票支持。

Goo​gle 自己的分层因此主要是一个关于延迟和分辨率的决策,而不是一条质量阶梯;对厂商来说,这是很合理的售卖点。只不过,它并不是大多数“该选哪个 Veo”的文章所宣称的那种东西。

The Artificial Analysis image-to-video board showing all three Veo 3.1 tiers and Vidu Q4 Preview on one scale.

确实成立的比较

在图生视频排行榜上,Vidu Q4 Preview 比 Veo 3.1 所在档位高出 97 Elo,每月还便宜 16.80 美元,并且比 Veo 3.1 Fast 高出 113 Elo。这些差距是相关区间宽度的五到七倍,因此并非噪声。

显而易见的反驳是,这是拿一个2026年10月的模型去和一个2026年1月的模型作比较——确实如此,而这正是整项结论的要点所在。Veo 3.1在这份榜单上已经存在八个月了,它的分级上一次被实质性调整还是在三月Lite推出的时候,而如今它已被一个规模更小的实验室以更低价格推出的预览版所超越。榜单自己的公告称,过去30天内新增了两款模型,Vidu Q4 Preview就是其中之一。

同样显而易见的制衡在于:Vidu Q4 Preview 完全没有文生视频入口,而 Veo 的三档中有两档正属于这一类。如果你的工作负载是从文字提示词而非一帧画面开始,那么这些比较都不适用,两者中只有 Veo 的阶梯式档位能给出答案。

The Artificial Analysis text-to-video board, on which Vidu Q4 Preview has no entry.

Veo 能为你提供而 Vidu 不能提供的东西

有一个维度,其差距是结构性的,而非数值上的,而且它与Elo毫无关系。

Google 的 Veo 3.1 输出在每一帧上都带有 SynthID 水印,并带有 C2PA 内容凭证,记录其由 AI 生成,Gemini 应用中提供了检测器。这不是一个你可以开启的功能;它就是模型生成的结果。对于任何要向有披露要求的市场发布产品、要与筛查合成媒体的平台合作,或只是想要一份记录哪些镜头为生成内容的审计轨迹的人来说,这是任何基准测试都不会告诉你的采购差异。在某些工作流程中,这也是不使用它的一个理由——如果你的交付物需要作为未标记的素材通过,那么无法禁用的水印就是一种限制。

Vidu Q4 Preview 未发布具有可比具体性的水印或来源溯源机制。这是未作主张,而非主张不存在,且应照此记录。

两个较小但值得持有的不对称机会:

• 音频默认设置 — Vidu Q4 Preview 的图生视频端点有一个 audio 参数,默认值为 true,因此除非将其关闭,否则画面会附带声音;Veo 3.1 将音频作为独立的档位决策来定价,Standard 档包含音频时约为 $0.40/秒,而静音输出的价格则低得多

• 参考配额 — Vidu Q4 Preview 在参考生视频中最多接受 15 张参考图像和 3 段参考音频片段;Veo 3.1 对参考素材的处理方式未记录到如此详细的程度

这让选择处于何种境地

如果你是拿静帧来生成——产品帧、角色参考图、分镜画面——独立排行榜会将 Vidu Q4 Preview 划入与每个 Veo 3.1 变体都不同的档位,而价格仅为最高档位的一小部分,并且 Veo 内部的档位阶梯也救不了它。这就是该发现,其依据是 5,543 票对分别为 7,040、5,122 和 14,688 票。票数是真实的;随着区间收窄,排名将会变动。

如果你需要内置溯源功能、文本转视频,或者一家拥有 Google 分发渠道和企业条款的供应商,那么 Veo 3.1 就是答案——原因在于 Elo 排行榜无法表达,也不应被解读为可以凌驾于这些原因之上。

如果你两者都需要,算术很简单:一次集成,而不是两次。一个兼容 OpenAI 的端点,覆盖 200 多个模型,按各提供商的标价透传、不额外加价,因此任一供应商调价当天就会反映在你的账单上,而不是等到续约时才体现;跨提供商的自动故障转移意味着某条路由不可用不会把请求一并拖垮。目前 Vidu Q4 Preview 和 Veo 3.1 都不是 OrcaRouter 的路由——我们实际提供的视频模型(包括 MiniMax H3)都能在同一个端点上调用——所以诚实的说法是:在你决定哪条渲染路径胜出期间,我们可以让编排层保持稳定,而不是说我们托管这两者中的任何一个。

真正重要的问题

Veo 3.1 并不是一个糟糕的模型。它是 2026 年 1 月的模型,定价却如同旗舰,而它自身的三个档位却趋同于同一分数;如今它又被拿来与一个 2026 年 10 月的预览版相较,后者击败其最佳变体的优势幅度,比 Veo 整个内部差距还要大。

什么会改变这一局面:AA-Video-I2V v2.0 已宣布即将推出,与 T2V v2.0 的分类体系保持一致,并全程覆盖 1080p。在一张新榜单上、以新的投票池重新跑一遍,可能会让其中任何名次上升或下降,而这两个模型都应在这张新榜单上重新解读,而不是采信本页上的数字。

对于只想要一个简短答案的读者:在两者同时出现的唯一榜单上,单个 Vidu Q4 Preview 版本排名高于 Veo 3.1 的全部三个档位,而且它做到这一点时的价格是每分钟 $7.20,相比之下 Veo 3.1 Standard 为 $24.00、Veo 3.1 Fast 为 $9.00——不过面对 Veo 3.1 Lite 时除外,后者是唯一一个价格低于它的 Veo 档位,每分钟 $4.80,且在同一榜单上低十八位。Veo 自己的档位阶梯并不是质量阶梯,而这正是这项对比中值得继续保留的部分。广义的答案是,它们面向不同的任务,而决定这一点的产出,是你的输入究竟是一张照片还是一句话。