一張為 Vidu Q4 Preview 對決 Google Veo 3.1 生成的標題卡,副標題為「三個 Veo 等級,一個 Vidu 版本」,標籤文字顯示「Vidu Q4 Preview — Elo 1,179」、「Veo 3.1 — Elo 1,082」以及「Veo 3.1 Lite — Elo 1,071」。OrcaRouter 標誌位於右下角的留白區塊。
Guides & Insights

Vidu Q4 Preview 對決 Google Veo 3.1:Veo 分三級販售,而三者之間的差距,比向上攀升的落差還小

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

Goo​gle 的 Veo 3.1共分三個等級。在 Artificial Analysis 的圖像轉影片排行榜上,它們分別得分 1,082、1,071 和 1,066——整個區間相差十六 Elo——而每分鐘價格卻橫跨五倍,從 $4.80 到 $24.00。Vidu Q4 Preview是一款模型,不是三款,在同一排行榜上得分 1,179,標價為每分鐘 $7.20。依序讀完這些數字,實際的問題就不再是「該選哪個 Veo 等級」,而是「為什麼要買其中任何一個」——這不是大多數頁面會寫的比較,而它值得下面這個具體答案,而不是一句聳肩。

Vidu Q4 Preview 於 2026 年 10 月 7 日由 Shengshu Technology 推出,是其下一代旗艦產品的首次公開預覽,搶在 Q4 完整版正式發布之前登場,並提供兩種模式:圖像轉影片與參考轉影片。Veo 3.1 自 2026 年 1 月起便已問世,並於 3 月新增 Lite 版本,且同時支援文字提示與圖像輸入。形態各異、世代不同,卻有同一個舞台可供彼此一較高下。

A generated two-column scoreboard for Vidu Q4 Preview and Google Veo 3.1. Left column rows read 'Image-to-video Elo: 1,179', 'Tiers: one build', 'Text-to-video: none', 'Measured rate: $7.20 per minute', 'Provenance: none stated' and 'Max resolution: 4K'; right column rows read 'Image-to-video Elo: 1,082 / 1,071 / 1,066', 'Tiers: three', 'Text-to-video: yes', 'Measured rate: $24.00 / $9.00 / $4.80 per minute', 'Provenance: SynthID plus C2PA' and 'Max resolution: not stated'. A footer reads 'Elo and rates per Artificial Analysis, 8 October 2026; provenance per Google DeepMind.' The OrcaRouter logo sits in the bottom-right padded strip.

Veo 的等級階梯,直接從看板上讀出

以下所有數據均來自 Artificial Analysis,擷取於 2026 年 10 月 8 日,且保留音訊。每個排行榜都有自己的 Elo 量表和投票池,因此這兩個區塊彼此無法互相比較——只能在各自內部比較。

圖生影片(AA-Video-I2V v1.0):

• Vidu Q4 Preview — 第 3 名、1,179 ±10、5,543 個樣本、2026 年 10 月、每分鐘 $7.20

• Veo 3.1 — 第 12 名,1,082 ±7,7,040 個樣本,2026 年 1 月,每分鐘 $24.00

• Veo 3.1 Lite — 第 15 名,1,071 ±8,5,122 個樣本,2026 年 3 月,每分鐘 $4.80

• Veo 3.1 Fast — 第 18 名,1,066 ±6,14,688 個樣本,2026 年 1 月,每分鐘 $9.00

文字轉影片(AA-Video-T2V v2.0):

• Veo 3.1 — 19 日至 21 日,962 ±10,2,998 個樣本,2026 年 1 月,每分鐘 24.00 美元

• Veo 3.1 Fast — 第20名,961 ±10,4,325 個樣本,2026年1月,每分鐘 $7.20

• Veo 3.1 Lite — 22日至25日,948 ±10,2,903 個樣本,2026年3月,每分鐘 $4.80

• Vidu Q4 Preview — 此看板上未顯示

這兩個區塊從不同角度講述了同一個故事。在圖像轉影片方面,三個 Veo 等級落在十六分的區間內,而價格卻相差五倍——因此,為 Veo 3.1 付出比 Veo 3.1 Lite 高五倍的價格,換來的是十一點 Elo,完全落在這兩個分數所帶的 ±7 與 ±8 區間內。在文字轉影片方面,同樣五倍的價格範圍內,差距為十四分,而在那裡,排名對便宜等級相當寬容:Veo 3.1 Fast 以三分之一的價格,僅落後旗艦機型一點 Elo,且其數字背後有更多票數支持。

Google 自家的分層因此主要是延遲與解析度上的取捨,而不是一條品質階梯;對廠商來說,這是個很合理的賣點。只是,它並不是大多數「該選哪一款 Veo」文章所宣稱的那回事。

The Artificial Analysis image-to-video board showing all three Veo 3.1 tiers and Vidu Q4 Preview on one scale.

那個確實成立的比較

Vidu Q4 Preview 在圖生影排行榜上比 Veo 3.1 的最佳等級高出 97 Elo,每分鐘便宜 16.80 美元,並比 Veo 3.1 Fast 高出 113 Elo。這些差距是所涉信賴區間寬度的五到七倍,因此並非雜訊。

明顯的反駁是,這拿 2026 年 10 月的模型與 2026 年 1 月的模型相比,而它確實如此——這正是整個發現。Veo 3.1 在這個排行榜上已問世八個月,其層級上次有意義地重新洗牌是在 3 月 Lite 推出時,而且它已被來自較小型實驗室、價格更低的預覽版本超越。該排行榜自己的公告說,過去 30 天內新增了兩個模型,而 Vidu Q4 Preview 就是其中之一。

同樣顯而易見的制衡因素:Vidu Q4 Preview 完全沒有文生影片項目,而 Veo 的三個層級中,有兩個正落在這裡。如果你的工作流程是從文字提示開始,而非從影格開始,那麼這些比較都不適用,而 Veo 階梯是兩者中唯一能回應需求的一方。

The Artificial Analysis text-to-video board, on which Vidu Q4 Preview has no entry.

Veo 給你而 Vidu 沒有的東西

有一個維度,其中的差距是結構性的,而非數值上的,而且這與 Elo 毫無關係。

Goo​gle's Veo 3.1 output is watermarked with SynthID on every frame and carries C2PA content credentials recording that it was AI-generated, with a detector available in the Gem​ini app. That is not a feature you switch on; it is what the model produces. For anyone shipping into a market with disclosure requirements, working with a platform that screens for synthetic media, or simply wanting an audit trail of which shots were generated, this is a procurement difference that no benchmark will show you. It is also, on some workflows, a reason not to use it — a watermark you cannot disable is a constraint if your deliverable needs to pass as unmarked footage.

Vidu Q4 Preview 並未公布任何具備同等具體程度的水印或來源追溯機制。這是「未提出主張」,而非「主張其不存在」,且應如此記錄。

兩個較小的不對稱值得保留:

• 音訊預設 — Vidu Q4 Preview 的圖片轉影片端點有一個 音訊參數,預設為true,因此除非你關閉它,否則畫面會附帶聲音;Veo 3.1 將音訊視為獨立的方案層級決定,Standard 方案包含音訊時約為每秒 $0.40,而無聲輸出則便宜得多

• 參考額度 — Vidu Q4 Preview 在 Reference-to-Video 中最多接受 15 張參考圖片和最多 3 段參考音訊片段;Veo 3.1 的參考處理方式並未記錄到如此詳細的程度

這讓選擇處於何種境地

如果你是从靜態圖生成——產品影格、角色參考、分鏡畫格——獨立排行榜會把 Vidu Q4 Preview 置於與每一個 Veo 3.1 變體都不同的層級,而且價格只是最高層級的一小部分,而 Veo 內部的層級階梯也救不了它。這就是這項發現,且它立基於 5,543 票對上分別為 7,040、5,122 與 14,688 票。票數是真實的;排名會隨著區間收窄而變動。

如果你需要內建的來源溯源、文字轉影片,或是一個擁有 Google 通路與企業條款的供應商,Veo 3.1 就是答案,其背後的理由非 Elo 評分表所能表達,也不應被解讀為能加以推翻。

如果您兩者都需要,算術上就是一對二的整合。OrcaRouter 運行一個與 OpenAI 相容的端點,涵蓋 200 多個模型,並直接傳遞供應商的定價且不額外加價,因此任一供應商調整價格時,您的發票當天就會反映出來,而不是等到續約時才變動;而跨供應商的 automatic failover 意味著單一路由無法使用時,請求不會跟著失敗。Vidu Q4 Preview 和 Veo 3.1 目前都不是 OrcaRouter 的路由——我們確實提供的影片模型,包括 MiniMax H3,都可以在同一個端點上呼叫——所以誠實的說法是,我們可以在您決定哪條算圖路徑勝出時,讓協調層保持穩定,而不是我們託管了這兩者中的任何一個。

真正重要的問題

Veo 3.1 不是個糟糕的模型。它是一款 2026 年 1 月的模型,卻被定價得像旗艦機種,而它自身三個層級的分數還趨於一致;如今它被拿來與一款 2026 年 10 月的預覽版相比,而後者擊敗它最佳變體的差距,還比 Veo 內部全部的落差更大。

什麼會改變局勢:AA-Video-I2V v2.0 宣佈即將推出,與 T2V v2.0 分類體系保持一致,並全面涵蓋 1080p。在新的排行榜上以新的投票池重新運行,可能會讓這些排名中的任何一個上升或下降,而這兩個模型應該在該排行榜上重新解讀,而不是信任本頁面上的數字。

給只想要簡短答案的讀者:在唯一同時收錄兩者的排行榜上,單一的 Vidu Q4 Preview 版本排名高於全部三個 Veo 3.1 層級;而且它是以每分鐘 $7.20 做到這點,相較於 Veo 3.1 Standard 的 $24.00 與 Veo 3.1 Fast 的 $9.00——但相較於 Veo 3.1 Lite 則不然,Lite 是唯一在價格上低於它的 Veo 層級,每分鐘 $4.80,且在同一排行榜上低十八名。Veo 自家的層級階梯並不是品質階梯,而這正是這段比較中值得延續下去的部分。廣義的答案是:兩者鎖定的是不同工作,而決定這件事的交付成果,在於你的輸入是一張照片,還是一句話。