Wan 3.0 與 Kling 3.0 比較的標題卡,副標題為「一鏡到底,對比規劃好的六鏡頭序列」,並有三個數據標籤寫著「Arena 排名:#2 對 #12」、「最長片段:30 秒 對 15 秒」與「多鏡頭:否 對 是」。頁尾:「Elo 依據 Artificial Analysis,擷取於 2026 年 9 月 18 日。Kling 供應商定價有爭議。」
Guides & Insights

Wan 3.0 對決 Kling 3:一鏡到底對抗六個規劃鏡頭

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

先從一個沒有人調和過的落差開始。 Wan 3.0只有一個公開價格。 Kling 3.0,快手目前的影片旗艦模型,卻有兩個——而且兩者相差三倍。快手自家的 API 文件將 Kling Video 3.0 的標準方案列為每秒 $0.084,專業方案為 $0.112。Artificial Analysis 在它列出 Wan 3.0 的同一個排行榜上,將同一款模型定價為 1080p 專業方案每分鐘 $20.16——也就是每秒 $0.336。兩者不可能是在描述相同設定下的同一代生成結果。在有人公布調和結果之前,這兩個模型之間任何以秒為單位的比較,所依據的數字可能根本不是在衡量同一件事。

真正能誠實比較的,是規格、盲測評分和設計哲學——而在這些方面,這兩個模型幾乎在所有重要的事情上都不一致。快手打造 Kling 3.0 時,是圍繞多鏡頭序列來設計;阿里巴巴打造 Wan 3.0 時,則是圍繞單一不中斷的長鏡頭來設計。這不是行銷上的區別;它會在價格進入討論之前,就決定兩者中哪一個更適合你的專案。

兩種模型,兩種對「片段」的看法

Kling 3.0 於 2026 年 2 月 5 日推出,屬於四模型系列——Video 3.0、Video 3.0 Omni、Image 3.0 與 Image 3.0 Omni。其標誌性功能是自動多鏡頭排序:模型會自行規劃鏡頭切換,而自訂模式可讓你設定鏡頭數量及每個鏡頭的持續時間。評測者回報,單一提示詞最多可產生約六個不同鏡頭的可用序列,並可逐鏡頭指定景別、運鏡與敘事節拍。每次生成的上限為 15 秒,下限為 3 秒。

Wan 3.0 反其道而行。它的上限是一次連續生成 30 秒,而整體設計的取向就是不剪接——時間足以完成單一運鏡、一鏡到底的產品示範,或是一段不經剪輯也能撐住的獨白。它沒有多鏡頭規劃器,因為其賣點正是你根本不需要這種東西。

實際後果是:這不是一個孰優孰劣的問題,而是關於你剪輯的問題。一部短劇、一支由多個剪接構成的廣告、任何角色之間你來我往的對白——那是 Kling 3.0 的形狀。一段連續的產品揭曉、一支舞蹈或表演作品、一個必須保持連貫的單一移動鏡頭——那是 Wan 3.0 的形狀。試圖把其中一方硬塞進另一方格式的團隊會發現,失敗模式是結構性的:Kling 3.0 的六個鏡頭不重新生成就無法變得連續,而 Wan 3.0 的三十秒不失去你付錢買到的東西,就無法剪成六個乾淨的鏡頭。

競技場的數字,依其衡量的項目拆分

這是這場對比中報導最糟糕的部分,因為大多數頁面引用的都是已經過時五個月的 Kling Elo。快手 2026 年 2 月的發布資料,將 Kling 3.0 列在文字轉影片排行榜首位,Elo 約為 1,240。那在二月是準確的。Artificial Analysis 的即時排行榜,擷取於 2026 年 9 月 18 日,含音訊:

• Wan 3.0 — 第2名,Elo 1,229,每分鐘 $12.00

• Kling 3.0 1080p Pro — 第 12 名,Elo 1,095,每分鐘 $20.16

• Kling 3.0 720p Standard — #13,Elo 1,089,每分鐘 $15.12

• Kling 3.0 Omni 720p Standard — #18,Elo 1,082,$13.44/分鐘

• Kling 3.0 Omni 1080p Pro — #22,Elo 1,075,每分鐘 $16.80

所以,二月的領先者在七個月後成了中游模型,這並非它自身的過錯——而是整個領域往前推進了。另請注意,Kling 自家的各級別在排行榜上橫跨十一個名次,其間 Elo 差距達 20 分,這意味著你購買的級別對實測品質的影響,小於你選擇的模型。購買 Pro 而非 Standard,換來的是解析度,以及在這個排行榜上大約六點 Elo。

接著還有一個讓整體情況變得複雜的數字,而且幾乎沒有人引用它。在圖像轉影片排行榜上 音訊的情況下,Kling 3.0 是截然不同的存在:Omni 1080p Pro 級別拿下 Elo 1,284,排名第 8,而 1080p Pro 級別則以 1,282 排名第 9。這是前十名的成績,明顯優於它在文字轉影片的表現。解讀是,Kling 3.0 在從提供的圖像開始、且不以生成音效來評判時最為強大——而這正好符合很大一部分實際商業工作的情況。如果你的流程是圖像轉影片,而且你自己為音訊評分,那麼上述的競技場數字就大幅低估了這個模型。

音訊,其中兩者都提出相同的主張,而其中一個有已記載的問題

兩款模型都能在同一輪中原生生成音訊。快手版本支援中文、英文、日文、韓文與西班牙文,能處理單一片段內的混合語言對話,為多角色場景中的每個角色綁定不同嗓音,並提供區域口音——美式、英式與印度英語;東北、北京、台灣、粵語與四川中文。Wan 3.0 的音訊預設為開啟,可用旗標停用,並接受最多五段參考音訊片段來引導結果。

表面上看,這是一場平局,差別只在語言清單不同。但就實際回報的成果而言,並非如此。唇形同步一致性是獨立 Kling 3.0 評測中最常被指出的單一弱點——一項實測發現,大約五段對話片段中就有兩段需要重拍,而即使在影像方面給予高度評價的評測者,仍形容其唇形同步不一致。據報的音訊瑕疵主要集中在吵雜環境中的對話,在水聲和風聲背景下,可能導致語音變得悶糊。阿里巴巴的問題性質不同:其自家的發表資料就將音訊品質列為仍有待改進的領域,這是對保真度而非同步性的承認。

這兩家廠商都沒有在賣已經做好的對白工具。如果你的專案重點是對白,首先該測的不是畫質,而是在完整 15 或 30 秒內,嘴型是否都對得上台詞,因為這正是這兩者會出問題的地方,也是重拍的來源。

Artificial Analysis's Text to Video Leaderboard (With Audio), read 18 September 2026, showing Wan 3.0 second at Elo 1,229 and $12.00/min with Kling's four tiers spread from twelfth to twenty-second — Kling 3.0 1080p Pro at 1,095 and $20.16/min, Kling 3.0 720p Standard at 1,089 and $15.12/min, Kling 3.0 Omni 720p Standard at 1,082 and $13.44/min.

參考控制與解析

• 多鏡頭 — Kling 3.0:自動鏡頭規劃,另有可自訂每個鏡頭數量與時長的自訂模式,最多約六個鏡頭。Wan 3.0:無;單一連續生成。

• 時長 — Kling 3.0:3 至 15 秒。Wan 3.0:2 至 30 秒,並支援向前、向後及雙向延伸。

• 解析度 — Kling 3.0:官方指南中為 720p 與 1080p,快手自家文件則宣稱原生 4K,價格為每秒 $0.42。Wan 3.0:480p、720p 與 1080p;沒有 4K。

• 幀率 — Kling 3.0:標準 30fps,在更高效能模式下宣稱可達 60fps。Wan 3.0:30fps。

• 參考控制 — Kling 3.0:元素綁定,可在平移與縮放過程中鎖定主體,來自上傳的圖片或角色影片。Wan 3.0:最多 10 張參考圖片、5 段參考影片和 5 段音訊片段,總資產上限為 20,另加一份文件或公開網頁。

• 依據 — Wan 3.0 可接受 DOC、XLS、PPT、PDF、TXT、MD 及公開 URL 作為輸入,並將其轉換成影片。Kling 3.0 沒有對應功能。

解析度這一欄應該拿來對照你自己的交付規格,因為它確實有爭議。快手自家的文件聲稱 Video 3.0 原生支援 4K;但其使用指南只列出 720p 和 1080p。第三方對 4K 的點數費率在不同來源之間相差超過兩倍。如果 4K 是硬性要求,請透過你的帳戶取得書面確認,而不是從比較頁面(包括本頁)得知。

您能真正打電話給他們的地方

這是本系列賽中唯一一組對戰,其中可用性的答案並不對稱,而這點值得直白說明。

Kling 3.0 已收錄於 OrcaRouter 目錄中,型號為kling/kling-v3,每筆請求定價為 $0.08,並以供應商標價 0% 加價直接轉嫁。這與上述彙整概況有實質差異:你不必再持有一個快手帳戶,也不必為工作流程所需的任何其他模型另行整合,Kling 3.0 與 200 多個其他模型共用同一組金鑰和同一個相容 OpenAI 的端點。由於我們不對供應商價格加價,快手的價格調整或促銷降價當天即會在我們這邊生效,而不必等到一個合約週期之後——而且若上游供應商效能下降或受到速率限制,自動容錯移轉會在回應開始前轉移請求,而不是向你的應用程式回傳錯誤。

Wan 3.0 並未收錄在我們的產品目錄中,也不在任何通用型路由平台上。目前可透過阿里巴巴自家的平台——阿里雲上的 Model Studio 與 Qwen Cloud——以及在其 8 月 24 日發布後整合此模型的第三方創作工具來使用;阿里巴巴自家平台正推出限時 30% 折扣,優惠持續至 9 月 23 日。另一條途徑則是快手自家的消費者方案與 Kling AI 網頁應用程式,採點數計費,且沒有無限用量方案。

對想要兩者兼得的團隊而言,這種不對稱正是這項決策的實際樣貌:前者是設定變更,後者則是多建立一段供應商關係。

該由誰來選擇哪一個

• 選擇 Wan 3.0 以進行超過 15 秒的連續鏡頭、用於以文件或網頁為依據的簡報、用於短於三秒的短片、以最低公佈價格取得最寬裕的參考預算,以及用於原本需要拼接的 30 秒單次處理工作。

• 若要從單一提示詞生成多鏡頭敘事序列、進行圖生影片工作且其在無音訊競技場中的名次確實位居前十、製作涵蓋五種支援語言並可綁定各角色聲音的多語言對話、在鏡頭運動間維持元素一致性,以及在你確認方案層級後使用 4K,就選擇 Kling 3.0。

誠實的總結是:這兩者與其說是競爭對手,不如說是依專案類型選擇的替代方案;而通常能解決這個問題的價格比較,目前並不可信——Kuaishou 公佈的每秒費率與獨立排行榜的每分鐘數字不可能兩者都正確,且差異大到足以推翻一項決定。在問題解決之前,決定性的證據應該是對你自己的素材進行相同提示詞的測試:在 Kling 3.0 上以一個六鏡頭 15 秒序列,對比 Wan 3.0 上一個連續 15 秒的一鏡到底,解析度 1080p,並以你真的會交付的片段來評分。

Two-column scoreboard for Wan 3.0 and Kling 3.0 across six shared dimensions: arena Elo (#2 — 1,229 vs #12 — 1,095), price per minute ($12.00 vs $20.16), max clip (30s one take vs 15s), multi-shot (no vs up to six shots), frame rate (30fps vs 30fps) and native 4K (no vs claimed, unconfirmed). Footer: “Elo per Artificial Analysis, Sept 18 2026; Kling vendor rate disagrees with this column.”

值得關注的不是任一家實驗室的新模型,而是 Kuaishou 的價目表。如果供應商費率是對的,Kling 3.0 是此系列中最便宜且可信的影片模型,而競技場的每分鐘欄位所衡量的是大多數人不會購買的配置。如果排行榜的數字是對的,Kling 3.0 是這裡最貴的模型,而它位居中游的排名是個問題。這兩種說法其中一個是真的,但沒有人說過是哪一個。

OrcaRouter's own model page for kling/kling-v3, showing the model summary “Kling 3.0 — flagship text-to-video and image-to-video, multi-shot + subject + motion control, 3-15s clips, up to native 4K”, the /v1/video/generations endpoint, a per-request price of $0.08, p50 and p95 time-to-first-token of 1.00s, and an OpenAI-compatible code sample against api.orcarouter.ai/v1.