
Wan 3.0 發布日期:確認於 8 月 24 日發布 — 現已登陸 ComfyUI 和第三方 API
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
2026年8月24日,阿里雲確認正式推出Wan 3.0——即通義萬象影片模型家族的第三代,也是Wan 2.7的後繼者——距8月6日開放公開測試僅18天。此次發布將測試階段按量計費、需申請才能使用的API轉為完全開放,並讓Wan 3.0進入第三方創意工具:Envato的AI影片工具當週也開始在ModelMatch引擎中提供此模型,Leonardo.Ai已將Wan 3.0加入其影片生成器,ComfyUI也已原生支援此模型,單次生成最長可達30秒。消費級影片剪輯軟體PowerDirector(CyberLink)也已加入對Wan 3.0的支援,阿里官方X帳號於8月28日發布了這項消息,PowerDirector自家的日文帳號也同步轉發。此外,阿里官方X帳號也確認,目前已有第三方影片生成API平台提供Wan 3.0——單一模型同時涵蓋影片與音訊、最長30秒、支援多模態參考——以每秒0.20美元的固定費率計費。這是迄今最明確的訊號,顯示該模型已全面正式上線。阿里自家的上市宣傳現在也以最直接的方式印證這點:官方表示,Wan 3.0的上市廣告就是以該模型製作的,官方Wan帳號也在X上發布了這支廣告的完整幕後拆解——從概念、角色設定、提示詞,甚至到失敗的生成結果。該帳號此後也將同樣的焦點轉向外部創作者——一篇與Pixmax_ai的Liz Zhang的訪談,內容涵蓋上市概念片,以及如何圍繞該模型打造完整創意工作流程。9月3日迎來了對模型本身的首份獨立評價:Artificial Analysis以盲測兩兩對決的投票(而非廠商宣稱)為影片模型排名,Wan 3.0首度進榜即在「影片編輯排行榜(含音訊)」名列第一,並在「文字轉影片(含音訊)」中以些微差距位居第二。不過,此次發布仍舊沒有包含開放權重。圍繞Wan 3.0流傳的Apache-2.0「1.3B + 14B」說法,並未出現在任何阿里公告中,幾乎與2025年某款模型的規格完全吻合,也與阿里過去一年實際發布影片模型的方式背道而馳。以下是8月24日發布所改變的內容、8月6日已確認的內容,以及Wan 3.0故事中你仍應視為未經證實的部分。
開頭先說明資料來源,因為這篇報導有兩個層次。能力與定價章節中的所有內容均為阿里巴巴自行發布:內容來自官方公開測試版公告與阿里巴巴的英文部落格,並已與中國媒體的報導交叉比對。8 月 24 日的正式發表由廠商宣布,多家媒體也在同一天報導。Envato、Leonardo.Ai、ComfyUI、Pixmax 與 PowerDirector 的整合——以及在發表當週即開始提供該模型服務的第三方影片生成 API 平台——均由阿里巴巴在 X 上宣布,並獲得各平台本身確認:Envato 在其自家部落格、Leonardo.Ai 在其公告、ComfyUI 在其官方部落格、Pixmax 在其自家頁面、PowerDirector 在 CyberLink 自家帳號、API 平台則在其自家模型頁面上,其中描述了每秒 0.20 美元的單一費率、音訊預設開啟,以及全模態(omni-modal)參考。這些是廠商與合作夥伴的聲明,並非獨立測試,且已如此標示。下文所述的發表廣告拆解(launch-ad breakdown)也屬於同一類別:這是阿里巴巴對自家產品的陳述,發布在 X 的官方 Wan 帳號上,並非獨立測試。下文所述的創作者展示也帶有相同標示:官方帳號對 Pixmax_ai 的 Liz Zhang 所做的訪談,是阿里巴巴選用合作夥伴對其自身工作的陳述,發布於 X,並非獨立測試。截至 9 月 3 日為止的例外是 Artificial Analysis:其排行榜是獨立測量、而非廠商宣稱,並將 Wan 3.0 列為影片編輯(含音訊)第一名,以及文字轉影片(含音訊)緊追在後的第二名——這是該模型首個非阿里巴巴的評分,下文會加以討論。目前仍沒有模型卡、沒有參數數量、也沒有可廣泛取得的權重可供執行。尤其是「開放權重」的說法並未獲得廠商證實;那是與官方發表相矛盾的社群謠言,且文中凡出現此說法之處均已如此標示。
Wan 3.0 實際上搭載了什麼
Wan 3.0 是一款能將文字、影像、影片和音訊轉換為影片的生成模型。它最引人注目的能力——在所有報導測試版的媒體中一再被提及——是單次生成長達 30 秒的影片片段,是 Wan 2.7 的 15 秒上限的兩倍,也是中國影片生成模型中原生單一片段最長的。這正是評論者們不斷描述的「從生成一個鏡頭到講述一個完整故事」:30 秒足以呈現連續的鏡頭運動或一鏡到底的場景,這是較短的片段無法做到的。
• 最大長度 — 單次生成長達 30 秒,是 Wan 2.7 的 15 秒的兩倍,具備「智能時長」功能,可根據提示詞建議長度,並提供影片延伸工具,能銜接更長的敘事。
• 輸入 — 文字、圖片、影片和音訊,以及家族中首次推出的文件:doc、xls、ppt、pdf、md、txt、key、pages 和 numbers 檔案,還有網頁連結。單一檔案最多 100 MB / 50 頁,可直接轉換成影片——這正是引發多數行銷和教育興趣的「文件轉影片」功能。
• 多重參考 — 每次生成最多可包含 10 張圖片、5 段影片和 5 個音訊參考,以確保跨鏡頭的角色、道具、音訊、空間佈局和風格一致性。
• 編輯 — 在生成後,以指令方式修改視覺、劇情和對話,而非完全重新生成。
• 已指出的缺點 — 阿里巴巴承認音訊品質和螢幕文字準確性仍有待改進;這是來自供應商自己的公告,而非評測者的結論。
值得分開看待:「30秒片段」和「原生4K輸出」兩者都曾被提及為Wan 3.0的功能,但官方測試版公告只承諾30秒生成,解析度為480p、720p和1080p。原生4K出現在該模型的第三方行銷頁面上,而非阿里巴巴的公告中。請將4K視為未獲證實。

定價:按量計費的 API,及其打破的模式
Wan 3.0 按生成的影片秒數計價。阿里巴巴公布的 API 費率為:480p 每秒 0.3 元人民幣(約 0.05 美元),720p 每秒 0.6 元人民幣(約 0.10 美元),1080p 每秒 1.2 元人民幣(約 0.20 美元)。因此,一支完整的 30 秒影片在 480p 下約需 9 元人民幣(1.50 美元),720p 下約 18 元人民幣(3.00 美元),1080p 下約 36 元人民幣(6.00 美元)。8 月 24 日的發布會確認了相同的每秒計價結構,並在阿里雲的百煉(Bailian)與千問(Qianwen)AI 平台上推出限時 30% 折扣,優惠至 9 月 23 日——據阿里巴巴表示,活動期間一支 30 秒的 1080p 影片價格降至約 25 元人民幣。中國媒體報導指出,720p 的費率約為主流競爭對手每秒價格的 60%——阿里巴巴顯然想藉此定價策略瞄準中小型團隊。
定價模式本身就是一個故事,因為它刻意偏離了該公司的歷史軌跡。Wan 2.1 與 2.2 以 Apache 2.0 授權完整開放權重。Wan 2.5 宣稱開放但從未釋出權重。Wan 2.6 是封閉 API。Wan 2.7 僅部分開放。Wan 3.0 延續的是那條路線,而非 Wan 2.1 的路線:它是一個按量計費的封閉 API——{{1}}beta 版的申請門檻已在 8 月 24 日上線時解除——{{/1}}而官方發布聲明完全沒有提及釋出權重一事。任何在權衡「該不該等開放權重」的人,都是在等待一個阿里巴巴從未承諾、且近期模式也傾向反對的{{2}}東西{{/2}}。
這裡也是路由經濟效益的關鍵所在。當影片模型的定價精細到這種程度——按秒、按解析度計費——供應商之間的差異通常不在於模型本身,而在於計費方式。在 OrcaRouter 上,我們路由的 200 多個模型均按供應商列表價格計費,以 0% 加成轉傳,因此供應商的降價當天就會同步反映在我們這邊,而不是等到合約週期結束。Wan 3.0 目前未上架於任何通用模型路由平台——使用者可透過阿里巴巴自家的主控台、Envato、Leonardo.Ai、ComfyUI、Pixmax 與 PowerDirector 等第三方創意工具,以及在上線首週便開始提供服務的影片生成 API 平台來使用——但既然 API 已完全開放,該確認的重點在於:您所取得的每秒費率是否為供應商自己的費率。我們的模型頁面會顯示列表價格,而這就是比較時應採用的基準。

你可以實際試用的地方
API 自 8 月 24 日上線起已完全開放;在測試期間則需申請才能使用。阿里巴巴在公告中列出了這些存取點:
• Model Studio(百煉) — 阿里雲的AI平台,您可以在這裡申請模型測試。
• Qwen Cloud — 阿里巴巴的AI原生雲端服務,目前顯示限制為兩個並行任務、每分鐘30次請求,以及非同步佇列中的50個任務。
• Wanxiang 官方網站與Qwen Creation PC 客戶端——面向消費者的介面。
• WonderClip (Wanjing Yike)、IF STUDIO 和 Duiyou — 阿里巴巴的內容工具,與主要平台並列。
• Qwen app —— 漸進式(灰度)發布,而非全面發布。
• Envato 的 AI 影片工具 — 一個第三方創意介面,在發布當週加入了 Wan 3.0,由 Envato 的 ModelMatch 在幕後選定,而非每次生成時個別挑選。可供 Envato 使用者使用;由阿里巴巴宣布,並經 Envato 自家部落格證實。
• Leonardo.Ai — 一個第三方創意平台,已在其影片生成器中加入 Wan 3.0。此消息由阿里巴巴在 X 上宣布,並由 Leonardo.Ai 在其自己的公告中確認。Leonardo 用戶可將其作為另一個非阿里巴巴的接入途徑使用。
• ComfyUI — 基於節點的工作流程平台,在 v0.33.4 更新中及 Comfy Cloud 上原生加入了 Wan 3.0。單次生成在 480p、720p 或 1080p 解析度下最多執行 30 秒,且 ComfyUI 的 Omni-Reference 節點可匯入最多 20 個圖像、影片和音訊參考,以及文件和網頁。此消息由阿里巴巴在 X 上宣布,並由 ComfyUI 在其官方部落格上確認;ComfyUI 與 Comfy Cloud 使用者均可使用。
• Pixmax — 一個第三方AI創作平台,約在同一時期加入Wan 3.0,阿里巴巴官方帳號於8月25日宣布,並在Pixmax自家頁面獲得確認;該頁面主打「電影級輸出」和「跨任何藝術風格皆無瑕的視覺一致性」。這裡也是官方帳號首個創作者展示的所在地:Pixmax的Liz Zhang逐一介紹圍繞該模型打造的發布概念影片及創意工作流程。此為廠商宣布,並已在平台自家頁面上確認。
• PowerDirector — CyberLink 推出的消費級影片編輯器,現已加入 Wan 3.0,讓使用者可以直接在編輯器內將簡單提示轉換為完成的 AI 影片。此消息於 8 月 28 日在阿里巴巴官方 X 帳號上宣布,PowerDirector 的日本官方帳號也同步轉發;這是首款採用該模型的消費級主流影片編輯器。此為廠商及合作夥伴聲明,並非獨立測試結果。
• 第三方影片生成 API 平台——最新登場的路線,由阿里巴巴官方 X 帳號在發表週宣布。首個提供此模型的此類平台,透過簡單的任務型 API 公開模型,用於文字提示轉影片生成,定價為每秒 0.20 美元——阿里巴巴 1080p 輸出的標準費率——音訊在同一次生成中一併產生(預設開啟),影片長度 2–30 秒,並支援全模態參考:圖片、影片片段、音訊、檔案與網頁連結,另有首幀/末幀條件設定可作為替代輸入。此資訊由供應商宣布,並已在平台自身的模型頁面上確認。
自8月24日發布起,API已完全開放;8月初報導中所述的僅限邀請門檻已解除。對於「我今天可以呼叫它嗎?」這個問題,現在實際的答案是「可以」——無論是透過Alibaba控制台、透過已整合Wan 3.0的創意工具(如Envato、Leonardo.Ai、ComfyUI、Pixmax或PowerDirector),還是透過在發布當週即開始提供該服務的第三方影片生成API平台。
發布時程:8月6日 Beta 版,8月10日 展示會,8月24日 正式發布
追蹤訊號中標記的事件——8月10日在杭州的「Wan 3.0 發布」——需要一個精確的名稱。該事件確實存在且為官方活動:「Wan 3.0 Release and AI+Marketing Special Event」,於8月10日14:00在杭州Weike地區的阿里巴巴中心舉辦,由杭州市工業和信息化服務中心與Weike阿里巴巴中心共同主辦。議程涵蓋新模型的技術演進與特性、AI+行銷與電商解決方案分享,以及Wan 3.0實作練習。
但該模型當時已進入公開測試階段。8月10日的活動並非模型真正成形的時刻——那發生在8月6日——也不是正式發布,後者於8月24日登場。這是一場正式的企業面向展示:阿里巴巴向行銷與電商買家推介Wan 3.0,沿用其為Qwen應用程式所採用的兩天消費者加企業節奏。這些日期之所以重要,原因只有一個:如果你一直看到「Wan 3.0於8月10日推出」的說法,準確的陳述是:模型在8月6日進入公開測試,8月10日舉辦企業展示,並於8月24日正式發布。8月24日的發布才是真正算數的發布。

The launch ad was made with Wan 3.0 — here's the workflow
Wan 3.0 確實已正式上線的最直接證據,就是阿里巴巴將其用於自家發布活動。阿里巴巴在 X 平台上的官方 Wan 帳號(@Alibaba_Wan)發布了 Wan 3.0 發布廣告的完整解析——包括概念、角色設定、所用提示詞,乃至失敗的生成結果。精確而言,這是供應商對自家製作的說明,而非獨立測試,也是供應商所能提供的最有力證據,證明一個封閉、僅提供 API 的模型確實在執行真實的生產工作。這份解析的存在本身就是一個上線信號——阿里巴巴信任此模型,將其用於自家行銷。
阿里巴巴此後也將同樣的證據向外推廣。官方帳號的創作者系列——「創作者實際上如何在真實專案中使用 Wan 3.0——而不只是按一下生成?」——由 Pixmax_ai 的 Liz Zhang 開場,討論了上市概念影片、圍繞該模型建構完整創意工作流程,以及該平台的下一步。這與上市廣告拆解屬於同一類證據:由廠商發布、與合作夥伴的對談,並非獨立測試,但具體說明了該模型在阿里巴巴自身行銷之外從事實際製作工作的情況。
這份拆解所描述的工作流程,圍繞著{{1}}這個家庭最棘手的問題:在單一30秒的片段中,讓角色在多個鏡頭之間保持可辨識度{{/1}}。阿里巴巴的說明重點在於{{2}}透過角色設定表來錨定跨鏡頭的身份一致性{{/2}}。逆向研究了官方範例的社群分析師,以結構性的術語描述同樣的紀律:{{3}}將每個參考素材綁定到提示詞中具名的主題,而不是只描述一次;設定適用於整個片段的全域規則,包括一份明確的「禁止」清單,列出模型否則會預設採用的動作;並將時間軸撰寫成帶有時間戳記的節拍,而非氛圍描述{{/3}}。這些結構性發現是社群對{{4}}官方範例集所做的分析,並非廠商指引{{/4}},但它們與阿里巴巴展示的內容一致。
讓這份拆解與眾不同的細節在於,它呈現了失敗的部分。Alibaba 公開的是失敗的生成結果——漂移的身分、崩壞的節拍——而不只是成功落地的影格。這是對模型仍在哪些地方力有未逮的誠實審視,也是對任何在此之上建構者的實用規範:初次失敗是工作流程的一部分,而非模型壞掉的跡象。
開放權重的傳聞,以及為何未經證實
在 Wan 3.0 周圍,你會發現一個具體的說法:它以 Apache 2.0 授權發布開放權重,有兩種尺寸——一個 1.3B 的消費級 checkpoint 和一個 14B 的專業級 checkpoint——而且這些權重會在大約 8 月 10 日上傳到 Hugging Face。這是最需要小心的說法,因為它被最廣泛地重複,卻最缺乏支持。
• 它不在 Alibaba 的任何公告中。官方公開測試版的貼文描述的是付費、按量計費的 API。在 Alibaba 自己的資料中,完全沒有出現任何授權、權重釋出或 Hugging Face/GitHub 儲存庫。
• 這些數字看起來像是重複使用的。 1.3B + 14B 的組合正是 2025 年 2 月發布的 Wan 2.1 的確切規格。8 月 4 日發布的一篇對 Wan 3.0 傳聞的獨立拆解分析(在 beta 版公告之前)指出,「1.3B + 14B、Apache 2.0」的表格缺乏來源,且與 Wan 2.1 的事實相符,而非阿里巴巴所說的任何內容。
• 這與趨勢相悖。Wan 系列的開放權重止步於 Wan 2.2(2025 年 8 月)。Wan 2.5、2.6 和 2.7 從未發布核心權重;阿里巴巴在 2026 年開放的僅是周邊模型——一個音樂轉舞蹈模型、一份技術報告——而核心影片產品線始終保持閉源。開放的 Wan 3.0 將扭轉此一模式,這正是懷疑論者將其視為「有可能、未承諾、且與近期趨勢相悖」的原因。
• 8月10日權重的傳聞未經證實。它源自一份人工追蹤筆記,並非來自阿里巴巴或任何可追溯的來源;此外,8月10日的活動議程是關於營銷和電子商務,並非關於在Hugging Face上發布。
這一切都不能證明開放權重不會發生——供應商可以改變路線。但該說法的每一項要素目前都未能通過第一手來源查核,而官方發布所描述的是相反的發行模式。在阿里巴巴發布儲存庫或授權之前,Wan 3.0 開放權重的準確標籤是:未經證實,且與官方公告相矛盾。
獨立驗證於本週送達
這篇文章自發布以來一直秉持的界線——在獨立實驗室運行該模型之前,以上每個數字都是阿里巴巴自己的說法——已在9月3日改變。Artificial Analysis 的 Video Arena 是根據真實生成內容的盲測兩兩對決投票(而非供應商提供的數字)來為模型排名;該平台將 Wan 3.0 加入排行榜,而該模型在影片編輯排行榜(含音訊)上首度亮相即登上第一名:Elo 約1,189,來自數千票,明顯領先 MiniMax H3(約1,129)與 Gemini Omni Flash(約1,124)。在文字轉影片(含音訊)方面,它以約1,237拿下緊追在後的第二名,與榜首 Gemini Omni Flash(約1,238)實質上不分軒輊;AA 也將它列在圖片轉影片(含音訊)的第五名。這些排行榜同樣顯示出該系列的世代躍進:阿里巴巴先前的模型 Wan 2.7,在同一個影片編輯排行榜上以約1,077位居第五。競技場的評判能證明與不能證明什麼:盲測投票得出的 Elo 衡量的是人們在兩兩對決中偏好的輸出——這是強而有力的獨立品質訊號,但不是受控的實驗室基準——而阿里巴巴至今仍未發布任何模型卡、沒有參數量,也沒有可廣泛取得的權重。「未經驗證」的標籤已不再適用於該模型的頭條品質;它如今適用的是引擎蓋下的一切。
發行日期的問題,已回答。
就這篇文章所針對的搜尋來說,摘要很簡短:
• Wan 3.0 何時發布?公開測試版:2026年8月6日,經阿里巴巴確認。企業展示:2026年8月10日於杭州。正式發布:2026年8月24日。
• 它是開源的嗎? 沒有已確認的權重。Apache 2.0 / 1.3B + 14B 的說法未經證實,且官方發布僅限 API。
• 費用是多少?480p / 720p / 1080p 每秒分別為 0.3 / 0.6 / 1.2 元;一段 30 秒的 1080p 影片約 36 元(6.00 美元)。
• 我可以使用它嗎?可以。API 自 8 月 24 日起全面開放——可透過 Model Studio 或 Qwen Cloud、上述列出的消費者介面、第三方創意工具(例如 Envato 的 AI 影片工具、Leonardo.Ai、ComfyUI、Pixmax 或 PowerDirector),或是在上市首週即開始提供服務的第三方影片生成 API 平台使用。
人們真正在問的問題
Wan 3.0 真的發布了嗎,還是仍然只是傳聞?
它已全面發布:公開測試版於8月6日上線,企業展示於8月10日登場,正式發布則於8月24日推出。任何仍將Wan 3.0稱為傳聞或未發布測試版的報導都已過時——包括在8月6日之前仍屬準確的「尚未宣布」分析。
Wan 3.0 會開放權重嗎?
阿里巴巴的公告中並未提及此事;廣為流傳的 1.3B + 14B 規格對應的是 Wan 2.1,而非任何新版本;而且該系列自 Wan 2.2 以來的發展軌跡一直是走向封閉、僅限 API 的影片模型。在出現程式庫或授權之前,請將「開放 Wan 3.0」視為傳聞;近期的模式正是最有力的反證。
30秒的Wan 3.0影片要多少錢?
按照所公布的 API 費率,每個片段約為 1080p 36 元人民幣(6.00 美元)、720p 18 元人民幣(3.00 美元)、480p 9 元人民幣(1.50 美元)。這些是阿里雲的定價,以每秒計,且該 API 現已全面開放。一項 30% 的推出促銷活動將持續到 9 月 23 日,適用於 Bailian 和 Qianwen AI。
30秒生成是真的嗎?有什麼陷阱?
30秒單次生成是阿里巴巴主打的特色,也是中國影片模型中最長的單一原生片段,長度是 Wan 2.7 的兩倍。但廠商也坦承其弱點:音訊品質與畫面文字準確度仍有不足。現有的獨立評測結果是 Artificial Analysis 競技場於9月3日發布的評比——在影片編輯(含音訊)項目拿下第一,在文字轉影片(含音訊)項目則以些微差距位居第二——該評比是透過盲選投票衡量整體輸出品質,而非針對30秒上限進行測試。
真的有用 Wan 3.0 做出什麼實際的東西嗎?
是的——就是那支發布廣告本身。阿里巴巴在 X 上的官方 Wan 帳號表示,Wan 3.0 的發布活動是用該模型製作的,並公布了完整的製作拆解:概念、角色設定、提示詞,以及失敗的生成結果。這是廠商自述的案例,而非獨立測試,但它確實是銷售該封閉 API 的人員對其實際投入生產的用法。阿里巴巴的官方帳號也展示了外部創作者使用該模型進行實際工作的例子:對 Pixmax_ai 的 Liz Zhang 的一段專訪,談論發布概念片以及圍繞 Wan 3.0 的創意工作流程。同樣的標籤——廠商自述、由阿里巴巴挑選——但它將生產用途的證據延伸到阿里巴巴自身的行銷之外。
重點
Wan 3.0 確實存在、已經推出,而且定價極具侵略性——支援 30 秒生成、文件轉影片,720p 下按秒計費的價格低於主流競品,第三方創作路線也已打通,可透過 Envato 的 AI 影片工具、Leonardo.Ai、ComfyUI、Pixmax 和 PowerDirector 使用,另有一個影片生成 API 平台,以每秒 0.20 美元的固定費率提供該模型。最能證明它已作為正式生產軟體出貨的,就是這次上市宣傳活動本身:阿里巴巴表示,Wan 3.0 的上市廣告就是以該模型製作,並公布了完整拆解,內容包括角色設定表與失敗的生成結果。接下來幾天,官方帳號也從外部創作者處展示了同樣的證明:與 Pixmax_ai 的 Liz Zhang 進行了一場訪談,談論這支上市概念影片,以及環繞該模型的完整創作工作流程。需要抗拒的是圍繞它而生的種種說法。開放權重的宣稱,是拿舊規格重炒的謠言,與官方發布內容相牴觸。品質說法不再只是阿里巴巴的一面之詞:上市十天內,一個獨立競技場便將 Wan 3.0 列為影片剪輯(含音訊)第一名,並在文字轉影片(含音訊)項目以些微差距位居第二。真正還有待獨立檢驗的,是引擎蓋下的所有細節——架構、參數數量,以及任何必須實際執行模型、而非只對其輸出投票才能成立的主張。
仍可能改變此一看法的,是具體的事項:模型卡或參數數量能解答架構上的未決問題;儲存庫或授權會讓開放權重的傳聞成真;而受控的實驗室基準測試——而非 Artificial Analysis 本週發布的競技場 Elo——能讓品質宣稱變成完全可查核的事實。截至本次更新,Wan 3.0 的精確一句話總結是:一個已確認、定價激進的產品發布,目前在獨立影片剪輯評比中排名第一,在含音訊的文字轉影片領域則以微小差距排名第二——可透過 Envato、Leonardo.Ai、ComfyUI、Pixmax 和 PowerDirector 等第三方創意工具,以及第三方影片生成 API 平台使用——至於開放權重,證據顯示不太可能實現。
