一張 Meta Muse Video 的參考卡,疊在「Meta Superintelligence Labs,2026 年 7 月 7 日的預覽貼文」這行文字上方,並列出三項從 Meta 自家頁面讀到的事實:早期預覽,即將向創作者與 Meta AI 推出;原生音訊與音視訊同步,被 Meta 列為目前的缺口;以及 Meta 所稱在文字轉影片的人類偏好 Elo 中排名第 3。OrcaRouter 標誌合成於右下角。
Guides & Insights

Meta Muse Video:Meta 預覽影片模型的參考頁面

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

Meta Muse Video 尚未有發布日期。這就是大多數人帶著這個問題前來時所得到的完整答案,而這也是 Meta 自家頁面給出的答案:該模型是以早期預覽的形式分享,被描述為即將向創作者與 Meta AI 推出,此後便未再公布任何正式推出日期、價格、解析度或影片片段長度。本頁是這個名稱的參考目的地——Meta Muse Video 是什麼、Meta 對它有何宣稱、它在公開排行榜上位於何處,以及你今天能用它做什麼、不能做什麼。這並非第二份公告:該系列的公告早已存在,其中一份正是我們自己對該預覽及其周邊 API 外洩的報導,本頁僅連結該報導一次,並不重述其內容。

在實質內容之前,先講理由,因為讀者理應知道這是哪一種頁面。我們已經過了那個通常用來決定一個模型是否值得撰寫的七天窗口——本頁寫於 2026-09-29,窗口於 2026-09-22 開啟,而 Meta 對 Meta Muse Video 的預覽早於該窗口。我們所依據的例外,並不是新聞豁免。這是一個模型的標準參考頁,該模型今天已在我們的頁面目錄中上線:是讀者搜尋模型自身名稱、而非某個事件名稱後抵達的目的地。它的依據是我們在 2026-09-29 以第一方數據測得的持續搜尋需求,而不是某次發布的新鮮度——在截至 2026-09-25 的 28 天內,我們關於此系列的頁面在十八個 URL 上共獲得 2,530 次曝光,而它們全都依附在單一篇關於外洩的頁面之下。讀者正在問這個問題,卻找到錯誤的頁面。本文提到的可標定日期的錨點——Meta 自己於 2026 年 7 月 7 日的貼文——是用來標定該模型的日期,而不是報導某個事件。

Meta Muse Video 是什麼,先從掌管其他一切的部分開始

Meta Muse Video 是早期預覽版,並非正式全面推出的模型。這項區別並非模稜兩可的迴避說法;而是本頁其餘內容所依據的事實。Meta 自家的發布貼文,以 Meta Superintelligence Labs 為署名,於 2026 年 7 月 7 日發布,標題為「推出 Muse Image 與 Muse Video」,在開頭段落便開門見山地說:「我們很興奮地宣布推出 Muse Image,並預覽 Muse Video,這是 Meta Superintelligence Labs 開發的首批媒體生成模型。」兩者之中,一款已正式推出,另一款則僅供預覽。影片模型的可用性說明,在同一頁上重複出現兩次,內容是:「Muse Video 即將向創作者與 Meta AI 推出。」

這對整個 Muse 家族而言代表什麼,值得一次說清楚,因為這條界線很容易模糊:Meta Muse Image 和 Meta Muse Video 是同時推出的,也共享一個基礎——Meta 表示,影片模型「建立在與圖像模型相同的預訓練基礎上」——但兩者處於不同階段。Meta Muse Image 是已推出的產品。Meta Muse Video 則是一個有名稱的示範。

Meta 對它宣稱的內容,以及 Meta 自己說仍嫌不足的部分

Meta 針對 Meta Muse Video 的說法簡短、具體,且屬於廠商自行報告的內容;也就是說,它們來自 Meta 自家的貼文,尚未被任何我們能引用的對象獨立重現:

• 在提示詞遵循、視覺保真度與時間一致性方面具備競爭力的表現。這是 Meta 在其預覽區段中逐字提出的說法,而且這是一項相對性的宣稱,並未附帶任何具名的比較組合。

• 原生音訊支援。Meta 的介紹將 Muse Video 描述為具備「卓越的視覺保真度與原生音訊支援」——音效是與畫面同步生成,而非事後添加。Meta Muse Image 僅生成靜態圖像,沒有音訊功能,因此這正是區分兩者的關鍵能力。

• 兩個已坦承的落差。在提出該說法的同一段文字中,Meta 點名了目前尚未到位的事物:「我們正在投資目前仍有效能落差的領域,例如影音同步與物理上精確的高速動作。」照字面解讀。具備原生音訊、但影音同步不完美的預覽,並不是具備可靠脣形同步的預覽,而高速動作則被點名為另一項已知弱點。

• 一項浮水印承諾,而非有文件記載的流程。Meta 的隱形來源追溯系統 Content Seal 隨 Muse Image 一同推出;該文章表示 Meta 計劃「很快將 Content Seal 擴展至影片」。對影片生成模型而言,這就是目前為止的來源追溯解答——已規劃,但尚未說明。

這份資料集中沒有基準測試。Meta 並未發布任何針對 Meta Muse Video 的提示詞遵循度、保真度或同步性的獨立評估,而 Meta 頁面上確實存在的那些數字,是該圖像模型的內部消融結果。基準測試的缺席是文件本身的一項事實,而在這裡,這正是那項事實。

A screenshot of the 'Previewing Muse Video' section of Meta's own post, reading: 'Alongside the release of Muse Image, we're sharing an early preview of Muse Video. It offers competitive performance in prompt adherence, visual fidelity, and temporal consistency. We're investing in areas with current performance gaps, such as audio-video synchronization and physically accurate fast motion. Muse Video is coming soon to creators and in Meta AI.' Below it, a clip caption reading 'A baby panda tumbling head over heels down a small grassy slope', and the line 'On Arena, Muse Video ranks No. 3 in human-preference Elo for text-to-video at the time of writing.'

Muse Video 在 Arena 上排在什麼位置,以及為何你不該把這個數字視為穩定不變的

Meta 以自己的話說明該模型在排行榜上的位置:「在 Arena 上,截至撰寫本文時,Muse Video 在文字轉影片的人類偏好 Elo 中排名第 3,」該頁面上的圖表標題為「截至 2026 年 7 月 5 日的 Arena Elo 排名」。請將這三個限定條件都視為關鍵。這是供應商報告的數字,這是人類偏好 Elo,而非基準測試分數,而且它明確地被限定在某個時間點——即撰寫本文時,以及在發文前兩天所標註的圖表上。

如果你在其他地方看到不同的數字,最誠實的描述是:這個名次隨著時間推移而變動了。人類偏好排行榜持續收集投票,並隨著參賽項目增加而重新排名,因此七月擷取到的名次,並不代表排行榜在九月顯示的名次,而我們不會在這裡去調和這些快照:我們既有的 Muse Video 外洩頁面保存了附有日期的擷取紀錄,以及其背後的投票數,那才是它們該待的地方。請在腦中把這兩個頁面以一對一的關係連結起來:那個頁面是時間軸,這個頁面是模型。有一點提醒適用於你在任何地方讀到的任何數字,包括 Meta 的數字——一個對無法公開取用的模型進行評分的排行榜,測量的並不是你能不能在上面開發。

Muse Video 不是什麼

有三個值得釐清的困惑,因為它們正是促使這頁背後搜尋出現的原因:

• 這不是 Meta AI 內已推出的產品。「即將向創作者與 Meta AI 推出」這樣的說法,就是該發布目前的狀態。沒有東西可以開啟。

• 不在 Meta 的 Model API 上。Meta 的開發者文件在介紹 Model API 時,一併列出了它所服務的模型——Muse Spark、Muse Image、Muse Voice Transcribe、Muse Glimmer 和 Segment Anything——而 Meta Muse Video 並不在其中。它的開發者網址會導向 Meta 自家的「此頁面無法使用」畫面。因此,這個預覽版並沒有附帶端點、識別碼、結構描述或速率限制,任何告訴你這條 API 路徑存在的人,都只是在猜測。

• 這跟 Meta 的即時虛擬人像研究不是同一回事。 Meta 的研究部落格在 2026-09-23 刊出了「Bringing Your Muse to Life」,文中介紹了 Muse Realtime Avatar——這是一層具身化層,能將 Muse Realtime Voice 轉變為可互動的虛擬人像。那是即時、可對話的介面,而不是短片生成器;它是另一項產品,在我們這組資料中有不同的參考頁面。如果你想要的是可以下載、剪輯的生成影片,那這兩者也都不是。

Meta Muse Image 是你今天就能實際使用的兄弟產品

這是對大多數搜尋 Meta Muse Video 而來的讀者而言的實際答案。Meta 的圖像模型才是真正已推出的那個,而它就是你現在可以使用的 Muse 生成模型。

• 運行範圍(供應商回報)。 Meta 的貼文指出,Meta Muse Image「即日起可在 Meta AI 應用程式和 meta.ai 上使用,美國的 Instagram 限時動態以及部分國家的 WhatsApp 也能使用,並即將在 Facebook 推出。」

• Meta 公布價格之處的收費為何。Meta 自家針對 Meta Muse Image 的模型頁面標明固定收費「每張 0.01 美元」,並列出該模型已啟用推理與工具使用功能,形容其為「由搜尋作為依據的代理式圖像生成,並以每張 0.01 美元的價格針對生產規模量定價」。那是 Meta 在自家頁面上的數字,也是我們唯一能指出的可讀 Muse Image 價格。Meta 的價目表並未以我們能擷取的形式公布:Meta 開發者網域下的定價網址只回傳一個不含任何數字的空殼,因此任何 Muse 模型的價格,唯有在模型頁面上讀到時才可供報導,正如這次的情況。

• 它能做到影片模型辦不到的事。Meta 將 Meta Muse Image 描述為代理式生成器——它會規劃、使用搜尋與程式碼工具、從多個參考素材進行組合,並在多輪互動中精進自身的成果。這些在 Meta Muse Video 上都沒有任何文件記載。

針對 Meta Muse Video,沒有對應的價格、方案層級或限制可報告,因為 Meta 並未公布任何相關資訊。我們不會用同系列頁面來填補這個缺口,你也不應該這麼做。

上市日期問題,直接解答

Meta 尚未公布 Meta Muse Video 的正式上市日期。截至 2026-09-29,在 Meta 自家頁面上,沒有日期、沒有月份、沒有時間範圍,也沒有任何承諾,只有「即將推出」。對於你看到的每一個 Meta Muse Video 具體日期,你都應該將其視為推測,除非它能追溯到比 2026-07-07 貼文更新的 Meta 公告——這包括外流的時間範圍、日曆上的猜測,以及任何源自開發者平台痕跡的內容。我們自己現有關於這次外流的報導,已將該限制視為自身規則,而我們在此逐字沿用:若某個頁面引用 Meta Muse Video 的具體推出日或價格,卻沒有更新的 Meta 公告,那就是在推測。

能確定的是這些未解問題的輪廓,而每一項都是 Meta 尚未處理的事:存取途徑(先推出消費者應用程式、開發者端點,或兩者並行)、影片片段長度與解析度、原生音訊輸出是否包含在首發版本中,還是日後才成熟、區域推行,以及商業條款。如果你正在決定 Meta Muse Video 是否會改變本季的製作計畫,目前的答案是還不能,因為根本沒有可供規劃的依據。

你能透過 OrcaRouter 呼叫 Meta Muse Video 嗎?不行——而這是你所能呼叫的

我們在 2026-09-29 查核了自己實際線上的模型清單,而不是憑假設,而 Meta Muse Video 並非由我們提供。這就是誠實的那句話,也是讀者對一個自家供應商尚未發布的模型所應預期的說法:一個預覽中的模型不可能在任何地方被路由,而若有閘道告訴你並非如此,那會是錯的。我們對 Muse 涵蓋範圍的任何說明,都不應被解讀為暗示相反的情況——收錄 Muse Spark 並不代表收錄一個 Meta 尚未推出的 Meta 模型。

今天真正可用的範圍更窄,卻也更實用:Meta Muse Spark 1.2 今天已可在 OrcaRouter 上路由,採用 Meta 自家的定價,我們不額外加價,因此想在自己的流程中加入 Meta 推理模型的管線,不必枯等一個根本不存在的影片端點。而當 Meta Muse Video 真的開放時——無論以什麼形式——同樣的模式也適用於我們確實有提供服務的模型:我們實際有路由的模型,只要一組金鑰和一個端點,0% 加價的原價直通,讓供應商的價格變動在生效當天就在我們這邊同步生效,還有自動容錯移轉,讓你用來對照正式路徑測試的模型,本身永遠不會成為單一故障點。這正是路由層存在的目的,而這也是本頁面唯一能幫你處理你無法呼叫的模型的方式。

A screenshot of the OrcaRouter model page for Meta: Muse Spark 1.2, showing the model name, the identifier meta/muse-spark-1.2, its input surface of text, image, video, file and audio against a text output, a p50 time-to-first-token of 10.00 s over the last seven days, and the listing price of $1.25 input / $4.25 output per million tokens.

該關注什麼,以及什麼會改變這個頁面

有三件事能讓 Meta Muse Video 從預覽版變成你可以實際據以行動的對象,而每一件都是具體、可查證的事件,而非傳聞:它在 Meta 開發者模型清單中的條目——那正是 API 介面必須出現的地方;Meta 自家貼文上可用性說明那行的變更,或是一篇以 Meta Superintelligence Labs 署名的新貼文;以及一個已公布的價格,而這個模型至今從未以任何形式有過價格。在其中一項成真之前,本頁的答案依然成立,而讀者在等待期間所能做的最有用的事,就是決定什麼才算夠好。現在就寫下你會用來測試它的測試簡報——一個動作密集的鏡頭、一段你會檢查同步的旁白、一段必須在整段長度內維持臉部一致性的短片——這樣當存取開放的那天,你就能用自己的素材來評判這個模型,而不是根據示範影片來評判它。

這就是 Meta Muse Video 的真實狀況:一個來自真正實驗室、貨真價實的模型,只是預覽而非正式推出,是 Meta Superintelligence Labs 一對媒體生成模型中的第一款,曾在七月某個時間點於排行榜上名列前茅,而那個排名如今已經變動,而且仍然沒有你能夠據以規劃的日期。

A scoreboard for Meta Muse Video with six rows: availability is early preview, coming soon; general release date, none announced; claimed, prompt adherence, visual fidelity and temporal consistency; vendor-named gap, audio-video synchronization and fast motion; text-to-video rank, No. 3, vendor-reported; price, none published. The footer reads: all figures per Meta's own post of July 7, 2026; rank vendor-reported and dated. The OrcaRouter logo sits bottom-right.