一张关于 Meta Muse Video 的参考卡,叠在“Meta Superintelligence Labs,预览帖日期为 2026 年 7 月 7 日”这行字之上,并列出从 Meta 自家页面上读到的三项事实:早期预览,即将面向创作者和 Meta AI 推出;原生音频与音视频同步,被 Meta 列为当前的一项短板;以及 Meta 报告的在文本生成视频人类偏好 Elo 中排名第三。OrcaRouter 标志合成于右下角。
Guides & Insights

Meta Muse Video:Meta 预览版视频模型的参考页

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

Meta Muse Video 没有发布日期。这就是大多数人带着这个问题前来时得到的全部答案,也是 Meta 自家页面给出的答案:该模型是作为早期预览分享的,被描述为即将面向创作者和 Meta AI 推出,而自那以后,就没有再公布任何正式可用日期、价格、分辨率或片段长度。本页是关于这一名称的参考页面——Meta Muse Video 是什么、Meta 对它宣称了什么、它在某个公开排行榜上处于什么位置,以及如今你可以用它做什么、不能做什么。这不是第二份公告:该系列的公告已经存在,其中之一就是我们对这次预览以及围绕它的 API 泄露的报道,本页只链接一次,不再重述。

在实质内容之前,先讲推理,因为读者有权知道这是怎样一种页面。我们已经越过了通常决定一个模型是否值得撰写的七天窗口——本页写于 2026-09-29,窗口于 2026-09-22 开启,而 Meta 对 Meta Muse Video 的预览早于该窗口。我们所立足的例外并不是新闻豁免。这是一个权威参考页,面向一个今天已上线于我们页面目录中的模型:读者搜索模型自身名称、而不是事件名称后所抵达的目的地。它的依据是我们于 2026-09-29 用第一方数据测得的持续性搜索需求,而不是一次发布的新鲜度——截至 2026-09-25 的 28 天内,我们关于该系列的页面在十八个 URL 上共获得 2,530 次展示,而它们全都依附于同一篇关于泄露的页面。读者正在问这个问题,却找到了错误的页面。本文提到的可确定日期的锚点——Meta 自己于 2026 年 7 月 7 日发布的帖子——是用来给该模型定日期的,而不是用来报道某个事件。

Meta Muse Video 是什么,从决定其他一切的部分开始说起

Meta Muse Video 是早期预览版,并非普遍可用的模型。这一区别并非含糊其辞;本页其余内容正是从这一事实展开的。Meta 自己的发布帖以 Meta Superintelligence Labs 为署名,于 2026-07-07 发布,标题为“推出 Muse Image 和 Muse Video”,其在开头段落中直言不讳地写道:“我们很高兴推出 Muse Image,并预览 Muse Video,这是 Meta Superintelligence Labs 开发的首批媒体生成模型。”两者中有一个已正式发布。另一个则处于预览阶段。视频模型的可用性说明在同一页面上重复了两次:“Muse Video 即将面向创作者和 Meta AI 推出。”

这对整个 Muse 家族意味着什么,值得明确说明一次,因为很容易混淆:Meta Muse Image 和 Meta Muse Video 是一起推出的,并且共享一个基础——Meta 表示,视频模型与图像模型“构建在相同的预训练基础之上”——但它们处于不同阶段。Meta Muse Image 是一款已发布的产品。Meta Muse Video 则是一个有名有号的演示。

Meta 对其宣称的内容,以及 Meta 自己承认仍然薄弱的部分

Meta 对 Meta Muse Video 的宣称简短、具体,而且来自厂商自述,也就是说,它们出自 Meta 自己的帖子,尚未被任何我们能引用的来源独立复现:

• 在提示词遵循度、视觉保真度与时间一致性方面具有竞争力的表现。这正是 Meta 在其预览部分逐字给出的说法,而这是一个相对性的宣称,并未附带任何具名的对比基准。

• 原生音频支持。Meta 在产品介绍中将 Muse Video 描述为能够提供“卓越的视觉保真度与原生音频支持”——声音与画面同步生成,而非事后添加。Meta Muse Image 生成静态图像,不具备音频功能,因此这正是区分二者的关键能力。

• 两个已承认的差距。在同一段中,Meta 点明了尚不存在的东西:“我们正在投资于当前存在性能差距的领域,例如音视频同步和物理上准确的快速运动。”照字面理解。一个带有原生音频、但音视频同步并不完美的预览,并不是一个口型同步可靠的预览,而快速运动则被点名为另一个已知弱点。

• 一项水印承诺,而非有文档记录的流程。Meta 的隐形溯源系统 Content Seal 随 Muse Image 一同发布;该帖子称 Meta 计划“很快将 Content Seal 扩展到视频”。对于一个视频生成模型而言,就目前而言,这就是溯源方面的答案——只是有计划,尚无具体说明。

这一组中没有基准测试。Meta 没有发布对 Meta Muse Video 的提示词遵循度、保真度或同步性的独立评估,而 Meta 页面上确实存在的数字,是图像模型的内部消融结果。缺失基准本身就是一个关于文档的事实,而这里的事实正是如此。

A screenshot of the 'Previewing Muse Video' section of Meta's own post, reading: 'Alongside the release of Muse Image, we're sharing an early preview of Muse Video. It offers competitive performance in prompt adherence, visual fidelity, and temporal consistency. We're investing in areas with current performance gaps, such as audio-video synchronization and physically accurate fast motion. Muse Video is coming soon to creators and in Meta AI.' Below it, a clip caption reading 'A baby panda tumbling head over heels down a small grassy slope', and the line 'On Arena, Muse Video ranks No. 3 in human-preference Elo for text-to-video at the time of writing.'

Muse Video 在 Arena 上处于什么位置,以及为什么你不应把这个数字视为稳定不变的

Meta 用自己的话说出了该模型在排行榜上的位置:“截至撰写本文时,在 Arena 上,Muse Video 在文本生成视频的人类偏好 Elo 中排名第三”,该页面上的图表标题为“Arena Elo 排名,截至 2026 年 7 月 5 日”。这三个限定条件都至关重要。这是一个由厂商报告的数值,它是人类偏好 Elo,而非基准测试得分,并且它被明确限定在某一时刻——即撰写本文之时,而图表所标注的日期比文章发布还早两天。

如果你在其他地方看到了不同的数字,诚实的描述是:排名随时间发生了变化。人类偏好排行榜会持续收集投票,并随着参评条目增加而重新排名,因此 7 月记录到的排名并不是榜单在 9 月显示的排名,我们也不会在这里去统一这些快照:我们现有的关于 Muse Video 泄露的页面保存了带日期的抓取结果以及其背后的投票数,那里才是它们该在的地方。在心里把这两个页面一一对应起来:那个页面是时间线,这个页面是模型。有一点提醒适用于你在任何地方读到的任何数字,包括 Meta 的——一个给没有公开访问权限的模型打分的榜单,并不是在衡量你是否能基于它进行构建。

Muse Video 不是什么

有三个混淆点值得澄清,因为正是它们导致了本页面背后的那些搜索:

• 并非 Meta AI 内已发布上线的产品。“即将面向创作者和 Meta AI 推出”这一表述就是该版本当前的实际情况。并没有什么可以打开。

• 不在 Meta 的 Model API 上。Meta 的开发者文档在介绍 Model API 时列出了它所服务的一系列模型——Muse Spark、Muse Image、Muse Voice Transcribe、Muse Glimmer 和 Segment Anything——而 Meta Muse Video 并不在其中。为其提供的开发者 URL 会跳转到 Meta 自己的“此页面不可用”页面。因此,这次预览发布时并未附带端点、标识符、架构或速率限制,任何告诉你该 API 路径存在的人都是在猜测。

• 与 Meta 的实时虚拟形象(realtime avatar)工作不是一回事。 Meta 的研究博客在 2026-09-23 列出了《Bringing Your Muse to Life》,其中介绍了 Muse Realtime Avatar——一个具身层(embodiment layer),可将 Muse Realtime Voice 转变为可交互的虚拟形象。那是一个实时的对话界面,而不是片段生成器,并且它是另一款产品,在我们这组资料中对应另一个参考页面。如果你想要的是可下载、可剪辑的生成视频,那两者也都不是。

Meta Muse Image 是你现在真正能用的那个兄弟产品

对于大多数通过搜索 Meta Muse Video 来到这里的读者来说,这就是实际答案。Meta 的图像模型才是真正发布的那一个,而它就是你现在可以使用的 Muse 生成模型。

• 运行范围(供应商报告)。Meta 的帖子称,Meta Muse Image“今日起可在 Meta AI 应用和 meta.ai 上使用,在美国可用于 Instagram Stories,在部分国家可用于 WhatsApp,并即将登陆 Facebook。"

• Meta 公布价格时,费用是多少。Meta 自己在 Meta Muse Image 的模型页面上标明了固定的“$0.01/image”,并在推理与工具使用均处于启用状态下列出该模型,将其描述为“由搜索提供依据的智能体式图像生成,面向生产规模定价为 $0.01/image”。那是 Meta 页面上的 Meta 给出的数字,也是我们唯一能够指出的可读的 Muse Image 价格。Meta 的费率卡并未以我们能够抓取的形式公布:Meta 开发者域名下的定价 URL 只返回一个不含任何数字的空壳,因此任何 Muse 模型的价格,只有在模型页面上读到才可报道,正如这次的情况一样。

• 它能做到视频模型做不到的事。Meta 将 Meta Muse Image 描述为一款智能体式生成器——它会制定计划、调用搜索与代码工具、依据多个参考素材进行合成,并在多轮交互中不断打磨自己的作品。而 Meta Muse Video 没有任何这方面的文档说明。

对于 Meta Muse Video,没有相应的价格、层级或限制可报告,因为 Meta 没有公布任何相关信息。我们不会从同级页面来填补这一空白,你也不应该这样做。

发布日期问题,直接回答

Meta 尚未公布正式可用日期。截至 2026-09-29,在 Meta 自己的页面上,除了“即将推出”之外,没有具体日期、没有月份、没有时间窗口,也没有任何承诺。对于你在 Meta Muse Video 上看到的每一个具体日期,你都应将其视为猜测,除非它能追溯到比 2026-07-07 那篇帖子更新的 Meta 公告——这包括泄露的时间窗口、日历猜测,以及任何源自开发者平台痕迹的信息。我们自己对此次泄露的现有报道,把这一约束作为其自身规则,我们在此逐字继承:一个引用 Meta Muse Video 具体发布日或价格、却没有更新的 Meta 公告的页面,就是在猜测。

可以确定的是这些未决问题的轮廓,而每一个都是 Meta 尚未回应的事项:访问路径(先面向消费者应用、开发者端点,还是两者皆是)、片段长度与分辨率、原生音频输出是会包含在首个版本中还是之后再逐步完善、区域推广,以及商业条款。如果你正在判断 Meta Muse Video 是否会改变本季度的制作计划,那么今天的答案是:不会,因为根本没有什么可供作为规划依据。

你能通过 OrcaRouter 调用 Meta Muse Video 吗?不能——不过你可以调用以下这些

我们在 2026-09-29 检查了我们自己的实时模型列表,而不是想当然,Meta Muse Video 并非由我们提供服务。这是诚实的说法,而对于一款其自身厂商尚未发布的模型,这也正是读者应当期待的那句话:预览版模型不可能在任何地方可路由,而一个告诉你并非如此的网关会是错的。关于我们 Muse 覆盖范围的任何内容,都不应被解读为暗示相反的情况——提供 Muse Spark 并不意味着提供 Meta 尚未发布的 Meta 模型。

今天真正可用的东西更窄,但也更实用:Meta Muse Spark 1.2 如今已可在 OrcaRouter 上路由,按 Meta 自己的标价,我们不加任何加价,因此想要把 Meta 的推理模型纳入其中的工作流,现在就能用上,而不必去等一个并不存在的视频端点。而当 Meta Muse Video 真正开放时——无论以何种形式——同样的模式也适用于我们确实提供的模型:一个密钥、一个端点,接入我们确实路由的模型,0% 加价的直通机制让供应商的价格变动在生效当天就同步到我们这边,还有自动故障转移,让你正在针对生产路径测试的模型永远不会独自成为单点故障。这正是路由层的意义所在,也是本页面能为你无法调用的模型提供帮助的唯一方式。

A screenshot of the OrcaRouter model page for Meta: Muse Spark 1.2, showing the model name, the identifier meta/muse-spark-1.2, its input surface of text, image, video, file and audio against a text output, a p50 time-to-first-token of 10.00 s over the last seven days, and the listing price of $1.25 input / $4.25 output per million tokens.

值得关注的事项,以及什么会改变这一页面

有三件事会让 Meta Muse Video 从预览变成你可以据以行动的对象,而每一件都是具体、可核查的事件,而不是传闻:它出现在 Meta 的开发者模型列表中——API 接口要出现,就必须出现在那里;Meta 自己那篇帖子的可用性说明发生变化,或者出现一篇以 Meta Superintelligence Labs 为署名的新帖子;以及公布价格,而这个模型至今还从未以任何形式有过价格。在其中任何一项落地之前,本页的答案就仍然成立,而读者在等待期间能做的最有用的事,就是决定什么才算足够好。现在就写下你日后要拿来测试它的简报——一个运动密集的镜头、一段你要检查同步的旁白、一段必须在整个时长内保持人脸一致的片段——这样等访问开放那天,你就能用自己的素材来评判这个模型,而不是根据一支演示样片来评判它。

这就是 Meta Muse Video 的真实处境:一个来自真正实验室的真家伙,以预览而非正式发布的形式亮相,是 Meta Superintelligence Labs 两款模型中的首个,在 7 月某个时间点于某个榜单上名列前茅,而该榜单此后已经变动,并且仍然没有一个能让你据此安排计划的日期。

A scoreboard for Meta Muse Video with six rows: availability is early preview, coming soon; general release date, none announced; claimed, prompt adherence, visual fidelity and temporal consistency; vendor-named gap, audio-video synchronization and fast motion; text-to-video rank, No. 3, vendor-reported; price, none published. The footer reads: all figures per Meta's own post of July 7, 2026; rank vendor-reported and dated. The OrcaRouter logo sits bottom-right.