
Tavus Griffin 与 Runway Gen-4.5:对话与渲染是两笔不同的账
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 223 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
把 Tavus Griffin 和 Runway Gen-4.5 摆在一起,你首先注意到的,是它们并不共用同一种计量单位。Griffin 由 Tavus 于 2026 年 10 月作为研究预览版发布,是一个人类交互模型——一套视频到视频系统,能进行实时的面对面交谈,并在通话进行过程中生成另一方的面容和声音。Runway Gen-4.5 则于 2025 年 12 月 1 日发布,并从 12 月 12 日起向付费订阅用户开放,是一款文本生成视频和图像生成视频的生成器,按其所渲染画面的秒数向你收费。前者按轮次出售,后者按秒出售,而唯一诚实的比较方式,就是意识到 Griffin 的一分钟与 Gen-4.5 的一分钟,并不是同一分钟。
两个朝相反方向运行的时钟
Gen-4.5 已在付费用户手中使用了将近一年。它能根据文本提示或静态图像生成两到十秒的片段,分辨率为 720p,帧率为每秒 24 或 25 帧,支持六种宽高比。它没有音轨,没有多镜头分镜,也没有对话——它是一个渲染引擎,而且是一个纪律严明的渲染引擎。它的 API 是异步的,对于一项耗时超出请求应有长度的任务来说,这正是恰当的形态。Runway 自家的 API 除了提供自己的模型外,也提供第三方视频模型;而该公司还发布了一个世界模型 GWM-1,这说明了 Runway 认为真正有趣的问题在哪里:不在于进行对话,而在于对场景建模。
Griffin 指向的是另一个方向。Tavus 已发布架构中的每一个设计决策,关心的都是延迟而非保真度。Tavec 编解码器以 48 kHz 运行,每帧 40 个值、每秒 100 帧,不使用码本,采用完全因果的解码器,数据包小至 10 毫秒。视频路径以 320 毫秒为块输出 720p,其中一个潜变量覆盖 25 fps 下的八帧,每个潜变量需要三次扩散步骤。在 H100s 上,音频到视频的延迟平均为 0.43 秒,Tavus 称这大约是其测得的第二快方法的一半。该技术栈中没有任何部分试图渲染出优美的十秒钟。其中一切都试图及时渲染出接下来的 320 毫秒。
所以,规格比较是真实的,但它不是记分牌:
• 计费单位 —— Runway Gen-4.5 按输出秒数计费,按下生成之前你就能知道费用。Griffin 则完全没有公布价格,因为它没有公开的产品。
• 片段长度 — Gen-4.5 可生成两到十秒的片段;Griffin 的时长与通话时长一致。
• 分辨率与帧率 — Gen-4.5 以 24 或 25 fps 渲染 720p;Griffin 则以 320 毫秒的分块流式传输 720p、25 fps 的画面。
• 音频 — Gen-4.5 不生成音轨;Griffin 可同时生成语音和视频,并能根据约 10 秒的样本克隆声音。
• 交互性 — Gen-4.5 采用单向异步请求;Griffin 为全双工,可在话语中途被打断。
• 动态与调色附加项 — Gen-4.5 以每秒 5 积分的附加费用提供 ProRes 和 PNG 导出,HDR 则为每秒 20 积分,当分辨率高于约四百万像素时升至 40;Griffin 没有对应项,因为它不导出文件。
• 可用性 — Gen-4.5 自 2025 年 12 月 12 日起已向付费订阅用户开放;Griffin 正面向选定测试者进行研究预览,Tavus 表示其暂不面向客户使用。

用直白的数字解读 Gen-4.5 法案
Runway 将 Gen-4.5 定价为每生成一秒视频 12 个积分。按每个积分一美分的标准价格计算,这相当于每秒 0.12 美元,如果能连续生成的话,一分钟素材大约要 7.20 美元——但你做不到,因为该模型最长只有十秒,所以一分钟意味着要把六次或更多次独立生成拼接在一起,并承受由此带来的各种连续性错误。ProRes 和 PNG 输出每秒加收 5 个积分,HDR 每秒加收 20 个积分,在超过约四百万像素时升至 40 个积分。API 积分与应用订阅积分分开计费,这个细节会让那些先在网页应用中做原型、随后转向 API 的团队措手不及。

Gen-4.5 是通过哪里访问到的,这一点也很重要。它可通过 Runway 自己的 API 以及多个第三方平台获取。它并非 OrcaRouter 的一条路由——我们并不托管它,也不会暗示你可以在这里获取它。
Griffin 要花多少钱,以及为什么那是个错误的问题
Tavus Griffin 尚无定价。Tavus 的发布材料称,研究预览版 Griffin-Lite 今日面向一组精选的早期测试者开放,更强大的模型随后将更大范围发布,Griffin-Lite 目前不供客户使用,而 Griffin 尚未登陆 Tavus 平台——一旦公司弄清楚如何安全发布它,它就会推出。
那段话承担了很多解释工作。它意味着,本文中的对比并不是一项采购决策,而且在 Tavus 公布价格之前也不可能成为采购决策。它还意味着,对于一个大多数供应商都会以带有“联系销售”按钮的产品页面来发布的结果,Tavus 却表现得异常直接。
Griffin 确实发布的是关于行为表现的证据。在与伦敦玛丽女王大学合作开展的一项研究中,54 名参与者中有 26 人——48%——在一分钟视频通话后相信 Griffin 是真人,而 Tavus 此前由 Phoenix-4.5、Sparrow-2 和 Raven-1 组成的方案为 41 人中的 1 人(2.4%)。在 NVIDIA 的 VideoFDB 基准测试中,2026 年 9 月评分,Tavus 报告在面对面 AI 方面位列第一:生成得分 3.83,而最强已报告基线为 2.80,人类参考为 3.92;感知得分 3.73,而最佳已报告基线为 3.44,人类为 4.20;在感知方面,对十五个模型进行评估,任务目标达成率为 73.8%。这些是供应商报告的数据,依托于 NVIDIA 构建的基准测试,而且它们关乎对话,而非电影摄影。

不同的工作,直白地说明
如果你想要一个黄昏城市的镜头,并且摄像机运动与参考帧匹配,Gen-4.5 是一个确实存在的工具,今天就能做到,价格约为每秒十二美分。Griffin 在任何情况下都帮不了你,因为 Griffin 不接受提示词,也不返回文件。
如果你想要一张能倾听、会被打断,并且能在几分钟内保持对话连贯的脸,Gen-4.5 帮不上忙,因为它在请求发送后就不再接受输入。一段带有会说话头像的十秒短片并不是对话;它只是对话的视频,而这一区别正是 Tavus 所推销的。
两者的重合部分比“AI 视频”这一标签所暗示的要窄:两者都输出人物像素,并且都以 720p 和 25 fps 运行。除此之外的一切都不同,连发票上的单位都不一样。
为什么路由器恰好在这个位置很有用
最终同时需要这两类能力的团队,往往是以惨痛的方式才发现的——产品既想要一个生成的定场镜头又想要一个会说话的数字人,而这两者来自不同的供应商,带着不同的认证方式、不同的计费体系和不同的故障模式。这正是单一端点能体现价值的情形。OrcaRouter 用一个密钥承载两百多个模型,以0% 加价透传供应商的标价,因此供应商调价当天价目表上就会同步生效,同时在一条路由失败时改向健康的供应商重试,而不是把超时直接丢给你。路由 DSL 让你把低风险的草稿发往容量最便宜的地方,把任何面向客户的内容固定到特定供应商;模型融合则让你在昂贵的生成调用之前,先接一个便宜的文本模型来重写提示词,免得白白浪费那几秒钟。
准确地说,在这场对比中,它涵盖和不涵盖哪些内容:Gen-4.5 不是我们的路线之一,Griffin 也不是。目录的视频部分包括minimax/minimax-h3,这是 MiniMax 的全模态生成器,768P 输出每秒 0.08 美元,2K 每秒 0.13 美元——与 Runway 处于同一维度上的按秒计价,而且来自一个我们今天就能实际为你提供服务的模型。如果你需要的是生成的秒数,并且希望它们与其他所有内容合并在同一张账单上,这就是诚实的推荐。
该围绕哪一个来安排?
Gen-4.5 是安全得多的依赖选择,优势十分明显:自 2025 年 12 月起,它就已交到付费用户手中,其 API 有文档记录,积分有明确定价,而它的各项限制——十秒时长、无音频、无分镜——都是公开说明的,而非需要用户自行摸索发现。需要生成影像素材的团队,本周就能开始使用。
Griffin 是上限更高、下限更低的押注。它的 48% 和 0.43 秒的平均延迟所描述的是一种真正全新的东西,而 Tavus 至今拒绝出售它,这一事实说明的是这个东西本身的成熟度,而非一项营销决策。不要把它作为依赖项写进路线图;把它放进观察名单,等那条安全说明消失时再来看看。
