
Odyssey-3 vs Seedance 2.5:数秒素材 vs 数小时仿真
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77代码
- google新Google: Gemini 3.8 Flash2026-09-0241智能76代码
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0340智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69代码
问 Seedance 2.5 要多少钱,你会得到一个以每秒美元计的答案。问 Odyssey-3 要多少钱,你却什么也得不到——没有价目表,没有接口端点,没有授权,因为这款于 2026 年 9 月 15 日发布的模型尚未正式推出,其制造商只公开承诺会在“未来几周内”问世。这一落差看似是成熟度的差异,而实质多半是品类上的差异。Seedance 2.5 由字节跳动的 Seed 团队于 2026 年 7 月 31 日发布,是一台按成片秒数计费、卖给需要素材的人的生产引擎。Odyssey-3 则是一个带动作接口的世界模型,它瞄准的买家根本不要素材——它要的是一个当有东西在其中行动时能正确作出响应的环境。两者正被指向一些相同的问题,包括机器人与驾驶数据,而这恰恰是值得仔细厘清这一区别的原因所在。
Seedance 2.5 是一个制作引擎,首发合作伙伴证明了这一点
核心亮点在于时长。Seedance 2.5 单次生成三十秒,是其前代十五秒的两倍,并支持多轮扩展以生成更长序列,据报道其超长测试模式还能进一步延长。仅这一点就改变了该模型的定位:三十秒是一整场戏,而非一个镜头,ByteDance 的营销正是因此才强调“一镜到底”这一说法。
围绕时长的,是那些让生成内容能用于真实剪辑的功能。该模型支持大量多模态参考——有报道称,每次生成最多可接受三十张图像、十个视频片段和十个音频片段,其中参考视频和参考音频的上限均约为三十秒,而纯音频参考是这个版本新增的。新增了针对白模或黏土渲染、绿幕素材、运动参考和创意参考的参考模式。控制精细到时间戳级别,使提示词能够针对特定时间范围内的叙事、镜头或运动,而生成后的区域级编辑可保持连续性,而不必强制重新生成。音频和视频在一次处理中联合生成,因此口型同步会跟随所引用的对白,并且原生支持十多种语言。
采用名单就是关键线索。发布当天,XCMG、XPeng、Lingchu Intelligence、Weifen Zhifei 和 Qiongche Intelligence 确认了合作,而所述用例从具身 AI 训练数据、自动驾驶极端场景,一直延伸到工业 SOP 培训视频、教育及电商广告。其中一部分是创意工作。另一部分是为日后将在现实世界中行动的系统生成数据——而这一部分正是与 Odyssey-3 重叠的部分。
Seedance 2.5 一秒多少钱
定价已公布,并且按 token 而非秒计费,因此在正式投入之前,值得先做一步换算。ModelArk 端点报告的数字是:无视频输入时每百万 token 为 10.70 美元,包含视频输入时每百万 token 为 6.40 美元。实际算下来,一段 5 秒、16:9、480p 的片段大约为 0.51 美元,而同一片段在 720p 下约为 1.16 美元。这些是供应商在发布时报告的公布费率;请将它们视为当前标价,而不是每项交付成果的实测成本,因为分辨率和时长都会使其按比例变化。
可用范围确有实际边界。消费者访问通过字节跳动自有应用进行,而 API 访问则分为中国境内的火山引擎方舟和国际上的 BytePlus ModelArk。至少有一家分销商表示,该模型在美国不可用;对于支持的分辨率最高是 720p 还是可达到 1080p,各方说法不一——在围绕某一分辨率进行设计之前,这一差异值得对照厂商自己的文档加以澄清。
这类模型正是路由层能凭借具体理由赢得一席之地的典型:费率会变。按 token 计费的视频价格在发布时改过一次,以后还会再改;基于今天的数字构建的成本模型,与基于上个季度数字构建的成本模型之间的差异,就是利润与意外之间的差异。OrcaRouter 以 0% 加价率透传提供商标价,因此供应商降价当天就会在我们这边生效,而不是等到下一次合同续签;当某个提供商端点性能下降时,自动故障转移还能让生成队列继续运转——在视频工作负载中,这是调度层面的现实问题,而不是理论问题。Seedance 2.5 本身并不经由 OrcaRouter 路由;它通过字节跳动自有平台及其 ModelArk 端点提供服务。

Odyssey-3 不按秒出售
Odyssey-3 目前还没有任何销售单元,而这正是关键所在。它被描述为一个基础世界模型,能够驱动机器人、驾驶汽车、训练 AI、操控无人机并玩电子游戏——这是一个在大量视觉观察数据上训练的自回归扩散 Transformer,其创造者称,由此获得了对物理、动力学、因果关系以及人类行为的学习性理解。适应新任务的方式是:在观察-动作对上训练一个动作解码器,并让预训练的世界模型保持冻结,这样一个小型策略就能读取冻结的表征并输出运动指令。
这些演示全部由厂商报告,且无一经过独立复现,涵盖六种具身形态:基于数十小时演示训练出的机械臂,包括数据中原本没有的恢复行为;使用 Flexion 基于数十小时遥操作构建的人形机器人策略,Odyssey 称其泛化能力优于所测试的 VLA 基线,但未公布具体数值;基于二十小时模拟数据在印度进行的闭环驾驶;基于模拟数据的室内无人机飞行;无需额外训练即可从 Grand Theft Auto V 迁移到 Red Dead Redemption 2 和 Sleeping Dogs 的策略,约两小时的 GTA 素材便在 RDR2 中产生骑马动作;以及通过 PROWL 工作生成用于训练其他 AI 的环境。
唯一确凿的数字是 77%——经仿真训练的驾驶策略,在两次安全员干预之间行驶的距离,大约只有用真实录像训练的策略的 77%。这是一个厂商给出的数字,背后既没有技术报告,也没有任何外部验证。

销售单位决定了什么会被优化
一旦你把这两个模型看作衡量标准而非能力,它们之间的差异就不再像是一个领先于另一个了。
一个按输出秒数计费的模型,优化的目标是产出能让观众满意的内容。这并不是更低的追求;而是一个不同的目标,有着它自己的难题。Seedance 2.5 能生成连贯的三十秒画面,并让对白同步、实现时间戳级别的控制,这本身就是一项极为困难的成果;而它被评判时所依据的那些失败模式——角色面部漂移、剪辑落点不对、一句对白对不上口型——恰恰是剪辑室里的人一眼就会注意到的问题。
一个被要求预测当控制器采取行动时接下来会发生什么的模型,其优化目标却是观众永远不会检查的东西:动力学能否在一系列决策下保持成立,包括没有人演示过的决策。这就是为什么 Odyssey 报告的是从数十小时数据中涌现出的恢复行为,而不是报告保真度,也是为什么它唯一的定量主张是以安全驾驶员干预次数来衡量,而不是以视觉质量来衡量。渲染器可能出错的方式,观众会原谅。模拟器可能出错的方式,控制器会据此采取行动,而第二种错误会在一次推演中不断累积。
所宣称用例的重叠之处——机器人训练数据、自动驾驶边缘场景——正是这两者交汇的地方,而这是一场围绕预算的真实竞争,而非围绕基准排名的竞争。机器人团队实际面临的问题是:究竟该购买一个可信世界的渲染秒数,还是购买一个带有动作接口的动力学模型;答案取决于其下游的消费方是人工审阅者,还是训练循环。
并排
• 计价单位 —— Seedance 2.5:按 token 计费,折算下来 480p 下每段 5 秒视频约 $0.51,720p 下约 $1.16。Odyssey-3:未公布。
• 每个单位可获得的内容 — Seedance 2.5:一次生成即可得到成品影像,最长 30 秒,并带同步音频与对白。Odyssey-3:预测的下一时刻世界状态,以及针对所接硬件的电机动作。
• 输入 — Seedance 2.5:文本,最多约 30 张图像、10 个视频和 10 个音频片段。Odyssey-3:一个在冻结主干之上、基于观测-动作对训练的动作解码器。
• 编辑控制 — Seedance 2.5:时间戳级定位与区域级生成后编辑。Odyssey-3:不适用;不存在编辑界面。
• 已公布的合作方 —— Seedance 2.5:徐工、小鹏及另外三家为首发合作方。Odyssey-3:Flexion 参与人形机器人政策;未公布商业客户。
• 可用性 — Seedance 2.5:自 2026 年 7 月 31 日起已上线,受地区限制。Odyssey-3:于 2026 年 9 月 15 日公布,公开发布时间为"未来几周内",没有具体日期,也没有价格。
哪一个适合你的技术栈?
如果交付物是给人观看的视频,那么 Seedance 2.5 是一款已上市的产品,有公开定价和广泛的功能集,决策就是常规的“自建还是购买”问题——但有两个注意事项值得先核实:你需要的分辨率是否确实能在你可访问的端点上提供,以及你所在地区是否在服务范围内。它更长的单次生成时长和时间戳控制是最能改变工作流的功能,因为它们省去的是拼接步骤,而不是提升单帧质量。
如果交付成果是一个训练好的策略或控制器,那么无论画面看起来多好,Seedance 2.5 都不能替代它,而 Odyssey-3 虽然瞄准了你的问题,却没有任何东西可买。值得追踪的说法是那个冻结的主干网络:一个预训练模型通过一个小型解码器就能驱动机械臂、人形机器人、一辆汽车、一架无人机和三款游戏,这说明物理理解在不同具身形态之间能迁移多少,而如果这一说法站得住脚,它就会改变机器人团队需要收集什么。它尚未经 Odyssey 以外的任何人测试,也没有技术报告、没有许可证、没有价格。
值得关注的点并不光鲜:对 Seedance 2.5 来说,是一个稳定的价格和一份清晰的区域可用性声明;对 Odyssey-3 来说,则是一个代码仓库、一份许可证,以及一个第三方对 77% 的复现。在第二份清单出现之前,这两个模型之间的差别不在于质量。而在于:其中一个是产品,另一个只是一个论点。

OrcaRouter 将 200+ 款模型都置于单个 API 密钥之后,因此你选中的视频模型并非你唯一能调用的模型。
