文章標題卡,比較 Odyssey-3 與 Seedance 2.5,副標為「數秒素材 vs 數小時模擬」,並有三個數據標籤:「30 秒單次生成」、「720p 下每段 5 秒影片約 $1.16」,以及「Odyssey-3:無單位販售」。
Guides & Insights

Odyssey-3 與 Seedance 2.5:數秒的影片片段 vs 數小時的模擬

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

Seedance 2.5要多少錢,你會得到以每秒美元計的答案。但問Odyssey-3要多少錢,你什麼也得不到——沒有價目表、沒有端點、沒有授權,因為這款於 2026 年 9 月 15 日發表的模型尚未發布,其開發商只公開承諾「將在未來數週內」推出。這道落差看似是成熟度的差異,實際上主要是類別上的差異。Seedance 2.5 由字節跳動的 Seed 團隊於 2026 年 7 月 31 日發布,是一款以成品影片每秒計價、賣給需要影片素材者的製作引擎。Odyssey-3 則是具備動作介面的世界模型,它所鎖定的買家根本不想要影片素材——它要的是一個當有東西在其中行動時能正確回應的環境。這兩者正被指向某些相同的問題,包括機器人與駕駛資料,這正是為什麼值得仔細劃分這項區別。

Seedance 2.5 是一套製作引擎,而首發合作夥伴正展示了這一點

最受矚目的核心能力在於時長。Seedance 2.5 能在單次生成中產出三十秒的內容,是前代十五秒的兩倍,並可透過多輪延伸產生更長的序列,據稱還有能延伸得更遠的超長 beta 模式。光是這一點就改變了這個模型的用途:三十秒是一個場景,而不只是一個鏡頭,而 ByteDance 的行銷正是基於這個理由,主打「一鏡到底」這個說法。

在時長之外,還有那些讓生成結果能真正用於實際剪輯的功能。該模型支援大量多模態參考——報導指出每次生成最多可接受三十張圖片、十段影片片段與十段音訊片段,參考影片與參考音訊各自上限約三十秒,而純音訊參考是本版本的新功能。此外還新增了多種參考模式,涵蓋白模或黏土渲染、綠幕素材,以及動態與創意參考。控制達到時間戳層級,讓提示詞能針對特定時間範圍內的敘事、鏡頭或動態下指令;而生成後的區域級編輯則能維持連貫性,不必被迫重新生成。音訊與影片在一次處理中聯合生成,因此嘴型同步會跟著引號中的對白走,並原生支援超過十種語言。

採用名單就是關鍵所在。在發布當天,XCMG、XPeng、Lingchu Intelligence、Weifen Zhifei 與 Qiongche Intelligence 都確認了合作關係,而所述應用案例涵蓋從具身 AI 訓練資料與自動駕駛邊角案例,到工業 SOP 訓練影片、教育與電子商務廣告。其中有些是創意工作。有些則是為日後將在世界中行動的系統生成資料——而這正是與 Odyssey-3 重疊的部分。

一秒 Seedance 2.5 要多少錢

價格已公布,而且是以 token 而非秒數計費,這會產生一個在你下訂前值得先做的換算步驟。ModelArk 端點所回報的數字是:不含視訊輸入時每百萬個 token 為 10.70 美元,而包含視訊輸入時每百萬個 token 為 6.40 美元。實務上,這換算下來大約是 480p 的五秒 16:9 短片為 0.51 美元,而同一段短片在 720p 約為 1.16 美元。這些是供應商在發布時所回報的公布費率;請把它們視為目前牌價,而不是每項交付成果的實測成本,因為解析度和時長都會使其按比例變動。

可用性確實有明顯分野。消費者的取用管道是透過字節跳動自家的應用程式,而 API 存取則分為中國的火山引擎方舟與國際版的 BytePlus ModelArk。至少有一家經銷商表示,該模型未在美國提供,而各方來源對於支援的解析度上限究竟是 720p 還是可達 1080p 說法不一——在你依據某個解析度進行設計之前,這個歧異值得對照供應商自家文件加以釐清。

這正是路由層之所以有其存在價值的一類模型,原因很具體:價格會變動。按 token 計價的影片價格在推出時調過一次,之後還會再變;而建立在今日數字上的成本模型,與建立在上一季數字上的成本模型,兩者之間的差異,就是利潤與意外之間的差異。OrcaRouter 將供應商定價以 0% 加價原樣傳遞,因此供應商降價時,我們這邊當天就會生效,而不必等到下一次合約續約;當某個供應商端點效能下降時,自動容錯移轉也能讓生成佇列持續運作——這在影片工作負載上是排程問題,而非理論問題。Seedance 2.5 本身並非由 OrcaRouter 路由;它是透過 ByteDance 自家平台及其 ModelArk 端點提供服務。

Two-column scoreboard for Odyssey-3 and Seedance 2.5 across six shared dimensions — unit of sale, what you get, inputs, editing control, availability and partners. Seedance 2.5 reads tokens at roughly $0.51 per 5s at 480p, finished footage up to 30s, shipping since 31 Jul 2026; Odyssey-3 reads not published, next world state plus actions, announced 15 Sep 2026, Flexion on humanoids.

Odyssey-3 不以秒計費

Odyssey-3 目前還沒有可供銷售的單位,而這正是重點。它被描述為一個基礎世界模型,能驅動機器人、駕駛汽車、訓練 AI、操控無人機與玩電子遊戲——這是一個自迴歸擴散 Transformer,以大量視覺觀察資料訓練而成;其開發者表示,這能產生對物理、動力學、因果關係與人類行為的習得理解。若要調適到新任務,做法是在觀察-動作配對上訓練一個動作解碼器,並讓預訓練的世界模型保持凍結,因此一個小型策略會讀取凍結的表示,並發出馬達指令。

這些示範全屬廠商自行報告,且無一經獨立重現,涵蓋六種實作案例:透過數十小時示範訓練的機械手臂,其中包括資料中未包含的復原行為;以 Flexion 建構、取自數十小時遙操作的人形機器人策略,Odyssey 稱其泛化表現優於所測試的 VLA 基線,卻未公布數據;以二十小時模擬資料在印度進行的閉環駕駛;以模擬資料進行的室內無人機飛行;無需額外訓練即可從 Grand Theft Auto V 移轉至 Red Dead Redemption 2 與 Sleeping Dogs 的策略,約兩小時的 GTA 影像便在 RDR2 中產生騎馬動作;以及透過 PROWL 研究為訓練其他 AI 而進行的環境生成。

唯一確切的數字是 77%——以模擬訓練的駕駛策略,在安全駕駛員介入之間的行駛距離,約為以真實影像訓練的策略的 77%。這是廠商公布的數字,背後沒有技術報告,也沒有外部驗證。

Screenshot of Odyssey's “Introducing Odyssey-3: A General-Purpose Physical Intelligence” page, dated September 15th, 2026, showing the model subtitle “Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games” and the authors Oliver Cameron and Jeff Hawke.

銷售單位決定了什麼會被最佳化

一旦你把這兩個模型視為量尺,而不是能力,它們之間的差異就不再像是一方領先另一方。

以每輸出秒計費的模型,是針對能滿足觀看者的輸出進行最佳化的。這並不是比較低的企圖心;而是一個不同的目標,有著它自己的硬問題。Seedance 2.5 能產出三十秒連貫、對白同步,並具備時間戳層級控制的內容,是真正艱難的成果,而用來評判它的失敗模式——角色臉部漂移、剪接不到位、一句對白對不上——正是剪輯室裡的人會注意到的那些問題。

當一個模型被要求預測控制器採取行動後接下來會發生什麼時,它被最佳化的目標是觀眾永遠不會檢查的一件事:動態能否在一連串決策下成立,包括沒有人示範過的決策。這就是為什麼 Odyssey 報告的是從數十小時資料中湧現的恢復行為,而不是報告保真度;也是為什麼它唯一的量化聲明,是以安全駕駛員介入次數來衡量,而不是以視覺品質來衡量。渲染器出錯的方式,觀眾會原諒。模擬器出錯的方式,控制器會據以行動,而第二種錯誤會在整個推演過程中不斷複合。

這些宣稱使用案例的重疊——機器人訓練資料、自動駕駛邊緣案例——正是兩者交會之處,而這是一場真正為了預算、而非為了基準排名的競爭。機器人團隊實際面對的問題是:究竟該購買貌似合理世界的渲染秒數,還是該購買具備動作介面的動力學模型?答案取決於下游消費者是人類審查者,還是訓練迴圈。

並肩

銷售單位 — Seedance 2.5:以代幣計價,換算後 480p 每段 5 秒影片約 $0.51,720p 約 $1.16。Odyssey-3:未公布。

每單位可獲得的內容 — Seedance 2.5:一次生成即可產出成品影片,最長 30 秒,並附有同步音訊與對白。Odyssey-3:預測的下一個世界狀態,以及供所連接硬體使用的馬達動作。

輸入 — Seedance 2.5:文字加上最多約 30 張圖片、10 段影片和 10 段音訊片段。Odyssey-3:一個在凍結主幹網路上、以觀察—動作配對訓練而成的動作解碼器。

編輯控制 — Seedance 2.5:時間戳層級定位與區域層級生成後編輯。Odyssey-3:不適用;沒有編輯介面。

已公布的合作夥伴 — Seedance 2.5:XCMG、XPeng 及另外三家於發佈時率先採用。Odyssey-3:Flexion 負責人形機械人政策;未公布任何商業客戶。

供應情況 — Seedance 2.5:自 2026 年 7 月 31 日起出貨,受各地區限制。Odyssey-3:於 2026 年 9 月 15 日發表,公開推出時間為「未來數週內」,既無確切日期,亦無價格。

哪一個屬於你的技術棧?

如果交付物是給人觀看的影片,Seedance 2.5 就是一款已正式推出的產品,有公開的定價與廣泛的功能組合,而這個決定也不過是尋常的自建與外購取捨——但有兩點但書值得先確認:你需要使用的解析度,是否真的能在你能連上的端點上取得;以及你所在的地區是否有提供服務。它更長的單次生成時長與時間戳記控制,是最能改變工作流程的功能,因為它們移除的是拼接步驟,而不是改善單一畫面。

如果交付成果是訓練好的策略或控制器,那麼無論影片畫面看起來多好,Seedance 2.5 都不是替代品,而 Odyssey-3 雖然針對你的問題,卻沒有東西可買。值得追蹤的說法是凍結主幹:一個預訓練模型透過小型解碼器觸及機械手臂、人形機器人、汽車、無人機和三款遊戲,這說明了物理理解在不同具身之間能轉移多少;如果這一點站得住腳,就會改變機器人團隊必須蒐集的資料。它尚未經過 Odyssey 以外任何人的測試,而且沒有技術報告、沒有授權條款,也沒有價格。

該關注的事情並不光鮮:對 Seedance 2.5 而言,是穩定的價格,以及清楚的地區供應聲明;對 Odyssey-3 而言,則是一個儲存庫、一份授權,以及由第三方重現那 77%。在第二份清單出現之前,這兩個模型之間的差異不在於品質。而在於其中一個是產品,另一個是論點。

Infographic titled “What One Unit Buys” contrasting Seedance 2.5, billed per token, with a 5s clip costing about $0.51 at 480p and about $1.16 at 720p and up to 30s in a single pass, against Odyssey-3, which has no published price and reaches robot arms, humanoids, a car and a drone through a frozen backbone plus action decoder across six embodiments with no third-party runs.

OrcaRouter 把 200+ 個模型藏在單一 API 金鑰後面,因此你選擇的影片模型並不是你唯一能呼叫的模型。