Odyssey-3 對決 ByteDance Seedance 2 的標題卡,左側面板標題為 Odyssey-3,寫著「由你即時駕馭的世界」,832x480 或 1280x720 Pro,Physics-IQ +9.99 個百分點,排名 03;右側面板標題為 ByteDance Seedance 2,寫著自 2026 年 2 月 12 日起正式推出,按用量計費平台,成品片段最長 15 秒,解析度未公布,Physics-IQ 未提交。
Guides & Insights

Odyssey-3 對比 ByteDance Seedance:一個你能置身其中行動的環境,對上一段你只能觀看的影片

作者

Magnus Corvin

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

把 Odyssey-3 和 ByteDance Seedance 2 並排放在一起,首先會注意到的是:它們爭奪的並不是同一個需求。Odyssey-3 由 Odyssey 於 2026 年 10 月 8 日發布,它會根據提示詞生成一個環境,然後在你於其中移動或觸發事件時,持續即時對它進行預測——它是一台由你操控攝影機的模擬器。ByteDance Seedance 2 則是一台附帶導演椅的片段生成器:輸入文字、圖像、音訊與影片參考,輸出完成的影片,最長可達十五秒,一次生成,並以固定成品的形式交付。其中一個有控制輸入,另一個有時間軸。儘管如此,這個比較仍值得做,因為兩者正匯聚到同一群買家身上,也因為它們對生成式影片模型的價值究竟落於何處,下了相反的賭注。

有一個共用的排行榜,而它比表面上看起來更單薄。Seedance 2 本身並未出現在 Physics-IQ Verified 上,也就是由 Anates Labs 與 DeepMind 製作、用來評分模型預測真實物理實驗表現的那個排行榜。但 2026 年 7 月 31 日推出的後繼版本 Seedance 2.5 則有上榜。所以,唯一能讓這個系列的任何東西與 Odyssey-3 並列的第三方數字,是一項單方面跨越兩個模型世代的比較;在任何人把它當成一場公平對決來引用之前,這點值得先說清楚。

這兩種機制

Odyssey-3是一個自迴歸擴散 Transformer。Odyssey 自己的描述是:一個多步驟影片擴散模型,以教師強制與因果遮罩自迴歸地延伸,使它從先前的觀測繼續,並以動作輸入為條件預測未來狀態;接著再經過一輪分布匹配與對抗式蒸餾的後訓練,產出一個快到足以即時互動的少步數變體。輸出不是一段會播放的場景,而是一個會回應的場景。預覽提供了第一人稱導航、第三人稱導航與獨立攝影機移動——三種不同的方式去推動同一個預測,並觀察它會有什麼反應。

ByteDance Seedance 2是一套統一的多模態影音聯合生成模型。它接受文字、圖像、音訊與視訊作為參考,一次就能生成片段,長度可達十五秒,而且音訊是同步共同生成,而非事後配音。ByteDance 的頁面描述圖像、音訊與視訊參考能控制表演、打光、陰影與攝影機運動,這是製作語彙,而非模擬:你是在指定一個鏡頭,而不是操控一個世界。它於 2026 年 2 月 12 日發布,數日內便因真實演員與既有電影的片段而爆紅——而這也正是引爆著作權風暴的原因:Disney 與 Netflix 寄出停止侵權函,美國電影協會與 SAG-AFTRA 予以譴責,2026 年 3 月還有兩位美國參議員致函 ByteDance,要求將其下架。ByteDance 在 2026 年 2 月表示正在強化防護措施。若你要推出任何商業用途的東西,這段歷史就是這款模型規格的一部分。

逐維度地

ByteDance's BytePlus ModelArk developer documentation in English, showing the Ark SDK quick-start with a Python client using model seed-2-0-lite-260228 against base_url https://ark.ap-southeast.bytepluses.com/api/v3, a sidebar covering Models, video generation, image generation and the Model list, and three endpoint cards for Dola Seed 2.0, Dreamina Seedance 2.5 (described as the mainline video generation model with 30s extended storytelling, multimodal references and improved generation quality) and Dola Seedream 5.0.

• 它會輸出什麼——一個你能在其中行動的互動環境,對照一段最長十五秒的固定片段。這一列之後的所有內容都會改變。

• 控制介面 —— 即時導覽與生成中途事件,相對於事前指定的提示詞以及圖像、音訊與視訊參考。其一在生成期間受到操控,另一則在生成之前先行指定。

• 音訊 — Seedance 2 會在同一個模型中與影片共同生成。Odyssey-3 的發布資料則完全沒有提到音訊。

• 解析度 — Odyssey-3 以 832×480 運作,Odyssey-3 Pro 則為 1280×720。ByteDance 的 Seedance 2 頁面並未公布輸出解析度,而流傳的 1080p 數字屬於較早的 Seedance 1.0 系列。

• 成本 — 在 Physics-IQ 的標準化成本欄中,Odyssey-3 每支生成影片的標價為 $0.139,Odyssey-3 Pro 則為 $0.267,兩者皆不含提示詞處理費用。Seedance 2 並未公布任何我們能查證的每秒或每段影片定價;其後繼版本 Seedance 2.5 在同一看板上每支影片標價為 $2.838。

• 獨立評分——兩個模型各自的生成結果都沒有第三方正面對決。Seedance 2.0 公布的結果是 B​yteDance 內部的 SeedVideoBench-2.0;Odyssey-3 的結果則是一份基準測試提交,加上廠商在他人資料集上執行的評估。

• 權重 — 雙方皆為封閉。Odyssey 從未釋出任何檢查點,而 Seedance 也從未開放。

• 商業定位——Odyssey-3 是研究預覽版,提供 API 存取用的聯絡表單,沒有價目表。Seedance 2 透過 ByteDance 自家平台銷售,在中國以外則透過 CapCut 以 Dreamina Seedance 2.0 的形式販售。

真正能比較它們的那個數字

Physics-IQ Verified 以百分點評估模型在物理合理性上相對於該賽道平均值的淨提升,並記錄使用了哪一組提示詞。在基準測試本身的提示詞上,Seedance 2.5 以 +3.59 個百分點排名第七,每部影片的正規化成本為 2.838 美元。Odyssey-3 在同一組提示詞上以 +2.15 個百分點排名第八,每部影片成本為 0.129 美元。仔細看,這是一個對 Seedance 有利的 1.44 個百分點差距,以及一個對它不利、約達二十二倍的成本差距。

Odyssey-3 的頭條列採用的是不同的欄位。以自訂提示提交時,Odyssey-3 得分 +9.99 個百分點,Odyssey-3 Pro 則是 +11.15 個百分點——在排行榜上分別名列第三與第二,落後 +12.27 個百分點的 FLUX 3 [large]。同一個模型家族在同一個排行榜上,以兩套截然不同的提示機制出現兩次,且得分差異極大,而這正是理解該如何解讀這個排行榜時最有用的一件事:這個數字一部分取決於模型本身的特性,一部分取決於提示是誰寫的。

Odyssey 也回報 Odyssey-3 Pro 在影片轉影片項目上獲得 66.1,這是它聲稱的最高分,而 Odyssey-3 Pro 在圖片轉影片上則為 54.7。這兩項都是供應商對其提交的排行榜所做的自家解讀,並非獨立測試結果。

Two-column scoreboard headed “Odyssey-3 vs ByteDance Seedance 2 — the scoreboard” with six shared dimension labels. Odyssey-3: an environment you act inside; live navigation and mid-run events; no audio; 832x480, 1280x720 Pro; /bin/bash.139 a video, Pro /bin/bash.267; no independent scoring yet. ByteDance Seedance 2: a fixed clip up to 15 seconds; text, image, audio and video references upfront; audio generated jointly with the video; resolution not published; no per-second list price published; not on Physics-IQ. Footer: “Odyssey-3 figures vendor-reported and unreproduced; Seedance 2 has no third-party score; Seedance 2.5, a later model, is on Physics-IQ at +3.59 pp”.

各自真正勝出之處

如果你的問題是「我需要一個鏡頭」,Seedance 2 的設計正是為了回答這件事:多模態參考意味著你可以把演員的容貌、音訊底軌和運鏡交給它,然後得到一段帶有聲音的完成品片段。Odyssey-3 的預覽中沒有任何東西做得到這一點,它的發布素材裡也沒有任何跡象顯示它將來能做到。十五秒的上限確實是一項實際限制,但五秒、沒有聲音的世界模型推演也同樣是。

如果你的問題是「我需要知道接下來會發生什麼」,那取捨就會朝另一個方向走。Seedance 2 無法被問一個反事實問題——你只得到一段片段,而想看到另一種結果時,你得再次下提示,然後得到一段毫不相關的內容。Odyssey-3 的整個前提是,下一個狀態取決於你剛才採取的動作,這正是它能用於駕駛策略、機械手臂,或是一個序列比單一鏡頭更重要的訓練環境的原因。

物理準確度的證據在機制上對 Odyssey-3 有利,即使在分數欄位上看不出來:該模型是在擾動之後的續接內容上受評估,而這正是互動式預覽所主打的同一項能力。Seedance 2.5 在同一排行榜上的 +3.59 個百分點,對一款短片生成器而言是相當強勁的成績,而且值得注意的是,在配對提示集上還優於 Odyssey-3 —— 這正是為什麼誠實的總結應該是:B​yteDance 的影片模型在物理上的合理程度,超出了一個影片模型理應達到的水準,而不是 Odyssey-3 在自己的主場上被击败了。

OrcaRouter's own model page for minimax/minimax-h3, showing the model header “text + image + video + audio”, output video, a p50 time-to-first-token of 406 ms, performance and vision/audio badges, and a Python code sample on the left with the model list and playground navigation above.

到達其中任何一個

這兩個模型今天都無法從這裡呼叫。OrcaRouter 並未託管 Odyssey-3 或 B​yteDance Seedance 2——Odyssey-3 沒有公開價格可供任何人路由,而 Seedance 則是透過 B​yteDance 自家的平台銷售。

單一 OrcaRouter 金鑰所能觸及的,是影片技術堆疊的其他部分:768P 輸出每秒 $0.08 的 MiniMax-H3、每次請求 $0.084 至 $0.28 的 K​ling 影片系列,以及總計超過 200 款模型,全部以供應商標價、0% 加價提供,因此供應商的價格變動會在同日即時反映到你的帳單上,而不是等到續約時。 自動容錯移轉能在某個上游服務降級時讓評估掃描持續運作,而路由 DSL 可將多個影片模型置於同一個介面之後,因此測試新的生成器只是變更設定,而不是進行整合。當這兩者之中有任何一個推出自助式端點時,那就是適合將其納入的架構。

看什麼

有兩件事會比任何基準測試更新都更能改變這場比較。第一是音訊:如果 Odyssey-3 的下一代能像 Seedance 那樣聯合生成聲音,「你所置身其中行動的環境」就不再是較狹隘的一類。第二是一套獨立測試框架——由第三方在同一批片段上並排跑 Seedance 2.0 和 Odyssey-3,而不是讓其中一方出現在另一方從未提交過的榜單上。在那之前,解讀 Odyssey-3 與 ByteDance Seedance 2 的正確方式是:它們不是同一份工作的兩個候選者。它們是兩個不同問題的兩種答案,而你問的是哪個問題,就替你決定了該選哪個模型。