
Odyssey-3 對決 Runway Gen-4.5:對同樣兩個字的兩種押注
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
把Odyssey-3與Runway Gen-4.5放在一起對比,有趣的地方在於:兩家公司對終點的看法一致,對路徑的看法卻分歧。雙方都說目標是通用世界模型——一個經過學習、能把現實模擬得足以派上用場的系統。Runway 的立場由其技術長直白道出:你得先打造出非常出色的影片模型才能抵達那裡,因為教網路直接預測像素,是通往通用模擬最有希望的路徑。Odyssey 的立場——從它針對 Odyssey-3 所發表的每一項架構選擇中都看得出來——則是像素只是副產品,動態才是重點。Gen-4.5 是第一個賭注目前最強而有力的體現。Odyssey-3 於 2026 年 9 月 15 日發表,並承諾「在接下來幾週內」公開發布,則是以完整模型形式陳述的第二個賭注。並排閱讀,它們其實算不上競爭對手——它們是對同一個問題的兩種答案,而那個問題是:通往世界模型的路,是否非得經過渲染。
Runway 的賭注:透過渲染贏得世界模型
Runway 並非晚到或偶然才採用世界模型的框架。它推出了一個它稱之為通用世界模型的模型——GWM-1,被描述為專為現實的即時模擬而打造,可互動且可控——並將其視為其影片模型之上的層級,而非取代它們。這個論點是一個階梯:讓模型擅長在十秒內維持場景一致性的同一個訓練訊號,正是教會它物體如何持續存在、光線如何表現、運動如何延續的訊號。把像素做到足夠好,通用模擬就會自然浮現。
Gen-4.5 是當前的最新層級。它於 2025 年 12 月 1 日發布,並從 12 月 12 日起向付費訂閱者推出,是一款文字轉影片與圖像轉影片模型,具備 Runway 賴以建立聲譽的各項特質:動態品質、提示遵循度、角色與主體一致性,以及鏡頭控制。它的限制與其優勢一樣被坦白說明。片段長度為二到十秒——十秒是上限,而非預設值。輸出為 720p、每秒 24 或 25 格,涵蓋六種長寬比。沒有音軌,也沒有多鏡頭分鏡腳本;一段序列是你從各自獨立的生成結果中組裝而成的。它是一個渲染器,而且是非常出色的一個,而這正是其母公司需要它成為的樣子。
Gen-4.5 的費用是多少,以及其定價結構為何
Runway 將 Gen-4.5 定價為每生成一秒影片 12 點。點數每個售價 1 美分,因此實際換算基準是每秒 $0.12:五秒短片為 $0.60,十秒短片為 $1.20。在 API 上,輸出選項會收取附加費用——ProRes 或 PNG 序列每秒加收 5 點,HDR 每秒加收 20 點,若超過約 400 萬像素則提高到 40 點。那些是供應商定價表上的數字,而價差比表面標價更重要:一段 HDR 的十秒影片成本是一般影片的三倍以上,因此一旦 HDR 進入交付規格,以每秒 $0.12 建立的成本模型就失準了。
在編列預算之前,有兩個結構性細節值得先了解。API 點數與應用程式訂閱點數是各自獨立的餘額——Standard、Pro 或 Max 方案並不支付 API 生成費用——而且 API 是異步的,任務是提交後再輪詢,而非即時回傳。這兩點都不是批評;兩者都是團隊投入整合之後才會發現的事。該 API 除了 Runway 自家的模型之外,也提供第三方影片模型,這意味著只要你有需要,一把 Runway 金鑰就能觸及 Runway 模型目錄之外的更多選擇。

Odyssey 的賭注:重要的不是畫面
Odyssey-3 被其開發者描述為一個基礎世界模型,能夠驅動機器人、駕駛汽車、訓練 AI、操控無人機以及玩電子遊戲。在架構上,它是一個以大量視覺觀察資料訓練的自迴歸擴散 Transformer,而 Odyssey 表示其結果帶有對物理、動力學、因果關係與人類行為的習得理解。揭示這項賭注的細節在於任務如何被調適:Odyssey 並非微調模型,而是附加一個以觀察-動作配對訓練的動作解碼器,並在整個過程中保持預訓練世界模型凍結。一個小型策略會讀取凍結模型的內部表徵,並將其轉換為馬達指令。
那個設計唯有在你相信表徵——而非渲染出來的畫面——才是資產時,才說得通。這些示範在六種具身系統上支持了這一點,且全都是供應商自行報告的。機械手臂來自數十小時的示範資料,包括沒有人放進資料中的復原行為,例如在抓取失敗後重新調整夾爪方向。以 Flexion 建構的人形機器人策略,使用數十小時的遙操作資料;Odyssey 稱其泛化能力優於它測試過的 VLA 基準,但未公布數據。在印度以二十小時模擬資料進行的閉環駕駛。室內無人機飛行來自模擬資料。從 Grand Theft Auto V 移轉到 Red Dead Redemption 2 和 Sleeping Dogs 的策略,且在那些作品中不需額外訓練——大約兩小時的 GTA 影片就足以在 RDR2 中做出騎馬移動。以及為訓練其他 AI 生成環境,這與 Odyssey 的 PROWL 強化學習工作有關。
一個數字已公布。Odyssey 報告指出,在模擬中訓練的駕駛策略,在兩次安全駕駛員介入之間的行駛距離,大約是在真實影像上訓練的策略的 77%。上述段落中的每一項說法都未經重現,沒有技術報告,也沒有第三方執行過該模型。橫跨六種具身形態的廣度是有趣的主張;缺乏基準表,正是應該對它保留看待的原因。

這兩項押注變得可檢驗之處
關於策略的分歧,只有在能產生預測時才有用,而這個分歧確實能。如果 Runway 是對的——如果渲染保真度就是那條路——那麼影片模型的物理品質,就應該會隨著它有多擅長影片而提升,而這兩個排行榜也應該同步變動。如果 Odyssey 是對的,那就應該會有一些情況是:一個渲染得漂亮的模型毫無用處,而一個渲染得粗糙的模型卻很有用,因為真正有用的特性,是下一個狀態是否足夠可預測,讓控制器能據以行動。
已經有跡象顯示這會朝哪邊發展,而這對雙方都沒有美化作用。Runway 自己列出 Gen-4.5 的弱點——其中包括物理——提醒我們,渲染器的最佳化目標是讓觀眾信服,而觀眾的寬容,是控制迴路所沒有的。與此同時,Odyssey 唯一公布的數字——真實影片駕駛效能的 77%——是輸給真實資料,而不是勝利。兩家公司都沒有聲稱這條路已經走完。不同的是,他們各自衡量的是什麼。
賭注真正分歧之處在於具身性。Gen-4.5 的設計或定價完全沒有考慮動作空間;它是從文字或圖像到影片片段的函式。Odyssey-3 的素材完全沒有考慮可交付的檔案;它是從世界狀態與動作到下一個世界狀態的函式。這些是不同的產品,有不同的買家,而且無論哪一方取得多少進展,都無法把其中一個轉變成另一個,因為介面才是差異所在。
並肩
• 這是什麼 — Runway Gen-4.5:文字轉影片與圖像轉影片的渲染器。Odyssey-3:可預測下一個狀態並輸出動作指令的世界模型。
• 如何驅動它 — Runway Gen-4.5:一個提示詞或一張靜態圖片,透過非同步 API。Odyssey-3:一個動作解碼器,加上一個讀取凍結主幹的小型策略。
• 輸出 — Runway Gen-4.5:2–10 秒片段,720p,24/25 fps,六種長寬比,無音訊。Odyssey-3:無渲染交付成品;六種具身形態下的模擬狀態。
• 價格 — Runway Gen-4.5:每秒 12 點數,每秒 0.12 美元,ProRes 或 PNG 另加每秒 5 點數,HDR 則加 20 點數(供應商清單)。Odyssey-3:未公開,且未公布商業條款。
• 成熟度 — Runway Gen-4.5:自 2025 年 12 月起已在市場上,擁有成熟的 API 與第三方報導。Odyssey-3:於 2026 年 9 月 15 日發表,公開釋出「在接下來幾週內」。
• 證據——Runway Gen-4.5:八個月的公開產出。Odyssey-3:僅有單一廠商數據,沒有獨立測試紀錄。
這兩者都不在我們的關鍵上,而這是誠實的版本。
OrcaRouter 並未路由這兩個模型,本文也不會假裝不是如此:Runway Gen-4.5 是透過 Runway 自家的 API 提供服務,而 Odyssey-3 則完全沒有端點。在這樣的比較中,路由這個切入點真正能發揮作用的地方,是圍繞它們的管線。一個實際的 Gen-4.5 工作流程並不是單一模型——它包含一個用來擴寫簡報的提示模型、一個產生首幀的圖像模型、影片模型本身,以及下游用來為輸出評分或加上說明的元件。透過路由 DSL 將這些組合成單一次呼叫、使用同一把金鑰,以供應商定價、0% 加成,這正是 OrcaRouter 今天能真正替你從技術堆疊中卸下的部分。自動容錯移轉在這裡很重要,原因很平凡:非同步影片 API 會進行輪詢、佇列會回堵,而只要管線在某個效能退化的端點上卡住,就會一路卡到最終交付成果。
當 Odyssey-3 真的出貨時,路由問題將會截然不同,而且更加棘手。一個賣點在於能在你自己擁有的硬體上執行的模型,根本不會明顯是路由的候選對象;對路由器來說,真正有趣的問題會是它周遭的一切——模擬到現實的工具鏈、策略訓練、評估——而不是模型呼叫本身。
誰才是對的,是 2027 年的問題。
如果你本季需要影片,Gen-4.5 就是答案,沒有什麼好權衡的:它已定價、有文件,且已公開使用八個月,而以每秒 $0.12 的價格,了解它是否適合你的工作,成本並不高。請為附加費用以及另外的 API 額度餘額編列預算,並將十秒上限視為硬性設計限制,而不是一個你會設法繞過的數字。
如果你正在打造控制器——任何需要由學習模型告訴硬體下一步該做什麼的東西——那麼 Gen-4.5 無論如何都不在考慮之列,而 Odyssey-3 才是針對你的問題而來,卻沒有辦法取得。值得關注的具體理由是凍結骨幹的結果:如果一個預訓練模型能透過小型解碼器驅動機械手臂、人形機器人、汽車、無人機和三款遊戲,那就說明了有多少物理理解能夠遷移,而這正是能讓世界模型成為基礎層、而非逐任務策略的主張。值得等待的具體理由是,Odyssey 之外沒有人實際運行過它。
該留意什麼,依序是:一份技術報告,再來是授權條款,然後是第三方在自家硬體上重現 77% 這個數字。Runway 的路和 Odyssey 的路,最終都通向一個通用世界模型。目前只有其中一條,設有你可以直接走上前去的收費站。

將提示模型、圖像模型與影片模型透過一個具備自動容錯移轉的端點來路由,而非三個整合。
