比較 Odyssey-3 與 MiniMax H3 的文章標題卡,副標題為「差別就在一次下載」,並附有三個數據標籤:「自 2026 年 8 月 3 日起開放權重」、「社群授權,768p」以及「Odyssey-3:未公布價格」。
Guides & Insights

Odyssey-3 與 MiniMax H3:差別就在一次下載

作者

Magnus Corvin

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

2026年8月3日,一個2K影片模型的權重以一個任何人都能下載並執行的名稱登上 Hugging Face:MiniMax H3。六週後,也就是9月15日,Odyssey 為 Odyssey-3 發布了一頁研究頁面——這是一個基礎世界模型,能驅動機械手臂、一輛車、一架無人機與三款電子遊戲——並在下載連結原本該出現的位置放了一句話:它將「在未來幾週內」公開發布。這兩句話就是全部的比較。其中一個模型今晚就能進駐你的叢集,跑在你自己的晶片上,並遵循一份你讀得懂的授權條款。另一個則無法被其實驗室以外的任何人購買、租用或下載,而該公司尚未說明這種情況何時會改變。這種不對稱並非這場對決的註腳。它就是這場對決本身。

MiniMax H3 實際上能為你帶來什麼

H3 於 2026 年 7 月 31 日發布,並於 8 月 3 日開源。它是一個通用模型,而非單一任務的影片生成器:它可將文字、圖像、影片和音訊作為上下文讀取,並生成最長 15 秒、最高 2K 的影片,具備 32 kHz 的原生立體聲音訊與每秒 24 幀。支援六種長寬比(21:9 至 9:16),並穩定支援十一種語言的對話。開源基礎模型有兩個已發布的變體——H3-Base-FL2VA 用於文字轉影片,以及首幀、末幀或首末幀生成;H3-Base-Ref2VA 則可接受最多九張圖像、三段影片片段和三段音訊片段,輸入檔案上限為十二個。

這個比較中真正重要的部分,在於開放的那一半停在哪裡。完整的 H3 系統是一條三階段管線:H3-Context-IR 負責前處理並統籌脈絡,H3-Base 以 768p 生成,H3-Regenerate-2K 則把結果提升到 2K。只有 H3-Base 的權重是公開的,而且它們是以 MiniMax H3 Community License 發布,而非 Apache 或 MIT——這是一份附帶條件的授權條款,在它進入商用管線之前值得先讀一讀。Context-IR 階段與 2K 重生成模組都在 MiniMax 那一側運作。所以這裡的「開放權重」買到的是管線的中段。一支下載 H3-Base 並自行託管的團隊,能得到 768p 的影片生成,卻沒有不呼叫供應商就能通往 2K 的路徑。

Two-column scoreboard for Odyssey-3 and MiniMax H3 across six shared dimensions — what it produces, what you can download, price, availability, third-party runs and evidence. MiniMax H3 reads H3-Base weights under a community licence, $0.08/s at 768p and $0.13/s at 2K, open since 3 Aug 2026; Odyssey-3 reads nothing yet, not published, announced 15 Sep 2026 with no date.

Odyssey-3 反而為你帶來什麼

Odyssey-3 改而為你提供的是一項主張與一組演示。Odyssey 將其描述為一個基礎世界模型,而它已公布的架構細節具體到日後足以查核:一個自迴歸擴散 Transformer,以大量世界視覺觀察資料訓練而成,該公司稱這能產生對物理、動力學、因果關係與人類行為的習得理解。任務適配的做法是外掛一個以觀察—動作配對訓練的動作解碼器,同時預先訓練好的世界模型保持凍結——一個小型策略會讀取這個凍結模型的表徵,而非微調模型本身。

這些示範涵蓋六種具身形態。機械手臂在數十小時的示範之後——其中包括訓練資料裡沒有的復原行為——在抓取失手後重新調整夾爪的方位。以 Flexion 打造的人形機器人策略,來自數十小時的遙操作資料;Odyssey 表示其泛化能力優於所測試的 VLA 基線,卻未公布任何數字。閉環駕駛從二十小時的模擬資料中學習,並在印度實際上車。室內避障無人機飛行,取自模擬資料。遊戲環境,包括在《俠盜獵車手 V》中訓練、之後未在那些作品中額外訓練便能移轉至《碧血狂殺 2》與《香港秘密警察》的策略;大約兩小時的 GTA 畫面就足以在 RDR2 中產生騎馬動作。以及用於訓練其他 AI 的環境生成,這與該公司的 PROWL 強化學習工作相關。

頁面上唯一的硬數字,是與真實影像相比的比較:Odyssey 報告指出,以模擬訓練的駕駛策略在安全駕駛介入之間的行駛距離,約為以真實資料訓練的策略的 77%。這是廠商提供的數字,未經重現,背後沒有技術報告,也沒有第三方發表過關於 Odyssey-3 的結果。這類數字決定了一個世界模型是否有用,而目前它只是單一公司的說法。

兩種看起來截然不同的鎖定

人們很容易把 MiniMax H3 歸為「開放的那一方」,把 Odyssey-3 歸為「封閉的那一方」,但授權的實際情況比這更有趣,而且這種情況是雙向的。

MiniMax H3 是中間開放、邊緣封閉。你可以掌握生成器、檢視它、微調它,並在無需網路呼叫的情況下執行它。你無法掌握讓它成為通用模型的上下文編排,也無法掌握 2K 階段。如果你的產品品質主張取決於輸出解析度,你的開放權重部署就有一個上限,而這個上限只有供應商的託管層級能突破。

Odyssey-3 在每一層都是封閉的,而公司自身的表述正是這顯得奇怪的原因。一個面向機器人、無人機與車輛的世界模型,所面向的是在自己掌控的硬體上執行推論的買家——工廠產線、測試車輛、航空器機體。那些買家無法在控制迴路中使用託管端點;延遲與連線能力使其不可行。因此,像這樣的模型,其商業模式必須涉及權重,否則在 Odyssey 不斷點名的那些市場區隔中,它就不會有客戶。如今沒有授權,與其說是表明意圖,不如說是在表明商業條款仍在撰寫中。Odyssey 在 2026 年 6 月宣布的 3.1 億美元 B 輪融資,估值 14.5 億美元,並以 AWS 為首選雲端、以 Trainium 為運算基質,正是這些條款將被決定的背景。

逐維度地

產出內容 — MiniMax H3:一段算圖完成的短片,4–15 秒,最高可達 2K,含立體聲音訊。Odyssey-3:模擬的世界狀態,以及供所連接硬體使用的馬達動作指令。

你可以下載什麼——MiniMax H3:H3-Base 權重、社群授權條款、768p。Odyssey-3:什麼都沒有;沒有權重、沒有授權條款、沒有儲存庫。

仍由廠商保留的部分 —— MiniMax H3:H3-Context-IR 與 H3-Regenerate-2K,這兩個模組讓它具備通用性,也讓它達到 2K。Odyssey-3:全部。

價格 — MiniMax H3:公開的每秒費率,768p 約為 $0.08、2K 約為 $0.13,另加重新生成輸出每秒 $0.05(廠商數據)。Odyssey-3:任何地方皆未公開。

可用性 — MiniMax H3:自 2026 年 8 月 3 日起開放,現已可呼叫。Odyssey-3:於 2026 年 9 月 15 日宣布,「將在未來幾週內」,尚無具體日期。

第三方證據——MiniMax H3:在第三方評測中,影片剪輯排名第一,文字轉影片與圖像轉影片排名第二或第三。Odyssey-3:僅有一項廠商數據,完全沒有外部測試結果。

如果你這個月需要打造某個東西

實際的後果是,這兩者之中只有一個是你真正能據以行動的決策。minimax/minimax-h3 在 OrcaRouter 上是依供應商定價表的價格路由,零加成——所以廠商的費率就是你支付的費率,而當 MiniMax 調整某個數字時,你的帳單會在同一天跟著變動,而不是等到續約時才調整。對一個按秒計價的影片模型來說,這點比大多數情況都更重要,因為 768p 到 2K 的價差將近兩倍,而原型與正式上線之間的差別,可能就是這兩個級距之間的差別。

這裡還有第二個理由,說明為何在此情境下應該採用路由器,而非直接與供應商整合。H3 的開放部分本身就確實很有用,而最可能在意這一點的團隊,正是那些擁有 GPU、且對 GPU 很有主見的團隊。這些團隊最終會落在混合式架構中:以自行託管的 H3-Base 處理大量工作,用託管路徑處理 2K 重生成,再搭配一兩個其他模型來應付整個影片流程周邊所需的任何任務。在這種形態下,一組金鑰加上跨供應商的自動容錯移轉,價值遠高於單一模型的技術堆疊;而路由 DSL 則能把周邊的模型——提示詞模型、用於起始影格的圖像模型、影片模型——組合成單一次呼叫,而不是三套整合。

Odyssey-3,明確地說,並非由 OrcaRouter 或任何其他人進行路由。沒有可供路由的端點,也沒有可供傳遞的價格。本文並未主張相反的情況。

值得向兩家供應商提出的問題

MiniMax 已經回答了關於 H3 那個有趣的問題,而答案是「中間路線,768p,依我們的授權條款」。如果你正在評估 H3,要測試的事情是:開放基礎模型加上你自己的基礎設施,在每可用秒成本上是否勝過代管的 2K 路徑——而且要在你以 2K 輸出建立產品宣稱之前就測試。

Odyssey 尚未就其版本給出答案。當發布窗口關閉時,第一個問題不是基準測試,而是授權條款:這六種具現化型態中,哪一種是受支援的部署、跑在誰的硬體上、價格為何,以及那個讓凍結的世界模型得以驅動機械手臂的動作解碼器,究竟是由客戶自行訓練,還是由 Odyssey 出貨。一個以單一主幹網路觸及機械手臂、人形機器人、汽車、無人機與三款遊戲的世界模型,是一種通用性主張,而通用性正是讓它成為基礎模型而非策略的原因——這也正是為什麼決定誰能使用它的,會是商業條款,而不是示範影片。

Screenshot of Odyssey's “Introducing Odyssey-3: A General-Purpose Physical Intelligence” page, dated September 15th, 2026, showing the model subtitle “Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games” and the authors Oliver Cameron and Jeff Hawke.

在那之前,誠實的計分板寫的是:一個你能拉取的模型,一個你能觀望的模型。先看儲存庫與授權,再看基準測試——順序就是這樣,因為少了前兩者,第三者就無從驗證。

Screenshot of the OrcaRouter model page for MiniMax-H3, model ID minimax/minimax-h3, showing a release date of 2026-07-31, 4–15 second clips at 768P or 2K with native stereo audio, and pricing of $0.08 per second at 768P and $0.13 per second at 2K.

讓整條流程只需透過一組具備自動容錯移轉的 API 金鑰即可運作,不必再串接三套各自獨立的整合方案。