Odyssey-3 対 Wan 3.0 のタイトルカード。Odyssey-3 は 2026年10月8日からの研究プレビューで、公開価格も API もなく、Physics-IQ Verified の正味改善はランク02で +11.15 pp。一方、Wan 3.0 は 2026年8月24日から一般提供されている従量課金 API で、720p は1秒0.6元。
Guides & Insights

Odyssey-3 vs Wan 3.0:ワールドモデルがビデオファクトリーと出会う

著者

Elias Hawthorne

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Odyssey-3とWan 3.0はどちらも「動画モデル」の下に分類されるが、その共通のラベルは、それが背負える以上の重みを担わされている。Odyssey-3は学習された力学系——プロンプトから環境を構築し、誰かがその中を移動したりイベントを引き起こしたりするにつれてその環境がどう変化するかを予測するシミュレータ——で、Odysseyが2026年10月8日に研究プレビューとして公開した。Wan 3.0はAlibaba Cloudの実運用向け動画生成ツールで、2026年8月24日のローンチ以来一般提供されており、秒単位で課金され、すでに2つの独立したリーダーボードで評価されている。このうち一方は、カメラを置く場所になろうとしている。もう一方は、あなたが公開する映像をレンダリングするものになろうとしている。

2つの発表ページを並べてみれば、違いはすぐに明らかになる。Odysseyは物理的な正確さを前面に押し出す — 物体が衝突したときにどう振る舞うかを、そのモデルがどれだけ理解しているかだ。A​libabaはスループット、持続時間、参照制御を前面に押し出す。30秒のテイク、ネイティブ音声、1回の生成につき最大10枚の画像と5本の動画を指定できる。どちらかが他方の劣化版というわけではない。それらは異なる問いへの答えであり、その答えはチームが今週何をすべきかを変える。

数字に入る前に、ひとつ前提となる注記を。本記事のほとんどの数値は各ベンダー自身の発表資料に由来し、それらラボの外部で誰も再現していない。数値がプレスページではなく独立した評価ボードから来ている場合は、本文でその旨を明記している。この区別はここではいつも以上に重要だ。なぜなら、この2つのモデルは検証可能な情報の公開量が極端に異なるからだ。一方はオープンなAPIで秒単位課金で販売され、もう一方は価格を一切公表していない。

それぞれが実際に何なのか

Odyssey自身によるOdyssey-3の説明は、ローンチ投稿としては異例なほど具体的で、要約して丸めてしまうよりも引用する価値がある。それは「学習された力学系であり、自己回帰拡散トランスフォーマーとして実装され、物体が空間内をどのように移動し相互作用するか、また状況が時間とともにどのように進展するかを予測するもの」だ。これが返すものは、通常の意味でのクリップではない。駆動されている間、進化し続ける状態である。このモデルは2つのサイズで提供される — 832×480のOdyssey-3と、1280×720のOdyssey-3 Pro — そしてOdysseyによれば、そのプレビューは一人称および三人称のナビゲーションに加えて、独立したカメラ移動をサポートする。このビルドには、分布マッチングと敵対的蒸留を組み合わせて生成された数ステップの蒸留バリアントも含まれており、ベンダーはこれをリアルタイムインタラクティブだと説明している。

Wan 3.0は、確立されたモデルに基づく生成器だ。プロンプトと1つ以上の参照を入力すると、完成した動画が出力される。Alibabaの主な能力は、1回の実行で30秒を生成できること、ネイティブ音声、テキスト・画像・動画・音声にわたる参照入力、さらにdoc、xls、ppt、pdf、md、txt、key、pages、numbers形式のドキュメントへの対応(最大100 MB、50ページ)だ。編集は指示ベースで、つまりゼロから再生成することなく、ビジュアルやセリフを変更できる。Alibabaはまた、音声品質と画面上のテキスト精度にはまだ改善が必要だと率直に述べている。これはローンチ投稿では本来よりも珍しい認め方であり、記録に残しておくのに役立つものでもある。

• 出力の内容 — あなたが内部で行動するシミュレーション環境(Odyssey-3)対 あなたが公開するレンダリング済みクリップ(Wan 3.0) • 公称サイズ — 832×480、または Odyssey-3 Pro では 1280×720 対 480p、720p、1080p • 単一実行の長さ — 環境が駆動され続ける限り 対 生成あたり30秒 • 音声 — どちらのサイズでも目玉機能ではない 対 ベンダーが品質上の制約を明示したネイティブ音声 • 入力 — 環境を定義するプロンプト 対 テキスト、画像、動画、音声、および最大100 MB・50ページのドキュメント • 編集モデル — 状態を変更して再シミュレーションする 対 完成した生成物への指示ベースの編集 • 文書化されたAPI — 公開なし 対 2026年8月24日以降、オープンかつ従量制 • 公表価格 — なし 対 480p / 720p / 1080p で毎秒 0.3 / 0.6 / 1.2 元

1秒分の出力にかかるコストと、なぜ単位が揃わないのか

Wan 3.0の価格は、買い手にとって最も分かりやすい単位、すなわち時間で設定されています。アリババの料金は、生成動画1秒あたり480pで0.3元(約0.05ドル)、720pで0.6元(約0.10ドル)、1080pで1.2元(約0.20ドル)です。したがって、30秒のフル生成は、480pで約9元(1.50ドル)、720pで18元(3.00ドル)、1080pで36元(6.00ドル)になります。これらは8月のローンチ時の料金です。30%割引のローンチプロモーションは9月23日までの実施だったため、上記の数字が現在買い手が直面する料金です。Wan 3.0を再販するプロバイダーは、通常は代わりに1分あたりの価格を提示します。予算を承認する前に、この秒単位の計算と照らし合わせて確認する価値があります。

Odyssey-3には比較可能な数値がない。Odysseyが価格、料金表、ライセンス、APIドキュメントのいずれも公開していないからだ。代わりに存在するのは、サードパーティのベンチマーク内のコスト数値であり、ベンダーが公然と述べている前提、すなわちMI355X GPU 1時間あたり1ドルに基づいて算出されている。それに基づき、Physics-IQ VerifiedはOdyssey-3 Proを生成動画1本あたり0.267ドル、Odyssey-3を0.139ドルと記載しており、いずれも24 FPSおよび幅1280の出力に正規化されている。同じボードは別途、OdysseyのAPIを通じたプロンプト書き換えが提出動画1本あたり0.01ドルと見積もられていることも注記している。これは注意深く読むべきだ。価格ではなくモデリングの前提である。ベンダーが想定するハードウェア料金でシミュレーションした場合にいくらかかるかを示しているにすぎず、Odysseyが請求する金額を示すものではない。

その2つの事実は、買い手にとって相反する方向を指している。Wan 3.0 は従量制の明細項目であり、その最悪ケースは何かがレンダリングされる前に計算できる。Odyssey-3 は動画あたりのモデル化されたコストがより低く、それを紐付ける請求書が存在しない — まさにこれが、調達の会話が止まる段階である。比較を公平にするには、読者は両方の半面を保持しなければならない:実際の請求書を伴う実際の料金と、まだ何も裏付けのない推定料金である。

Two-column scoreboard comparing Odyssey-3 and Wan 3.0 across six dimensions: what you get, advertised sizes, single-run length, published price, documented API, and Physics-IQ Verified. Odyssey-3 returns a simulated environment, ships at 832x480 or 1280x720 on Odyssey-3 Pro, runs as long as it is driven, has no published price or documented API, and scores +11.15 pp at rank 02 on Physics-IQ Verified; Wan 3.0 returns a rendered clip, ships at 480p, 720p and 1080p, renders 30 seconds per run, costs 0.3 / 0.6 / 1.2 yuan a second, has been open and metered since 24 August 2026, and is not listed on that board.

彼らが共有する唯一のスコアボード、そしてそこから欠けている名前

Physics-IQ Verifiedは、Anates LabsとDeepMindによる、動画モデルが物理原理をどれだけうまく扱えるかを示す動的ランキングであり、この組み合わせが共通して持つ唯一の独立系ボードだ。そして、まさにここで比較は本当に興味深いものになる。なぜなら、ここはそれが破綻する場所でもあるからだ。

Odysseyのローンチ投稿は、Odyssey-3 Proが「Physics-IQ Verifiedのベンチマークで新たな最先端を打ち立て、WorldMarkの4カテゴリーのうち3つで1位となった」と述べている。そのうちWorldMarkに関する部分は、Odysseyが公表している数値と一致する。First-Person Stylized(77.2)、Third-Person Real(79.0)、Third-Person Stylized(76.3)で1位、First-Person Realは80.6で2位となり、AlayaWorldの83.0とLyra 2.0の84.4の後塵を拝している。これらの数値はいずれも、Odyssey自身の評価実行に基づくベンダー報告値である。

「最先端」という部分こそ、読者が慎重になるべきところだ。現在利用可能なPhysics-IQ Verifiedボードのバージョンでは、トラック平均を上回る純改善幅(パーセントポイント)で順位付けすると、Black Forest LabsのFLUX 3 [large]が+12.27 ppでランク01に位置する。Odyssey-3 Proは+11.15 ppでランク02、Odyssey-3は+9.99 ppでランク03だ。したがって、そのベンダーの「新たな最先端」は、ベンダー自身が引用するボード上では2位である — その主張がボードの更新より前のものだからか、あるいは文が示唆するよりも狭い範囲に限定されているからだ。いずれにせよ、正直に読めば、Odyssey-3 Proはトップ3に入る物理モデルであり、断トツのリーダーではない。FLUX 3 [large]はまた、動画あたり$0.868という、Odyssey-3 Proの$0.267に対してはるかに高いコストを伴い、これこそこのボードのコスト表示が明らかにするために存在するトレードオフである。

Odysseyはサブ指標の内訳で、文句なしの1位をただ1つ確かに獲得している。時空間(Spatiotemporal)が44.70で、42.97のOdyssey-3 Proと41.57のPhysis-Lang(Cosmos3 Super)を上回る。Spatialでは4位(59.17)で、FLUX 3(64.36)、Odyssey-3 Pro(61.78)、Physis-Lang(59.87)に次ぐ。Weighted SpatialとMSEでは、それぞれ4位と3位である。このパターン、つまり時間を通じて動きがどれほどうまくまとまりを保つかにおいて文句なしの首位に立ち、単一フレームの空間的忠実度では二番手集団にいるというパターンは、美しい静止画を描くためではなく進化をシミュレートするために作られたモデルの、一貫した特徴である。

さて、欠けている名前について。Wan 3.0はPhysics-IQ Verifiedにまったく載っていない。唯一のWanの項目は、17位のWan 2.2 14B(−6.64 pp)と22位のWan 2.2 5B(−11.13 pp)だけで、どちらもトラック平均を下回り、どちらもオープンソースで、どちらも一世代前だ。ボード自身の対象範囲の注記には、リーダーボードは「ベンチマーク済みのモデルや、プレプリントまたは発表で知られるモデルを含む。たとえ一般公開されていなくても、リリース日が確認されていなくても」と書かれている。したがって、Wan 3.0が載っていないことは、スコアが悪い証拠ではない。それは、この軸で誰もWan 3.0を測定していないという証拠である。実務上の帰結は明快だ。Odyssey-3が物理的妥当性でWan 3.0を上回るという主張はどちらの方向でも未検証であり、上回らないという主張も同様に未検証である。Wan 3.0の独立した実績は別の場所にある。OpenArt Arenaでは総合2位、Artificial AnalysisではVideo Editing with Audioで1位だった。それらは物理ではなく、知覚品質と編集品質を測るボードである。

今日呼べるもの、そして尋ねることしかできないもの

Wan 3.0 は、Alibaba Cloud のローンチによって従量課金制かつ申請制のベータ版が完全にオープンな API に変わった2026年8月24日以降、呼び出し可能になっています。このモデルは、ベンダー自身の API と複数のサードパーティプラットフォームを通じて利用でき、いずれも従量課金制で、上記の秒単位の料金が適用されます。チームが今日の午後にも生成動画を必要としているなら、それは現実的な選択肢であり、請求が伴います。

Odyssey-3はそれを提供していない。Odysseyのページには、リサーチプレビューが「今すぐ利用可能」と書かれ、フィジカルAI開発者に連絡を取るよう促している——これはデモと会話を説明するものであり、キーの背後にあるエンドポイントではない。公開された価格も、ライセンスも、APIドキュメントもなく、上のセクションが示すとおり、独立した評価もない。発表記事を読んだ開発者は、今日時点でOdyssey-3上のプロダクションビルドにいくらかかるかを計算したり、ベンダー自身のハーネスの外で物理に関する主張が成り立つかを確認したりすることはできない。これはローンチ当日のワールドモデルとしては普通のことだが、この比較において最も重要な一つの事実でもある。

どちらのモデルも当社のカタログにはありません——OrcaRouterのモデルリストにはOdyssey-3もWan 3.0も存在しないからです——そこで有用なルーティングポイントとなるのは、それらの上に位置する層です。動画の構築では、おそらく1つのモデルを呼び出すだけでは済みません。プロンプト書き換えモデル、動画モデル、時には音声モデルを呼び出し、ベンダーが価格やレート制限を変更するたびにそのすべてを呼び直します。OrcaRouterでは、それらはプロバイダーの定価で200以上のモデルをカバーする単一のAPI(マークアップ0%)の背後にあるため、動画ベンダーによる秒単位の値下げも、設定変更を待つことなくその日のうちにここへ反映されます。さらに、自動フェイルオーバーにより、1つのモデルの障害がレンダリングキューを滞らせることはありません。当社が実際に提供している動画モデル——MiniMax H3、Kling 3.0、Kling Video O1など——も同じキー上にあるため、Wan 3.0のプレビューやOdyssey-3のトライアルがついに公開されたときの差し替えが安価に済みます。

Capture of Odyssey's own 'Meet Odyssey-3' launch page, dated October 8th 2026, describing Odyssey-3 as a learned dynamical system implemented as an autoregressive diffusion transformer and inviting physical-AI developers to get in touch about the research preview.

あなたのスタックに属するのはどれですか

この選択は僅差ではない。なぜなら、両者が生み出すものには重なりがないからだ。誠実な判断基準は、最終的にあなたが必要とする成果物にこそある。

人が視聴する映像、つまり広告、ショットインサート、SNS向けカット、教育セグメントが成果物なら、Wan 3.0を選んでください。1回の実行あたり30秒でネイティブ音声、画像・動画・音声にまたがる参照制御、指示ベースの編集、入力としてのドキュメントは制作向け機能リストであり、従量課金APIならテスト費用を事前に把握できます。これは生成であり、シミュレーションではありません — モデルの仕事はクリップが終わるところで終わります。ベンダーの秒単位料金で予算を組み、音声と画面上のテキストに関するベンダー自身の注意書きは脚注ではなく設計制約として扱ってください。

成果物がファイルではなく振る舞いであるなら、入手できるときにはOdyssey-3を選べ。ポリシーが学習する環境、行動に対する応答が長いロールアウトを通じて一貫していなければならないシーン、カメラが問題の一部となるナビゲーションやマニピュレーションのタスクなどだ。そこでは、時空間的妥当性における文句なしの第1位と、動画1本あたり$0.139~$0.267というモデル化コストが実際に重要になる。欠けているのは、制作チームがコミットするために必要なものすべて——価格、ライセンス、エンドポイント、そして外部による測定——であり、それらのどれもデモで代用できるものではない。

注目すべき点は具体的で、すぐ手の届くところにある。Wan 3.0がPhysics-IQ Verifiedに登場すれば、物理の問題は一方の方向で答えが出る。Odysseyが料金表かAPIを公開すれば、コストの問題はもう一方の方向で解決する。そのどちらかが起きるまでは、この比較は奇妙な形をしている。公開された価格を持ちながら物理スコアがないプロダクションシステムの隣に、公開された物理スコアを持ちながら価格がないシミュレーターが並んでいる。今日どちらが優れているかを断言する人は、少なくともそれら2つの数値のうち1つについて推測している。

Capture of the Physics-IQ Verified leaderboard from Anates Labs and DeepMind, ranked by net improvement in percentage points above the track mean, showing FLUX 3 [large] first at +12.27 pp, Odyssey-3 Pro second at +11.15 pp and Odyssey-3 third at +9.99 pp, with Wan 2.2 14B at rank 17 and Wan 2.2 5B at rank 22 and no entry for Wan 3.0.