بطاقة عنوان لـ Odyssey-3، بعنوان فرعي “نموذج Odyssey التفاعلي للعالم، معاينة بحثية عامة افتُتحت في 8 أكتوبر 2026”، مع لوحتين إحصائيتين: Odyssey-3 بدقة 832x480 و16 إطارًا في الثانية على الفئة الأساسية، Physics-IQ +9.99 نقطة مئوية، المرتبة 03 على المطالبات المخصصة، التكلفة المعيارية 0.139 دولارًا لكل فيديو؛ و Odyssey-3 Pro بدقة 1280x720 على فئة Pro، Physics-IQ +11.15 نقطة مئوية، المرتبة 02، و66.1 على مسار فيديو إلى فيديو، التكلفة المعيارية 0.267 دولارًا لكل فيديو.
Guides & Insights

Odyssey-3: نموذج العالم الجديد من Odyssey ينتزع تاج Physics-IQ ويفتح معاينة عامة

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

سجّل Odyssey-3 Pro نتيجة 66.1 على مسار فيديو-إلى-فيديو الخاص بـ Physics-IQ Verified، ونشرت Odyssey ذلك الرقم في 8 أكتوبر 2026 إلى جانب ما يهم المطوّر فعلاً: معاينة بحثية عامة لـ Odyssey-3، وهو محوّل انتشار انحداري ذاتي بُني لتوليد بيئة من مطالبة ثم الاستمرار في التنبؤ بها في الوقت الفعلي بينما يتجول فيها شخص، أو يحرّك كاميرا، أو يشغّل حدثًا. Odyssey-3 هو النموذج؛ Odyssey-3 Pro هو فئة 720p منه، يعمل بدقة 1280×720 مقابل 832×480 للنموذج الأساسي. يُطرح كلاهما في اليوم نفسه، ضمن معاينة يمكنك تشغيلها بنفسك على experience.odyssey.systems، مع مسار تواصل منفصل للوصول إلى API.

هذا الاقتران هو ما يجعل هذا أكثر من مجرد منشور عن المعايير. كانت نماذج العالم التفاعلية مجرد برمجيات استعراضية لمدة عامين؛ فالنماذج التي تولّد بضع إطارات من حركة معقولة على مسار ثابت ليست الشيء نفسه كنموذج يُبقي تنبؤاته متماسكة بعد أن تضغط على عناصر التحكم. تزعم Odyssey الأمر الثاني، وهي تتيح لأي شخص اختبار هذا الادعاء.

ما الذي تم إصداره، بالتحديد؟

نقطتا حفظ، معمارية واحدة، بلا أوزان.

• Odyssey-3 — فئة 480p، بإخراج 832×480، و16 إطارًا في الثانية على منصة الاختبار المعيارية، ومُدرَج عند 0.139 دولار لكل فيديو مُولَّد في عمود التكلفة المعيارية بلوحة الصدارة.

• Odyssey-3 Pro — فئة 720p، ‏1280×720، بسعر 0.267 دولار لكل فيديو على الأساس نفسه.

• الوصول — معاينة بحثية في المتصفح مع تنقّل من منظور الشخص الأول، وتنقّل من منظور الشخص الثالث، وحركة كاميرا مستقلة. الوصول إلى API يكون عبر نموذج تواصل، وليس مفتاحًا ذاتي الخدمة.

• الانفتاح — لا شيء. لا أوزان، ولا ترخيص، ولا سعر لكل توكن منشور. آخر تحديث لصفحة شروط API على الموقع نفسه كان في 2026-01-22، وما زالت تحكم «النموذج الأولي لـ Odyssey-2 API»، وهو ما يوضح لك مدى حداثة الواجهة التجارية.

تُوصَف البنية في ما كتبته Odyssey بنفسها بأنها محوّل انتشار فيديو متعدد الخطوات، موسَّع بالانحدار الذاتي عبر إجبار المعلّم والإخفاء السببي، مع خط أنابيب لما بعد التدريب يجمع بين مطابقة التوزيع والتقطير التخاصمي في نسخة مقطّرة قليلة الخطوات — وهو الجزء الذي يجعل التفاعل الآني ممكنًا أصلًا. يمنحك الانتشار الدقة؛ ويمنحك الانحدار الذاتي نموذجًا يصمد أمام تسلسل إجراءات؛ ويمنحك التقطير سرعة الساعة. العناصر الثلاثة كلها أساسية، وكلها رواية المورّد عن نظامه الخاص، لا رواية مستقلة.

المعيار المرجعي، مقروءًا بالطريقة التي يقرؤه بها مجلس الإدارة فعليًا.

The Physics-IQ Verified leaderboard from Anates Labs and Google DeepMind, headed “Dynamic ranking of video models by how well they understand physical principles”, read 9 October 2026, with separate image-to-video and video-to-video columns. The visible ranking runs FLUX 3 [large] at 01, Odyssey-3 Pro at 02, Odyssey-3 at 03, then Cosmos-class entries at 04 to 06, Seedance 2.5 at 07, Odyssey-3 at 08, MiniMax H3 at 09, Cosmos3 Nano at 10 and MiniMax H3 Max in the low teens.

يُدار Physics-IQ Verified بواسطة Anates Labs بالتعاون مع DeepMind، وهو معيار تقييم يصعب حقًا التلاعب به: فهو يعرض على النماذج مقاطع فيديو لتجارب فيزيائية حقيقية — ديناميكا الموائع، والبصريات، وميكانيكا المواد الصلبة، والمغناطيسية، والديناميكا الحرارية — ويقيّم التتمة مقابل ما حدث فعليًا. وهو يصنّف حاليًا 41 نموذجًا من 16 مختبرًا. تُعد درجة 66.1 التي حصل عليها Odyssey-3 Pro أعلى درجة خام في مسار الفيديو إلى الفيديو الذي يقدمه Odyssey، كما أن عمود صافي التحسين في لوحة النتائج نفسها، الذي يقيس مقدار التحسن عن متوسط المسار بالنقاط المئوية، يروي قصة مختلفة بشكل طفيف:

• صافي التحسّن مقارنة بمتوسط المسار — يتصدّر FLUX 3 [large] عند +12.27 نقطة مئوية؛ ويأتي Odyssey-3 Pro في المركز الثاني عند +11.15 نقطة مئوية؛ ويحلّ Odyssey-3 في المركز الثالث عند +9.99 نقطة مئوية.

• تكلفة كل فيديو مُولَّد — Odyssey-3 Pro ‏$0.267، وOdyssey-3 ‏$0.139، مقابل FLUX 3 [large] عند $0.868 وSeedance 2.5 عند $2.838. (تم توحيد التكاليف وفق 24 إطارًا في الثانية وإخراج بعرض 1280 حيثما تستطيع لوحة الصدارة ذلك، كي تكون قابلة للمقارنة بين النماذج التي لا تتشارك معدل الإطارات نفسه.)

• الريادة في المقاييس الفرعية — تحلّ Odyssey-3 في المركز الأول على المقياس الفرعي الزمكاني عند 44.70، متقدمةً على Odyssey-3 Pro عند 42.97؛ وتحلّ FLUX 3 [large] في المركز الأول على المقياس المكاني عند 64.36 والمقياس المكاني المرجّح عند 53.25، مع حلول إدخالي Odyssey في المركزين الثاني والرابع على المقياس المكاني.

إذن القراءة الصادقة ليست "Odyssey-3 هو أفضل نموذج فيديو في العالم." بل هي: نموذج عالمي مُصمَّم للتفاعل وصل إلى القمة تقريباً في لوحة المعقولية الفيزيائية التي كانت سابقاً حكراً على المولِّدات السينمائية، وقد فعل ذلك بتكلفة تعادل نحو ثلث التكلفة المعيارية لـ FLUX 3. وادعاء Odyssey المنفصل — 54.7 لـ Odyssey-3 Pro في مسار الصورة-إلى-فيديو، أفضل 8 — يقع على اللوحة نفسها، وينطبق التحفظ ذاته: فهذه إعدادات مُقدَّمة ذاتياً، وتخلط لوحة الصدارة بين إدخالات قُدِّمت بموجِّهات مخصَّصة وإدخالات شُغِّلت بموجِّهات المعيار نفسه. ويظهر Odyssey في العمودين كليهما، وهو ما يتّسم بشفافية غير معتادة، ويعني أيضاً أن صفّيه لا يقيسان الشيء نفسه.

Single-column scoreboard headed “Odyssey-3 — the scoreboard” with six rows: Access — browser preview plus contact form; Sizes — 832x480, 1280x720 Pro; Independent scoring — none yet; Physics-IQ, custom prompts — +9.99 pp base, +11.15 pp Pro; Physics-IQ, board prompts — +2.15 pp, rank 08; Published price — none. Footer: “Odyssey-3 figures vendor-reported and unreproduced; Physics-IQ Verified board read Oct 9 2026”.

لماذا "نموذج العالم" ليس مرادفًا لـ"نموذج الفيديو"

هذا التمييز هو حجة المنتج بأكملها، لذا يجدر قوله بوضوح. مولّد المقاطع يأخذ أمرًا نصيًا ويعيد كائنًا ثابتًا؛ وتكون المخرجات نفسها لكل من يطلبها. أما Odyssey-3 فيأخذ أمرًا نصيًا ويعيد نظامًا تتصرّف من داخله — ووضعا الكاميرا في المعاينة بمنظور الشخص الأول ومنظور الشخص الثالث، وقدرته على استقبال حدث أثناء التوليد، هما الآلية التي يتنبأ بها بما سيحدث بعد ذلك بناءً على ما فعلته للتو، لا بناءً على ما قاله الأمر النصي.

هذه الخاصية هي ما يجعل نتائج الأنظمة الفيزيائية في مواد إطلاق Odyssey تبدو كما تبدو. وتذكر الشركة أن مُفكِّك ترميز إجراءات مرتبطًا بالنموذج العالمي المجمَّد، ومدرَّبًا على عشرات الساعات من عروض الروبوت، أنتج سلوكيات استرداد لم تكن موجودة في العروض — إعادة توجيه القابض بعد فشل الالتقاط، واستعادة جسم سقط في وضعية غير معتادة. وتذكر أن سياسة روبوت شبيه بالبشر بناها Flexion فوق Odyssey-3 باستخدام عشرات الساعات من بيانات التشغيل عن بُعد واصلت التنفيذ في ظل تغييرات الإضاءة التي أفسدت خطوط الأساس VLA التي قُورنت بها. وتذكر أن سياسة قيادة دُرّبت على 20 ساعة من بيانات المحاكاة قد قادت في حلقة مغلقة على طرق حقيقية، حيث قطعت مسافةً تبلغ نحو 77% من المسافة التي قطعتها سياسة دُرّبت على لقطات حقيقية بين تدخلات سائق الأمان. وتذكر أن ملاحة الطائرات بدون طيار من بيانات طيران محاكاة واللعب في GTA V قد نقلت الحركة إلى Red Dead Redemption 2 وقيادة الدراجات النارية إلى Sleeping Dogs دون مزيد من التدريب.

كل واحدة من تلك نتيجة يبلّغ عنها المورّد دون تكرار مستقل، واثنتان منها تُصاغان صراحةً من قِبَل Odyssey كملاحظات نوعية لا كقياسات. لكنها النوع الصحيح من الأدلة على هذا الادعاء: الجزء المثير ليس أن النموذج يستطيع أداء مهمة دُرّب عليها، بل أن عمودًا فقريًا مجمّدًا مع مُهايِئ صغير يستخرج سلوكًا ذا معنى من بضع عشرات من الساعات من البيانات، ويتعمّم أحيانًا إلى ما هو أبعد من ذلك.

ما الذي لا يزال غير مُثبت؟

Odyssey's own launch post, “Meet Odyssey-3: Our Most Powerful Foundation World Model”, dated October 8 2026 and credited to Oliver Cameron and other authors, with the Odyssey site navigation (About, News, Careers, Contact) and the opening line “Today we're launching Odyssey-3, our most powerful foundation world model yet.”

ثلاثة أمور، وهي ليست صغيرة.

أولًا، لم يقم أي مُقيِّم مستقل بتشغيل Odyssey-3. إن مُدخل Physics-IQ هو مشاركة مقدَّمة، ومصدر التقييم الثاني في ما كتبته Odyssey بنفسها — WorldMark، الذي يحتل فيه Odyssey-3 المرتبة الأولى في ثلاثة من أربعة تقسيمات — هو تقييم تجريه الجهة المورِّدة باستخدام التسميات التوضيحية الخاصة بالمعيار نفسه، وبصياغة Odyssey نفسها، «متوسط درجات مقاييسه الـ13 المُبلَّغ عنها». أي أن الشركة تقيّم نفسها على مجموعة بيانات شخص آخر. وهو أكثر مما تقدّمه معظم عمليات الإطلاق. لكنه ليس طرفًا ثالثًا.

ثانيًا، الفئة الفرعية الوحيدة التي لا يفوز بها Odyssey-3 في ذلك التقييم هي الأقرب إلى الادعاء التسويقي. في البيئات الواقعية بمنظور الشخص الأول، يأتي في المركز الثالث عند 80.6، خلف Lyra 2.0 عند 84.4 وAlayaWorld عند 83.0. ويتركّز تفوّق النموذج في التقييم نفسه في البيئات الأسلوبية وبيئات منظور الشخص الثالث — 77.2 في البيئات الأسلوبية بمنظور الشخص الأول، و79.0 في البيئات الواقعية بمنظور الشخص الثالث، و76.3 في البيئات الأسلوبية بمنظور الشخص الثالث. إذا كنت تبني من أجل تجسيد واقعي فوتوغرافي بمنظور الشخص الأول، فإن التصنيف الذي ينبغي أن يهمّك هو التصنيف الذي لا يتصدّر فيه Odyssey-3.

ثالثًا، التوفّر. عبارة «معاينة بحثية» لها ثقل حقيقي في تلك الجملة. لا توجد صفحة تسعير، ولا توثيق لحدود المعدل، ولا مفتاح ذاتي الخدمة. إذا أردت استخدام هذا في منتج، فأنت في قائمة انتظار.

مقارنته بدون عقد ثانٍ

إليك المشكلة العملية مع إطلاق كهذا: Odyssey-3 هو أكثر شيء مثير للاهتمام في توليد الفيديو هذا الأسبوع، ومع ذلك لا يزال يتعذر عليك استدعاؤه. أما النماذج التي قد تقارنه بها فعليًا فقصتها مختلفة.

لا تستضيف OrcaRouter نموذج Odyssey-3، ولا يوجد سعر منشور يمكن تمريره حتى لو استضفناه. ما يصل إليه مفتاح واحد هو بقية مجموعة المقارنة — minimax/minimax-h3 بسعر 0.08 دولار لكل ثانية من الفيديو المُولَّد بدقة 768P، وخط فيديو K​ling، وأكثر من 200 نموذج خلف نقطة نهاية واحدة — بسعر قائمة المزوّد مع هامش ربح 0%، بحيث يظهر تغيير سعر البائع في فاتورتك في اليوم نفسه بدلًا من التجديد التالي. التحويل التلقائي عند الفشل بين المزوّدين يعني أن جولة التقييم الشاملة لا تتعطل لأن أحد الأنظمة المصدرية يمرّ بظرف بعد الظهر، وتتيح لك لغة توجيه DSL وضع عدة نماذج خلف واجهة واحدة، بحيث تكون المقارنة المباشرة تغييرًا في الإعدادات بدلًا من تكامل ثانٍ. إذا أطلقت Odyssey واجهة API ذاتية الخدمة، فهذا هو الشكل الذي تريد إدراجه فيه.

ما الذي سيحسم الأمر؟

تشغيل مستقل لـ Odyssey-3 على منظومة اختبار لم تخترها. اثنا عشر ممارسًا يمتلكون صلاحية الوصول التجريبي يصفون أين تتماسك البيئة بعد دقيقة من العمل المكثف بالكاميرا وأين لا تتماسك. سعر. أيٌّ من ذلك يحوّل هذا من إطلاق قوي إلى نقطة مرجعية.

إن ما هو صحيح بالفعل أضيق نطاقًا، لكنه لا يزال جديرًا بالملاحظة: على لوحة الصدارة العامة الوحيدة التي تقيس ما إذا كان النموذج التوليدي يفهم الفيزياء بدلًا من قياس ما إذا كان يلتقط الصور جيدًا، يحتل نموذج غرضه التفاعل المركزين الثاني والثالث، بتكلفة مُعيارية أدنى من النموذج المتصدّر.