
Odyssey-3: מודל העולם החדש של Odyssey זוכה בכתר Physics-IQ ופותח תצוגה מקדימה ציבורית
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 378 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Odyssey-3 Pro קיבל ציון 66.1 במסלול video-to-video של Physics-IQ Verified, ו-Odyssey פרסמה את המספר הזה ב-8 באוקטובר 2026 לצד הדבר שבאמת חשוב למפתח: תצוגה מקדימה מחקרית ציבורית של Odyssey-3, טרנספורמר דיפוזיה אוטורגרסיבי שנבנה כדי ליצור סביבה מפרומפט ואז להמשיך לחזות אותה בזמן אמת כשמישהו מהלך דרכה, מזיז מצלמה או מפעיל אירוע. Odyssey-3 הוא המודל; Odyssey-3 Pro הוא דרגת ה-720p שלו, שפועלת ב-1280×720 לעומת 832×480 של מודל הבסיס. שניהם עולים לאוויר באותו יום, לתצוגה מקדימה שתוכלו להפעיל בעצמכם בכתובת experience.odyssey.systems, עם דרך יצירת קשר נפרדת לגישה ל-API.
הצירוף הזה הוא מה שהופך את זה ליותר מאשר פוסט בנצ'מרק. מודלי עולם אינטראקטיביים היו בגדר תוכנת דמו במשך שנתיים; אלה שמייצרים כמה פריימים של תנועה סבירה במסלול קבוע אינם אותו ארטיפקט כמו מודל ששומר על תחזיותיו עקביות אחרי שאתה דוחף בפקדים. Odyssey טוענת לדבר השני, והיא מאפשרת לכל אחד לבדוק את הטענה.
מה נשלח, בדיוק
שני צ'קפוינטים, ארכיטקטורה אחת, בלי משקלים.
• Odyssey-3 — דרגת 480p, פלט 832×480, 16 fps על רתמת הבנצ'מרק, רשום במחיר $0.139 לכל סרטון שנוצר בעמודת העלות המנורמלת של לוח הדירוג.
• Odyssey-3 Pro — שכבת ה-720p, 1280×720, רשומה במחיר $0.267 לסרטון על אותו בסיס.
• גישה — תצוגה מקדימה למחקר בדפדפן עם ניווט בגוף ראשון, ניווט בגוף שלישי, ותנועת מצלמה עצמאית. גישה ל-API היא טופס יצירת קשר, ולא מפתח בשירות עצמי.
• פתיחות — אין. אין משקולות, אין רישיון, ולא פורסם מחיר לכל טוקן. דף תנאי ה-API באותו אתר עודכן לאחרונה ב-2026-01-22 ועדיין חל על "האב-טיפוס של Odyssey-2 API", מה שמעיד עד כמה המשטח המסחרי חדש.
הארכיטקטורה מתוארת במסמך התיאור של Odyssey עצמה כטרנספורמר דיפוזיה לווידאו רב-שלבי, המורחב באופן אוטורגרסיבי באמצעות Teacher Forcing ומיסוך סיבתי, עם צינור אימון-בדיעבד המשלב התאמת התפלגויות וזיקוק יריבי לגרסה מזוקקת בת כמה צעדים בלבד — החלק שמאפשר בכלל אינטראקציה בזמן אמת. דיפוזיה נותנת נאמנות; אוטורגרסיה נותנת מודל שמחזיק מעמד לאורך רצף פעולות; הזיקוק נותן את מהירות השעון. כל השלושה חיוניים, וכל השלושה הם התיאור של הספק את המערכת של עצמו, ולא תיאור עצמאי.
אמת המידה, כפי שהדירקטוריון קורא אותה בפועל
![The Physics-IQ Verified leaderboard from Anates Labs and Google DeepMind, headed “Dynamic ranking of video models by how well they understand physical principles”, read 9 October 2026, with separate image-to-video and video-to-video columns. The visible ranking runs FLUX 3 [large] at 01, Odyssey-3 Pro at 02, Odyssey-3 at 03, then Cosmos-class entries at 04 to 06, Seedance 2.5 at 07, Odyssey-3 at 08, MiniMax H3 at 09, Cosmos3 Nano at 10 and MiniMax H3 Max in the low teens.](https://cms.orcarouter.ai/api/media/file/2-1765.png)
Physics-IQ Verified מופעל על ידי Anates Labs עם DeepMind, וזהו מבחן מידה שקשה במיוחד לרמות בו: הוא מציג למודלים וידאו של ניסויים פיזיקליים אמיתיים — דינמיקת נוזלים, אופטיקה, מכניקת מוצקים, מגנטיות, תרמודינמיקה — ומדרג את ההמשך לעומת מה שקרה בפועל. נכון לעכשיו הוא מדרג 41 מודלים מ-16 מעבדות. הציון 66.1 של Odyssey-3 Pro הוא הציון הגולמי הגבוה ביותר במסלול וידאו-לווידאו ש-Odyssey מדווחת עליו, ואותה טבלה — העמודה של שיפור נטו, שמודדת את הרווח מעל ממוצע המסלול בנקודות אחוז — מספרת סיפור שונה במקצת:
• שיפור נטו לעומת ממוצע המסלול — FLUX 3 [large] מוביל עם +12.27 נקודות אחוז; Odyssey-3 Pro במקום השני עם +11.15 נקודות אחוז; Odyssey-3 במקום השלישי עם +9.99 נקודות אחוז.
• עלות לכל וידאו שנוצר — Odyssey-3 Pro $0.267, Odyssey-3 $0.139, לעומת FLUX 3 [large] ב-$0.868 ו-Seedance 2.5 ב-$2.838. (העלויות מנורמלות ל-24 פריימים לשנייה ולפלט ברוחב 1280 היכן שלוח התוצאות מאפשר, כך שהן ברות השוואה בין מודלים שאין להם אותו קצב פריימים.)
• הובלה בתת-מדדים — Odyssey-3 ראשון בתת-המדד המרחבי-זמני עם 44.70, לפני Odyssey-3 Pro עם 42.97; FLUX 3 [large] ראשון במדד המרחבי עם 64.36 ובמדד המרחבי המשוקלל עם 53.25, כששני הערכים של Odyssey במקום השני והרביעי במדד המרחבי.
אז הקריאה הכנה היא לא "Odyssey-3 הוא מודל הווידאו הטוב בעולם". היא: מודל עולם שנבנה לאינטראקציה הגיע סמוך לראשו של לוח סבירות פיזית שהיה בעבר נחלתם של מחוללים קולנועיים, והוא עשה זאת בעלות של כשליש מהעלות המנורמלת של FLUX 3. הטענה הנפרדת של Odyssey — 54.7 עבור Odyssey-3 Pro במסלול image-to-video, best-of-8 — נמצאת על אותו לוח, ואותו סייג חל: אלו תצורות שהוגשו עצמאית, ולוח הדירוג מערבב רשומות שהוגשו עם פרומפטים מותאמים אישית ורשומות שהורצו עם הפרומפטים של המבחן עצמו. Odyssey מופיע בשתי העמודות, וזו שקיפות יוצאת דופן וגם אומר ששתי השורות שלו לא מודדות את אותו הדבר.

מדוע "מודל עולם" אינו שם נרדף ל"מודל וידאו"
ההבחנה הזו היא כל הטיעון של המוצר, ולכן כדאי לנסח אותה בבירור. מחולל קליפים מקבל פרומפט ומחזיר אובייקט קבוע; הפלט זהה עבור כל מי שמבקש. Odyssey-3 מקבל פרומפט ומחזיר מערכת שפועלים בתוכה — מצבי המצלמה בגוף ראשון ובגוף שלישי של התצוגה המקדימה, והיכולת שלו לקבל אירוע תוך כדי היצירה, הם המנגנון שבאמצעותו הוא חוזה מה יקרה בהמשך בהתאם למה שעשית זה עתה, ולא בהתאם למה שהפרומפט אמר.
התכונה הזו היא מה שגורם לתוצאות המערכת הפיזית בחומר ההשקה של Odyssey להיראות כפי שהן נראות. החברה מדווחת שמפענח פעולות המחובר למודל העולם הקפוא, שאומן על עשרות שעות של הדגמות רובוט, יצר התנהגויות התאוששות שמעולם לא הופיעו בהדגמות — כיוון מחדש של גריפר לאחר אחיזה שהוחמצה, אחזור חפץ שנפל בתנוחה יוצאת דופן. היא מדווחת על מדיניות הומנואידית שנבנתה על ידי Flexion על גבי Odyssey-3 עם עשרות שעות של נתוני טלאופציה, שהמשיכה לפעול תחת שינויים בתאורה ששברו את קווי הבסיס של VLA שמולם היא הושוותה. היא מדווחת על מדיניות נהיגה שאומנה על 20 שעות של נתונים מדומים, שנסעה בלולאה סגורה על כבישים אמיתיים, כשנסעה מרחק של כ-77% בין התערבויות של נהג בטיחות לעומת מדיניות שאומנה על צילום אמיתי. היא מדווחת על ניווט רחפן מנתוני טיסה מדומים ומשחק ב-GTA V שהעביר תנועה ל-Red Dead Redemption 2 ורכיבה על אופנוע ל-Sleeping Dogs ללא אימון נוסף.
כל אחד מאלה הוא תוצאה שדווחה על ידי ספק ללא שכפול בלתי תלוי, ושניים מהם מוצגים במפורש על ידי Odyssey כתצפיות איכותניות ולא כמדידות. אבל הם סוג הראיות הנכון לטענה: החלק המעניין אינו שהמודל יכול לבצע משימה שאומן עבורה. אלא שעמוד שדרה קפוא בתוספת מתאם קטן מפיק התנהגות משמעותית מכמה עשרות שעות של נתונים, ולעיתים מכליל מעבר להם.
מה עדיין לא הוכח

שלושה דברים, והם לא קטנים.
ראשית, אף מעריך בלתי־תלוי לא הריץ את Odyssey-3. הרשומה של Physics-IQ היא הגשה, והמקור השני לניקוד בכתיבה של Odyssey עצמה — WorldMark, שבו Odyssey-3 מדורגת ראשונה בשלושה מתוך ארבעה פיצולים — הוא הערכת ספק המשתמשת בכיתובים של המבחן עצמו, ובלשון Odyssey, "הממוצע של 13 ציוני המדדים המדווחים שלה." כלומר, החברה נותנת לעצמה ציון על מערך הנתונים של מישהו אחר. זה יותר ממה שרוב ההשקות מציעות. זה לא צד שלישי.
שנית, החלוקה היחידה ש-Odyssey-3 לא מנצח בה בהערכה הזו היא זו הקרובה ביותר לטענה השיווקית. בסביבות אמיתיות בגוף ראשון הוא ממוקם במקום השלישי עם 80.6, אחרי Lyra 2.0 עם 84.4 ו-AlayaWorld עם 83.0. היתרון של המודל באותה הערכה מרוכז בסביבות מסוגננות ובסביבות בגוף שלישי — 77.2 בגוף ראשון מסוגנן, 79.0 בגוף שלישי אמיתי, 76.3 בגוף שלישי מסוגנן. אם אתם בונים עבור התגלמות פוטוריאליסטית בגוף ראשון, הדירוג שכדאי לכם להתחשב בו הוא זה שבו Odyssey-3 לא נמצא בראש.
שלישית, זמינות. "תצוגה מקדימה למחקר" עושה עבודה אמיתית במשפט הזה. אין דף תמחור, אין תיעוד של מגבלת קצב, ואין מפתח בשירות עצמי. אם אתה רוצה את זה במוצר, אתה בתור.
להשוות את זה בלי חוזה שני
הנה הבעיה המעשית עם השקה כמו זו: Odyssey-3 הוא הדבר המעניין ביותר ביצירת וידאו השבוע, ובכל זאת עדיין אי אפשר להפעיל אותו. המודלים שמולם באמת הייתם עורכים לו בנצ׳מרק הם סיפור אחר.
OrcaRouter לא מארח את Odyssey-3, ואין מחיר מפורסם שאפשר להעביר הלאה גם אם היינו מארחים אותו. מה שמפתח אחד כן מגיע אליו הוא שאר מערך ההשוואה — minimax/minimax-h3 במחיר של $0.08 לשנייה של וידאו שנוצר ב-768P, קו הווידאו Kling, ויותר מ-200 מודלים מאחורי נקודת קצה אחת — במחיר המחירון של הספק עם 0% תוספת, כך ששינוי מחיר של ספק מופיע בחשבונית שלך באותו יום ולא בחידוש הבא. מעבר אוטומטי בין ספקים במקרה של כשל פירושו שסבב הערכה לא מת בגלל שספק אחד במעלה הזרם חווה אחר צהריים קשה, וה-DSL של הניתוב מאפשר לך לשים כמה מודלים מאחורי ממשק אחד כך שהשוואה ראש-בראש היא שינוי בקונפיגורציה ולא אינטגרציה נוספת. אם Odyssey תפתח API בשירות עצמי, זו הצורה שתרצה לשבץ אותו לתוכה.
מה יפתור את זה?
ריצה עצמאית של Odyssey-3 על הרנס שהוא לא בחר. תריסר אנשי מקצוע עם גישת תצוגה מקדימה שמתארים היכן הסביבה מחזיקה מעמד אחרי דקה של עבודת מצלמה אגרסיבית והיכן היא לא. מחיר. כל אחד מאלה הופך את זה מהשקה חזקה לנקודת ייחוס.
מה שכבר נכון הוא מצומצם יותר, ועדיין ראוי לציון: בלוח הדירוג הציבורי היחיד שמודד אם מודל גנרטיבי מבין פיזיקה ולא אם הוא מפיק תמונות טובות, מודל שמטרתו אינטראקציה ממוקם במקום השני והשלישי, בעלות מנורמלת נמוכה מזו של המודל שבמקום הראשון.
