כרטיס כותרת עבור Odyssey-3 לעומת Kandinsky 6.0 Video, עם לוח שמאלי שכותרתו Odyssey-3 ועליו כתוב סביבה אינטראקטיבית, תצוגה מקדימה מחקרית שנפתחה ב-8 באוקטובר 2026, 832x480 או 1280x720 Pro, ללא משקלים וללא מחיר; ולוח ימני שכותרתו Kandinsky 6.0 Video ועליו כתוב משקלים פתוחים ב-6 באוקטובר 2026 תחת רישיון MIT, קליפים באורך 5s עם אודיו ב-44 kHz, Full HD 1920x1080, Physics-IQ לא הוגש.
Guides & Insights

Odyssey-3 מול Kandinsky 6.0 Video: משקולות פתוחות ואודיו לעומת תצוגה מקדימה אינטראקטיבית סגורה

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Kandinsky 6.0 Video הגיע ב-6 באוקטובר 2026 עם הדבר ששחרורים של מודלים פתוחים לעיתים רחוקות מקבלים ביום הראשון: תמיכה ב-Diffusers, ComfyUI, vLLM-Omni, SGLang ו-FastVideo, כולם מתועדים ביומן העדכונים של המאגר עצמו, לצד דוח arXiv שהוגש ב-4 באוקטובר וצ'קפוינטים ברישיון MIT ב-Hugging Face. Odyssey-3 הגיע יומיים לאחר מכן, ב-8 באוקטובר, כתצוגה מקדימה מחקרית ציבורית של טרנספורמר דיפוזיה אוטורגרסיבי שבונה סביבה מפרומפט ומנבא שינויים בזמן אמת כשאתם נעים בתוכה. האחד הוא מודל בעל 29 מיליארד פרמטרים שתוכלו להוריד ולהריץ על ה-GPU שלכם כבר הלילה. האחר הוא מערכת אינטראקטיבית שאליה אפשר להגיע רק דרך התצוגה בדפדפן של Odyssey וטופס יצירת קשר. הם שני הקטבים של מה שהמשמעות של ״מודל וידאו״ הייתה באותו שבוע של אוקטובר 2026, והבחירה ביניהם היא פחות שאלה של מדדי ביצועים ויותר שאלה של מי מחזיק במשקולות.

הם גם רוצים ממך דברים שונים. Kandinsky 6.0 Video הוא מודל יצירה: פרומפט נכנס, קליפ של חמש שניות עם אודיו מסונכרן יוצא. Odyssey-3 הוא מודל חיזוי: פעל, וראה איך העולם מגיב. אף אחד מהם לא מחליף את האחר, והעובדה שהם שוחררו בהפרש של 48 שעות היא ההקשר השימושי ביותר שיש לכל אחד מהם.

שתי הארכיטקטורות, במונחים של הספקים עצמם

Kandinsky 6.0 Video היא משפחה של מודלי דיפוזיה בסיסיים ליצירת אודיו-וידאו מסונכרן, הכוללת את Kandinsky 6.0 Video Lite עם 3B פרמטרים ו-Kandinsky 6.0 Video Pro עם 29B. שניהם יוצרים קטעים באורך חמש שניות עם אודיו מסונכרן ב-44 kHz, כולל סנכרון שפתיים, במצבי טקסט-לאודיו-וידאו ותמונה-לאודיו-וידאו, ומודל סופר-רזולוציה חיצוני (plug-in) מעלה את הפלט ל-Full HD 1920×1080. הטכניקה היא CrossDiT דו-זרמי שמחבר זרם וידאו מאומן מראש לזרם אודיו מאומן מחדש באמצעות קשב צולב דו-כיווני, כך ששתי המודאליות מיושרות בזמן ובסמנטיקה במקום להיות מיוצרות בנפרד וממוקססות. מתכון האימון הוא רציף: זרם האודיו מאומן מאפס על קורפוסי אודיו גדולים, לאחר מכן שני הזרמים מאומנים יחד על נתוני אודיו-וידאו מזווגים תוך שמירה על נאמנות חד-מודאלית, ולאחר מכן כיוונון עדין מפוקח, אימון-מחדש בלמידת חיזוק ודיסטילציה.

Odyssey-3 הוא שנאי דיפוזיה אוטורגרסיבי שתואר על ידי Odyssey כמודל דיפוזיה לווידאו רב-שלבי, המורחב באמצעות teacher forcing ומיסוך סיבתי, שאומן להמשיך מתצפיות קודמות ולחזות מצבים עתידיים המותנים בקלטי פעולה, ואחר כך זוקק באמצעות התאמת התפלגות וזיקוק יריבי לגרסה בת כמה צעדים, מהירה מספיק כדי לקיים איתה אינטראקציה. הוא פועל ברזולוציית 832×480, כאשר Odyssey-3 Pro פועל ב-1280×720, אינו מפיק אודיו, וכל מטרתו היא שפלטו תלוי במה שעשית לפני רגע.

תמיכה מהיום הראשון היא ההבדל שאף אחד לא מודד.

The kandinsky-6 repository on GitHub, read 9 October 2026, showing the kandinsky-lab organisation, main branch and 2 branches, 0 tags, a fix/comfyui-lite-distill commit, folders for assets, comfyui, kandinsky, scripts and tests, and repository files including JUSTFILE, LICENSE, README.md, pyproject.toml and uv.lock under an MIT license badge.

קרא שוב את יומן העדכונים של Kandinsky 6.0, מפני שזו העובדה המוחשית ביותר בהשוואה הזו. ב-6 באוקטובר הפרויקט תיעד זמינות ב-Diffusers, ב-ComfyUI node registry, ב-vLLM-Omni, ב-SGLang וב-FastVideo, וכן ב-Hugging Face Space עבור מודל ה-Pro המזוקק. אלה חמישה סטאקים עצמאיים להסקה ביום אחד. עבור כל מי שחיכה חודשים עד שצ'קפוינט יגיע למסגרת הגשה, זה המספר שמכריע אם המודל שמיש.

כעת הצג זאת לצד סיפור הגישה של Odyssey-3. התצוגה המקדימה פועלת בכתובת experience.odyssey.systems עם ניווט בגוף ראשון, ניווט בגוף שלישי ותנועת מצלמה עצמאית. גישה ל-API היא דרך טופס יצירת קשר. אין עמוד תמחור, אין תיעוד של הגבלת קצב, ואין מפתח בשירות עצמי. תנאי ה-API של האתר עודכנו לאחרונה ב-2026-01-22 והם עדיין חלים על "האב־טיפוס של Odyssey-2 API" — הפן המסחרי לא נכתב מחדש עבור המודל שיצא החודש.

• היכן זה פועל — ה-GPUs שלכם, עם משקלים וקוד תחת MIT, מול שרתי Odyssey בלבד.

• כיצד משלבים את זה — צינור Diffusers, צמתי ComfyUI, vLLM-Omni, SGLang, FastVideo, מול תצוגה מקדימה בדפדפן וטופס יצירת קשר.

• מה שניתן לבחון — ארכיטקטורה, מתכון אימון וגדלי נקודות ביקורת בדוח ציבורי, מול תיאור ספק של צינור האימון ללא משקלים וללא מאמר.

• מה שאתם יכולים לשנות — כיוונונים עדינים, LoRA-ים, קוונטיזציה וזיקוק, שכל אלה הקהילה כבר פרסמה ב-Hugging Face יום לאחר ההשחרור, לעומת כלום מוחלט.

מימד אחר מימד

Two-column scoreboard headed “Odyssey-3 vs Kandinsky 6.0 Video — the scoreboard” with six shared dimension labels. Odyssey-3: an interactive environment; 832x480, 1280x720 Pro; a world that responds; no published price; no licence and no weights; Physics-IQ +9.99 pp rank 03. Kandinsky 6.0 Video: five-second clip with audio; Full HD 1920x1080; 3B Lite and 29B Pro parameters; $0 per clip on your own GPU; MIT with weights on Hugging Face; Physics-IQ not submitted. Footer: “Odyssey-3 figures vendor-reported and unreproduced on Physics-IQ Verified; Kandinsky 6.0 Video absent from that board”.

• פלט — קטעים בני חמש שניות עם אודיו מסונכרן ב-44 kHz עבור שתי רמות Kandinsky, לעומת סביבה אינטראקטיבית ללא אודיו עבור Odyssey-3.

• רזולוציה — Full HD 1920×1080 באמצעות מודל הסופר-רזולוציה בתוסף עבור Kandinsky 6.0 Video, לעומת 832×480 עבור Odyssey-3 ו-1280×720 עבור Odyssey-3 Pro.

• מודאליות — טקסט ותמונה עבור Kandinsky, במצבי טקסט-לאודיו-וידאו ותמונה-לאודיו-וידאו; פרומפט בתוספת קלט בקרה חי עבור Odyssey-3.

• פרמטרים — 3B ו-29B פורסמו עבור שכבות ה-Lite וה-Pro, לעומת נתונים שלא פורסמו עבור שתי שכבות Odyssey-3.

• חומרה — כרטיס GPU של NVIDIA ו-Python 3.13 או 3.14, עם פריסטים שמסופקים עבור כרטיסים מדרגת H100/H200 ועד RTX 5090 עבור Kandinsky; דפדפן עבור Odyssey-3.

• מחיר — $0 לכל קליפ עבור Kandinsky 6.0 Video אם יש לך GPU, לעומת היעדר מחיר מפורסם מכל סוג שהוא עבור Odyssey-3. הערכות העלות המנורמלות של הלוח עבור Odyssey-3 ו-Odyssey-3 Pro הן $0.139 ו-$0.267 לכל סרטון שנוצר, לא כולל טיפול בפרומפט.

• ניקוד מצד שלישי — הפלט של אף אחד מהמודלים עצמם אינו נכלל בהשוואה ראש-בראש בלתי תלויה. הדוח של Kandinsky נשען על הערכה אנושית זה-לצד-זה מול קודמו; הנתונים של Odyssey-3 מגיעים מהגשה לבנצ'מרק בתוספת הערכה שנערכה על ידי הספק.

• רישיון — MIT עבור Kandinsky 6.0 Video, לעומת מצב שבו לא פורסם רישיון כלל, כי אין משקלים שניתן להעניק להם רישיון.

מה שהבנצ'מארקים אומרים ומה שהם לא אומרים

Kandinsky 6.0 Video אינו מופיע ב-Physics-IQ Verified, הלוח של Anates Labs ו-DeepMind שמדרג המשכים של ניסויים פיזיקליים אמיתיים בקרב 41 מודלים. גם לא השותף להתמודדות ראש-בראש של Odyssey-3 כאן, מפני שהלוח מדרג מודלים שמייצרים קליפים, ושניהם עושים זאת. מה שכן מופיע בלוח הוא סדרת מודלי-העולם המוקדמת יותר של Kandinsky, ‏Kandinsky-WM 1.0, במקום ה-20 ובפער של −8.02 נקודות אחוז מול ממוצע המסלול — משפחה אחרת, מטרה אחרת, והרשומה היחידה של Kandinsky בלוח.

השורות של Odyssey-3, לשם השוואה: מקום 8 ב-+2.15 נקודות אחוז בפרומפטים של המבחן עצמו ו-$0.129 לסרטון, ומקום 3 ב-+9.99 נקודות אחוז בפרומפטים מותאמים אישית, כאשר Odyssey-3 Pro שני בסך הכול ב-+11.15 נקודות אחוז. אלה מספרים טובים יותר מכל מה שיש לסדרת Kandinsky באותו מבחן מסוים, והם גם מודדים יכולת שונה — את Odyssey-3 מדרגים לפי מה שהוא חוזה לאחר הפרעה, וזה בדיוק מה שהפריוויו שלו מוכר.

הראיה של Kandinsky עצמו היא ההערכה האנושית בדוח הטכני: Kandinsky 6.0 Video Pro עולה בבירור על קודמו Kandinsky 5.0 Video Pro, ונשאר תחרותי מול מודלים מובילים ליצירת אודיו-וידאו, במיוחד באיכות דיבור. מדובר בהשוואה זה-לצד-זה שהספק מריץ, וזה מסוג הטענות שאפשר לבדוק כנגדן checkpoint ששוחרר על ידי כל מי שיש לו 5090 ואחר צהריים. את הטענה המקבילה של Odyssey-3 לא יכול לבדוק אף אחד בלי מפתח API.

OrcaRouter's own model page for minimax/minimax-h3, showing the model header “text + image + video + audio”, output video, a p50 time-to-first-token of 406 ms, performance and vision/audio badges, and a Python code sample on the left with the model list and playground navigation above.

להגיע אליהם

OrcaRouter אינו מארח אף אחד מהמודלים, ולעולם לא ירמוז אחרת: ל-Odyssey-3 אין תעריף מפורסם שמישהו יוכל לנתב אליו, ו-Kandinsky 6.0 Video הוא בעל משקלים פתוחים, מה שאומר שהדרך הנכונה להריץ אותו היא ההתקנה של המאגר עצמו על ה-GPU שלך, ולא נקודת קצה מתארחת.

המקום שבו מפתח OrcaRouter אחד נכנס לתמונה הוא השכבה שסביב הניסוי. המאגר של Kandinsky מניח שאתם מספקים את ה-GPU, את הסביבה ואת ההשוואה; מה שהוא לא מספק הוא דרך לקרוא למודלים שאיתם אתם רוצים להשוות אותו. יותר מ-200 מודלים עומדים מאחורי מפתח OrcaRouter אחד במחיר המחירון של הספק עם 0% תוספת — כולל minimax/minimax-h3, מודל הווידאו בעל המשקולות הפתוחות ש-MiniMax שחררה ב-31 ביולי 2026, במחיר של 0.08 דולר לשנייה של פלט 768P — כך ששינוי מחיר מצד ספק נוחת על החשבונית שלכם באותו היום, ומעבר אוטומטי בין ספקים במקרה של תקלה מונע מסבב הערכה לקרוס בגלל שעה רעה של ספק במעלה הזרם, וה-DSL של הניתוב מאפשר לכם להעמיד מודל וידאו מתארח ומודל ראייה מאחורי ממשק אחד כשהמשימה היא ליצור ואז לדרג. אתם עדיין משכפלים את המאגר ומריצים את ההתקנה בעצמכם. פשוט אין לכם צורך לבנות את החצי השני של המערכת.

איזה מהם אתה בעצם רוצה

אם אתם זקוקים לפלט שאתם יכולים להחזיק בבעלותכם — תנאים מסחריים שאתם יכולים לקרוא, משקלים שאתם יכולים לכוונן, פייפליין שרץ בלי שה-API של מישהו אחר יהיה זמין — Kandinsky 6.0 Video הוא התשובה, והתמיכה במסגרת מיום הראשון אומרת שאתם לא מהמרים על תוצר מחקרי. אם אתם זקוקים לקול בסרטון, זה היחיד מבין השניים שמייצר קול בכלל.

אם הבעיה היא חיזוי ולא ייצור — מדיניות שצריכה להגיב, סביבת אימון, כל דבר שבו המצב הבא תלוי בפעולה האחרונה — Odyssey-3 הוא היחיד מבין השניים שעושה זאת, והוא גם זה שאי אפשר לקנות. זו הצורה הכנה של ההתמודדות הזו בשבוע שבו שניהם הושקו: מודל פתוח שאפשר להוריד ומודל אינטראקטיבי שאפשר רק לנסות, כאשר הראיות מהבנצ'מרקים מעדיפות את הסגור והראיות המעשיות מעדיפות את הפתוח.