
Vidu Q4 Preview לעומת MiniMax H3: בראש הלוח יש תיקו, ורק אחד מהם נמצא בשלושה לוחות
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
לוח ה-image-to-video ב-Artificial Analysis, בקריאה מתאריך 8 באוקטובר 2026, מציב את MiniMax H3 Max במקום הראשון עם 1,195 Elo, MiniMax H3 במקום השני עם 1,181, ואת Vidu Q4 Preview במקום השלישי עם 1,179. שש עשרה נקודות מפרידות בין המקום הראשון לשלישי, במרווחים של בערך ±10 ו-±11, על פני 5,894, 7,284 ו-5,543 הצבעות בהתאמה. זהו שוויון סטטיסטי בתחפושת של פודיום, וכל עמוד שנפתח בהכרזה על מנצח בלוח הזה קורא רעש.
אז השאלה המעניינת היא לא איזה משני המודלים האלה טוב יותר. אלא מה קורה להשוואה ברגע שאתם יורדים מהלוח האחד שבו שניהם מופיעים — כי MiniMax H3 שוחרר ב-31 ביולי 2026 כמודל אומני-מודאלי שקורא הפניות טקסט, תמונה, וידאו ואודיו כהקשר יחיד, ו-Vidu Q4 Preview הגיע ב-7 באוקטובר 2026 עם שני מצבי קלט ושתי נקודות קצה של API. אחד מהם נמדד בשלושה מקומות. האחר נמדד במקום אחד.
מה תיקו משולש כן אומר ומה הוא לא אומר
שתי הרשומות של MiniMax והבנייה של Vidu נמצאות זו בתוך המרווחים של זו, כך שהאמירה הכנה היא ששלושת מודלי התמונה-לווידאו המובילים אינם ניתנים להבחנה לפי העדפת בני אדם בגודלי המדגם הנוכחיים. שני פרטים הופכים את התיקו הזה לפחות מחמיא לכולם ממה שזה נשמע.
הראשון הוא גיל. ההצבעות של MiniMax H3 הן מיולי ושל H3 Max מאוגוסט; אלו של Vidu Q4 Preview מאוקטובר. מאגרי הצבעות גדולים וותיקים יותר נמדדים מול תחרות שונה ומול קבוצה שונה של מתחרים, וזה פועל לשני הכיוונים: מדידה טובה יותר, וגם שאלה מעט שונה. פער של 16 נקודות לכאן או לכאן אינו ראיה.
השנייה היא עמודת המחיר. Artificial Analysis רושם את MiniMax H3 ב-$7.80 לדקה ואת H3 Max ב-$4.80 לדקה בלוח הזה. Vidu Q4 Preview נרשם ב-$7.20. אם קוראים אותם כדירוג, H3 Max נראה כמו בחירת הערך מבין השלושה — אבל תעריפי הספק שמאחוריהם מסבירים את התווית במקום לסתור אותה. אנחנו מפרטים את MiniMax-H3 ב-$0.08 לשנייה ב-768P וב-$0.13 לשנייה ב-2K בכרטיס המודל שלנו, שהם $4.80 ו-$7.80 לדקה. שני הנתונים של MiniMax בלוח הם אותו מודל במחיר בשתי רמות רזולוציה, לא רמת פרימיום ורמה זולה. עמודות לדקה בלוח העדפות מועילות לסדרי גודל ומסוכנות לכל דבר עדין יותר.
היכן ש-MiniMax H3 מופיע ו-Vidu Q4 Preview לא מופיע
זהו החלק בהתמודדות ששורד את התיקו, וזהו הבדל מבני ולא הבדל באיכות.
MiniMax H3 (768p) נמצא במקום הרביעי בלוח הטקסט לווידאו עם 1,137 Elo לאחר 8,315 הצבעות, כאשר H3 Max במקום החמישי עם 1,130 לאחר 5,719. הוא שוב במקום הרביעי בלוח עריכת הווידאו עם 1,119 לאחר 7,023 הצבעות, בלוח המדרג מודלים על עריכת וידאו מהוראת טקסט תוך שמירה על האודיו. Vidu Q4 Preview אינו מופיע באף אחד מהשניים.
היעדרות זו אינה פער מדידה — היא מהות המוצר. ה-API של Vidu Q4 Preview מתעד שתי נקודות קצה, /ent/v2/img2video ו-/ent/v2/reference2video, ועמוד המוצר מפרט שני מצבים: Image-to-Video ו-Reference-to-Video. אין נתיב text-to-video בתיעוד. אין גם נתיב לעריכת וידאו, כלומר המודל אינו יכול לקחת קליפ קיים ולשנות בו משהו. MiniMax H3 עושה את שניהם, והמסגור הרב-מודאלי שלו — הפניות טקסט, תמונה, וידאו ואודיו בהקשר אחד — הוא הסיבה לכך שהוא מסוגל לכך.
כדאי לדייק בכל הנוגע לצד האודיו, כי שני המודלים מייצרים אודיו נייטיבי, ושתי הדברים אינם אותו דבר. Vidu Q4 Preview מייצר אודיו וווידאו יחד, עם פרמטר אודיו בנקודת הקצה של תמונה לווידאו, שמוציא וידאו עם דיאלוג ואפקטי קול, והוא מקבל עד שלושה קטעי אודיו ייחוס כדי לשמור על עקביות הקול של הדמות. MiniMax H3 מוציא אודיו סטריאו נייטיבי ומקבל אודיו כמודאליות קלט לצד תמונות וווידאו. תרחיש השימוש של קול ייחוס הוא החוזק הספציפי של Vidu; תרחיש השימוש של "הכול כייחוס" הוא של MiniMax.
האריתמטיקה לפי שנייה, שכבה אחר שכבה
שני המודלים מחייבים לפי שנייה של פלט מיוצר, מה שהופך זאת להשוואה הנדירה שבה אפשר להעמיד את כרטיסי התעריפים זה מול זה בלי המרה.
• 540p — Vidu Q4 Preview בלבד: 9 קרדיטים לשנייה, כ-0.045 $ לפי תעריף הקרדיט הסטנדרטי המפורסם של הפלטפורמה, 0.005 $
• 720P / 768P — Vidu Q4 Preview 19 קרדיטים לשנייה, בערך $0.095 לעומת MiniMax-H3 $0.08 לשנייה
• 1080p — Vidu Q4 Preview 24 קרדיטים לשנייה, כ-$0.12 לעומת MiniMax-H3 שאין לו דרגת 1080p מפורסמת
• 2K — Vidu Q4 Preview 38 קרדיטים לשנייה, בערך $0.19 לעומת MiniMax-H3 $0.13 לשנייה
• 4K — Vidu Q4 Preview בלבד: 78 קרדיטים לשנייה, בערך $0.39
התבנית שעולה מכך אינה "אחד מהם זול יותר". רצפת התמחור של Vidu Q4 Preview נמוכה באמת — שכבת ה-540p שלה היא שכבת בלוקינג שמתומחרת בדיוק למטרה שלשמה היא משמשת, להוכיח קומפוזיציה לפני שמשלמים על רינדור ברזולוציה מלאה, ושום דבר במחירון של MiniMax לא ממלא את התפקיד הזה. MiniMax H3 זול יותר ב-2K, השכבה העליונה ששני המודלים חולקים, בכשליש בערך. ושכבת ה-4K של Vidu היא שכבת היצירה היחידה ב-4K בהשוואה, במחיר שמשקף זאת.
נתון ההשקה של $0.014 לשנייה שליווה את ההכרזה של Vidu הוא דרגת 540p בתעריף קרדיטים מוזל, ולא תעריף כללי. הפלטפורמה של Shengshu מציעה כעת הנחות חבילה לזמן מוגבל של עד 30% על חבילות קרדיטים, אשר מורידות כל דרגה יחד כלפי מטה במקום לשנות את צורת העקומה. התייחסו לעקומת תעריף המחירון כאל נקודת ההשוואה, ולהנחה כאל קיזוז זמני.
מצדנו: אנחנו מנתבים את MiniMax-H3. הוא פעיל ב-API הציבורי של המודלים בכתובת minimax/minimax-h3, מחויב לפי שנייה של פלט מיוצר לפי תעריף המחירון של הספק, מועבר הלאה ללא כל תוספת, וניתן לקרוא לו באותו endpoint תואם OpenAI כמו כל מודל טקסט שאנחנו מספקים. Vidu Q4 Preview אינו נתיב ב-OrcaRouter, והעמוד הזה לא טוען אחרת — מודלי הווידאו שאנחנו כן מספקים יושבים על מפתח אחד וצורת בקשה אחת לצד מודלי השפה, וזה הסידור שהופך השוואה בין כמה מהם לזולה. תוצאה מעשית אחת של תמחור עובר-דרך: כשספק משנה תעריף לפי שנייה, השינוי נראה בנתיב באותו יום ולא בחידוש החוזה.
מה "אומני-מודאלי" נותן בבקשה אמיתית
ההקשר המאוחד של MiniMax H3 קל לקרוא כרשימת תכונות ולתפוס בטעות כלא-הבדל הנדסי. מודל שמקבל וידאו כהפנית קלט יכול להיות מכוון לשוט קיים ולהתבקש להמשיך, להאריך או לשנות את הסגנון שלו; מודל בלי קלט וידאו לא יכול. זהו המנגנון שמאחורי נוכחותו של H3 בלוח העריכה, וזו גם הסיבה לכך שטווח הפלט של 4–15 שניות של המודל הוא פחות מגבלה ממה שהמספר מרמז — הארכה רב-סבבית היא הדרך הרגילה לבנות ממנו רצף ארוך יותר.
גם התקרה של 16 שניות ב-Vidu Q4 Preview היא לכל יצירה, ומצב Reference-to-Video שלו בנוי לסיפור רב-שוטים בתוך החלון הזה, כשהתיעוד מתאר מעברי מצלמה חכמים ועקביות בין עמדות מצלמה מרובות. מה שאין לו הוא דרך לקבל קליפ שכבר צילמת ולשנות אותו. אם זרימת העבודה שלך מתחילה מצילום ולא מתמונה סטטית או מסט ייחוס, אחד משני המודלים האלה פשוט לא זמין לך, ושום מספר Elo לא סוגר את זה.
איזה אחד, לפי עבודה
השתמשו ב-MiniMax H3 כאשר הקלט הוא כל דבר מלבד תמונה או סט ייחוס. טקסט לווידאו, עריכת וידאו לווידאו, קלט אודיו, הארכה רב-סיבובית מעבר לחמש עשרה שניות, או צינור עיבוד שבו המודל צריך להחזיק היקף של מקרי שימוש של שלושה לוחות שונים — זה השטח של H3, והוא היחיד מבין השניים שיש בו משהו מזה. תעריף ה-2K שלו הוא גם הזול מבין השניים ברמה העליונה המשותפת להם.
קחו את Vidu Q4 Preview כשהמשימה היא עקביות של קאסט וקול, או כשאתם זקוקים לרמת יצירה של 4K, או כשאתם רוצים מעבר בלוקינג זול ב-540p כדי לבצע איטרציות על שוט לפני שמתחייבים. חמש־עשרה הפניות לתמונות ושלוש הפניות לאודיו הן תקציב הפניות מפורסם גדול יותר ממה ש-MiniMax מתעדת, ואף מודל אחר בהשוואה הזו לא מייצר באופן נייטיבי ב-4K. מערך המצבים המצומצם יותר הוא המחיר שמשלמים על כך.
מה היה משנה את זה: שחרור מלא של Vidu Q4 שמוסיף נקודת קצה לטקסט-לווידאו היה מעמיד את שני המודלים על אותם לוחות והיה הופך את זה לתחרות ישירה. AA-Video-I2V v2.0, שהוכרז כמי שיגיע עם 1080p בכל התחומים וטקסונומיית יכולות מתוקנת, היה מחליף את ההצבעות בראש הלוח במקום למיין אותן מחדש — והיה מכריע אם התיקו המשולש הנוכחי הוא תיקו או מגבלת מדידה. עד אז, המספר שיש לשמור הוא שישה עשר, עם שם הלוח והתאריך לצידו.
הדבר האחד ששווה לקחת מהפודיום עצמו: מקום ראשון שנמצא שש-עשרה נקודות Elo מעל המקום השלישי, במרווחים כה רחבים, אינו דירוג. אלה שלושה מודלים שמצביעים אנושיים אינם יכולים להבדיל ביניהם, וההכרעה ביניהם חייבת להגיע מכל שאר הדברים בעמוד הזה.



