
HiDream-O1-Video-1.0 עולה לראשונה במקום השישי ב-Artificial Analysis — וה-API הציבורי שלו קטן בהרבה מההשקה שלו
- OrcaחדשOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 לכל 1M טוקנים · 73 tok/s
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 115 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 359 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
HiDream-O1-Video-1.0 נמצא במקום השישי בטבלת המובילים Image-to-Video של Artificial Analysis, עם Elo של 1,175 מתוך 3,231 הצבעות, במחיר של 5.80 דולר לדקה של וידאו שנוצר. זהו המיקום שהיצרנית שלו הכריזה עליו — אלא שהודעת ההשקה של HiDream.ai, מתאריך 17 בספטמבר 2026, אמרה מקום רביעי. שני המספרים נכונים והם מתארים דברים שונים: ההודעה מצטטת את הדירוג שהמודל החזיק ביום שבו הוכרז, והלוח זז מאז. בקריאה ב-10 באוקטובר 2026 עם מסנן האודיו מופעל, HiDream V1 נמצא אחרי MiniMax H3 Max, MiniMax H3, Vidu Q4 Preview, Omni Flash ו-Dreamina Seedance 2.0 720p, בסדר הזה.
הסיפור המעניין יותר אינו הדירוג. הוא ש-HiDream-O1-Video-1.0 הוכרז כמודל שלוקח טקסט, תמונות וווידאו ומחזיר קטעי וידאו באורך חמש עד עשרים שניות וב-1080p עם אודיו מסונכרן באופן מובנה — ומה שאפשר למעשה לקרוא לו היום לוקח בדיוק תמונת ייחוס אחת ופרומפט טקסטואלי אופציונלי, ולא דבר אחר. שתי האמירות האלה מתועדות. הפער ביניהן הוא הדבר שכדאי לדעת לפני שבונים על המודל הזה.
הלוח, כשהוא נקרא כראוי
Artificial Analysis מריצה את לוחות הדירוג שלה לווידאו בדרגים, שלכל אחד מהם סולם Elo משלו ומאגר הצבעות משלו, כך שציון אינו עובר ביניהם. ב-AA-Video-I2V v1.0 כשהאודיו נכלל, ששת המובילים מופרדים בעשרים נקודות Elo, ורווחי הסמך הם ברוחב של בין שבע לעשר נקודות. אותם ששת המובילים, נכון ל-10 באוקטובר 2026:
• MiniMax H3 Max — 1,195 ±9 מתוך 5,894 דגימות, אוגוסט 2026, $4.80 לדקה
• MiniMax H3 — 1,181 ±8 על פני 7,284 דגימות, יולי 2026, $7.80 לדקה
• Vidu Q4 Preview — 1,179 ±10 מתוך 5,543 דגימות, אוקטובר 2026, $5.04 לדקה
• Gemini Omni Flash — 1,178 ±7 מתוך 12,327 דגימות, מאי 2026, $6.00/דקה
• Dreamina Seedance 2.0 720p — 1,176 ±7 על פני 15,721 דגימות, מרץ 2026, $9.07 לדקה
• HiDream-O1-Video-1.0 — 1,175 ±10 מתוך 3,231 דגימות, אוגוסט 2026, 5.80$ לדקה
קראו את המרווחים האלה כקבוצה, והסיכום הכנה הוא שהמקומות הראשון עד השישי הם, מבחינה סטטיסטית, תחרות אחת עם זנב ארוך מאוד של תיקו. הפער שלא נמצא בתוך הרעש הוא זה שבין HiDream V1 לשאר המשתתפים: המקום השביעי, Wan 3.0 של עליבאבא, נמצא ב-1,164 — אחד עשר נקודות ומרווח שלם מתחת למקום השישי, וכמעט שלוש מאות קולות לפניו. מספר הדגימות של HiDream עצמו הוא הקטן ביותר בשישייה המובילה, מה שאומר שהמרווח שלו הוא מהרחבים ביותר ומיקומו הוא הפחות מבוסס.

שני דברים ש-Artificial Analysis מציינת לגבי הלוח עצמו ראויים לשאת הלאה. היא מתעדת מודל אחד שנוסף ב-30 הימים האחרונים, והיא אומרת ש-AA-Video-I2V v2.0 עומד להגיע, בהתאמה לטקסונומיה של AA-Video-T2V v2.0, עם 1080p לאורך כל הדרך. זה חשוב למודל שטענות ההשקה שלו עוסקות ב-1080p ובהתניית טקסט ווידאו: הלוח שהוא מושק עליו לראשונה הוא במפורש לוח מעבר, והמחליף משנה את מה שנמדד.
היכן שהמודל אינו
HiDream-O1-Video-1.0 מופיע בלוח וידאו אחד בדיוק של Artificial Analysis. הוא נעדר מ-AA-Video-T2V v2.0, מלוח הטקסט-ללווידאו, ומלוח עריכת הווידאו. בדקתי את שניהם ב-10 באוקטובר 2026 — Wan 3.0 מוביל בטקסט-ללווידאו עם 1,156 ובעריכת וידאו עם 1,157, FLUX 3 נמצא במקום השישי בטקסט-ללווידאו עם 1,128, ו-HiDream לא מופיע באף אחד משני הדירוגים.
היעדרות זו היא סימן ולא פסילה. מודל שצורך רק תמונת ייחוס אינו יכול להיכלל בהצבעת טקסט-לווידאו, ומודל שרק מבצע הנפשה אינו יכול להיכלל בהשוואת עריכה. המשמעות המעשית היא שאין מדידה עצמאית של HiDream V1 בביצוע טקסט-לווידאו או עריכת וידאו, שהם בדיוק שניים משלושת מצבי הקלט שאותם מפרסמת מהדורת ההשקה שלו.
שני תאריכים, ותשעים הימים שביניהם
יש סיבוך קטן בתיארוך שכל מי שמצטט את המספרים האלה צריך לטפל בו בזהירות. Artificial Analysis רושמת את תאריך ההשקה של HiDream-O1-Video-1.0 כ-28 באוגוסט 2026 ואת התאריך שבו הוצג ללוח כ-10 בספטמבר 2026. הודעת ההשקה של HiDream עצמה מתוארכת ל-17 בספטמבר. הפניות למודלים של צד שלישי שהופיעו מאז מתארות אותו כמי שפורסם ב-15 בספטמבר וכמי שאומת ב-17 בספטמבר.
מה שהתבנית הזו מתארת הוא מודל שהגיע לצינור ההערכה לפני שהגיע להודעה לעיתונות — דבר נורמלי למדי, והוא אומר שתאריך היציאה בלוח הוא המוקדם מבין השניים, לא שגיאה. היא אינה מתארת מודל ממרץ שמכריזים עליו מחדש באוגוסט, וזהו אופן הכשל שהבלוג הזה נכווה ממנו בעבר. HiDream-O1-Video-1.0 הוא אכן חדש: תשתית לוח הדירוג עצמה מתארכת את הגעתו בתוך החודשיים האחרונים.
מה שההשקה טוענת, ומי אומר זאת
סיפור הארכיטקטורה מגיע מ-HiDream ולא שוחזר באופן בלתי תלוי. לפי הספק: HiDream-O1-Video-1.0 — HiDream V1, או HD-V1 — מדמה במשותף טקסט, וידאו ואודיו בתוך תהליך יצירה אחד, במקום ליצור תמונה ולהוסיף קול לאחר מכן, כך שתנועת שפתיים, צליל סביבה ופעולה פיזית חולקים ציר זמן. משך הזמן מתוכנן ולא קבוע, כאשר המודל בוחר אורך שבין חמש לעשרים שניות בהתאם לאירוע המתואר. התנהגות פיזית — כבידה, התנגשות, אינרציה, דפורמציה, דעיכת אור — נלמדת כאילוץ יצירה. האימון שלאחר מכן משתמש בלמידת חיזוק דיפוזיבית כנגד מודל תגמול רב-מודאלי המיושר לתפיסה האנושית. היצירה מתנהלת בשלושה שלבים שהחברה מתארת כ: תכנון ראשון, יצירה משותפת שנייה, יישור שלישי.
HiDream ממקמת את המודל בתוך תיק של ארבע משפחות המבוסס על תשתית משותפת של שנאי מאוחד — HiDream-O1-Image, HiDream-O1-Video, HiDream-O1-World ו-HiDream-O1-Embodied — ומציינת מיקומים קודמים בבנצ'מרקים עבור האחים למשפחה, ובהם HiDream-O1-Image 1.5 במקום השני בעולם בלוח הטקסט-לתמונה של Artificial Analysis ו-HiDream-O1-World במקום הראשון ב-WBench. אלו הם הנתונים של הספק עבור מודלים אחרים במשפחה, הנמסרים כאן ללא אימות עצמאי. החומר התאגידי של החברה מתאר גם מחסנית טכנולוגית של מודל בסיס בעל "יותר מ-200 מיליארד" פרמטרים; זוהי הצהרה ברמת הפלטפורמה, ולא מפרט של HiDream-O1-Video-1.0, ואף מקור אינו מפרסם מספר פרמטרים עבור הצ'קפוינט הזה. לא שוחררו עבורו משקלים פתוחים.

מה אתה יכול בעצם לקרוא
כאן התיעוד ברור באופן יוצא דופן, והוא מצומצם יותר מההכרזה. HiDream מספקת את המודל דרך HiHarness, פלטפורמת ה-MaaS שלה. נקודת הקצה של הווידאו היא POST אל /api/maas/gw/v1/videos/generations עם מזהה המודל HiDream-O1-Video-1.0. הקלט הנדרש הוא בדיוק תמונת ייחוס אחת — כתובת URL ציבורית, או Base64 ללא הקידומת data-URL, בין 40 KB ל-20 MB. הפרומפט הטקסטואלי הוא אופציונלי וברירת המחדל שלו היא ריק. היצירה היא אסינכרונית: אתם שולחים, מקבלים task_id, ומבצעים polling אל /api/maas/gw/v1/videos/generations/results עד ש-result.status מציג 1.
שלוש השמטות בסכמה ההיא ראויות לציון מפורש, משום שכל אחת מהן היא יכולת שמהדורת ההשקה מפרסמת.
• סרטון ייחוס — ההכרזה מפרטת וידאו בין הקלטים של המודל; בבקשה המתועדת אין שדה עבורו.
• רזולוציה מפורשת — ההכרזה טוענת ל-1080p; בבקשה המתועדת אין בורר רזולוציה, והתוצאה משמרת במקום זאת את יחס הגובה-רוחב של תמונת הייחוס.
• שליטה באודיו — ההכרזה טוענת לאודיו מסונכרן מובנה; הבקשה המתועדת אינה חושפת קלט אודיו או פרמטר ליצירת אודיו.
מה שהסכימה כן חושפת הוא force_10s, ערך בוליאני שברירת המחדל שלו היא false. אם משאירים אותו false, המודל בוחר את משך הזמן. אם מגדירים true, מקבלים עשר שניות. אין שדה משך מספרי, ולכן הטווח המפורסם של חמש עד עשרים שניות הוא טענה ברמת המודל שמשטח הבקשות הציבורי לא מאפשר לך לכוון אלא על ידי בחירה באחד משני מצבים.

יש פרט מימוש אחד בחוזה התגובה הזה שיפגע באינטגרציה שנכתבה באמצעות התאמת תבניות ל-API-ים אחרים של וידאו. result.status = 1 פירושו שכל תת-משימה הגיעה למצב סופי — לא שההפקה הצליחה. עדיין צריך לקרוא את sub_task_results[].task_status, כאשר 1 הוא הצלחה, 3 הוא כשל בהפקה ו-4 הוא כשל בבדיקת בטיחות. לקוח שמתייחס למצב סופי כהצלחה ימסור לך כתובת URL של וידאו שלא קיימת.
המחיר, בהקשר
לפי הרישומים של Artificial Analysis, במחיר של $5.80 לדקה, HiDream V1 מתומחר במחיר בינוני לקטגוריה שלו ולא בזול. בתוך ששת הראשונים בלוח הוא זול יותר מ-MiniMax H3 ($7.80) ו-Dreamina Seedance 2.0 ($9.07) ויקר יותר מ-MiniMax H3 Max ו-Vidu Q4 Preview. לעומת המודלים שאיתם הוא יושווה לרוב, הפער רחב יותר: Google Veo 3.1 עומד על $24.00 לדקה, Kling 3.0 1080p Pro על $20.16, Alibaba Wan 2.7 על $9.00 ו-Wan 3.0 על $12.00, בעוד Grok Imagine Video 1.5 עומד על $8.40.
תעריפי הדקה האלה אינם ניתנים להשוואה ישירה, מפני שדקה של פלט באיזו רזולוציה ועם איזה אודיו היא בדיוק הדבר שתיעוד ה-API מותיר בלתי מוגדר עבור המודל הזה. התייחסו למספר כאל נקודת התחלה לחישוב שלכם ולא כמחירון.
לנסות מסלול לא מוכח בלי להמר עליו צינור
הטיעון לזהירות כאן אינו שהמודל גרוע. הטיעון הוא שמשטח הגשה מתקופת התצוגה המקדימה — סוג קלט אחד, מתג משך זמן אחד, דגל מסוף דו-מצבי — הוא המקום הלא נכון לקודד בו באופן קשיח נתיב ייצור. HiDream-O1-Video-1.0 אינו מודל שאנחנו מגישים ב-OrcaRouter היום, כך ששום דבר להלן אינו טענה לגבי אירוח שלו: המקום שבו המוצר שלנו באמת עוזר הוא בצד השני של ההחלטה, שבו אתם רוצים לבדוק נתיב וידאו חדש מול נתיב קיים ולהיות מסוגלים לנטוש אותו בכל נקודה. נקודת קצה אחת תואמת OpenAI מעל 200 מודלים, מעבר אוטומטי לכשל כך שנתיב שמתחיל להיכשל בשקט אינו הנתיב שאתם משיקים, מחירי מחירון של ספקים שמועברים הלאה בלי תוספת רווח, ו-DSL לניתוב שמאפשר לכם להשוות שני מודלים בתוך בקשה אחת במקום שתי אינטגרציות. שום דבר מזה לא דורש ספציפית את המודל של HiDream.
מה היה משנה את הקטע הזה
שלוש התפתחויות היו מזיזות את התמונה, לפי סדר יורד של סבירות.
ראשית, חוזה הגשה רחב יותר. אם ב-HiHarness יתווספו שדה וידאו-ייחוס, בורר רזולוציה או בקרות אודיו מתועדות, הפער בין ההכרזה ל-API ייסגר, והטענות בדבר 1080p וטקסט-לווידאו יהפכו לניתנות לבדיקה. זהו שינוי בתיעוד, לא שינוי במודל, והוא עשוי לנחות בכל שבוע.
שנית, הלוח AA-Video-I2V v2.0. Artificial Analysis אמרה שהוא בדרך, בהתאמה לטקסונומיה של T2V v2.0 עם 1080p לאורכו. לוח של 1080p בלבד יהיה הסביבה העצמאית הראשונה שבה טענת הרזולוציה של HiDream V1 מקבלת משמעות — ואם עדיין לא ניתן להזין את המודל בלוח הטקסט-לווידאו תחת הטקסונומיה החדשה, היעדרו שם הופך לממצא מהותי ולא לארטיפקט של הקטגוריות הישנות.
שלישית, גודל המדגם. 3,231 קולות הם מדידה אמיתית וצעירה, הצרה ביותר מבין ששת המובילים. המרווח הוא ±10 כעת, והוא יצטמצם בכל כיוון שאליו ידחפו אותו המצביעים. כל מי שמצטט "שישי" כעובדה מוגמרת צריך לציין את התאריך שבו קרא זאת, מפני ששישי הוא תיקו אחד בתוך תיקו בין שישה.
השאלה שראויה להישמר אינה אם HiDream-O1-Video-1.0 תחרותי — בלוח האחד שבו אפשר למדוד אותו, הוא בבירור תחרותי, ובמחיר לדקה שאפשר להצדיק. היא אם המודל שלבסוף יגיע ל-API רחב הוא זה שהוכרז. לפי התיעוד הנוכחי, אלה עדיין שני מוצרים שונים.
HiDream-O1-Video-1.0 אינו אחד מהנתיבים שאנו מספקים היום, אבל אותו סוג של ממשק עומד מאחורי למעלה מ-200 מודלים עם מחירי המחירון של הספקים כפי שהם, וללא תוספת.
