כרטיס הירו של מכ״ם המודלים של OrcaRouter שכותרתו 'MiMo-V2.6-Flash מול Qwen 3.8', עם כותרת משנה 'הורדה מול שירות מדוד בתשלום, ורק לצד אחד יש ציון מצד שלישי', עם פאנל שמאלי עבור MiMo-V2.6-Flash שמציג 309B סה״כ / 15B פעילים, רישיון MIT, ללא הגבלת גישה וללא ציון בלתי תלוי, פאנל ימני עבור Qwen3.8-Max שמציג 2.4T סה״כ / 95B פעילים, $2.00 קלט / $6.00 פלט ל-1M ו-AA Index 45, בסקאלה הנוכחית, ושלושה תגים מתחת שמציגים Flash: פורסם 21 בספטמבר 2026, Qwen: מדוד בתשלום מאז 3 באוגוסט 2026 ו-Routable: Qwen3.8-Max בלבד.
Guides & Insights

MiMo-V2.6-Flash מול Qwen3.8-Max: הורדה מול מד, ורק לאחד מהם יש ציון

מחבר

Gideon Frost

תאריך פרסום

חזרה לכל הפוסטים

מספר אחד קובע כיצד ההשוואה הזאת נכתבת בדרך כלל, והוא אינו מבחן ביצועים. Qwen3.8-Max הוא מודל מתארח שנמדד ברציפות על ידי Artificial Analysis, ולכן הוא נושא מדד Intelligence Index עדכני של 45 בסולם v4.3 המכויל מחדש, מהירות פלט של 39.2 טוקנים לשנייה, ומחיר מחירון של 2.00 דולר למיליון טוקני קלט ו-6.00 דולר למיליון טוקני פלט. MiMo-V2.6-Flash, שאותו Xiaomi פרסמה כמשקולות להורדה ב-21 בספטמבר 2026, אינו נושא אף אחד מהדברים האלה: אין כרטיס תעריפים של ספק, אין מזהה מודל ש-Xiaomi הכריזה עליו, ואין דף Artificial Analysis בכלל. כל מה שפורסם על היכולות של MiMo-V2.6-Flash מגיע מטבלאות ההערכה של Xiaomi עצמה בכרטיס המודל שלו. אף נתון אחד לא הורץ מחדש על ידי מישהו שאינו עובד ב-Xiaomi.

האסימטריה הזו אינה מהווה חיסרון למודל. זו עובדה לגבי סוג הרכישה שכל אחד מהם מהווה, והיא משנה את מה שאתה יכול למעשה להסיק מהשוואה ראש בראש. שאר המאמר הזה עוסק בשלושת הדברים שבאמת ניתן להשוות — צורת הטענה, עלות הטוקן, והרישיון — בתוספת מספר אחד שהוא אמיתי, נמדד באופן עצמאי, ואינו שייך לאף אחד משני המודלים שבכותרת.

קודם כל, איזה Qwen 3.8, ואיזה MiMo

שני השמות באותה כותרת הם משפחות שמתחזות לנקודות ביקורת, וההחלפות אינן בלתי מזיקות.

• Qwen3.8-Max — דגם הדגל המתארח של Alibaba, שנחשף ב־3 באוגוסט 2026. מודל תערובת־מומחים דליל (sparse mixture-of-experts) בעל 2.4 טריליון פרמטרים, עם כ־95 מיליארד פרמטרים פעילים לכל טוקן, חלון הקשר של מיליון טוקנים, וקלט טקסט, תמונה ווידאו. זהו המודל ששאר המאמר מתייחס אליו כיריב.

• Qwen3.8-Max (0902) — תמונת המצב המתוארכת ל-2 בספטמבר של אותו מודל, המוגשת כרשומה בפני עצמה עם אותם תמחורים של $2.00 ו-$6.00 ותקרת פלט של 131,072 טוקנים. העמוד הנוכחי של Artificial Analysis מתייחס לבנייה הזו, וזה משמעותי כשמצטטים ציון מדד.

• Qwen3.8-2.4T-A95B — צ'קפוינט במשקלים פתוחים של אותה ליבה, שניתן להורדה מאז 12 באוגוסט 2026 תחת רישיון Qwen3.8-Max. הוא מיועד לטקסט בלבד, החשיבה תמיד פעילה, וחלון ההקשר המקורי שלו הוא 262K ולא מיליון. הוא לא המודל שבכותרת.

MiMo-V2.6-Flash — צ'קפוינט תערובת-מומחים דליל של Xiaomi עם 309B בסך הכול ו-15B פעילים, ללא הגבלת גישה ב-Hugging Face תחת רישיון MIT, אומנימודאלי ילידי, עם טענה לחלון הקשר של 1M טוקנים. זהו החבר היעיל במהדורה בת שני צ'קפוינטים, שספינת הדגל שלה היא MiMo-V2.6-Pro עם 1.02T בסך הכול ו-42B פעילים.

• MiMo-V2-Flash — המודל מדצמבר 2025. אותו 309B בסך הכול, אותם 15B פעילים, אותו חלון הזזה של 128 טוקנים. הרצת אימון שונה, טבלת בנצ׳מרקים שונה, והקשר של 256K. כל עמוד שמדרג את "MiMo-V2-Flash" מול מודל Qwen משווה את הדור הלא נכון, ודף המפרט לבדו לא יספר לך זאת.

ההתנגשות ב-MiMo היא החדה מבין שתי המלכודות, משום שהמספרים שמזהים את המודל הם במקרה גם אותם מספרים הזהים בין נקודות הביקורת של 2025 ו-2026. ההתנגשות ב-Qwen מתונה יותר, אך כרוך בה מחיר: משקולות ה-2.4T הפתוחות וה-API המתארח הם ארטיפקטים שונים עם תנאים שונים, והשוואה שמחליפה ביניהם תטעה הן ביכולת והן ברישיון.

האינדקס נבנה מחדש, והמספר שרוב העמודים עדיין מדפיסים נעלם

הנה מצב הכשל שיש לשים לב אליו לפני שמופיע ציון כלשהו.

Artificial Analysis כייְללה מחדש את מדד ה-Intelligence Index שלה לגרסה v4.3 ב-7 בספטמבר 2026. ציונים מלפני תאריך זה אינם ברי-השוואה לציונים שאחריו, ובעמוד החי של Qwen3.8-Max מופיע תג מעודכן המסמן תוצאה שנוסחה מחדש. הנתון הנפוץ בתפוצות של 58 עבור Qwen3.8-Max שייך לסקאלה הישנה. Qwen3.8-Max הנוכחי (0902) מציג 45, ומדורג במקום ה-19 מבין 202 המודלים ש-Artificial Analysis משבצת במחלקה הזו.

זו לא קפדנות יתר. כאשר 58 מוצב לצד 46, זה נקרא כפער של שתים־עשרה נקודות. אותם שני דגמים באותו סולם עדכני מרוחקים נקודה אחת בלבד זה מזה — וה־46 אפילו אינו הדגם שהמאמר הזה עוסק בו:

• Qwen3.8-Max (0902), נמדד באופן עצמאי — Intelligence Index 45 ב-v4.3. מהירות פלט 39.2 טוקנים לשנייה, מדורגת במקום ה-151 מתוך 202, מה שהעמוד עצמו מציין כאיטי. עלות לכל משימת Intelligence Index: $5.41. טוקני פלט שנוצרו כדי להשלים את המדד: 190M.

• MiMo-V2.6-Pro, נמדד באופן עצמאי — Intelligence Index 46, דורג ראשון מבין 114 המודלים בקטגוריית המשקולות הפתוחות. מהירות פלט 134.3 טוקנים לשנייה. עלות למשימת Intelligence Index: $0.13. טוקני פלט להשלמת המדד: 140M.

• MiMo-V2.6-Flash, הנושא האמיתי — אין דף של Artificial Analysis. אין מה לצטט.

קראו את שלושתם יחד, והסיכום הכנה אינו נוח לשני הספקים. נקודת ההשוואה שכולם רוצים — Flash מול Qwen3.8-Max על סולם ניטרלי — אינה קיימת ואי אפשר לבנות אותה מטבלאות של ספקים, משום ששני הספקים הריצו מערכי בדיקה שונים על צ'קפוינטים שונים בזמנים שונים, ואז השוו את עצמם למודלים של חברות אחרות שאותם גם הם הריצו. מה שכן קיים הוא פער של נקודה אחת בין דגם הדגל Qwen לצ'קפוינט של Xiaomi הגדול יותר, בעלות קטנה פי 40 בערך לכל משימת אינדקס. זהו המספר האמיתי המעניין ביותר בהתמודדות הזו, והוא נוגע למודל שאיש משני צדי הכותרת אינו מזכיר בשמו.

Scoreboard card headed 'MiMo-V2.6-Flash vs Qwen3.8-Max', with paired rows for parameters (309B total / 15B active against 2.4T total / 95B active), licence (MIT, ungated, no revenue trigger, against a hosted API whose open 2.4T sibling uses the Qwen3.8-Max License), price per 1M (no vendor rate card against $2.00 in and $6.00 out with an 88% cache discount), independent score (None published, no Artificial Analysis page, against AA Index 45 on the v4.3 scale, 19th of 202 in class), DeepSWE v1.1 (67.9 on Xiaomi's own harness against Not published) and routability (No - nowhere, including OrcaRouter, against Yes - on OrcaRouter, base tier and the 0902 snapshot).

מה טבלאות הספקים יגידו לך ומה הן לא יגידו

שני הספקים מפרסמים מספרים. הם לא מאותו סוג של מספר, והצבתם טור אחר טור זה לצד זה מפיקה תרשים ולא ממצא — אבל צורת הטענות עדיין שווה קריאה, כי היא מספרת לך למה כל מעבדה עשתה אופטימיזציה.

• סוכן קוד — Xiaomi מדווחת כי MiMo-V2.6-Flash משיג ב-DeepSWE v1.1‏ 67.9, ב-Terminal Bench 2.1‏ 87.6, ב-ProgramBench‏ 26.0 וב-MiMo Code Bench‏ 61.2. Alibaba מדווחת כי Qwen3.8-Max משיג ב-SWE-bench Pro‏ 67.7 וב-Terminal-Bench 2.1‏ 86.6. נתוני Terminal-Bench קרובים דיים לכך שסביר שההרנס, ולא המודל, הוא זה שקובע את הסדר.

• סוכן כללי — Xiaomi מדווחת AutomationBench v1.0.6 52.3, Toolathlon-Verified 73.6, OSWorld-Verified 80.8 ו-Agents' Last Exam 27.6 עבור Flash. Alibaba מדווחת OSWorld-Verified 86.1, WideSearch 81.9 ו-Agent's Last Exam 52.4 עבור Qwen3.8-Max. בשני המבחנים ששתי המעבדות הריצו, הנתונים המדווחים של Qwen גבוהים יותר — על ההרנס של Alibaba עצמה.

• ידע ואבטחה — Xiaomi מריצה את CyberGym (Flash 95.1), MiMo Cyber Bench (77.2), ExploitGym (6.0), ExploitBench (25.3) ו-SEC Bench Pro (47.5). Alibaba מריצה את GPQA Diamond (92.6), Humanity's Last Exam (43.6) ו-PaperBench (93.0). כמעט אין חפיפה, ולכן כמעט אין מה להשוות.

הדבר האחד שבאמת שימושי שטבלה של ספק יכולה להראות הוא חוסר עקביות פנימי, ולטבלה של Xiaomi יש אחד כזה. לוח המחוונים הציבורי שלה ל-RL, ששידר את ריצת האימון עד ספטמבר, פרסם את MiMo-V2.6-Flash בציון 65.68 ב-DeepSWE v1.1 באמצעות הרנס mini-swe-agent בממוצע של שלוש. כרטיס המודל המוגמר מציג 67.9 עבור המשקולות ששוחררו. אלה מתארים תמונת מצב של אימון וארטיפקט ששוחרר בהתאמה, וההפרש של שתי נקודות זהה בגודלו לפער בין שתי נקודות הביקורת של Xiaomi. אם ציטטת את המספר מלוח המחוונים מאז השבוע שעבר, הוא מיושן.

החשבון, שהוא הנקודה שבה שני המודלים מפסיקים להיות ברי השוואה

זה הקטע שמכריע את הפריסות, וזה לא צמוד בכלל.

• Qwen3.8-Max מחויב לפי שימוש. 2.00 דולר למיליון טוקנים בקלט ו-6.00 דולר למיליון בפלט במחירון הבינלאומי של אליבאבא, עם הנחת מטמון ש-Artificial Analysis מודדים ב-88% ועלות של 5.41 דולר למשימת Intelligence Index. התיעוד של אליבאבא לאזור סין מפרט 12 יואן ו-36 יואן למיליון עבור אותו זוג. אפשר לבצע קריאה אליה כבר אחר הצהריים ולקבל חשבונית.

• MiMo-V2.6-Flash הוא הורדה. Xiaomi אינה מפרסמת תעריף לפי טוקן עבור דור MiMo-V2.6 באתר שלה, ולא הודיעה על מזהה ניתן לקריאה לאף אחד מהצ'קפוינטים, כך שאין מה למדוד. מה שכן יש זה 172.9 GB של נתוני משקל FP8 על פני 65 רסיסים, לפני KV cache עבור הקשר של 1M טוקנים, וקטע פריסה שממליץ על SGLang ב-tensor parallel 16 עם מקדם data-parallel של 2, או מתכון vLLM ב-tensor parallel 8 — משימת הגשה רב-צומתית.

• רשימות של צד שלישי אינן מחירון. דפי קטלוג אכן כוללים נתונים עבור סדרת MiMo-V2.6, ו-Artificial Analysis סופרת ספק API יחיד שמציע את MiMo-V2.6-Pro במחיר של $0.435 ו-$0.87 למיליון. זו רשומה של ספק עבור הצ'קפוינט הגדול יותר, ולא מחיר של Xiaomi, והיא כלל אינה קיימת עבור Flash.

אז החשבון הוא סעיף חיוב נמדד מול החלטת השקעה הונית. בכמה מאות מיליוני טוקנים בחודש, Qwen3.8-Max הוא חשבון שאפשר לחזות מראש, ו-Flash הוא צומת שהייתם קונים כדי לשרת מודל שאף אחד מחוץ ל-Xiaomi לא מדד. במיליארדי טוקנים בחודש המסלול הפתוח מתחיל לנצח מבחינת עלות, וזו הנקודה שבה הרישיון מפסיק להיות הערת שוליים משפטית והופך לנתון בתהליך הרכש.

הרישיונות אינם אותה הרשאה

רישיון MIT הוא בערך הרישיון המתירני ביותר שמשקלים פתוחים מגיעים אליו. רישיון Qwen3.8-Max אינו MIT, ולפער הזה יש שיניים.

MiMo-V2.6-Flash מופץ תחת רישיון MIT ללא סף הכנסות, ללא תנאי של מספר משתמשים, ללא הסכם מסחרי נפרד וללא סעיף מחקר. פריסה מסחרית, שינוי, הפצה מחדש ואימון נוסף מותרים כולם, והמאגר פתוח ללא הגבלת גישה.

רישיון Qwen3.8-Max מעניק שימוש, שינוי, הפצה, רישוי משנה, מכירה, פריסה, אירוח וכיוונון עדין, בשני תנאים. מוצר או שירות החורגים מ-100 מיליון משתמשים פעילים בחודש או בעלי הכנסות חודשיות של 20 מיליון דולר חייבים להציג את שם המודל באופן בולט בממשק שלהם. ועסק של Model-as-a-Service או עוזר עבודה מבוסס בינה מלאכותית, שהכנסותיו המצטברות עולות על 50 מיליון דולר לאורך כל שנים-עשר חודשים רצופים, זקוק לרישיון נפרד מ-Alibaba לפני שימוש מסחרי. שימוש פנימי מוחרג, בתנאי שהמודל או יכולותיו אינם נחשפים לצדדים שלישיים.

עבור רוב הצוותים אף אחד מהתנאים אינו מחייב. עבור עסק פלטפורמה שמצליח, אחד מהם כן מחייב — והוא מחייב בדיוק ברגע שבו המודל הפך לנושא עומס. שים לב גם שתנאים אלה חלים על המשקולות הניתנות להורדה בגודל 2.4T, ולא על ה-API המתארח, שבו חלים במקום זאת תנאי הספק. לשני המסלולים יש התחייבויות שונות, וזו סיבה נוספת שלא להשוות את הצ'קפוינט הפתוח לזה המתארח כאילו היו אותו מוצר.

היכן OrcaRouter מתאים, והיכן לא

Qwen3.8-Max ניתן לניתוב ב-OrcaRouter, הן ברשומת הבסיס והן בתמונת המצב המתוארכת 0902, דרך מפתח API אחד במחיר המחירון של הספק, עם תוספת של 0% המועברת הלאה. זה חשוב כאן ספציפית משתי סיבות. ראשית, גרסת 0902 היא רשומה נפרדת ולא החלפה שקטה, ולכן ה-DSL של הניתוב יכול להצמיד תעבורה הרגישה לשחזוריות לתמונת המצב המתוארכת בעוד כל השאר הולך לפי שכבת הבסיס — בלי אינטגרציה שנייה, בלי שינוי בקוד. שנית, כיוון שמחיר המחירון מועבר הלאה ולא מתווספת עליו תוספת, שינוי בלוח המחירים של Alibaba נוחת אצלך באותו יום במקום בחידוש החוזה הבא, וזה מה ששומר על החישוב שלעיל של מדוד לפי שימוש מול צומת כאמין כשהמחירים משתנים. עומסי עבודה עתירי מטמון שומרים גם על הנחת המטמון של הספק, במקום לאבד חלק ממנה לשולי הרווח של המשווק מחדש.

Screenshot of the OrcaRouter model page for Qwen3.8 Max, marked FEATURED, giving the model id qwen/qwen3.8-max, a 1M-token context, text, image and video input with text output, an input price of $2.00 and output price of $6.00 per 1M tokens, a p50 time to first token of 3.33 seconds, and seven-day traffic of 30.8M tokens.

MiMo-V2.6-Flash אינו ניתן לניתוב בשום מקום, כולל אצלנו. אנחנו לא מנתבים שום מודל של Xiaomi, ושורת הזמינות בכרטיס של Xiaomi עצמה מפנה לערוצים של Xiaomi עצמה: פלטפורמת MiMo API, ‏AI Studio, ‏MiMo Code ואפליקציית השולחן. אם אתה רוצה את ה-checkpoint הזה, אתה מוריד 172.9 GB ומוצא צומת.

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 on the updated v4.3 scale ranked 19th of 202, output speed of 39.2 tokens per second ranked 151st of 202, a price of $2.00 per million input tokens and $6.00 per million output with an 88% cache discount and a $5.41 cost per Intelligence Index task, 190M output tokens generated on the index, and a 984k-token context window.

איזה מהם, ומתי

בחר ב-Qwen3.8-Max אם אתה רוצה יכולת בלי חומרה, אם היקף השימוש שלך אינו ודאי, או אם אתה רוצה אפשרות למספר עצמאי לפני שאתה מתחייב. קבל את העובדה ש-45 במדד הנוכחי הוא עמדת אמצע-חזית ולא עמדת צמרת, ש-39.2 אסימונים לשנייה איטיים מספיק כדי להשפיע בתוך לולאת סוכן, וש-190M אסימוני פלט כדי לסיים את ה-Intelligence Index מהווים בערך פי שניים מהחציון — מילוליות עולה כסף בצד המתומחר לפי פלט של המונה.

קחו את MiMo-V2.6-Flash אם האילוץ הוא הרישיון, נתיב הנתונים, או חשבון ארוך-טווח שאפשר לפרוס — ואם יש לכם את הצומת. תנאי MIT בלי שער הכנסות הם באמת הרשאה שונה מרישיון עם סף MAU וטריגר של חלוקת הכנסות, ועבור חברה שמצפה להיות גדולה, זו הסיבה לבחור בו. תקצבו שירות רב-צמתי, קבעו את הגודל לפי נתוני המשקלים שפורסמו ולא לפי עמוד המאגר, והתייחסו לכל מספר בכרטיס של Xiaomi כדיווח ספק עד שמישהו מחוץ למעבדה יריץ אותו מחדש.

ואם אתם בוחרים היום ולא ברבעון הבא, הפעילו תחילה את אפשרות המדידה. חודש של Qwen3.8-Max יגיד לכם מה עומס העבודה שלכם באמת צריך. צומת יגיד לכם רק את מה שקיוויתם שהוא יגיד.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית