כרטיס Hero שכותרתו 'MiMo-V2.6-Pro לעומת MiMo-V2.6-Flash' עם כותרת המשנה 'פער מחירים של פי 3, ומה לא מסביר אותו', ושני פאנלים: פאנל שמאלי שכותרתו 'MiMo-V2.6-Pro' עם הכיתוב '$0.435 / $0.87 ל-1M' ו-'42B פרמטרים פעילים', ופאנל ימני שכותרתו 'MiMo-V2.6-Flash' עם הכיתוב '$0.14 / $0.28 ל-1M' ו-'15B פרמטרים פעילים', מעל כותרת תחתונה עם הכיתוב 'שניהם ברישיון MIT · שניהם עם הקשר של 1M · האינדקס פורסם עבור Pro בלבד'.
Guides & Insights

MiMo-V2.6-Pro מול MiMo-V2.6-Flash: פער מחירים פי 3 ששני מבחני ביצועים לא מסבירים

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

בטבלאות ההערכה של Xiaomi עצמה, MiMo-V2.6-Flash מנצח את MiMo-V2.6-Pro. השורה היא CyberGym, והפער הוא 95.1 מול 94.0. זו שורה אחת מתוך חמש עשרה, והיא הסיבה לקרוא את שאר ההשוואה הזו בתשומת לב במקום להניח שדגם הדגל הוא תמיד התשובה — כי MiMo-V2.6-Flash עולה בערך שליש ממה שעולה MiMo-V2.6-Pro, וברוב השורות השניים נמצאים במרחק של כמה נקודות זה מזה.

שני המודלים פורסמו כמאגרי Hugging Face ב-21 בספטמבר 2026, תחת רישיון MIT, בהפרש של שמונה עשרה שניות זה מזה, כריצות אימון נפרדות ולא כשליבות באותו סולם. Xiaomi MiMo-V2.6-Pro הוא דרגת טריליון הפרמטרים. MiMo-V2.6-Flash הוא דרגת היעילות. השאלה שעמוד זה בא לענות עליה היא מי מהם שייך למסלול הייצור שלך, והתשובה הכנה תלויה במספר שלא קיים באף אחד מהשחרורים.

מה כל אחד מהם הוא

• פרמטרים — Xiaomi MiMo-V2.6-Pro עם 1.02T סה"כ ו-42B פעילים לכל טוקן, לעומת Xiaomi MiMo-V2.6-Flash עם כ-309B סה"כ ו-15B פעילים
• ארכיטקטורה — שניהם תערובת מומחים דלילה עם קלט אומנימודלי נייטיבי; Flash מתועד עם 48 שכבות, 39 שכבות קשב מסוג חלון מחליק ו-9 שכבות קשב מלא, גודל חבוי 4096, 256 מומחים מנותבים עם 8 פעילים וללא מומחים משותפים, לצד שנאי חזותי 681M, טוקנייזר אודיו 308M ומקודד patch אודיו 127M
• הקשר — 1M טוקנים בשניהם, עם עד 128,000 טוקני פלט בשניהם
• רישיון — MIT בשניהם, משקלים ללא הגבלת גישה בשניהם
• מחיר — $0.435 לקלט ו-$0.87 לפלט למיליון טוקנים עבור Pro, לעומת $0.14 ו-$0.28 עבור Flash: פער של פי 3.1 בשני צידי הכרטיס
• קלט עם פגיעת מטמון — $0.0036 למיליון ב-Pro, $0.0028 ב-Flash
• הוצאות אימון — Xiaomi מדווחת על כ-$2.62M עבור ריצת ה-RL של Pro ו-$854K עבור Flash, כל אחת הושלמה בפחות משישה ימים על פני 30 צעדי למידת חיזוק וכ-750,000 מסלולים
• ציון אינדקס עצמאי — 46 עבור Xiaomi MiMo-V2.6-Pro ב-Artificial Analysis Intelligence Index v4.3.2; לא פורסם ציון עבור MiMo-V2.6-Flash

השורה האחרונה היא זו שכדאי להיאחז בה. כל מה שמעליה, מלבד ציון ה-Pro, מדווח על ידי Xiaomi.

במקום שבו פי שלושה מהמחיר קונה כמעט כלום

טבלה 3 של Xiaomi מעמידה את השניים זה לצד זה על פני כל ההרנסים שעליהם אומנה הסדרה, ובעבודה סוכנית ארוכת טווח הפערים זעירים:

• DeepSWE v1.1 — Pro 71.9, Flash 67.9
• MiMo Code Bench — Pro 63.2, Flash 61.2
• AutomationBench v1.0.6 — Pro 53.1, Flash 52.3
• Toolathlon-Verified — Pro 76.9, Flash 73.6
• Terminal Bench 2.1 — Pro 89.9, Flash 87.6
• OSWorld-Verified — Pro 82.0, Flash 80.8
• JobBench — Pro 62.0, Flash 61.2
• MiMo Visual Coding — Pro 72.3, Flash 71.5
• CyberGym — Pro 94.0, Flash 95.1
• MiMo Cyber Bench — Pro 80.2, Flash 77.2

קראו את העמודה הזו מלמעלה למטה, ותגלו שהיתרון של מכשיר הדגל הוא לרוב בין נקודה אחת לארבע נקודות, כאשר שורה אחת אבודה לחלוטין. בתהליך עבודה שבו ההבדל בין 67.9 ל-71.9 הוא ההבדל בין השלמת משימה לכישלון שלה, מחיר גבוה פי שלושה הוא זול. בתהליך עבודה שבו זה ההבדל בין שתי תשובות קבילות, הוא אינו זול. טבלאות של ספקים עם מקומות עשרוניים כאלה מזמינות דיוק מדומה — אף אחד מחוץ ל-Xiaomi לא הריץ אותן, ופער של שתי נקודות במערכת בדיקות עם דירוג פנימי נמצא היטב בתוך הטווח שמדרג אחר או מדיניות ניסיונות חוזרים אחרת יכולים להזיז.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash — the scoreboard'. The left column, MiMo-V2.6-Pro, reads Active params 42B, Price $0.435 / $0.87, DeepSWE v1.1 71.9, CyberGym 94.0, ExploitGym 17.8, Independent index 46. The right column, MiMo-V2.6-Flash, reads Active params 15B, Price $0.14 / $0.28, DeepSWE v1.1 67.9, CyberGym 95.1, ExploitGym 6.0, Independent index none published. A footer reads 'All benchmark figures are Xiaomi's own runs; only the Pro index score is independent.'

איפה זה קונה הרבה

יש אשכול של שורות שבהן הפער מפסיק להיות ויכוח על עיגול. כל אחת מהן היא עבודת אבטחה:

• ExploitGym — Pro 17.8, Flash 6.0
• ExploitBench — Pro 47.9, Flash 25.3
• SEC Bench Pro — Pro 66.3, Flash 47.5
• Agents' Last Exam — Pro 31.6, Flash 27.6
• Terminal Bench 4.0 — Pro 34.9, Flash 28.8

ב-ExploitGym דגם הדגל הוא פי שלושה מהמודל הזול יותר, שזה אותו מקדם כמו המחיר, וב-SEC Bench Pro הוא פי 1.4. התבנית הזו היא מה שהייתם מצפים ממודל עם 42B פרמטרים פעילים לעומת אחד עם 15B: משימה שדורשת שרשרת הסקה ארוכה בלי ניקוד חלקי היא מסוג המשימות שבהן הקיבולת הנוספת באה לידי ביטוי, ו-CyberGym שיושב בכיוון ההפוך הוא החריג שמוכיח ששתי ההרצות למדו דברים שונים ולא את אותו הדבר בגדלים שונים.

אז החלוקה תואמת גבול אמיתי של עומסי עבודה ולא גבול שיווקי. עבודה סוכנית בנפח גבוה עם קריטריון הצלחה סלחני — אחזור, סיווג, עריכות שגרתיות, קריאות שניסיון חוזר יכול להציל — היא בתחומו של Flash. עבודה שבה תשובה שגויה יקרה ותשובה חלקית חסרת ערך — פיתוח אקספלויטים, סקירת אבטחה, הפעלות טרמינל עם מצב רב-שלבי — היא המקום שבו דרגת Pro מצדיקה את המכפיל.

המספר שלא קיים

ל-MiMo-V2.6-Flash אין דף מודל ב-Artificial Analysis. לאחיו בסדרה יש. האסימטריה הזו היא הדבר החשוב ביותר בעמוד הזה, משום שהיא אומרת שהנתון היחיד שנמדד באופן עצמאי בכל סדרת MiMo-V2.6 הוא ה-46 שלצד Xiaomi MiMo-V2.6-Pro. כל מספר של Flash שלמעלה — כולל שורת ה-CyberGym שבה הוא מנצח — מגיע מהרנס של Xiaomi, ממדרג של Xiaomi ומהרצה לא מקוונת של Xiaomi.

יש בסיס סביר להניח שזה זמני: המודל בן יומו בלבד בזמן כתיבת שורות אלה, והערכה של צד שלישי אורכת זמן. יש גם בסיס סביר להניח שזה מבני, שכן Flash הוא שכבת הנפח, ושכבות נפח מושכות פחות תשומת לב של בנצ'מרקים. כך או כך, המשמעות המעשית היום היא שאינך יכול להשוות את Flash לשום דבר מחוץ למשפחה שלו באותה מידת ביטחון שבה אתה יכול להשוות את Pro. אם אתה בוחר בין Flash למודל שאינו Xiaomi על בסיס יחס מחיר-איכות, אתה משווה נתון של ספק מול נתון מדוד של מישהו אחר.

שתי כרטיסי המודל נושאים את אותה הסתייגות שנייה. אף אחד משני המאגרים אינו נפרס על ידי ספק הסקה כלשהו — Hugging Face אומרת זאת במפורש בכל עמוד, ו-Artificial Analysis ספרה ספק API אחד בלבד עבור Pro. איננו מארחים אף אחד מהצ'קפוינטים, כך שאף אחד מהם אינו ניתן לניתוב דרכנו. הדרך אל שניהם היא הפלטפורמה של Xiaomi עצמה והקטלוגים של צד שלישי שמכילים אותם.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Flash-RL, showing the MIT licence tag and multimodal tags including 8-bit precision and fp8, a Safetensors panel reporting a model size of 159B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a model tree listing one finetune and six quantizations, and a collection block headed MiMo-V2.6 holding three items.

המחיר שאתה משלם בחומרה, לא בטוקנים

תמחור לפי טוקן הוא רק חצי ממה שצ'קפוינט עולה לך, והשניים נבדלים בחדות רבה יותר בדיסק מאשר בכרטיס התעריפים. MiMo-V2.6-Flash מפרסם 172.9 GB של משקולות FP8 על פני 65 שארדים. Xiaomi MiMo-V2.6-Pro מכיל בערך פי שלושה פרמטרים, מה שמעמיד את ההורדה הגולמית שלו בטווח של חצי טרה-בייט לפני כל קוונטיזציה — והמאגר שלו עצמו מדווח על גודל מודל Safetensors של 524B פרמטרים, נתון שאינו מתיישב לא עם סך 1.02T ולא עם מספר הפרמטרים הפעילים 42B.

הפער הזה משנה את צורת ההחלטה. Flash בנפח 172.9 GB הוא מודל שצוות קטן יכול לארח בעצמו על קיבולת שכורה ולהתייחס אליו כאל מצרך. Pro, שגדול ממנו פי שלושה בערך, הוא החלטה ברמת אשכול — הסיקור סביב ההשקה הציב את שני תהליכי האימון על כ-4,000 וכ-8,000 יחידות GPU שוות-ערך ל-H200, בהתאמה. אם הסיבה שלך להסתכל על משקולות פתוחות היא שאתה רוצה את האפשרות להפסיק לשלם לפי טוקן, שתי נקודות הביקורת מציעות את האפשרות הזו בהיקפי מחויבות שונים מאוד.

לבחור ביניהם

הכלל ששורד את ההסתייגויות שלעיל הוא לבחור לפי סוג עומס העבודה ולא לפי ממוצע בנצ'מרק. Flash לכל דבר שתרגישו בנוח לנסות שוב; Pro לכל דבר שנסיון חוזר לא יציל אתכם. ואז מדדו, כי לאף אחד מהמודלים אין ציון עצמאי בבנצ'מרקים שבאמת חשובים לכם.

השוואת שני צ'קפוינטים זה לצד זה היא המקום שבו ראוטר עושה משהו שחוזה לפי מודל בודד לא יכול לעשות. הצבת שכבה זולה על עיקר התעבורה שלך והסלמה של המקרים הקשים בלבד אל היקרה היא אותה החלטה כמו בעמוד הזה, רק מבוטאת כקונפיגורציה ולא ככתיבה מחדש — וההרכבה הזו היא בדיוק הסיבה שקיימת שכבת הניתוב. זה חשוב גם למחיר עצמו: אנחנו מעבירים הלאה את מחיר המחירון של הספק בתוספת של 0%, כך שאם Xiaomi מורידה את המחיר על אחד מהצ'קפוינטים, המספר אצלנו משתנה באותו היום ולא בחידוש החוזה הבא. זה חל על המודלים שאנחנו מציעים. לגבי הצמד MiMo-V2.6 ספציפית, נכון להיום, אתם עדיין קונים ישירות מ-Xiaomi.

מה יפתור את זה?

שני דברים יהפכו את זה מהחלטה שיפוטית לשאלה אריתמטית. עמוד Artificial Analysis עבור MiMo-V2.6-Flash יציב את שני הצ'קפוינטים על אותו ציר עלות-למשימה שכרגע מציב את Pro בעלות של $0.133 לכל משימת Intelligence Index, וההשוואה תיפתר מעצמה. שכפול מצד שלישי של אשכול האבטחה — ExploitGym, ExploitBench, SEC Bench Pro — יאשר אם הפער של פי 3 בשורות האלה הוא תכונה של המודל או תכונה של המעריך.

עד אז, העמדה הניתנת להגנה היא שXiaomi MiMo-V2.6-Flash הוא הקנייה הטובה יותר עבור רוב הצוותים רוב הזמן, ושXiaomi MiMo-V2.6-Pro הוא הקנייה הטובה יותר עבור סוג העבודה הצר שבו כישלון הוא התוצאה היקרה. השורה האחת שבה Flash מנצח לא מבטלת את זה — אבל זו תזכורת שימושית שהפרמיום של ספינת הדגל הוא טענה לגבי עומס עבודה, לא לגבי מודל.

Screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, showing the Xiaomi attribution and 'Released September 2026', an Intelligence card reading 46 ranked #1 of 114, a Speed card reading 125.2 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.13 cost per Intelligence Index task, and a Verbosity card reading 140M output tokens, with a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.