כרטיס כותרת להשוואה בין Xiaomi MiMo-V2.6-Pro ל-MiniMax M3, המציג שני כרטיסי מפרט זה מול זה: Xiaomi MiMo-V2.6-Pro במדד אינטליגנציה v4.3.2 46, מהירות פלט 134.3 טוקנים לשנייה, מחיר משולב $0.18 ל-1M וספק API אחד, לעומת MiniMax M3 במדד 29, 168.9 טוקנים לשנייה, $0.22 ו-15 ספקי API.
Guides & Insights

Xiaomi MiMo-V2.6-Pro לעומת MiniMax M3: לציון הטוב יותר יש הנתיב הדק יותר

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Xiaomi MiMo-V2.6-Pro הפך לזמין באופן כללי ב-22 בספטמבר 2026 ותפס את המקום הראשון בקטגוריית המשקולות הפתוחות במדד הבינה של Artificial Analysis עם 46 בגרסה v4.3.2. MiniMax M3 מחזיק בגרסה של אותו תואר מאז שיצא ב-31 במאי 2026, ובאותו מדד היום הוא מקבל 29 — שבעה עשר נקודות מאחור. הציון הוא הדבר הפחות מעניין בשניים האלה. MiniMax M3 מספק 168.9 אסימוני פלט בשנייה לעומת 134.3, עונה תוך 0.92 שניות לעומת 2.15, זול יותר לכל אסימון קלט, ונגיש דרך חמישה עשר ספקי API לעומת ספק אחד של Xiaomi. המודל החדש יותר, בעל הציון הגבוה יותר, הוא זה שקשה יותר להפעיל בפועל, וההיפוך הזה הוא נושא ההשוואה הזו.

שניהם עם משקלים פתוחים, שניהם מולטימודליים, בהפרש של ארבעה עשר שבועות זה מזה

שני המודלים הם קרובי משפחה קרובים בכוונת העיצוב. שניהם מודלים דלילים מסוג תערובת-מומחים ממעבדות סיניות, לשניהם חלון הקשר של 1M טוקנים, שניהם מקבלים תמונות ווידאו באופן נייטיבי ולא באמצעות מתאם שהותקן בדיעבד, ושניהם מפרסמים משקלים. ארבעה־עשר שבועות מפרידים בין השחרורים שלהם, והפער במדד ביניהם הוא המרחק שחזית המשקלים הפתוחים גמעה בחלון הזה.

• סה״כ פרמטרים — Xiaomi MiMo-V2.6-Pro 1.02T; MiniMax M3 כ-427B, שניהם MoE דליל

• פעילים לכל טוקן — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 בערך 23–25B

• הקשר — 1M טוקנים כל אחד, כאשר MiniMax M3 מבטיח מינימום של 512K

• מודאליות קלט — טקסט, תמונה ווידאו לשניהם; Xiaomi מוסיפה קלט אודיו

• משקלים — רישיון MIT על Xiaomi MiMo-V2.6-Pro; ‏MiniMax M3 מופץ תחת רישיון MiniMax Community, שאינו מתירני ודורש הסכם נפרד לשימוש מסחרי

• שוחררו — Xiaomi MiMo-V2.6-Pro 21–22 בספטמבר 2026; MiniMax M3 31 במאי 2026

• נגישות — ספק API אחד נספר עבור Xiaomi MiMo-V2.6-Pro ב-Artificial Analysis; חמישה עשר עבור MiniMax M3

השורה האחרונה היא זו שצריך לשמור לנגד העיניים. כל השאר בגיליון מטה לטובת הדגם החדש יותר. השורה הזו לא, והיא השורה שקובעת אם דגם יכול לשבת בנתיב ייצור.

מה המדד מודד, ומי מדד אותו

Artificial Analysis הריצה בעצמה את שני המודלים על v4.3.2 — מכלול בן עשרה מדדים המכסה הסקה, ידע, מתמטיקה ותכנות, כולל AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience ו-AA-LCR v1.1. לא ה-46 ולא ה-29 הם מספרי ספק, וזה חשוב כאן משום ששתי המעבדות גם פרסמו נתוני בנצ'מרק משלהן שהיו מספרים מטעם הספק, ואסור לערבב בין שני הסוגים.

הציון 46 מציב את Xiaomi MiMo-V2.6-Pro בראש תחום המשקלים הפתוחים במדד המשולב הזה. הוא אינו מציב אותו בראש המדד: Claude Fable 5.1 ו-GPT-6 Astra נמצאים שניהם ב-53, ו-Claude Opus 5 ב-51. הציון 29 של MiniMax M3 מציב אותו במקום השישה-עשר מתוך 114 מודלים שנמדדו, הרבה מעל החציון של קטגוריית הגודל שלו, אך רחוק מאוד מהחזית שאליה הוא הושווה ביוני.

ל-MiniMax M3 יש את ההוכחות שאין ל-Xiaomi

זה החלק בהשוואה שמדלגים עליו, וזה החלק שכל קונה צריך לשקול במשקל הרב ביותר. MiniMax M3 נמצא בלוח המובילים הציבורי של DeepSWE v1.1 עם רשומה רשמית: 20.4% Pass@1 ו-48.7% Pass@4, שפורסמה ב-8 ביוני 2026 לאחר ששדרוג האינפרנס של MiniMax תיקן יצירת טוקנים חריגה ושיפר את התנהגות המטמון בהקשר ארוך. הרשומה הזו הגיעה עם חשבונאות יעילות מצורפת, והחשבונאות אינה מחמיאה: חציון של 311 צעדי סוכן, כ-91,000 טוקני פלט, ובערך 5.04 דולר למשימה. הוא עובר משימות הנדסיות באופק ארוך, והוא עושה זאת ביוקר.

הנתון הראשי של Xiaomi בבנצ'מרק עבור המודל החדש שלה הוא 72.57 ב-DeepSWE v1.1, עלייה מ-58.4 כבסיס, שנמדד עם mini-swe-agent לפי ממוצע של שלושה על ההרנס של Xiaomi עצמה. הוא אינו רשומה בלוח המובילים, ולא הוגש ככזו. הצבת 72.57 לצד 20.4 של MiniMax והסקת ניצחון של 52 נקודות ממנה היא אריתמטיקה בין שתי מדידות שונות: הלוח מפרסם Pass@1 עבור תצורה מסוימת שצד שלישי יכול להריץ מחדש, עם רווח סמך ועלות ממוצעת למשימה, ולנתון של הספק אין שום דבר מזה מצורף אליו. המספר 72.57 עשוי בהחלט להיות כנה. הוא פשוט אינו אותו סוג של אובייקט.

MiniMax גם פרסמה נתוני השקה משלה, ואותה הסתייגות חלה על כל אחד מהם: SWE-Bench Pro ב-59.0, BrowseComp ב-83.5, SVG-Bench ב-63.7 ו-Terminal-Bench 2.1 ב-66.0, שהורצו על התשתית של MiniMax עצמה ועם הסקפולדינג שלה. התייחסו אליהם כאל טענות על המודל, לא כמדידות שלו.

מהירות, השהיה, ושני המספרים שמכריעים את החשבון

פער התפוקה מנוגד לפער האיכות, והוא רחב מספיק כדי שיהיה לו משמעות. MiniMax M3 מייצר 168.9 טוקני פלט לשנייה לעומת 134.3 של Xiaomi MiMo-V2.6-Pro, והזמן של 0.92 שניות עד לטוקן הראשון שלו הוא בערך פי שניים וחצי מהיר יותר מ-2.15 של Xiaomi. עבור מוצר אינטראקטיבי, השהיית הטוקן הראשון היא המספר שהמשתמש מרגיש; עבור צינור עיבוד באצוות, התפוקה היא המספר שקובע את שעון הקיר.

מבחינת עלות, השניים קרובים יותר ממה ששיעורי המחיר הרשמיים מרמזים, והכיוון תלוי בתעבורה שלך. המחיר הרשמי של MiniMax M3 הוא $0.30 למיליון טוקני קלט ו-$1.20 למיליון טוקני פלט; המחיר הרשמי של Xiaomi MiMo-V2.6-Pro הוא $0.43 ו-$0.87. M3 זול יותר בצד הקלט, Xiaomi זול יותר בצד הפלט. לאחר החלת הנחות המטמון — 80% עבור M3, 99% עבור Xiaomi — התעריפים המשולבים מגיעים ל-$0.22 ו-$0.18 למיליון בתמהיל של 7:2:1 של פגיעות מטמון/קלט/פלט. Artificial Analysis גם מתעד עלות של $0.13 למשימת Intelligence Index עבור Xiaomi MiMo-V2.6-Pro, הנמדדת באותו אופן עבור כל מודל בלוח, וזהו נתון העלות הבודד הניתן להשוואה ביותר הזמין עבור השניים.

A two-column comparison scoreboard for Xiaomi MiMo-V2.6-Pro and MiniMax M3 covering Intelligence Index v4.3.2 (46 vs 29), output speed (134.3 vs 168.9 tokens/second), time to first token (2.15s vs 0.92s), blended rate ($0.18 vs $0.22 per 1M), API providers (1 vs 15) and long-horizon evidence (vendor harness only vs public Pass@1 entry).

חמישה עשר נתיבים מול אחד, וכמה שווה מעבר לגיבוי

יתרון של שבעה עשר נקודות במדד לא יעזור לך אם נקודת הקצה מושבתת. Artificial Analysis ספרה ספק API אחד בלבד עבור Xiaomi MiMo-V2.6-Pro בזמן כתיבת הדברים, וספירה זו היא עובדה על ההשקה ולא על המודל: צ'קפוינט שפורסם לפני שלושה ימים לא הספיק להתפשט. את MiniMax M3, בן ארבעה חודשים, משרתים חמישה עשר.

ההבדל הזה הוא מה שלשמו נועד ראוטר, וכאן שני המודלים מתפצלים מבחינה מסחרית. MiniMax M3 נמצא ב-OrcaRouter בתור minimax/minimax-m3: נקודת קצה אחת תואמת OpenAI, מחיר המחירון של הספק מועבר הלאה עם 0% תוספת, כך שה-$0.30 וה-$1.20 שלמעלה הם המספרים של MiniMax עצמה ולא שלנו, ושינוי מחיר של MiniMax נכנס לתוקף אצלנו באותו היום. חמישה-עשר ספקי המקור שלה הם מה שהופך שרשרת מעבר אוטומטית לגיבוי למשמעותית — בקשה שנתקעת אצל ספק אחד מנסה שוב אצל אחר לפני שהתגובה מתחילה, וזו הבטחה שונה ממודל שיש לו מקום אחד לפנות אליו. Xiaomi MiMo-V2.6-Pro לא נמצא ב-OrcaRouter; אף מודל של Xiaomi לא נמצא שם, והגעה אליו היום משמעה הפלטפורמה של Xiaomi עצמה והקטלוגים של צדדים שלישיים שמפרטים אותו.

אם אתה רוצה את שניהם באותה אפליקציה, הצורה המעשית היא מפתח אחד שמחזיק את המודלים שכבר החלטת עליהם, כאשר המצטרף החדש נבחן מולם במקום לאמץ אותו על סמך ציון בן שלושה ימים. זו החלטת ניתוב, והתכונה השימושית היא שמסלול גיבוי לא עולה דבר עד היום שבו הוא מציל אותך.

The OrcaRouter model page for minimax/minimax-m3, showing MiniMax as the vendor, the 2026-05-31 release date, Vision, Tools, JSON and Reasoning capability tags, a 1M-token context window, 512K maximum output, $0.30 per 1M input and $1.20 per 1M output, and a p50 time to first token of 8.49 seconds.

איזה אחד לבחור?

אם אתם צריכים מודל במשקלים פתוחים, רב-מודאלי, של מיליון טוקנים, בפרודקשן השבוע, התשובה היא MiniMax M3, וזה לא מתחרה צמוד — חמישה עשר ספקים, טוקן ראשון בפחות משנייה, מסלול מסחרי מתירני מספיק רק אם קראתם את רישיון הקהילה, ורשומת בנצ'מרק רשמית לאופק ארוך שתוכלו לבדוק. אזהרת היעילות אמיתית: תקצבו 91,000 טוקני פלט לכל משימה, לא רק את התעריף לכל טוקן.

אם אתם בוחרים מודל לעבודה שתתחילו בחודש הבא, Xiaomi MiMo-V2.6-Pro הוא המודל המסוגל יותר בפער מדוד וגדול, בתעריף משוקלל נמוך יותר, ועם רישיון MIT שמסיר לחלוטין את השיחה על רישוי. מה שעדיין אין לו הוא מקום שני להריץ בו. הדבר שכדאי לעקוב אחריו הוא מספר הספקים: כשהוא מפסיק להיות אחד, הפער של שבעה עשר נקודות מפסיק להיות תוצאת מחקר והופך להחלטת פריסה.

עד אז, הסיכום הכנה הוא שהמודל הטוב יותר הוא זה שאי אפשר לבצע ממנו מעבר כשל, והמודל החלש יותר הוא זה שאפשר להעמיד מול לקוחות כבר הלילה.

The Artificial Analysis model page showing the Intelligence Index v4.3.2 scores, output speed, latency and per-task cost that both models in this comparison are measured on.

מאיפה מגיעים המספרים בקטע הזה

ציוני המדד, התפוקה, ההשהיה, הנחות המטמון ומספרי הספקים עבור שני המודלים הם מדידות של Artificial Analysis במדד Intelligence Index v4.3.2, שנקראו ב-22 בספטמבר 2026, וה-29 של MiniMax M3 יושב על אותה גרסה של המדד המשולב כמו ה-46 של Xiaomi MiMo-V2.6-Pro. הנתונים של DeepSWE v1.1 עבור MiniMax M3 הם מערך לוח התוצאות הציבורי של 8 ביוני 2026. השינוי מ-58.4 ל-72.57 ב-DeepSWE, ההוצאה על למידת חיזוק של כ-2.62 מיליון דולר עבור הרצת ה-Pro על פני שלושים צעדים, ומספרי SWE-Bench Pro, BrowseComp, SVG-Bench ו-Terminal-Bench עבור MiniMax M3 — כולם מדווחים על ידי הספקים על גבי מערכות הבדיקה של המעבדות המתאימות ולא שוחזרו באופן עצמאי. התעריפים לכל אסימון הם מחירי המחירון של הספקים עצמם.