כרטיס כותרת שנוצר שמשווה בין Xiaomi MiMo-V2.6-Pro ל-Grok 4.6 במאמץ גבוה. בכרטיס השמאלי כתוב Intelligence Index v4.3.2: 46, חלון הקשר: 1M טוקנים, $0.43 בקלט / $0.87 בפלט ל-1M, ו-134.3 טוקנים לשנייה; בכרטיס הימני כתוב Intelligence Index v4.3.2: 44, חלון הקשר: 500K טוקנים, $2.00 בקלט / $6.00 בפלט ל-1M, ו-63.0 טוקנים לשנייה. בפוטר כתוב: שני הציונים על Artificial Analysis Intelligence Index v4.3.2. נתוני DeepSWE מופקים על ידי הספק ואינם ברי השוואה. הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

MiMo-V2.6-Pro לעומת Grok 4.6: שני הספקים פרסמו נתוני DeepSWE, ואף אחד מהם אינו בלוח

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שני ספקים, מבחן מידה אחד, שני מספרים שאי אפשר לחסר זה מזה. החומר ההשקתי של SpaceXAI עבור Grok 4.6 מדווח על 65.9% ב-DeepSWE v1.1. החומר של Xiaomi עבור MiMo-V2.6-Pro מדווח על 72.57 ב-DeepSWE v1.1. בקריאה משותפת הם מרמזים שהמודל הזול יותר עם משקלות פתוחות מנצח את המודל הקנייני מהחזית בכמעט שבע נקודות. בקריאה זהירה הם כמעט אינם אומרים דבר, משום שאחד הוא אחוז מתוך מצגת השקה על ההרנס של הספק עצמו, והאחר הוא ממוצע של שלוש מתוך ריצת למידת חיזוק על המעריך של Xiaomi עצמה, ואף אחד מהם לא הוגש ללוח DeepSWE הציבורי. ההשוואה בין MiMo-V2.6-Pro ל-Grok 4.6 שעומדת בבדיקה מדוקדקת היא במדד העצמאי, ושם התשובה הפוכה למספרי הספקים: 46 מול 44, לטובת Xiaomi, בפער של שתי נקודות.

Grok 4.6 שוחרר ב-12 באוגוסט 2026 על ידי SpaceXAI והוא המכהן כאן — מודל חזיתי שהושק ומוגש באופן נרחב, עם רשימת מחירים מתועדת וחודשים של מדידה בלתי תלויה מאחוריו. Xiaomi MiMo-V2.6-Pro הועמד לרשות הכלל ב-22 בספטמבר 2026, כאשר מאגרי נקודות הביקורת שלו ללמידת חיזוק הופיעו יום קודם לכן, והוא המצטרף החדש. שניהם בעלי יכולת הסקה, שניהם בנויים לעבודה סוכנית ארוכת טווח, ופער המחירים ביניהם גדול מספיק כך שהחוסר ניסיון של המצטרף החדש הוא הדבר היחיד שמעכב את ההשוואה.

מה כל מודל הוא בפועל

Grok 4.6 הוא קנייני, מקבל קלט טקסט ותמונה ומחזיר טקסט, ובעל קטיעת ידע של 1 בפברואר 2026. חלון ההקשר שלו הוא 500,000 טוקנים, שהוא מחצית מהגודל של המתחרים העיקריים שלו והמפרט היחיד בעל ההשלכות המשמעותיות ביותר בדף המפרט שלו. תעריפי המחירון שלו הם $2.00 למיליון טוקני קלט, $0.50 למיליון קלט במטמון ו-$6.00 למיליון פלט מתחת ל-200,000 טוקני פרומפט, כאשר בגבול הזה חלה קפיצה חדה: ב-200K ומעלה התעריפים הופכים ל-$4.00, $1.00 ו-$12.00, והמדרגה הגבוהה מחייבת את כל הבקשה ולא רק את החלק שמעל הגבול. עיבוד בעדיפות מכפיל את התעריף הסטנדרטי. Artificial Analysis מדדה 63.0 טוקני פלט לשנייה ו-42.79 שניות לטוקן הראשון במאמץ מקסימלי, ו-$2,351.83 להרצת המדד המלא.

Xiaomi MiMo-V2.6-Pro הוא מודל תערובת-מומחים דלילה (sparse mixture-of-experts) עם 1.02 טריליון פרמטרים בסך הכול ו-42 מיליארד פרמטרים פעילים לכל טוקן, עם חלון הקשר של מיליון טוקנים ורב-מודאליות ילידית בטקסט, בתמונה, בווידאו ובאודיו. הוא ברישיון MIT עם משקולות שניתנות להורדה, ו-Xiaomi שמרה על התמחור של הדור הקודם במקום לתמחר מחדש כלפי מעלה את ה-checkpoint החדש — $0.43 למיליון טוקני קלט ו-$0.87 למיליון טוקני פלט, הנחת מטמון של 99%, ותמחור משוקלל של $0.18 בתמהיל של 7:2:1 של פגיעות מטמון/קלט/פלט. Artificial Analysis מדדה 134.3 טוקני פלט בשנייה, 2.15 שניות עד לטוקן הראשון, ו-$206.66 להרצת האינדקס — $0.13 למשימה.

• משקלים — MiMo-V2.6-Pro ברישיון MIT וזמין להורדה; Grok 4.6 קנייני, API בלבד

• פרמטרים — MiMo-V2.6-Pro ‏1.02T סה״כ / 42B פעילים; Grok 4.6 לא נחשפו

• הקשר — MiMo-V2.6-Pro 1M טוקנים; Grok 4.6 500K, עם צוק מחירים ב-200K של קלט

• מודאליות — MiMo-V2.6-Pro קולט טקסט, תמונה, וידאו ואודיו; משטח הקלט המפורסם של Grok 4.6 הוא טקסט ותמונה

• ציון מדד — MiMo-V2.6-Pro 46; Grok 4.6 44, שניהם Artificial Analysis v4.3.2

• מחיר מחירון — MiMo-V2.6-Pro $0.43 / $0.87 לכל 1M; Grok 4.6 $2.00 / $6.00, מוכפל מעל 200K קלט

• תעריף משוקלל — MiMo-V2.6-Pro $0.18 לכל 1M; Grok 4.6 $1.35

• עלות הרצת האינדקס — MiMo-V2.6-Pro ‏$206.66; Grok 4.6 ‏$2,351.83

• מהירות — MiMo-V2.6-Pro 134.3 אסימוני פלט לשנייה; Grok 4.6 63.0

• זמן עד לטוקן הראשון — MiMo-V2.6-Pro‏ 2.15 שניות; Grok 4.6‏ 42.79 שניות

• נקודת חתך הידע — MiMo-V2.6-Pro לא פורסם; Grok 4.6 1 בפברואר 2026

A two-column scoreboard titled MiMo-V2.6-Pro vs Grok 4.6, subtitled Two vendor DeepSWE figures, neither submitted to the public board. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; list price $0.43 / $0.87 per 1M; context window 1M tokens; speed 134.3 tokens per second; DeepSWE v1.1 72.57 vendor-run, avg@3; public DeepSWE entry none. The right column, Grok 4.6 (high), reads Intelligence Index v4.3.2 44; list price $2.00 / $6.00 per 1M; context window 500K tokens; speed 63.0 tokens per second; DeepSWE v1.1 65.9% vendor-reported; public DeepSWE entry ~67% submitted. A footer notes the two DeepSWE figures come from different vendor harnesses with different metrics and must not be subtracted, and that Grok 4.6 list rates double at or above 200K input tokens. The OrcaRouter logo is composited in the bottom-right corner.

הבנצ'מרק ששני הספקים הריצו, ומדוע הוא אינו בר־השוואה

DeepSWE v1.1 הוא הערכה אמיתית, ציבורית, של צד שלישי, של סוכן קידוד, המופעלת על ידי Datacurve, והיא משפחת המשימות היחידה ששתי החברות בחרו לפרסם מולה. זה הופך את זה למפתה. אין להשתמש בזה כהשוואה ראש בראש, והסיבה אינה שאחד מהספקים משקר — אלא ששני המספרים מתארים מדידות שונות של אותו שם משימה.

ה-72.57 של Xiaomi הוא ממוצע של שלוש הרצות על ההרנס שלה עם mini-swe-agent, שהופק במהלך ריצת למידת חיזוק ולא ממועמד שחרור קפוא, ומדווח לצד נתון התחלתי של 58.4. הריצה מתועדת כ-30 צעדים וכ-750,000 מסלולים לכל מודל, והושלמה תוך פחות משישה ימים בהוצאה שפורסמה של כ-2.62 מיליון דולר עבור מודל ה-Pro. הוא לא הוגש ללוח של Datacurve. הנתון של SpaceXAI של 65.9% עבור Grok 4.6 הוא נתון ממצגת השקה מתוך מערך ההערכה של הספק עצמו, המדווח לצד שיפורים לעומת Grok 4.5 של 11.9 נקודות באותו מבחן — והלוח הציבורי מציג תצורת Grok 4.6 שהוגשה בסביבות 67%, שקרובה מספיק למספר הספק כדי לרמוז שההרנס לפחות בקירוב מתואם. זה לא נכון לגבי הנתון של Xiaomi, שאין לו כלל מקביל פומבי.

אז ההצהרה הכנה היא זו: בלוח הציבורי, Grok 4.6 נוכח ו-MiMo-V2.6-Pro נעדר. במדד המשולב העצמאי, אותו מעריך הריץ בפועל את שניהם, והמודל של Xiaomi מוביל בשתי נקודות. שתי העובדות האלה אינן עומדות בסתירה. הן פשוט מודדות דברים שונים, והשנייה היא זו שיש לצטט.

הקונטקסט של 500K הוא המפרט שקובע עומסי עבודה אמיתיים

חצי מיליון טוקנים הוא חלון הקשר גדול לפי כל סטנדרט רגיל, וקטן עבור 2026. המודלים ש-MiMo-V2.6-Pro משויך אליהם נמצאים כולם ב-1M, וההשלכה המעשית מתגלה בדיוק בעומסי העבודה ש-Grok 4.6 משווק עבורם. סוכן קידוד ארוך-טווח שמחזיק מאגר קוד, תמלול כלים ותוכנית מצטברת יחצה 200,000 טוקנים של פרומפט בסשן — ובקו הזה, התעריפים של Grok 4.6 מוכפלים וחלים רטרואקטיבית על כל הבקשה. אותו סשן על MiMo-V2.6-Pro מגיע למיליון טוקנים בלי שינוי מדרגה.

זהו הבדל במפרט והבדל במבנה התמחור בו-זמנית, ואת השני קל להחמיץ כשמשווים תעריפים עיקריים. תעריף משוקלל של $1.35 עבור Grok 4.6 לעומת $0.18 עבור MiMo-V2.6-Pro הוא פער של פי 7.5. בפרומפט שחוצה 200K הוא מתרחב למשהו קרוב יותר לפי 15, כי תעריף Grok מוכפל וזה של Xiaomi לא זז.

הטיעון הנגדי מתועד אף הוא, ובדין. תזת ההשקה של Grok 4.6 התמקדה ביעילות סבבים ולא בהקשר גולמי: בהערכה האייג'נטית שבה הוא נמדד מול Claude Opus 5 במשימות זהות, הוא סיים בכ-53 סבבים ובכ-500 מיליון טוקני קלט, לעומת כ-103 סבבים ושני מיליארד טוקנים אצל המודל האחר, בעלות מוערכת של 0.84 דולר למשימה — הנתון הנמוך ביותר מבין מודלי החזית באותה השוואה. מודל שמקיף את הלולאה חצי ממספר הפעמים אינו זקוק להקשר רב כל כך, ואינו שורף כל כך הרבה טוקנים. זהו יתרון ארכיטקטוני אמיתי, וזה הטיעון החזק ביותר בעד Grok 4.6 נגד כל חלופה זולה יותר לכל טוקן, כולל זו.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 22 September 2026. The header reads 46 Artificial Analysis Intelligence Index, ranked first of 114 in its class; 134.3 output tokens per second, ranked eleventh of 114; $0.435 input and $0.87 output per 1M tokens with a 99% cache discount; $0.13 cost per Intelligence Index task, ranked twelfth of 114; and 140M output tokens from the Intelligence Index. Technical specifications list reasoning Yes, input modality text, image, speech and video, output modality text, a 1M-token context window, 1.0T total parameters, 42B active parameters, an MIT licence and Hugging Face model weights, under a breadcrumb reading Xiaomi, Open weights model, Released September 2026. A comparison summary notes it cost $206.66 to evaluate MiMo-V2.6-Pro on the Intelligence Index.

להגיע לכל אחד מהם

Grok 4.6 נמצא ב-OrcaRouter בתור grok/grok-4.6, נגיש דרך נקודת קצה אחת תואמת OpenAI במחיר המחירון של הספק עם תוספת של 0% — כך ששינוי מחיר של SpaceXAI, כולל שינוי במצוק הזה של 200K, פעיל אצלנו באותו היום. Xiaomi MiMo-V2.6-Pro אינו נמצא ב-OrcaRouter. אף דגם של Xiaomi אינו נמצא בו, והדרך אליו היום היא הפלטפורמה של Xiaomi עצמה או אחד מהקטלוגים של צד שלישי שמפרטים אותו. לומר זאת בפשטות מועיל יותר מאשר לאפשר לעמוד של דגם לרמוז אחרת.

מה שהאסימטריה הזו שווה בפועל הוא ניסוי בזול. Grok 4.6 הוא המודל שאולי אתם כבר משלמים עליו. MiMo-V2.6-Pro הוא שיפור של שתי נקודות במדד בשבריר מהתעריף, שהושק השבוע, עם נתיב הגשה יחיד מאחוריו. השאלה שכדאי לענות עליה אינה איזה מהם טוב יותר באופן מופשט, אלא כמה מתעבורת ה-Grok שלכם מודל Xiaomi יכול לקחת על הפרומפטים שלכם — ולענות עליה בפתיחת חוזה שני, מפתח שני ומערכת חיוב שנייה היא החיכוך שמונע מהניסוי לקרות. עם נקודת קצה אחת ומעבר אוטומטי בין ספקים, ההשוואה היא שינוי בקונפיגורציה, וחלק המעבר האוטומטי חשוב כאן יותר מהרגיל: מודל שהושק השבוע והופיע אצל ספק API אחד כשמנת Artificial Analysis לכדה אותו אינו משהו ששמים בנתיב ייצור בלי נתיב נסיגה.

Screenshot of the OrcaRouter model page for Grok 4.6, captured 22 September 2026, showing the breadcrumb Home > Models > SpaceXAI > Grok 4.6, the model id grok/grok-4.6 dated 2026-08-12, the Vision, Tools, JSON and Reasoning capability badges, and the on-this-page index for code samples, pricing, performance, public benchmarks, community buzz, comparisons and FAQ. The rate card sits below the visible area of the capture.

איזה מהם לבחור

בחר ב-Grok 4.6 כאשר יעילות תורות היא הדבר שאתה מייעל — לולאות סוכנים ארוכות שבהן היכולת של המודל לסיים במחצית מהצעדים שווה יותר מהתעריף לפי טוקן שלו — או כאשר אתה רוצה מודל עם חודשים של מדידה בלתי תלויה מאחוריו ולא שבוע. הקצב שלו של 63 טוקנים לשנייה וזמן של 42.79 שניות לטוקן הראשון הופכים אותו למודל אצווה ועומסי עבודה לא מקוונים במונחים אינטראקטיביים, וההקשר שלו של 500K עם צוק מחירים ב-200K מצדיק לשמור על פרומפטים קצרים.

בחר ב-MiMo-V2.6-Pro כאשר אתה מריץ לולאות עתירות הקשר וחזרתיות שהיו חוצות את המצוק של 200K של Grok, כאשר אתה זקוק להשהיית הטוקן הראשון נמוכה מספיק כדי שאדם ימתין, כאשר אתה רוצה את המשקולות בתשתית שלך, או כאשר הנפח הופך את פער התעריף המשולב של פי 7.5 למספר המכריע. יתרון שתי הנקודות שלו במדד קטן מספיק כדי שלא יהיה הסיבה בפני עצמו; העלות של $206.66 לעומת $2,351.83 להרצת אותה חבילת הערכה היא סיבה טובה יותר.

מה שיכריע את השאלה הפתוחה הוא תצורת DeepSWE שהוגשה עבור MiMo-V2.6-Pro. ל-Grok 4.6 כבר יש אחת. ברגע שהמודל של Xiaomi יופיע בלוח הציבורי עם הרנס מצוין, רווח סמך ועלות לכל משימה, 72.57 מפסיק להיות מספר של ספק, וההשוואה שלמעלה הופכת לאמיתית — ובהינתן הפער של שתי נקודות במדד, היא יכולה להתפתח לכאן או לכאן.

OrcaRouter מציג 200+ מודלים מאחורי נקודת קצה אחת תואמת OpenAI במחיר המחירון של הספק עם תוספת של 0%, כך ששינוי מחיר של ספק נכנס לתוקף כבר באותו יום.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית