כרטיס כותרת שנוצר, ועליו הכיתוב MiMo-V2.6-Pro לעומת Grok 4.7, עם כתובית המשנה 29x זול יותר לכל משימה, ואיטי יותר משני הצדדים מתחתיה, ושלושה אייקוני קו שטוחים מעל הכותרת שמרמזים על ערימות מטבעות בהשוואה, חוגת מהירות ומנעול פתוח. הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Xiaomi MiMo-V2.6-Pro מול Grok 4.7: זול פי 30 לכל משימה, ואף אחד מהם לא מהיר

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Xiaomi MiMo-V2.6-Pro ו-Grok 4.7 יצאו שניהם ב-21 בספטמבר 2026, שניהם מגיעים ל-46 במדד Artificial Analysis Intelligence Index v4.3.2, ושניהם מכונים איטיים בעמוד שמדד אותם — 43.6 אסימוני פלט לשנייה עבור MiMo-V2.6-Pro לעומת חציוני של 67.1, ו-40 עבור Grok 4.7 במאמץ xhigh. מה שמבדיל ביניהם הוא העלות של תשובה. הנתון של המעריך לכל משימה הוא $0.13 עבור הצ'קפוינט הפתוח הסיני ו-$3.74 עבור המודל Grok 4.7, פי כ-29. זה לא הבדל בתעריף, או לא רק כזה: תעריף הפלט של Grok 4.7 הוא $6.00 למיליון אסימונים לעומת $0.87, שזה פי שבעה, ושאר המכפיל נובע ממספר האסימונים שכל מודל שורף כדי להגיע לתשובה.

שני מודלים באותו חודש, על אותו מדד, באותו ציון, מתומחרים כאילו הם שייכים לעשורים שונים של השוק. השאלה המעניינת אינה מי מהם מנצח. אלא איזה חלק מאותו 29× אפשר באמת לעקוף — כי בצימוד הזה בדיוק אחד מהשניים הוא מסלול שאפשר לקנות היום, והוא היקר.

אותו יום, אותו ניקוד, חיות שונות

Grok 4.7 הושק ב-21 בספטמבר 2026 במחיר של 2.00 דולר למיליון אסימוני קלט ו-6.00 דולר למיליון אסימוני פלט, עם חלון הקשר של 500,000 אסימונים, נקודת חיתוך ידע ממאי 2026, הנחת מטמון של 75%, וקלט טקסט ותמונה אל מול פלט טקסט. הוא השיג 46 באינדקס במאמץ xhigh, 56 ב-Coding Agent Index בסביבת ההרצה של Grok Build, ו-1,657 Elo ב-AA-Briefcase — רביעי בלוח הזה, אחרי שלוש רשומות של Anthropic, בערך במחצית מהעלות למשימה של Claude Opus 5.

Xiaomi MiMo-V2.6-Pro הוא צ'קפוינט דליל של תערובת מומחים, 1.02 טריליון פרמטרים בסך הכול עם 42 מיליארד פעילים, ברישיון MIT, הקשר של מיליון טוקנים, קלט טקסט, תמונה, דיבור וווידאו אל מול פלט טקסט, 0.43 דולר ו-0.87 דולר למיליון טוקנים עם הנחת מטמון של 99% שמצמצמת את תעריף הקלט האפקטיבי לכמעט אפס בפרומפט חם. Artificial Analysis ממקמת אותו במקום הראשון מבין 114 מודלים עם משקלים פתוחים במדד ובמקום השנים-עשר מבין 114 מבחינת עלות. ניתן לגשת אליו דרך שלושה ספקי API. הוא אינו נמצא במסלולים שלנו, ואנחנו לא מפרסמים מודל לפני שספק הטמיע אותו.

השורה היחידה שמכריעה את זה

• עלות לכל משימת אינדוקס — MiMo-V2.6-Pro‏ $0.13; Grok 4.7‏ $3.74 — פי 29 • קצב פלט — MiMo-V2.6-Pro‏ $0.87 / 1M; Grok 4.7‏ $6.00 / 1M — פי 6.9 • אסימוני פלט בהרצת האינדוקס — MiMo-V2.6-Pro‏ 140M; Grok 4.7‏ 240M, מול חציון של 88M • מהירות פלט — MiMo-V2.6-Pro‏ 43.6 t/s; Grok 4.7‏ 40 t/s — שתיהן מתחת לחציון • חלון הקשר — MiMo-V2.6-Pro‏ 1M; Grok 4.7‏ 500K • משקלים — MiMo-V2.6-Pro ברישיון MIT וניתן להורדה; Grok 4.7 קנייני, API בלבד

קראו את שני התבליטים הראשונים יחד וצורת הפער מתבהרת. במחיר המחירון, השניים רחוקים זה מזה פי 6.9 בפלט. בהרצת האינדקס הם רחוקים זה מזה פי 29 במה שעולה תשובה. הגורם המכפיל שביניהם הוא מילוליות: Grok 4.7 יצר 240 מיליון טוקנים בפלט לעומת חציון של 88 מיליון במחלקה שלו, ו-MiMo-V2.6-Pro יצר 140 מיליון. זהו קנס טוקנים של פי 1.71 שיושב מעל קנס התעריף של פי 6.9, ו-1.71 × 6.9 הוא 11.8 — יתרת המרחק עד 29 מגיעה מצד הקלט, שם הנחת המטמון של 99% ותעריף הקלט של $0.43 של MiMo-V2.6-Pro עושים את העבודה הכבדה בעומס עבודה שיש בו ולו קידומת חוזרת אחת.

A two-column scoreboard titled MiMo-V2.6-Pro vs Grok 4.7 - the scoreboard, subtitled Same index score, same month, 29x apart per task. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context; weights downloadable, and carries a tag reading Open weights - MIT. The right column, Grok 4.7 (xhigh), reads Intelligence Index v4.3.2 46; cost per index task $3.74; list price $2.00 / $6.00 per 1M; output speed 40 tokens per second; 240M output tokens; 500K context; weights not released, and carries a tag reading Proprietary - API only. A footer line reads that index scores, per-task cost, speed and token counts are per Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and that both models shipped 21 September 2026. The OrcaRouter logo is composited in the bottom-right corner.

מילוליות היא המספר שאנשים משמיטים מהאומדן.

מודלים של עלויות נבנים בדרך כלל ממחירון ומספירת טוקנים משוערת. שני החצאים של זה שגויים כאן. המחירון שגוי משום שהנחת המטמון אינה הערת שוליים — 99% לעומת 75% הם ההבדל בין הנחיית מערכת שעולה לך כסף בכל קריאה לבין עלות כמעט אפסית. ספירת הטוקנים שגויה משום ששני המודלים לא פולטים אותו מספר טוקנים עבור אותה עבודה, והמעריך מדד את ההבדל: 240 מיליון לעומת 140 מיליון, פער של פי 1.71 בבנצ'מרק זהה.

אף אחד מאלה אינו פרוקסי שאפשר לקרוא מדף מפרט. דירוג המילוליות של Grok 4.7 הוא #94 מתוך 210 מודלים בקטגוריה שלו; דירוג העלות של MiMo-V2.6-Pro הוא #12 מתוך 114 בקטגוריה שלו. צוות שמצטט את כרטיס התעריפים של Grok 4.7 ומניח עומס עבודה נייטרלי מבחינת טוקנים יחזות בקירוב רבע ממה שהאינדקס הוציא בפועל לכל משימה. התיקון אינו בכך שתשתמש גם בעלות האינדקס כאומדן שלך — היא מדידה של הצורה של בנצ׳מרק אחד. אלא בכך שתמדוד את מספרי הטוקנים שלך משני הצדדים לפני התחייבות, משום שהפער בין שני המודלים הוא פי 6.9 על הנייר ופי 29 בפועל, ורק אחד מהמספרים האלה אמיתי עבור התעבורה שלך.

Screenshot of the Artificial Analysis model page for Grok 4.7 (xhigh), captured 25 September 2026. The header shows Intelligence rank 21 of 210, Speed 159 of 210, Cost 210 of 210, Verbosity 94 of 210, 46 on the Artificial Analysis Intelligence Index, $2.00 input and $6.00 output per 1M tokens with a 75% cache discount, $3.74 per task to evaluate on the Intelligence Index, and 500K context; the summary paragraph calls the model notably slow and very verbose, and the verbosity line shows 240M output tokens generated on the index run against a median of 88M.

שניהם איטיים, וזה לא תיקו.

Artificial Analysis מדדה את Grok 4.7 ב-40 טוקני פלט לשנייה ומכנה אותו “מבין האיטיים ביותר”; את MiMo-V2.6-Pro ב-43.6 ומכנה אותו “איטי באופן ניכר”. שתי הקריאות הללו קרובות מספיק כדי שמהירות לא תשמש כשובר שוויון ביניהן. אבל החציונים שמתחת לא כאלה: 67.1 עבור שדה המשקלים הפתוחים ש-MiMo-V2.6-Pro נמצא בו. שני המודלים נמצאים הרבה מתחתיו, ול-MiMo-V2.6-Pro יש גם זמן של 3.17 שניות עד לטוקן הראשון לעומת חציון של 2.31 שניות, וזה המספר שמזיק בלולאה אינטראקטיבית ולא בלולאת אצווה.

אז הסיכום הכנה של צד ההשהיה הוא ש-29× זול יותר לא קונה לך מוצר מהיר יותר, הוא קונה לך מוצר איטי יותר שעולה פחות — ואם המשתמשים שלך מסתכלים על סמן, ההמתנה של 3.17 שניות עשויה לעלות יותר מהטוקנים שנחסכו. עבור עבודת אצווה לילית, הערכה לא מקוונת, או כל צינור שבו השעון נמדד בשעות, העסקה פשוטה וה-29× כמעט בחינם.

מה נתב יכול ולא יכול לעשות עם צימוד זה

זו ההשוואה שבה הקטלוג שלנו הוא באמת חד-צדדי, וראוי לומר זאת בגלוי. Grok 4.7 זמין ב-OrcaRouter בתור grok/grok-4.7 במחיר של 2.00$ / 6.00$ של הספק עצמו, עם פלט מקסימלי של 450K ונקודת קצה תואמת OpenAI-SDK בכתובת https://api.orcarouter.ai/v1 — כך שאם ההשוואה גורמת לכם לרצות את המודל של xAI מאחורי אותו מפתח כמו כל השאר, הנתיב הזה קיים כבר היום. Xiaomi MiMo-V2.6-Pro אינו בנתיבים שלנו; לצד הזה, ה-API של הספק עצמו או כל אחד משלושת הספקים המופיעים ברשימה שלו שאתם כבר משתמשים בו הוא התשובה, ולא נעמיד פנים אחרת.

מה שמצדיק את מקומו של ראוטר בהשוואה כמו זו הוא דווקא החלקים שאינם המודל. מפתח אחד ל-200+ מודלים במחיר המחירון של כל ספק עם 0% תוספת משמעותו שהורדת מחיר של ספק מגיעה לחשבונית שלכם באותו יום ולא בחידוש החוזה הבא. מעבר אוטומטי בין שרתים (failover) פירושו שמסלול של 40 t/s שמתדרדר לא גורר איתו את הפייפליין שלכם. ה-DSL לניתוב מאפשר לבצע את הפיצול לפי העלות המפורסמת לכל משימה ולא לפי נאמנות למותג — מודל זול לנפח גבוה, מודל חזק לקריאות הקשות, בהחלטה לפי כל בקשה. ולעומסי העבודה שבהם אף אחד מהמודלים לא ממש מתאים, מיזוג מודלים יכול להריץ כמה מהם מאחורי קריאה אחת.

Screenshot of the OrcaRouter model page for Grok 4.7, captured 25 September 2026. The page shows the model id grok/grok-4.7, a maximum output of 450K, output text, public benchmarks by grok dated 2026-09-21, a price of $2.00 per 1M input and $6.00 per 1M output, and an OpenAI-SDK-compatible code sample whose base URL is https://api.orcarouter.ai/v1 and whose model field is grok/grok-4.7.

שאלות שהשוואה זו מעלה בדרך כלל

האם מכפיל ה־29× מחזיק מעמד עבור עומס העבודה שלי? רק אם תמהיל הטוקנים שלך דומה לזה של הרצת האינדקס. אם הפלטים שלך קצרים והפרומפטים שלך ארוכים ושמורים במטמון, המכפיל מתכווץ לעבר פער התעריפים של 6.9× בפלט ומתרחב בקלט, שם ההנחה של 99% של MiMo-V2.6-Pro היא הגורם המכריע. אם הפלטים שלך הם עקבות חשיבה ארוכים, הוא מתרחב מעבר ל־29×, כי קנס האריכות של Grok 4.7 פרופורציונלי לאורך הפלט.

האם ה-46 בכל צד הוא אותו 46? זהו אותו מדד, אותה סקאלה ואותו סולם — תתי-הציונים הבסיסיים היו 46.32 ו-46.45, פער של 0.13 נקודות, והמדד מעגל את שניהם ל-46. Artificial Analysis אינה מפרסמת פילוחים לפי הערכה בודדת עבור אף אחד מהמודלים, ולכן הציון המשולב הוא הרזולוציה העדינה ביותר שזמינה, ואין לפרש הבדל של 0.13 נקודות כדירוג יכולות.

לאיזה מהם אמור פרויקט חדש להיות מוגדר כברירת מחדל? אם עומס העבודה הוא אצווה, סובלני להשהיה ורגיש לעלות, MiMo-V2.6-Pro במחיר של $0.13 למשימה הוא ברירת המחדל, והמשקלים הפתוחים פירושם שאינך חשוף לתמחור של ספק יחיד. אם אתה צריך את המודל של xAI ספציפית — תוצאות ה-harness של Grok Build, המיקום ב-AA-Briefcase, חלון ההקשר של 500K עם תאריך חיתוך של מאי 2026 — Grok 4.7 הוא מסלול פעיל ב-OrcaRouter היום, והפרמיה למשימה היא המחיר של היכולת הספציפית הזו. אין כאן מודל שמנצח בשניהם.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית