
Xiaomi MiMo-V2.6-Pro מול Grok 4.7: זול פי 30 לכל משימה, ואף אחד מהם לא מהיר
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 36 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 181 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
Xiaomi MiMo-V2.6-Pro ו-Grok 4.7 יצאו שניהם ב-21 בספטמבר 2026, שניהם מגיעים ל-46 במדד Artificial Analysis Intelligence Index v4.3.2, ושניהם מכונים איטיים בעמוד שמדד אותם — 43.6 אסימוני פלט לשנייה עבור MiMo-V2.6-Pro לעומת חציוני של 67.1, ו-40 עבור Grok 4.7 במאמץ xhigh. מה שמבדיל ביניהם הוא העלות של תשובה. הנתון של המעריך לכל משימה הוא $0.13 עבור הצ'קפוינט הפתוח הסיני ו-$3.74 עבור המודל Grok 4.7, פי כ-29. זה לא הבדל בתעריף, או לא רק כזה: תעריף הפלט של Grok 4.7 הוא $6.00 למיליון אסימונים לעומת $0.87, שזה פי שבעה, ושאר המכפיל נובע ממספר האסימונים שכל מודל שורף כדי להגיע לתשובה.
שני מודלים באותו חודש, על אותו מדד, באותו ציון, מתומחרים כאילו הם שייכים לעשורים שונים של השוק. השאלה המעניינת אינה מי מהם מנצח. אלא איזה חלק מאותו 29× אפשר באמת לעקוף — כי בצימוד הזה בדיוק אחד מהשניים הוא מסלול שאפשר לקנות היום, והוא היקר.
אותו יום, אותו ניקוד, חיות שונות
Grok 4.7 הושק ב-21 בספטמבר 2026 במחיר של 2.00 דולר למיליון אסימוני קלט ו-6.00 דולר למיליון אסימוני פלט, עם חלון הקשר של 500,000 אסימונים, נקודת חיתוך ידע ממאי 2026, הנחת מטמון של 75%, וקלט טקסט ותמונה אל מול פלט טקסט. הוא השיג 46 באינדקס במאמץ xhigh, 56 ב-Coding Agent Index בסביבת ההרצה של Grok Build, ו-1,657 Elo ב-AA-Briefcase — רביעי בלוח הזה, אחרי שלוש רשומות של Anthropic, בערך במחצית מהעלות למשימה של Claude Opus 5.
Xiaomi MiMo-V2.6-Pro הוא צ'קפוינט דליל של תערובת מומחים, 1.02 טריליון פרמטרים בסך הכול עם 42 מיליארד פעילים, ברישיון MIT, הקשר של מיליון טוקנים, קלט טקסט, תמונה, דיבור וווידאו אל מול פלט טקסט, 0.43 דולר ו-0.87 דולר למיליון טוקנים עם הנחת מטמון של 99% שמצמצמת את תעריף הקלט האפקטיבי לכמעט אפס בפרומפט חם. Artificial Analysis ממקמת אותו במקום הראשון מבין 114 מודלים עם משקלים פתוחים במדד ובמקום השנים-עשר מבין 114 מבחינת עלות. ניתן לגשת אליו דרך שלושה ספקי API. הוא אינו נמצא במסלולים שלנו, ואנחנו לא מפרסמים מודל לפני שספק הטמיע אותו.
השורה היחידה שמכריעה את זה
• עלות לכל משימת אינדוקס — MiMo-V2.6-Pro $0.13; Grok 4.7 $3.74 — פי 29 • קצב פלט — MiMo-V2.6-Pro $0.87 / 1M; Grok 4.7 $6.00 / 1M — פי 6.9 • אסימוני פלט בהרצת האינדוקס — MiMo-V2.6-Pro 140M; Grok 4.7 240M, מול חציון של 88M • מהירות פלט — MiMo-V2.6-Pro 43.6 t/s; Grok 4.7 40 t/s — שתיהן מתחת לחציון • חלון הקשר — MiMo-V2.6-Pro 1M; Grok 4.7 500K • משקלים — MiMo-V2.6-Pro ברישיון MIT וניתן להורדה; Grok 4.7 קנייני, API בלבד
קראו את שני התבליטים הראשונים יחד וצורת הפער מתבהרת. במחיר המחירון, השניים רחוקים זה מזה פי 6.9 בפלט. בהרצת האינדקס הם רחוקים זה מזה פי 29 במה שעולה תשובה. הגורם המכפיל שביניהם הוא מילוליות: Grok 4.7 יצר 240 מיליון טוקנים בפלט לעומת חציון של 88 מיליון במחלקה שלו, ו-MiMo-V2.6-Pro יצר 140 מיליון. זהו קנס טוקנים של פי 1.71 שיושב מעל קנס התעריף של פי 6.9, ו-1.71 × 6.9 הוא 11.8 — יתרת המרחק עד 29 מגיעה מצד הקלט, שם הנחת המטמון של 99% ותעריף הקלט של $0.43 של MiMo-V2.6-Pro עושים את העבודה הכבדה בעומס עבודה שיש בו ולו קידומת חוזרת אחת.

מילוליות היא המספר שאנשים משמיטים מהאומדן.
מודלים של עלויות נבנים בדרך כלל ממחירון ומספירת טוקנים משוערת. שני החצאים של זה שגויים כאן. המחירון שגוי משום שהנחת המטמון אינה הערת שוליים — 99% לעומת 75% הם ההבדל בין הנחיית מערכת שעולה לך כסף בכל קריאה לבין עלות כמעט אפסית. ספירת הטוקנים שגויה משום ששני המודלים לא פולטים אותו מספר טוקנים עבור אותה עבודה, והמעריך מדד את ההבדל: 240 מיליון לעומת 140 מיליון, פער של פי 1.71 בבנצ'מרק זהה.
אף אחד מאלה אינו פרוקסי שאפשר לקרוא מדף מפרט. דירוג המילוליות של Grok 4.7 הוא #94 מתוך 210 מודלים בקטגוריה שלו; דירוג העלות של MiMo-V2.6-Pro הוא #12 מתוך 114 בקטגוריה שלו. צוות שמצטט את כרטיס התעריפים של Grok 4.7 ומניח עומס עבודה נייטרלי מבחינת טוקנים יחזות בקירוב רבע ממה שהאינדקס הוציא בפועל לכל משימה. התיקון אינו בכך שתשתמש גם בעלות האינדקס כאומדן שלך — היא מדידה של הצורה של בנצ׳מרק אחד. אלא בכך שתמדוד את מספרי הטוקנים שלך משני הצדדים לפני התחייבות, משום שהפער בין שני המודלים הוא פי 6.9 על הנייר ופי 29 בפועל, ורק אחד מהמספרים האלה אמיתי עבור התעבורה שלך.

שניהם איטיים, וזה לא תיקו.
Artificial Analysis מדדה את Grok 4.7 ב-40 טוקני פלט לשנייה ומכנה אותו “מבין האיטיים ביותר”; את MiMo-V2.6-Pro ב-43.6 ומכנה אותו “איטי באופן ניכר”. שתי הקריאות הללו קרובות מספיק כדי שמהירות לא תשמש כשובר שוויון ביניהן. אבל החציונים שמתחת לא כאלה: 67.1 עבור שדה המשקלים הפתוחים ש-MiMo-V2.6-Pro נמצא בו. שני המודלים נמצאים הרבה מתחתיו, ול-MiMo-V2.6-Pro יש גם זמן של 3.17 שניות עד לטוקן הראשון לעומת חציון של 2.31 שניות, וזה המספר שמזיק בלולאה אינטראקטיבית ולא בלולאת אצווה.
אז הסיכום הכנה של צד ההשהיה הוא ש-29× זול יותר לא קונה לך מוצר מהיר יותר, הוא קונה לך מוצר איטי יותר שעולה פחות — ואם המשתמשים שלך מסתכלים על סמן, ההמתנה של 3.17 שניות עשויה לעלות יותר מהטוקנים שנחסכו. עבור עבודת אצווה לילית, הערכה לא מקוונת, או כל צינור שבו השעון נמדד בשעות, העסקה פשוטה וה-29× כמעט בחינם.
מה נתב יכול ולא יכול לעשות עם צימוד זה
זו ההשוואה שבה הקטלוג שלנו הוא באמת חד-צדדי, וראוי לומר זאת בגלוי. Grok 4.7 זמין ב-OrcaRouter בתור grok/grok-4.7 במחיר של 2.00$ / 6.00$ של הספק עצמו, עם פלט מקסימלי של 450K ונקודת קצה תואמת OpenAI-SDK בכתובת https://api.orcarouter.ai/v1 — כך שאם ההשוואה גורמת לכם לרצות את המודל של xAI מאחורי אותו מפתח כמו כל השאר, הנתיב הזה קיים כבר היום. Xiaomi MiMo-V2.6-Pro אינו בנתיבים שלנו; לצד הזה, ה-API של הספק עצמו או כל אחד משלושת הספקים המופיעים ברשימה שלו שאתם כבר משתמשים בו הוא התשובה, ולא נעמיד פנים אחרת.
מה שמצדיק את מקומו של ראוטר בהשוואה כמו זו הוא דווקא החלקים שאינם המודל. מפתח אחד ל-200+ מודלים במחיר המחירון של כל ספק עם 0% תוספת משמעותו שהורדת מחיר של ספק מגיעה לחשבונית שלכם באותו יום ולא בחידוש החוזה הבא. מעבר אוטומטי בין שרתים (failover) פירושו שמסלול של 40 t/s שמתדרדר לא גורר איתו את הפייפליין שלכם. ה-DSL לניתוב מאפשר לבצע את הפיצול לפי העלות המפורסמת לכל משימה ולא לפי נאמנות למותג — מודל זול לנפח גבוה, מודל חזק לקריאות הקשות, בהחלטה לפי כל בקשה. ולעומסי העבודה שבהם אף אחד מהמודלים לא ממש מתאים, מיזוג מודלים יכול להריץ כמה מהם מאחורי קריאה אחת.

שאלות שהשוואה זו מעלה בדרך כלל
האם מכפיל ה־29× מחזיק מעמד עבור עומס העבודה שלי? רק אם תמהיל הטוקנים שלך דומה לזה של הרצת האינדקס. אם הפלטים שלך קצרים והפרומפטים שלך ארוכים ושמורים במטמון, המכפיל מתכווץ לעבר פער התעריפים של 6.9× בפלט ומתרחב בקלט, שם ההנחה של 99% של MiMo-V2.6-Pro היא הגורם המכריע. אם הפלטים שלך הם עקבות חשיבה ארוכים, הוא מתרחב מעבר ל־29×, כי קנס האריכות של Grok 4.7 פרופורציונלי לאורך הפלט.
האם ה-46 בכל צד הוא אותו 46? זהו אותו מדד, אותה סקאלה ואותו סולם — תתי-הציונים הבסיסיים היו 46.32 ו-46.45, פער של 0.13 נקודות, והמדד מעגל את שניהם ל-46. Artificial Analysis אינה מפרסמת פילוחים לפי הערכה בודדת עבור אף אחד מהמודלים, ולכן הציון המשולב הוא הרזולוציה העדינה ביותר שזמינה, ואין לפרש הבדל של 0.13 נקודות כדירוג יכולות.
לאיזה מהם אמור פרויקט חדש להיות מוגדר כברירת מחדל? אם עומס העבודה הוא אצווה, סובלני להשהיה ורגיש לעלות, MiMo-V2.6-Pro במחיר של $0.13 למשימה הוא ברירת המחדל, והמשקלים הפתוחים פירושם שאינך חשוף לתמחור של ספק יחיד. אם אתה צריך את המודל של xAI ספציפית — תוצאות ה-harness של Grok Build, המיקום ב-AA-Briefcase, חלון ההקשר של 500K עם תאריך חיתוך של מאי 2026 — Grok 4.7 הוא מסלול פעיל ב-OrcaRouter היום, והפרמיה למשימה היא המחיר של היכולת הספציפית הזו. אין כאן מודל שמנצח בשניהם.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
