כרטיס כותרת שנוצר המשווה בין Xiaomi MiMo-V2.6-Pro ל-Gemini 3.1 Pro Preview. הכרטיס השמאלי מציג Intelligence Index v4.3.2: 46, $0.43 קלט / $0.87 פלט לכל 1M, זמן עד לאסימון הראשון: 2.15 שניות, ו-GA - משקלים ברישיון MIT; הכרטיס הימני מציג Intelligence Index v4.3.2: 30, $2.00 קלט / $12.00 פלט לכל 1M, זמן עד לאסימון הראשון: 63.62 שניות, ו-Preview - קנייני. בתחתית כתוב: שני הציונים ב-Artificial Analysis Intelligence Index v4.3.2, נקראו ב-22 בספטמבר 2026. הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

MiMo-V2.6-Pro מול Gemini 3.1 Pro: פער של 16 נקודות שקיים רק בגרסה אחת של האינדקס

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שים את Xiaomi MiMo-V2.6-Pro ואת Gemini 3.1 Pro Preview זה לצד זה במדד האינטליגנציה של Artificial Analysis ותקבל 46 מול 30 — יתרון של שישה־עשר נקודות למודל שעולה חמישית מזה של האחר בעלות הקלט. שים אותם זה לצד זה לפי המספרים ששני היצרנים פרסמו בהשקות שלהם עצמם, ו-Gemini 3.1 Pro מנצח באחת־עשרה. שתי הקריאות מגיעות מאותו מעריך. הסיבה שהן חלוקות היא הדבר השימושי ביותר להבנה בהשוואת מודלים בספטמבר 2026: המדד נבנה מחדש מתחת לשניהם, וציון הוא בעל משמעות רק לצד מספר הגרסה שהפיק אותו.

ה-Composite של v4.3.2 הוא הנוכחי. הוא מריץ עשר הערכות — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience ו-AA-LCR v1.1 — ועליו, לפי קריאה מ-22 בספטמבר 2026, המודל של Xiaomi מקבל 46 ושל Google מקבל 30. בהשקה ב-19 בפברואר 2026, Gemini 3.1 Pro Preview דווח על 57 בסולם שהיה אז בתוקף, מה שהוביל את הטבלה. שני הנתונים האלה של Gemini אינם ירידה. הם שני סרגלי מדידה שונים.

מה כל מודל הוא בפועל

Gemini 3.1 Pro Preview הוא מודל החשיבה המתקדם של Google, שיצא ב-19 בפברואר 2026 ועדיין נושא את תווית ה-Preview גם שבעה חודשים לאחר מכן. חלון ההקשר שלו הוא 1M אסימונים, הפלט מוגבל ל-65,536 אסימונים — מוצג כ-64K על ידי Artificial Analysis וכ-65K בעמוד המודל שלנו — והוא קולט טקסט, תמונות, קובצי PDF, אודיו וווידאו, ופולט טקסט. הוא קנייני, כאשר מספר הפרמטרים שלו לא נחשף וחתך הידע שלו הוא ינואר 2025. ה-API של Google עצמה גובה $2.00 למיליון אסימוני קלט ו-$12.00 למיליון אסימוני פלט מתחת ל-200K קלט, ועובר ל-$4.00 ו-$18.00 מעליו, כאשר קלט במטמון עולה $0.20.

Xiaomi MiMo-V2.6-Pro הפך לזמין באופן כללי ב-22 בספטמבר 2026, כאשר מאגרי נקודות הביקורת של למידת החיזוק הופיעו יום קודם לכן. זהו מודל תערובת מומחים דליל עם 1.02 טריליון פרמטרים כוללים ו-42 מיליארד מופעלים לכל טוקן, עם חלון הקשר של 1M טוקנים, מולטימודליות מקורית על פני טקסט, תמונה, וידאו ואודיו, ומשקלים להורדה ברישיון MIT. Xiaomi שמרה על התמחור של הדור הקודם MiMo-V2.5 במקום לתמחר מחדש את נקודת הביקורת החדשה כלפי מעלה: 0.43 דולר למיליון טוקנים בקלט ו-0.87 דולר למיליון בפלט, עם הנחת מטמון של 99% ותעריף משוקלל של 0.18 דולר בתמהיל של 7:2:1 של פגיעות מטמון/קלט/פלט.

• משקלים — Xiaomi MiMo-V2.6-Pro ברישיון MIT וניתן להורדה; Gemini 3.1 Pro Preview קנייני, API בלבד

• פרמטרים — MiMo-V2.6-Pro 1.02T סה"כ / 42B פעילים; Gemini 3.1 Pro Preview לא נחשף

• הקשר — 1M טוקנים בשניהם; Gemini 3.1 Pro Preview מגביל את הפלט ל-65,536 טוקנים, MiMo-V2.6-Pro לא מפרסם מגבלה מקבילה

• מודאליות — MiMo-V2.6-Pro מקבל טקסט, תמונה, וידאו ואודיו; Gemini 3.1 Pro Preview מקבל טקסט, תמונה, PDF, אודיו ווידאו

• מחיר מחירון — MiMo-V2.6-Pro ‏$0.43 / $0.87 לכל מיליון טוקנים; Gemini 3.1 Pro Preview ‏$2.00 / $12.00 עבור קלט מתחת ל-200K, ‏$4.00 / $18.00 מעל

• מטמון — MiMo-V2.6-Pro הנחה של 99%; Gemini 3.1 Pro Preview ‏$0.20 לכל מיליון קריאות מהמטמון

• מהירות — MiMo-V2.6-Pro 134.3 אסימוני פלט/שנייה; Gemini 3.1 Pro Preview 121.8

• זמן עד לאסימון הראשון — MiMo-V2.6-Pro ‏2.15 שניות; Gemini 3.1 Pro Preview ‏63.62 שניות

• העלות הנמדדת להרצת האינדקס — MiMo-V2.6-Pro $206.66, או $0.13 למשימה; Gemini 3.1 Pro Preview $1,310.21, או $0.67 למשימה

A two-column scoreboard titled MiMo-V2.6-Pro vs Gemini 3.1 Pro, subtitled Same evaluator, two index versions, and a sixteen-point gap that belongs to the ruler. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; list price $0.43 / $0.87 per 1M; cost to run the index $206.66; cost per index task $0.13; speed 134.3 tokens per second; time to first token 2.15 s. The right column, Gemini 3.1 Pro Preview, reads Intelligence Index v4.3.2 30; list price $2.00 / $12.00 per 1M; cost to run the index $1,310.21; cost per index task $0.67; speed 121.8 tokens per second; time to first token 63.62 s. A footer notes both scores are Artificial Analysis Intelligence Index v4.3.2 read 22 September 2026, and that Gemini 3.1 Pro Preview was reported at 57 on the index scale current at its 19 February 2026 launch. The OrcaRouter logo is composited in the bottom-right corner.

תווית התצוגה המקדימה היא ההבדל האמיתי

כל מה שלמעלה הוא מפרט. השורה היחידה שמשנה את האופן שבו יש לקרוא את כל ההשוואה היא המילה "preview". מודל preview הוא מועמד שגוגל לא התחייבה להשאיר בנקודת הקצה הזו. זה משנה לעמוד השוואה באופן שפער של שישה־עשר נקודות במדד לא משנה, מפני שמודל שאי אפשר להסתמך על כך שהוא יהיה שם בעוד חצי שנה אינו מודל שמבססים עליו תקן — והמשפחה של גוגל עצמה כבר עברה הלאה ממנו. Gemini 3.6 Flash ו-Gemini 3.8 Flash נמצאים מעל Gemini 3.1 Pro בעבודת קידוד ובעבודה סוכנית בעלות נמוכה יותר, ולכן סקירה טכנית אחת של מהדורת 3.1 Pro תיארה אותו כדור קודם באופן מובהק. עמוד AA עצמו מציג אותו בדירוג 71 מתוך 202 באינטליגנציה.

המודל של Xiaomi נמצא בעמדה הפוכה. הוא שוחרר השבוע, המשקלים זמינים תחת MIT, ומאפייני ההגשה הם הדבר החזק ביותר בו. 134.3 אסימוני פלט לשנייה ממקמים אותו במקום ה-11 מתוך 114 מודלים שנמדדו למהירות, ו-2.15 שניות עד לאסימון הראשון הן בערך פי 30 מהר יותר מ-63.62 השניות של Gemini 3.1 Pro Preview. עבור אפליקציה אינטראקטיבית, זה לא שובר שוויון. זה ההבדל בין מוצר להדגמה, וזה המספר שסביר ביותר להיות בלתי נראה בטבלת בנצ'מרקים.

לאן הכסף באמת הולך

חישוב לפי טוקן ממעיט בפער בין השניים, כי המודלים לא שורפים את אותו מספר טוקנים כדי לסיים את אותה משימה. הנתון הנקי יותר הוא מה ש-Artificial Analysis מדדה כדי להריץ את ה-Intelligence Index המלא שלה כנגד כל אחד: $206.66 עבור MiMo-V2.6-Pro ו-$1,310.21 עבור Gemini 3.1 Pro Preview. אותה סוויטה, אותו הרנס, נמדד באותה צורה — הבדל של פי 6.3 על סט משימות זהה, ואחד שכבר מביא בחשבון את העובדה שמודלי חשיבה פולטים הרבה טוקנים בזמן החשיבה. Gemini 3.1 Pro Preview ייצר 67 מיליון טוקני פלט לאורך המדד; החציון עבור מודלים בקטגוריית המחיר שלו הוא 90 מיליון, כך שהוא למעשה חסכוני יותר לנקודה מאשר עמיתיו, והוא עדיין עולה פי שישה יותר להערכה מאשר המודל של Xiaomi.

ואז תריץ מולו לולאת פרודקשן. הרצת סוכן בת 30 שלבים שקוראת 200,000 טוקנים של הקשר בכל שלב וכותבת 2,000 טוקנים בכל שלב היא 6 מיליון טוקני קלט ו-60,000 טוקני פלט לכל הרצה. ב-Gemini 3.1 Pro Preview מתחת למדרגת 200K זה $12.00 של קלט ו-$0.72 של פלט — $12.72 לכל הרצה. ב-MiMo-V2.6-Pro זה $2.58 ו-$0.05 — $2.63. אם חוצים 200,000 טוקנים של קלט במודל של Google, תעריף הקלט מוכפל ל-$4.00, ואז אותה לולאה עולה $24.00 לפני פלט. שמירה במטמון מזיזה את שני המספרים, אבל הנחה של 99% במודל זול לעומת קריאה ממטמון בעלות $0.20 במודל יקר משאירה את המודל היקר בפער של סדר גודל מקדימה בלולאה עתירת הקשר.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 22 September 2026. The header reads 46 Artificial Analysis Intelligence Index, ranked first of 114 in its class; 134.3 output tokens per second, ranked eleventh of 114; $0.435 input and $0.87 output per 1M tokens with a 99% cache discount; $0.13 cost per Intelligence Index task, ranked twelfth of 114; and 140M output tokens from the Intelligence Index. Technical specifications list reasoning Yes, input modality text, image, speech and video, output modality text, a 1M-token context window, 1.0T total parameters, 42B active parameters, an MIT licence and Hugging Face model weights, under a breadcrumb reading Xiaomi, Open weights model, Released September 2026. A comparison summary notes it cost $206.66 to evaluate MiMo-V2.6-Pro on the Intelligence Index.

שאלת הניתוב, בניסוח כן

הנה החלק שקל לטעות בו. Gemini 3.1 Pro Preview נמצא ב-OrcaRouter כ-google/gemini-3.1-pro-preview, נגיש דרך מפתח אחד תואם OpenAI במחיר המחירון של הספק עם 0% תוספת — כך ששינוי מחיר של Google מתעדכן אצלנו באותו יום ולא במחזור החיוב הבא. Xiaomi MiMo-V2.6-Pro אינו נמצא ב-OrcaRouter. אף דגם של Xiaomi אינו שם, ואמירה מפורשת על כך מועילה יותר מאשר לאפשר לדף דגם לרמוז אחרת. להגיע אליו היום משמעו הפלטפורמה של Xiaomi עצמה או אחד מהקטלוגים של צדדים שלישיים שמפרטים אותו.

האסימטריה הזו היא בדיוק הסיבה לכך שנתב זוכה למקום בהשוואה הזו במקום להיות הערת שוליים בה. שני המודלים לא מתחרים על אותן בקשות. Gemini 3.1 Pro Preview הוא המודל הקיים שאולי אתה כבר משלם עליו, והשאלה שהעמוד הזה עונה עליה היא האם המודל החדש והזול יכול לקחת חלק מהתעבורה שלו. הפעלת המבחן הזה כראוי משמעה לשלוח את ההנחיות שלך לשניהם ולהשוות את התשובות, לא לקרוא אינדקס — ולעשות זאת על ידי פתיחת חוזה שני, מפתח שני וקשרי חיוב שני הוא החיכוך שמונע מהמבחן הזה לקרות בכלל. מפתח אחד, שני המסלולים היכן שאנחנו מנתבים אותם, וההשוואה הופכת לשינוי בקונפיגורציה. מעבר אוטומטי מכסה את החצי השני: מודל תצוגה מקדימה יכול להימשך או להיות מוגבל בקצב בהתראה קצרה, ומסלול שני מאחורי אותו endpoint הוא מה שהופך את זה מהשבתה להחלטת ניתוב.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview, captured 22 September 2026. The page lists the model id google/gemini-3.1-pro-preview, by Google, dated 2026-02-19, with Vision, Audio, Tools, JSON and Reasoning capability badges, a 1M-token context window, a maximum output of 65K tokens, input of audio, file, image, text and video with text output, $2.00 per 1M input tokens and $12.00 per 1M output tokens, 109.8M tokens of traffic over seven days, and a code sample calling the model through the OpenAI-compatible base URL api.orcarouter.ai/v1.

איזה מהם לבחור

בחר את Gemini 3.1 Pro Preview כאשר המשימה דורשת קלט PDF ואודיו באופן מובנה, כאשר אתה כבר נמצא בתוך האקוסיסטם של Google, או כאשר אתה זקוק ספציפית להתנהגות של אותו מודל ויכול לחיות עם סיכון ההתיישנות של נקודת קצה בתצוגה מקדימה. זמן ההגעה לטוקן הראשון של 63 שניות אומר שהוא למעשה מודל לעבודות אצווה ועומסי עבודה לא מקוונים, לא משנה מה השיווק אומר על אינטראקטיביות.

בחרו ב-MiMo-V2.6-Pro כשהנפח הוא האילוץ, כשהלולאה עתירת הקשר וחזרתית, כשאתם רוצים את המשקלים על החומרה שלכם — רישיון MIT מתיר פריסה מסחרית, שינוי ואימון נוסף — או כשהשהיית הטוקן הראשון היא חלק מהמוצר. זהו המקרה הנדיר של מודל זול שהוא גם המהיר, ושילוב כזה שווה יותר ממה ששש-עשרה נקודות המדד מרמזות.

מה שישנה את התמונה הזו הוא יורש לא-תצוגה מקדימה ל-Gemini 3.1 Pro, או שחזור בלתי תלוי של נתוני DeepSWE ששיאומי פרסמה מהארנס שלה — 72.57 עבור Pro, 65.68 עבור Flash, תוך מעבר מ-58.4 ו-48.8 בהתאמה לאורך ריצת למידת חיזוק. המספרים הללו מדווחים על ידי הספק, הוערכו על גריידר של שיאומי עם mini-swe-agent בממוצע של שלוש, ולא הוגשו ללוח תוצאות ציבורי. עד שמישהו יריץ אותם מחדש, ה-Artificial Analysis 46 הוא המספר שיש לצטט, והוא נמדד על אותו סרגל כמו ה-30.

OrcaRouter מציג 200+ מודלים מאחורי נקודת קצה אחת תואמת OpenAI במחיר המחירון של הספק עם תוספת של 0%, כך ששינוי מחיר של ספק נכנס לתוקף כבר באותו יום.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית