כרטיס כותרת שנוצר, שעליו הכיתוב MiMo-V2.6-Pro מול GPT-5.6 Sol, עם כתובית המשנה פי 15 מהעלות לכל משימה עבור נקודת אינדקס אחת מתחתיו, ושלושה אייקוני קו שטוחים מעל הכותרת המרמזים על מד עלות, כרטיס ניקוד והודעה מתוארכת. הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

MiMo-V2.6-Pro מול GPT-5.6 Sol: נקודת מדד אחת עולה פי חמישה עשר יותר לכל משימה

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ב-Artificial Analysis Intelligence Index v4.3.2, כפי שנקרא ב-25 בספטמבר 2026, GPT-5.6 Sol במאמץ מקסימלי מקבל ציון 47 ו-MiMo-V2.6-Pro של Xiaomi מקבל ציון 46. נקודה אחת. המספר שבאמת מפריד ביניהם אינו הציון, וגם לא התעריף לכל טוקן — אלא העלות של משימת אינדקס בודדת, שאותה Artificial Analysis מפרסמת כ-1.99 דולר עבור GPT-5.6 Sol וכ-0.13 דולר עבור MiMo-V2.6-Pro. פי חמישה עשר מהכסף עבור נקודה אחת. ונכון לקריאה הזו, העמוד של המעריך עצמו עבור אותו דגם נושא הודעת הפסקת תמיכה, מכיוון ש-GPT-6 Sol החליף אותו.

Xiaomi פרסמה את המשקלים ואת הדוח הטכני של MiMo-V2.6-Pro ב-21 בספטמבר 2026, ארבעה ימים לפני הקריאה הזו; OpenAI שחררה את GPT-5.6 Sol ב-9 ביולי 2026. שתי העובדות שלעיל חדשות מאז שהזיווג הזה נסקר לאחרונה, והן מושכות לכיוונים מנוגדים. הודעת ההתיישנות אומרת שההשוואה היא מול מודל ש-OpenAI כבר עברה הלאה ממנו. הנתון לכל משימה אומר שהדבר שנראה כמו שגיאת עיגול כששני המודלים צוטטו במחיר מחירון הוא, בעומס עבודה אמיתי, ההחלטה כולה. איזו מהשתיים חשובה תלוי בשאלה אם אתה קונה מודל או מחליף מודל קיים.

מה שני העמודים אומרים כעת

GPT-5.6 Sol שוחרר ב-9 ביולי 2026 כמוביל משפחת GPT-5.6. מחיר המחירון שלו הוא $4.00 למיליון טוקנים של קלט ו-$20.00 למיליון טוקנים של פלט ב-API של OpenAI מצד ראשון, עם הנחת מטמון של 90%, והעמוד מתעד 90 מיליון טוקנים של פלט שנוצרו לאורך הרצת האינדקס לעומת חציון של 88 מיליון. הוא מדד 73 טוקנים של פלט לשנייה, שאותו עמוד מכנה מהיר מהממוצע לעומת חציון של 72 t/s. רשומת האינדקס שלו ממוקמת בדירוג 19 מתוך 210 מודלים במחלקה שלו.

Xiaomi MiMo-V2.6-Pro הוא נקודת ביקורת של תערובת מומחים דלילה עם 1.02 טריליון פרמטרים סך הכל ו-42 מיליארד פעילים, ברישיון MIT, עם חלון הקשר של 1M אסימונים וקלט טקסט, תמונה, דיבור ווידאו כנגד פלט טקסט. הוא מתומחר ב-$0.43 וב-$0.87 למיליון אסימונים עם הנחת מטמון של 99% — עשירית מקצב הקלט של Sol וחלק עשרים ושלושה מקצב הפלט של Sol. הוא ייצר 140 מיליון אסימוני פלט בהרצת האינדקס, והוא מדד 43.6 אסימוני פלט לשנייה, שהעמוד שלו מתאר כאיטי במיוחד לעומת חציון של 67.1 t/s.

• עלות משימת האינדקס — MiMo-V2.6-Pro ‏$0.13; GPT-5.6 Sol ‏$1.99 — הפער הוא פי 15 • מחיר מחירון — MiMo-V2.6-Pro ‏$0.43 / $0.87 ל-1M; GPT-5.6 Sol ‏$4.00 / $20.00 • הנחת מטמון — MiMo-V2.6-Pro ‏99%; GPT-5.6 Sol ‏90% • אסימוני פלט בהרצת האינדקס — MiMo-V2.6-Pro ‏140M; GPT-5.6 Sol ‏90M • מהירות פלט — MiMo-V2.6-Pro ‏43.6 t/s, לעומת חציון של 67.1; GPT-5.6 Sol ‏73 t/s, לעומת חציון של 72 • חלון הקשר ומשקלות — MiMo-V2.6-Pro ‏1M וברישיון MIT; GPT-5.6 Sol ‏1M וקנייני

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

הודעת ההתיישנות היא השורה בעלת ההשלכות המשמעותיות יותר.

Artificial Analysis פותחת כעת את העמוד של GPT-5.6 Sol עם הודעה ממוסגרת: "המודל הזה מיושן. אנחנו ממשיכים לבצע בנצ'מרק ביצועים רק עבור עומס ברירת המחדל של 10k טוקני קלט", ולאחריה המשפט ש-OpenAI השיקה מודל חדש יותר, GPT-6 Sol (max), ושאותו יש לשקול במקום. ה-47 באינדקס הוא אפוא קריאה של מודל שכבר אינו הדבר שיש לקנות. זה לא הופך את הקריאה לשגויה — היא נמדדה באותו אינדקס, באותו יום, ובאותה הגדרת מאמץ כמו ה-46 — אבל זה משנה מה מטרת ההשוואה. זו כבר לא השאלה "באיזה דגם דגל עליי להשתמש". זו השאלה "מה עולה פסגת הלוח הקנייני, ברגע שבו היא הייתה הפסגה".

הניסוח מחדש הזה חשוב יותר ממה שהוא נשמע, משום שהודעות התיישנות בדפי מעריך הן אחד המקומות הבודדים שבהם קצב המוצרים של ספק מתגלה כשינוי בנתונים ולא כהודעה לעיתונות. הציון קפוא; המודל אינו מוצע. כל דבר שתבנה מול ה-47 נבנה מול תמונת מצב.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

למה המספר לכל משימה הוא זה שמולו יש למדל

תעריפים לפי טוקן מחמיאים למודלים זולים ומטעים ביחס לעומסי עבודה שאינם ניטרליים מבחינת טוקנים. עלות משימת האינדקס היא מדידה שונה: היא מה שהמעריך בפועל הוציא כדי לקבל תשובה אחת מכל מודל, שמגלמת גם את התעריף וגם את מספר הטוקנים שהמודל בחר לפלוט. MiMo-V2.6-Pro פולט יותר טוקנים מ-Sol בהרצת האינדקס — 140 מיליון לעומת 90 מיליון, בערך פי 1.6 — ועדיין עולה $0.13 למשימה לעומת $1.99. יתרון התעריף הוא בערך פי עשרים ושלושה בתפוקה; קנס המילוליות הוא פי 1.6; המכפלה היא פער של פי חמישה עשר למשימה.

זה החשבון שמודל עלויות צריך להיבנות עליו, וזה החשבון שנעלם מהעין אם משווים $0.87 מול $20.00 ועוצרים. הוא גם אומר לך מה היה מפריך את המסקנה. אם עומס העבודה שלך נשלט על ידי פלטים קצרים מאוד, מספר הטוקנים של Sol מתכווץ לעבר שלך ופער התעריף של פי עשרים ושלושה עושה את רוב העבודה, כך שהמכפיל האמיתי נע לעבר פער התעריף ולא מתרחק ממנו. אם עומס העבודה שלך נשלט על ידי עקבות חשיבה ארוכים, המילוליות של 1.6× של MiMo-V2.6-Pro מצטברת, ו-$0.13 הופך לתקרה במקום לאומדן. הנתון שפורסם הוא מדידה של הצורה של בנצ'מרק אחד, לא הצעת מחיר שאפשר למסור למחלקת הכספים.

שורת ההשהיה היא משקל הנגד הכנה

בקצב של 43.6 אסימוני פלט לשנייה, MiMo-V2.6-Pro איטי יותר מ-GPT-5.6 Sol, שנמדד באותו יום על 73 — ואיטי יותר מהמודלים שאליהם העמוד שלו עצמו משווה אותו, שהחציון שלהם הוא 67.1. העמוד שלו אומר זאת במפורש: "איטי במיוחד". עבור צינור עיבוד באצווה זוהי עלות תפוקה שאפשר לתמחר. עבור סוכן אינטראקטיבי זוהי החלטת מוצר, וזול פי חמישה עשר למשימה לא הופך מודל איטי למהיר. אם האילוץ שלך הוא תקציב לכל תור ולא חשבון חודשי, היחס שקובע הוא 43.6 מול 73, ו-MiMo-V2.6-Pro מפסיד בו.

לאן זה מגיע בנתב

הצורה השימושית של השילוב הזה אינה "לבחור אחד מהם". היא בכך ששני המודלים עונים לאותו אינדקס, והמעריך מפרסם עלות לכל משימה עבור כל אחד מהם, כך שאפשר לפצל לפי עלות מדודה ולא לפי דרגות של ספקים. ב-OrcaRouter הקטלוג מגיע ל-200+ מודלים מאחורי מפתח אחד, במחיר המחירון של כל ספק עם 0% תוספת — הורדת מחיר מצד הספק מגיעה לחשבונית שלכם עוד באותו יום, בלי חוזה נוסף שצריך לנהל משא ומתן מחדש — וה-DSL לניתוב מאפשר לעומס עבודה לשלוח את הקריאות הזולות בנפח גבוה למודל אחד ואת הקשות לאחר, לפי משימה ולא לפי מותג. מעבר כשל אוטומטי מכסה את המקרה שבו המסלול הזול נפגע. Xiaomi MiMo-V2.6-Pro אינו נמצא במסלולים שלנו — איננו מפרסמים מודל לפני שהספק השלים את ההטמעה שלו — ולכן עבור הצד הזה של ההשוואה התשובה הכנה היא ה-API של הספק עצמו או כל פלטפורמה מתארחת שכבר יש לכם קשר איתה.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

מה לעשות עם זה עד השבוע הבא

שני דברים השתנו ב-25 בספטמבר 2026 ורק אחד מהם נוגע למחיר. GPT-5.6 Sol נושא הודעת התיישנות במדד שבו הוא נמדד ב-47, מה שמוציא אותו מכלל החלטה על בסיס מדד ומותיר אותו כהפניה בלבד. MiMo-V2.6 נמדד ב-$0.13 למשימת מדד לעומת $1.99 של Sol, שזה פי חמישה עשר יותר כסף עבור נקודת מדד אחת — והוא 43.6 טוקנים לשנייה, שזה איטי יותר מהמודל שאליו הוא מושווה ואיטי יותר מהחציון של המחלקה שלו. הרץ את שני הנתונים האלה מול התעבורה שלך לפני שכל אחד מהמספרים הופך להחלטה: העלות למשימה היא מדידה, לא תעריף, והשהיה היא מדידה, לא דעה. אם הפלטים שלך קצרים ולא אינטראקטיביים, הטיעון בעד צ'קפוינט פתוח חזק יותר ממה שפער המדד מרמז. אם הפלטים שלך ארוכים או שהמשתמשים שלך ממתינים, החיסכון פי חמישה עשר קונה לך מוצר איטי יותר, וזהו שיקול שרק עומס העבודה שלך יכול לתמחר.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית