כרטיס הירו שנוצר שכותרתו 'שני מסלולים מהירים, בהפרש של שישה-עשר יום' עם כותרת המשנה 'GPT-6.1 Ultrafast מול Xiaomi MiMo v2.6 Pro Ultraspeed', פאנל שמאלי שבו כתוב 'פי 6 מהסטנדרט', 'API סגור' ו'מכפיל מהירות שאול מ-GPT-6 Astra', ופאנל ימני שבו כתוב 'בערך פי 10 מהסטנדרט', 'משקולות MIT' ו'סה"כ 1.02T / 42B פעילים', מעל כותרת תחתונה שבה כתוב 'נתוני ספקים וקטלוג, ספטמבר–אוקטובר 2026; אין מדידות בלתי תלויות של אף אחת מהדרגות.'
Engineering & Research

GPT-6.1 Ultrafast מול Xiaomi MiMo v2.6 Pro Ultraspeed: שני נתיבים מהירים, אחד מספר כמה זה עלה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שתי הדרכים המהירות ביותר לקנות מודל חזיתי הועמדו למכירה בהפרש של שישה עשר ימים זו מזו, ורק אחת מהן סיפרה לך כיצד הופקה המהירות. GPT-6.1 Ultrafast — שכבת השירות מעל GPT-6.1 Sol, שאותה שחררה OpenAI ב-29 בספטמבר 2026 ואשר קיבלה את השכבה הזו ב-8 באוקטובר 2026 — הוא דגל סגור שאליו מגיעים דרך API, במחיר של פי שישה מ-Standard, בלי שום תיעוד מפורסם של מה שקורה בין המשקולות לבקשה שלך. Xiaomi MiMo v2.6 Pro Ultraspeed, שיצא ב-22 בספטמבר 2026, הוא שכבת מהירות מעל MiMo-V2.6-Pro, נקודת ביקורת ברישיון MIT שגם סביבת הלמידת חיזוק שלה פורסמה על ידי Xiaomi. שתיהן מוכרות השהיה במכפיל. רק המכפיל של Xiaomi יושב על משהו שלקוח יכול לבדוק, וההבדל הזה שווה להחלטה יותר מכל אחת משתי טענות המהירות.

המחיר של שני המסלולים הוא החלק הקל, והוא מכוסה בהמשך. החלק הקשה הוא שדרגת מהירות היא הבטחה לגבי מתן שירות, ושני הספקים נתנו את ההבטחה הזו ברמות גילוי שונות מאוד — אחד שאל את נתון הכותרת שלו ממודל אחות, והשני סיפק את מתכון האימון לצד רשימת המחירים. אם אתם עומדים להעביר עומס ייצור למסלול מהיר, פער הגילוי הוא הסיכון שאתם לוקחים על עצמכם בפועל.

המחירים, כששני הצדדים באותה שורה

שתי הדרגות נמכרות כמכפלה של מסלול סטנדרטי, והמכפלות קרובות מספיק לכך שהמחיר אינו מה שמבדיל ביניהן.

• מסלול סטנדרטי — GPT-6.1 Sol במחיר 2.00$ לקלט / 10.00$ לפלט למיליון טוקנים, לעומת MiMo-V2.6-Pro ב-0.44$ / 0.87$.

• מסלול מהיר — GPT-6.1 Ultrafast במחיר $12.00 / $60.00, לעומת MiMo-V2.6-Pro-UltraSpeed במחיר $4.35 / $8.70.

• המכפיל — בדיוק פי 6 בכל שורה עבור הדרג של OpenAI, בערך פי 9.9 בקלט ובדיוק פי 10 בפלט עבור הדרג של Xiaomi.

• קלט במטמון — GPT-6.1 Sol מציג $0.10 למיליון ב-Standard ו-$0.60 ב-Ultrafast; כרטיס התעריפים של MiMo שאנו יכולים לקרוא אינו מפרסם שורת קלט במטמון נפרדת עבור אף אחד משני המסלולים.

• הקשר ארוך — GPT-6.1 Sol מתמחר מחדש את כל הבקשה בפי 2 תעריפי קלט ומטמון ופי 1.5 פלט מעל 272,000 אסימוני קלט, מה שמעמיד את Ultrafast על $24.00 / $1.20 / $30.00 / $90.00. ל-MiMo-V2.6-Pro יש חלון הקשר של 1M אסימונים ללא קפיצת תמחור מפורסמת מקבילה.

• פער מוחלט — שני המסלולים המהירים רחוקים זה מזה פי 2.8 בקלט ופי 6.9 בפלט, וזהו הפער בין מודל סגור בחזית למודל עם משקולות פתוחות שמתגלה בתוך דרג המהירות ולא בתעריף הסטנדרטי.

סיכום בשורה אחת של הבלוק הזה: X​iaomi גובה מכפיל גדול יותר על מודל זול בהרבה, ו-O​penAI גובה מכפיל קטן יותר על מודל יקר בהרבה. על טוקני פלט אתה משלם $60.00 למיליון עבור המסלול של O​penAI ו-$8.70 עבור זה של X​iaomi. אף אחד מהספקים אינו מציע הנחה עבור מהירות; שניהם מתמחרים אותה כמוצר נפרד, וזה הסימן הראשון לכך שבשני המקרים המסלול הסטנדרטי הוא עדיין ברירת המחדל והמסלול המהיר הוא חריג שמצדיקים לפי עומס עבודה.

מה כל ספק יגיד לך על המהירות

כאן מפסיקות שתי ההשקות להיות סימטריות, וזה הדבר השימושי ביותר בעמוד.

המספר שפרסמה OpenAI עבור Ultrafast הוא ש-GPT-6 Astra Ultrafast מייצר טוקנים עד פי 8 מהר יותר מ-GPT-6 Astra במצב Standard ב-Codex. זו מדידה של מודל אחר, בלקוח אחר, שמנוסחת כתקרה. התיעוד שמכסה את Ultrafast עבור GPT-6.1 Sol אומר שהדרגה מקצרת את הזמן בין טוקני פלט מיוצרים ומפנה לכרטיס תעריפים; הוא לא נוקב במספר עבור דרגת Sol בכלל. אז המספר הכותרתי שמצורף להשקה הזו שאול ממודל האחות שנמצא ב-Ultrafast מאז 29 בספטמבר, ואף גורם בלתי תלוי לא פרסם מדידת טוקנים לשנייה עבור אף אחד מהם. ייתכן בהחלט שזה מחזיק — אותו סטאק הגשה, אותו מנגנון — אבל זו תקרת ספק ש-OpenAI עצמה לא מדדה עבור המודל הזה.

הגילוי של Xiaomi שונה במהותו, וההבדל אינו בכך שהוא מדויק יותר. החומר שלה עצמה טוען כי UltraSpeed מגיע לעד פי 20 ממהירות הפלט של שירות Pro הסטנדרטי באותה איכות. רשומות קטלוג של צד שלישי המתארות את אותו דגם באותו יום אומרות בערך פי 10. שני המספרים נמצאים בתפוצה, הם אינם אותו מספר, ואיש לא פרסם מדידה שמיישבת ביניהם. אם קוראים את זה בכנות: "עד פי 20" הוא תקרת ספק בתנאים ש-Xiaomi לא פירטה, "בערך פי 10" הוא מה שקטלוג היה מוכן לטעון כטיפוסי, והמכפיל האמיתי נמצא אי שם בטווח רחב עד שמישהו יפרסם התפלגויות השהיה לכל בקשה ברמת מקביליות מוצהרת.

אז Xiaomi נותנת לך שני מספרים שאינם מתיישבים, ו-OpenAI נותנת לך מספר אחד ששייך למודל אחר. אף אחד מהם אינו עובדה שאפשר לתקצב לפיה, וההשלכה המעשית זהה בשני המקרים: מדוד את הדרגה על הפרומפטים שלך לפני שאתה מתחייב למסלול ייצור עבורה.

האסימטריה שכן חשובה: מה שהספרות הנוספות קונות

בלי קשר לטענות המהירות, שני המסלולים משויכים לסוגים שונים בתכלית של מוצר, וכאן הבחירה מפסיקה להיות השוואת מחירים.

MiMo-V2.6-Pro הוא עיצוב תערובת-מומחים דליל שXiaomi תיארה בפומבי: 1.02 טריליון פרמטרים בסך הכל, עם 42 מיליארד מופעלים לכל טוקן, חלון הקשר של 1M טוקנים, מולטימודליות מקורית על פני טקסט, תמונה, וידאו ואודיו, ותג רישיון MIT על נקודות הביקורת ששוחררו. חבילת השחרור כוללת דוח טכני והערות פריסה, וXiaomi אומרת שהיא מפרסמת בקוד פתוח את סביבת האימון ללמידת חיזוק ואת הקוד שלה, כדי שניתן יהיה לבחון ולשחזר את שלב לאחר-האימון. ריצת ה-RL מתועדת גם כן — 30 צעדים וכ-750,000 מסלולים לכל מודל, בפחות משישה ימים, בהוצאה משותפת שפורסמה של כ-3,474,715 דולר עבור ריצות ה-Pro וה-Flash. על DeepSWE v1.1, הרתמה של Xiaomi עצמה עם mini-swe-agent ב-avg@3, החברה מדווחת ש-MiMo-V2.6-Flash עובר מ-48.8 ל-65.68 ו-MiMo-V2.6-Pro מ-58.4 ל-72.57 לאורך הריצה הזו. אלה דווחו על ידי הספק ולא שוחזרו; ההבחנה בין "הרתמה של Xiaomi אומרת 72.57" לבין "72.57 הוא הציון" היא ההבדל בין טענה לעובדה.

GPT-6.1 Sol לא מפרסם דבר מכל זה. אין מספר פרמטרים, אין הערת ארכיטקטורה, אין נתון על הוצאות אימון, אין צ'קפוינט, ואין רישיון לקרוא — יש כרטיס מודל, חלון הקשר, תאריך חיתוך ידע של 30 באפריל 2026, ו-API. זהו הסדר הרגיל עבור מעבדת חזית, וזו אינה ביקורת. אבל יש לכך השלכה על החלטת רכישה שסיקור ההשקה נוטה לפספס: במסלול המשקלים הפתוחים, דרג מהיר מאכזב ניתן לתיקון. אם יתברר ש-UltraSpeed אינו שווה פי 10 מהתעבורה שלך, אותו צ'קפוינט ניתן להורדה ותוכל לספק אותו בעצמך או דרך ספק אחר, מה שמגביל את ההפסד הפוטנציאלי שלך במחיר המעבר. במסלול הסגור, דרג מהיר מאכזב הוא חשבון ותקציב הגבלת קצב שאתה מכוון בחזרה כלפי מטה; אינך יכול לעקוף אותו על ידי הרצת המשקלים, כי אין משקלים להריץ.

אזהרה אחת לגבי תג ה-MIT הזה, כי הוא משתטח בסיקור ההשקה. הרישיון חל על הצ'קפוינטים שXiaomi פרסמה. UltraSpeed הוא שירות מתארח, ושירותים מתארחים נשלטים על ידי תנאי שירות ולא על ידי רישיון משקולות. להחזיק בזכות להריץ את הצ'קפוינט על החומרה שלך ולהחזיק בזכות למכור מחדש הגשה מואצת של מישהו אחר שלו הם שני זכויות שונות, ורק הראשונה מגיעה מקובץ הרישיון.

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

שתי מלכודות בשמות לפני שתעתיק כל אחד מהמזהים

אף אחד מהשמות בכותרת של עמוד זה אינו נקודת ביקורת, והתיעוד של שני הספקים מקל לחזור על הטעות.

• GPT-6.1 Ultrafast — לא מודל. המזהה בבקשה נשאר זהה לזה של המודל הסטנדרטי; הדרג נקבע על ידי שדה בבקשה, והתוצאה היא אותו צ׳קפוינט המתוזמן אחרת.

• MiMo v2.6 Pro Ultraspeed — גם לא סט נפרד של משקולות. זהו הצ'קפוינט MiMo-V2.6-Pro המוגש בנתיב מהיר יותר ומתומחר כסעיף חיוב בפני עצמו.

• מה זה אומר לבנצ'מרקינג — אם תשוו את שני המסלולים של כל אחד מהמודלים על פרומפטים זהים, התוצאה הצפויה היא אותן תשובות בקצבים שונים. תוכן שונה באותו קלט הוא פגם שיש לדווח עליו, לא יכולת שרכשתם.

• מה זה אומר לגבי בדיקת הרישיון — עבור X​iaomi, קראו את כרטיס המודל. עבור O​penAI, אין מה לקרוא, כי המשקלים אינם מופצים.

יש גם אסימטריה רכה יותר שמתגלה באופן שבו כל דרגה נמכרת. GPT-6.1 Sol תומך בשהות נתונים בארה"ב ובאיחוד האירופי ובעיבוד גלובלי, כולל תחת Ultrafast, כך שלעומס עבודה המוצמד לעיבוד אירופי יש תשובה מתועדת. כרטיס התעריפים של MiMo שאנו יכולים לקרוא אינו מציין שהות נתונים כלל — Xiaomi מוכרת מודל ונתיב שירות, לא עמדת ציות. עבור קונה מפוקח, השורה הבודדת הזו עשויה להכריע את ההשוואה לפני ששוקלים מחיר.

היכן שכל נתיב אכן ניתן לקריאה

שני המסלולים המהירים נגישים דרך ה-API של הספק שלהם, ושניהם מופיעים בפלטפורמות של צד שלישי. אף אחד מהם אינו ב-OrcaRouter, וכדאי לומר זאת במפורש במקום לתת לדף השוואה לרמוז אחרת.

מה שנמצא ב-OrcaRouter הוא המסלול הסטנדרטי של המודל של OpenAI: openai/gpt-6.1-sol בתעריפי המחירון הרשמיים של OpenAI עצמה — 2.00 דולר למיליון טוקנים בקלט ו-10.00 דולר למיליון טוקנים בפלט — עם 0% תוספת רווח ומחיר הספק מועבר ישירות, כך שעדכון מחירים של ספק נוחת אצלנו באותו היום. Ultrafast הוא דגל של שכבת שירות שמחויב בחשבון OpenAI שלכם, ואף מודל של Xiaomi לא מתארח כאן בכלל. מה שמפתח אחד כן קונה הוא המסלול הסטנדרטי לצד יותר מ-200 מודלים אחרים מאחורי נקודת קצה אחת תואמת OpenAI, עם מעבר אוטומטי בין ספקים — וזו התנוחה השימושית כשהעומס שאתם מגנים עליו הוא זה שהיה מבחין בתקרת הגבלת קצב בשלוש לפנות בוקר.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

איזה נתיב לבדוק, לפי הסדר

אם עומס העבודה שלך הוא אינטראקטיבי וזמן הייצור יושב על השעון של אדם, שתי השכבות שוות ניסיון והגורם המכריע לא יהיה המחיר — אלא תאריך התפוגה של האמון שלך. המסלול עם המשקולות הפתוחות מאפשר לך לאמת ואז לעזוב; המסלול הסגור מבקש ממך לאמת עם הספק היחיד שיכול לשרת אותו ולהישאר. האסימטריה הזו אמיתית, אבל היא גם לא בחינם: MiMo-V2.6-Pro-UltraSpeed הוא שירות מתארח, כך שהיציאה היא הגירה ולא שינוי תצורה, ונקודת הביקורת שאליה תעבור להגירה עשויה שלא להתאים לאופטימיזציות ההגשה של השכבה.

אם עומס העבודה שלך הוא באצווה או מתוזמן, שתי האפשרויות הן הרכישה הלא נכונה, ב-6x וב-10x, והמהלך הישר הוא להריץ אותו במסלול הסטנדרטי ולהוציא את ההפרש על הערכה במקום.

מה היה משנה את העמוד הזה: מדידה בלתי תלויה של מהירות הפלט של כל אחת מהשכבות ברמת מקביליות מוצהרת, הצהרת רזידנסי מפורסמת מ-Xiaomi, או מספר הגבלת קצב מ-OpenAI עבור שכבת Sol שקונה יכול לתכנן לפיו במקום לבקש. עד שאלה יתקיימו, ההשוואה היא רשימת מחירים מול רשימת מחירים, כשאחד משני הספקים פרסם הרבה יותר על האובייקט שמתומחר.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית