כרטיס כותרת שנוצר עם הכיתוב GPT-6 מול Grok 4.6, שני דרגי ביניים, חשבון אחד שמתפצל מעל 200K אסימונים, עם כרטיסי נתונים עם הכיתוב מחיר קלט $2.00 מול $2.00 למיליון, שלב בקשה ארוכה 272K מול 200K אסימוני קלט, ומחיר פלט מעל השלב $15.00 מול $12.00 למיליון, עם כותרת תחתונה עם הכיתוב שיעורי הקשר קצר של GPT-6 Sol ו-Grok 4.6 לפי כרטיס התעריפים של כל ספק; שלבי הקשר ארוך לפי אותם כרטיסים.
Guides & Insights

GPT-6 מול Grok 4.6: שתי דרגות ביניים, חשבון אחד שנפרד מעל 200K טוקנים

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

GPT-6 Sol וGrok 4.6 עולים אותו סכום — 2.00 דולר למיליון טוקני קלט ו-6.00 דולר למיליון טוקני פלט — בראשן של שתי העמודות. מה שכמעט אף אחד לא מציין לצד זה הוא שהעמודות מפסיקות להתאים זו לזו בנקודות שונות בבקשה. Grok 4.6 מתחיל לגבות את תעריף ההקשר הארוך שלו ברגע שפרומפט עובר 200,000 טוקני קלט; GPT-6 Sol ממתין עד 272,000. מעל לקווים האלה כל הבקשה מתומחרת מחדש — לא רק החלק העודף — ושתי הספקיות מתמחרות אותה מחדש בכיוונים מנוגדים, וזה החלק שמכריע את החשבון בהרצת סוכן ארוכה. GPT-6 Sol ואחיו GPT-6 Astra ו-GPT-6 Luna שוחררו ב-22 בספטמבר 2026; Grok 4.6, שכבת הביניים בקו של SpaceXAI, שוחרר ב-12 באוגוסט 2026 וכבר הצטרף אליו Grok 4.7, כך שזו השוואה בין שני מודלים ששוחררו ולא השקה של אף אחד מהם.

דבר שני השתנה ב-7 באוקטובר 2026 שחשוב לאופן שבו אתה קורא את GPT-6 בכלל: OpenAI החלה להכניס GPT-6 ללשונית הצ'אט הראשית של ChatGPT, והגיעה למסלולים החינמיים ב-8 באוקטובר, כאשר מסלולי Plus, Pro, Business ו-Enterprise מריצים את GPT-6 Sol והמסלולים Free ו-Go מריצים את GPT-6 Luna. זהו שינוי במשטח — אותם מודלים, קהל גדול בהרבה, ושכבת ממשק חדשה ש-OpenAI מכנה Intelligent UI. הוא לא משנה ולו תעריף API אחד. אבל הוא כן אומר שאם אתה עורך בנצ'מרק של "GPT-6" מול משהו, אתה כעת עורך בנצ'מרק מול מודל שמספר עצום של אנשים גם משוחח איתו בלשונית דפדפן.

היכן ששני הכרטיסים למעשה נבדלים

• קלט בהקשר קצר — GPT-6 Sol 2.00 דולר למיליון לעומת Grok 4.6 2.00 דולר למיליון
• פלט בהקשר קצר — GPT-6 Sol 10.00 דולר למיליון לעומת Grok 4.6 6.00 דולר למיליון
• סף בקשה ארוכה — GPT-6 Sol מתמחר מחדש מעל 272,000 טוקני קלט לעומת Grok 4.6 מעל 200,000
• קלט לבקשה ארוכה — GPT-6 Sol 4.00 דולר למיליון לעומת Grok 4.6 4.00 דולר למיליון
• פלט לבקשה ארוכה — GPT-6 Sol 15.00 דולר למיליון לעומת Grok 4.6 12.00 דולר למיליון
• קלט שמור במטמון — GPT-6 Sol 0.20 דולר למיליון לעומת Grok 4.6 0.50 דולר למיליון
• חלון הקשר — GPT-6 Sol 1,050,000 טוקנים לעומת Grok 4.6 500,000 טוקנים
• מודאליות קלט — שניהם מקבלים טקסט, תמונה וקובץ
• ציון עבודת ידע — GPT-6 Sol 47.6 לעומת Grok 4.6 44.3 במדד Artificial Analysis Intelligence Index
• Terminal-Bench 2.1 — GPT-6 Sol לא פורסם באותה גרסה לעומת Grok 4.6 88.4

קראו את שתי שורות הפלט יחד, וצורת ההחלטה מתגלה. Grok 4.6 זול ב-4.00 דולר למיליון טוקני פלט בכל בקשה מתחת ל-200K, ומעל ל-200K הוא זול יותר רק ב-3.00 דולר. זה פער קטן בהרבה ממה שהנתון הכותרתי של 40% מרמז עליו, מכיוון ששני המודלים מתמחרים מחדש את כל הבקשה ולא רק את החלק שמעל לקו — פרט ששווה להתעכב עליו, שכן פרומפט של 200,001 טוקנים אינו מחויב כטוקן אחד בתעריף היקר בתוספת 200,000 בתעריף הזול.

ואז הסף עצמו פועל בכיוון ההפוך. Grok 4.6 מתחיל לתמחר מחדש 72,000 טוקנים מוקדם יותר מ-GPT-6 Sol. עבור עומס עבודה שנמצא בעקביות בין 200K ל-272K, Grok 4.6 הוא המודל היקר יותר למרות המחיר המפורסם הזול יותר שלו לכל טוקן, והוא היחיד מבין השניים שזז בכלל. באיזה צד של החלון הזה הפרומפטים שלך נוחתים היא שאלה שימושית יותר מאשר איזה מחיר מפורסם נמוך יותר.

Generated comparison scoreboard titled GPT-6 vs Grok 4.6, the scoreboard, with six matched rows. GPT-6 Sol: input $2.00 per million, output $10.00 per million, long-request step above 272K input tokens, long-context output $15.00, context window 1,050,000 tokens, Intelligence Index 47.6. Grok 4.6: input $2.00 per million, output $6.00 per million, long-request step above 200K input tokens, long-context output $12.00, context window 500,000 tokens, Intelligence Index 44.3. A footer reads GPT-6 Sol rates per OpenAI's rate card and Intelligence Index per Artificial Analysis; Grok 4.6 rates per SpaceXAI's rate card and Intelligence Index per Artificial Analysis.

פער מדד הייחוס קטן וצר יותר מפער המחיר.

במדד האינטליגנציה של Artificial Analysis, שהוא מדידה של צד שלישי ולא טבלת ספקים, GPT-6 Sol ניצב על 47.6 ו-Grok 4.6 על 44.3. פער של 3.3 נקודות בסולם של 0 עד 100 הוא אמיתי, אך הוא אינו מסוג המרחק שגורם למודל אחד להיות לא מתאים למשימה והאחר מתאים לה. הוא גם נמדד בהגדרת הסקה ספציפית לכל מודל, ו-GPT-6 Sol חושף מאמץ הסקה ניתן להגדרה בעוד Grok 4.6 חושף את שלו — כך שכל מי שמצטט מספר ראש-בראש בודד מצטט נקודה אחת ברשת דו-ממדית.

היכן ששני אלה באמת רחוקים יותר זה מזה הוא בעבודה סוכנית בסגנון טרמינל. ב-Terminal-Bench 2.1, Grok 4.6 מציג 88.4. ל-GPT-6 Sol אין נתון מפורסם בר-השוואה על המהדורה שהקטלוג שלנו כולל, והקריאה הכנה של תא ריק היא שהמספר אינו מפורסם — ולא שהמודל תיפקד גרוע. אם עומס העבודה הוא סוכן ארוך-טווח המונע על ידי מעטפת, הראיות המפורסמות מעדיפות את Grok 4.6, והראיות החסרות אינן נחשבות לראיה לאף אחד מהצדדים.

ההפך נכון באחזור ידע באורך. GPT-6 Sol רושם 83.7 באחזור ארוך-הקשר לעומת 80.3 של Grok 4.6, וספקי שני המודלים מדווחים על הנתונים שלהם במקומות אחרים — SpaceXAI מדגישה את GPQA Diamond ב-94.9 עבור Grok 4.6, והחומר של OpenAI על GPT-6 הוא ברובו מדווח על ידי הספק ולא משוחזר. שני כללים שומרים על זה ישר: מספר של ספק הוא טענה, ומספר של אינדקס הוא מדידה על גרסה נקובה בשם. הם אינם ניתנים להחלפה ואין לעולם למצע אותם לציון "טוב יותר" אחד.

בעיית היורש

אף אחד מאלה אינו המודל החדש ביותר של המעבדה שממנה הוא בא, ולהעמיד פנים אחרת יהיה הדבר המטעה ביותר שהשוואה הזו יכולה לעשות. SpaceXAI השיקה את Grok 4.7 ב-21 בספטמבר 2026 באותו תעריף בסיס של $2.00 / $6.00, כאשר מדד האינטליגנציה עולה מ-44.3 ל-46.4. OpenAI השיקה את GPT-6.1 Sol ב-29 בספטמבר 2026, גם כן ב-$2.00 / $10.00, כאשר מדד האינטליגנציה עומד על 51.8 ותעריף אחד אף השתפר: קלט במטמון ירד מ-$0.20 ל-$0.10 למיליון. Artificial Analysis מסמנת כעת את עמוד GPT-6 Sol שלה כמיושן, ומפנה קוראים אל GPT-6.1 Sol.

אז המסגור ההוגן אינו "איזו משתי אלו עליך לאמץ" אלא "איזו משתי אלו, והאם אתה בטוח שזה לא דור אחד חדש יותר באף אחד מהצדדים". הסיבה להישאר על GPT-6 Sol היא בדרך כלל אינטגרציה ספציפית בת שמונה ימים ולא טענת יכולת; הסיבה להישאר על Grok 4.6 היא מספר שפורסם של סוכן טרמינל שהמחליף שלו טרם השיג בפומבי. שניהם לגיטימיים, ושניהם מוגבלים בזמן.

OrcaRouter model page for Grok 4.6 (grok/grok-4.6) by SpaceXAI, dated 2026-08-12, showing the model tagged Vision, Tools, JSON and Reasoning, a 500K-token context window with text, image and file input and text output, a list price of $2.00 per million input and $6.00 per million output, and a p50 time to first token of 4.73 seconds.

הרצת שניהם ממפתח אחד

שני המודלים מנותבים על ידי OrcaRouter, כך שהחלק המכני של שמירה על שני מועמדים פעילים לא עולה כלום: API אחד מול 200+ מודלים, אותו מפתח, בלי חוזה שני ובלי שינוי קוד ביניהם. זה חשוב כאן יותר מהרגיל, כי המקרה למודל שני בזיווג המסוים הזה אינו גידור יכולות אלא החלטת ניתוב — שלח את החלון של 200K עד 272K ל-GPT-6 Sol ואת כל מה שקצר יותר ל-Grok 4.6, ואותה אפליקציה מקבלת את החשבון הזול יותר בשני צידי הסף שאף ספק לא מאפשר לך לבחור.

מעבר אוטומטי לגיבוי הוא החצי המשעמם של אותה הגדרה. הרצות סוכן עם הקשר ארוך הן ארוכות בדיוק משום שמשהו מחזיק הפעלה פתוחה, ותקלה חולפת של ספק בדקה הארבעים היא הסוג היקר של כשל. מסלול שני שהוגדר מראש הופך זאת לניסיון חוזר במקום להרצה מחדש.

הקטלוג שלנו מציג את שניהם במחיר המחירון של הספק שלהם עצמו, בלי שום תוספת, כך ששינוי תעריף באחד מהכרטיסים נוחת אצלנו באותו היום שבו הוא נוחת אצלם. כדאי לומר זאת בפשטות ולא כסיסמה: הסיבה שזה חשוב היא שההפרש של $0.20 לעומת $0.50 בקלט המטמון שלמעלה הוא בדיוק מסוג השורות שספקים מזיזים בשקט, והעברה ישירה פירושה שלעולם לא תצטרכו לחכות שמשווק ידביק את הפער.

Artificial Analysis model page for GPT-6 Sol (Max), a proprietary OpenAI model released September 2026, carrying a banner stating the model is deprecated and that OpenAI has launched a newer release, GPT-6.1 Sol. The page shows an Intelligence rank of 25 of 225, an output speed of 87.9 tokens per second, $2.00 per million input tokens and $10.00 per million output tokens, a 90% cache discount, a $1.04 blended rate, and a note that the model generated 77 million tokens during the Index evaluation, described as fairly concise.

מה בעצם מכריע את זה

אם הפרומפטים שלך קצרים, Grok 4.6 מנצח במחיר הפלט בפער שאף דלתא של מדד לא סוגרת, וציון סוכן הטרמינל שלו הוא המספר המפורסם החזק ביותר בכל אחת מהעמודות. אם הפרומפטים שלך ארוכים, סף התמחור מחדש המאוחר יותר של GPT-6 Sol והחלון הארוך יותר שלו שווים יותר מאשר תעריף הפלט הגבוה יותר שלו, ושורת הקלט השמור במטמון היא רבע מהעלות. אם הפרומפטים שלך נמצאים בין 200K ל-272K, אתה מחזיק בעומס העבודה האחד שבו המודל שנראה זול יותר הוא היקר יותר, והתיקון הוא בחירת מסלול ולא בחירת מודל.

הדבר שצריך לשים לב אליו אינו אחד מהמודלים, אלא שני היורשים שכבר נמצאים על המדף. גם Grok 4.7 וגם GPT-6.1 Sol מחלישים את הטיעון להמתין להחלטה כאן, והשוואה שצריכה להיערך מחדש כל שלושה שבועות היא השוואה שמקומה מאחורי ראוטר ולא במסמך ארכיטקטורה.

השוואות במאמר הזה3

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית