
GPT-6 מול Grok 4.6: שתי דרגות ביניים, חשבון אחד שנפרד מעל 200K טוקנים
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
GPT-6 Sol וGrok 4.6 עולים אותו סכום — 2.00 דולר למיליון טוקני קלט ו-6.00 דולר למיליון טוקני פלט — בראשן של שתי העמודות. מה שכמעט אף אחד לא מציין לצד זה הוא שהעמודות מפסיקות להתאים זו לזו בנקודות שונות בבקשה. Grok 4.6 מתחיל לגבות את תעריף ההקשר הארוך שלו ברגע שפרומפט עובר 200,000 טוקני קלט; GPT-6 Sol ממתין עד 272,000. מעל לקווים האלה כל הבקשה מתומחרת מחדש — לא רק החלק העודף — ושתי הספקיות מתמחרות אותה מחדש בכיוונים מנוגדים, וזה החלק שמכריע את החשבון בהרצת סוכן ארוכה. GPT-6 Sol ואחיו GPT-6 Astra ו-GPT-6 Luna שוחררו ב-22 בספטמבר 2026; Grok 4.6, שכבת הביניים בקו של SpaceXAI, שוחרר ב-12 באוגוסט 2026 וכבר הצטרף אליו Grok 4.7, כך שזו השוואה בין שני מודלים ששוחררו ולא השקה של אף אחד מהם.
דבר שני השתנה ב-7 באוקטובר 2026 שחשוב לאופן שבו אתה קורא את GPT-6 בכלל: OpenAI החלה להכניס GPT-6 ללשונית הצ'אט הראשית של ChatGPT, והגיעה למסלולים החינמיים ב-8 באוקטובר, כאשר מסלולי Plus, Pro, Business ו-Enterprise מריצים את GPT-6 Sol והמסלולים Free ו-Go מריצים את GPT-6 Luna. זהו שינוי במשטח — אותם מודלים, קהל גדול בהרבה, ושכבת ממשק חדשה ש-OpenAI מכנה Intelligent UI. הוא לא משנה ולו תעריף API אחד. אבל הוא כן אומר שאם אתה עורך בנצ'מרק של "GPT-6" מול משהו, אתה כעת עורך בנצ'מרק מול מודל שמספר עצום של אנשים גם משוחח איתו בלשונית דפדפן.
היכן ששני הכרטיסים למעשה נבדלים
• קלט בהקשר קצר — GPT-6 Sol 2.00 דולר למיליון לעומת Grok 4.6 2.00 דולר למיליון
• פלט בהקשר קצר — GPT-6 Sol 10.00 דולר למיליון לעומת Grok 4.6 6.00 דולר למיליון
• סף בקשה ארוכה — GPT-6 Sol מתמחר מחדש מעל 272,000 טוקני קלט לעומת Grok 4.6 מעל 200,000
• קלט לבקשה ארוכה — GPT-6 Sol 4.00 דולר למיליון לעומת Grok 4.6 4.00 דולר למיליון
• פלט לבקשה ארוכה — GPT-6 Sol 15.00 דולר למיליון לעומת Grok 4.6 12.00 דולר למיליון
• קלט שמור במטמון — GPT-6 Sol 0.20 דולר למיליון לעומת Grok 4.6 0.50 דולר למיליון
• חלון הקשר — GPT-6 Sol 1,050,000 טוקנים לעומת Grok 4.6 500,000 טוקנים
• מודאליות קלט — שניהם מקבלים טקסט, תמונה וקובץ
• ציון עבודת ידע — GPT-6 Sol 47.6 לעומת Grok 4.6 44.3 במדד Artificial Analysis Intelligence Index
• Terminal-Bench 2.1 — GPT-6 Sol לא פורסם באותה גרסה לעומת Grok 4.6 88.4
קראו את שתי שורות הפלט יחד, וצורת ההחלטה מתגלה. Grok 4.6 זול ב-4.00 דולר למיליון טוקני פלט בכל בקשה מתחת ל-200K, ומעל ל-200K הוא זול יותר רק ב-3.00 דולר. זה פער קטן בהרבה ממה שהנתון הכותרתי של 40% מרמז עליו, מכיוון ששני המודלים מתמחרים מחדש את כל הבקשה ולא רק את החלק שמעל לקו — פרט ששווה להתעכב עליו, שכן פרומפט של 200,001 טוקנים אינו מחויב כטוקן אחד בתעריף היקר בתוספת 200,000 בתעריף הזול.
ואז הסף עצמו פועל בכיוון ההפוך. Grok 4.6 מתחיל לתמחר מחדש 72,000 טוקנים מוקדם יותר מ-GPT-6 Sol. עבור עומס עבודה שנמצא בעקביות בין 200K ל-272K, Grok 4.6 הוא המודל היקר יותר למרות המחיר המפורסם הזול יותר שלו לכל טוקן, והוא היחיד מבין השניים שזז בכלל. באיזה צד של החלון הזה הפרומפטים שלך נוחתים היא שאלה שימושית יותר מאשר איזה מחיר מפורסם נמוך יותר.

פער מדד הייחוס קטן וצר יותר מפער המחיר.
במדד האינטליגנציה של Artificial Analysis, שהוא מדידה של צד שלישי ולא טבלת ספקים, GPT-6 Sol ניצב על 47.6 ו-Grok 4.6 על 44.3. פער של 3.3 נקודות בסולם של 0 עד 100 הוא אמיתי, אך הוא אינו מסוג המרחק שגורם למודל אחד להיות לא מתאים למשימה והאחר מתאים לה. הוא גם נמדד בהגדרת הסקה ספציפית לכל מודל, ו-GPT-6 Sol חושף מאמץ הסקה ניתן להגדרה בעוד Grok 4.6 חושף את שלו — כך שכל מי שמצטט מספר ראש-בראש בודד מצטט נקודה אחת ברשת דו-ממדית.
היכן ששני אלה באמת רחוקים יותר זה מזה הוא בעבודה סוכנית בסגנון טרמינל. ב-Terminal-Bench 2.1, Grok 4.6 מציג 88.4. ל-GPT-6 Sol אין נתון מפורסם בר-השוואה על המהדורה שהקטלוג שלנו כולל, והקריאה הכנה של תא ריק היא שהמספר אינו מפורסם — ולא שהמודל תיפקד גרוע. אם עומס העבודה הוא סוכן ארוך-טווח המונע על ידי מעטפת, הראיות המפורסמות מעדיפות את Grok 4.6, והראיות החסרות אינן נחשבות לראיה לאף אחד מהצדדים.
ההפך נכון באחזור ידע באורך. GPT-6 Sol רושם 83.7 באחזור ארוך-הקשר לעומת 80.3 של Grok 4.6, וספקי שני המודלים מדווחים על הנתונים שלהם במקומות אחרים — SpaceXAI מדגישה את GPQA Diamond ב-94.9 עבור Grok 4.6, והחומר של OpenAI על GPT-6 הוא ברובו מדווח על ידי הספק ולא משוחזר. שני כללים שומרים על זה ישר: מספר של ספק הוא טענה, ומספר של אינדקס הוא מדידה על גרסה נקובה בשם. הם אינם ניתנים להחלפה ואין לעולם למצע אותם לציון "טוב יותר" אחד.
בעיית היורש
אף אחד מאלה אינו המודל החדש ביותר של המעבדה שממנה הוא בא, ולהעמיד פנים אחרת יהיה הדבר המטעה ביותר שהשוואה הזו יכולה לעשות. SpaceXAI השיקה את Grok 4.7 ב-21 בספטמבר 2026 באותו תעריף בסיס של $2.00 / $6.00, כאשר מדד האינטליגנציה עולה מ-44.3 ל-46.4. OpenAI השיקה את GPT-6.1 Sol ב-29 בספטמבר 2026, גם כן ב-$2.00 / $10.00, כאשר מדד האינטליגנציה עומד על 51.8 ותעריף אחד אף השתפר: קלט במטמון ירד מ-$0.20 ל-$0.10 למיליון. Artificial Analysis מסמנת כעת את עמוד GPT-6 Sol שלה כמיושן, ומפנה קוראים אל GPT-6.1 Sol.
אז המסגור ההוגן אינו "איזו משתי אלו עליך לאמץ" אלא "איזו משתי אלו, והאם אתה בטוח שזה לא דור אחד חדש יותר באף אחד מהצדדים". הסיבה להישאר על GPT-6 Sol היא בדרך כלל אינטגרציה ספציפית בת שמונה ימים ולא טענת יכולת; הסיבה להישאר על Grok 4.6 היא מספר שפורסם של סוכן טרמינל שהמחליף שלו טרם השיג בפומבי. שניהם לגיטימיים, ושניהם מוגבלים בזמן.

הרצת שניהם ממפתח אחד
שני המודלים מנותבים על ידי OrcaRouter, כך שהחלק המכני של שמירה על שני מועמדים פעילים לא עולה כלום: API אחד מול 200+ מודלים, אותו מפתח, בלי חוזה שני ובלי שינוי קוד ביניהם. זה חשוב כאן יותר מהרגיל, כי המקרה למודל שני בזיווג המסוים הזה אינו גידור יכולות אלא החלטת ניתוב — שלח את החלון של 200K עד 272K ל-GPT-6 Sol ואת כל מה שקצר יותר ל-Grok 4.6, ואותה אפליקציה מקבלת את החשבון הזול יותר בשני צידי הסף שאף ספק לא מאפשר לך לבחור.
מעבר אוטומטי לגיבוי הוא החצי המשעמם של אותה הגדרה. הרצות סוכן עם הקשר ארוך הן ארוכות בדיוק משום שמשהו מחזיק הפעלה פתוחה, ותקלה חולפת של ספק בדקה הארבעים היא הסוג היקר של כשל. מסלול שני שהוגדר מראש הופך זאת לניסיון חוזר במקום להרצה מחדש.
הקטלוג שלנו מציג את שניהם במחיר המחירון של הספק שלהם עצמו, בלי שום תוספת, כך ששינוי תעריף באחד מהכרטיסים נוחת אצלנו באותו היום שבו הוא נוחת אצלם. כדאי לומר זאת בפשטות ולא כסיסמה: הסיבה שזה חשוב היא שההפרש של $0.20 לעומת $0.50 בקלט המטמון שלמעלה הוא בדיוק מסוג השורות שספקים מזיזים בשקט, והעברה ישירה פירושה שלעולם לא תצטרכו לחכות שמשווק ידביק את הפער.

מה בעצם מכריע את זה
אם הפרומפטים שלך קצרים, Grok 4.6 מנצח במחיר הפלט בפער שאף דלתא של מדד לא סוגרת, וציון סוכן הטרמינל שלו הוא המספר המפורסם החזק ביותר בכל אחת מהעמודות. אם הפרומפטים שלך ארוכים, סף התמחור מחדש המאוחר יותר של GPT-6 Sol והחלון הארוך יותר שלו שווים יותר מאשר תעריף הפלט הגבוה יותר שלו, ושורת הקלט השמור במטמון היא רבע מהעלות. אם הפרומפטים שלך נמצאים בין 200K ל-272K, אתה מחזיק בעומס העבודה האחד שבו המודל שנראה זול יותר הוא היקר יותר, והתיקון הוא בחירת מסלול ולא בחירת מודל.
הדבר שצריך לשים לב אליו אינו אחד מהמודלים, אלא שני היורשים שכבר נמצאים על המדף. גם Grok 4.7 וגם GPT-6.1 Sol מחלישים את הטיעון להמתין להחלטה כאן, והשוואה שצריכה להיערך מחדש כל שלושה שבועות היא השוואה שמקומה מאחורי ראוטר ולא במסמך ארכיטקטורה.
השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
