
GPT-6 Sol נגד Grok 4.7: הטוקן הזול יותר שעולה פי שלושה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
שני מודלים שוחררו בהפרש של יום אחד בספטמבר 2026, ועל תג המחיר הם בכלל לא קרובים. Grok 4.7 הושק ב-21 בספטמבר במחיר של $2.00 למיליון טוקני קלט ו-$6.00 למיליון טוקני פלט. GPT-6 Sol הושק ב-22 בספטמבר באותו מחיר של $2.00 לקלט ו-$10.00 לפלט. הפלט של Grok זול ב-40%. זה כל הבסיס שעליו רוב ההשוואות יבחרו בו, וזה המספר הלא נכון להסתכל עליו.
המספר שמכריע בהשוואה הזו לא מופיע באף אחד משני מחירוני התעריפים. זה 240 מיליון מול 77 מיליון — טוקני הפלט שכל מודל ייצר כאשר Artificial Analysis הריצה את Intelligence Index. Grok 4.7 שרף קצת יותר מפי שלושה טוקנים כדי לענות על אותה קבוצת שאלות. תכפילו את זה בתעריף לכל טוקן, והמודל שהפלט שלו זול יותר מגיע לעלות של 3.74 דולר למשימה שהושלמה, לעומת 1.06 דולר. זול יותר לכל טוקן, אבל החשבון יותר מפי שלושה.
מה כל מודל הוא בפועל
Grok 4.7 הוא היורש של xAI ל-Grok 4.6, וממוצב כמודל החזק ביותר שלה לקידוד ולעבודת ידע, עם חלון הקשר של 500,000 טוקנים, קלט טקסט ותמונה, פלט טקסט, ומאמץ חשיבה הניתן להגדרה ברמות נמוכה, בינונית, גבוהה ו-xhigh. xAI לא חשפה מספר פרמטרים. הוא מקבל חיתוך אימון מקדים המדווח כיוני 2026, עם אימון משלים עד אוגוסט.
GPT-6 Sol הוא מודל GPT-6 בדרג הביניים של OpenAI — מתחת ל-GPT-6 Astra, דגם הדגל, ומעל ל-GPT-6 Luna, דגם התקציב — עם חלון הקשר של 1,050,000 טוקנים, קלט מקסימלי של 922,000 טוקנים, תקרת פלט של 128,000 טוקנים ותאריך חיתוך ידע של 20 באפריל 2026. הוא קולט טקסט ותמונה ומפיק טקסט, עם מאמץ הסקה מ"ללא" ועד "מקסימום", ו-OpenAI תיארה את התמחור שלו כקבוע ולא כמבצעי.
חלונות ההקשר אינם קרובים זה לזה. זה של Sol גדול בערך פי שניים. זה משנה בדיוק לסוג אחד של עומס עבודה, והוא אינו הסוג שרוב האנשים מריצים.
כרטיס התעריפים, והשורה שהופכת אותו
• קלט — GPT-6 Sol $2.00 למיליון טוקנים לעומת Grok 4.7 $2.00 למיליון טוקנים; זהה
• פלט — GPT-6 Sol $10.00 למיליון טוקנים לעומת Grok 4.7 $6.00 למיליון טוקנים; Grok זול ב-40%
• קלט במטמון — GPT-6 Sol $0.20 למיליון טוקנים לעומת Grok 4.7 $0.50 למיליון טוקנים; קריאת המטמון של Sol זולה פי שניים וחצי, וזה ההיפך ממה שתעריף הפלט מרמז
• כתיבות מטמון — GPT-6 Sol $2.50 למיליון טוקנים לעומת Grok 4.7 תעריף שלא פורסם באותו גיליון
• חלון הקשר — GPT-6 Sol 1,050,000 טוקנים לעומת Grok 4.7 500,000 טוקנים
• תוספת עבור הקשר ארוך — GPT-6 Sol מתמחרת מחדש בקשה מעל 272,000 אסימוני קלט בתעריפים של פי 2 לקלט ולמטמון ופי 1.5 לפלט עבור הבקשה כולה, לעומת Grok 4.7 שמכפילה כל תעריף ב-200,000 אסימוני קלט, גם עבור הבקשה כולה
• מועד חיתוך הידע — GPT-6 Sol, 20 באפריל 2026 לעומת Grok 4.7, שמועד חיתוך האימון המקדים שלו דווח כיוני 2026 עם אימון משלים עד אוגוסט
• מאמץ חשיבה — GPT-6 Sol: ללא, נמוך, בינוני (ברירת מחדל), גבוה, גבוה במיוחד, מקסימלי לעומת Grok 4.7: נמוך, בינוני (ברירת מחדל), גבוה, גבוה במיוחד
• מודאליות — קלט טקסט ותמונה, פלט טקסט, עבור שניהם
שורת המטמון היא זו שכדאי לקונה לבחון לעומק. תעריף הפלט של Grok נמוך יותר, אבל הקלט השמור במטמון שלו גדול פי שניים וחצי מזה של Sol, והקלט השמור במטמון הוא המקום שבו נמצאים היסטוריות סוכנים ארוכות והנחיות מערכת חוזרות. עומס עבודה שרובו קריאה חוזרת של הקשר גדול ויציב ימצא את השניים קרובים בהרבה ממה ש-$6 מול $10 מרמז — וברגע שמיישמים על כך גם את יחס נפח הטוקנים, הסדר מתהפך.

למה 240 מיליון טוקנים הם כל הסיפור
Artificial Analysis מדדה את Grok 4.7 ב-xhigh כשהוא מייצר כ-240 מיליון אסימוני פלט לאורך ריצת האינדקס שלו, לעומת חציון של כ-88 מיליון עבור המודלים באותו לוח. הסיכום שלה עצמה מכנה את המודל "איטי במיוחד ומפורט מאוד". GPT-6 Sol, שנמדד באותה ערכת בדיקה, ייצר 77 מיליון — ותואר בלוח כ"תמציתי למדי".
הלוח גם מציג את התוצאה ישירות. Grok 4.7 מקבל ציון 46 במדד Intelligence Index בעלות של 3.74 דולר למשימה. בהגדרה הגבוהה שלו הציון הוא גם 46 והעלות היא 2.73 דולר למשימה. GPT-6 Sol מקבל ציון 48 בעלות של 1.06 דולר למשימה. אותו מדד, אותה מערכת הערכה, והפרש עלות של פי שניים עד שלושה וחצי שאף מחירון לא מציג.
שתי אזהרות לפני שאתם מתייחסים לנתונים האלה כהשוואה ראש בראש נקייה. שני העמודים נתפסו באותו יום אבל הלוחות מציגים סיכומים שונים — העמוד של Grok מציג מחלקה של 212 דגמים, ורישום Grok נפרד מדווח על דירוג מתוך 655 — לכן שני הציונים לא מובטחים להיות על אותה בניית אינדקס. ואף אחד מהנתונים אינו מספר ספק: Artificial Analysis מריצה את ההרנס של עצמה, וזו הנקודה, אבל הגדרות החשיבה שונות בין שני הרישומים (xhigh עבור Grok, max עבור Sol), אז התייחסו לפער העלות של חמש מאות אחוזים כממצא ולפער האינדקס של שתי נקודות כמקורב.

מה שפרסמה xAI, ומה שאף אחד לא בדק
מספרי ההשקה של xAI עצמה חזקים, וכמו כל מספרי השקה של ספקים, לא משוחזרים. CursorBench 4.0 ב-46.3% ב-xhigh לעומת 40.4% של Grok 4.6. Terminal-Bench 4.0 ב-38.0% לעומת 20.3% — השיפור הבודד הגדול ביותר בגרסה. DeepSWE v1.1 ב-71.0% ב-high לעומת 65.2%. EEBench ב-64.0% לעומת 53.0%. אלה מערכת ההערכה של xAI, ההגדרות של xAI, הדיווח של xAI.
המספרים של OpenAI עבור GPT-6 Sol עוקבים אחר אותו דפוס וראויים לאותה הנחה. ההבדל הוא של-Sol יש ראיה עצמאית אחת נוספת לעומת Grok: נתון העלות-למשימה של Artificial Analysis, שמחושב מצריכת טוקנים נמדדת ולא מטבלת ניקוד של ספק. זה המספר ששורד את ההשוואה הזו.
מה שאף אחד לא פרסם עבור אף אחד משני המודלים הוא השוואה ראש-בראש על אותן משימות, עם אותה מסגרת בדיקה ואותה הגדרת מאמץ. אם תיתקלו באחת כזו, בדקו איזה משלושת המשתנים האלה זז.
תמחור חודש של תעבורת סוכנים במטמון
קח עומס עבודה שברובו הוא הקשר יציב: סוכן קידוד עם הנחיית מערכת של 60,000 טוקנים ותקציר מאגר, שנקראים מחדש ב-5,000 קריאות בחודש, כאשר כל אחת מהן מחזירה 4,000 טוקני פלט. נניח שהמטמון פועל ושהקידומת היציבה מחויבת לפי תעריף המטמון.
בנוגע ל-GPT-6 Sol: 300 מיליון טוקני קלט במטמון במחיר של 0.20 דולר למיליון הם 60.00 דולר. עשרים מיליון טוקני פלט במחיר של 10.00 דולר למיליון הם 200.00 דולר. סה"כ, 260.00 דולר.
ב-Grok 4.7: אותם 300 מיליון טוקני קלט במטמון ב-0.50 דולר למיליון הם 150.00 דולר. עשרים מיליון טוקני פלט ב-6.00 דולר למיליון הם 120.00 דולר. סה״כ, 270.00 דולר.
כמעט זהים — וזה כשנפח הטוקנים מוחזק קבוע, וזו ההנחה הנדיבה. רמת הפירוט הנמדדת של Grok 4.7 בהרצת האינדקס הייתה פי שלושה מזו של Sol. אפילו אם מחילים מכפיל של 1.5× על נפח הפלט, החשבון של Grok עולה ל-$330.00 לעומת $320.00 של Sol, והפער מתרחב משם והלאה. תעריף הפלט הזול יותר לא שורד שמירה במטמון יחד עם פירוט; הוא בקושי שורד שמירה במטמון בלבד.
שום דבר כאן אינו טענה לגבי המחיר של אף אחד מהמודלים דרך OrcaRouter — אף אחד מהם לא נמצא בקטלוג שלנו. אפשר להגיע אל GPT-6 Sol דרך ה-API של OpenAI עצמה, ואל Grok 4.7 דרך ה-API של xAI; שאר סדרת Grok, כולל Grok 4.6, ניתנת לניתוב דרכנו במחיר המחירון של xAI לפי מודל ה-pass-through. הנקודה בחישוב היא שכלל ההסלמה שאתם כותבים צריך להתבסס על עלות למשימה שהושלמה בתעבורה שלכם, ולא על כרטיס התעריפים — ושכבת ניתוב היא מה שמאפשר לכם לבחון את הכלל הזה בלי חוזה נוסף.

איפה שכל אחד שייך
• עבודת סוכנים בנפח גבוה עם הקשר נשמר במטמון — GPT-6 Sol. שורת הקלט הנשמר במטמון היא פי 2.5 לטובת Sol, ושורת נפח הפלט גרועה מזו אצל Grok, ושתיהן מצטברות.
• עבודת קידוד שבה אתה רוצה את השיפור החזק ביותר שפורסם ב-Terminal-Bench במהדורה — Grok 4.7 הוא המודל עם המספר, והוא גדול. רק תתקצב עבור הטוקנים, לא עבור התעריף.
• מסמכים ארוכים מעל 500,000 טוקנים — GPT-6 Sol, וזה ממש לא צמוד. החלון של Grok מסתיים במקום שבו החלון של Sol נמצא רק באמצע הדרך.
• נתיבים רגישים להשהיה — לא זה ולא זה. Artificial Analysis מציינת את Grok 4.7 בקצב של 39.2 טוקני פלט לשנייה, ומתארת זאת כאיטי במיוחד. בדוק את נתון המהירות של Sol בלוח הדירוג הנוכחי לפני שתניח שהוא טוב יותר.
• אם הוצגה בפניך השוואה לכל טוקן שמסתיימת ב"אז Grok זול יותר" — היא הסתיימה צעד אחד מוקדם מדי. הצעד הבא הוא ספירת הטוקנים.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
