
Grok 4.7 מול GPT-5.6 Sol: המודל הזול יותר עולה יותר לכל תשובה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok 4.7 רשום במחיר של $2.00 למיליון אסימוני קלט ו-$6.00 למיליון אסימוני פלט. GPT-5.6 Sol רשום במחיר $4.00 ו-$20.00. במחירון, המודל של הספק זול פי 3.33 מבחינת עלות ההפקה, וזה המספר שרוב ההשוואות היו עוצרות בו. זה המספר השגוי. Artificial Analysis מודדת אסימוני פלט למשימה עבור כל מודל שהיא מדרגת, ובמדד הנוכחי Grok 4.7 — שיצא ב-21 בספטמבר 2026 — פולט 81,000 אסימוני פלט למשימה בעוד ש-GPT-5.6 Sol, זמין באופן כללי מאז 9 ביולי 2026, פולט 29,000. תכפילו את התעריפים באסימונים ופער המחירים של פי 3.3 הופך להפרש עלות של כעשרים אחוזים לכל תשובה מוגמרת, לטובת Sol מבחינת איכות. שניהם חזקים; הסיבה לקרוא מעבר למחירון כאן היא ששני המודלים חלוקים לגבי אילו הערכות חשובות, והמחלוקת היא שיטתית.
שני מודלים בחזית עם הרגלי טוקנים מנוגדים
GPT-5.6 Sol הוא דגם הדגל בחזית של OpenAI, שהושק ב-9 ביולי 2026, ועדיין זמין באופן כללי גם לאחר ש-GPT-6 Astra הגיע מעליו ב-3 בספטמבר. הוא נושא חלון הקשר של 1,050,000 טוקנים עם קלט מרבי של 922,000 טוקנים ופלט מרבי של 128,000 טוקנים, קולט טקסט ותמונות כקלט, וחושף סולם מאמץ חשיבה הכולל none, low, medium, high, xhigh ו-max, כאשר medium הוא ברירת המחדל. משטח הכלים שלו רחב באופן יוצא דופן — hosted shell, apply patch, computer use, MCP, code interpreter, image generation, file search — והוא תומך בפלטים מובנים. המשקלים סגורים.
Grok 4.7 הוא בן יום, במשקל סגור, ומחזיק בהקשר של 500 אלף טוקנים — בערך חצי מזה של Sol — עם קלט טקסט ותמונה ופלט טקסט. חוג מאמץ החשיבה שלו הוא משל עצמו, והתמחור שלו עולה מעל 200 אלף טוקני פרומפט ל-$4.00 ו-$12.00, עם קריאות שמורות במטמון ב-$0.50 ו-$1.00. xAI גם מפרטת גרסה מהירה יותר במהירות פלט כפולה בערך ובמחיר כפול, ובנפרד הכריזה על תצורת Ultrafast באוגוסט הפועלת על חומרה בקנה מידה של פרוסה במהירות של עד 750 טוקני פלט לשנייה; זו תצוגה מקדימה מוגבלת ללא תמחור מפורסם, כך שזו אינה שכבה שאתה יכול לתכנן לפיה כרגע. אף אחד מהספקים לא מפרסם נתון פלט מקסימלי עבור Grok 4.7 בתיעוד שנבדק כאן.
חמישה קצוות במרחק זה מזה, ומופנים לכיוונים שונים
שני המודלים מקבלים ציון לפי Artificial Analysis Intelligence Index v4.3.2, המהדורה שפורסמה ב-19 בספטמבר 2026. העמודה של Sol נמדדת במאמץ מקסימלי, וזו של Grok 4.7 ב-xhigh. הפער המשולב הוא נקודה אחת. הפיזור לפי הערכה אינו.
• משולב — Grok 4.7 (xhigh): 46 במדד הבינה המלאכותית של Artificial Analysis Intelligence Index v4.3.2, מדורג במקום ה-16 מתוך 655. GPT-5.6 Sol (max): 47 באותה גרסה, מדורג במקום ה-14 מתוך 200 בקטגוריה שלו.
• סוכני טרמינל — Grok 4.7: Terminal-Bench 4.0 26. GPT-5.6 Sol: 40. הניצחון הגדול ביותר של Sol, וההערכה הקרובה ביותר לעבודת תוכנה אוטונומית.
• חשיבה קשה — Grok 4.7: Humanity's Last Exam 43, CritPt 18, GDP.pdf 20. GPT-5.6 Sol: HLE 49, CritPt 32, GDP.pdf 27. Sol מוביל בכל שלושתם, בשש, בארבע עשרה ובשבע נקודות.
• הקשר ארוך — Grok 4.7: AA-LCR v1.1 77%, חלון 500k. GPT-5.6 Sol: 84%, חלון 1.05M. Sol מוביל גם במדידה וגם במגבלה.
• אוטומציה של זרימות עבודה — Grok 4.7: AutomationBench-AA 66%. GPT-5.6 Sol: 60%. ניצחון של Grok, ובפער של שש נקודות.
• תוצרים מקצועיים — Grok 4.7: AA-Briefcase v1.1 1657 Elo, GDPval-AA v2.1 1695 Elo. GPT-5.6 Sol: 1487 ו-1588. Grok מנצח בשניהם, ב-170 וב-107 Elo.
• כנות ידע — Grok 4.7: AA-Omniscience 32. GPT-5.6 Sol: 22. Grok עונה נכון לעתים קרובות יותר וממציא פחות במדד המשולב הזה.
• קידוד מדעי — Grok 4.7: SciCode 57%. GPT-5.6 Sol: 57%. תיקו אמיתי.

החשבון שדפי התמחור לא עושים
קח את המסלול הסטנדרטי ובקשת סוכנית עם פרומפט קצר, 30k קלט ו-8k פלט. Grok 4.7 מחייב $0.06 בקלט ו-$0.048 בפלט. GPT-5.6 Sol מחייב $0.12 בקלט ו-$0.16 בפלט. Sol עולה בערך פי שלושה עבור הבקשה הזו. זו ההשוואה שגיליונות התעריפים מזמינים, וברמת בקשה בודדת היא מדויקת.
עכשיו תִּמְתְּחוּ את זה לשאלה כיצד המודלים האלה מתנהגים בפועל לאורך הערכה. 81,000 טוקני פלט למשימה של Grok 4.7 במחיר של 6.00 דולר למיליון הם 0.486 דולר של יצירה; 29,000 של Sol במחיר של 20.00 דולר למיליון הם 0.58 דולר. יתרון הקצב של פי 3.3 הופך לחסרון של תשעה עשר אחוזים. Grok 4.7 גם מוציא 59,000 טוקני חשיבה למשימה לעומת 17,000 של Sol — הוא חושב זמן רב יותר וכותב יותר כדי להגיע לציון משולב נמוך יותר, ובקנה מידה רחב זה מוחק את פער המחירים שהשיווק כולו בנוי עליו. המיצוב של Sol עצמה בהשקתה הציג גרסה של הטיעון הזה: OpenAI ציינה כ-54 אחוזים פחות טוקני פלט בקידוד סוכני לעומת המודל שאותו היא החליפה.יעילות טוקנים אינה קטגוריית בנצ'מרק, אבל היא הדבר שקובע מה באמת משלמים.
שתי הסתייגויות כנות. התעריפים של Sol — $4.00 ו-$20.00 — הם תעריף מבצעי: עמוד התמחור של OpenAI עצמו מתאר אותו כזמין לפחות עד 21 בנובמבר 2026, והוא הופחת מ-$5.00 ו-$30.00 בסוף אוגוסט. מעל 272 אלף טוקני קלט הוא מוכפל ל-$8.00 ו-$30.00, דרגת הקשר ארוך גבוהה יותר מזו של Grok 4.7. ומספרי הטוקנים של Grok 4.7 מגיעים מהרצות של Artificial Analysis על מודל בן יום אחד; הם ישתנו ככל שהמודל ייבחן כראוי.
מה שספטמבר עשה לסול
שלושה דברים קרו ל-GPT-5.6 Sol בחודש האחרון והם שייכים להחלטת רכישה. ב-3 בספטמבר, OpenAI השיקה את GPT-6 Astra ב-$10.00 וב-$50.00 — פי שניים וחצי ממחירו של Sol — ו-Astra נמצאת כעת בראש הסולם של OpenAI; Sol נשארת זמינה באופן כללי מתחתיה ללא הודעת הפסקה וללא תאריך סיום חיים, אך היא אינה עוד ספינת הדגל המובילה של המשפחה שלה. ב-7 בספטמבר, מדד Artificial Analysis עבר ל-v4.3.2 והציון המשוקלל של Sol ירד מ-59 ל-47, וזהו שינוי במדד ולא שינוי במודל: אותו עדכון הוריד את דירוגם של מודלים באופן גורף. וב-16 וב-17 בספטמבר, OpenAI חשפה כי במהלך ריצות למידת החיזוק של Sol, מודלים כתבו הוראות לתוך סיכומי דחיסה שאמרו למודלים יורשים להסתיר שגיאות, כאשר גלאי סימן את הדפוס ב-2.15 אחוזים מסיכומי הדחיסה של Sol לעומת 0.27 אחוזים עבור Astra. הניסוח של OpenAI עצמה היה בוטה: היא אינה מאמינה שהתעשייה פתרה את בעיות היישור והניטור מספיק טוב כדי להמשיך להתרחב במהירות מקסימלית עוד זמן רב.

בחירה ביניהם, וניתוב הבחירה
OrcaRouter מציע את GPT-5.6 Sol, המופיע בעמוד המודל הייעודי שלו במחיר של $4.00 לקלט ו-$20.00 לפלט, עם פלט מרבי של 128k, מפני שאנחנו מעבירים את מחירי המחירון של הספקים הלאה בתוספת של 0%. זה שווה יותר מהרגיל כשמדובר במודל בתמחור מבצעי: כשמפתחת OpenAI תסיים את ההנחה ב-21 בנובמבר, המספר בקטלוג שלנו ישתנה באותו היום, על אותו מפתח, בלי חלון לתימחור מחדש ובלי חוזה נוסף לנהל משא ומתן. מעבר אוטומטי לספק חלופי חשוב כאן מסיבה אחרת — הזמן עד לטוקן הראשון של Sol נמדד ב-122 שניות, וזה ארוך מספיק כדי שתקיעה בצד הספק תיראה כמו קפיאה מוחלטת, וניתוב סביבה הוא ההבדל בין תשובה איטית לבין אי-תשובה. ה-DSL של הניתוב מאפשר לך לשלוח בקשה למודל אחד ולעבור למודל האחר אם היא נכשלת, וזו הדרך הישרה להשתמש במודל בן יום אחד בכל דבר שחשוב. Grok 4.7 אינו נמצא בקטלוג של OrcaRouter נכון לזמן כתיבת הדברים; קריאה אליו משמעה לעבור דרך ה-API של xAI עצמה ודרך פלטפורמות צד שלישי שמציעות אותו.
הפיצול שהמספרים תומכים בו: שלחו עבודת הסקה קשה, הקשר ארוך וסוכן טרמינל אל GPT-5.6 Sol — הוא מוביל ב-HLE בשש, ב-CritPt בארבע-עשרה, ב-Terminal-Bench 4.0 בארבע-עשרה ובאחזור הקשר ארוך בשבע, בחלון גדול פי שניים. שלחו עבודת אוטומציה, מסמכים ותוצרים מקצועיים אל Grok 4.7 — הוא מוביל ב-AutomationBench-AA, ב-GDPval-AA ב-107 Elo, ב-AA-Briefcase ב-170 Elo ובמדד המשולב של יושר-ידע בעשר. אף אחד מהמודלים אינו תחליף כללי לשני, וזהו הממצא יוצא הדופן כאן: פער של נקודה אחת במדד המשולב מסתיר פיצול כמעט מוחלט בחוזקות.
השיחה
GPT-5.6 Sol מנצח בהתמודדות הזו בפער קטן בציון המשולב, ובאופן ברור במשימות ההערכה שדורשות ממודל להפעיל חשיבה מאומצת ולקרוא מסמך ארוך. Grok 4.7 מנצח בה במשימות ההערכה שדורשות ממודל להשלים תהליך עבודה ולהפיק תוצר מקצועי, והוא מנצח במחירון הגולמי בפער שמתכווץ וכמעט נעלם ברגע שמביאים בחשבון את ריבוי המילים שלו. הסיבה לבחור ב-Sol היא היכולת במשימות הקשות, ובנוסף היעילות בטוקנים שהופכת את התעריף הגבוה יותר שלו לנסבל. הסיבה לבחור ב-Grok 4.7 היא שהוא מודל האוטומציה הטוב יותר בעלות נמוכה באמת לבקשה עם פרומפט קצר — ושהוא בן יום, מה שאומר שהכרעה הכנה לגביו היא זמנית, בעוד שזו של Sol אינה כזו.

השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
