
GPT-6 Sol מול GPT-5.6 Sol: נקודת אינדקס אחת, חצי מהמחיר, ורגרסיה שאיש לא הודיע עליה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 610 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 189 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
כן, שדרגו — אבל קראו את הפסקה השנייה לפני שתעשו זאת. GPT-6 Sol, שיצא ב-22 בספטמבר 2026, מקבל ציון 48 במדד Intelligence Index של Artificial Analysis. GPT-5.6 Sol, שיצא ב-9 ביולי 2026, מקבל ציון 47. נקודה אחת. המודל שהחליף אותו עולה חצי: 2.00 דולר למיליון טוקנים בקלט ו-10.00 דולר למיליון טוקנים בפלט, לעומת 4.00 ו-20.00 דולר. לפי המספרים הבולטים, זו החלטת השדרוג הקלה ביותר בהיצע הנוכחי, והקיצוץ במחיר הוא אמיתי, קבוע, וההפחתה הבודדת הגדולה ביותר שהספק ביצע במוצר דגל.
הסיבוך הוא שההערכה של Artificial Analysis עצמה את GPT-6 Sol מצאה תערובת של שיפורים ונסיגות ולא עלייה נקייה. יש נסיגות ב-GDPval-AA v2.1. יש גם מדרגת תמחור מחדש להקשר ארוך מעל 272,000 טוקני קלט, שמכפילה בערך את תעריף הקלט ומעלה את הפלט בחצי — ו-272K הוא בדיוק הטווח שבו ל-GPT-5.6 Sol יש חוזק מפורסם. הגירה שנראית כמו חצייה ישרה של החשבון שלך יכולה, בתעבורת הקשר ארוך, לצאת קרוב יותר לאיזון, עם ויתור על יכולת בצד.
מה עלייה של נקודה אחת ב{{1}}Index{{/1}} באמת אומרת
שני המודלים נמדדו על אותו לוח, גרסה 4.3.2, מה שהופך את זו להשוואה הנקייה ביותר בכל סדרת GPT-6 Sol — אין הבדלים במערכת הבדיקה, אין אי-התאמה בין ספק לגורם בלתי תלוי, מעבדה אחת שמודדת שני מודלים מאותו ספק.
• מדד AA Intelligence — GPT-6 Sol 48, מדורג 18 מתוך 212 לעומת GPT-5.6 Sol 47, מדורג 19 מתוך 212
• עלות לכל משימת Index — GPT-6 Sol כמחצית מ-GPT-5.6 Sol
• מהירות פלט — GPT-6 Sol 104.4 אסימונים/שנייה לעומת GPT-5.6 Sol 72.6 אסימונים/שנייה
• זמן עד לאסימון הראשון — GPT-6 Sol 107.18 שנ׳ לעומת GPT-5.6 Sol מהיר יותר, שניהם לעומת חציון לוח של 3.87 שנ׳
• מחיר קלט — GPT-6 Sol $2.00 ל-1M לעומת GPT-5.6 Sol $4.00 ל-1M
• מחיר פלט — GPT-6 Sol $10.00 ל-1M לעומת GPT-5.6 Sol $20.00 ל-1M
• קלט במטמון — GPT-6 Sol בהנחה של כ-90% לעומת GPT-5.6 Sol $0.40 ל-1M
• תעריף אצווה — GPT-6 Sol לא פורסם לעומת GPT-5.6 Sol $2.50 / $15.00
• דרג הקשר ארוך — GPT-6 Sol מתמחר מחדש מעל 272K קלט לעומת GPT-5.6 Sol ללא שלב מקביל
• חלון הקשר — GPT-6 Sol 872K לפי AA, 1.05M מוצהר לעומת GPT-5.6 Sol בערך 1.05M עד 1.1M
• פלט מקסימלי — 128K בשניהם
• שוחרר — GPT-6 Sol 2026-09-22 לעומת GPT-5.6 Sol 2026-07-09

הסתכלו על שני קווי המהירות יחד. GPT-6 Sol מייצר פלט מהר בכ-44% מקודמו, והוא איטי באופן דרמטי בהפקת הטוקן הראשון — 107.18 שניות לעומת חציון של 3.87 בלוח. GPT-5.6 Sol גם הוא אינו מודל מהיר לפי סטנדרטים של הלוח, אבל הוא לא נמצא בטריטוריה הזו. אם עברתם ל-GPT-5.6 Sol עבור מוצר אינטראקטיבי, GPT-6 Sol אינו תחליף ישיר, וזו רגרסיה פונקציונלית שאינה תלויה באף בנצ'מרק.
שורה אחת היא חיובית בשקט: התעריף הסטנדרטי של GPT-6 Sol, העומד על $2/$10, נמוך מהתעריף האצוותי של GPT-5.6 Sol, העומד על $2.50/$15. אפילו המדרגה המוזלת של הדגם הישן יקרה יותר ממחיר המחירון של הדגם החדש. זו הראיה החזקה ביותר לכך שההורדה היא מבנית ולא מבצעית.
הרגרסיה היא החלק המעניין
Artificial Analysis מצאה ש-GPT-6 Sol מפחית בערך בחצי את העלות לכל משימה, תוך יצירת שילוב של שיפורים ורגרסיות. GDPval-AA v2.1 היא הרגרסיה הנקובה בשם. בנפרד, גם GPT-5.6 Luna של OpenAI רשמה רגרסיה ב-Coding Agent Index — מה שמרמז על דפוס בדור הזה ולא על פספוס מבודד במודל אחד.
כדאי להתייחס לזה ברצינות דווקא משום שזהו הממצא העצמאי. חומרי ההשקה של OpenAI בנויים סביב עלות למשימה וסביב שורות בנצ'מרק שהיא בחרה; ל-Artificial Analysis אין מוצר למכור, והיא מדווחת את מה שהפיק מערך הבדיקות שלה. מודל שזול יותר ובערך שווה בציון המשולב, אך גרוע באופן מדיד בתת־משימות מסוימות, אינו מודל טוב יותר באופן מוחלט. זו נקודה אחרת על החזית.
הגרסה המעשית של זה: אם עומס העבודה שלכם הוא בעל צורה מובהקת של GDPval-AA — עבודת ידע בעלת ערך כלכלי, סוג המשימה שהמדד הזה נבנה כדי לתמחר — אז הרווח המשולב של נקודה אחת אינו מכסה אתכם, והרגרסיה היא המספר שחשוב. אם עומס העבודה שלכם הוא כללי, הפחתת עלות המשימה בחצי היא המספר שחשוב, והציון המשולב אומר שלא ויתרתם על שום דבר מדיד.
איפה GPT-5.6 Sol עדיין מנצח
ל-GPT-5.6 Sol יש תוצאת אחזור ארוכת-הקשר שפורסמה, שאותה GPT-6 Sol אינו משיג עם שום דבר שקול: MRCR v2, 8-needle, 91.5% בטווח 256K עד 512K. זהו נתון דיוק אחזור ברצועה שבה מחירון התעריפים של GPT-6 Sol משתנה.
הצג את שתי העובדות זו לצד זו. מעל 272,000 טוקני קלט, כל בקשה ב-GPT-6 Sol מתומחרת מחדש לבערך $4 לקלט ו-$15 לפלט. זה בערך התעריף הישן של GPT-5.6 Sol לקלט ושלושה רבעים ממנו לפלט — כך שהחיסכון של 50% שעבורו היגרתם מתמוטט לבערך 0% בקלט ו-25% בפלט, בדיוק בטווח ההקשר שבו ל-GPT-5.6 Sol יש חוזקה מתועדת ול-GPT-6 Sol אין מקבילה שפורסמה.
תוצאות אחרות שפורסמו של GPT-5.6 Sol נותרות מכובדות והן הסיבה לכך שחלק מהצוותים לא יעברו:
• המבחן האחרון של הסוכנים — GPT-5.6 Sol 53.6
• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0
• SWE-Bench Pro — GPT-5.6 Sol 64.6
• OSWorld 2.0 — GPT-5.6 Sol 62.6
• BrowseComp — GPT-5.6 Sol 90.4
• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo
• HLE — GPT-5.6 Sol 49.5
• MRCR v2, 8-מחטים — GPT-5.6 Sol 91.5% ב-256K עד 512K
אלה דווחו על ידי OpenAI. שימו לב ש-BrowseComp עם 90.4 ונתון ה-MRCR הם השניים שהכי קשה להחליף: סוכני מחקר באינטרנט ואחזור בהקשר ארוך הם עומסי עבודה שבהם מודל בן חודשיים עם מספר שפורסם הוא הימור בטוח יותר ממודל חדש בלי מדידה מקבילה.
מה GPT-6 Sol מביא שאינו מופיע במחירון
התמחור הוא הסיפור, אבל שלושה דברים אחרים השתנו.
ראשית, תקרת ההקשר. GPT-6 Sol מופיע עם 872,000 טוקנים לפי Artificial Analysis, לעומת טענה של 1.05M במקום אחר בחומרים של OpenAI, עם מקסימום קלט של 922K. GPT-5.6 Sol נמצא בסביבות 1.05M עד 1.1M בהתאם למקור. על הנייר זהו צעד קטן אחורה בחלון השמיש — עם הסתייגות: גבול המדרגה של 272K, ולא התקרה, הוא שקובע את העלות.
שנית, זמינות. GPT-6 Sol נמצא ב-API וב-ChatGPT Work ו-Codex ב-Plus, Pro, Business, Enterprise ו-Edu — ומנהלי Enterprise צריכים להפעיל אותו לפני שמשתמשים רואים אותו. הוא לא נמצא ב-ChatGPT Chat. GPT-5.6 Sol היה פריסה רחבה יותר. אם נתיב הגישה של הצוות שלך עובר דרך מנהל Enterprise, ההגירה היא לא רק שינוי בקוד.
שלישית, השקתו של דגם דגל חדש בדרך כלל משמעה שהדגם הישן הופך לחלופת גיבוי זולה יותר במקום לצאת משימוש. GPT-5.6 Sol במחיר $4/$20 הוא עדיין מודל מצוין עם 47 באינדקס, ולעבודות אחזור בהקשר ארוך יש לו מספר מפורסם שלמודל GPT-6 Sol אין.
הגירה שעולה פחות ממה שזה נראה
הסיבה לכך שהשדרוג המסוים הזה קל היא ששני המודלים הם של אותו ספק, בעלי אותה צורת API, וסמוכים זה לזה בדירוג — מה שאומר שההגירה היא שינוי של מחרוזת מודל ולא בנייה מחדש של הארכיטקטורה, ונתיב הגיבוי כבר נמצא בקוד שלך. GPT-5.6 Sol זמין ב-OrcaRouter במחיר המחירון של OpenAI, במסגרת מודל ה-pass-through שמעלה שינוי מחיר של OpenAI אצלנו לאוויר באותו היום ולא אחרי שמפיץ מנהל משא ומתן מחדש.
GPT-6 Sol אינו בקטלוג שלנו נכון למועד כתיבת שורות אלה — ניתן להגיע אליו דרך ה-API של OpenAI עצמה. לכן הצורה הכנה של מיגרציה היא מסלול עם GPT-5.6 Sol מאחוריו על אותו מפתח: לשלוח תעבורה חדשה אל GPT-6 Sol, להשאיר את הדגם הקודם במרחק שינוי קונפיגורציה אחד, ולתת ל-failover אוטומטי לכסות את החלון שבו הזמינות של דגם דגל חדש עדיין מתגבשת. עבור דגם בן יומיים, שמולו נמצא מתג הפעלה של Enterprise ושכבת הקשר ארוך שמשנה את הכלכלה מעל 272K טוקנים, העובדה שהדור הקודם עדיין מחובר אינה זהירות — היא ההבדל בין אחר צהריים רע לשבוע רע.

רשימת הבדיקה של המיגרציה
מדוד את התפלגות ההקשר בפועל שלך לפני כל דבר אחר. אם האחוזון ה-95 של הבקשות שלך נמצא מתחת ל-272,000 אסימוני קלט, בצע מיגרציה — החיסכון הוא 50% אמיתי משני צדי החשבון, העלות למשימה יורדת בחצי, והמדד המשולב אומר שלא ויתרת על דבר. אם חלק משמעותי מהתעבורה נמצא מעל לקו הזה, בצע מידול זהיר של השכבה: בתעריף של בערך $4/$15, היתרון לעומת $4/$20 של GPT-5.6 Sol הוא 25% בפלט ולא כלום בקלט, ואתה משלם על כך באובדן של תוצאת אחזור מתועדת בהקשר ארוך.
בדוק אם מישהו ממתין לטוקן הראשון. 107 שניות הן בערך פי עשרים ושמונה מהחציון של הלוח, וזהו מצב הכשל שיצוף ראשון בפרודקשן. כל דבר שבצד השני שלו נמצא אדם צריך להישאר על GPT-5.6 Sol או להיות מנותב למקום אחר.
לאחר מכן בדוק את נתיב ההפעלה. תוכניות Enterprise דורשות שמנהל יפעיל את GPT-6 Sol, והוא נעדר לחלוטין מ-ChatGPT Chat. ודא שהמשתמשים שלך באמת יכולים להגיע אליו לפני שתכריז על מיגרציה באופן פנימי.
לבסוף, עקבו אחר GDPval-AA v2.1 בהערכות שלכם במהלך החודש הראשון. המעבדה העצמאית מצאה שם רגרסיה, ושיפור מורכב של נקודה אחת לא אומר לכם אם מערך המשימות הספציפי שלכם עלה או ירד. הריצו את ההערכות שלכם על שני המודלים לפני שאתם עוברים, לא אחרי.

השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
