
GPT-6.1 Sol עלה לאוויר: קרוב ל-Astra בחמישית מהמחיר, שבוע לאחר המודל שהוא מחליף
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 397 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 195 tok/s
- OrcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- xAISpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
OpenAI השיקה את GPT-6.1 Sol ב-29 בספטמבר 2026, בנאום המרכזי של DevDay 2026 — רענון של GPT-6 Solהדרגה שהושקה בדיוק שבוע קודם לכן, בלי שינוי מחיר, ומכוונת ישירות לדגם שעולה פי חמישה. מספרי הכותרת לא השתנו לעומת הדגם שהיא מחליפה: 2.00 דולר למיליון טוקנים בקלט ו-10.00 דולר למיליון טוקנים בפלט. המספר שכן זז הוא זה שרוב עומסי העבודה של סוכנים משלמים בפועל: קלט במטמון ירד מ-0.20 דולר ל-0.10 דולר למיליון טוקנים, מחצית מהתעריף של GPT-6 Sol ועשירית מזה של GPT-6 Astra. הניסוח של OpenAI עצמה הוא ש-GPT-6.1 Sol "כמעט משתווה" לאינטליגנציה של GPT-6 Astra בקידוד סוכני, שימוש במחשב ועבודה מקצועית, במחיר של חמישית ממחירי הטוקנים הסטנדרטיים של Astra, וזו טענה של ספק, לא טענה מדודה — נכון ל-30 בספטמבר, אף מעריך בלתי תלוי לא פרסם ולו ציון אחד לדגם. מה שמובא בהמשך מפריד בין השניים.
מה שוחרר, והיכן נמצאת הרשומה

השחרור מתועד היטב באופן יוצא דופן עבור הכרזת DevDay. בתוך שעות הופיע עמוד מודל ב-developers.openai.com, בלוק תמחור, נספח כרטיס מערכת ב-deploymentsafety.openai.com, וקומיט בסכימת ה-API הציבורית של הספק עצמו שכותרתו "Add gpt-6.1-sol model to model enums," עם חתימת זמן 17:16 UTC ב-29 בספטמבר. יומן השינויים למפתחים של OpenAI, לעומת זאת, עדיין מסתיים בערך מ-22 בספטמבר שהכריז על GPT-6 Sol ו-GPT-6 Luna — הערך של 6.1 לא נכתב שם, ולכן עמוד המודל ופוסט ההשקה הם התיעוד העיקרי. להכרעה הזו יש חשיבות משום שאין תמונת מצב מדור שני להצביע עליה: רשימת תמונות המצב של העמוד מכילה מזהה אחד, gpt-6.1-sol, בלי וריאנט מתוארך, כך ש"GPT-6.1 Sol" והפריסה שאתה מכנה היום הם אותו הדבר.
הצורה שלו, זה לצד זה עם מה שהוא מחליף:
• מזהה — gpt-6.1-sol, תמונת מצב אחת לעומת gpt-6-sol שגם לו אין וריאנט מתוארך
• הקשר — 1,050,000 טוקנים ומקסימום 128,000 טוקני פלט לשניהם; עמוד 6.1 מציין את שני הנתונים במפורש, בעוד שעמוד 6.0 מתעד מקסימום קלט של 922,000 טוקנים במקום
• חתך הידע — 30 באפריל 2026 לעומת 20 באפריל 2026
• מאמץ החשיבה — low, medium (ברירת מחדל), high, xhigh, max, כאשר none ו-minimal אינם נתמכים, לעומת אותו סולם בתוספת none
• תמחור — $2.00 קלט / $0.10 במטמון / $2.50 כתיבה למטמון / $10.00 פלט למיליון טוקנים לעומת $2.00 / $0.20 / $2.50 / $10.00
• פרומפטים ארוכים — מעל 272K טוקני קלט כל הבקשה מתומחרת מחדש לפי 2× תעריפי קלט ומטמון ו-1.5× פלט, זהה בשני המודלים
• זמינות — Plus, Pro, Business, Enterprise ו-Edu ב-ChatGPT Work ו-Codex, ובנוסף ה-API; במפורש לא במוצר ה-Chat הצרכני
• תושבות נתונים — תושבות נתונים בארה"ב ובאיחוד האירופי נתמכת, כאשר מצב מהיר אינו זמין תחת תושבות באיחוד האירופי
• כלים — חיפוש באינטרנט, חיפוש קבצים, יצירת תמונות, מפרש קוד, מעטפת מתארחת, apply patch, כישורים, שימוש במחשב, MCP וחיפוש כלים, כולם נתמכים דרך Responses API
• כוונון עדין — לא נתמך באף אחד מהם
צורת API אחת ששווה לסמן לפני שאתם מבצעים מיגרציה: GPT-6.1 Sol תומך ב-Chat Completions, אך קריאה לכלים דורשת את Responses API. ב-GPT-6 Sol האילוץ היה ההפוך-הסמוך — קריאה לפונקציות ב-Chat Completions עבדה רק עם reasoning_effort: "none". אם הסטאק שלכם קורא לכלים דרך /v1/chat/completions, זהו שינוי בקוד, לא החלפת מודל.
טענות ה-benchmark, המסומנות כטענות
כל מספר בסעיף הזה הוא של OpenAI, שפורסם בפוסט ההשקה, ואף אחד מהם עדיין לא שוחזר בידי מישהו מחוץ ל-OpenAI. כדאי לקרוא אותם במלואם, מפני שהדפוס שמאחוריהם עקבי — ההישגים לעומת GPT-6 Sol אמיתיים, אבל המסגור שנפוץ הוא ההשוואה ל-Astra, וההשוואה ל-Astra היא תמיד השוואת עלויות.
• DeepSWE v1.1, משימות הנדסת תוכנה מורכבות במאגרי קוד אמיתיים — OpenAI מדווחת ש-GPT-6.1 Sol משתווה ל-GPT-6 Astra בערך בחמישית מהעלות, ומנצח את הציון הטוב ביותר של GPT-6 Sol ב-6.4 נקודות אחוז במאמץ חשיבה נמוך יותר ובעלות נמוכה יותר.
• GDP.pdf, שאלות מקצועיות על מסמכי PDF מורכבים — OpenAI מדווחת ש-GPT-6.1 Sol משיג ציון מעל Claude Opus 5.5 עם מנגנוני גיבוי בפחות ממחצית העלות לכל משימה בהגדרות החשיבה שנבדקו, ומתקרב לתוצאה המתקדמת ביותר של Astra בערך בחמישית מהעלות לכל משימה.
• AutomationBench 1.0.6, תהליכי עבודה עסקיים רב-שלביים על פני 47 כלים — OpenAI מדווחת על 2.2 נקודות אחוז מעל Claude Opus 5.5 במאמץ חשיבה בינוני בערך בשליש מהעלות, ועל 4.8 נקודות מעל GPT-6 Sol באותה הגדרה.
• OSWorld 2.0 סט אופליין, שימוש ממוחשב ארוך-טווח — OpenAI מדווחת על שיפור של שבע נקודות לעומת GPT-6 Sol במאמץ חשיבה מרבי בפחות ממחצית מהעלות, ועל תוצאה בפער של עד 2.1 נקודות מ-Astra בערך בשביעית מהעלות לכל משימה.
• Terminal-Bench Science 0.1, תהליכי עבודה מדעיים — OpenAI מדווחת ש-GPT-6.1 Sol יותר ממכפיל את הציון של GPT-6 Sol במאמץ מרבי בפחות ממחצית העלות לכל משימה, במחיר ממוצע של $5.47 למשימה לעומת $23.21 עבור Claude Opus 5.5 ו-$23.80 עבור Astra. OpenAI גם מציינת ש-Astra עדיין מחזיקה בציון הגבוה ביותר מבין המודלים שהיא בדקה, עם 68.1%, ושיש להשתמש בה לעבודה המדעית הקשה ביותר — משפט מועיל בכך שאינו שיווקי.
• Factuality — בשיחות שעברו הסרת זיהוי, שבהן משתמשים סימנו שגיאה של מודל קודם, OpenAI מדווחת שחלק התשובות המכילות שגיאה עובדתית ירד מ-11.4% ל-7.7% במאמץ חשיבה נמוך, הפחתה של כ-32%, כאשר שיעור השגיאות נשאר בפער של עד 1.9 נקודות מזה של Astra בהגדרות שנבדקו ובפחות מחמישית מהעלות לכל משימה.
שניים מאלה ראויים לתרגום. ראשית, הערכת העובדתיות מורצת על פרומפטים שנבחרו בכוונה משום שמודל קודם טעה בהם; OpenAI אומרת זאת בפוסט, ופירוש הדבר הוא ש-11.4% ו-7.7% מתארים פרוסה עוינת של תעבורה, לא את התעבורה שלך. שנית, הפסקה שקוראת הכי חזק לטובת המודל היא זו שעוסקת בשקיפות כלי החיפוש בנספח הבטיחות: במשימות שנבנו כדי לעורר כשלים במאמץ החשיבה המרבי, GPT-6.1 Sol נכשל בלומר למשתמש שכלי החיפוש שלו מקולקל ב-2.1% מהמקרים, לעומת 4.9% אצל GPT-6 Sol, 1.5% אצל GPT-6 Astra ו-28.7% אצל GPT-6 Luna. זהו סוג המספר שמכריע אם סוכן ניתן לפריסה, והוא גם, שוב, של הספק עצמו.
הרשומה העצמאית ריקה, וזהו החצי האחר של הסיפור

Artificial Analysis — לוח הצד השלישי שבלוג הזה מתייחס אליו כאמת מידה נייטרלית — אין בו רשומה של GPT-6.1 Sol. כתובות ה-URL של המודל עבור ה-slug של 6.1 Sol מחזירות 404, והמחרוזת אינה מופיעה ב-HTML החי של לוח המובילים. מה שכן יש ללוח הוא הערכה מלאה של GPT-6 Sol במאמץ הסקה מקסימלי: Intelligence Index של 48, עלות של $1.06 לכל משימת אינדקס, 77 מיליון טוקני פלט שנוצרו בזמן הרצת האינדקס לעומת חציון של 88 מיליון בלוח, ו-Coding Agent Index של 57 בעלות של $2.99 למשימה. הנתונים האלה הם העוגן העצמאי הקרוב ביותר למודל ש-GPT-6.1 Sol מחליף, ואליהם כל טענה בנוגע ל-6.1 צריכה בסופו של דבר להימדד.
עד שהרשומה הזו תופיע, כל מי שמצטט ציון של 6.1 Sol מול מודל אחר מצטט בעצם את OpenAI מול OpenAI. זו אינה סיבה לאי-אמון בפוסט ההשקה; זו סיבה להריץ מערך הערכה משלכם לפני שאתם מעבירים מסלול ייצור. הספק נותן הנחיה קונקרטית במיוחד בעצמו: OpenAI מורה למפתחים שכבר משתמשים ב-GPT-6 Sol לעבור על הנחיות המיגרציה לפני המעבר, והנחיות המיגרציה מורות להם להשוות תצורות במשימות מייצגות במקום להניח שהמאמץ הגבוה ביותר הוא הפשרה הטובה ביותר.
הקיצוץ בקלט המטמון הוא החלק שבאמת משנה את החשבון
מחירון שלא זז אך תעריף מטמון שנחתך בחצי — קל לפספס בקריאה, והוא השורה בעלת ההשלכות הגדולות ביותר בהשקה הזו לכל מי שמריץ סוכנים. קלט שמור במטמון במחיר $0.10 למיליון טוקנים הוא 5% מתעריף הקלט ללא מטמון, מחצית מתעריף המטמון של GPT-6 Sol, ולעומת הקלט השמור במטמון של GPT-6 Astra במחיר $1.00 — עשירית מזה של דגם הדגל. לולאות סוכנים ששולחות שוב ושוב קידומת יציבה אלפי פעמים חיות כמעט כולן על השורה הזו. אותו חודש סוכנים של 200 מיליון טוקנים, שהיה מחויב בכ-40$ בעבור קלט שמור במטמון ב-GPT-6 Sol, מחויב בכ-20$ ב-GPT-6.1 Sol; ב-GPT-6 Astra אותה תעבורת קלט שמורה במטמון עולה 200$.
החישוב לעולם אינו יוצא כל כך נקי בסביבת ייצור, כי קריאות מהמטמון מחויבות לפי התעריף הזה רק כשהקידומת אכן נמצאת במטמון, ו-OpenAI מציינת ששינוי מאמץ החשיבה או סט הכלים הזמין כבר אינו מבטל רשומת מטמון כפי שנהג בעבר — זה התיקון השקט שהופך את שורת המטמון לשמישה בלולאת סוכן בכלל. הסף הנוסף שכדאי לשים לב אליו לא השתנה: חצו 272,000 אסימוני קלט והבקשה כולה מתומחרת מחדש בפי שניים מתעריפי הקלט והמטמון ובפי 1.5 מתעריף הפלט. Batch ו-Flex פועלים ב-50% מתחת לתעריף הרגיל, מצב מהיר פועל בפי 2 מהתעריף הרגיל, ועיבוד אזורי מוסיף תוספת של 10% במקומות שבהם הוא זמין.
מה שטרם שוחרר, ומה זה אומר לגבי ניתוב

OpenAI אומרת ש-GPT-6.1 Sol Ultrafast מגיע "בימים הקרובים" ב-Codex בקצב יצירת טוקנים מהיר עד פי 8, בלי מחיר מצורף. זו הבטחה, לא מוצר, וראוי לכנות אותה ככזו: אין היום מחירון Ultrafast לרמת 6.1, ו-OpenAI לא אמרה אם הנתון של פי 8 נמדד מול מהירות רגילה או מול מצב מהיר, שבעצמו מתומחר פי 2 מהרגיל. התייחסו להכרזה כאל אות תזמון ותמחרו אותה כשמספר יופיע.
מצדנו, ובכנות: GPT-6.1 Sol עדיין לא נמצא במסלולים של OrcaRouter. נקודת הקצה הציבורית של הקטלוג מחזירה "model not found" עבור openai/gpt-6.1-solהיום, ורשימת המודלים שלנו מ-OpenAI כוללת את GPT-6 Astra, GPT-6 Sol ו-GPT-6 Luna. מה שניתן לקרוא לו ב-OrcaRouter כרגע הוא GPT-6 Sol במחיר המחירון של OpenAI עצמה, ללא כל תוספת — מחירון ה-$2.00 / $0.20 / $10.00, וכלל התמחור-מחדש של 272K, מועברים בדיוק כפי שהספק מפרט אותם. לכך יש חשיבות גדולה מהרגיל השבוע, מסיבה ספציפית: אותה העברה ישירה משמעה שאם OpenAI תוריד את המחיר של שכבת 6.1, או תצמיד מספר ל-Ultrafast, השינוי יהיה פעיל אצלנו באותו היום שבו הוא פעיל אצל OpenAI, בלי חוזה נוסף לנהל משא ומתן מחדש. כאשר 6.1 Sol יגיע למסלולים הוא יופיע בתוך הקטלוגבמחיר הספק, כמו כל השאר, ועד אז התשובה הכנה היא שהמודל שהוא מחליף הוא זה שאפשר לקרוא לו.
הגרסה המעשית של ההחלטה: אם אתם כבר על GPT-6 Sol ועומס העבודה שלכם עתיר מטמון, סוכני או ארוך-אופק, רענון 6.1 משפר בדיוק את הממדים שאתם משלמים עליהם, וההגירה היא שינוי מחרוזת מודל בתוספת מעבר מ-Chat-Completions ל-Responses אם אתם משתמשים בכלים. אם עומס העבודה שלכם הוא יצירת פרומפטים קצרים עם מעט שימוש חוזר, השחרור כמעט לא משנה לכם דבר — אותו מחיר קלט, אותו מחיר פלט, אותו חלון. ואם חיכיתם לציון של צד שלישי לפני שהתחייבתם, ההמתנה הזו עדיין פתוחה.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
