
GPT-6 Sol: המדריך המלא ל-GPT-6 בדרגת הביניים של OpenAI
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 982 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 195 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
GPT-6 Sol הוא הדרגה האמצעית במשפחה — המודל בין דגם הדגל GPT-6 Astra שמעליו והזול, המהיר GPT-6 Luna שמתחתיו, שוחרר ב-22 בספטמבר 2026 במחיר של $2.00 למיליון טוקנים בקלט ו-$10.00 למיליון טוקנים בפלט. זה חצי ממה שGPT-5.6 Sol עלה עבור מודל שהספק מתאר בתיעוד שלו כ"בנוי להפעיל קידוד מורכב וזרימות עבודה סוכניות": חלון הקשר של 1,050,000 טוקנים, תקרת פלט של 128,000 טוקנים, קלט טקסט ותמונה, ושש רמות של מאמץ חשיבה הנעות מללא עד מקסימום.
העמוד הזה הוא עמוד הייחוס לדגם הזה — זה שאליו אתם מגיעים אחרי שהקלדתם את שמו. הוא במכוון לא הכרזה שנייה. תאריך ההשקה משמש כאן כדי לתארך את הדגם, לא כדי לדווח על אירוע: הדגם הוא היום מוצר API פעיל וזמין לשימוש כללי, ומה שדרוש לקורא שמגיע לעמוד הזה הוא המחירון, המעטפת, הטענות של הספק מסומנות בבירור, ומה שמעריך בלתי תלוי מדד. עוגן התאריך הוא 22 בספטמבר 2026, שישה ימים לפני שהעמוד הזה נכתב, כך שההשקה נמצאת גם היא בתוך חלון טריות של שבעה ימים; הקטע שאתם קוראים הוא הסיבה לכך שהעמוד הוא עמוד ייחוס ולא ידיעה חדשותית. הסיבה שהוא קיים בכלל היא ביקוש בחיפוש שנמדד ממקור ראשון באתר הזה: אנשים מקלידים את שמו של הדגם עצמו, והתנועה הלא ממוקדת סביב השם הזה היא כולה בצורת השוואות "מול" וכבר מטופלת על ידי עמודי ההשוואה שאנחנו מפרסמים בנפרד.
היכן GPT-6 Sol נמצא בסטאק של GPT-6
התיעוד של OpenAI עצמה מציין שלושה מודלים של GPT-6 ומקצה לכל אחד מהם תפקיד. GPT-6 Astra הוא הדגל — במדריך של החברה עצמה הוא מכונה המודל האינטליגנטי ביותר שלה, מיועד לשימוש במחשב, גלישה, הנדסת תוכנה, מדע ויצירת מסמכים, ומחירו 10.00$ / 50.00$ לפני כל דרגות. GPT-6 Luna הוא דרג היעילות, מיועד לעבודה מוגדרת היטב בנפח גבוה, ועולה 0.10$ / 0.50$. GPT-6 Sol הוא האמצע: עמוד המודלים של OpenAI מתאר אותו בשורה אחת כמי שנבנה לקידוד מורכב ולתהליכי עבודה סוכניים, והמדריך המשפחתי שלו אומר למפתחים לבחור ב-gpt-6-astra לרמת היכולת הגבוהה ביותר, ב-gpt-6-sol ל"חשיבה חזקה במשימות תובעניות", וב-gpt-6-luna לעבודה יעילה וניתנת לחזרה בהיקף גדול.
שתי עובדות הופכות את השכבה הזו לממשית ולא לתווית תמחור. Sol נושאת את אותו חלון של 1,050,000 טוקנים ואותה תקרת פלט של 128,000 טוקנים כמו Astra — השכבה האמצעית אינה חלון קטן יותר, אלא פחות דולרים של יכולת לכל טוקן. ו-Sol תומכת בהגדרת חשיבה ש-Astra אינה תומכת בה: reasoning.effort מקבל none ב-Sol, כך שאפשר להריץ את המודל בלי מעבר חשיבה כלל, בעוד שסולם האפשרויות של Astra מתחיל ב-low. בכל השאר סולם המאמץ זהה — none, low, medium (ברירת המחדל), high, xhigh, max.
Artificial Analysis מתארכת את GPT-6 Astra ל-3 בספטמבר 2026 ואת GPT-6 Sol ו-Luna ל-22 בספטמבר 2026 — שלושה שבועות שמפרידים בין ההשקה הראשונה של דור הדגל לבין אחיו הזולים יותר. שימו לב ששורת הקטלוג שלנו עבור GPT-6 Astra נושאת תאריך קטלוגי של 4 בספטמבר; זהו ארטיפקט קטלוגי, וה-3 בספטמבר של העוקב העצמאי הוא תאריך ההשקה שבו אנו משתמשים כאן.
כרטיס התעריפים, במלואו
כל נתון בסעיף זה מקורו בתיעוד התמחור של OpenAI עצמה ובעמוד המודל GPT-6 Sol, שניהם נקראו ב-28 בספטמבר 2026, ושניהם לפי מיליון טוקנים בדולר ארה"ב.
• רגיל, עד 272,000 אסימוני קלט — $2.00 קלט, $0.20 קלט במטמון, $2.50 כתיבה למטמון, $10.00 פלט.
• יחס קלט שמור במטמון — OpenAI מחייבת על קלט שמור במטמון ב־10% מהתעריף של קלט לא שמור, הנחה של 90%, ומציינת שכתיבות למטמון מחויבות ב־1.25× מתעריף הקלט הלא שמור. ההשקה של GPT-6 גם הסירה חיכוך שנהג לעלות כסף בשקט: שינוי מאמץ החשיבה או זמינות הכלים כבר אינו מבטל את המטמון.
• הקשר ארוך, מעל 272,000 אסימוני קלט — 4.00$ קלט, 0.40$ קלט במטמון, 5.00$ כתיבות מטמון, 15.00$ פלט. הסף הוא 272K, והוא מצוין בעמוד המודל GPT-6 Sol של OpenAI עצמו ולא שאול מעמוד Astra, הנושא את אותו מספר. אותו עמוד מציין את כלל התמחור מחדש במשפט אחד: פרומפטים עם יותר מ-272K אסימוני קלט מתומחרים ב-2× מתעריפי הקלט והמטמון וב-1.5× פלט עבור הבקשה כולה. אין זה תשלום עודף על העודף. בקשת 300,000 אסימונים מחייבת את כל 300,000 האסימונים בתעריף ההקשר הארוך, כך שהעלות של חציית הקו היא קפיצת מדרגה ולא שיפוע — והקפיצה מגיעה בגבול שרוב צינורות המסמכים הארוכים חוצים בטעות.
• Batch and Flex — שניהם מתומחרים ב-50% מהתעריפים הסטנדרטיים החלים, כך ש-Batch and Flex ב-Sol הם $1.00 / $5.00 עבור הקשר קצר ו-$2.00 / $7.50 עבור הקשר ארוך, כאשר קלט במטמון מתומחר ב-$0.10 ו-$0.20 בהתאמה.
• מצב מהיר — פי 2 מהתעריף החל, כלומר $4.00 / $20.00 עבור הקשר קצר ו-$8.00 / $30.00 עבור הקשר ארוך. OpenAI שינתה את שם עיבוד העדיפות ל"מצב מהיר" ב-30 ביולי 2026 ומקבלת גם service_tier: "priority" וגם "fast".
• שתי תוספות מחיר שכדאי להכיר — נקודות קצה של עיבוד אזורי כוללות תוספת של 10% עבור מודלים שיצאו לאור ב-5 במרץ 2026 ואילך, ונקודות קצה של FedRAMP כוללות תוספת של 10% על התעריפים הסטנדרטיים. עבור GPT-6 Sol ו-Luna, שהיית נתונים באיחוד האירופי זמינה רק עם עיבוד Standard.
• הקשר למחיר — מחירון OpenAI עדיין מציג את GPT-5.6 Sol במחיר $4.00 / $20.00, כאשר צוין שתמחור מבצעי תקף לפחות עד 21 בנובמבר 2026. המחיר $2.00 / $10.00 של Sol הוא הפחתה של 50% בשני הצדדים לעומת קודמו הישיר, ו-OpenAI אמרה לכתבים שהתעריפים החדשים קבועים ולא מבצעיים. זוהי הצהרה של דובר ולא התחייבות כתובה במחירון, ולכן ראוי להתייחס אליה כהצהרת ספק ולא כעובדה חוזית.

המעטפה
• הקשר ופלט — חלון הקשר של 1,050,000 טוקנים, 922,000 טוקני קלט מרביים, 128,000 טוקני פלט מרביים. המספר 1,050,000 הוא של OpenAI עצמה; Artificial Analysis מציינת 872,000 בטבלת המפרטים שלה עבור אותו דגם, והשאלות הנפוצות באותו עמוד אומרות 870k. התייחסו למספר הספק כאל החוזה ולמספר של כלי המעקב כאל מדידה של תצורה מסוימת שנמצאת בשירות.
• מודאליות — קלט טקסט ותמונה, פלט טקסט, לפי עמוד המודל של OpenAI. בשורת הקטלוג שלנו עבור המודל מופיע גם קלט קובץ לצד טקסט ותמונה, ובעמוד של OpenAI לא. עמוד הספק קובע, ולכן הקריאה הכנה של המודל הזה כיום היא קלט טקסט ותמונה.
• תאריך חתך הידע — 20 באפריל 2026. התאריך של GPT-6 Luna הוא 18 במאי 2026, וזה של Astra הוא 30 באפריל 2026, כך ששלושת המודלים במשפחה אינם חולקים תאריך חתך.
• נקודות קצה — גם Chat Completions וגם Responses נתמכים, וגם Batch נתמך. Realtime, תרגום ותמלול ב-Realtime, Assistants, כיוונון עדין, הטמעות, יצירה ועריכה של תמונות, דיבור, תמלול ותרגום שמע, מודרציה, ונתיב Completions הישן — כולם אינם נתמכים.
• כלים ופלט מובנה — הזרמה, פלטים מובנים, קריאה לפונקציות, חיפוש בקבצים, קלט תמונות, חיפוש באינטרנט ומטמון פרומפטים — כולם מופיעים ברשימה. יש כאן מלכוד אחד: ב-Chat Completions, קריאה לפונקציות עובדת רק כאשר reasoning_effort הוא none. חשיבה עם כלים דורשת את Responses API.
• פרמטרים לא נתמכים כאשר reasoning מופעל — כאשר reasoning effort מוגדר לכל ערך שאינו none, הסר temperature, top_p ו-top_logprobs; ב-Chat Completions הסר גם logprobs.
מה OpenAI טוענת, ואיזה סוג של טענה זו
חומר ההשקה של OpenAI עבור GPT-6 Sol, כפי שדווח על ידי The Decoder ביום ההשקה, מוטב לקרוא אותו כטיעון בדבר עלות בשוויון ולא כטענת יכולת. הנתונים שלהלן מדווחים על ידי הספק, לא שוחזרו באופן עצמאי, והם הצורות ש-OpenAI בחרה לפרסם; מערך הבנצ'מרקים צר מהמבחר הרגיל, כפי שמציין אותו סיקור — GDPval ו-Terminal-Bench 4.0 נעדרים ממנו.
• FrontierCode 1.1, לפי דיווח הספק — GPT-6 Sol משיג 49.3% במאמץ מרבי בעלות של $2.14 למשימה. OpenAI מציבה זאת בערך באותה רמה כמו Claude Fable 5.1 עם 50.3% במאמץ מרבי, שעולה $12.83 למשימה בהשוואה של OpenAI עצמה.
• DeepSWE v1.1, לפי דיווח הספק — 68.8% עבור GPT-6 Sol במאמץ מרבי, בפער של 1.1 נקודות בלבד מהתוצאה הטובה ביותר שפורסמה של Claude Fable 5, 69.9%, ובעודף על GPT-6 Luna של OpenAI עצמה, שלדברי OpenAI משתווה ל-Sol ב-xhigh במחיר נמוך בהרבה.
• AutomationBench ו-OSWorld 2.0, לפי דיווח הספק — OpenAI מדווחת ש-GPT-6 Sol במאמץ מקסימלי גובר על Claude Opus 5 במאמץ מקסימלי במדד זרימות עבודה עסקיות בעלות של 9% מהעלות למשימה, ואומרת ש-GPT-6 מספק תוצאות שימוש במחשב דומות ל-Claude Opus 5 בעלות נמוכה בכ-80%, כאשר GPT-6 Astra עדיין מובילה בקטגוריה הזו בתוך המשפחה של OpenAI עצמה.
קראו את הצורה של המשפטים האלה ולא את המספרים. כל אחד מהם מצמיד ציון שקרוב לזה של מתחרה לעלות שהיא שבריר מהעלות של המתחרה. זו טענת השתוות בעלות נמוכה יותר, לא טענת דומיננטיות, והיא הצהרה חלשה באופן מהותי יותר מ"המודל הטוב ביותר" — וזה מה ש-OpenAI מייעדת ל-Astra. טענות הספק כאן אומרות ששכבת הביניים סגרה את פער המחיר; הן לא אומרות שהיא סגרה את פער היכולות.
הקריאה העצמאית
Artificial Analysis העריכה את GPT-6 Sol במאמץ חשיבה מרבי ופרסמה את התוצאות ביום ההשקה. הנתונים שלה בלתי תלויים והם מהווים את המשקל שכנגד לפסקה שלעיל.
• מדד האינטליגנציה — 48 במדד האינטליגנציה של Artificial Analysis v4.3.2, הכולל עשר הערכות, ובהן AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience ו-AA-LCR v1.1. העמוד מציב אותו במקום ה-18 מתוך 211 מודלים בקבוצת ההשוואה שלו — מכנה שמשתנה ככל שהעוקב מוסיף מודלים.
• עלות לכל משימה — 1.06 דולר לכל משימה ב-Intelligence Index, לעומת תעריף משולב של 1.54 דולר למיליון טוקנים בתמהיל 7:2:1 של פגיעות מטמון/קלט/פלט של Artificial Analysis. המודל ייצר 77 מיליון טוקני פלט במהלך הרצת המדד, לעומת חציון של 88 מיליון בקרב מודלי חשיבה בדרג המחיר שלו, כך שהוא אינו מנצח בקיצור.
• מהירות והשהיה — 88.7 אסימוני פלט בשנייה שנמדדו דרך ה-API של OpenAI, מעל החציון של 82.6 במעקב עבור מודלי חשיבה דומים, עם זמן עד לאסימון הראשון של 138.06 שניות לעומת חציון של 3.79 שניות. שני המספרים הללו מתארים את אותה פשרה: המודל מהיר מרגע שהוא מתחיל ואיטי להתחיל, וזו החתימה הצפויה של מעבר חשיבה ארוך.
• היכן זה הלך אחורה — הפרשנות של The Decoder לתוצאות של Artificial Analysis מדווחת על רגרסיות בשתי הערכות של עבודת ידע לעומת הדור הקודם: כ-100 נקודות Elo שאבדו ב-GDPval-AA v2.1 וכ-75 ב-Luna, כאשר בדיקה ידנית מייחסת את הירידה בעיקר לאיכות ההצגה ולתוצאות חלקיות. הסיכום של Artificial Analysis עצמו, כפי שדווח, הוא שעלויות פר משימה צומצמו בכמחצית בעוד שציוני האינטליגנציה נותרו ברמות של GPT-5.6, עם שיפורים בהערכות מסוימות ורגרסיות באחרות.
הסתייגות אחת חלה על כל האמור. GPT-6 Sol ו-GPT-6 Astra לא הושוו זה מול זה במבחני ביצועים במאמץ חשיבה תואם ובמערכת בדיקה תואמת בידי אף גורם שאנו יכולים לצטט, ושני המספרים שמצוטטים זה לצד זה — Sol ב-48 ו-Astra ב-53 — מגיעים מאותו מדד אך לא בהכרח מאותה תצורה. הגרסה הכנה של ההשוואה הזו קצרה: במדד, Astra משיגה ציון גבוה מ-Sol, ואף הרצה שפורסמה אינה מבודדת כמה מהפער נובע מהמודל וכמה מהגדרת מאמץ החשיבה.

זמינות, והדבר האחד שהשתנה לאחר ההשקה
OpenAI הוציאה את שני המודלים ב-22 בספטמבר 2026 דרך ה-API שלה כ-gpt-6-sol ו-gpt-6-luna, וחומרי ההשקה שלה הציבו אותם ב-ChatGPT Work וב-Codex עבור מנויי Plus, Pro, Business, Enterprise ו-Edu, כאשר משתמשי Free ו-Go הגיעו ל-GPT-6 Luna דרך אפליקציית שולחן העבודה. אף אחד מהמודלים לא היה זמין בממשק ChatGPT Chat הרגיל בעת ההשקה — זו ההצגה של OpenAI עצמה כפי שדווח באותו יום, וזה הפרט שסביר ביותר לבלבל קורא שחיפש את Sol בבורר המודלים ולא מצא אותו.
השינוי שלאחר ההשקה שחשוב לכל מי שמזין למודל הזה תמונות נמצא ביומן השינויים של ה-API של OpenAI עצמה, מתוארך ל-25 בספטמבר 2026: OpenAI תיקנה באג בקידוד תמונות שלדבריה פגע ביכולת הבנת התמונות ב-GPT-6 Sol וב-GPT-6 Luna, והשפיע על משימות חזותיות ב-API וב-Codex, כולל שימוש במחשב. ההמלצה של יומן השינויים עצמו היא להריץ מחדש הערכות ולנסות שוב תהליכי עבודה שנפגעו אם קלטי תמונה הם חלק ממקרה השימוש שלכם. זהו תיקון בן שלושה ימים במודל בן שישה ימים, וזו הסיבה לכך שהרצת בנצ'מרק משבוע ההשקה והרצה מהשבוע הזה יכולות להיות שונות זו מזו בכל דבר חזותי.
הרצת GPT-6 Sol על OrcaRouter
GPT-6 Sol מנותב ב-OrcaRouter כ-openai/gpt-6-sol on OrcaRouter, במחיר המחירון של OpenAI עצמה, כאשר מחיר המחירון של הספק מועבר הלאה ב-0% תוספת, לצד openai/gpt-6-astra ו-openai/gpt-6-luna. שלושתם יושבים מאחורי נקודת קצה אחת תואמת OpenAI ומפתח API אחד, וזה מה שהופך את שאלת השכבה לניתנת לבדיקה במקום לתיאורטית: אפשר לכוון את אותו גוף בקשה אל Sol עבור נתיב ייצור ואל Luna עבור עבודת הכמות שלצידו, בלי חוזה שני ובלי שינוי בקוד, ושינוי מחיר מצד הספק נכנס לתוקף כאן באותו היום ולא אחרי מחזור תמחור מחדש. אם אתם מעבירים עומס עבודה למודל כה חדש, מעבר אוטומטי לגיבוי בין ספקים הוא החצי השני של הטיעון — כך אתם מנסים מודל בן שישה ימים על תעבורה אמיתית בלי להמר את נתיב הייצור על החודש הראשון שלו.
שני דברים שכרטיס התעריפים עושה לחשבון אמיתי, עם החישוב המלא:
• הרצת ניתוח מסמך של 900,000 אסימונים מחויבת לפי הקשר ארוך עבור כל הבקשה: 900,000 אסימוני קלט במחיר $4.00 למיליון הם $3.60, בתוספת פלט. אותה הרצה שנשמרת מתחת ל-272,000 אסימונים מחויבת במחיר $2.00 למיליון. פיצול בקשה אחת גדולה מדי לארבע קריאות מתחת לסף אינו טריק כאן; זהו חיסכון ישיר של פי 2 בקלט.
• לולאת סוכן במטמון היא המקום שבו הנחת קלט שמור של 90% עושה את העבודה: קידומת יציבה הנקראת מחדש מאות פעמים עולה $0.20 למיליון ב-Sol במקום $2.00, ומכיוון ששינוי מאמץ החשיבה כבר אינו מבטל את המטמון, ניתן ללכת במעלה סולם המאמץ בתוך שיחה אחת בלי לשלם על בנייה מחדש של הקידומת.
אם מה שאתם באמת רוצים הוא ההכרעה בין שני המודלים — זה או הדגם המוביל — הרצנו בנפרד את ההשוואה המלאה של GPT-6 Sol מול GPT-6 Astra, והתיעוד מלפני ההשקה של מה שהיה אז מודל שטרם שוחרר נשמר בטקסט משלו, במקום להידון מחדש כאן.

השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
