
GPT-6 Sol Pro מול GPT-6 Astra: מכפיל המחיר שכולם מצטטים הוא שגוי
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
GPT-6 Sol Pro ו-GPT-6 Astra הם הדרגה הזולה ודגם הדגל של אותו ספק, והמכפיל שרוב הסיקור מצמיד לפער הזה הוא 2.5×. זה לא 2.5×. GPT-6 Sol — הדגם של הספק שתצורת gpt-6-sol-pro מריצה, זמין באופן כללי מאז 22 בספטמבר 2026 במחיר של $2.00 למיליון טוקני קלט ו-$10.00 למיליון טוקני פלט — מתומחר מול GPT-6 Astra, דגם הדגל שהגיע לזמינות כללית ב-3 בספטמבר 2026, במחיר של $10.00 ו-$50.00. כלומר פי חמישה בקלט ופי חמישה בפלט. הנתון של 2.5× שייך להשוואה אחרת: Astra מול GPT-5.6 Sol, הדור הקודם, שעלה $4.00 ו-$20.00.
שווה לתקן את הבלבול הזה לפני כל דבר אחר, כי הוא משנה את ההחלטה. פרמיה של פי 2.5 עבור דגם הדגל היא שגיאת עיגול בתקציב פרויקט. פרמיה של פי 5 היא הסעיף הבודד הגדול ביותר ברוב תוכניות ההסקה, וזה המספר שקובע אם דגם הדגל הוא ברירת מחדל או חריג.
מהיכן הגיע המכפיל השגוי
כאשר Astra הושקה ב-3 בספטמבר, ההשוואה ש-OpenAI ורוב כלי התקשורת ערכו הייתה מול GPT-5.6 Sol, שהיה דגם הביניים הזמין באותה עת. Astra עלתה פי 2.5 מהדגם הזה. תשעה עשר ימים לאחר מכן OpenAI שחררה את GPT-6 Sol והפחיתה בחצי את מחיר דגם הביניים, מ-4.00$ ו-20.00$ ל-2.00$ ו-10.00$, ותיארה את המספרים החדשים כקבועים ולא כמבצעיים. כל עמוד "vs" בתוצאות המובילות עבור ההשוואה הזו נכתב בחלון של תשעה עשר הימים ההם ומשווה את Astra לדגם שכבר אינו תופס את המשבצת.
שום דבר ב-Astra לא השתנה. המדרגה שמתחתיה זזה, והמכפיל הוכפל.
שני כרטיסי התעריפים, שורה אחר שורה
שניהם המספרים שפרסמה OpenAI בעצמה, שעברו ללא שינוי דרך הפלטפורמות שמארחות אותם.
• קלט — GPT-6 Sol $2.00 למיליון טוקנים לעומת GPT-6 Astra $10.00 למיליון טוקנים
• פלט — GPT-6 Sol $10.00 למיליון טוקנים לעומת GPT-6 Astra $50.00 למיליון טוקנים
• קלט במטמון — GPT-6 Sol 0.20 דולר למיליון טוקנים לעומת GPT-6 Astra 1.00 דולר למיליון טוקנים; בשניהם 10% קבועים מתעריף הקלט ללא מטמון
• כתיבה למטמון — GPT-6 Sol $2.50 למיליון טוקנים לעומת GPT-6 Astra $12.50 למיליון טוקנים, שניהם בשיעור של פי 1.25 מתעריף הקלט ללא מטמון
• טיפול בהקשר ארוך — GPT-6 Sol מתמחר מחדש בקשה מעל סף הקלט שלה בפי שניים מתעריפי הקלט והמטמון ופי 1.5 מתעריף הפלט, עבור הבקשה כולה; GPT-6 Astra עושה את אותו הדבר מעל 272,000 אסימוני קלט, ב-$20.00, $2.00, $25.00 ו-$75.00
• אצווה — GPT-6 Sol במחצית מהתעריפים הסטנדרטיים לעומת GPT-6 Astra במחצית מהתעריפים הסטנדרטיים שלה, $5.00 ו-$25.00, מה ששומר בדיוק על יחס ה-5×
• חלון הקשר — 1,050,000 טוקנים עבור שניהם
• פלט מקסימלי — 128,000 טוקנים עבור שניהם
• מודאליות קלט — טקסט ותמונה עבור שניהם, כאשר GPT-6 Astra מקבל גם קלט קבצים
• נקודת חיתוך הידע — GPT-6 Sol, 20 באפריל 2026 לעומת GPT-6 Astra, 30 באפריל 2026, בהפרש עשרה ימים
שני הכרטיסים אינם רק דומים במבנה; הם אותו מבנה עם מכפיל של פי חמישה המיושם על כל שורה, כולל שכבת האצווה ושכבת ההקשר הארוך. זהו עיצוב מוצר מכוון, והוא אומר שהבחירה ביניהם היא באמת החלטת יכולת ולא החלטת אסטרטגיית תמחור. אין הנחה שתימצא על ידי שינוי צורת הבקשה שלך.

חוגת המאמץ היא האסימטריה שאיש לא כותב עליה
שני המודלים חושפים פרמטר של מאמץ חשיבה. שני הסולמות אינם זהים, ולהבדל יש השלכות על ההגירה.
הסט המתועד של GPT-6 Sol הוא none, low, medium, high, xhigh ו-max, כאשר medium הוא ברירת המחדל. הסט של GPT-6 Astra הוא low, medium, high, xhigh ו-max — אין none. לא ניתן לכבות את החשיבה בדגם הדגל. אם בצינור שלך יש שלב סיווג רגיש להשהיה שפועל כרגע ברמת effort none, השלב הזה לא עובר ל-Astra ללא שינוי; הוא צריך להיות מכוונן מחדש, מועבר למודל אחר, או מתקבל עם רצפת השהיה גבוהה יותר.
זה דבר קטן שעולה זמן הנדסה אמיתי, והוא נעדר מכל עמוד השוואה בעימות הזה כי העמודים האלה נכתבו מטבלאות מחירים ולא מתיעוד ה-API.
המספרים הבלתי תלויים, עם גרסת האינדקס המצורפת
Artificial Analysis ערכה מחדש את ה-Intelligence Index שלה מספר פעמים ב-2026, וההתמודדות הזו היא המקום שבו זה הכי משנה, כי ציון ה-Astra החוזר על עצמו ביותר הוצא משימוש.
אסטרה קיבלה 61 במדד גרסה v4.1.1 בעת ההשקה — בתיקו עם GPT-5.6 Sol, ולכן סיקור ההשקה הרב כל כך תיאר את הדגל כצעד צנוע. ה-61 הזה אמיתי והוא מגיע ממדד שכבר אינו קיים. בלוח הנוכחי, אסטרה במאמץ מקסימלי מקבלת 53 בעלות של $3.26 לכל משימת מדד, ובמאמץ גבוה מקבלת 51 בעלות של $1.73. GPT-6 Sol במאמץ מקסימלי מקבלת 48 בעלות של $1.06 לכל משימת מדד, ו-43 במאמץ גבוה תמורת $0.37.
קרא את ארבע השורות האלה יחד וצורת ההחלטה מתגלה.
• היתרון של Astra על Sol בראש שני החוגים הוא חמש נקודות מדד, בערך פי שלושה מהעלות לכל משימה שהושלמה.
• Astra במאמץ גבוה עולה $1.73 למשימה. Sol במאמץ מקסימלי עולה $1.06. הדגם המוביל, כשהוא פועל בהגדרת המאמץ שלו כברירת מחדל, יקר יותר מהשכבה הזולה שפועלת במלוא הכוח, וציוני המדד הם 51 ו-48.
• פער העלויות לכל משימה — בערך פי 3 — קטן מפער התעריפים של פי 5, מפני ש-Sol היא זו שצורכת יותר טוקנים מבין השתיים בכל משימה. זו נקודה אמיתית לזכותה של Astra, וזה החלק היחיד במסגור של "2.5×" ששורד מפגש עם הנתונים.
יש לצרף שתי הסתייגויות כנות. אלה עמודים שונים באותה משפחת אינדקסים, ולא ריצת ראש-בראש מפורסמת אחת, ונתוני השיהוי של Astra עצמה תלויים ברמת המאמץ במידה שהופכת מספר בודד למטעה — אותו מודל מדווח על זמן עד לאסימון הראשון הנמדד בעשרות שניות ברמת מאמץ אחת ובכמה דקות ברמה אחרת. אין לצטט נתון שיהוי של Astra בלי לציין את ההגדרה.
מה שדגם הדגל קונה ב-5×
הבדלי היכולות אמיתיים והם מרוכזים בעבודה סוכנית ומולטימודלית ולא בחשיבה כללית.
מדד סוכני-קוד — GPT-6 Astra 62 בהרנס Codex לעומת GPT-6 Sol 57, בעלות של $7.09 ו-$2.99 למשימה בהתאמה. דגם הדגל משתמש בככשליש מהטוקנים למשימה, ולכן הפער למשימה קטן יותר מפער התעריפים.
• Terminal-Bench 4.0 — 59% עבור Astra לעומת 43% עבור Sol באותו לוח בלתי תלוי, פער של 16 נקודות שהוא הפער הגדול ביותר ביכולת בודדת בין השניים.
• שורות אג'נטיות כפי שדווחו על ידי הספק — טבלת ההשקה של OpenAI עצמה מציגה את Astra ביתרון ב-OSWorld 2.0, ScreenSpot-Pro, AutomationBench ו-Agents' Last Exam, כולם הורצו על ידי הספק ואף אחד מהם לא שוחזר באופן בלתי תלוי. היא גם מציגה את Sol ביתרון ב-FrontierMath T1–3 וב-BrowseComp, מה שראוי לציון לכל מי שנוטה לקרוא את טבלת הספק כניצחון מוחלט.
• עמדת בטיחות — Astra היה המודל הראשון של OpenAI שהוגדר ברמת הסייבר הקריטית במסגרת ה-Preparedness Framework של החברה, ויכולות הסייבר ההתקפיות המתקדמות שלו נגישות רק דרך תוכנית גישה נפרדת. לחסימה הזו יש השלכה תפעולית מעבר להרשאות: מוניטור אי-יישור פועל על בקשות שמשתמשות בכלים, וב-API משימה שסומנה נעצרת במקום להיות מושהית לבדיקה, כפי שקורה בלקוחות הצרכניים.

הגרסה הקצרה היא ש-Astra טובה יותר בדברים שקשה להחליף — לופים ארוכים של סוכנים, עבודה בטרמינל, שימוש במחשב — ובערך באותה רמה כמו Sol בדברים שקל להחליף. חמש נקודות אינדקס של הסקה כללית לא שוות פי 5. שש-עשרה נקודות ב-Terminal-Bench ופער של חמש בסוכן קוד, בעבודה שבה ריצה שנכשלה עולה לאדם שעה של ניקוי, לפעמים כן.
כאשר שכבת ניתוב משנה את האריתמטיקה
GPT-6 Astra זמין ב-OrcaRouter בקטלוג במחיר של $10.00 לקלט ו-$50.00 לפלט למיליון טוקנים מתחת לסף קלט של 272,000 טוקנים, עם שכבת ההקשר הארוך ב-$20.00 ו-$75.00 מעליו, חלון הקשר של 1,050,000 טוקנים, תקרת פלט של 128,000 טוקנים וזמן p50 עד לטוקן הראשון של 7.82 שניות כפי שנמדד בעמוד המודל שלנו. תמחור הרשימה של הספק עובר הלאה עם ללא תוספת רווח מעל.
GPT-6 Sol אינו אחד מהמסלולים שלנו, ולכן אין כאן שום טענה לגבי המחיר שלו דרכנו.

יחס מחירים של פי 5 הוא המקרה הברור ביותר לטובת ניתוב ולא בחירה. התשובה הנכונה עבור רוב הצוותים אינה "הדגם המוביל" או "השכבה הזולה" — אלא שניהם, כשההחלטה מתקבלת בכל בקשה ולא פעם ברבעון. את העבודה שזקוקה ל-Astra אפשר לזהות בנקודת הקריאה: ההרצה הסוכנית, משימת הטרמינל, שלב השימוש במחשב. העבודה שלא זקוקה לה היא כל השאר. הצבת שניהם מאחורי מפתח אחד עם מעבר אוטומטי לגיבוי הופכת זאת לכלל ניתוב במקום למיגרציה, והיא מבטיחה שהמודל היקר יופעל רק במקום שבו הוא הדבר שעבורו משלמים.
כלל ההחלטה
• יצירת טקסט, חילוץ, סיווג ותמצות בהיקף גבוה — GPT-6 Sol. זול פי חמישה בכל שורה, בפיגור של שלוש נקודות מדד בחשיבה כללית, וברירת המחדל הנכונה.
• קידוד אייג'נטי, עבודה בטרמינל ושימוש במחשב — GPT-6 Astra. שש עשרה נקודות ב-Terminal-Bench וחמש במדד סוכני הקידוד, בעבודה שבה ריצה כושלת נמדדת בשעות אדם.
• פייפליינים שמריצים כעת שלב במאמץ חשיבה none — גם לא, ללא כיוונון מחדש. ל-Astra אין הגדרת none, והשלב הזה לא יעבור ללא שינוי.
• עבודה שדורשת קלט קבצים לצד תמונות — GPT-6 Astra, שהוא היחיד מבין השניים שמקבל קובץ.
• כל מי שקרא שהדגם המוביל הוא פרמיה של פי 2.5 — שיחשב מחדש את החשבון לפי 5×. זה אותו דגם באותו מחיר; השכבה שמתחתיו זזה, וההחלטה שונה במספר המתוקן.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
