לוח תוצאות השוואתי דו-טורי שנוצר, שכותרתו 'GPT-6.1 Sol נגד GPT-6 Astra — לוח התוצאות'. עמודה שמאלית 'GPT-6.1 Sol': שורות המציינות 'מדד אינטליגנציה: 51.8 (מקסימום)', 'עלות למשימת מדד: $0.72', 'קלט: $2.00 ל-1M', 'קלט במטמון: $0.10 ל-1M', 'פלט: $10.00 ל-1M', 'הושק: 29 בספטמבר 2026'. עמודה ימנית 'GPT-6 Astra': שורות המציינות 'מדד אינטליגנציה: 52.7 (מקסימום)', 'עלות למשימת מדד: $3.26', 'קלט: $10.00 ל-1M', 'קלט במטמון: $1.00 ל-1M', 'פלט: $50.00 ל-1M', 'הושק: 3 בספטמבר 2026'. בתחתית מופיע 'נתוני המדד לפי Artificial Analysis, Intelligence Index v4.3.2, נכון ל-30 בספטמבר 2026; המחירים לפי כרטיסי התעריפים המפורסמים של OpenAI.'
Guides & Insights

GPT-6.1 Sol מול GPT-6 Astra: נקודת אינדקס אחת, פי חמישה מכרטיס התעריפים

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

GPT-6.1 Sol ו-GPT-6 Astra הם הדגמים הבינוני והמוביל של אותה משפחה, שהושקו בהפרש של ארבעה שבועות זה מזה — Sol ב-29 בספטמבר 2026, Astra ב-3 בספטמבר 2026 — ועד השבוע נשענה ההשוואה ביניהם כולה על המספרים של Ope​nAI עצמה. זה כבר לא המצב. Artificial Analysis העריכה את שניהם במאמץ חשיבה מקסימלי על אותה גרסת אינדקס, והתוצאה היא פער של 0.84 נקודות לטובת Astra, שלצידו פער של פי 4.5 בעלות לכל הרצת הערכה לטובת GPT-6.1 Sol. במחירונים היחס חד אף יותר: Astra היא פי 5 מ-GPT-6.1 Sol בקלט ובפלט ופי 10 בקלט במטמון. השאלה שהעמוד הזה עונה עליה היא היכן הפרמיה הזו קונה משהו שאפשר להצביע עליו, והיכן היא פשוט מחיר של שם.

מהם שני המודלים, ומה מדד הלוח

שניהם קולטים טקסט ותמונה ופולטים טקסט, עם חלון הקשר של 1,050,000 טוקנים ומקסימום 128,000 טוקני פלט, ושניהם חושפים סולם מאמץ בן חמש דרגות — נמוך, בינוני, גבוה, xhigh ומקס — לאחר שהסירו את הגדרת "ללא" ש-GPT-6 Sol עדיין מקבל. אף אחד מהם אינו תומך בכיוונון עדין. ההבדלים המשמעותיים הם אלה שמצוינים במחירון: Astra היא דרגת הדגל, GPT-6.1 Sol הוא רענון של הדרגה שמתחתיה, והקו המיצובי של OpenAI עצמה עבור המודל החדש יותר הוא "ביצועים כמעט ברמת Astra לעבודה מורכבת בעלות נמוכה יותר".

Artificial Analysis נותנת ציון לטענה הזו ב-Intelligence Index שלה — עשר הערכות בגרסה v4.3.2, אותה גרסה עבור שני המודלים — ומתעדת את תאריך ההשחרור שהיא מחזיקה עבור כל אחד מהם. היא מעריכה את שניהם בתצורת המאמץ המרבי שדף המודל מציין בכותרתו. להלן אותה השוואה, בתוספת חשבון העלויות שהמדד לא עורך עבורך.

• GPT-6.1 Sol — שוחרר ב-2026-09-29, מדד הבינה 51.8 במאמץ מקסימלי, $2.00 קלט / $0.10 במטמון / $2.50 כתיבה למטמון / $10.00 פלט למיליון טוקנים.
• GPT-6 Astra — שוחרר ב-2026-09-03, מדד הבינה 52.7 במאמץ מקסימלי, $10.00 קלט / $1.00 במטמון / $12.50 כתיבה למטמון / $50.00 פלט למיליון טוקנים.
• אף אחד מהם — מקבל את מאמץ החשיבה none; שניהם מתמחרים מחדש את כל הבקשה ב-2× מתעריפי הקלט והמטמון וב-1.5× מהפלט ברגע שהקלט עובר 272,000 טוקנים. שכבת ההקשר הארוך של Astra היא $20.00 קלט / $2.00 במטמון / $75.00 פלט; ושל GPT-6.1 Sol היא $4.00 / $0.20 / $15.00.
• שניהם — תומכים בחיפוש באינטרנט, חיפוש בקבצים, יצירת תמונות, מפרש קוד, מעטפת מתארחת, החלת טלאי, מיומנויות, שימוש במחשב, MCP וחיפוש בכלים דרך Responses API.

0.84 נקודות מדד, פי 4.5 מחשבון ההערכה

A screenshot of the Artificial Analysis model page for GPT-6.1 Sol at maximum reasoning effort, with a class-rank strip above the summary naming the model's Intelligence, Speed, Cost and Verbosity positions out of 221 models, a summary paragraph reporting an Intelligence Index score of 52 against a class median of 26, $2.00 per million input tokens and $10.00 per million output tokens, $0.72 per task to evaluate on the Intelligence Index, and 67 tokens per second against a class average of 74. A lower band on the same page states that Intelligence Index v4.3.2 incorporates ten evaluations and lists them.

שתי דמויות יושבות זו לצד זו על הלוח, ויחד הן כל הטיעון. GPT-6 Astra במאמץ מרבי משיג 52.7. GPT-6.1 Sol במאמץ מרבי משיג 51.8. לצד כל ציון מפרסם הלוח מה עלה להריץ את המדד שמאחוריו: $3.26 למשימה עבור Astra, $0.72 עבור GPT-6.1 Sol. כשהיא נקראת כמשפט אחד — 0.84 נקודות תמורת פי 4.5 מהכסף — זהו המספר הרלוונטי ביותר להחלטה ששתי החברות פרסמו על שני המודלים האלה.

שני המודלים גם מפרסמים ציון עבור כל נקודה בסולם המאמץ, מה שמאפשר להריץ את ההשוואה בהוצאה שווה ולא בהגדרה שווה:

• מאמץ מקסימלי — GPT-6.1 Sol 51.8 ב-$0.72 לכל הרצה לעומת GPT-6 Astra 52.7 ב-$3.26.
• גבוה במיוחד — 51.0 ב-$0.39 לעומת 52.4 ב-$2.31.
• גבוה — 50.2 ב-$0.32 לעומת 50.9 ב-$1.73.
• בינוני — 47.8 ב-$0.21 לעומת 49.6 ב-$1.54.
• נמוך — 42.1 ב-$0.13 לעומת 45.8 ב-$0.82.

A generated two-column scoreboard titled 'GPT-6.1 Sol vs GPT-6 Astra — the scoreboard', with both columns carrying the same six labels. Left column 'GPT-6.1 Sol': Intelligence Index (max) 51.8, cost per index task $0.72, input $2.00 per 1M, cached input $0.10 per 1M, output $10.00 per 1M, released September 29, 2026. Right column 'GPT-6 Astra': Intelligence Index (max) 52.7, cost per index task $3.26, input $10.00 per 1M, cached input $1.00 per 1M, output $50.00 per 1M, released September 3, 2026. A footer reads that index figures are per Artificial Analysis, Intelligence Index v4.3.2, read September 30, 2026, and prices per OpenAI's published rate cards.

השוו את הדרגות בין המודלים, ותתגלה עובדה שאף ספק לא מפרסם: הפער של Astra עצמה בין מאמץ גבוה למאמץ מקסימלי הוא 1.8 נקודות מדד — יותר מפי שניים מכל הפער בין Astra במאמץ מקסימלי ל-GPT-6.1 Sol במאמץ מקסימלי. במילים אחרות, בחירה ב-Astra על פני GPT-6.1 Sol מקנה לך פחות ניקוד מאשר בחירה במאמץ המקסימלי של Astra על פני המאמץ הגבוה של Astra — והבחירה השנייה מבין השתיים עולה חלק קטן מהראשונה. כל מי שעומס העבודה שלו רגיש באמת ל-1.8 הנקודות האלה צריך לבדוק את הגדרת המאמץ לפני שהוא בודק את עמודת המודל.

איפה שהפרמיום של Astra עדיין קונה משהו

הציון המשולב צמוד; ההערכות הבודדות לא. כשמדרגים שורה אחר שורה במאמץ מרבי, GPT-6 Astra נהנה מיתרון בשש מתוך עשר, ואלה שבהן הוא נהנה מיתרון הן אלה שכרוכות בפעולה ולא במענה.

• AutomationBench-AA, תהליכי עבודה רב-שלביים בין כלים — 0.685 עבור Astra לעומת 0.649 עבור GPT-6.1 Sol. פער של 3.6 נקודות לטובת Astra.
• Terminal-B 4.0, עבודת טרמינל בסביבות אמיתיות — 0.591 לעומת 0.561. פער של 3.0 נקודות לטובת Astra.
• SciCode — 0.565 לעומת 0.542. פער של 2.3 נקודות לטובת Astra.
• Humanity's Last Exam — 0.547 לעומת 0.529. פער של 1.8 נקודות לטובת Astra.
• AA-Omniscience — 43.4 לעומת 41.5, ובאותה קבוצה שיעור ההזיות של Astra הוא 0.513 לעומת 0.543 של GPT-6.1 Sol. Astra גם מדויקת יותר וגם מוכנה יותר לומר שהיא לא יודעת.
• AA-Briefcase v1.1, תוצרי מסירה מקצועיים — Elo 1568.9 לעומת 1564.2. פער של 4.7 לטובת Astra.

הדפוס עקבי מספיק כדי לתכנן לפיו: כאשר המשימה מחייבת את המודל לשמור על רצף ארוך של פעולות בלי להתבלבל — לתפעל מסוף, להריץ תהליך עבודה רב-כלי, להפיק תוצר בצורת מסמך — היתרון של Astra אמיתי וניתן לשחזור בין הרנסים. כאשר המשימה היא שאלת ידע שנענית בתור אחד, היתרון נעלם ברובו.

היכן שהמודל הזול יותר מנצח, כולל שורת המטמון

GPT-6.1 Sol אינו Astra קצת פחות טובה באופן אחיד. בהערכות שמתגמלות קריאה והסקה על חומר ארוך הוא מוביל, ובכרטיס התעריפים הוא מוביל בפער שהמדד לעולם אינו רואה.

• GDPval-AA, עבודה מקצועית שנמדדת מול פלט מומחים — Elo 1575.1 עבור GPT-6.1 Sol לעומת 1541.9 עבור Astra. יתרון של 33 נקודות למודל שעולה חמישית בלבד, והניצחון העצמאי הגדול ביותר בשורה.
• AA-LCR v1.1, הסקה בהקשר ארוך — 0.830 לעומת 0.807. GPT-6.1 Sol מוביל.
• GDP.pdf — תיקו מוחלט ב-0.310, וכך גם CritPt ב-0.317.
• קלט במטמון — $0.10 למיליון טוקנים לעומת $1.00 של Astra. זו השורה שמכריעה את כלכלת הסוכנים והיא לא מופיעה כלל במדד.
• מהירות פלט — 66.8 טוקנים לשנייה לעומת 56.95 באותה ריצת הערכה, עם 67.2 מיליון טוקני פלט שהושקעו לעומת 60.0 מיליון של Astra. אף אחד מהמודלים אינו מהיר; GPT-6.1 Sol הוא המהיר מבין השניים.

חודש סוכן, מתומחר לפי שני כרטיסי התעריפים

קח עומס עבודה ששולח מחדש קידומת יציבה: 40 מיליון טוקני קלט בחודש, כאשר 85% מהם מוגשים מהמטמון, בתוספת 4 מיליון טוקני פלט. לפי המחירון של GPT-6.1 Sol, העלות היא $3.40 עבור קריאות מהמטמון, $12.00 עבור קלט שאינו מהמטמון ו-$40.00 עבור הפלט — $55.40 לחודש. לפי המחירון של GPT-6 Astra, אותה תעבורה עולה $34.00 עבור קריאות מהמטמון, $60.00 עבור קלט שאינו מהמטמון ו-$200.00 עבור פלט — $294.00. עומס העבודה זהה; החיוב גדול פי 5.3.

שני ספים מעקמים את החשבון הזה, ושניהם ראויים לתמחור לפני החלטת ההגירה ולא אחריה. הראשון הוא 272,000 טוקני קלט בבקשה אחת: אם חוצים אותו, כל הבקשה מתומחרת מחדש בפי שניים מתעריפי הקלט והמטמון ובפי 1.5 מתעריף הפלט, מה שמביא את GPT-6.1 Sol ל-$4.00 / $0.20 / $15.00 ואת Astra ל-$20.00 / $2.00 / $75.00. השני הוא סולם המאמץ עצמו — הורדת GPT-6.1 Sol מ-max ל-xhigh מקצצת את עלות ריצת האינדקס שלו מ-$0.72 ל-$0.39 תמורת 0.8 נקודה, והורדת Astra מ-max ל-high מקצצת מ-$3.26 ל-$1.73 תמורת 1.8. בלולאת סוכן עתירת מטמון, הגדרת המאמץ היא מנוף עלות גדול יותר מאשר עמודת המודל, וזה ההפך מהאופן שבו שני המודלים האלה בדרך כלל מושווים.

מה להריץ, ומה אפשר למעשה לקרוא

על פי הראיות, הפיצול נקי יותר ממה שהשיווק מרמז. נתבו את העבודה שצריכה לשרוד שרשרת ארוכה של פעולות — סשנים של טרמינל, אוטומציה עתירת כלים, תוצרי מסמכים שבהם פסקה הזויה יקרה — אל GPT-6 Astra, ושקלו להריץ אותו במצב high ולא במצב max, אלא אם מדדתם שנקודות ה-1.8 הנוספות נוחתות על המשימות שלכם. נתבו כל דבר שהוא עתיר ידע, עתיר מטמון או ברובו קריאה בלבד אל GPT-6.1 Sol: הוא טוב יותר בהערכת עבודה מקצועית, טוב יותר בהיסק של הקשר ארוך, מהיר יותר, וזול פי חמישה עד עשרה בשורות ששולטות בחשבון אמיתי.

A screenshot of the OrcaRouter model catalogue filtered to the query gpt-6, headed '3 models - 1 providers - one API key, one bill', showing three OpenAI cards side by side: openai/gpt-6-luna described as the fast, cost-efficient model in the GPT-6 series, openai/gpt-6-sol described as the cost-efficient high-end model positioned below the flagship, and openai/gpt-6-astra described as the flagship for demanding long-horizon work. Each card carries vision, tools and reasoning tags and a base-rate block; the GPT-6 Astra card reads $10.00 input, $50.00 output, $1.00 cache read and $12.50 cache write per million tokens.

מה שאפשר לקרוא לו היום הוא החלק הישר. OrcaRouter מגישה את GPT-6 Astra במחיר המחירון של OpenAI עצמה — תעריפי 10.00$ לקלט, 50.00$ לפלט, 1.00$ לקריאה מהמטמון ו-12.50$ לכתיבה למטמון, כאשר כלל התמחור מחדש של 272K מועבר בדיוק כפי שהספק מפרסם אותו — לצד GPT-6 Sol ו-GPT-6 Luna. היא אינה מגישה את GPT-6.1 Sol: הקטלוג הציבורי מחזיר "model not found" עבור openai/gpt-6.1-sol, ואנחנו לא מתכוונים לתאר מודל שאיננו יכולים לנתב. מכיוון שמחיר המחירון של הספק מועבר הלאה בלי תוספת רווח, ביום שהמודל הזה יגיע הוא יעלה את התעריף של OpenAI אצלנו בלי שלב של תמחור מחדש; היום החצי השמיש של העימות הזה הוא דגל, מאחורי מפתח API אחד, עם ה-DSL לניתוב זמין אם תרצו להרכיב מודל זול ומודל יקר לקריאה אחת במקום לבחור ביניהם לפי בקשה.

הדבר היחיד שכדאי לשים אליו לב הוא השורה שחסרה בהשוואה הזו. לא מספר הספק ולא מדד בלתי תלוי יגידו לך מה תעשה התעבורה שלך עצמך בשתי הדרגות האלה, והדרך הזולה היחידה לגלות זאת היא להריץ את אותה קבוצת משימות דרך שתיהן כאשר ה-failover מחזיק את הבמה. זהו ניסוי של מקש אחד כאשר שני החצאים ניתנים להפעלה, וחצי ניסוי עד שהם יהיו כאלה.