
היורשת של GPT-6 Astra: הדגל הבא של OpenAI יגיע, לפי הדיווחים, 'מאוד בקרוב'
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
GPT-6 Astra, הדגל החדש של OpenAI, הגיע לזמינות כללית ביום שישי, 5 בספטמבר. עד יום שלישי שלאחר מכן, הסיפור על יורשו חדל להיות שמועה והפך להדגמה רשמית: ב-8 בספטמבר הצהירה OpenAI כי מודל מהדור הבא, שטרם הושק ושמו לא נחשף — שלדבריה "מסוגל משמעותית יותר מ-GPT-6 Astra" — הניע כ-10,000 סוכנים מקבילים בריצה של 88 שעות כדי להפיק הוכחה לכאורה להתפוצצות בזמן סופי עבור משוואות נאוויה-סטוקס התלת-ממדיות, אחת משבע בעיות פרס המילניום של קליי במתמטיקה. זו הפעם הראשונה ש-OpenAI מתארת בפומבי את המודל שמאחורי ההמולה של "בקרוב מאוד" כמערכת עובדת, ולא ככיוון. זו אינה השקה: אין שם מודל, אין תאריך השקה, אין מזהה API, וההוכחה עצמה לא אומתה באופן בלתי תלוי. זהו מאמר של "מה שידוע לנו עד כה" על מה שהטענה הגדולה ביותר בתחום הבינה המלאכותית השבוע מספרת לנו — ומה היא לא מספרת — על הדגל הבא.
השבוע שבו נחתה הטענה כבר היה העמוס ביותר בשנה. Anthropic שחררה את Claude Fable 5.1 — ואת Claude Mythos 5.1, אחותו בעלת הגישה המוגבלת לתחומי אבטחת הסייבר והביולוגיה — ב-1 בספטמבר. OpenAI השיקה את GPT-6 Astra ב-3 בספטמבר במחיר של 10 דולר למיליון טוקני קלט ו-50 דולר למיליון טוקני פלט, עם חלון הקשר של כ-1.05 מיליון טוקנים, תקרת פלט של 128K, ודירוג אבטחת הסייבר הראשון בדרגת 'Critical' שמודל כלשהו של OpenAI קיבל אי פעם תחת ה-Preparedness Framework שלה. עד 5 בספטמבר המודל הסטנדרטי היה זמין באופן כללי בכל המסלולים בתשלום של ChatGPT וב-API. לוח התוצאות העצמאי פחות מחמיא מחומרי ההשקה: Claude Fable 5.1 מוביל את מדד ה-Artificial Analysis Intelligence Index עם 66, בעוד GPT-6 Astra ניצב על 61 — בערך במקום השמיני, לפי אותו מדד, באותה רמה כמו קודמו GPT-5.6 Sol ומאחורי Muse Spark 1.3 של Meta עם 62.
הפער הזה הוא הרקע לפטפוט על "כבר מיושן", והוא הופך את השאלה האמיתית ללא שאלה אם ל-OpenAI יש משהו גדול יותר — אנשיה ממשיכים לומר שכן — אלא לשאלה כמה קרוב זה, ומה יעשה מעבר דגל בטווח הקרוב להחלטה שאולי קיבלת זה עתה.
מה שסם אמר בפועל
התחל עם המקור הראשוני, כי הפרפרזה סטתה ממנו. בראיון לאקסיוס בפסגת החדשנות של G20 בצ'אפל היל, שדווח ב-3 בספטמבר, אמר אלטמן של-OpenAI יש "דגמים הרבה, הרבה, הרבה יותר יכולתיים שמגיעים בקרוב", הזהיר כי "הדור הבא של הדגמים הולך לגרום לכולם להתפכח", ותיאר את קצב השחרורים מעתה והלאה כ"מתוזמן לפי המהירות שבה נוכל להתקדם בהתאמה ובבטיחות". זה המשפט שעומד מאחורי "בקרוב מאוד". זהו איתות אמיתי ורשמי מהמנכ"ל — אבל קראו אותו במדויק: אלטמן לא אמר שיורש ל-GPT-6 Astra נמצא במרחק ימים, לא ציין שם של דגם ולא נתן תאריך. הוא אמר שדגמים יותר יכולתיים מגיעים, בקרוב, לפי שעון בטיחות, והעוקב אחרי OpenAI, @kimmonismus, אומר שמאז הוא קיבל אישור בדבר מושא ההתייחסות: ב-5 בספטמבר הוא אמר שקיבל אישור רשמי על כך שהתמליל המלא של הראיון מבהיר שההערות על "דגמים הרבה יותר יכולתיים" מכוונות לדגמים שמעבר ל-GPT-6 Astra, לא ל-Astra עצמה, וש-OpenAI "כבר יש לה דגמים יותר יכולתיים שמתוכננים לשחרור בקרוב". התייחסו לזה כאל דיווח מפי מקור על אישור פרטי, ולא כאל הצהרה רשמית של OpenAI — אבל הוא תואם את הכיוון של קליפ הווידאו למטה ושל מה שאומרים חוקרי המעבדה עצמה. אלה טענות שונות עם השלכות תכנוניות שונות, וערבוב ביניהן הוא הדרך שבה הדלפה הופכת לאזעקת שווא.
פיסת הראיות שזכתה לפחות תשומת לב היא חזקה יותר, משום שאלטמן עצמו הוא זה שמפריד בין אסטרה לבין מה שיבוא אחריה. קטע וידאו שהופץ ב-5 בספטמבר — שפורסם על ידי החשבון @cgtwts והוטמע על ידי @kimmonismus בפוסט שלמעלה — מראה את אלטמן אומר: "האימון של GPT-6 אסטרה הסתיים לפני זמן מה. המודל שעל השהייתו דיברנו לאחרונה, אה, הוא מודל עתידי. אבל עם אסטרה, אכן הגענו לרמה קריטית בסייבר." נניח בצד את השאלה מאיזה ראיון בדיוק הגיע הקטע; התוכן הוא העיקר. מול המצלמה, המנכ"ל של OpenAI אומר שלושה דברים חשובים: אסטרה סיימה את האימון "לפני זמן מה", ולכן אין מדובר במודל שעדיין מוצא את רגליו; המודל ש-OpenAI "דיברה לאחרונה על השהייתו" לא היה אסטרה אלא "מודל עתידי"; והממצא בדבר קריטיות בסייבר שייך לאסטרה, ששוחררה בכל זאת. זה ממסגר מחדש את השהיית הבטיחות מאוגוסט שעיכבה את השקת אסטרה — מה ש-OpenAI עצרה באמצע אוגוסט, לפי דבריו של המנכ"ל עצמו, כלל עבודה על היורש, ולא רק על מודל הדגל שכולם עקבו אחריו.
החוקרים אומרים בקול רם את מה שנהוג לומר בלחש.
טענת התזמון אינה נשענת על אלטמן בלבד. חוקרים המזוהים עם OpenAI הבהירו במהלך שבוע ההשקה, בפומבי ולעיני התחום כולו, שאסטרה היא נקודת ביניים ולא יעד. החוקר roon כתב שהוא "אפילו לא שרט את פני השטח של מה שאסטרה יכולה לעשות", ואז הוסיף: "אני מתאר לעצמי שהיא תתייתר בסדר גודל של שבועות, איכשהו." חוקר שני, Zuxin Liu, תיאר כיצד הוא חש ב"מומנטום החזק של RSI" — שיפור עצמי רקורסיבי, הלולאה שבה OpenAI משתמשת במודל הנוכחי כדי לבנות את הבא. אלה פוסטים פומביים של אנשים מתוך המעבדה, לא הכרזות רשמיות, ויש לראות בהם אותות פנימיים ולא עובדות. אבל כשמצרפים אותם להערת "המודל העתידי" של אלטמן, הם מתארים מעבדה שאינה ממתינה לקצב טבעי: אם אסטרה משמשת לאימון היורש של עצמה, היורש יכול להגיע מהר הרבה יותר מכפי שמשתמע מפער שמונת השבועות שבין GPT-5.6 Sol (9 ביולי) ל-GPT-6 Astra (3 בספטמבר).
באותו שבוע המשיך הקו הרשמי של החברה צעד נוסף קדימה. המסגור של גרג ברוקמן, "ברוכים הבאים לעידן ה-AGI", בעת ההשקה, הצהרתו של אלטמן בסוף אוגוסט ל־TIME כי OpenAI עשויה להחזיק במערכת שהוא יכנה AGI עד סוף 2026, והנתון של מארק צ'ן, מנהל המחקר הראשי, על "80% מהדרך" — כל אלה מתארים ארגון שמציג את Astra כשלב ברצף מהיר יותר. שום דבר מזה אינו תאריך שחרור. הכול עקבי מבחינה כיוונית עם הפרשנות של "בקרוב מאוד".
טענת ההוכחה של 8 בספטמבר
ב-8 בספטמבר קיבל הסיפור מעין ממצא, ולא הייתה זו הדלפה. OpenAI הצהיר כי מודל פנימי, לא משוחרר, מהדור הבא — שוב ללא שם, שוב ללא תאריך — רץ במשך 88 שעות אוטונומיות, כאשר עד 10,000 סוכנים פעלו במקביל, והפיק הוכחה (לכאורה) לכך שמשוואות נאוויר-סטוקס התלת-ממדיות יכולות לפתח סינגולריות בזמן סופי: נוזל חלק שמתפתח כך שמערבולת מתכווצת ומסתובבת מהר יותר עד שהמהירות הופכת לבלתי חסומה, בעוד שהאנרגיה הכוללת נשארת סופית. בעיה זו היא אחת משבע בעיות פרס המילניום בסך מיליון דולר, ורק אחת מהן — השערת פואנקרה — נפתרה אי פעם. OpenAI אומר שהמאמץ החל ב-1 בספטמבר, עלה לו מיליוני דולרים בכוח מחשוב, ומוצג כהדגמת יכולות ולא כניסיון לזכות בפרס: החברה אומרת שלא תתבע את מיליון הדולר. כל מרכיב בפסקה זו מוצהר על ידי OpenAI; שום דבר ממנה לא שוחזר באופן בלתי תלוי, ואף אחד מהפרטים אינו נוקב בשם מודל או בתאריך שחרור.
פער האימות הוא הנקודה שבה הטענה צריכה לשכון בראשכם. נכון למועד ההכרזה, הקהילה המתמטית טרם בחנה את ההוכחה, והדיווחים בעיתונות חלוקים בשאלה האם OpenAI פרסמה בכלל כתב-יד מלא. נשיא מכון קליי למתמטיקה, מרטין ברידסון, ציין כי בעיית הפרס נותרה פתוחה בעיני התחום — היא מוצגת בניסוחה הקלאסי עבור המשוואות ללא כפייה, בעוד שהתוצאה שדווחה מטעם OpenAI נוגעת לגרסה המאולצת — ומתמטיקאים ובהם חתן מדליית פילדס טימותי גוורס אמרו כי הטענה תזדקק לבחינה של הקהילה. הניגוד לאופן שבו אמורה לפעול מתמטיקה הניתנת לאימות הוא חד: המתמטיקאי טריסטן באקמאסטר מאוניברסיטת ניו יורק והמתמטיקאי של אנתרופיק, לבנט אלפוגה, פרסמו תוצאות קשורות משלהם יום קודם לכן, ב-7 בספטמבר, כשבצידן פורמליזציות ב-Lean הניתנות לבדיקה ממוחשבת, בעוד שההכרזה של OpenAI נעשתה בשיחת עיתונות.
8 בספטמבר פתח גם במאבק ייחוס שחשוב לאופן שבו יש לשקול את הטענה. באקמאסטר ואלפוגה בילו כשנה בבעיות קרובות של התפוצצות בזמן סופי, תוך שימוש בתערובת של Claude של Anthropic, Codex של OpenAI ומודלי GPT-6 Astra. באקמאסטר אומר ש-OpenAI יצרה עמו קשר ב-6 בספטמבר, ואמרה שהמודל שלה הפיק הוכחה במסלול דומה להפליא לשלהם, וטוען שסבסטיאן בובק מ-OpenAI לחץ עליו להותיר את אלפוגה מחוץ להכרזה משותפת בשל העסקתו של אלפוגה ב-Anthropic, והשמיע הערות שבאקמאסטר פירש כאיומים על הקריירה. OpenAI מכחישה את הדיווח — בובק כינה אותו „שקרי ומסית" — אומרת שלא חוקריה ולא סוכניה ראו את עבודת השניים לפני שפורסמה, ומודה רק בכך שאינה יכולה לשלול שנתונים שעברו הסרת זיהוי שמקורם במוצריה שלה עיצבו את המודלים שלה. אלה טענות שנויות במחלוקת על שיחות פרטיות; הסיכום הנייטרלי הוא ששתי קבוצות הגיעו לתוצאות קרובות בהפרש של ימים זו מזו, ושהמחלוקת היא עכשיו חלק מהאווירה סביב כל מה ש-OpenAI מסתירה.
מה שטחנת השמועות קוראת לו
השמות הם הנקודה שבה הסיפור הזה נעשה חלקלק, וכדאי שנהיה מפורשים בנוגע למצב העניינים. מאמר ההסבר על השקת Astra בבלוג הזה כבר סקר את שני שמות הקוד שמסתובבים סביב מה שיבוא אחר כך: "Doug" — ש-SemiAnalysis מסרה ללקוחות מוסדיים ב-7 באוגוסט כי מדובר במודל OpenAI "הרבה יותר גדול" שנמצא "בשלבי עבודה פעילים", ולפי חשבון ה-X האנונימי Chris GPT, תהיה זו ריצת ה-pre-training הגדולה ביותר של OpenAI עד כה, כזו שתגרום ל-Claude Fable 5 להיראות "פרימיטיבי"; ו-"Bel" — שחשבון ה-X האנונימי @synthwavedd דיווח ב-25 באוגוסט כי הוא ריצת pre-training שהושלמה עם למעלה מ-10 טריליון פרמטרים בסך הכול, ושתואר כיורש של Doug. הדיווחים סביב השניים אינם עקביים — יש המפרשים את Bel כבסיס של דור ה-GPT-6 שזה עתה הושק כ-GPT-6 Astra, ואחרים כמודל שאחריו — וכולם מקורם בחשבונות אנונימיים ללא מקור בעל שם ב-OpenAI.
מה שהשתנה השבוע הוא שדבריו של אלטמן עצמו מצביעים עכשיו לאותו כיוון כמו הקריאה "בל כיורש". אם אופן-איי, לפי דברי המנכ"ל, כבר השהתה "מודל עתידי" לבדיקת בטיחות, אז הרעיון שריצת פרה-טריינינג שהושלמה יושבת בצנרת ומחכה לעבודת יישור כבר אינו רק פוסט אנונימי — הוא עקבי עם מה שאופן-איי אמרה בעצמה. התייחסו לשמות הקוד כאל כינויים, לא כשמות מוצר. מתן השמות של אופן-איי הקדים את שמועות הרחוב בעבר: המודל שהבלוג הזה עקב אחריו במהלך הקיץ תחת שם העבודה GPT-6.7 שוחרר בשם GPT-6 Astra. דאג ובל ראויים לאותה ספקנות ולאותה סבלנות. מה שחשוב הוא לא איזה כינוי יתקבע, אלא שעדיין לא הופיע שום מזהה אמיתי — וזה הדבר הספציפי שצריך לעקוב אחריו.
הטיעון בעד סקפטיות
הטיעון בעד החיפזון כותב את עצמו מהציטוטים לעיל. הטיעון נגדו ראוי למשקל שווה, משום שהוא מעוגן במה ש-OpenAI עשתה בפועל, ולא במה שאנשיה אמרו.
ראשית, ההשקה עדיין מתייצבת. המודל הסטנדרטי של GPT-6 Astra הגיע לזמינות כללית רק ב-5 בספטמבר; הדרג הגבוה יותר שלו, GPT-6-Astra-Pro, עדיין הושק בתוכניות Pro, Business ו-Enterprise באותו שבוע, ו-OpenAI בילתה את אותו שבוע בניהול מה שתוארו בדיווחים כהשקה מבולגנת, כולל הודאה ביום השני מצד אלטמן שההשקה לא עברה חלקה כמתוכנן. השקת יורש באמצע כל זה תהיה מוזרה אפילו בסטנדרטים של OpenAI.
שנית, נתוני הקצב טוענים כנגד "ימים".{{1}} הקצב הדגל שהפגינה OpenAI ב-2026 עמד על בערך חודשיים — GPT-5.6 Sol ב-9 ביולי, GPT-6 Astra ב-3 בספטמבר.{{2}} יורש שישוחרר שבוע אחרי Astra יהיה מהיר בסדר גודל, וזה מתנגש עם מסר תדירות-הבטיחות ש-OpenAI מקרינה כבר חודש:{{3}} כל הסיבה שבגללה השקת Astra נדחתה מאוגוסט הייתה הממצא "Critical",{{4}} ואלטמן אמר שהשקות מותנות כעת בהתקדמות ביישור ובבטיחות.{{5}} מעבדה שעוצרת את הריצה הגובלת{{6}} הגדולה ביותר שלה באמצע אוגוסט מסיבות בטיחות ומשחררת יורש באמצע ספטמבר היא מעבדה ש"פתרה" את הממצא מהר מאוד,{{7}} או שמעולם לא ממש עצרה את מה שהיה חשוב.{{8}}
שלישית, והכי קונקרטית: הארטיפקט של השבוע הזה הוא טענה, לא מוצר. כל מחזור הדלפה קודם שהבלוג הזה עקב אחריו הותיר מאחור אובייקט בר-אימות — המזהה gpt-6-astra צץ בקוד הלקוח של Codex לפני ההשקה, וחתימת PR מטוהרת של 'gpt-nathree' דלפה מהמאגרים של OpenAI עצמה. ההכרזה על Navier-Stokes מה-8 בספטמבר היא סוג אחר של אובייקט: OpenAI אומרת שהמודל שלה מהדור הבא, שטרם הושק, הריץ כ-10,000 סוכנים במשך 88 שעות והפיק הוכחה, אבל ההוכחה אינה ניתנת לביקורת כפי שפורסמה, הסיקור חלוק בשאלה אם הכתבה המלאה בכלל ציבורית, ו-OpenAI ממסגרת את כל המהלך כהדגמת יכולות ולא כהתקדמות לקראת תאריך השקה. טענה שאי אפשר לבדוק קרובה יותר למילתו של המנכ"ל מאשר למזהה — היא אומרת לך שהיורש קיים וכבר מריצים אותו, והיא אומרת לך כמעט כלום על מתי תוכל להשתמש בו.
הנה הפתרון שהופך את כל שלוש הנקודות לנכונות בבת אחת: המודל Astra הושלם 'לפני זמן מה' ומאז הוא נמצא בסקירת בטיחות; היורש הוא המודל שהושהה בפועל באוגוסט; וההשהיה נגעה לבקרות, לא ליכולות. אם זה הרצף האמיתי, אז היורש אינו 'נבנה עכשיו' — הוא כבר נבנה, והמשתנה הוא באיזו מהירות OpenAI משלימה את עבודת הבטיחות. הגילוי מה-8 בספטמבר תואם את הקריאה הזו: OpenAI אומרת שהמודל מהדור הבא שלה החל במאמץ Navier-Stokes ב-1 בספטמבר, וזו אינה התנהגות של מעבדה שעדיין מרכיבה את המודל, אלא של אחת שכבר מפעילה אותו על הבעיות הקשות ביותר שהיא יכולה למצוא. זה בדיוק המצב שבו 'בקרוב מאוד' הוא סביר ו'שבועות, לא חודשים' היא הקריאה הנכונה. זה גם מצב שבו שום דבר אינו ודאי — אותו שער בטיחות שעיכב את Astra פעם אחת יכול לעכב גם את המודל הבא, והדגמת יכולת אינה החלטת מוצר.

מה יורש יצטרך לשנות
מכיוון ששום דבר לא ידוע על המודל עצמו, הדרך הכנה היחידה להסיק לשם מה הוא נועד היא לקרוא את הפערים במה שנשלח זה עתה. אלה השערות שכדאי לעקוב אחריהן, לא עובדות שכדאי לתכנן סביבן.
• פער המדד העצמאי. חומרי ההשקה של GPT-6 Astra טוענים למספרי הכותרת, אבל במדד Intelligence Index של Artificial Analysis הוא עומד על 61 לעומת 66 של Claude Fable 5.1. יורש שמאפס את הפער הזה — במקום רק לחזור ולאשר אותו מחדש במדדי ספקים — הוא ההבדל בין רענון לצעד אמיתי.
• שורת המחיר וההקשר. GPT-6 Astra הושק ב-$10 / $50 עם קונטקסט של ~1.05M. OpenAI כבר הורידה את המחירים של משפחת GPT-5.6 פעם אחת השנה, ויורש שיגיע עם מחיר מחירון נמוך יותר, קונטקסט גדול יותר, או כלכלת חשיבה ממושכת זולה יותר, ישנה את מתמטיקת האימוץ יותר מכל דלתא בנצ'מרק. עקוב אחר גיליון המחירים כמו שאתה עוקב אחר כרטיס המודל.
• תקרת השימוש במחשב. הצעת ההשקה של GPT-6 Astra היא אוטונומיה לטווח ארוך — "כל מה שאתה יכול לעשות במחשב" — והנתון המדווח על ידי הספק ב־OSWorld 2.0 (72.6% קרדיט חלקי) הוא המספר שכבר תוקפים אותו המתחרים. יורש שיגרום לטענות האוטונומיה לעמוד בבדיקות בלתי תלויות יהיה חשוב הרבה יותר מעלייה במדד.
• דלת הבטיחות. זהו המשתנה הספציפי ביותר ל-OpenAI. Astra שוגרה עם יכולות אבטחת הסייבר המתקדמות ביותר שלה מוגבלות לתוכניות גישה מהימנות, ואלטמן אמר כעת בוידאו שה"מודל העתידי" שהושהה הוא אמיתי. יש לעקוב האם היורש עובר את סף ה-Critical באותה דרך, משוגר מוגבל, או מעורר בדיקה ארוכה יותר — כל תוצאה אומרת משהו שונה על כמה הוא קרוב.
• השם. האם הוא נשאר במשפחת Astra, קופץ ל-GPT-7, או מגיע תחת שם משפחה חדש לחלוטין? OpenAI עוד הכריעה ימים ספורים לפני ההשקה אם Astra עצמה תושק בתור "GPT-6". השם שבו הוא יושק בפועל, לא השמועה, הוא האיתות האסטרטגי.
מה לעשות בזמן שמחכים
התחל ממה שזמין בפועל היום, כי שום דבר מזה לא משתנה על סמך טענה או שמועה. GPT-6 Astra הוא אמיתי, עבר בנצ'מרקים, וזמין דרך ה-API של OpenAI ובתוכניות ChatGPT. Claude Fable 5.1 הוא אמיתי, עבר בנצ'מרקים, וכיום מוביל את המדד העצמאי. GPT-5.6 Sol נותר הבחירה של OpenAI מבחינת תמורה למחיר עבור עבודה עם הקשר ארוך. עד השבוע, כל מספר שיוחס ליורש היה עמימות של מנכ"ל או פוסט אנונימי; עכשיו אחד מהם הוא טענת יכולת של OpenAI עצמה, שנאמרה בשיחת עיתונות ולא אומתה על ידי אף אחד מחוץ למעבדה. אף אחד מהם אינו גיליון מפרטים. תכנון מחדש של נתיב ייצור סביב מודל שלא קיבל שם — ושהישגו הפומבי ביותר אינו ניתן לבדיקה — יהיה ספקולציה מחופשת להנדסה.
העבודה השימושית היא להפוך את המהדורה הבאה לזולה לאימוץ אם היא תנחת — ושם שכבת הניתוב מצדיקה את קיומה, במקום רק לגבות את העמלה שלה.GPT-5.6 Sol זמין היום ב-OrcaRouter במחיר של OpenAI עצמה: $4 / $20 למיליון טוקנים, עם הקשר של 1.05M טוקנים שמועבר במחיר המחירון של הספק, ללא תוספת מחיר, ללא משא ומתן מחודש. כאשר ואם המחליף אכן יופיע בקטלוג של ספק, אותו כלל יחול: הוא יהפוך לזמין לקריאה דרך המפתח שבו אתה כבר משתמש ונקודת הקצה שאליה אתה כבר פונה, במחיר של הספק עצמו, ויעלה לאוויר באותו היום. זה גם הרגע שבו תבנית ה-failover מצדיקה את קיומה. מודל דגל חדש לגמרי עם התנהגות שרת שלא הוכחה הוא המקרה הקלאסי לכלל ניתוב: נעל את הייצור על המודל שאימתת, הפנה נתח צל של תעבורה אל המצטרף החדש, ותן לבקשות אמיתיות — לא לבלוג השקה — להחליט אם הוא תופס את החריץ הראשי. ב-OrcaRouter מדובר בעריכת מחרוזת ניתוב, לא במיגרציה. המחיר של טעות בנוגע ל"ממש בקרוב" הוא בדיוק מה שניתוב נועד לספוג.

מה לצפות
• מזהה. הדפוס עקבי: המזהה של gpt-6-astra דלף בקוד הלקוח של Codex לפני ש-OpenAI הכריזה על ההשקה, וחתימת commit מטוהרת של "gpt-nathree" דלפה מהמאגרים של OpenAI. כאשר היורש באמת קרוב, צפו למחרוזת בלקוח של צד שלישי, ברשימת מודלים בענן, או ביומן השינויים של ה-API של OpenAI לפני כל הכרזה. זה ההבדל בין אות אמיתי לבין ציר זמן של מנכ"ל.
• השם. משפחת Astra, GPT-7, או שם משפחה חדש — מי שיופיע ראשון יגלה לך אם OpenAI מתייחסת לזה כרענון של דגל הדגם שזה עתה השיקה, או כאיפוס של הדור.
• דלת הבטיחות. ה"מודל העתידי" המושהה הוא המשתנה האינפורמטיבי ביותר. אם הוא עובר את הרף הקריטי במהירות ומשוחרר בצורה מבוקרת, הפירוש "בקרוב מאוד" הוא הנכון. אם הוא מעורר בדיקה ארוכה יותר, ההשהיה באוגוסט לא הייתה רק בקרה — והלוח הזמנים נדחה בעקבותיה.
• מספרים עצמאיים. כשהיורש יוצא בפועל, הקריאות הראשונות של Artificial Analysis ו-LMArena יהיו חשובות יותר מכל לוח תוצאות השקה, ויש לתייג כל נתון של ספק ככזה עד שגורם בלתי תלוי ישחזר אותו. ההשקה של GPT-6 Astra עצמה היא סיפור אזהרה: השיווק אמר דבר אחד, והמדד אמר דבר אחר.
• דף המחירים. OpenAI כבר הורידה את תמחור GPT-5.6 פעם אחת השנה. יורש שיושק עם מחירי רשימה נמוכים יותר יאפס את כל כלכלת הגבול — ובנתב מעבר (pass-through), השינוי יהיה פעיל באותו היום שבו הספק יפרסם אותו.
האם ההוכחה הופכת לניתנת לבדיקה. OpenAI הציגה את ריצת נאוויה-סטוקס שלה כהדגמת יכולת, והדגמה אינה מחייבת אותה לשחרר את ההוכחה. אם הדיווח וכל פורמליזציה יופיעו בסופו של דבר לביקורת הקהילה, זהו אות אחד לגבי איך OpenAI מתכוונת להשתמש במודל הבא שלה; אם הטענה תישאר מוגבלת לשיחות עיתונאים בלבד, זהו אות שונה. אף אחד מאלה לא מזיז את תאריך ההשקה, אבל ההבחנה הזו היא עכשיו הקריאה הבהירה ביותר לגבי מה היורש מיועד לו בפועל.

שאלות נפוצות
האם OpenAI אישרה יורש ל-GPT-6 Astra?
לא כמוצר. סם אלטמן אמר ל-Axios של-OpenAI יש "דגמים הרבה, הרבה, הרבה יותר מסוגלים שיגיעו בקרוב", וב-8 בספטמבר OpenAI תיארה בפומבי מודל מהדור הבא שלא שוחרר וללא שם — "מסוגל משמעותית יותר מ-GPT-6 Astra" — כמי שהפיק את הוכחת ה-Navier-Stokes הנטענת. מה ש-OpenAI לא עשתה הוא לתת שם למודל, לתמחר אותו, לקבוע תאריך שחרור, או לחשוף מזהה ב-API כלשהו. קיומו של היורש מוצהר כעת על ידי OpenAI, אך זמינותו לא.
מה ייקרא היורש — GPT-6.7, Doug, או Bel?
אף אחד מאלה אינו שם מוצר. GPT-6.7 היה השם הזמני שהבלוג הזה עקב אחריו במהלך הקיץ עבור הדור ששוחרר בשם GPT-6 Astra. Doug ו-Bel הם ריצות פרה-טריינינג שדווחו בנפרד, עם שושלת לא עקבית בין הדיווחים — יש הקוראים את Bel כבסיס של דור ה-GPT-6, ואחרים כמודל שבא אחריו. צפו לשם האמיתי רק כשיופיע מזהה או הודעה.
האם ההוכחה של נאוויה-סטוקס היא תוצאה מאומתת?
לא. זו טענה של OpenAI שהוכרזה בשיחת עיתונאים ב-8 בספטמבר, ואיש מחוץ למעבדה לא בדק אותה. קהילת המתמטיקה לא ערכה ביקורת על מסמך כתוב, הדיווחים בעיתונות חלוקים בשאלה אם בכלל פורסם כזה, ונשיא מכון קליי, מרטין ברידסון, ציין שבעיית הפרס נותרה פתוחה — היא מוצגת באופן קלאסי עבור המשוואות ללא כוח חיצוני, בעוד שהתוצאה המדווחת של OpenAI עוסקת בווריאציה עם כוח חיצוני; OpenAI אומרת שלא תטען למיליון הדולר בכל מקרה. השווה זאת לתוצאות הקשורות של טריסטן באקמאסטר ולבנט אלפוגה מה-7 בספטמבר, שכללו פורמליזציות ניתנות לבדיקת מכונה ב-Lean. טענה מתמטית אינה תוצאה מתמטית עד שמישהו יכול לבדוק אותה.
האם כדאי לי להמתין עם הבנייה על GPT-6 Astra?
אין תשובה אחת נכונה, כי המודלים הקיימים כבר עברו בנצ'מרקים והיורש עדיין לא קיים. אם בניית סוכן עם אופק ארוך תלויה במודל דגל שעלול להוחלף בתוך שבועות, המהלך ההגנתי הוא להמשיך לקרוא למודל שכבר אימתת ולשמור על היכולת לעבור בלי לשכתב — וזו בדיוק המטרה של שכבת ניתוב עם מנגנון גיבוי. תנו להכרזה, לא להדלפה, לנתב את התעבורה שלכם.
הסיכום הכנה הוא טענה עם שעון עליה. משקיף OpenAI שזוכה למעקב נרחב אומר שהיורש של GPT-6 Astra יגיע "ממש בקרוב"; סם אלטמן אמר ל-Axios שמודלים בעלי יכולת גבוהה בהרבה מגיעים בקצב שנקבע בידי שעון הבטיחות — קריאה שמשקיף ה-OpenAI @kimmonismus אומר שאושרה לו מתוך התמליל המלא, והיא מצביעה על מודלים שמעבר ל-GPT-6 Astra, ולא על Astra עצמה — ואלטמן אמר בוידאו שהמודל ש-OpenAI השהתה היה מודל עתידי; החוקרים של OpenAI עצמה מתארים בפומבי את GPT-6 Astra כמיושן תוך שבועות; וב-8 בספטמבר החברה עצמה אמרה שמודל דור-הבא שטרם שוחרר, "בעל יכולת גבוהה משמעותית מ-GPT-6 Astra", הפיק את טענת ההוכחה שלו למשוואות נאווייה-סטוקס. אף אחד מאלה אינו הכרזה, אף אחד מהם אינו נוקב בשם מודל או קובע תאריך, וההוכחה אינה עדיין תוצאה מאומתת — כל ציפייה קונקרטית בכתבה הזאת עלולה להתברר כשגויה בשבוע הבא בשעה זו ממש. מה שאינו שנוי במחלוקת הוא ש-GPT-6 Astra קיים ועובד, ש-Claude Fable 5.1 עומד בראש המדד העצמאי מעליו, ושנתיב OpenAI זול יותר — GPT-5.6 Sol ב-$4 / $20 דרך OrcaRouter — נותר פעיל עבור העבודה שאינה זקוקה למודל דגל חדש לגמרי. הגישה היחידה שטענה מסוג זה מצדיקה היא זו שאינה עולה דבר: המשיכו לקרוא למה שאתם קוראים, השאירו פתוחה את האופציה לעקוף את השחרור הבא, והתייחסו להכרזה — ולביקורת — כלוח הזמנים היחיד שחשוב.
השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
