
הדלפת GPT-6.5 "Doug", גרסה מתוקנת: Doug הוא מודל הבסיס של GPT-6 Astra
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
מחזור ההדלפות הקצר ביותר שהבלוג הזה עקב אחריו נמשך כשתים־עשרה שעות. ב-7 בספטמבר חזה אנליסט המודלים העצמאי teortaxesTex שהדגל הבא של OpenAI יקרא GPT-6.5, ששם הקוד הפנימי שלו הוא ריצת ה-pretraining המדווחת "Doug", ושהוא יהיה "משהו שונה… לא רק גדול יותר" — שינוי מהותי, לא הגדלת קנה מידה. תוך כשתים־עשרה שעות הוא חזר בו. לאחר בדיקה אומר teortaxesTex שהוא הצמיד את המודל הלא נכון לשם הלא נכון: "Doug" אינו GPT-6.5 עתידי. בקריאה המתוקנת שלו מדובר במודל הבסיס של GPT-6 Astra — הדגל ש-OpenAI השיקה ב-3 בספטמבר במחיר של 10$ / 50$ למיליון טוקנים, עם חלון הקשר של כ-1.05 מיליון טוקנים, והשכבה הסטנדרטית שלו הגיעה לזמינות כללית ב-5 בספטמבר. ריצת ה-pretraining הענקית שמכונת השמועות רדפה אחריה במהלך אוגוסט הייתה, לפי חשבון זה, הבסיס לדבר שכבר נמצא בפרודקשן.
דף זה הוא מעקב אחר מה שידוע לנו, ולכן התוויות צריכות לנוע לפי התיקון. GPT-6 Astra אמיתי, נמדד באופן בלתי תלוי, וניתן להפעלה; ואילו סיפור שם הקוד סביבו לא. ההמשך של teortaxesTex הוא התיאור האישי שלו של מה שלמד, לא הצהרה של OpenAI, ולא הופיע שום ממצא עבור "Doug" — לא מזהה, לא רשומה בבורר המודלים, ולא רישום בקטלוג הענן — בכל פרשנות שהיא. מה שהתיקון פותר הוא קריאה שגויה שהגרסה הקודמת של הפוסט הזה חזרה עליה. קראו את מה שבהמשך כשובל שמועות שמתקן את עצמו, כשכל טענה עדיין ניתנת למעקב לחשבונות בעלי שם או אנונימיים, ולא ל-OpenAI.
הטענה, והתיקון
הפוסט המקורי של teortaxesTex, בקריאה דווקנית, כלל שלושה חלקים: {{1}}המודל הבא של OpenAI יישא את המספר GPT-6.5;{{/1}} {{2}}שם הקוד שלו הוא Doug;{{/2}} ו-{{3}}הוא מייצג שינוי מהותי ולא הגדלת קנה מידה.{{/3}} שני החלקים הראשונים היו השערות שמות שעלו בקנה אחד עם הדיווחים הקיימים על שמות הקוד. החלק השלישי הוא מה שגרם לפוסט להתפשט, משום שהוא חרג מעבר ל'מתי' — השאלה ששאר מכונת הרכילות התווכחה עליה — והעלה טענה לגבי 'מה'. יורש שונה ולא גדול יותר לא רק היה מאפס את מיקומה של OpenAI בלוחות הדירוג העצמאיים; הוא היה משנה את מהותו של הדור הבא של החזית.
הפוסט ההמשך שלו חוזר בו מרוב מה שנאמר שם, ולתיקון יש שלושה חלקים משלו. ראשית, "Doug" הוא מודל הבסיס של GPT-6/Astra — לא מודל נפרד וגדול יותר שמחכה בקנה, אלא ריצת הקדם-אימון שממנה נבנתה ה-Astra שכבר שוחררה. שנית, "Bel," היורשת המדווחת עם 10 טריליון פרמטרים, היא — בלשונו — "בולשיט של מקורבים." שלישית, ריצת הקדם-אימון שבאמת מצביעה על מה שיבוא אחרי Astra החלה "אולי לפני פחות מחודשיים" תחת שם קוד אחר שאיש לא דיווח עליו. שלושתן הן הצהרות של teortaxesTex על מה שמצא, באותו רישום כמו ההדלפה המקורית: שימושיות כאיתות באשר למקום שבו עומדת שרשרת השמועות, חסרות ערך כמסמך. אין בהן שום אישור של OpenAI, והוא מוסיף ששום דבר מזה לא משנה הרבה לדעתו — הנקודה האסטרטגית של הפוסט המקורי, הוא אומר, שורדת את החלפת השם. זה החלק שכדאי לבחון להלן.
מהיכן הגיעה הקריאה "דאג" — וכיצד היא תוקנה
הפרשנות בנוגע למודל העתידי לא החלה עם teortaxesTex, וכדאי לדייק במקורותיה, כי הגרסה המוקדמת יותר של הפוסט הזה נשענה עליה. ב-7 באוגוסט פרסמה חברת המחקר SemiAnalysis מזכר — המתוארך ל-9 ביולי — ובו הודיעה ללקוחות מוסדיים ש-OpenAI "התגברה על בעיות ה-pre-training שלה" וש"מודל גדול בהרבה בשם הקוד 'Doug' נמצא בפיתוח פעיל." יומיים לאחר מכן, חשבון ה-X ChrisGPT השלים את התמונה: Doug לא היה אותו מודל כמו GPT-6 (שרוב הגורמים סברו שהוא Astra), אלא פרויקט ה-pre-training הגדול ביותר של OpenAI עד כה, והוא יכול היה להגיע כבר בנובמבר. על סמך שני הדיווחים הללו, "Doug" הפך לכינוי למהלך גדול, נפרד, שצפוי בסוף השנה.
הקריאה לפיה דאג הוא דווקא הבסיס מתחת לאסטרה אינה חדשה גם היא — וזו הסיבה החזקה ביותר להתייחס לתיקון של teortaxesTex כאל משהו שהוא יותר מגחמה. פתק שוק של Samsung Securities מ-10 באוגוסט, חודש לפני ההודעה המשלימה שלו, כבר תיעד את התיקון שהסתובב בקהילה: לפי הפתק, חלק מהחשבונות קראו את דאג כמודל נפרד שעתיד לצאת אחרי אסטרה, אך "הובהר גם שדאג הוא מודל הפרה-אימון המשמש כבסיס של אסטרה", עם הסתייגות לפיה היחסים המדויקים נותרו בלתי מאומתים. הסיקור בעידן Bel היה חלוק בנקודה זו: הפוסט של החשבון האנונימי @synthwavedd מ-25 באוגוסט תיאר ריצה שהסתיימה בשם "Bel", שחלק מהנרטיבים הפכו ליורשת של דאג ואחרים הפכו ל"ככל הנראה הבסיס ל-GPT-6." עץ המשפחה מעולם לא היה עקבי בין החשבונות. ההודעה המשלימה של teortaxesTex פשוט בוחרת בצד שפתק Samsung כבר תיעד, ומשמיטה לחלוטין את שכבת Bel.

קריאה בתיקון מראה שדוחות SemiAnalysis ו-ChrisGPT עקבו אחר ריצה בשלביה האחרונים, ולא אחר פרויקט עתידי. מודל בסיס ש"בעבודה פעילה" בתחילת יולי, שעובר בהצלחה בדיקת בטיחות באוגוסט, ומושק כמוצר ב-3 בספטמבר, הוא מודל בסיס שהאימון המקדים שלו הסתיים חודשים לפני כן — כשהקיץ הוקדש ללמידת חיזוק, ליישור (alignment), ולהשהיית ההשקה שבאה לאחר דירוג אבטחת הסייבר "Critical" שקיבלה Astra במסגרת ה-Preparedness Framework של OpenAI עצמה. ציר הזמן הזה תואם את Doug כבסיס של Astra. הוא אינו תואם את Doug כהשקה בנובמבר. אם teortaxesTex צודק, חלון נובמבר היה שייך לריצה שפורשה לא נכון, והדיווח שהבטיח Doug נפרד וגדול יותר פשוט כיוון אל האובייקט הלא נכון.
מה ששורד את התיקון
התזה האסטרטגית שורדת במסגור מחדש. הטיעון הבסיסי של SemiAnalysis — שהשיפורים של OpenAI מאז GPT-4o הגיעו בעיקר מאימון המשך, למידת חיזוק ומחשוב בזמן הסקה על בסיס ישן יותר, ושהתשואות הללו פוחתות ללא בסיס טוב יותר — אינו תלוי בשם הקוד שנשא הבסיס. אם Doug הוא הבסיס של Astra, אזי איפוס מודל הבסיס שהמזכר חזה כבר התרחש וכבר שוחרר: GPT-6 Astra הוא המוצר הראשון של אימון מקדים שהחל מחדש ותוקן, לא עוד ליטוש של המוח מתקופת GPT-4o.
זה הופך את המדידה המתועדת למעניינת יותר, לא פחות. המוצר הראשון של האיפוס אינו "מפלת הענקים" שהכתבה על "תפוח האדמה הגדול ביותר" הבטיחה. במדד האינטליגנציה של Artificial Analysis, GPT-6 Astra (מקס) משיגה 61 — בערך מקום שמיני מתוך יותר מ-200 מודלים — בעוד ש-Claude Fable 5.1 מובילה את הטבלה עם 66. אם זה מה שבסיס מחודש קונה היום, אז "שונה, לא רק גדול יותר" מעולם לא היה תיאור של מה ש-Astra כבר מהווה; זו הייתה תקווה לגבי מה שהבסיס הבא — הריצה שהחלה לפני פחות מחודשיים תחת שם קוד שלא דווח — יפיק בסופו של דבר. האנרגיה של ההדלפה המקורית שייכת לאותה ריצה עתידית, לא לשם הקוד שכולם התווכחו עליו.

שתי השלכות נוספות נובעות אם התיקון תקף, ושתיהן ראויות להצגה כהסקה ולא כעובדה. ראשית, קו הטיעון "היורש מגיע בקרוב מאוד" — הערתו של סם אלטמן ל-Axios כי "דגמים הרבה, הרבה, הרבה יותר מסוגלים יגיעו בקרוב", והקליפ המסתובב שבו אמר שהמודל ש-OpenAI "דיברה לאחרונה על השהייתו" היה "מודל עתידי" — אינו יכול להתייחס לריצת האימון המקדים הטרייה; ריצה שהחלה באמצע יולי אינה מוצר בספטמבר. אם יורש אכן ינחת בקרוב, הוא יהיה מוצר שעבר אימון-על (post-training) על בסיס Doug/Astra, ולא הבסיס החדש עצמו. שנית, "Bel" תמיד היה החלק בסיפור החשוף ביותר בדיוק לסוג כזה של דחייה, וזה נושא הסעיף הבא.
למה "Bel" היה החוליה החלשה ביותר
דוח בל, שפורסם בחשבון האנונימי @synthwavedd ב-25 באוגוסט, נראה על פניו כהדלפה גדולה: OpenAI "סיימה" ריצת אימון מקדים ענקית למודל בעל יותר מ-10 טריליון פרמטרים בסך הכול, שתואר כיורש של Doug ובכמה קריאות כבסיס לדור GPT-6. לא היה בו שום ממשות. מקורו בפוסט אנונימי יחיד; מעולם לא הופיע מקור שני, מזהה, רשומת בורר או רישום ענן; והנרטיבים סתרו זה את זה בשאלה הבסיסית ביותר אם בל הופיע לפני Doug או אחריו — סימן שלחשבון לא היה מושא ייחוס קבוע. גם ציר הזמן היה בלתי קוהרנטי על פניו: מודל בסיס אינו יכול "לסיים" אימון מקדים בסוף אוגוסט ובה בעת לשמש כבסיס למודל שכבר נבנה, עבר בדיקת בטיחות והוכן להשקה ב-3 בספטמבר.
הפסילה של teortaxesTex — "בולשיט של חבר'ה מקורבים" — בוטה יותר מכל הדיווחים שהיו, אבל היא מצביעה על אותן ראיות. המסביר הקודם של הבלוג על היורש הצביע על חוסר העקביות בין Bel/Doug בשבוע שבו פורסם הדוח, והמסביר על השקת Astra כלל את אותה הסתייגות. מה שהתיקון מוסיף הוא סיבה להפסיק להתחמק: אם האימון המקדים של היורש האמיתי החל לפני פחות מחודשיים תחת שם קוד שאיש לא דיווח עליו, אז הסיפור על "Bel הגמור בעל 10 טריליון פרמטרים" לא היה רק לא מאומת — הוא תיאר משהו שלא יכול היה להתקיים על פי ציר הזמן המתוקן.
מה יפתור את זה?
רשימת הבדיקות לא השתנתה, והתיקון מעלה את הרף במקום להוריד אותו. כל מחזור הדלפה של OpenAI שהבלוג הזה עקב אחריו הותיר אחריו ממצא בר-אימות לפני ההכרזה — מזהה gpt-6-astra בקוד הלקוח של Codex, השמות Sol/Terra/Luna בבורר המודלים של GPT-5.6, רשימות הקטלוג של Azure ו-Bedrock לפני Astra. שום דבר בסיפור של Doug לא הפיק אף אחד מאלה, והתיקון לא משנה את זה: גם אם Doug הוא הבסיס של Astra, השם הוא עדיין כינוי פנימי שאף ארטיפקט לא אישר מעולם. מה שיישב את הקריאה המתוקנת הוא הצהרה של OpenAI, כרטיס מערכת שמציין את שם הבסיס, או עדות של גורם פנימי עם מסמך — ואף אחד מאלה לא קיים. עד שיהיה אחד כזה, התווית המדויקת עבור "Doug הוא מודל הבסיס של GPT-6 Astra" היא: האנליסט שכינה אותו לראשונה GPT-6.5 אומר כך כעת; הערת מחקר מלפני חודש תיעדה את אותו תיקון בקהילה; ו-OpenAI לא אמרה דבר.
שאלת לוח הזמנים היא המקום שבו התיקון נוגס בצורה החריפה ביותר. אם ריצת ה-pre-training הבאה באמת היא רק בת חודשיים ואין לה שם, אז כל תאריך שצורף ל"דאג" בדיווחים — חלון נובמבר של ChrisGPT, הציפיות ל"יורש בקרוב מאוד" — צורף לריצה הלא נכונה. מה שהקורא יכול לסמוך עליו בפועל הוא צר יותר: OpenAI שיחררה את Astra, בכירים אמרו שמודלים בעלי יכולת גבוהה יותר בדרך, ואיפוס מודל הבסיס הבא נמצא ככל הנראה בשלב מוקדם. שום דבר מזה אינו תאריך שחרור, והעמדה הכנה היא שהשעון של היורש מתחיל לפעול ברגע שמופיע מזהה או הכרזה — לא כשמדליף נוקב בשם קוד.
מה לעשות בזמן שהסיפור נפתר
אף אחת מהעובדות הרלוונטיות להחלטה אינה משתנה בעקבות תיקון, כי המודלים שקיימים הם אלה שאפשר לקרוא להם. GPT-6 Astra פעיל, נמדד וזמין דרך ה-API של OpenAI עצמה ובתוכניות ChatGPT — וגם ב-OrcaRouter במחיר המחירון של OpenAI, $10 / $50, עם הקונטקסט של ~1.05M טוקנים שמועבר במחיר הספק וללא שום תוספת. אם רוצים חוות דעת שנייה על מה שבחזית כרגע, בראש המדד העצמאי נמצא Claude Fable 5.1, ו-GPT-5.6 Sol נותר הנתיב המוכח והזול יותר של OpenAI לעבודה בקונטקסט ארוך.

ההכנה השימושית זהה למה שהייתה לפני התיקון, כי אי-הוודאות לא הצטמצמה — היא רק עברה למקום אחר. ראוטר מעבר (pass-through) גורם לכך שכל יורש שבפועל יופיע יהיה קריא דרך המפתח שבו אתה כבר משתמש, במחירון הרשמי של הספק עצמו, באותו היום שבו הוא מופיע בקטלוג הספק: אין חוזה שני, אין צורך בשכתוב, ושינוי המחיר מתעדכן בלייב ברגע שהספק מפרסם אותו. ומכיוון שדגם בסיס חדש לגמרי הוא בדיוק הסוג של דבר לא-מוכח שלא כדאי להמר עליו בנתיב ייצור לפני שעבר בדיקות עומס, כשל-אוטומטי (failover) הוא הדרך הכנה לנסות אותו: עקוץ את הייצור לדגם שאימתת, הפנה נתח צל של תעבורה לדגם החדש, ותן לבקשות אמיתיות להחליט. אם הקריאה המתוקנת נכונה ו"דאג" היה רק דגם הבסיס שמתחת למודל שכבר ניתן לקרוא, שום דבר בהתקנה הזו לא התבזבז; אם היורש ללא-שם ישוחרר, העלות של זה שהלכת אחרי שמועות היא אפס.
הסיכום ההוגן של התיקון הוא גרסה הדוקה יותר של אי-הוודאות המקורית. teortaxesTex, האנליסט שהדביק את "GPT-6.5" ל-Doug, אומר כעת שטעה: Doug הוא מודל הבסיס של GPT-6 Astra שכבר שוחרר, "Bel" היה רעש, וריצת האימון המקדים שחשובה היא בת פחות מחודשיים וללא שם — קריאה שסקירה של Samsung Securities כבר תיעדה חודש קודם לכן, וששום ארטיפקט או הצהרה של OpenAI לא אישרו עדיין. מה ששורד הוא הנקודה האסטרטגית, שכעת מכוונת למטרה הנכונה: OpenAI החלה מחדש אימון מקדים של מודל בסיס, המוצר הראשון שלה מדורג שמיני במדד העצמאי, והריצה שתכריע מה יבוא אחר כך רק החלה. העמדה המוצדקת לא השתנתה — המשיכו לקרוא למודל שאימתתם בשמו, השאירו פתוחה את האפשרות לעקוף את השחרור הבא, והתייחסו להכרזה, לא לשם קוד ולא לתיקון, כאל לוח הזמנים היחיד שחשוב.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
