
GPT-6.7 ושאלת "Bob": האם הדגל הלא-מושק של OpenAI באמת ירוץ לאט פי 2?
ב-15 באוגוסט, פוסט ב-X מהחשבון @Yuchenj_UW דחס שמועה למשפט אחד: "בוב, מלך קרנלי ה-GPU, עזב את החברה? GPT-6.7 ירוץ בחצי המהירות…." שתי טענות נשענות על סימן השאלה הזה — שהמהנדס החשאי ביותר של החברה עזב, ושעזיבתו מקטינה בחצי את מהירות ההגשה של GPT-6.7, ספינת הדגל של החברה שטרם הושקה (ששמה שונה ל-GPT-6-7 באוקטובר האחרון). אף אחת מהטענות לא אומתה. אבל הפוסט נוחת ברגע שבו המודל הבא של החברה הוא כבר שאלה של מתי, לא אם: שם משפחת Astra הגיע ב-1 באוגוסט, סקירת בטיחות השהתה אותו ב-7 באוגוסט, ו-GPT-5.6 Sol — ספינת הדגל הנוכחית, פעילה על OrcaRouter — היא נקודת ההתייחסות הקונקרטית היחידה למה שהדור הבא צריך להתעלות עליו. הנה מה שניתן לדעת בפועל נכון להיום.
דבר אחד מלכתחילה: אף אחד מחוץ ל-OpenAI לא הריץ את GPT-6.7. כל טענה לגבי כמה מהר הוא ישרת טוקנים היא אקסטרפולציה — כולל הנתון "איטי פי 2". להלן הפרדה בין העובדות המאומתות (השינוי שם, ציר הזמן של ההשקה, העזיבות שתועדו) לבין האגדה (בוב, הקרנל והמספר). כל חומר השמועות מסומן ככזה.
מי הוא "בוב", ולמה מהנדס אחד הפך לאגדה
"בוב" הוא הכינוי שבו משתמשים עובדי OpenAI למהנדס שחברת OpenAI מעולם לא אישרה את שמו. דיווחים עיתונאיים מספטמבר 2025, כולל QbitAI, The Paper ו-itbear — כולם מצטטים עובדים לשעבר ונוכחיים של OpenAI — מתארים חוקר חשאי שכותב לבדו את ליבות ה-CUDA המשמשות להסקה (inference), קוד ה-GPU ברמה הנמוכה שהופך את המתמטיקה של טרנספורמרים לטוקנים. ליבת הקשב שלו, המכונה "Bob kernel" בתוך OpenAI, מופעלת לפי הדיווחים טריליוני פעמים ביום על פני מאות אלפי GPU, עם דיוק מתאים: תקלה הייתה מחייבת גלגול לאחור של נקודות הביקורת (checkpoints) ומחזור אימון מחדש.
האגדה עקבית בכל הדיווחים. עובדים לשעבר מספרים שבוב פתר בתוך דקות בעיית ביצועים שעמיתים נאבקו בה במשך שבוע. בסלאק הפנימי של OpenAI יש אמוג'י "קסם של בוב". הערכות בתעשייה שצוטטו באותו דיווח מעמידות את מספר האנשים החיים שמסוגלים לכתוב קרנלי CUDA בעלי ביצועים גבוהים לאימון על פחות ממאה — וזו הסיבה שתלות באדם יחיד מסוג זה נתפסת כסיכון אמיתי ולא כמותרות.
בנוגע לזהות, OpenAI מעולם לא אמרה מי הוא בוב. ההשערה המובילה, שחוזרת על עצמה באותה סיקור עיתונאי, היא סקוט גריי — בוגר פיזיקה ומדעי המחשב שהצטרף ל-OpenAI ב-2016, היה הכותב הראשי של הפוסט בבלוג של OpenAI משנת 2017, "Block-sparse GPU kernels," ולאחר מכן היה שותף לכתיבת הדו"ח הטכני של GPT-4 והמאמר על חוקי הסקיילינג, עם ביבליוגרפיה של 51 מאמרים ויותר מ-80,000 ציטוטים. ההתאמה היא נסיבתית אך נפוצה; היא מסקנה, לא אישור.
האם בוב באמת עזב?
הציוץ הוא שאלה, לא טענה. אבל לעזיבה שהוא רומז עליה יש שובל תיעודי. סיכום תחלופת הנהגה שפורסם ב־15 באוגוסט 2026 מציין את סקוט גריי — שתואר כ"מהנדס מערכות GPU ותיק" שהצטרף ב־2016 וסייע לבנות את התשתית מאחורי טרנספורמרים דלילים, חוקי סקיילינג ו־GPT-3 — בין לפחות שנים־עשר בכירים שעזבו את OpenAI ב־2026. אותה רשימה מזכירה את ראש ההכנסות דניס דרסר, את ה־COO לשעבר בראד לייטקאפ, את מנכ"לית האפליקציות פיג'י סימו, את ראש תחום Sora ביל פיבלס, ואת ראשי תחומי הבטיחות, האתיקה, השיווק והחומרה. זהו דיווח משני, לא אישור רשמי, והוא אינו מציין תאריך עזיבה עבור גריי.
ההקשר הרחב הופך את השמועה לפחות מפתיעה. הדיווחים באותו שבוע ממסגרים את העזיבות כטלטלה לפני הנפקה: המייסד השותף גרג ברוקמן מושך לעצמו את סמכות הניהול לקראת רישום ציבורי מתוכנן, ו-CNBC דיווחה על עזיבת ה-CRO ב-13 באוגוסט. ו"בוב" היה יעד גיוס ידוע כבר שנה – דיווחים מספטמבר 2025 אמרו שמארק צוקרברג מ-Meta הפך את "מי זה בוב?" לסעיף קבוע בישיבות הגיוס. מלחמת הכישרונות סביב מערך המיומנויות הספציפי הזה היא אמיתית, וזה חלק מהסיבה לכך שההדלפה נשמעת סבירה.
עם זאת, לשרשרת הטענות יש שני חוליות לא מאומתות: שסקוט גריי הוא בוב, ושהרישום בסיכום הוא אותה עזיבה שהציוץ מתכוון אליה. בהחלט ייתכן שהציוץ חוזר על שמועה שקדמה לכל יציאה ממשית. סעיף זה הוא הסיכום הכנה: באופן רשמי, מהנדס GPU בכיר בשם סקוט גריי מופיע ברשימת עזיבות של 2026; לא רשמית, אותו אדם עשוי להיות או לא להיות בוב שהציוץ מתכוון אליו.
למה "פי 2 איטי יותר" יכול להיות משמעותי — ולמה זה כנראה לא כל כך פשוט
הקרנלים קובעים את שני המספרים שמכריעים את הכלכלה של מודל: אסימונים לשנייה ועלות לאסימון. אם GPT-6.7 ישווק עם קרנלי שרת חצי יעילים מהגרסה ההיפותטית "Bob-optimized", אותה חומרה תשרת חצי מהאסימונים ואותה בקשה תיקח פי שניים זמן — בערך פי שניים מהעלות השולית. עבור מפתח שמנתב תעבורה בייצור, זו פגיעה של פי 2 בחביון ופי 2 בעלות על דגם הדגל, בדיוק סוג המספר שמשנה את בחירת המודל. זו הסיבה שלשמועה הזו יש שיניים.
עכשיו הסיבות לא לסמוך עליו:
"2x" אין לו בסיס מוצהר. זה מספר בפוסט — ניסוי מחשבתי, לא מדידה, והתמונה המקושרת אינה נושאת אחד כזה גם כן.
• קרנלים הם קוד, והקוד שורד את כותביו. סטאק ההגשה שבוב (או כל אחד אחר) כתב עבור דגמים קודמים לא נעלם כשאדם עוזב; הדגם הבא יורש את רובו.
ארגון התשתית של OpenAI הוא גדול, והאגדה על "אדם אחד שכותב הכל" היא כמעט בוודאות פשטנות יתר. הסיכון של איש מפתח הוא אמיתי, אך לעיתים נדירות הוא בינארי.
• אפילו פגיעה אמיתית ביעילות לא תשנה את היכולת. היא משנה עלות ואחזור — כואב, אבל ספק יכול לספוג חלקית או לתמחר סביב זה, ו-OpenAI כבר השיקה תכונת מהירות (Ultrafast, עד פי 14 מהיר יותר על הדגם המוביל הנוכחי) שמכוונת בדיוק ללחץ מסוג זה של עלויות שרת.
הגרסה החזקה ביותר של הטענה היא הסטטיסטיקה של "מתחת למאה". אם האדם שכתב את קרנלי ה-serving של דגם הדגל איננו, ההחלפה אינה גיוס כוח אדם רגיל — אלא תהליך הדרגתי רב-שנים. זהו סיכון לגיטימי לכלכלת ה-serving של OpenAI. אבל זה סיכון הנוגע לצוות, לא עובדה מדודה על מודל שטרם שוחרר.
מה שאנחנו באמת יודעים על GPT-6.7
למודל שאליו מתייחסת השמועה יש היסטוריה פומבית ארוכה יותר ממה שמרמז הציוץ, ורובה עדכנית:
• 31 באוקטובר 2025 — סם אלטמן הכריז ב-X כי "GPT-6" ישונה ל-"GPT-6-7", שהתפרש באופן נרחב כקריצה לסלנג של דור האלפא "6-7." האם "GPT-6.7" ו-"GPT-6-7" הם אותו דבר בקפדנות אינו רשמי; הציוץ מתייחס אליהם כאל נרדפים, וכך גם מרבית הסיקור.
• אפריל 2026 — דיווחים כי האימון המקדים של GPT-6 הושלם, עם שחרור משוער בסביבות 14 באפריל. תאריך זה חלף ללא השקה.
• אוגוסט 2026 — לפי ההדלפות, ההשקה הוקדמה לתחילת אוגוסט, כאשר OpenAI מדלגת על GPT-5.7 עד GPT-5.9. לא אומת.
• Aug 1, 2026 — OpenAI הכריזה על "Astra" כשם משפחת המודלים הבאה שלה, באמצעות דוח מחקר שטוען שנפתרו עשר בעיות מתמטיות פתוחות. האם Astra תושק תחת השם GPT-6 לא אושר.
• 7 באוגוסט 2026 — OpenAI השהתה את פיתוח Astra ודחתה את ההשקה לאחר שבדיקת בטיחות פנימית סימנה סיכון אבטחת סייבר "קריטי" — הדגם הראשון שעורר את הרמה הזו. אלטמן אמר שהשקה רחבה "צריכה עוד קצת זמן."
• שווקי חיזוי — נכון לאמצע אוגוסט, הסוחרים העריכו את הסיכוי לשחרור GPT-6 עד 30 בספטמבר בכ-62% ועד 31 בדצמבר בכ-90% בערך.
• מפרטים שמועתיים — כ-2 מיליון טוקנים של קונטקסט, ביצועים טובים יותר בכ-40% מהדור הנוכחי, זיכרון מותאם אישית, וארכיטקטורה מולטי-מודאלית מובנית תחת שם הקוד "Symphony". הכל לא מאומת.
אז המודל שמאחורי "איטי פי 2" לא הושק, אין לו תאריך שחרור מאושר, והוא נמצא תחת בדיקת בטיחות פעילה. מספר מהירות ההגשה שמצורף אליו הוא ספקולטיבי כפליים — פעם אחת לגבי התאריך, ופעם אחת לגבי המהירות.

לוח התוצאות היחיד שכנה היום
מכיוון ש-GPT-6.7 עדיין לא קיים, לוח תוצאות יכול רק להשוות בין השמועה למה שבאמת פעיל:
• GPT-6.7 (לא שוחרר) — סטטוס: לא שוחרר; שחרור: משוער סתיו 2026; קונטקסט: ~2M טוקנים (משוער); מהירות: "איטי פי 2?" לא אומת; מחיר: לא זמין; ניתן לניתוב: עדיין לא.
{{1}}GPT-5.6 Sol (live){{/1}} — {{2}}סטטוס: בהפצה{{/2}}; {{3}}הקשר: 1.05M טוקנים, פלט מקסימלי 128K{{/3}}; {{4}}מהירות: ~290 טוקנים/שנייה, לפי סטטיסטיקות 7 הימים של OrcaRouter{{/4}}; {{5}}מחיר: $5.00 כניסה / $30.00 יציאה למיליון טוקנים בשכבת הקלט הסטנדרטית{{/5}}; {{6}}ניתן לניתוב: כן, במחיר המחירון של הספק{{/6}}.
הפער המעניין הוא בעמודת המחיר. הדגם הדגל הנוכחי של OpenAI עולה $5/$30 למיליון טוקנים דרך OrcaRouter, והתעריף המועבר ללקוח הוא מחיר המחירון של הספק עצמו ללא כל תוספת — כך שבכל מחיר ש-OpenAI תתמחר את GPT-6.7, המספר בצד שלנו ישתנה באותו היום שבו הוא יוצא לשוק, ללא משא ומתן מחודש. זהו החלק השימושי של לוח התוצאות עבור כל מי שמתכנן לקראת הדגם הבא.

איך לטפל בנזילה כזו
התבנית מוכרת: דגם שלא יצא לאור, מספר דרמטי, אדם ששמו מוזכר. כל חלק סביר ואף אחד לא אומת. התגובה הנכונה היא לא להתעלם מהשמועה ולא להמר עליה — אלא לבנות את ההחלטה כך שלא תצטרך לבחור.
זהו העניין לגבי ניתוב. כאשר GPT-6.7 ייצא לשוק, הדרך להעריך טענה על האטה פי 2 מבלי לסכן עליה נתיב ייצור היא לשים אותה מאחורי אותה נקודת קצה שבה אתה כבר משתמש: מפתח API אחד, מעבר אוטומטי ל-GPT-5.6 Sol ברגע שהמודל החדש מציג ביצועים נמוכים, ותעבורה אמיתית שתכריע אם השמועה הייתה נכונה. הטענה הופכת אז למדידה במקום לציוץ. אם רשימת המחירים של OpenAI משתנה עם ההשקה החדשה, שיעור ההעברה מתעדכן באותו יום — OrcaRouter מעביר את מחירי הרשימה של הספקים ללא תוספת מחיר, כך שהפחתת מחיר (או העלאה) של ספק נכנסת לתוקף כאן מיד, ללא משא ומתן מחדש.
בינתיים, הדגל הנוכחי הוא הדבר הקונקרטי. GPT-5.6 Sol עלה לאוויר על OrcaRouter היום במחיר של $5/$30 למיליון טוקנים, עם קונטקסט של 1.05 מיליון טוקנים וכ-290 טוקנים לשנייה, כפי שלוח התוצאות מראה. מצב ה-Ultrafast, שהוכרז ב-13 באוגוסט — עד פי 14 מהיר יותר, כ-750 טוקנים לשנייה על תשתית Cerebras — חל על המודל הזה, לא על GPT-6.7, וזוהי תזכורת לכך ש-OpenAI יכולה לתקוף את עלות האספקה גם באמצעות תשתית וגם באמצעות קרנלים.

מה אנחנו צופים בו עכשיו
האם עזיבתו של בוב תאושר. OpenAI אינה מגיבה על מי הוא בוב; האירוע המתועד הקרוב ביותר הוא שמו של סקוט גריי ברשימת העזיבות של 2026. אם OpenAI או גריי יאשרו זאת, החוליה הראשונה בשרשרת תהפוך לעובדה.
• האם למספר "איטי פי 2" יהיה אי פעם בסיס? אם GPT-6.7 ישוחרר ומדידות מהירות בלתי תלויות יופיעו, המספר יחדל להיות שמועה — או יאושר או ייגנז. עד אז זהו מספר בפוסט.
• האם השעיית הבטיחות של Astra דוחה את המועד. שווקי התחזיות כבר הוציאו את GPT-6 מחודש אוגוסט; הסיווג 'קריטי' והבדיקות הממשלתיות ש-OpenAI אומרת שהיא רוצה הם שניהם מקורות טבעיים לעיכוב נוסף.
• האם ה-benchmark של הקרנל ממיין מחדש. אם צוות ההגשה של OpenAI סופג את ההפסד — או שהאגדה מגזימה בחלקו של אדם אחד — השמועה כולה חסרת משמעות, והסימן הראשון יהיה ביצועי ההגשה של הדגם הבא ביחס לקודמו.
הקריאה הכנה: "איטי פי 2" הוא סיפור מרתק, ובינתיים רק זה. עזיבת אשף הליבה היא נקודת מידע אמיתית עם שובל מסמכים אמיתי; מספר המהירות הוא מספר בציוץ. עד ש-GPT-6.7 ישוגר, העמדה ההגנתית היא לתכנן לשני התרחישים — להניח שהשמועה עשויה להיות נכונה חלקית, ולבנות את הניתוב כך שמודל דגל איטי מהצפוי לא יעלה לך דבר לבדיקה. זו כל הנקודה של ניתוב מודל שלא פגשת.
