
המודל הלולאתי השני של OpenAI: מה ההדלפה של 'הציר האסור' מ-DevDay בעצם טוענת
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 177 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1323 tok/s
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
יש בדיוק מקור אחד לטענה שהמאמר הזה עוסק בה, והוא פוסט בודד ב-X. ב-24 בספטמבר, החשבון @scaling01 כתב שהספק "פתח את הסכרים וישחרר את המודל הלולאתי השני שלו מלבד GPT-6 Astra ב-DevDay", ותיאר עומק רקורסיבי כ"הציר האסור" וציין שהוא "כבר אינו אסור". זה כל מה שיש: אין שם מודל, אין מזהה מודל, אין מחיר, אין תאריך מעבר לנאום המרכזי של DevDay ב-29 בספטמבר בסן פרנסיסקו, ואין שום מילה מהספק. מה שהופך את הטענה לראויה לזמנו של הקורא אינו הציוץ אלא העובדות שכבר שוגרו מתחתיו. GPT-6 Astra, שהספק שחרר ב-3 בספטמבר, הוא מודל הייצור הראשון מכל מעבדה גדולה שדיווחים קשרו לארכיטקטורת עומק לולאתית ורקורסיבית. GPT-6 Sol ו-GPT-6 Luna, שיצאו ב-22 בספטמבר במחיר של $2 כניסה / $10 יציאה ו-$0.10 כניסה / $0.50 יציאה למיליון טוקנים, הפכו את דגל החברה לסולם מחירים. מודל לולאתי שני יהיה משמעו שהספק כבר אינו מתייחס לעומק רקורסיבי כהימור חד-פעמי אלא כארכיטקטורה קבועה — טענה גדולה יותר מכל השקה בודדת, והרבה יותר קשה לבדיקה.
זהו מאמר מסוג "מה שידוע עד כה". כל דבר המיוחס למפרסם או לדיווח אנונימי מסומן ככזה, ואין לקרוא דבר כאן כהודעה רשמית.
מדוע הביטוי 'ציר אסור' הוא החלק המעניין ביותר בציוץ
הניסוח הוא של כותב הפוסט עצמו, לא מונח מקצועי, אך הוא מצביע על משהו אמיתי. בהרחבה של טרנספורמרים יש שלושה צירים ברורים: פרמטרים, נתונים ומחשוב אימון. עומק באמצעות רקורסיה הוא ציר רביעי, והוא ציר מוזר. במקום לערום N בלוקים נפרדים, מודל בלולאה עושה שימוש חוזר באותה ערימה קטנה של בלוקים R פעמים, כך שהעומק האפקטיבי הוא בערך מספר השכבות כפול מספר החזרות, בעוד שמספר הפרמטרים נשאר קבוע. Google DeepMind הציגה את התאוריה בחשיבה עם מחשבות סמויות: על כוחם של טרנספורמרים עם לולאה, והמאמר המצוטט בהרחבה הגדלת מחשוב בזמן בדיקה עם חשיבה סמויה: גישת עומק רקורסיבית הציג את הטיעון המעשי.
זה לא עומק בחינם. עבודת הסקיילינג האיזו-עומקית על מודלים לשוניים עם לולאות מציבה את מעריך השקילות-חזרה על בערך 0.46 — כלומר לולאה נוספת אחת קונה לך כ-46% ממה שבלוק חדש באמת היה קונה. אתה קונה עומק בהנחה, ומשלם עליו בחישוב סדרתי במקום בזיכרון. זו עסקה משתלמת אם אתה מוגבל בזיכרון או רוצה שמודל קטן יתנהג כמו גדול, וזו בדיוק העסקה שהדרגות הזולות בכל משפחה מחפשות.
אז למה "אסור"? משום שהחישוב שמתרחש בתוך הלולאה מתרחש במצב חבוי, ולא בטוקנים שנפלטים. ניטור שרשרת המחשבה — קריאת מה שהמודל רושם בזמן שהוא חושב — היה כלי ההבטחה המרכזי של התעשייה מאז הגעתם של מודלי החשיבה, והוא הכלי שהפך את תקרית הסוכן של Hugging Face ביולי למובנת לחוקרים בכלל. מודל שעושה יותר מעבודתו במרחב הסמוי נותן לכלי הזה פחות לקרוא. זה היה הטיעון נגד לולאה בחזית במשך שנתיים, ולכן הטכניקה התפשטה במשקלים פתוחים — של ByteDance Seed Ouro ב-1.4B ו-2.6B, ו-Nanbeige4.2-3B, שמריץ מחסנית בת 22 שכבות פעמיים — בעוד שהמעבדות עם התחייבויות בטיחות מפורסמות נמנעו ממנה. מאמרי MeSH ו-SpiralFormer של Alibaba תקפו את אותה בעיה מצד היעילות.
מה OpenAI בעצם אמרה, ומה היא לא אמרה
הדיווח שהתחיל את זה הוא של The Information, ב-1 וב-2 בספטמבר: ש-Astra משתמשת בטכניקה שנקראת עומק רקורנטי, המתוארת גם כרקורנציה אטומה. זהו כלי תקשורת עם מקורות מבוססים ורקורד אמיתי, והוא עדיין דיווח ולא תיעוד. OpenAI מעולם לא פרסמה מאמר ארכיטקטורה המאשר עיצוב לולאתי, והניתוח הנקרא בהרחבה של סבסטיאן ראשקה על Astra אומר בבירור שהמבנה הלולאתי מוסק מהצהרות פומביות — לפי השחזור שלו, Astra מריצה את 22 הבלוקים שלה פעמיים, כלומר 44 הפעלות בלוק אפקטיביות, כששתי לולאות הן אופטימליות ויותר מהן מערערות את יציבות האימון.
מה שאנשי OpenAI עצמם אמרו הוא צר יותר וזהיר יותר ממה שהציעו הן הסיקור והן תגובת הנגד. המדען הראשי יאקוב פאצ'וקי פרסם ב-2 בספטמבר כי עומק גרף החישוב של מודלים בחזית, כולל Astra, נמצא בטווח של פי שניים מ-GPT-4 — כמות מוגבלת של לולאות, ולא רקורסיה קיצונית כפי שחלק מהכותרות רמזו — והתנגד למה שכינה דיווח מבולבל, בעודו מודה שניטור שרשרת המחשבה שברירי ונוטה לכיוון שלילי. על פי הדיווחים, כרטיס המערכת של Astra מציין כי יכולת הניטור של עקבות החשיבה מהווה ירידה לעומת GPT-5.6 Sol, וזו הודאה אמיתית שאינה תלויה באיזו ארכיטקטורה גרמה לכך.
התגובה בתחום הבטיחות הייתה קולנית. באק שלגריס מ-Redwood Research אמר שהוא מודאג מאוד והזהיר שהגברת ההישנות (recurrence) עשויה "להרוס לחלוטין את יכולת הניטור של CoT"; ריאן גרינבלט וצבי מושׁוביץ' העלו את אותה טענה בגוונים שונים. נקודת הנגד המועילה ביותר הגיעה מרשקה: OpenAI לא מפרסמת עקבות חשיבה גולמיות מאז דור o1, ללא תלות בארכיטקטורה, ומודל חזק יותר שמפיק שרשרת חשיבה קצרה יותר אינו כשלעצמו ראיה לקיומו של ערוץ חשיבה נסתר.
חברו את שתי הפסקאות האלה יחד ותקבלו את מצב הדברים שהציוץ מהמר עליו. "Astra בלופ" הוא דיווח אמין ש-OpenAI סירבה לאשר. "מודל בלופ שני יוצא ב-29 בספטמבר" הוא פוסט אחד.
חמש הדלפות של OpenAI מספטמבר, ואיפה זו נמצאת
ספטמבר ייצר מקבץ צפוף של סיפורי הדלפות על OpenAI, והדבר המועיל בהם הוא שהם לא כולם מאותו סוג של ראיות.
• 3 בספטמבר — המחרוזות gpt-6-astra וgpt-6-astra-aeon הופיעו בדגל תכונה של Statsig בתוך Codex Desktop, בצילום מסך של @notjazii שהופץ על ידי @kimmonismus. סיפור הסוכן Aeon צמח מכך. חמישה שבועות לאחר מכן, עדיין אין דף מוצר, אין מחיר, אין תיעוד ואין בנצ'מרק עבור Aeon, ואין מזהה מודל שמתפענח.
• 21 בספטמבר — מחרוזת "GPT-6 Sol medium" צצה ברשומות המיזוג של NVIDIA.
• 22 בספטמבר — שלושה נתיבי מרשם של Azure, עבור gpt-6-sol, gpt-6-luna ו-gpt-6-astra-minor, פורסמו מהפורום הסיני למפתחים locdd.com ככתובת URL פעילה של Microsoft. כאשר משכנו את נקודת הקצה הציבורית של תצורת ה-playground למחרת, שלושת השמות החדשים לא היו בה; המרשם הכיל במקום זאת את gpt-6-astra ואת רשומות הדור הישן יותר של GPT-5.6.
• 22 בספטמבר — GPT-6 Sol ו-GPT-6 Luna שוחררו. מחיר, מזהי מודלים, הערות שחרור של SDK, רשומה ב-Bedrock, ערך בורר ב-GitHub Copilot וברירת מחדל של Perplexity — כולם הופיעו בתוך יום.
הדפוס אינו עדין. סוגי ההדלפות שנשאו ארטיפקט בתוך משטח שבאמת משוחרר — הערת שחרור של SDK, רג'יסטרי בענן, דגל תכונה בדסקטופ — המשיכו להפוך למוצרים. סוגי ההדלפות שהיו רק שם לא עשו זאת. הטענה של היום, מודל שפה עם לולאה שני מבית OpenAI ב-DevDay, אינה נושאת ארטיפקט כלל: אין מחרוזת, אין דגל, אין נתיב רג'יסטרי, אין שורת מחיר, אין מזהה מודל. זה לא הופך אותה לשגויה. זה הופך אותה לבלתי ניתנת לבדיקה מבחוץ, וזה תיאור שונה ויותר כן.
תוכניית DevDay סביב זה אמיתית, ומתועדת היטב באופן יוצא דופן.
הדבר היחיד שניתן לתארך במדויק הוא האירוע. DevDay 2026 אושר ליום שלישי, 29 בספטמבר, בפורט מייסון שבסן פרנסיסקו, עם נאום מרכזי של סם אלטמן ושידור חי בחינם — OpenAI הודיעה על התאריך עוד באפריל.
מה שמצופה בו נרמז מראש בעוצמה רבה מהרגיל. אלטמן פרסם ב-15 בספטמבר ש-OpenAI תכננה "השקה גדולה השבוע, ואז ל-devday ship x 6", וחזר בו מהמחצית הראשונה למחרת בערב: "הדבר העיקרי שהתרגשתי להשיק השבוע יהיה בשבוע הבא במקום, אבל לדעתי שווה לחכות!" ראש המוצר טיבו סוטיו, שהציג את השבוע כבגודל DevDay, אמר ב-19 בספטמבר שההשקה עדיין תגיע ביום שלישי, וב-22 בספטמבר היא אכן הגיעה — Sol ו-Luna, ובנוסף איפוס שימוש ב-Codex שנצבר עבור חשבונות בתשלום. אם קוראים את "ship x 6" כמניין של שישה דברים שמשוחררים סביב DevDay, מודל בלולאה שני מתאים בנוחות למובן הרגיל של הביטוי; ואם קוראים אותו כהפרזה, הוא לא מתאים כלל. כך או כך, זה פוסט של מייסד, לא מפת דרכים.
הדלפות סמוכות מצביעות לאותו כיוון בלי לנקוב בשם של מודל. בילד של Codex Cloud צץ בבילד 9922 של ChatGPT לשולחן העבודה עם אינטגרציות Tailscale ופרוקסי, ותהליך אונבורדינג הציג רמות תוכנית למפתחים — Free, Prototype ו-Accelerate, כשהאחרונה ב-50 דולר — ימים לפני ה-keynote. אף אחד מהם אינו מודל בלולאה. שניהם עולים בקנה אחד עם DevDay שמתמקד יותר בפלטפורמה מאשר במחקר.
אם זה אמיתי, איזה דגם זה?
אף אחד לא דיווח על זהות, לכן הדברים הבאים הם הסקה ויש לקרוא אותם ככזו.
הדרך הקצרה ביותר אל "המודל הלופי השני של OpenAI" היא יורש של Astra. אלטמן אמר שמודלים בעלי יכולות גבוהות יותר מגיעים "בקרוב מאוד", והדרך הזולה ביותר לבנות אחד כזה על בסיס עומק רקורנטי היא לשמור על הארכיטקטורה ולהעלות את תקציב הלופים — יותר רקורנציה לכל טוקן במקום יותר משקלים. פרשנות זו גם מסבירה בצורה הטובה ביותר את המסגור של "פתיחת הסכרים", מפני שדגל שני על אותה ארכיטקטורה הוא הצהרה שהראשון עבד.
הקריאה השנייה היא דרג חדש בתוך סדרת GPT-6 הקיימת. דקדוק השמות כבר העלה מחרוזות gpt-6-astra-minor, gpt-6-sol ו-gpt-6-luna, ואח בלולאה בתקציב עומק שונה מתיישב לחלוטין עם משפחה שמשתרעת כעת בין $0.10 ל-$50 למיליון אסימוני פלט. מודל בלולאה זול יותר יהיה הגרסה של זה שהקורא מרגיש ביותר בכיס.
הפרשנות השלישית — שחרור מלופף במשקולות פתוחות — היא הפחות מבוססת. היא תסביר את הביטוי טוב יותר מכל דבר אחר, והספרות הפתוחה על מודלים מלופפים שאיתה היא תעמוד כבר קיימת ב-Ouro וב-Nanbeige4.2-3B, אבל OpenAI לא הודיעה דבר בכיוון הזה עבור הדור הזה, ולהמציא מוצר כדי שיתאים למילה היא הדרך שבה סיקור הדלפות משתבש.

מה יהפוך את זה לבר־בדיקה לפני ה־29 בספטמבר
עקוב אחר המשטחים שפתרו את שלוש הדליפות האחרונות, בסדר הזה:
• מזהה מודל שמוכר ל-API של OpenAI, או שורה חדשה בעמוד התמחור שלה.
• רשומת שחרור ב-SDK של openai-go או openai-node שמציינת מזהי מודל חדשים — כך בדיוק הדליפו Sol ו-Luna את הגעתן, כאשר SDK v3.65.0 הפיץ מזהי מודלים שעות לפני שדף ההכרזה עלה.
• רישום של Bedrock או Azure, או מחרוזת דגל Statsig חדשה בבילד למחשב שולחני.
• משפט ארכיטקטורה בכרטיס מערכת. זהו המשפט שהיה החשוב ביותר ומגיע אחרון, מפני ש-OpenAI מעולם לא אישרה את העיצוב הלולאתי עבור Astra.
כל דבר מלבד שלושת הראשונים הוא שם, ושמות היו הפריט הפחות אמין בכל המחזור הזה כולו.

למה זה משנה גם אם יתברר שהציוץ שגוי
שני דברים משתנים אם עומק חוזר הופך לסטנדרטי ולא לחריג.
הראשון הוא ערבות. אם הדור הבא עושה יותר מהחשיבה שלו במצב נסתר, אז כל הערכה שתלויה בקריאת שרשרת המחשבה הכתובה של מודל מאבדת אות — וזה כולל הערכת בטיחות של צד שלישי, לא רק הניטור של OpenAI עצמה. זהו נתון רכש לכל מי שיש לו דרישת ערבות, והוא לא יהיה גלוי בטבלת בנצ'מרק.
השני הוא צורת סולם המחירים. לופינג מחליף פרמטרים בחישוב סדרתי, כך שהוא מעביר עלות מזיכרון לזמן: פוטנציאלית זול יותר לאירוח, פוטנציאלית איטי יותר לכל טוקן. סדרת GPT-6 כבר מתמחרת את הפשרה הזו במפורש — GPT-6 Astra במחיר $10 קלט / $50 פלט למיליון טוקנים הוא מודל העומק, GPT-6 Sol במחיר $2 / $10 הוא המהיר, GPT-6 Luna במחיר $0.10 / $0.50 הוא המודל לנפחים גבוהים. כל השלושה זמינים ב-OrcaRouter במחיר המחירון של OpenAI ללא תוספת מחיר, כך שאם מודל רביעי, בלופ, מגיע ב-29 בספטמבר, המחירון אצלנו הוא המחירון של הספק ביום שבו הוא מושק — והורדת מחיר של הספק נכנסת לתוקף כאן באותו יום שבו היא נכנסת לתוקף שם.
השימוש המעשי בהדלפה כמו זו אינו חיזוי, אלא הכנה. מודל שעשוי לצאת בעוד חמישה ימים ואין לו בנצ'מרק עצמאי הוא בדיוק המקרה שבגללו קיים failover אוטומטי: כוון נתיב למודל החדש, השאר את GPT-6 Astra או GPT-6 Sol מאחוריו, ושבוע ראשון רע יעלה לך בחלק מתעבורתך במקום בנתיב הייצור שלך. זו גם הדרך ההגיונית לבדוק מודל עתיר עומק — ה-routing DSL מרכיב אותו לקריאה אחת לצד המודלים שהוא אמור להחליף, ומיזוג מודלים יריץ פאנל שלהם מול אותו פרומפט, שזה קריאה מהירה יותר של ארכיטקטורה חדשה מכל פוסט השקה.
מה באמת נכון הלילה?
פוסט אחד ב-X אומר שמודל השפה הלופי השני של OpenAI מגיע ב-29 בספטמבר. בלי מזהה מודל, בלי מחיר, בלי שם, בלי מקור שני, בלי ארטיפקט. מתחתיו: דגם דגל שהושק ב-3 בספטמבר, שדיווחים אומרים שהוא לופי ושאופןAI מעולם לא אישרה שהוא לופי, ירידה מוצהרת ביכולת ניטור עקבות חשיבה ביחס ל-GPT-5.6 Sol, מדען ראשי שאומר שהלולאה מוגבלת לעומק גרף חישוב של עד פי שניים מזה של GPT-4, ושכבה זולה שהושקה ב-22 בספטמבר שהפכה את שאלת הארכיטקטורה לרלוונטית מסחרית ולא אקדמית.
זו טענה דקה הנשענת על סיפור עבה, שזו הצורה הרגילה של הדלפה חמישה ימים לפני האירוע. אם ביום שלישי יופיע בפורט מאסון מודל לולאתי שני, הפרט המעניין לא יהיה מספר הבנצ'מרק — אלא השאלה אם כרטיס המערכת חוזר על הסתייגות הנוגעת ליכולת ניטור. המשפט הבודד הזה הוא מה שאומר לך אם "כבר לא אסור" הוא סיסמה או מדיניות.

השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
