
הסוכן "o" של OpenAI: מה באמת אומרת ההדלפה של DevDay 2026, ומה היא לא
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 610 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 189 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
השם שדווח הוא החלק הפחות מעניין. מה שההדלפה אומרת על הסוכן הפעיל תמיד של החברה הוא שהוא ייקרא "o", שהוא יהיה בכל מסלולי ChatGPT Pro, ושמצב מהיר — שפועל על שבבי Cerebras — משויך אליו. הפרט ששווה להתעכב עליו קטן יותר ומוזר יותר מכך: לפי הדיווח, האזכור זוהה בעמוד השדרוג של מסלול ה-Pro ב-100$, ולא של זה ב-200$, באותו חודש שבו החברה הפסיקה למכור את מסלול ה-200$ בכלל. אין עמוד מוצר, אין מחיר, אין מזהה מודל ואין הצהרת חברה שמשתמשת באות כשם מוצר. הפוסט שמאחורי המאמר הזה הוא סיכום של חשבון אחד של מה שלטענתו הוא ראה, והכנס שעליו הוא נשען הוא אמיתי: DevDay 2026 הוא ב-29 בספטמבר ב-Fort Mason Center בסן פרנסיסקו. הסוכן שהוא מתחרה בו הוא גם אמיתי — Grok Bot, מוצר העמית הדיגיטלי לעבודה ש-SpaceXAI הכניסה לבטא מוקדמת ב-11 באוגוסט. המודל שהסוכן ככל הנראה יפעל עליו הוא אמיתי ומתוארך: GPT-6 Astra, זמין באופן כללי מאז 3 בספטמבר. כמעט שום דבר אחר בטענה הזו אינו.
ממה מורכבת ההדלפה בפועל, ממוין לפי משקל
שלושה דברים מדווחים, והם אינם ראויים להיקרא כטענה אחת.
ההפניות בצילומי המסך הן החלק החזק ביותר. דיווח שפורסם ב-26 בספטמבר אומר שהפניות ל-"O" מופיעות בכל רחבי התצורה של ChatGPT עצמו — כשם תצוגה, וכסיומת דואר בכתיב "-o" — ושהמחרוזת הזהה הופיעה לאחרונה כהטבה בעמוד השדרוג של תוכנית ChatGPT Pro ב-100 דולר. אלו ארטיפקטים בצורת פריסה ולא המצאה: משטחי תצורה הם המקום שבו חברה מכינה מוצר לפני שהיא מכריזה עליו, בדומה לדגלי תכונה. הם גם הסוג החלש ביותר של ארטיפקט זמין, מפני שמחרוזת שהוכנה מראש יכולה לשנות את שמה, לקבל ייעוד אחר או להינטש, והיא אינה נושאת עמה שום התנהגות. הדיווח מפורש לגבי הפער הזה: מה הסוכן עושה, למה הוא עשוי לגשת, אם הוא מתזמן משהו, כמה זמן הוא זוכר, ומי מקבל אותו — כל אלה אינם מפורטים.
השם הוא הטענה מסדר שני. חשבון @o מושעה ב-X מוזכר כשריון אפשרי. כינוי מושעה הוא נקודת נתונים על כוונה ברגע מסוים, ולא על מה שהמוצר הוא, ואותה אות כבר עברה פעם אחת במחלקת השמות של OpenAI — עוד על כך בהמשך.
השכבה השלישית היא החלק שהגיע מהאות של השבוע הזה ולא מדיווח: ש"o" מופיע בכל מסלולי ה-Pro, ש-Fast Mode מאושר, שהוא ככל הנראה נכלל במסלול מנוי של 500 דולר, ושהסיליקון של Cerebras הוא מה שמאפשר את המהירות. "ככל הנראה" עושה עבודה גלויה במשפט הזה. הפוסט של האות עצמו מקוטע בלכידה שהרדאר ביצע — הפריט החמישי שלו מתחיל ב"shared m…" ונעצר — אז יש לקרוא את הרשימה כבלתי שלמה ולא כחמש נקודות מוחלטות.
בעיית השמות שאיש לא בדק
OpenAI כבר השתמשה באות הזו. מודלי ההסקה שלה הושקו תחת o1, o3, o3-mini ו-o4-mini לאורך 2024 ו-2025, והסדרה צומצמה ולא הורחבה: o4-mini הוסר מ-ChatGPT בפברואר 2026, GPT-4.5 עזב ביוני, ול-o3 הוקצתה פרישה בת 90 יום שהוכרזה בהערות שחרור המודל ב-28 במאי — פרישה שהבלוג הזה סיקר בזמנו מפני שמשתמשים דיווחו על תגובות נעלמות לפני המועד האחרון.
אז "o" לבדו כשם של סוכן צרכני יתנגש בהיסטוריה הקרובה של החברה עצמה, ויהיה דו־משמעי במקום היחיד שבו דו־משמעות יקרה: בורר מודלים. זו אינה הוכחה שההדלפה שגויה — ספקים ממחזרים אותיות, ושם קוד פנימי לעתים קרובות מת בבחינת השמות — אבל זו סיבה להתייחס לשם כחלק שהכי קל לוותר עליו בסיפור. אם "o" ייצא תחת תווית אחרת, כל עובדה מתוארכת שלהלן עדיין תקפה.
מדוע התזמון אמין למרות שהמוצר לא
הראיה החזקה ביותר להשקת סוכן ב-DevDay אינה ההדלפה. היא מה ש-OpenAI כבר הציבה במקום בארבעת השבועות שלפני כן.
• 3 בספטמבר — GPT-6 Astraהגיע לזמינות כללית בתור מודל החזית של OpenAI: חלון הקשר של 1.05M טוקנים, פלט מקסימלי של 128K, מתומחר ב-$10.00 למיליון טוקני קלט ו-$50.00 למיליון טוקני פלט, עם קלט במטמון ב-$1.00 וכתיבות מטמון ב-$12.50. הקטלוג שלנו כולל את אותו מודל תחת תאריך רישום 2026-09-04; Artificial Analysis מתארכת את ההשקה ל-3 בספטמבר.
• 10 בספטמבר — OpenAI פתחה את Agents API בבטא ציבורית, ומכרה למפתחים את רתמת ה-Codex המנוהלת: OpenAI מפעילה את התזמור, את דחיסת ההקשר ואת ההתאוששות, והמפתח מספק את המשימה, את המודל, את הכלים ואת הסביבה. זו התשתית של סוכן שפעיל תמיד, הנמכרת כמוצר למפתחים.
• 10 בספטמבר — באותו יום, הרשמות חדשות ושדרוגים לתוכנית ChatGPT Pro ב-$200 הושהו, כשהביקוש ל-GPT-6 Astra צוין כסיבה. מסלול ה-$100, Plus, Go, Business ו-Enterprise וה-API — כולם נשארו פתוחים.
• 22 בספטמבר — GPT-6 Sol ו-GPT-6 Lunaהושקו במחיר של 2.00 / 10.00 דולר ו-0.10 / 0.50 דולר למיליון טוקנים, שאותם OpenAI תיארה כקבועים ולא כמבצעיים, ובכך הרחיבה את הקצה הזול של הקו שהסוכן יסתמך עליו לצורך עבודה שגרתית.
• 26 בספטמבר — התיעוד של שכבת השירות Ultrafast הורחב, עם בורר מהירות המציע Standard, Fast ו-Ultrafast שנצפה במצב לא מפורסם ב-Responses API Playground, ודיווחים שמצביעים על פריסה רחבה יותר סביב DevDay.
• 29 בספטמבר — DevDay 2026, ההרצאה המרכזית שודרה בשידור חי, סם אלטמן פותח. חשבון המפתחים של OpenAI פרסם "72 שעות ל-OpenAI DevDay" באותו סוף שבוע שבו פורסם דוח הסוכנים.

קראו את שש השורות האלה יחד וצורת הסיפור מתחברת באופן עקבי: OpenAI הפכה את רתמת הסוכנים למוצר, מכרה אותה למפתחים, הקציבה במשורה את המושב הצרכני שנושא את המודל הטוב ביותר שלה, ויש לה הרצאה מרכזית בעוד ארבעה ימים. גרסה צרכנית של אותה רתמה — שנמכרת כמנוי ולא כנקודת קצה לפי טוקן — היא המהלך הבא המובן מאליו. שום דבר מזה לא מאמת את השם, את הדרגה או את הקישור ל-Cerebras. זה הופך את התזמון לסביר, וזו טענה שונה וחלשה יותר.
מצב מהיר, Ultrafast והטענה של Cerebras
האות אומר ש-Fast Mode "מאושר" ושהשבב של Cerebras "נכנס לתוקף". יש להפריד בין השניים זה מזה, מפני שאחד הוא תשתית פלטפורמה מתועדת והאחר הוא הסקה לגבי איזה שבב משרת איזה מוצר.
מצב מהיר הוא מסלול אמיתי ומתומחר ב-API של OpenAI עבור קו GPT-6: הוא מחויב לפי כפליים מהתעריף הסטנדרטי ומקנה מהירות פלט של פי 2.5 בערך, והוא אותו מסלול ששמו שונה מ-Priority processing ב-30 ביולי 2026 — ה-API מקבל גם service_tier: "fast" או service_tier: "priority". הוא אינו זמין עם שימור נתונים באיחוד האירופי (EU data residency) בלפחות מודל אחד בקו. בתוך מאגר המנויים של ChatGPT, דיווחים על מבנה קרדיטי המנוי מציבים את מצב מהיר בפי 2.5 משיעור הקרדיטים ולא בפי 2 כמו ב-API, מה שהופך את ההגדרה המהירה ביותר לעסקה מעט פחות משתלמת בתוך ChatGPT מאשר מחוצה לו — פרט שכדאי להכיר לפני שמניחים שתועלת של מצב מהיר שווה למה שהיא נשמעת.
Ultrafast הוא דרג ה-Cerebras וזה יצור אחר לגמרי. OpenAI הכריזה עליו ב-13 באוגוסט 2026 כמוצר הראשון של שותפות המחשוב שלה עם Cerebras — עסקה שדווחה בכ-10 מיליארד דולר על פני שלוש שנים — והוא מספק עד פי 14 מתפוקה רגילה ועד 750 טוקנים של פלט בשנייה על GPT-5.6 Sol, המודל שהוא מוגבל אליו כרגע. הגישה אליו מבוקרת, אין לו מחיר מפורסם, ונכון לשבוע זה הוא עדיין דרג ברשימת המתנה ולא דרג כללי. תיעוד ה-API של Responses מפרט את ultrafast כערך עבור ה-service_tier פרמטר עם ההסתייגות שהוא "זמין כעת עבור gpt-5.6-sol".
וזו בדיוק הסיבה לכך שיש להתייחס למשפט של Cerebras בהדלפה כאל ניחוש בעל בסיס סביר ולא כאישור. סוכן צרכני שרץ באופן רציף יהיה נשלט על ידי השהיה ועלות לכל משימה, ומהירות ברמת Cerebras היא תשובה אמיתית למחצית הראשונה של זה. אך אין עדיין נתיב Ultrafast מתועד לאף מודל GPT-6, אין כרטיס תעריפים עבורו, ואין דבר מ-OpenAI שמקשר סוכן צרכני לשבב הזה. כיוון ההסקה סביר; הוודאות בניסוח אינה מוצדקת.
מה יעלה לך "זמין בכל דרגות ה-Pro"
זהו החלק בטענה שקורא יכול למעשה להעריך, מפני שמבנה השכבות שמתחתיו מפורסם.
• מחירים חודשיים — שתי תוכניות ChatGPT Pro, ב-100$ וב-200$, היו זמינות לרכישה במהלך ספטמבר; ההרשמות החדשות לתוכנית ב-200$ הושהו מאז 10 בספטמבר, ו-OpenAI לא פרסמה סף לפתיחה מחדש.
• הגרסה המדודה של אותה יכולת — GPT-6 Pro מוגבל ל-200 הודעות בשבוע במסלול של 200 דולר ול-50 בשבוע במסלול של 100 דולר, כאשר האחרון נלקח ממכסה משותפת עם GPT-5.6 Sol Pro. מסלולי Business נמוכים יותר. אלה הנתונים המפורסמים של OpenAI והם הגבול האמיתי לשווי של "הטבה בעמוד השדרוג".
• אריתמטיקת טוקנים על המודל שמתחת — בתעריף $10.00 / $50.00 למיליון, $500 של GPT-6 Astra API הם כ-50M טוקני קלט או 10M טוקני פלט, ומצטמצמים שוב בחצי בעבודה אפקטיבית מעל סף הקלט של 272K, שבו כל הבקשה מתומחרת מחדש ב-$20.00 / $2.00 / $75.00.
• החצי הזול של הקו — אותם 500$ קונים בערך 250M טוקנים בקלט או 50M טוקנים בפלט ב-GPT-6 Sol במחיר $2.00 / $10.00, ופי עשרה מזה ב-GPT-6 Luna במחיר $0.10 / $0.50.
אם הסוכן מגיע בתוך מנוי קיים, ההשוואה מפסיקה להיות על מחיר מחירון והופכת להיות על איזה מושב אתם כבר משלמים עליו. אם הוא מגיע כסעיף חיוב נפרד, על OpenAI להצדיק אותו מול קטגוריה שבה מתחרה כבר מספק מוצר במשך שישה שבועות. כך או כך, סוכן שפעיל כל הזמן משנה את צורת החשבון: עוזר שממשיך לעבוד בזמן שאתם ישנים צורך טוקנים בלי שאדם נמצא בלולאה, וזהו עומס העבודה שמסלול מחויב לפי שימוש מעניש ומושב סופג. זה גם עומס העבודה שבו קלט שמור במטמון בעשירית ממחירו של קלט חדש קובע את הסכום הכולל — סוכן מתמשך שולח מחדש הקשר כמעט ללא שינוי בכל סבב, וזה בדיוק הדפוס שעבורו נועדה הנחת המטמון.
זו השכבה שבה OrcaRouter פועל, וכדאי לומר בפשטות מה היא אינה מכסה. אנו מנתבים את המודלים של OpenAI לפי הטוקן, כשמחיר המחירון של הספק מועבר הלאה במרווח של 0%, כך ששינוי בתעריפים של ספק נכנס לתוקף כאן באותו היום, עם מעבר אוטומטי בין ספקים ו-DSL לניתוב להרכבת קריאות. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol ו-GPT-6 Luna נמצאים כולם על מפתח אחד. מה שאנחנו לא יכולים למכור לך הוא מנוי ChatGPT או סוכן שעדיין לא קיים — אין מה לנתב עד ש-OpenAI תשיק אחד כזה.
הרף שהסוכן צריך לעבור נמוך ממה שזה נראה
Grok Bot הוא ההשוואה שההדלפה עצמה עורכת, והקריאה הכנה שלה היא ש-SpaceXAI הציבה רף נמוך. הוא נכנס לבטא מוקדמת ב-11 באוגוסט בתצורת כניסה בעלות 120 דולר למושב, בחבילה של Cursor Premium Teams, עם מסלולים אישיים ב-200 ו-300 דולר לחודש, וצריכה מעבר למגבלות הכלולות מחויבת לפי עלות טוקנים. כל בוט מקבל מכונה וירטואלית משלו בענן עם דפדפן, מערכת קבצים ומסוף; הוא מתחבר לאפליקציות שאין להן API; הוא שומר תהליכי עבודה שהודגמו כשגרות וממשיך לפעול גם אחרי שהמחשב הנייד נסגר.
מה שלא פורסם הוא החלק שהיה מכריע את הכף. SpaceXAI לא פרסמה בנצ'מרקים עצמאיים או נתוני אמינות עבורו, נתב המודלים שמאחוריו הוא אוטומטי ומשתמשים אינם יכולים לקבע מודל, בודקים מוקדמים לא התרשמו ממנו בפומבי, ומבקרים מציינים את היעדרה של שכבת בקרה ארגונית — אין הרשאות תחומות, כללי הסלמה או מסלול ביקורת. Muse של Meta הגיע לאחריו ב-8 בספטמבר אל תוך קטגוריה שכיום מונה שלושה מוצרים.

השורה האחרונה היא הנקודה של כל ההשוואה. אין מדד של Artificial Analysis ל"האם הסוכן סיים את המשימה בלי לעשות משהו קטסטרופלי", ולכן סוכן מתמשך נקנה על סמך אותן ראיות שעליהן נקנה צ'אטבוט ב-2023: הדגמות ווייבס. האילוץ המתוארך היחיד שאיש בסיפור הזה לא מזכיר הוא תפיסת הבטיחות של OpenAI עצמה. GPT-6 Astra הגיע לסף הקריטי ליכולות סייבר של החברה, ו-OpenAI הזהירה שהניטור עלול להאט, להשהות או לעצור משימות לגיטימיות — כולל במפורש עבודות ארוכות טווח. סוכן שפעיל תמיד הוא עבודה ארוכת טווח בהגדרה, בפלטפורמה שכבר הצהירה שהיא עשויה לקטוע אחת כזו.
מה יהפוך את זה לבר-בדיקה, ומתי
שמועות על מוצר ארבעה ימים לפני השקתו הן זולות, והבדיקות ספציפיות.
• עמוד של OpenAI, הערת שחרור או ערך במרכז העזרה שבהם השם משמש כשם מוצר. עד כה לא הופיע דבר, וההיסטוריה של האות בתוך OpenAI הופכת את זה למבחן שיש לו את הסיכוי הגדול ביותר להיכשל.
משטח תצורה ששורד רענון — תוכנית ברת-רכישה ממש, מכסה רשומה, עמוד הגדרות — ולא מחרוזת תצוגה שהוכנה בבילד.
• כל מפרט התנהגות שהוא: מה ניתן להעניק לו, מה הוא מתזמן, כמה זמן הוא זוכר, והאם יש לו זהות דואר משלו בסביבת הייצור או רק בקובץ תצורה.
• מחיר. "בכל מסלולי ה-Pro" אינו מחיר, ומסלול של 500$ אינו הופך לעובדה רק מפני שדוח נפרד מצא מחרוזות מינוי בסך 500$ במקום אחר.
• הקישור של Cerebras או שמופיע בתיעוד ההגשה של OpenAI עצמה עבור השכבה, כפי שעשתה ההגבלה של Ultrafast ל-GPT-5.6 Sol, או שאינו מופיע כלל.

ההחלטה שזה מותיר לקורא קטנה ממה שההדלפה מרמזת, והיא אינה עוסקת במכתב. אם אתם בוחנים סוכן שפועל תמיד לעבודה, המוצר שקיים היום הוא Grok Bot, והמהלך הנבון הוא התנסות קצרה מול זרימת העבודה שלכם ולא התחייבות למושב — מסלול הכניסה ב-120 דולר הוא רצפה, לא תקרה, ושימוש מעבר למגבלות הכלולות מחויב לפי עלות טוקנים. אם אתם בונים, ה-Agents API נמצא בבטא ציבורית מאז 10 בספטמבר והוא החלק בסיפור הזה שאפשר ממש לבדוק היום, כאשר רתמת הבדיקות, ארגז החול והחיוב מתועדים כולם.
ואם אתם מתמחרים מה יעלה להריץ את כל זה, עשו זאת על סמך המודלים ולא על סמך השמועה. GPT-6 Astra במחיר $10.00 / $50.00 למיליון טוקנים זמין ב-OrcaRouter במחיר המחירון של OpenAI עצמה, בלי תוספת, GPT-6 Sol ו-GPT-6 Luna נמצאים שם ב-$2.00 / $10.00 וב-$0.10 / $0.50, ותעריף קריאת המטמון — $1.00 לעומת $10.00 עבור Astra — הוא השורה שקובעת מה באמת עולה עומס עבודה מתמשך. סוכן ש-OpenAI לא הכריזה עליו לא ניתן לבצע עליו בנצ'מרק, לנתב אותו או לקנות אותו. עם הטוקנים שמתחתיו אפשר לעשות זאת, היום, והמונה שתבנו מולם עדיין יהיה המונה הנכון גם אם השם שעל הקופסה יתברר כמשהו אחר מאשר אות בודדת.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
