
GPT-6.1 Sol Ultrafast מושק ל-API, Codex ו-ChatGPT עובדים
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
OpenAI משיקה מצב Ultrafast עבור GPT-6.1 Sol — שכבת השירות המהירה ביותר שהיא מוכרת, והפעם הראשונה שלשכבת ה-Sol הקרובה ל-Astra יש כזו. המהלך מציב את GPT-6.1 Sol באותו מדרג כמו GPT-6 Astra Ultrafast ב-API, ב-Codex וב-ChatGPT Work, והוא מגיע עם מחירון מפורסם במקום רשימת המתנה: 12.00 דולר למיליון טוקנים בקלט ו-60.00 דולר למיליון טוקנים בפלט, בדיוק פי שישה ממה ש-GPT-6.1 Sol הרגיל עולה. טענת המהירות על האריזה היא "עד פי 8". החלק המעניין הוא מה שהביטוי הזה מודד, והתשובה היא לא המודל שאתם עומדים לשלם עליו.
ביומן השינויים למפתחים מופיע הערך מיום 8 באוקטובר: "נוסף מצב Ultrafast עבור GPT-6.1 Sol ב-Responses API. השתמשו ב-gpt-6.1-sol עם service_tier: "ultrafast" כדי להפחית את הזמן בין אסימוני הפלט הנוצרים. הוא זמין לכל משתמשי ה-API, בכפוף למגבלות קצב, עם עיבוד גלובלי וריבונות נתונים בארה״ב ובאיחוד האירופי." בדף התיעוד של Ultrafast נכתב כעת "זמין באופן נרחב עבור GPT-6 Astra ו-GPT-6.1 Sol, עם גישה בתצוגה מקדימה עבור GPT-5.6 Sol", ודף המהירות בצד ChatGPT מאשר את החלק הנוגע למנויים: Ultrafast זמין ב-Codex וב-ChatGPT Work ב-Pro $500 ובמסלולי Enterprise ו-Edu זכאים.
Ultrafast היא שכבת שירות, לא מודל שני.
שום דבר במשקלים לא משתנה. אותו צ'קפוינט, אותו חלון הקשר של 1,050,000 טוקנים, אותו קלט מקסימלי של 922,000 טוקנים, אותה תקרת פלט של 128,000 טוקנים, אותו חיתוך ידע של 30 באפריל 2026, אותן תשובות. מה שאתה קונה הוא עדיפות בתזמון: המודל מייצר טוקנים מהר יותר, וההצגה של OpenAI עצמה צרה בכוונה — המסלול "מקצר את הזמן בין טוקני פלט שנוצרים". זה לא הופך את המודל לחכם יותר, וזה לא מקצר את שלב החשיבה.
ההבחנה הזו היא כל ההחלטה. עבור לולאת סוכנים שמבצעת ארבעים קריאות כלים ברצף, הרווח מצטבר מפני שהפלט של כל תור מגיע מוקדם יותר. עבור בקשת חשיבה קשה בודדת שמבלה את רוב זמן השעון שלה בהתלבטות, אפשר לשלם פי שישה ולצפות באותו ספינר.
סולם הדרגות, פעם אחת, במילים פשוטות:
• Batch and Flex — חצי מ-Standard, המסלול הזול לעבודה שאיש לא ממתין לה
• רגיל — $2.00 קלט / $0.10 במטמון / $2.50 כתיבה למטמון / $10.00 פלט למיליון טוקנים
• Fast — פי שניים מ-Standard, או $4.00 / $0.20 / $5.00 / $20.00; OpenAI שינתה את שם Priority processing ל-Fast mode ב-30 ביולי 2026
• מהיר במיוחד — פי שישה מ-Standard, או $12.00 / $0.60 / $15.00 / $60.00
• מעל 272K טוקני קלט — כל הבקשה מתומחרת מחדש לפי 2x מתעריפי הקלט והמטמון ו-1.5x מהפלט; Ultrafast long-context הוא $24.00 / $1.20 / $30.00 / $90.00
החשבון שאיש לא מכניס לדף השיווק
פי שישה מהמחיר תמורת פי שמונה מהמהירות אינו עסקה מפסידה, וגם לא ארוחת חינם. החיוב ב-Ultrafast הוא לפי טוקן, כך שעבודה שעולה $1.00 ב-Standard עולה $6.00 ב-Ultrafast — ומסתיימת בכשמינית מהזמן. החיסכון אינו בחשבון, אלא בזמן השעון. אתה משלם חמישה דולרים נוספים כדי להסיר שבע שמיניות מזמן התור של אותה עבודה, והאם זה זול או אבסורדי תלוי לחלוטין בכמה שווים לדקה האדם או הפייפליין שממתינים בקצה השני.
מכך נובעות שתי השלכות, והן דווקא אלה שבדרך כלל מפספסים אותן:
• עבודה אינטראקטיבית היא ה"כן" הקל. מפתח שצופה ב-diff נוחת, סוכן שאינו יכול להמשיך עד שקרא את התוצאה — אלה המקרים שבהם זמן התגובה הוא המוצר. פלט מהיר פי שמונה בלולאה בת ארבעים סיבובים אינו שיפור שולי בתפיסה האנושית; זה ההבדל בין כלי שאתה משתמש בו לבין כלי שאתה מפעיל ברקע.
• עבודה מתוזמנת ועבודות באצוות הן ה"לא" הקל. אם למשימה ממילא יש זמן עד הבוקר, Ultrafast הוא חיוב גדול פי 6 שלא לצורך, ומסלול Batch בחצי מחיר ממש יושב שם.
קלט שנשמר במטמון ראוי למבט שני, משום שגם הוא זז: 0.60$ למיליון ב-Ultrafast לעומת 0.10$ ב-Standard, עדיין 5% משיעור הקלט שאינו במטמון. סוכנים עם מטמון פרומפט ששולחים מחדש פרומפט מערכת גדול בכל תור יגלו שהנחת המטמון מותאמת לפי השכבה במקום להגן עליהם מפניה.

מאיפה מגיע המספר "עד פי 8"
זה החלק שיש לקרוא בעיון, כי כאן הכותרת של ההשקה והתיעוד של ההשקה מתארים בשקט דברים שונים.
מדידת המהירות הספציפית-למודל היחידה ש-OpenAI מפרסמת היא המשפט הזה: "GPT-6 Astra Ultrafast מייצר טוקנים עד פי 8 מהר יותר מ-GPT-6 Astra במצב Standard ב-Codex." זהו נתון של Astra, שנמדד ב-Codex. אין מכפיל מקביל מפורסם עבור GPT-6.1 Sol. המסמך שמכסה את Ultrafast עבור המודל הזה אומר שהוא מפחית את הזמן בין טוקני הפלט שנוצרים ומצביע על טבלת תמחור; הוא לא נוקב במספר. עמוד המהירות בצד של ChatGPT חוזר על המשפט של Astra ונעצר.
אז הקריאה הכנה של "עד פי 8 מהר יותר" היא: זו הכותרת של הדרגה, שמקורה במודל האח שנמצא ב-Ultrafast מאז 29 בספטמבר, והיא טענה של ספק שאף גורם בלתי תלוי לא שחזר עבור אף אחד משני המודלים. ייתכן בהחלט שזה תקף ל-GPT-6.1 Sol — השניים פועלים על אותה מחסנית הגשה והמנגנון של הדרגה זהה — אבל אף אחד מחוץ ל-OpenAI לא פרסם מדידת טוקנים לשנייה עבור וריאנט ה-Sol, וה"עד" עושה עבודה אמיתית במשפט הזה.
כדאי גם להשאיר את הדרגות מופרדות לפי מודל, כי הישנה היא עדיין עניין לא גמור. Ultrafast הוכרז ב-13 באוגוסט 2026 עבור GPT-5.6 Sol כ"עד פי 14 מהיר יותר מעיבוד Standard", בתצוגה מוקדמת מוגבלת ללקוחות נבחרים. שלושה חודשים לאחר מכן, התיעוד עדיין אומר של-GPT-5.6 Sol יש "גישת preview" וטבלת התמחור של Ultrafast מכילה בדיוק שתי שורות — GPT-6 Astra ו-GPT-6.1 Sol. מספר של פי 14 שמעולם לא הגיע לזמינות כללית ואין לו תעריף מפורסם הוא הצהרה, לא מוצר.

מי יכול בעצם להפעיל את זה
צד ה-API הוא רחב; צד המנוי הוא צר, וההבדל הזה מפתיע אנשים.
• API — זמין לכל משתמשי ה-API ב-gpt-6.1-sol, בכפוף למגבלות קצב נפרדות מאלה של Standard ו-Fast. המשמעות היא תקציב שני שצריך לעקוב אחריו, ולא רק מחיר שני.
• מגבלות קצב מהירות-על עבור GPT-6.1 Sol — 1,000,000 טוקנים בדקה ב-Build, 4,000,000 ב-Launch, 40,000,000 ב-Grow. OpenAI פישטה את שכבות השימוש מחמש לשלוש ב-6 באוקטובר, כך ששלושת השמות האלה הם הסולם הנוכחי, ולא סולם מדור קודם.
• שהות נתונים — GPT-6.1 Sol תומך בשהות נתונים בארה״ב ובאיחוד האירופי ובעיבוד גלובלי, כולל במסגרת Fast ו-Ultrafast. ה-Ultrafast של Astra אינו כולל שהות נתונים באיחוד האירופי, כך שאם עומס העבודה שלך מוצמד ל-EU, זו תצורת ה-Ultrafast הראשונה שאפשר לקנות בכלל.
• Codex ו-ChatGPT Work — Ultrafast זמין במסלול Pro ב-$500 ובמסלולים זכאים של Enterprise ו-Edu. מנהלי Enterprise מקבלים אותו מושבת כברירת מחדל, וצריכים להפעיל אותו לכל משתמש או לכל מרחב עבודה.
• Chat — אינו נכלל. GPT-6.1 Sol עצמו נמצא ב-Work וב-Codex; משטח ה-Chat הצרכני אינו חלק מכך.
• כיצד זה מחויב במסגרת מנוי — השימוש הכלול מנוצל בפי 8 מהתעריף הסטנדרטי, וקרדיטים שנרכשו או תשלום לפי שימוש ב-Enterprise מחויבים בפי 6 מהתעריף הסטנדרטי. כדאי להכיר את שני המספרים האלה לפני שמשאירים את זה מופעל.
פרט מימוש אחד קובע אם תראו בכלל משהו מהמהירות. ההנחיה של OpenAI בוטה בעניין: השתמשו ב-WebSockets, "במיוחד עבור יישומים סוכניים שמבצעים קריאות כלים רבות ברצף מהיר", משום ש"בלי חיבור מתמשך, תקורת רשת יכולה להפחית את שיפורי ההשהיה". אם הלקוח שלכם פותח חיבור HTTP חדש לכל קריאה, תקורה לכל בקשה יכולה לאכול את כל היתרון של הדרגה ששילמתם עליה זה עתה פי 6. HTTP עדיין עובד. הוא פשוט עשוי שלא להיות שווה את הדרגה.
מה אנחנו מנתבים, ומה אנחנו לא
הדגם GPT-6.1 Sol ברמת Standard נמצא ב-OrcaRouter בתור openai/gpt-6.1-solבמחיר של הספק עצמו — $2.00 לקלט ו-$10.00 לפלט למיליון טוקנים, עם 0% תוספת — מחיר המחירון של הספק מועבר כמו שהוא, כך שכאשר OpenAI משנה תעריף, השינוי מגיע לחשבון שלך באותו יום שבו הוא מגיע למחירון, ולא בחידוש החוזה הבא שלך. אותו מפתח ואותו endpoint נושאים יותר מ-200 מודלים, כך שקריאה ל-GPT-6.1 Sol וקריאה ל-Claude או ל-Qwen יושבות מאחורי אינטגרציה אחת עם failover אוטומטי וללא חוזה נוסף, וה-DSL של הניתוב ירכיב מודלים לקריאה אחת כאשר משימה דורשת יותר מדעה אחת.
Ultrafast אינו אחד מהמודלים האלה, וזה יהיה מטעה לרמוז אחרת. זהו דגל של שכבת שירות בחשבון OpenAI — אתה שולח service_tier: "ultrafast" אל gpt-6.1-sol ו-OpenAI מחייב את החשבון שלך לפי התעריפים שלמעלה — כך שזה נמצא בתוך האינטגרציה הישירה שלך עם OpenAI. אם תפעיל אותו, השאר את התעבורה המדורגת במפתח הספק שלך ונתב את תעבורת הנפח הסטנדרטי דרכנו. זו החלוקה הכנה, והיא גם האפשרות הזולה יותר עבור כל דבר שלא ממתין לאדם.

מה לעשות עם זה היום
אם יש לך מושב של Codex או ChatGPT Work ב-Pro $500, המתג כבר קיים וההתנסות לא עולה לך דבר מלבד מכפיל השימוש — הרץ את אותה משימה בשתי הדרכים ובדוק אם ללולאה שאתה באמת מריץ יש מספיק סבבים כדי שהשיפור פי שמונה יבוא לידי ביטוי. אם אתה על ה-API, הניסוי ששווה להריץ צר יותר ממה שההכרזה מרמזת: מדוד כמה מהשהיה שלך היא יצירת טוקנים וכמה היא חשיבת המודל, ואז כוון את Ultrafast לחלק שהוא באמת יכול לדחוס.
ואם יש לך בחירה בין Fast במהירות 2x לבין Ultrafast במהירות 6x עבור אותה בקשה, Fast הוא הדרג שהגיע לכאן ראשון וזה שאת התנהגותו אפשר להסיק ממחירון בלבד. Ultrafast חדש עבור המודל הזה, ואף מדידה בלתי־תלויה לא תמחרה אותו, והוא שווה בדיוק כמה שהסטופר שלך אומר.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
