
GPT-5.6 Sol Ultrafast: Ultrafast שוחרר במחיר גבוה פי 6 מהמחיר הסטנדרטי, אבל המודל הזה עדיין בגרסת תצוגה מקדימה בלבד
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
ההמתנה הסתיימה עבור הדרגה, אבל לא עבור המודל הזה. ב-DevDay ב-29 בספטמבר 2026, הספק הפך את Ultrafast למשהו שאפשר לקנות: תוכנית ChatGPT Pro 500 החדשה ב-500 דולר לחודש כוללת אותו, ה-API מפרסם כעת מחירון Ultrafast בפי שישה מהתעריף הרגיל — 60.00 דולר לקלט / 300.00 דולר לפלט למיליון טוקנים ב-GPT-6 Astra — ותיעוד Codex של הספק מאשר שדרגות ה-Pro אינן כוללות כלל מגבלת שימוש של חמש שעות, חלון שחל על Plus. כל זה נאמר על ידי הספק, ופורסם בסיכום ה-DevDay של הספק עצמו, בעמודי העזרה ובתיעוד למפתחים. מה שלא זז הוא המודל שהדף הזה עוסק בו. GPT-5.6 Sol Ultrafast, שהוכרזה ב-13 באוגוסט 2026 כדרגת הגשה מואצת ב-Cerebras עבור GPT-5.6 Sol בקצב תפוקה של עד פי 14 מהרגיל ו-750 טוקני פלט לשנייה, היא עדיין בגישת תצוגה מקדימה בלבד — בתיאום דרך צוות החשבונות של הספק — ועדיין אין לה מחיר מפורסם משל עצמה. הדרגה הושקה. גרסת Sol עדיין ממתינה.
שתי תנועות מחירים נרשמו מאז שכתבנו על כך לראשונה, והן מצביעות לכיוונים מנוגדים. המודל שמתחתיהן הוזל: GPT-5.6 Sol הסטנדרטי מחויב כעת ב-$4.00 למיליון טוקני קלט וב-$20.00 למיליון טוקני פלט — תעריף מבצע של OpenAI, שלפי הספק יהיה זמין לפחות עד 21 בנובמבר 2026 — ולא ב-$5.00 / $30.00 שהיו תקפים באוגוסט. שכבת המהירות שמעליו קיבלה מחיר לראשונה, והוא לא זול: Ultrafast ב-GPT-6 Astra מחויב ב-$60.00 / $300.00 למיליון. כל נתון בכתבה זו נבדק מחדש מול כרטיס התעריפים המפורסם של OpenAI, מסמך ה-API שלה ותיעוד התמחור של Codex שלה בתאריך 2026-09-30.
מה זה בעצם מצב Ultrafast
Ultrafast הוא דרג שירות, לא מודל חדש. OpenAI הכריזה עליו ב-13 באוגוסט 2026 כמוצר הראשון של שותפות המחשוב שלה מינואר 2026 עם יצרנית השבבים Cerebras — עסקה שדווחה בכ-10 מיליארד דולר על פני שלוש שנים. בעוד שהסקת מסקנות סטנדרטית של GPT-5.6 Sol פועלת על אשכולות GPU ומבלה חלק ניכר מזמנה בהעברת משקלים בין זיכרון למחשוב, Ultrafast טוען את משקלי המודל אל 44 GB של SRAM על-שבבי בשבבים בקנה מידה של פרוס של Cerebras; מודל בגודלו של Sol משתרע על פני כמה פרוסות בשכבות, כך שהמשקלים יושבים במקום שבו המחשוב נמצא. התוצאה היא תקרת תפוקה שנקבעת על ידי הסיליקון ולא על ידי רוחב הפס של הזיכרון.
סיפור החומרה קיבל תפנית ב-2026-08-18. באירוע Supernova שלה, Cerebras חשפה את ה-CS-4, מערכת בקנה מידה של מתלה מהדור הבא הבנויה על פלטפורמת Nexus שלה — שלושה שבבי Wafer-Scale Engine לכל מתלה, עד פי 2 ממהירות יצירת הטוקנים של ה-CS-3 הקודם, ולפי Cerebras, יותר מ-1,000 טוקנים לשנייה על מודלים עם למעלה מ-10 טריליון פרמטרים. אלו הן טענות של Cerebras עבור מערכת בגישה מוקדמת, שעדיין אינה זמינה לציבור הרחב. מאז החשיפה, פוסט בודד ב-X טוען שה-CS-4 כבר משרת את GPT-5.6 Sol בכ-1,300 טוקנים לשנייה — עקבי בכיוון עם המספרים של Cerebras עצמה, אבל עדיין לא אושר על ידי אף אחד. תייחסו לזה כאות מוקדם: סביר, לא מאומת, וכדאי לבדוק שוב לפני שמתכננים סביבו יכולות.
החלק שחשוב לקוד שלך: מזהה המודל, המשקלים, התנהגות החשיבה והפלט זהים לחלוטין ל-GPT-5.6 Sol הרגיל. OpenAI ממסגרת את Ultrafast כ"יותר עבודה שימושית בשנייה" ולא כמדרגת איכות, והתצוגה המקדימה מריצה את הדגם המלא — המהירות לא נובעת מהחלפה לדגם זול יותר. מה שמשתנה הוא כמה מהר יוצאים הטוקנים.
אל תבלבלו בין Ultrafast לבין מצב מהיר. מצב מהיר הוא שכבה נפרדת וניתנת לרכישה על חומרה סטנדרטית: מהירות פלט של עד פי 2.5 בערך, בתוספת מחיר כפול לכל טוקן, וללא שינוי באיכות — שמו שונה מ-Priority Processing ב-30 ביולי 2026, וב-GPT-5.6 Sol הוא עומד על $8.00 קלט / $40.00 פלט למיליון טוקנים. Ultrafast הוא דבר אחר לגמרי — חומרה של Cerebras, עד פי 14 ב-GPT-5.6 Sol ועד פי 8 ב-GPT-6 Astra, בעלות של פי 6 מהתעריף הסטנדרטי ב-Astra ועדיין ללא תמחור ב-Sol. שני השמות יושבים כעת זה לצד זה באותו בורר מודלים, וזה נותר הדבר הכי מבלבל בשחרור הזה.
כמה מהר — המספרים שחשובים

הנתון הראשי הוא 14×, והוא דורש הגדרה. OpenAI אומרת ש-Ultrafast מייצר עד 750 טוקני פלט בשנייה, לעומת העיבוד הסטנדרטי של GPT-5.6 Sol. זהו מדד תפוקה עבור טוקני פלט, ולא טענה גורפת שהכול רץ פי 14 מהר יותר — זמן הבקשה מקצה לקצה כולל גם עיבוד קלט ואת החשיבה של המודל עצמו, ולכן 14× מוגדר כמקסימום.
• תפוקת פלט מקסימלית — עד 750 טוקנים של פלט לשנייה, לפי הודעת OpenAI (2026-08-13).
• לעומת עיבוד סטנדרטי — מהיר עד פי 14, על פי אותה הודעה; הרווחים בפועל משתנים בהתאם לאורך הקלט ולסוג המשימה.
• Humanity's Last Exam, 2,500 שאלות — דיווח של OpenAI/Cerebras: GPT-5.6 Sol Ultrafast מסיים תוך 11 שעות ו-11 דקות לעומת 78 שעות ו-27 דקות אצל Claude Fable 5, עם דיוק דומה. הנתונים מדווחים על ידי הספקים, וההשוואה משתרעת על ערימות חומרה של שני ספקים — יש להתייחס אליה כאינדיקציה, לא כפסק דין.
• GDP-Val, מקצה לקצה — Cerebras מדווחת על מהירות כוללת גבוהה פי 5.6 ללא אובדן איכות מדיד. גם זאת לפי דיווח הספק.
• השוואה בין מצב Fast ל-Ultrafast — מצב Fast מגיע לשיא של בערך פי 2.5 במהירות הפלט תמורת תוספת מחיר של פי 2, ומוגבל לאותה תקרה של ~272K טוקנים כמו התמחור הסטנדרטי. Ultrafast הוא הקפיצה הגדולה יותר: פי 14 ב-GPT-5.6 Sol לפי ההכרזה מאוגוסט, ועד פי 8 ב-GPT-6 Astra ב-Codex לפי התיעוד הנוכחי של OpenAI, כאשר סיקור ההשקה מעמיד זאת על עד 300 טוקני פלט לשנייה.
• CS-4, החומרה הבאה — Cerebras טוענת שמערך CS-4 מספק יותר מ-1,000 טוקנים בשנייה על מודלים עם יותר מ-10 טריליון פרמטרים, עד פי 2 מקצב יצירת הטוקנים של CS-3. דיווח קהילתי לא מאומת מעריך ש-GPT-5.6 Sol על CS-4 בכ-1,300 טוקנים בשנייה — אותו כיוון, אך טרם אושר על ידי OpenAI או Cerebras.
הסתייגות אחת לפני שאתם מצטטים את 14×: מדובר בתקרת תפוקת פלט בחומרה של ספק אחד, והשוואות בלתי תלויות של השקת 14× נעו בערך בין 7× ל-11×, בהתאם לחלק מעומס העבודה שנמדד. הדבר נכון גם לגבי אות המהירות של CS-4 — הנתון של כ-1,300 טוקנים/שנייה עבור GPT-5.6 Sol על CS-4 החל כפוסט בודד ב-X, ולא OpenAI ולא Cerebras אישרו זאת. התייחסו לכל אלה כטענות של ספקים וקהילה, לא כהכרעות בנצ'מרק.
מה עולה Ultrafast כעת — ולמה זה עדיין לא מתמחר את Sol

הנה מצב שאלת המחיר ל-30 בספטמבר 2026, בניסוח פשוט. ל-Ultrafast יש תעריף מפורסם — עבור GPT-6 Astra, ורק עבור GPT-6 Astra. עמוד התמחור של OpenAI כולל כעת עמודת Ultrafast לצד Standard, Batch, Flex ו-Fast: $60.00 קלט / $6.00 קלט במטמון / $75.00 כתיבות מטמון / $300.00 פלט למיליון טוקנים בהקשר קצר, כשהם מוכפלים ל-$120.00 / $12.00 / $150.00 / $450.00 מעבר לכ-272K טוקנים. זה פי שישה מתעריף Astra הסטנדרטי, שבו מצב Fast הוא פי שניים — וזה הנתון הקשיח הראשון ש-OpenAI קבעה לשכבה. הכרטיס למעלה הוא תמונת המצב שלנו מ-2026-08-18, והנתונים הדולריים בו הוחלפו פעמיים: על ידי הקיצוץ בתעריף הסטנדרטי, וכעת על ידי שורת ה-Ultrafast הזו. מה שעדיין חסר בטבלה הזו הוא תעריף Ultrafast כלשהו עבור GPT-5.6 Sol: עמודת Ultrafast מפרטת בדיוק מודל אחד, gpt-6-astra. השכבה מתומחרת; המודל הזה לא.
מה שאפשר לתמחר היום, דגם אחר דגם:
• Standard GPT-5.6 Sol — $4.00 לקלט / $20.00 לפלט לכל 1M טוקנים עבור פרומפטים של עד כ-272K טוקנים. OpenAI מציינת זאת כתמחור מבצעי הזמין לפחות עד 21 בנובמבר 2026. זהו קו הבסיס שאפשר לפנות אליו כעת.
• מצב מהיר — $8.00 / $40.00 בהקשר קצר ב-GPT-5.6 Sol, ומכפיל את עצמו ל-$16.00 / $60.00 מעבר לכ-272K טוקנים. פי שניים מהתעריף הסטנדרטי עבור מהירות פלט של עד בערך פי 2.5, וב-GPT-5.6 Sol זה עדיין הדבר המהיר ביותר שאפשר ממש לקנות.
• מטמון פרומפט — קריאות מטמון מחויבות ב-$0.40 לכל 1M (הנחה של 90% מקלט חדש); כתיבות מטמון מחויבות ב-$5.00 לכל 1M.
• דרגת הקשר ארוך — קלטים מעבר לכ-272K טוקנים מחויבים ב-$8.00 / $30.00 בעיבוד סטנדרטי, בתוך חלון של ~1.05M טוקנים של המודל ופלט מקסימלי של 128K טוקנים.
• Batch API — $2.00 / $10.00 עבור הקשר קצר ו-$4.00 / $15.00 עבור הקשר ארוך, הנחה אחידה של 50% עם זמן עיבוד של כ-24 שעות.
עבור GPT-5.6 Sol, המספר של Astra הוא הרמז הטוב ביותר שקיים, ולא יותר מכך. OpenAI מתמחרת את Ultrafast בשיעור של פי 6 מהתעריף הסטנדרטי של המודל הבסיסי; החילו את המכפיל הזה על $4 / $20 של Sol ותגיעו ל-$24 / $120 למיליון. זו אריתמטיקה, לא מחיר מפורסם — OpenAI לא אמרה דבר על תעריף Sol Ultrafast, וקבוצות הפריוויו מאוגוסט לא חויבו בתעריף שכבתי. תכננו לפי Sol סטנדרטי ב-$4 / $20 או מצב מהיר ב-$8 / $40 עד ש-OpenAI תפרסם את השורה.
איך להשתמש בזה — זמין באופן נרחב ב-Astra, עדיין לפי בקשה ב-Sol
הגישה התפצלה לשניים ב-29 בספטמבר, והפיצול פועל לרעת המודל שהדף הזה עוסק בו. Ultrafast זמין כעת באופן נרחב ב-GPT-6 Astra: התיעוד של ה-API של OpenAI אומר שהוא פתוח לכל משתמשי ה-API במגבלות קצב נמוכות — 500,000 אסימונים לדקה בשכבות שימוש 1–3, מיליון בשכבה 4, 5 מיליון בשכבה 5 — והוא נכלל בתוך ChatGPT Work ו-Codex בתוכנית Pro 500 החדשה ובתוכניות Enterprise ו-Edu זכאיות, שבהן בעל מרחב עבודה צריך להפעיל אותו, ושבהן הוא אינו נתמך עבור מרחבי עבודה שדורשים הסקה מחוץ לארצות הברית. GPT-5.6 Sol Ultrafast לא עבר יחד איתו. אותו תיעוד עדיין מתאר אותו כגישה בתצוגה מקדימה דרך צוות חשבון של OpenAI, והתיאור של הפרמטר עצמו בסכימת ה-API עדיין מציין "currently available for gpt-5.6-sol" — שורה שמפגרת כעת אחרי שאר התיעוד במקום להוביל אותו. אם אתם רוצים את השכבה היום, אתם רוצים אותה ב-Astra.
גם סוגיית הממשק הוכרעה. TestingCatalog דיווח ב-26 בספטמבר 2026 שבורר מהירות שהציע Standard, Fast ו-Ultrafast היה קיים ולא פורסם ב-Responses API Playground; שלושה ימים לאחר מכן OpenAI שחררה את הגרסה הצרכנית של בדיוק זה, כאשר Ultrafast הוא כעת אפשרות בבורר המודלים ב-ChatGPT Work וב-Codex ב-Pro 500. סימנו את התצפית ההיא כפרשנות של פרסום אחד לממשק משתמש שטרם שוחרר ואמרנו ש-OpenAI לא אישרה דבר מכל זה. היא הייתה נכונה בכיוון, וההשקה שאליה היא הצביעה הגיעה ב-DevDay ולא אחריו.
קבוצות התצוגה המקדימה ש-OpenAI ציינה באוגוסט היו כתיבת קוד, מסחר, מחקר פיננסי, תמיכה ועומסי עבודה אינטראקטיביים אחרים — צוותים שהסוכנים שלהם מבצעים קריאות רבות בכל בקשה, ושבלעדיהם השהיית התגובה היא צוואר הבקבוק. Jane Street, Rogo ו-Podium היו בין הבודקים המוקדמים שצוינו בשמם. אם עומס העבודה שלך הוא צ'אט של סבב יחיד, דרגת המהירות חשובה הרבה פחות מאשר בלולאת סוכן של 40 קריאות. התשובה המעשית תלויה כעת במודל שעליו אתה שואל: ב-GPT-6 Astra תוכל להגדיר service_tier: "ultrafast" כבר אחר הצהריים, ואילו ב-GPT-5.6 Sol עדיין לא.
מה אתה יכול לעשות היום — התשובה המעשית

בעוד ש-GPT-5.6 Sol Ultrafast נותר מאחורי דלת התצוגה המקדימה, שני דגמי הדגל פעילים ב-OrcaRouter בתעריף הספק עם 0$ תוספת לכל טוקן — מזהה המודל openai/gpt-5.6-sol דרך נקודת הקצה התואמת ל-OpenAI בכתובת api.orcarouter.ai/v1, ולצידו GPT-6 Astra במחיר הסטנדרטי 10.00$ / 50.00$, שהוא המודל ש-OpenAI הוסיפה לו כעת שכבת Ultrafast ואשר אנחנו לא מנתבים בשכבה הזו. הצילום שלמטה הוא מאוגוסט 2026 והוא עדיין מציג את השורה שהייתה בתוקף אז, 5.00$ / 30.00$; התעריף של Sol היום הוא 4.00$ / 20.00$, וזה מה שאנחנו מעבירים הלאה. ההעברה הזו היא הסיבה לכך שתנועות מחירים של ספקים מגיעות אלינו באותו יום: 4.00$ קלט / 20.00$ פלט, אותם נתונים ש-OpenAI מפרסמת, בלי תוספת לכל טוקן. אם כבר יש לכם לקוח OpenAI, ההגירה היא שינוי של כתובת בסיס ומזהה מודל; ולא דבר נוסף. אותו מפתח ואותה נקודת קצה נושאים יותר מ-200 מודלים, כך ש-Sol יושב לצד אחיו שלו — GPT-5.6 Terra ב-2.00$ / 12.00$ ו-GPT-5.6 Luna ב-0.20$ / 1.20$ — וגם המודלים במשקלים פתוחים שאיתם הייתם משווים אותו, ואתם יכולים לנתב לפי רמת קושי במקום לשלב מחדש כל אחד ואחד.
שני פרטים ספציפיים של OrcaRouter ראויים לציון בעמוד מהירות. BYOK: הבא את מפתח OpenAI שלך ו-OpenAI מחייבת אותך ישירות לפי התעריפים שלה — OrcaRouter מוסיף $0 לכל טוקן ושומר על מגבלות הקצב והקרדיטים של הספק שלך ללא פגע. Guardrails: PII Shield ומדיניות התוכן פועלים לפני החיוב, כך שבקשה חסומה מחזירה 400 נקי ולעולם אינה מחויבת, ו-Agent Firewall מדרג קריאות כלים ו-MCP לפני שהן מבוצעות. Ultrafast עצמו זמין באופן נרחב ב-GPT-6 Astra אך לא בתנאים הניתנים לניתוב ולא עבור Sol — זוהי שכבה מבוקרת גישה המחויבת בתעריף של פי 6 מהתעריף הסטנדרטי, ואנחנו לא מספקים אותה. אם OpenAI אי פעם תציע אותו בתנאים סטנדרטיים, חיבורו לאותה נקודת קצה הוא שינוי מזהה מודל; ההגדרה שאתה בונה היום נשארת תקפה.
הגבול הכנה — כאשר Ultrafast אינו התשובה
חמישה מקומות שסיפור המהירות עדיין לא מחזיק בהם, כעת כשמחציתו כבר התייצבה:
זמין אינו אותו דבר כמו זמין לך. Ultrafast נפתח לכל משתמשי ה-API ב-GPT-6 Astra, אך הוא נפתח במגבלות קצב נמוכות, הוא עדיין מתואר כמבוקר-גישה בסכמה של OpenAI, הוא אינו תומך בעיבוד אזורי באיחוד האירופי או באזורים אחרים מחוץ לארה״ב, ובסביבות עבודה של Enterprise הוא כבוי עד שבעלים מפעיל אותו. ב-GPT-5.6 Sol שום דבר לא נפתח בכלל. בדוק את הגישה שלך לפני שאתה מתכנן ארכיטקטורה על מי מהם.
14× הוא מקסימום, לא הבטחה. זוהי תקרת תפוקת פלט בחומרת Cerebras; השהיה מקצה לקצה עדיין כוללת עיבוד קלט, את זמן ההסקה של המודל ואת הרשת שלך. פרומפט עתיר הסקה יכול לבלות את רוב זמן השעון שלו בהסקה, ואז ההאצה הכותרתית מתכווצת.
לאחד מהמודלים יש מחיר ולאחר אין מחיר. התעריף של Astra Ultrafast מפורסם — 6× מהסטנדרט — ואין שורת Ultrafast עבור GPT-5.6 Sol בשום מקום. תקצב מול Sol הסטנדרטי ב-$4 / $20 או מצב מהיר ב-$8 / $40, והתייחס לכל נתון של "עלות GPT-5.6 Sol Ultrafast" שתראה, כולל האקסטרפולציה של $24 / $120 שלמעלה, כאל אריתמטיקה ולא כמחירון.
המדדים מדווחים על ידי הספק. ריצת ה-HLE בת 11 השעות ונתון ה-GDP-Val של פי 5.6 הם מספרים של OpenAI/Cerebras מההכרזה באוגוסט; הערכות בלתי תלויות של תוספת המהירות נעות בערך מפי 7 עד פי 11, בהתאם למה שנמדד. הוסף לרשימה הזו גם את האות CS-4: הנתון של ~1,300 טוקנים/שנייה עבור GPT-5.6 Sol על CS-4 מגיע מפוסט בודד ב-X ואין לו אישוש בלתי תלוי. נתוני Astra Ultrafast החדשים — פי 8 ב-Codex, פי 6 במחיר — גם הם של OpenAI עצמה.
והאחד שעולה כסף ולא זמן: הוא לא יתקן צוואר בקבוק שאין לך. אם הסוכנים שלך איטיים בגלל האורקסטרציה שלך, השהיית כלים, או פרומפטים עתירי קלט, מסלול פלט מהיר יותר מזיז את הזנב רק במעט. החלטת התאמת השכבה — GPT-5.6 Sol ב-$4 / $20 לעומת GPT-5.6 Terra ב-$2 / $12 לעומת GPT-5.6 Luna ב-$0.20 / $1.20 — עדיין מזיזה את החשבון שלך יותר מכל שכבת מהירות.
שורה תחתונה. Ultrafast הוא כבר לא שכבת רשימת המתנה שאפשר רק לקרוא עליה. נכון ל-29 בספטמבר 2026, OpenAI מוכרת אותו: כלול בתוכנית ChatGPT Pro 500 ב-500 דולר ב-Work וב-Codex, פתוח לכל משתמשי ה-API על GPT-6 Astra במגבלות קצב נמוכות, ומתומחר פי שישה מהתעריף הסטנדרטי — 60 / 300 דולר למיליון טוקנים בהקשר קצר. GPT-5.6 Sol Ultrafast, תצוגת אוגוסט שדף זה נבנה סביבה, לא זזה: עדיין תחת בקרת גישה, עדיין מוגבל ל-gpt-5.6-sol בסכימת ה-API, עדיין ללא תמחור, והנתון של ~1,300 טוקנים לשנייה שדווח עבור Sol על ה-CS-4 של Cerebras הוא עדיין פוסט בודד שלא אומת ב-X. GPT-5.6 Sol הסטנדרטי ב-4 / 20 דולר הוא מה שאפשר לקרוא היום ב-OrcaRouter בתוספת של 0 דולר; GPT-6 Astra ב-10 / 50 דולר הוא מה שאפשר לקרוא אם אתם רוצים את המודל שקיבל את שורת ה-Ultrafast.
Ultrafast עולה כעת כסף אמיתי ב-GPT-6 Astra — פי 6 מהרגיל, או כחלק מחבילת Pro 500 ב-500$ — בעוד ש-Ultrafast של GPT-5.6 Sol נשאר בתצוגה מקדימה. GPT-5.6 Sol המלא פעיל ב-OrcaRouter במחיר 4$ / 20$ למיליון טוקנים ללא תוספת מחיר, ומוכן לשימוש עם המפתח שלך.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
