
תמחור GPT-6 Astra: מדוע שלושה מחירים שונים כולם נכונים, ומה העלות האמיתית של משימה
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
השורה התחתונה תחילה: GPT-6 Astra עולה $10.00 למיליון טוקני קלט, $1.00 למיליון קלט שמור במטמון, ו-$50.00 למיליון טוקני פלט במסלול הסטנדרטי של OpenAI. זהו מחיר המחירון של OpenAI עצמה, כפי שנקרא מדף התמחור של OpenAI עצמה בתאריך 16 בספטמבר 2026 — והתאריך חשוב, כי מחיר המודל היה שונה בנקודות שונות, וקוראים ממשיכים למצוא את המספרים האחרים ההם. GPT-6 Astra עצמו הושק ב-3 בספטמבר 2026, שלושה עשר ימים לפני העמוד הזה. זה אינו מאמר השקה ואינו מאמר הכרזה; זהו עמוד עיון למודל שכיום זמין באופן כללי, והחל מהשבוע הזה, פרוס באופן כללי. GPT-5.6 Sol מופיע למטה כבסיס המחיר שמעליו נמכר Astra, ולא כנושא.
הסיבה שכרטיס תעריפים צריך עמוד שלם היא שהמספרים בתפוצה חלוקים ביניהם. חפשו את המחיר של המודל הזה ותמצאו $10/$50 מ-OpenAI, תעריף אצווה של $5/$25, Azure מציגה גם $10/$50 וגם $11/$55, ולפחות נקודת קצה אחת רשומה ב-$20/$100. אף אחד מאלה אינו שגיאת הקלדה, ואף אחד מהם אינו מחיר המחירון ששונה בשקט. אלה רמות שירות שונות ומוכרים מחדש שונים, וההבחנה ביניהם היא ההבדל בין תקציב לניחוש.
כרטיס התעריפים, כאשר כל שורה מתויגת ומתוארכת
כל מה שמופיע בקטע הזה נקרא מתוך תיעוד התמחור והמודלים של ה-API של OpenAI עצמה, בתאריך 16 בספטמבר 2026. כאשר נתון מגיע ממישהו אחר, המשפט שנושא אותו אומר זאת.
• סטנדרטי, בקשות של עד 272,000 אסימוני קלט — $10.00 לכל 1M קלט, $1.00 לכל 1M קלט במטמון, $12.50 לכל 1M כתיבות מטמון, $50.00 לכל 1M פלט (טבלת התמחור של OpenAI עצמה, נקראה ב-2026-09-16).
• שורת כתיבת המטמון אמיתית, ואנשים מפספסים אותה — בפעם הראשונה שאתם שולחים קידומת זו כתיבה בתעריף של $12.50 ל-1M, לא קריאה ב-$1.00. כתיבות מטמון מחויבות ב-1.25x מתעריף הקלט הרגיל.
• סטנדרטי, בקשות מעל 272,000 טוקנים בקלט — $20.00 קלט, $2.00 קלט במטמון, $25.00 כתיבות למטמון, $75.00 פלט למיליון. כל הבקשה מתומחרת מחדש, לא רק הטוקנים שמעבר לגבול (טבלת התמחור של OpenAI עצמה, נקראה ב-2026-09-16).
• Batch and Flex — חצי מהתעריף הרגיל: $5.00 קלט, $0.50 קלט במטמון, $6.25 כתיבות למטמון, $25.00 פלט לכל 1M (טבלת התמחור של OpenAI עצמה, נקראה ב-2026-09-16). עבור קלט מעל 272K תעריף האצווה הוא $10.00 / $1.00 / $12.50 / $37.50.
• מצב מהיר — כפול מהסטנדרט: 20.00$ קלט, 2.00$ קלט שמור במטמון, 25.00$ כתיבה למטמון, 100.00$ פלט לכל 1M (טבלת התמחור של OpenAI עצמה, נקראה ב-2026-09-16).
• מפרטי דגם שקובעים את החיוב — חלון הקשר 1,050,000 טוקנים, קלט מקסימלי 922,000, פלט מקסימלי 128,000, תאריך עדכון ידע 2026-04-30, תמיכה בטוקני חשיבה כן, ערכי מאמץ חשיבה low / medium / high / xhigh / max (תיעוד המודל של OpenAI עצמה, נקרא 2026-09-16).
אם אתם רוצים את גרסת המשפט היחיד: במסלול הסטנדרטי, בקשה שנשארת מתחת ל-272K טוקני קלט עולה 10 דולר למיליון בקלט ו-50 דולר למיליון בפלט, קריאות מהמטמון עולות עשירית מתעריף הקלט, וכל השאר במאמר הזה הוא או הנחה על הסכמה לעיבוד איטי יותר או תוספת תשלום על חציית סף.
מדוע תראה מספר שונה, ומה זה מה
חמישה דברים שונים מייצרים הצעת מחיר שאינה $10/$50. ארבעה מהם אנו יכולים לקשר לתיעוד; אחד לא, ואנחנו נאמר זאת במקום לנחש.
$5/$25 הוא מסלול האצווה, וזהו המחיר של OpenAI עצמה. זה אינו הנחת משווק או תעריף ארגוני שנקבע במשא ומתן. בדף התמחור של OpenAI, עיבוד אצווה מופיע במחצית מהתעריף הרגיל, ושורת האצווה של Astra מציגה קלט של $5.00 ופלט של $25.00. אם מקור מציין בפניך $5/$25 כאילו מדובר במודל אחר, זה אותו מודל, אותם משקלים, בתור האיטי יותר. אצווה היא התשובה הנכונה להרצות הערכה בלילה, והתשובה הלא נכונה לכל דבר אינטראקטיבי.
$11/$55 הוא בדיוק תוספת של 10% על מחיר המחירון, ו-OpenAI מתעדת תוספת של 10% עבור נקודות קצה של תושבות.בדף התמחור של OpenAI נכתב כי עבור נקודות קצה של תושבות נגבית תוספת של 10% עבור מודלים שיצאו לאור ב-5 במרץ 2026 ואילך. GPT-6 Astra שוחרר ב-3 בספטמבר 2026, ולכן הוא עומד בתנאי. הכפלת מחיר המחירון ב-1.1 מניבה $11.00 ו-$55.00 לדיוק הסנט. זהו הסבר חזק למקור ההצעה הגבוהה יותר בסגנון Azure — נקודת קצה הכבולה לתושבות שעוברת דרך תוספת מתועדת, ולא ספק משנה שממציא מרווח. עלינו להיות מדויקים לגבי גבול הטענה הזו: התוספת מתועדת על ידי OpenAI, והחשבון תואם בדיוק, אך הרשומה הספציפית של Azure שראינו אינה מציינת בעצמה שהיא נקודת קצה של תושבות. יש להתייחס לכך כהסבר הסביר, לא כמאומת.
$20/$100 הוא תעריף המצב המהיר של OpenAI עבור מודל זה. זהו הנתון שנראה הכי כמו מספר מומצא והכי פחות מומצא. המצב המהיר מכפיל כל שורה, והשורה הסטנדרטית של Fast של Astra היא $20.00 קלט ו-$100.00 פלט לכל 1M. נקודת קצה שמצטטת $20/$100 מצטטת רמת שירות אחרת — עיבוד בעדיפות — לא מחיר מחירון אחר ולא מודל אחר. אם אתם רואים את הנתון הזה לצד השם של Astra, השאלה שיש לשאול היא איזו שכבת עיבוד, לא איזה ספק.
קיימים מחירים מתחת למחיר המחירון, והם המרווח של מישהו אחר. שערים ומשווקים של צד שלישי מפרסמים את Astra מתחת למחירון. שער אחד מפרסם בפומבי מחיר הנמוך בכ-20% מהתעריף של OpenAI. זוהי החלטה מסחרית של אותו מפעיל, ולא שינוי מחיר מצד OpenAI — והיא נושאת עמה את תנאי הטיפול בנתונים והאמינות שאותם מחיל אותו מפעיל. איננו מתכוונים לנקוב בשמותיהם או להחשיב את ההנחה שלהם כראיה לגבי המחיר של המודל הזה, משום שהיא ראיה על העסק שלהם, ולא על מחירון התעריפים של OpenAI.
מה שלא הצלחנו לאמת. ראינו רישום של נתב שמציג את המודל כ-gpt-6-astra עם דרגת batch במחיר $5/$25 וכינוי משתנה מהצורה ~openai/gpt-astra-latest. הנתון של batch תואם לדף של OpenAI עצמו. הכינוי הוא מבנה gateway: התיעוד של המודלים של OpenAI מפרט בדיוק רשומה אחת תחת snapshots והיא gpt-6-astra החשוף, בלי צורה מתוארכת ובלי כינוי -latest. אל תכניסו כינוי של gateway לקונפיגורציה כאילו הספק פרסם אותו. בנפרד, לא מצאנו תיעוד של OpenAI לשום דרגה בתמחור נפרד בשם "Astra Pro", "Astra-Medium" או דרגה דומה. "Pro" מופיע בשמות תוכניות ChatGPT, לא בכרטיס התעריפים של API, ורישום של נתב אינו תיעוד של ספק. אם אתם צריכים לאמת דרגה, אמתו אותה בדף של OpenAI עצמו.

Astra לצד שאר כרטיס התעריפים של OpenAI
מחיר מקבל משמעות רק לצד החלופות באותו כרטיס. אלה כולם התעריפים הסטנדרטיים של OpenAI עצמה, כולם נקראו ב-16 בספטמבר 2026, כולם לכל מיליון טוקנים, כולם בקלט של 272K או פחות.
• GPT-6 Astra — $10.00 קלט / $1.00 במטמון / $12.50 כתיבה / $50.00 פלט.
• GPT-5.6 Sol — קלט 4.00$ / שמירה במטמון 0.40$ / כתיבה 5.00$ / פלט 20.00$.
• GPT-5.6 Terra — $2.00 קלט / $0.20 מטמון / $2.50 כתיבה / $12.00 פלט.
• GPT-5.6 Luna — $0.20 קלט / $0.02 במטמון / $0.25 כתיבה / $1.20 פלט.
• גרסאות ההקשר הארוך — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.
מתחת לטבלה הזו רץ מבצע, והוא זה שקובע את המכפיל שכולם מתווכחים עליו. בעמוד התמחור של OpenAI מצוין שהתמחור הפרומוציוני של GPT-5.6 Sol זמין לפחות עד 21 בנובמבר 2026. לעומת התעריף הפרומוציוני שבתוקף היום, Astra היא פי 2.5 מ-Sol בכל שורה ושורה — פי 2.5 בקלט, פי 2.5 בקלט במטמון, פי 2.5 בפלט. לעומת התעריף הלא-פרומוציוני של Sol, 5.00 דולר לקלט ו-30.00 דולר לפלט, Astra היא פי 2 בקלט ופי 1.67 בערך בפלט. שתי המכפלות נכונות אריתמטית ושתיהן מתארות את אותם שני מודלים באותו יום. ההבדל הוא כולו בשאלה איזה תעריף של Sol אתה משתמש בו כמכנה, והתשובה הכנה לשאלה "האם Astra היא פי 2.5 מ-Sol?" היא: כן, עד 21 בנובמבר 2026, או עד ש-OpenAI תסיים את המבצע, המוקדם מבין השניים.
אנחנו מדגישים את הנקודה הזו בהרחבה כי זו השגיאה הנפוצה ביותר בסיקור של המודל הזה, כולל בבלוג הזה. מכפיל לפי טוקן שבוחר בשקט שער Sol אחד ואינו מציין אותו אינו עובדה על Astra. זו עובדה על המועד שבו נכתב המשפט.

עלות למשימה, לא עלות לטוקן.
המסגור של OpenAI עצמה הוא שהשוואת מחירי טוקנים עבור המודל הזה היא ההשוואה הלא נכונה, כי Astra תוכנן להשלים עבודה בטווח ארוך בפחות טוקנים ובפחות ניסיונות חוזרים. שווה להתייחס לטענה הזו ברצינות מספקת כדי לעשות את החשבון במקום לחזור עליה. אז הנה דוגמה מחושבת עם ההנחות מוצגות מראש, כך שתוכל לשנות אותן כדי שיתאימו לעומס העבודה שלך.
עומס העבודה: הרצת סוכן בת 200 קריאות, בדומה להגירת לילה שלמה. כל קריאה נושאת 10,000 טוקני קלט, מהם 8,000 קריאות מטמון ו-2,000 חדשים, ומייצרת 500 טוקני פלט. לאורך ההרצה מדובר ב-400,000 טוקני קלט חדשים, 1,600,000 טוקני קלט מהמטמון ו-100,000 טוקני פלט, ובנוסף כתיבת מטמון אחת של 10,000 טוקנים לזריעת הקידומת. מסלול Standard, מתחת ל-272K לבקשה, כך שלא חלה תוספת תשלום על הקשר ארוך.
• GPT-6 Astra — חדש 0.4M x $10.00 = $4.00; במטמון 1.6M x $1.00 = $1.60; כתיבה 0.01M x $12.50 = $0.13; פלט 0.1M x $50.00 = $5.00. סה"כ $10.73.
• GPT-5.6 Sol בתעריף המבצעי שלו — קלט חדש $1.60; מהמטמון $0.64; כתיבה $0.05; פלט $2.00. סה"כ $4.29.
• GPT-5.6 Sol בתעריף שאינו מבצעי — טרי $2.00; במטמון $0.80; כתיבה $0.06; פלט $3.00. סה״כ $5.86.
• GPT-5.6 Terra — חדש $0.80; מטמון $0.32; כתיבה $0.03; פלט $1.20. סה״כ $2.35.
• GPT-5.6 Luna — חדש $0.08; מטמון $0.03; כתיבה $0.00; פלט $0.12. סה״כ $0.23.
במספרי טוקנים זהים, אם כך, Astra היא בערך פי 46 מ-Luna ופי 4.6 מ-Terra. אף אחד לא קונה Luna כדי לבצע עבודה בגודל של Astra, והערת השוליים הזו היא כל הסיבה לכך שהשוואות עלות-לטוקן בין שני הדגמים האלה הן תיאטרון. ההשוואה ל-Sol היא זו שמכריעה משהו, אז הנה המספר שמשנה.
נקודת האיזון היא 40%. מכיוון ש-Astra היא בדיוק פי 2.5 מ-Sol בכל שורה בתעריף המבצעי של Sol, Astra יכולה לשרוף עד 40% מהטוקנים של Sol באותה משימה ועדיין להסתכם באותו חיוב — וזה נכון לכל תמהיל של קלט חדש, קלט שמור במטמון ופלט, כי היחס אחיד. אם Astra משתמשת בשליש מהטוקנים של Sol, היא יוצאת זולה יותר; אם היא משתמשת במחצית, היא יקרה יותר. לעומת התעריף הלא-מבצעי של Sol, נקודת האיזון מתמתנת לבערך 55% בתמהיל עתיר המטמון הזה, כי מכפיל הפלט של Astra יורד ל-1.67x ואילו מכפיל הקלט שלה יורד ל-2x.
המספר הבודד הזה הוא זה שמועיל, והוא המקום שבו טענת הספק והמדידה העצמאית מפסיקות להסכים. OpenAI מדווחת על Terminal-Bench 4.0 בשיעור 57.9% עבור Astra לעומת 37.3% עבור GPT-5.6 Sol, בעלות API מוערכת נמוכה בכ-9% לכל משימה — לפי דיווח הספק. Artificial Analysis, בהערכה עצמאית שפורסמה ב-9 בספטמבר 2026, מדדה את Astra תוך שימוש בכשליש בערך מהטוקנים של Sol לכל משימה ב-Coding Agent Index שלה, ובכל זאת מצאה את Astra בעלות של $7.09 לכל משימה במאמץ מקסימלי — כ-15% יותר מ-Sol (max) — עבור ציון גבוה ב-7 נקודות. ב-Intelligence Index שלה, אותה הערכה מיקמה את Astra בין $0.82 ל-$3.26 לכל משימה ברמות המאמץ השונות, כ-60% יותר יקר מ-Sol במאמץ מקסימלי.
שני הדברים האלה יכולים להיות נכונים בעת ובעונה אחת, והפער ביניהם הוא הכותרת הכנה. החיסכון בטוקנים אמיתי וגדול — שליש הוא בדיוק סוג המספר שמכסה נקודת איזון של 40% — אבל חיסכון הנמדד בטוקני פלט אינו מקטין את שורות קריאת המטמון והקלט החדש ששולטות בסשן סוכן ארוך. האם Astra זולה יותר לכל משימה מאשר Sol תלוי בתמהיל שלך, והכיוון מתהפך בין עומסי עבודה. כל מי שאומר לך שהיא פשוט זולה יותר, או פשוט יקרה פי 2.5, מצטט שורה אחת מהחשבון כאילו הייתה הסכום הכולל.
מה בעצם קובע את החיוב במודל הזה?
שלושה דברים שולטים, ושלושתם ספציפיים לאופן שבו Astra אמורה לשמש.
אסימוני חשיבה הם אסימוני פלט. הם מחויבים בתעריף של $50.00 למיליון, כמו פלט גלוי. בעמוד המודל של OpenAI מפורטים ערכי המאמץ הנתמכים: low, medium, high, xhigh ו-max, ואין הגדרת השבתה — הרצפה גבוהה יותר ממה שהייתה במודלים ישנים יותר. במדד Intelligence Index העצמאי, הפער בין מאמץ low ל-max היה $0.82 עד $3.26 למשימה, פי ארבעה על עבודה זהה. רמת המאמץ היא מנוף העלות הגדול ביותר שבשליטתך, וכדאי להגדיר אותה לכל קריאה בנפרד ולא באופן גלובלי.
ניסיונות חוזרים מכפילים הכול. סוכן שנכשל ורץ מחדש משלם שוב על כל הקידומת. זה המנגנון שמאחורי הטענה של OpenAI על פחות ניסיונות חוזרים, וזו גם הסיבה שחישוב לפי טוקן מטעה בשני הכיוונים: מודל שעולה פי 2.5 לטוקן אך מסיים במעבר אחד יכול לגבור על מודל זול יותר שנזקק לשלושה. אם אתם מעריכים את Astra מול משהו, מדדו משימות שהושלמו לדולר, לא טוקנים לדולר.
הקשר ארוך הוא המצב המתוכנן, והוא כרוך בתשלום נוסף. החלון הוא 1,050,000 טוקנים. אם חוצים 272,000 טוקני קלט בבקשה בודדת, כל הבקשה מתומחרת מחדש ב-20.00$ לקלט ו-75.00$ לפלט למיליון — לא רק החלק העודף. בקשה בת 280,000 טוקנים עולה בערך כפול מבקשה בת 270,000 עבור כ-4% יותר קלט. במודל שנבנה לעבודה בטווח ארוך, זו הדרך הקלה ביותר לשרוף תקציב בלי לשים לב, ולכן פיצול משימה ארוכת טווח לבקשות מתחת ל-272K הוא בדרך כלל זול יותר משליחתה בשלמותה, אף שהמודל מסוגל לקבל אותה בשלמותה.
משקל הנגד הוא המטמון, ושם סשנים ארוכים של סוכן באמת חוסכים כסף. קריאות מהמטמון עולות $1.00 לעומת $10.00 לקריאה טרייה, הפחתה של 90%, וסשן ארוך שולח מחדש את אותה קידומת עשרות פעמים. הכתיבה למטמון בעלות $12.50 משולמת פעם אחת. בדוגמה המעובדת שלעיל, אם כל קריאה הייתה צריכה לשלוח מחדש את הקידומת בת 8,000 הטוקנים שלה ללא מטמון, החשבון של Astra היה עולה מ-$10.73 לסכום של כ-$25.00 — המטמון עושה יותר עבודה עבור התקציב מכל שורה בודדת אחרת.
השיא על המכפיל
כמה עמודים בבלוג הזה, כולל GPT-6 Astra מול GPT-5.6 Sol: האם מחיר גבוה פי 2.5 שווה את זה? וגם הביקוש ל-GPT-6 Astra משהה הרשמות חדשות ל-ChatGPT Pro ב-200 דולר, מציינים כי Astra רשומה במחיר של פי 2.5 ממחיר הטוקן של GPT-5.6 Sol. נתון זה חושב לפי המחיר המבצעי של Sol, 4.00 דולר לקלט ו-20.00 דולר לפלט, שהוא המחיר שעמוד התמחור של OpenAI מציג היום ומתאר כמבצעי, וזמין לפחות עד 21 בנובמבר 2026.
אז המכפיל לא הפסיק להיות נכון — הוא קיבל תאריך תפוגה שלעמודים המוקדמים יותר לא היה. לעומת התעריף הלא-מבצעי של Sol של $5.00 לקלט ו-$30.00 לפלט, Astra היא פי 2 בקלט ובערך פי 1.67 בפלט, לא פי 2.5. את העמודים שאומרים פי 2.5 יש לקרוא כמתייחסים לחלון המבצע; כיוון ההשוואה לא משתנה, אבל גודל הפער מצטמצם בחמישית עד שליש ברגע שהמבצע מסתיים. כל מי שמתקצב מעבר ל-21 בנובמבר 2026 צריך להשתמש ב-$5.00 וב-$30.00 כמכנה של Sol ובפי 2 / פי 1.67 כמכפיל של Astra. איננו מציגים מחדש את הטיעונים בעמודים האלה — ההיגיון של הבנצ'מרק והמהימנות שם עומד בפני עצמו — אלא רק מתקנים את המכנה שלפיו הם חושבו.
שאלת ה"חינם", נענית בלי הסתייגויות.
אין שכבת חינם למודל הזה, ואין מסלול API חינמי אליו. משתמשי ChatGPT בחינם וב-Go לא מקבלים את GPT-6 Astra בכלל. מנויי Plus מקבלים אותו רק דרך ChatGPT Work ו-Codex, לא בצ'אט הרגיל. ה-API מחויב מהטוקן הראשון ב-$10.00 למיליון קלט, והדרך הלגיטימית הזולה ביותר להפחית את המספר הזה היא שכבת ה-Batch ב-$5.00 למיליון, שעולה לך בהשהיה ולא ביכולת. כל מי שמפרסם גישה חינמית ל-API של GPT-6 Astra מוכר מחדש משהו — בדרך כלל מאגר קרדיטים לניסיון בשער צד שלישי עם תנאי נתונים משלו. זה לא בהכרח עסקה רעה, אבל זה לא חינם, וזה לא OpenAI.
כדאי לדעת אם אתם מתכננים קיבולת סביב מנוי ולא סביב ה-API: ב-10 בספטמבר 2026, OpenAI השהתה הרשמות חדשות ושדרוגים לרמת ChatGPT Pro ב-200 דולר שלה, תוך ציון הביקוש ל-Astra. רמת ה-100 דולר, Plus, Go, ה-API וחשבונות Business ו-Enterprise נשארו פתוחים. הצרכנים קוצבו; הגישה ל-API ולארגונית לא קוצבה. אם התוכנית שלכם תלויה במכסת השימוש של מנוי צרכני, זה הסיכון שכדאי למדל.
ניתוב זה, ומה שנתב לא מתקן
Astra הוא אחד מהמודלים הזמינים דרך OrcaRouter תחת openai/gpt-6-astra, במחיר זהה של $10.00 לקלט ו-$50.00 לפלט שגובה הספק, עם מדורגי מעל 272K כפי שמוצג בעמוד המודל שלנו. אנחנו מעבירים את מחיר המחירון של הספק הלאה עם 0% תוספת, מה שחשוב יותר במודל הזה מאשר ברוב המודלים: המספרים במאמר הזה כבר השתנו פעם אחת במהלך חיי המודל, ומחיר בתעריף מעבר משתנה ביום שבו הספק משנה אותו ולא כשמישהו נזכר לעדכן טבלה.

הטיעון הכנה בעד ניתוב כאן אינו המחיר, כי אין הנחה למכור לך — אלא שחשבון העלויות שלמעלה תלוי בעומס העבודה, ולא תדע באיזה צד של נקודת האיזון של 40% תנחת עד שתריץ אותו. הצבת Astra מאחורי נקודת קצה אחת לצד Sol, Terra ו-Luna מאפשרת לך למדוד משימות שהושלמו לדולר על התעבורה שלך ולהחליף מודלים בלי חוזה שני או שינוי בקוד. ה-DSL לניתוב מאפשר לך להרכיב קריאה על פני כמה מודלים במקום להקדיש נתיב ייצור לאחד מהם, ומעבר אוטומטי בעת כשל מטפל במקרה שהמודל הזה כבר הדגים פעמיים — שהביקוש לו יכול לעלות על הקיבולת.
הפשרות ממשיות באותה מידה וראויות לתת להן שם. ראוטר הוא חוליה בנתיב הבקשה, ובמודל שנקודת המכירה שלו היא עבודה אוטונומית לטווח ארוך, החוליה הזו היא עוד גורם בתחום הכשל; אם סובלנותך לכך היא אפס, פנה ישירות לספק. כמה דברים במאמר זה קיימים רק בקשר ישיר: אפשרות Zero Data Retention ש-OpenAI מציעה ללקוחות API זכאים בנקודות קצה נתמכות כפופה לאישור של OpenAI, והפעלה ארגונית — שמושבתת כברירת מחדל בהשקה ומופעלת על ידי מנהלים לפי המחירון החל עליהם — היא הסכם בינך לבין OpenAI, לא משהו שראוטר יכול להעניק. OpenAI גם מתעדת שמצב Fast עבור מודל זה אינו זמין עם ריבונות נתונים באיחוד האירופי, אז אם אתה צריך גם ריבונות נתונים וגם מהירות, האילוץ הזה חל על המודל, לא על הנתיב. ותוספת של 0% של ראוטר אינה הנחה: אנחנו לא זולים יותר מלפנות ישירות, אנחנו באותו מחיר עם פחות אינטגרציות לתחזק.
מה לצפות
תאריך אחד ומספר אחד. התאריך הוא 21 בנובמבר 2026, שבו התמחור הפרומוציונלי של Sol אינו מובטח עוד — אם הוא יפוג, המכפיל של Astra מול Sol יורד מ-2.5x ל-2x בקלט, ול-1.67x בפלט, וכל השוואת עלות-למשימה בתפוצה נעשית טובה יותר בשיעור של חמישית עד שליש לטובת Astra, בלי שדבר אחד ישתנה אצל Astra. המספר הוא נקודת האיזון האישית שלך: הרץ משימה מייצגת אחת לטווח ארוך על שני המודלים, ספור משימות שהושלמו ואת סך הדולרים, ותקבל תשובה שימושית יותר מכל דבר שפורסם, כולל העמוד הזה.
הצבת Astra מאחורי נקודת קצה אחת לצד Sol, Terra ו-Luna מאפשרת לך למדוד משימות שהושלמו לכל דולר בתעבורה שלך ולהחליף מודלים בלי חוזה נוסף או שינוי בקוד.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
