כרטיס כותרת שנוצר בכותרת 'Step 5 Preview vs GPT-6 Astra — פי עשרה מהמחיר' עם שתי עמודות: Step 5 Preview ב-AA Index 44, 600B סה"כ / 27B פעיל, מחיר $1.00 / $2.70, משולב $0.51 ו-99.8 טוקנים/שנייה; GPT-6 Astra ב-AA Index 53, מחיר $10.00 / $50.00, משולב $7.70 ו-59.3 טוקנים/שנייה. בתחתית כתוב 'שני הנתונים לפי Artificial Analysis Intelligence Index; התמחור של Astra עולה ל-$20 / $75 מעל 272K טוקני קלט.'
Guides & Insights

Step 5 Preview לעומת GPT-6 Astra: פי עשרה ממחיר הקלט עבור תשע נקודות מדד

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שני המודלים האלה הוכרזו בהפרש של שבעה־עשר יום ותומחרו לכוכבי לכת שונים. Step 5 Preview, המודל הדליל מסוג mixture-of-experts עם 600 מיליארד פרמטרים של StepFun, שהוכרז ב־20 בספטמבר 2026, גובה 1.00 דולר למיליון טוקני קלט ו־2.70 דולר למיליון טוקני פלט. GPT-6 Astra, דגל החברה שיצא ב־3 בספטמבר 2026, גובה 10.00 ו־50.00 דולר עבור אותן יחידות מתחת לסף קלט של 272 אלף טוקנים — ו־20.00 ו־75.00 דולר מעליו. זה פי עשרה ממחיר הקלט ובערך פי שמונה־עשרה ממחיר הפלט, עבור מודל שמקבל ציון גבוה בתשע נקודות ב־Intelligence Index העצמאי, 53 לעומת 44. השאלה אם Astra טובה יותר כלל אינה עומדת לדיון. השאלה היא אם הפער הזה שווה שלושים דולר נוספים למיליון טוקני פלט בעומס העבודה שלכם, והתשובה משתנה פעמיים לאורך הכתבה הזו.

מה נועד כל דגם

Step 5 Preview בנוי ונמכר לעבודה סוכנית: קידוד ב-AI, הנדסת תוכנה, עבודת ידע מקצועית, פיננסים. הארכיטקטורה מכווננת לכך — 600B פרמטרים בסך הכל עם כ-27B פעילים לכל טוקן, הקשר של 1M טוקנים, קלט טקסט ותמונה, והסקה עם חשיבה מורחבת. StepFun דילגה על כל סדרת Step 4.x כדי להגיע לכאן, ועברה ישירות מ-Step-3.7-Flash ל-Step 5.

GPT-6 Astra הוא מודל הדגל הרב-תכליתי של OpenAI: חלון הקשר של מיליון טוקנים, עד 128 אלף טוקני פלט, קלט בטקסט, בתמונות ובקבצים, פלט בטקסט, חיתוך ידע לתאריך 30 באפריל 2026, ותמיכה בהיסק, בתכנות ובזרימות עבודה סוכניות. זהו המודל שארגונים פונים אליו כשהתשובה חייבת להיות נכונה, וחשבון הטוקנים אינו האילוץ המגביל.

• Intelligence Index — Step 5 Preview 44 מול GPT-6 Astra 53

• פרמטרים — Step 5 Preview: 600B סה״כ / 27B פעילים לעומת GPT-6 Astra שלא נחשפו

• הקשר ותקרת הפלט — לשניהם הקשר של 1M טוקנים; Astra מציינת חלון של 1,050,000 טוקנים ותקרת פלט של 128K, בעוד StepFun לא פרסמה תקרת פלט

• אופן קלט — טקסט ותמונות לעומת טקסט, תמונות וקבצים

• מהירות פלט — Step 5 Preview 99.8 טוקנים לשנייה לעומת GPT-6 Astra 59.3 טוקנים לשנייה

• מחיר ל-1M טוקנים — $1.00 קלט / $2.70 פלט לעומת $10.00 קלט / $50.00 פלט כשהקלט מתחת ל-272K, ועולה ל-$20.00 / $75.00 מעל לכך

• מטמון — Step 5 Preview עם הנחה של 95% לעומת GPT-6 Astra עם הנחת קריאה של 90% עם תעריף כתיבה למטמון של $12.50 למיליון

• עלות לכל משימת Intelligence Index — Step 5 Preview $0.71 לעומת GPT-6 Astra $3.26

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GPT-6 Astra — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71 and output speed 99.8 tokens/sec. The right column gives GPT-6 Astra the rows AA Index 53, parameters undisclosed, price $10.00 / $50.00, cache discount 90%, cost per index task $3.26 and output speed 59.3 tokens/sec. A footer reads 'Both figures per Artificial Analysis Intelligence Index; Astra pricing rises to $20 / $75 above 272K input tokens.'

החשבונית, שורה אחר שורה

התמחור של Step 5 Preview אחיד וזול: $1.00 בקלט, $2.70 בפלט, עם הנחת מטמון של 95% שמביאה קלט שמור במטמון לכמעט $0.05 למיליון טוקנים. בתמהיל של 7:2:1 של פגיעות מטמון, קלט ופלט — המוסכמה שהבלוג הזה משתמש בה לתעבורת סוכנים — התעריף המשולב מגיע לכמעט $0.51 למיליון טוקנים, והעלות לכל משימה של Intelligence Index מסתכמת ב-$0.71, מקום 27 מתוך 200. ההסתייגות היא מילוליות יתר: המודל הפיק 160 מיליון טוקני פלט באותו Index לעומת חציון של 92 מיליון, כך שספירות הטוקנים הגולמיות גבוהות ממה שהמחיר הנקוב מרמז.

התמחור של GPT-6 Astra הוא מדורג, והמדרגה היא החלק ששווה לקרוא מקרוב. מתחת ל-272K אסימוני קלט לבקשה זה $10.00 ו-$50.00; מעל זה, $20.00 ו-$75.00. המדרגה נבחרת לפי מספר אסימוני הקלט של כל בקשה בעצמה, וזה חשוב יותר ממה שזה נשמע עבור מודל שנמכר על הקשר של 1M אסימונים — קריאה אחת עם הקשר גדול חוצה את הקו ומכפילה את התעריף עבור כל הבקשה. קריאות מטמון הן $1.00 למיליון, הנחה של 90%, וכתיבות מטמון הן $12.50 למיליון. באותה תערובת 7:2:1 התעריף המשוקלל מגיע לסמוך ל-$7.70 למיליון אסימונים, והעלות למשימת Index היא $3.26, במקום ה-71 מתוך 200.

Astra חותכת לכיוון ההפוך בכל הנוגע למילוליות, והיא המודל התמציתי כאן: 60 מיליון אסימוני פלט ב-Index לעומת 160 מיליון של Step 5 Preview, מקום 27 מתוך 200 במדד הזה. פחות אסימונים בקצב גבוה יותר מצמצם את הפער באופן שהמכפיל הגולמי מגזים בו. זה לא סוגר אותו — נתון העלות למשימה כבר מנטרל יחד מילוליות, התנהגות מטמון ותמחור, ו-$3.26 לעומת $0.71 הוא עדיין פער של פי 4.6.

מה קונות תשע נקודות המדד

המספרים המובילים של Astra הם של OpenAI עצמה ולא שוחזרו: 96.1 ב-GPQA Diamond, 72.6% ב-OSWorld 2.0, 97.6% ב-FrontierMath Tier 4, 57.2% ב-Humanity's Last Exam עם כלים, וכ-57.9% ב-Terminal-Bench 4.0. הנתון של ARC-AGI-3 הוא זה שצריך להתייחס אליו בזהירות — OpenAI מדווחת על 99.9% תחת הרנס ה-provider-adapter שלה ועל 62.7% בהרנס הסטנדרטי, ופער של 37 נקודות בין הרנסים אומר משהו על ההרנס לפחות באותה מידה כמו על המודל.

המספרים המפורסמים של Step 5 Preview נמצאים באותו תחום במשימות הסוכניות שעבורן הוא נבנה, ומלווים באותה הסתייגות: 33.3% ב-Terminal-Bench 4.0, 80.5 ב-ProgramBench, 67.7 ב-DeepSWE v1.1 ו-49.0 ב-StepCodeBench, כולם מ-StepFun ואף אחד מהם לא שוחזר באופן עצמאי. ספקים שונים, מערכי בדיקה שונים, אין הרצה משותפת — וזו בדיוק הסיבה לכך שהפער בן תשע הנקודות שנמדד באופן עצמאי הוא המספר השימושי יותר מכל אחד מאלה.

הפער הזה אמיתי והוא לא קטן. בלוח של 200 מודלים, 53 ו-44 נמצאים במקום השלישי והעשרים וארבעה, וההבדל מתבטא כסוג אחר של משימה ולא כציון שונה באותה משימה: הניצחונות שפורסמו של Astra מתרכזים בהסקה לטווח ארוך ובשימוש במחשב, וזה המקום שבו ראש הטבלה מתנתק. אם עומס העבודה שלך נמצא שם, תשע הנקודות שוות יותר מהחשבונית.

הסתייגות אחת לגבי הציון של Astra. Artificial Analysis מעדכנת את מדד האינטליגנציה, והנתונים לאותו מודל משתנים בין תמונות מצב שנלקחו בהפרש של שבועות זה מזה — 52.8, 53 ו-54.7 מופיעים כולם בחומר שפורסם על המודל הזה במהלך אותו חודש. ה-53 בעמוד המודל הנוכחי הוא המספר שיש להשתמש בו, וכל השוואה שמציבה תמונת מצב ישנה של Astra לצד נתון נוכחי של Step 5 Preview מודדת בשני סרגלים שונים.

Screenshot of the Artificial Analysis model page for GPT-6 Astra, showing OpenAI as the creator with a September 2026 release date, an Intelligence Index of 53 at rank 3 of 200, output speed 59.3 tokens per second at rank 101 of 200, cost per Intelligence Index task $3.26 at rank 71 of 200, verbosity 60M output tokens at rank 27 of 200, pricing of $10.00 per million input tokens and $50.00 per million output tokens with a 90% cache discount, and technical specifications listing reasoning, text and image input, a 1M-token context window and an April 30, 2026 knowledge cutoff.

מהירות ולטנטיות הן שתי שאלות שונות

בכל הנוגע למהירות היצירה, הלוח העצמאי אינו משתמע לשתי פנים: 99.8 אסימוני פלט לשנייה עבור Step 5 Preview לעומת 59.3 עבור GPT-6 Astra, שהוא גם איטי יותר מהממוצע של 70 אסימונים לשנייה בקרב המודלים שנמדדו. בלולאת קידוד אינטראקטיבית זהו ההבדל בין הצעה להפוגה, והוא מצטבר לאורך סשן כפי שמצטברת הנחת מטמון.

השהיה היא הסיפור המסובך יותר, ומספר בודד מטעה לגביה. ‏Astra מנתבת את תהליך החשיבה לפני שהיא פולטת פלט, ולכן הזמן עד לאסימון הראשון והזמן עד לתשובה שאפשר להשתמש בה אינם אותה מדידה, והנתונים המפורסמים לגביה משתנים מאוד בהתאם לשאלה אם החשיבה נספרת. בתעבורה שלנו בשבעת הימים האחרונים, חציון הזמן עד לאסימון הראשון של ‏GPT-6 Astra הוא 6.72 שניות, עם אחוזון 95 של 10.00 שניות — המספר שמי שמתקשר חווה בפועל דרך נקודת הקצה שלנו. ‏Artificial Analysis מציבה את הזמן עד לאסימון הראשון של ‏Step 5 Preview על 2.96 שניות בהרנס משלה, ושני הנתונים הללו אינם נמדדים באותה שיטה, ולכן אין להחסיר אותם זה מזה.

היכן שאי־הסימטריה של המטמון למעשה נוחתת

שני המודלים מעניקים הנחה ניכרת על תחיליות חוזרות ושניהם גובים עבור כתיבתן, וההבדל ביניהם הוא פי 20 בקריאה. הנחת המטמון של 95% של Step 5 Preview מעמידה את הקלט השמור במטמון על קרוב ל-$0.05 למיליון טוקנים. GPT-6 Astra קוראת מטמון ב-$1.00 למיליון — הנחה של 90% מתעריף בסיס גבוה פי עשרה — וכותבת אותו ב-$12.50 למיליון.

בלולאת סוכן ששולחת מחדש את אותה הנחיית מערכת והקשר מאגר בכל תור, תעריף הקריאה הוא זה שמצטבר, וההנחה הגדולה יותר על המודל הזול שווה יותר מההנחה הקטנה יותר על המודל היקר. התערובת של Astra עדיין מסתכמת בקרוב ל-$7.70 למיליון טוקנים לעומת $0.51 של Step 5 Preview באותה תערובת 7:2:1 — הבדל של פי חמישה עשר שסשן ארוך לא מצמצם אלא מרחיב.

הרצת שניהם ממפתח אחד

GPT-6 Astra זמין כעת ב-OrcaRouter תחת openai/gpt-6-astra לפי תעריפי המחירון של OpenAI — 10.00$ ו-50.00$ למיליון מתחת לסף 272K, ו-20.00$ ו-75.00$ מעליו — ומועברים הלאה ללא כל תוספת, כך ששינוי מחיר של הספק נכנס לתוקף אצלנו באותו היום ולא במחזור החיוב הבא. הטלמטריה שלנו בת שבעת הימים על נקודת הקצה הזו מראה חציון של 6.72 שניות וזמן של 10.00 שניות עד לאסימון הראשון באחוזון ה-95, כמצוטט לעיל, לצד 277.9 מיליון אסימונים של תעבורה דרכה בשבוע האחרון.

Step 5 Preview אינו בקטלוג שלנו ואנחנו לא מנתבים אותו. הוא פועל ב-API וב-Studio של StepFun עצמה, וזה המקום היחיד שבו הוא פועל עד שהצ'קפוינט של 15 באוקטובר נוחת. האסימטריה הזו אינה פגם בהשוואה; היא ההשוואה. החצי הזול של העימות הזה הוא החצי שאתה צריך ללכת למקום אחר כדי לקרוא לו, והחצי שאתה יכול להכניס לייצור היום נמצא מאחורי API אחד עבור יותר מ-200 מודלים: GPT-6 Astra במחירים שלמעלה, GLM-5.3 ב-$1.26 ו-$3.96, DeepSeek V4 Pro, Claude Opus 5 והשאר, עם מעבר אוטומטי בין ספקים ששומר על נתיב יציב כאשר הקיבולת של ספק משתנה, וה-DSL לניתוב שמאפשר למשימה להתחיל בזול ולהסלים רק כשצריך. כלל ההסלמה הזה הוא התשובה האמיתית לפער מחירים של פי עשרה: רוב עומס העבודה לא צריך את ראש לוח המובילים, ושכבת ניתוב היא הדרך להפסיק לשלם על החלק שלא צריך.

Screenshot of the OrcaRouter model page for GPT-6 Astra at www.orcarouter.ai/models/openai/gpt-6-astra, showing the model id openai/gpt-6-astra with NEW, FLAGSHIP and FEATURED badges, a 1M-token context and 128K max output, text, image and file input with text output, best-for tags for reasoning, coding and agentic work, input pricing of $10.00 and output pricing of $50.00 per million tokens, a seven-day median time to first token of 6.72 seconds and a 95th percentile of 10.00 seconds, 277.9M tokens of seven-day traffic, and the chat-completions and responses endpoints behind the OrcaRouter API.

מי צריך לבחור איזה

אם עומס העבודה שלך הוא סוכן ארוך-טווח שחייב לבצע נכון משימה קשה — שימוש במחשב, מחקר רב-שלבי, עבודה שבה תשובה שגויה עולה יותר מהטוקנים — היתרון של תשע נקודות של GPT-6 Astra הוא החלק הזול ביותר בהחלטה, והחשבונית היא המחיר שהיכולת גובה. הרץ אותו כיעד ההסלמה, לא כברירת המחדל, ושיים לב לסף 272K: בקשה בודדת גדולה מדי מכפילה את התעריף עבור כל מה שבה.

אם עומס העבודה שלך הוא טקסט סוכני בנפח גבוה — יצירת קוד, ריפקטורים, חילוץ מובנה, הלולאה הפנימית של עוזר קידוד — Step 5 Preview מוביל בכל מה שלחשבונית ולשעון אכפת ממנו, ותשע נקודות מדד לא סביר שישרדו מפגש עם התפלגות משימות שאינה יושבת בראש לוח הדירוג. המלכוד אינו בביצועים: המודל קנייני, בלי רישיון מפורסם, בלי היתר לשימוש מסחרי ובלי צ'קפוינט עד 15 באוקטובר. אפשר לקרוא לו; אי אפשר להחזיק בו, לכוונן אותו או להפיץ נגזרת שלו.

אם התשובה אינה מובנת מאליה, התבנית היא פיצול דרגות ולא בחירה. נווט תעבורה כללית למודל בדרגה בינונית ושמור את Astra לבקשות שזקוקות לראש הטבלה — שני הקצוות של כלל זה נמצאים מאחורי מפתח אחד בצד שלנו, כך שהפיצול עולה כלל ניתוב ולא חוזה שני. תשלום תעריפי דגל עבור עבודה שמודל בדרגה בינונית מסיים נכון הוא הטעות שההשוואה הזו בעצם עוסקת בה.