כרטיס כותרת שנוצר שכותרתו 'Step 5 Preview לעומת DeepSeek V4 Pro — מה שאפשר להוריד' עם שתי עמודות: Step 5 Preview ב-AA Index 44, 600B סה"כ / 27B פעילים, משקלים הובטחו ל-15 באוקטובר ומאגר שמכיל קובץ .gitattributes אחד; DeepSeek V4 Pro ב-AA Index 36, 1.6T סה"כ / 49B פעילים, משקלים MIT וניתנים להורדה כעת וצ'קפוינט מלא ב-Hugging Face. בתחתית כתוב 'שני נתוני המדד לפי Artificial Analysis Intelligence Index v4.3.2 במאמץ חשיבה מקסימלי.'
Guides & Insights

Step 5 Preview מול DeepSeek V4 Pro: האחד הוא הבטחה, האחר הוא רישיון MIT

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הכול בהשוואה הזו תלוי בשאלה שאין לה שום קשר לבנצ'מרקים: מה אתם באמת יכולים להוריד? DeepSeek V4 Pro — הגרסה שהספק שחרר בשם DeepSeek-V4-Pro-0813 ב-13 באוגוסט 2026 — היא מודל תערובת מומחים (mixture-of-experts) עם 1.6 טריליון פרמטרים תחת רישיון MIT, כשהמשקלים נמצאים כרגע ב-Hugging Face. Step 5 Preview, שאותו StepFun הכריזה עליו ב-20 בספטמבר 2026, הוא MoE דליל עם 600 מיליארד פרמטרים שמקבל שמונה נקודות יותר באותו לוח דירוג עצמאי, ובמאגר Hugging Face שלו יש בדיוק קובץ אחד, .gitattributes. StepFun אומרת שהצ'קפוינט BF16 מגיע ב-15 באוקטובר. אז הצורה הכנה של ההשוואה הזו היא לא "איזה מודל טוב יותר". היא "על איזה מהשניים האלה אפשר לבנות ברבעון הזה, ולאיזה מהם אתם מחכים".

המסגור הזה פחות מרגש מקרב בנצ'מרקים והרבה יותר שימושי, מפני שפער שמונה הנקודות וההמתנה של עשרים וחמישה ימים אינם אותו סוג של עובדה. את אחד מהם אפשר לקחת בחשבון בתכנון כבר היום.

שמונה נקודות, והארבע שחשובות

Artificial Analysis מריצה את שני המודלים דרך Intelligence Index v4.3.2 — עשר הערכות — וזהו המקום היחיד שבו נמדדו השניים הללו בידי אותו גורם.

• Intelligence Index — Step 5 Preview 44 לעומת DeepSeek V4 Pro 36

• דירוג בלוח הזה — Step 5 Preview במקום ה-24 מתוך 200 לעומת DeepSeek V4 Pro במקום ה-7 מתוך 113 בקטגוריה שלו

• Terminal-Bench 4.0 — Step 5 Preview 33.3%; DeepSeek V4 Pro אינו רשום באותו לוח, ולכן אין שורה אג'נטית ברת-השוואה לצטט

• מהירות פלט — Step 5 Preview 99.8 אסימונים/שנייה לעומת DeepSeek V4 Pro 88.8 אסימונים/שנייה

• זמן עד לטוקן הראשון — Step 5 Preview 2.96s לעומת DeepSeek V4 Pro 1.69s

• מחיר ל־1M טוקנים — Step 5 Preview ‏$1.00 קלט / ‏$2.70 פלט לעומת DeepSeek V4 Pro ‏$1.32 קלט / ‏$3.96 פלט בתעריף השיא של DeepSeek, כשהוא יורד בחצי ל־‏$0.66 / ‏$1.98 מחוץ לשעות השיא

• הנחת מטמון — Step 5 Preview ‎95% לעומת DeepSeek V4 Pro ‎97%

• הקשר — לשניהם 1M טוקנים; DeepSeek מפרסמת תקרת פלט של 384,000 טוקנים, ו-StepFun לא פרסמה כזו

• משקלים — Step 5 Preview נסגר, נקודת ביקורת BF16 מתוכננת ל-15 באוקטובר; DeepSeek V4 Pro MIT, זמין להורדה כעת

שתי שורות סותרות את הכותרת. DeepSeek V4 Pro משיב את הטוקן הראשון שלו תוך 1.69 שניות לעומת 2.96 של Step 5 Preview — יתרון התחלה של 43% בכל קריאה, אשר בלולאת סוכן ארוכה מצטבר לזמן שעון אמיתי. והנחת המטמון שלו טובה בשתי נקודות, מה שהכי חשוב בדיוק לעומס העבודה שלשמו נמכרים שני הדגמים האלה: סוכן ששולח מחדש בכל תור את אותה הנחיית מערכת ואת אותו הקשר מאגר חי כמעט כולו בתוך ההנחה הזו.

הפער המצטבר של שמונה נקודות הוא אמיתי, והוא גם צר מכפי ששמונה נקודות נשמעות. מדד הוא שילוב של עשר הערכות, וההרכב הוא המקום שבו שני המודלים נבדלים. 33.3% של Step 5 Preview ב-Terminal-Bench 4.0 הוא תוצאה סוכנית אמיתית; החוזק המוביל של DeepSeek V4 Pro עצמו הוא הסקה לטווח ארוך במחיר ששום דבר אחר בשכבת המשקלים הפתוחים אינו משתווה לו. אף לוח אינו מפרסם שורה שבה השניים מנוגדים זה לזה ישירות, וזו הסיבה הכנה לכך שאין להכריע את ההשוואה הזו במספר בודד.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second, cost per Intelligence Index task $0.71, verbosity 160M output tokens, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

מה "פתוח" נותן לך כשהספק משנה את דעתו

הנה החלק בהשוואה הזו שמפרט טכני לא יכול להעביר, וכדאי לציין אותו עם התאריכים המדויקים, כי זה קרה אחד עשר ימים לפני ההכרזה על Step 5 Preview.

DeepSeek הודיעה למשתמשים שהיא מפסיקה את V4 Pro. ב-9 בספטמבר החברה אמרה שהבקשות ינותבו אל DeepSeek V4.1 Flash החדש יותר; ב-10 בספטמבר היא קיבעה את המועד ל-12:00 לפי שעון בייג'ינג ב-14 בספטמבר. ב-11 בספטמבר היא חזרה בה — שירות ה-API של V4 Pro ממשיך גם אחרי 14 בספטמבר, החיוב ללא שינוי, במילותיה של DeepSeek. מחרוזת המודל, חלון ההקשר של 1M טוקנים ומגבלת 500 הבקשות במקביל — כולם עדיין כשהיו, ובדף Models & Pricing של DeepSeek ההיפוך מופיע כהערת שוליים על deepseek-v4-proהשורה של

ראו בזה הדגמה של הדבר שמשקלים פתוחים באמת מגנים עליכם מפניו, ושל הדבר שהם לא מגנים עליו. ה-API כמעט נלקח מכם בגלל החלטת תזמון. המשקלים לא יכלו להילקח. לצ׳קפוינט ברישיון MIT על החומרה שלכם אין ספק שיכול להכריז על פרישתו, וזו ערובה מסוג שונה מהבטחת מחיר — היא בכלל לא הבטחה.

וזה בדיוק הפער שבתוכו נמצא Step 5 Preview. ‏StepFun התחייבה ל-15 באוקטובר עבור צ'קפוינט ה-BF16, ושם המאגר שהיא כבר שמרה לעצמה — stepfun-ai/Step-5-Preview-BF16 — הוא הפורמט שממנו מכווננים ועושים קוונטיזציה, שנקרא בעת היצירה ומתמלא לאחר מכן. זהו אות תזמון, לא חפץ. עד שהמאגר יכיל משהו מלבד .gitattributes, ‏Step 5 Preview הוא מודל שאתה שוכר, בתנאים של ספק אחד, בלי רישיון לקרוא ובלי חלופה אם התנאים ישתנו.

שתי הדרכים להיות האופציה הזולה

שני המודלים האלה חותכים את החזית הסגורה בפער ניכר, והמנגנונים אינם זהים — וזה משנה עד כמה המחיר עמיד.

DeepSeek V4 Pro זול כי מעבדה פרסמה משקלים ושוק הגשה תחרותי סחט את השוליים החוצה. זהו רצפה מבנית: כל אחד יכול להגיש את נקודת הבדיקה, כך שהמחיר נקבע לפי עלות של שעת GPU ולא לפי אסטרטגיית התמחור של חברה כלשהי. ה-API של DeepSeek עצמו מתמחר אותו בשני חלונות — 1.32 דולר ו-3.96 דולר בשעות עומס, וחצי מכך מחוץ להן — והעומס צר, כמה שעות בבוקר בימי חול לפי UTC, כך שרוב התעבורה נופלת על התעריף הזול וסופי שבוע לעולם לא רואים את היקר.

Step 5 Preview זול כי StepFun החליטה לתמחר אותו כך. יש נקודת קצה אחת, רשימת מחירים אחת ואין מקור שני. זו לא האשמה — מודל דליל של 600B/27B באמת עולה פחות להריץ ממה שמספר הפרמטרים שלו מרמז, ויחס הפרמטרים המופעלים הוא הסיבה. זה פשוט סוג אחר של מחיר, וההבדל מתגלה ביום שבו StepFun תחליט שהתצוגה המקדימה מילאה את תפקידה.

הפער במחיר בין השניים קטן מספיק כדי שלא צריך להכריע שום דבר: $1.00 ו-$2.70 מול $1.32 ו-$3.96 הוא הבדל של 24% בקלט ו-32% בפלט, הרבה בתוך הטווח שהנחה עקב מטמון, הבדל באורך הפלט או שיעור ניסיונות חוזרים יכולים למחוק. בסוגיית האריכות השניים קרובים — Step 5 Preview יצר 160M אסימוני פלט בהרצת האינדקס מול חציון של 92M, וההרצה של DeepSeek V4 Pro עצמו נמצאת באותו טווח. אף אחד מהם אינו מודל חסכני, ושניהם נמכרים כבייצ'? לא, כזולים לכל אסימון ולא כזולים לכל משימה.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs DeepSeek V4 Pro — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, TTFT 2.96s, and weights due October 15. The right column gives DeepSeek V4 Pro the rows AA Index 36, parameters 1.6T total / 49B active, price $1.32 / $3.96, cache discount 97%, TTFT 1.69s, and weights MIT-licensed and downloadable now. A footer reads 'Both per Artificial Analysis Intelligence Index v4.3.2 at maximum reasoning effort.'

איפה כל אחד מהם שייך בסטאק אמיתי

אם אתם צריכים מודל שאפשר לכוונן, לכמת, לארח ב-VPC משלכם, או למסור לצוות משפטי עם קובץ רישיון שהם יכולים לקרוא, זו לא החלטה גבולית וזה לא קשור למדדי ביצועים. DeepSeek V4 Pro זמין תחת MIT היום. ל-Step 5 Preview אין רישיון, אין קונפיגורציה ואין קובץ פרמטרים, והמועד המוקדם ביותר שאפשר לתכנן לפיו הוא אמצע אוקטובר. פער של שמונה נקודות במדד לא משנה את החשבון הזה, כי מודל שלא ניתן להוריד לא ניתן לפרוס.

אם מה שאתם מחפשים הוא התוצאה הסוכנית החזקה ביותר שקיימת בדולר למיליון טוקני קלט, ‏Step 5 Preview מוביל בלוח היחיד שמדד את שניהם, והוא ברירת המחדל הטובה יותר לעבודת הניסוי והטעייה שממלאת את רובו של לולאת סוכן — חילוץ, סיווג, פיגומי בדיקות, הקריאות השגרתיות שבין השתיים שחשובות. ‏99.8 הטוקנים שלו לשנייה גם מסיימים פלט מהר יותר מ-88.8 של ‏DeepSeek V4 Pro, מה שמקצר את הלולאה עצמה ולא רק את החשבון.

המקרה המסובך הוא זה שרוב הצוותים נמצאים בו בפועל: אתם רוצים את המספר של Step 5 Preview, אבל אינכם יכולים להעלות על נתיב פרודקשן נקודת קצה של תצוגה מקדימה שנפתחה ביום ההשקה, בלי תקרת פלט מפורסמת. זו בעיית ניתוב, והיא זו שההשוואה הזו מסתיימת בה. אפשר להגיע אל DeepSeek V4 Pro דרך OrcaRouter במחיר של $0.66 ו-$1.98 למיליון טוקנים, המחצית שמחוץ לשעות העומס של מחירון DeepSeek של $1.32 ו-$3.96, ולצדם מודלי הטקסט שמסביב — מאחורי מפתח אחד ליותר מ-200 מודלים עם 0% תוספת מחיר, כך ששינוי מחירים של DeepSeek נוחת על החשבון שלכם באותו יום ולא בעת החידוש. כוונו את פרוסת התעבורה הניסיונית אל התצוגה המקדימה והשאירו את נתיב הפרודקשן על המודל שעומד מאחוריו רישיון, עם מעבר אוטומטי בין ספקים (failover) שעושה את העבודה שעקומת הקיבולת של נקודת קצה בתצוגה מקדימה מחייבת.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro at www.orcarouter.ai/models/deepseek/deepseek-v4-pro, showing the model id deepseek/deepseek-v4-pro, a 1M-token context and 384K max output, input pricing of $0.66 and output pricing of $1.98 per million tokens, a p50 time to first token of 4.01 seconds, 3,730M tokens of traffic over seven days, and the endpoints and SDK snippets behind the OrcaRouter API.

מה יפתור את זה?

שלושה דברים, וכל שלושתם ניתנים לבדיקה ולא לוויכוח.

הראשון הוא הרישיון. כשהצ׳קפוינט BF16 נוחת, מה המאגר אומר שעסק רשאי לעשות איתו? רישיון מתירני סוגר את רוב הפער הזה מעצמו, כי הוא הופך את היתרון של שמונה נקודות למשהו שאפשר להחזיק בבעלות ולא לשכור. רישיון מגביל מותיר את DeepSeek V4 Pro כמודל היחיד בזוג שעליו אפשר באמת לבנות מוצר.

השנייה היא תקרת הפלט. DeepSeek מפרסמת 384,000 טוקנים. ההודעה של StepFun אומרת הקשר של 1M ואינה מזכירה תקרת פלט, ותצורה חיצונית נפרדת שהופצה במהלך ההדלפה פירטה הקשר של 350,000 עם מקסימום פלט של 64,000. עבור עבודת סוכנים לטווח ארוך, שעבורה נמכרים שני המודלים, המספר הזה אינו הערת שוליים.

השלישי הוא האם המחיר מחזיק מעמד לאחר שהסיומת 'Preview' יורדת. מחיר תצוגה מקדימה הוא נתון לרכישת לקוחות; מחיר של גרסה משוחררת הוא מודל עסקי. רצפת המחיר של DeepSeek V4 Pro נקבעת על ידי שוק שירות תחרותי ואינה יכולה לזוז הרבה. הרצפה של Step 5 Preview יכולה לזוז ביום שלישי.

עד שתיינתנה תשובות לשתי השאלות הראשונות, הקריאה המעשית היא ש-DeepSeek V4 Pro הוא המודל שתפרוס ו-Step 5 Preview הוא המודל שמולו תבצע השוואת ביצועים — עם הסתייגות שנקודת קצה של תצוגה מקדימה בת ימים ספורים, שנמצאת שמונה נקודות מעל מודל דגל בוגר ברישיון MIT, היא תוצאה אמיתית, והסיבה ש-15 באוקטובר שווה רשומה ביומן ולא משיכת כתפיים.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית