
Step 5 Preview מול DeepSeek V4 Pro: האחד הוא הבטחה, האחר הוא רישיון MIT
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
הכול בהשוואה הזו תלוי בשאלה שאין לה שום קשר לבנצ'מרקים: מה אתם באמת יכולים להוריד? DeepSeek V4 Pro — הגרסה שהספק שחרר בשם DeepSeek-V4-Pro-0813 ב-13 באוגוסט 2026 — היא מודל תערובת מומחים (mixture-of-experts) עם 1.6 טריליון פרמטרים תחת רישיון MIT, כשהמשקלים נמצאים כרגע ב-Hugging Face. Step 5 Preview, שאותו StepFun הכריזה עליו ב-20 בספטמבר 2026, הוא MoE דליל עם 600 מיליארד פרמטרים שמקבל שמונה נקודות יותר באותו לוח דירוג עצמאי, ובמאגר Hugging Face שלו יש בדיוק קובץ אחד, .gitattributes. StepFun אומרת שהצ'קפוינט BF16 מגיע ב-15 באוקטובר. אז הצורה הכנה של ההשוואה הזו היא לא "איזה מודל טוב יותר". היא "על איזה מהשניים האלה אפשר לבנות ברבעון הזה, ולאיזה מהם אתם מחכים".
המסגור הזה פחות מרגש מקרב בנצ'מרקים והרבה יותר שימושי, מפני שפער שמונה הנקודות וההמתנה של עשרים וחמישה ימים אינם אותו סוג של עובדה. את אחד מהם אפשר לקחת בחשבון בתכנון כבר היום.
שמונה נקודות, והארבע שחשובות
Artificial Analysis מריצה את שני המודלים דרך Intelligence Index v4.3.2 — עשר הערכות — וזהו המקום היחיד שבו נמדדו השניים הללו בידי אותו גורם.
• Intelligence Index — Step 5 Preview 44 לעומת DeepSeek V4 Pro 36
• דירוג בלוח הזה — Step 5 Preview במקום ה-24 מתוך 200 לעומת DeepSeek V4 Pro במקום ה-7 מתוך 113 בקטגוריה שלו
• Terminal-Bench 4.0 — Step 5 Preview 33.3%; DeepSeek V4 Pro אינו רשום באותו לוח, ולכן אין שורה אג'נטית ברת-השוואה לצטט
• מהירות פלט — Step 5 Preview 99.8 אסימונים/שנייה לעומת DeepSeek V4 Pro 88.8 אסימונים/שנייה
• זמן עד לטוקן הראשון — Step 5 Preview 2.96s לעומת DeepSeek V4 Pro 1.69s
• מחיר ל־1M טוקנים — Step 5 Preview $1.00 קלט / $2.70 פלט לעומת DeepSeek V4 Pro $1.32 קלט / $3.96 פלט בתעריף השיא של DeepSeek, כשהוא יורד בחצי ל־$0.66 / $1.98 מחוץ לשעות השיא
• הנחת מטמון — Step 5 Preview 95% לעומת DeepSeek V4 Pro 97%
• הקשר — לשניהם 1M טוקנים; DeepSeek מפרסמת תקרת פלט של 384,000 טוקנים, ו-StepFun לא פרסמה כזו
• משקלים — Step 5 Preview נסגר, נקודת ביקורת BF16 מתוכננת ל-15 באוקטובר; DeepSeek V4 Pro MIT, זמין להורדה כעת
שתי שורות סותרות את הכותרת. DeepSeek V4 Pro משיב את הטוקן הראשון שלו תוך 1.69 שניות לעומת 2.96 של Step 5 Preview — יתרון התחלה של 43% בכל קריאה, אשר בלולאת סוכן ארוכה מצטבר לזמן שעון אמיתי. והנחת המטמון שלו טובה בשתי נקודות, מה שהכי חשוב בדיוק לעומס העבודה שלשמו נמכרים שני הדגמים האלה: סוכן ששולח מחדש בכל תור את אותה הנחיית מערכת ואת אותו הקשר מאגר חי כמעט כולו בתוך ההנחה הזו.
הפער המצטבר של שמונה נקודות הוא אמיתי, והוא גם צר מכפי ששמונה נקודות נשמעות. מדד הוא שילוב של עשר הערכות, וההרכב הוא המקום שבו שני המודלים נבדלים. 33.3% של Step 5 Preview ב-Terminal-Bench 4.0 הוא תוצאה סוכנית אמיתית; החוזק המוביל של DeepSeek V4 Pro עצמו הוא הסקה לטווח ארוך במחיר ששום דבר אחר בשכבת המשקלים הפתוחים אינו משתווה לו. אף לוח אינו מפרסם שורה שבה השניים מנוגדים זה לזה ישירות, וזו הסיבה הכנה לכך שאין להכריע את ההשוואה הזו במספר בודד.

מה "פתוח" נותן לך כשהספק משנה את דעתו
הנה החלק בהשוואה הזו שמפרט טכני לא יכול להעביר, וכדאי לציין אותו עם התאריכים המדויקים, כי זה קרה אחד עשר ימים לפני ההכרזה על Step 5 Preview.
DeepSeek הודיעה למשתמשים שהיא מפסיקה את V4 Pro. ב-9 בספטמבר החברה אמרה שהבקשות ינותבו אל DeepSeek V4.1 Flash החדש יותר; ב-10 בספטמבר היא קיבעה את המועד ל-12:00 לפי שעון בייג'ינג ב-14 בספטמבר. ב-11 בספטמבר היא חזרה בה — שירות ה-API של V4 Pro ממשיך גם אחרי 14 בספטמבר, החיוב ללא שינוי, במילותיה של DeepSeek. מחרוזת המודל, חלון ההקשר של 1M טוקנים ומגבלת 500 הבקשות במקביל — כולם עדיין כשהיו, ובדף Models & Pricing של DeepSeek ההיפוך מופיע כהערת שוליים על deepseek-v4-proהשורה של
ראו בזה הדגמה של הדבר שמשקלים פתוחים באמת מגנים עליכם מפניו, ושל הדבר שהם לא מגנים עליו. ה-API כמעט נלקח מכם בגלל החלטת תזמון. המשקלים לא יכלו להילקח. לצ׳קפוינט ברישיון MIT על החומרה שלכם אין ספק שיכול להכריז על פרישתו, וזו ערובה מסוג שונה מהבטחת מחיר — היא בכלל לא הבטחה.
וזה בדיוק הפער שבתוכו נמצא Step 5 Preview. StepFun התחייבה ל-15 באוקטובר עבור צ'קפוינט ה-BF16, ושם המאגר שהיא כבר שמרה לעצמה — stepfun-ai/Step-5-Preview-BF16 — הוא הפורמט שממנו מכווננים ועושים קוונטיזציה, שנקרא בעת היצירה ומתמלא לאחר מכן. זהו אות תזמון, לא חפץ. עד שהמאגר יכיל משהו מלבד .gitattributes, Step 5 Preview הוא מודל שאתה שוכר, בתנאים של ספק אחד, בלי רישיון לקרוא ובלי חלופה אם התנאים ישתנו.
שתי הדרכים להיות האופציה הזולה
שני המודלים האלה חותכים את החזית הסגורה בפער ניכר, והמנגנונים אינם זהים — וזה משנה עד כמה המחיר עמיד.
DeepSeek V4 Pro זול כי מעבדה פרסמה משקלים ושוק הגשה תחרותי סחט את השוליים החוצה. זהו רצפה מבנית: כל אחד יכול להגיש את נקודת הבדיקה, כך שהמחיר נקבע לפי עלות של שעת GPU ולא לפי אסטרטגיית התמחור של חברה כלשהי. ה-API של DeepSeek עצמו מתמחר אותו בשני חלונות — 1.32 דולר ו-3.96 דולר בשעות עומס, וחצי מכך מחוץ להן — והעומס צר, כמה שעות בבוקר בימי חול לפי UTC, כך שרוב התעבורה נופלת על התעריף הזול וסופי שבוע לעולם לא רואים את היקר.
Step 5 Preview זול כי StepFun החליטה לתמחר אותו כך. יש נקודת קצה אחת, רשימת מחירים אחת ואין מקור שני. זו לא האשמה — מודל דליל של 600B/27B באמת עולה פחות להריץ ממה שמספר הפרמטרים שלו מרמז, ויחס הפרמטרים המופעלים הוא הסיבה. זה פשוט סוג אחר של מחיר, וההבדל מתגלה ביום שבו StepFun תחליט שהתצוגה המקדימה מילאה את תפקידה.
הפער במחיר בין השניים קטן מספיק כדי שלא צריך להכריע שום דבר: $1.00 ו-$2.70 מול $1.32 ו-$3.96 הוא הבדל של 24% בקלט ו-32% בפלט, הרבה בתוך הטווח שהנחה עקב מטמון, הבדל באורך הפלט או שיעור ניסיונות חוזרים יכולים למחוק. בסוגיית האריכות השניים קרובים — Step 5 Preview יצר 160M אסימוני פלט בהרצת האינדקס מול חציון של 92M, וההרצה של DeepSeek V4 Pro עצמו נמצאת באותו טווח. אף אחד מהם אינו מודל חסכני, ושניהם נמכרים כבייצ'? לא, כזולים לכל אסימון ולא כזולים לכל משימה.

איפה כל אחד מהם שייך בסטאק אמיתי
אם אתם צריכים מודל שאפשר לכוונן, לכמת, לארח ב-VPC משלכם, או למסור לצוות משפטי עם קובץ רישיון שהם יכולים לקרוא, זו לא החלטה גבולית וזה לא קשור למדדי ביצועים. DeepSeek V4 Pro זמין תחת MIT היום. ל-Step 5 Preview אין רישיון, אין קונפיגורציה ואין קובץ פרמטרים, והמועד המוקדם ביותר שאפשר לתכנן לפיו הוא אמצע אוקטובר. פער של שמונה נקודות במדד לא משנה את החשבון הזה, כי מודל שלא ניתן להוריד לא ניתן לפרוס.
אם מה שאתם מחפשים הוא התוצאה הסוכנית החזקה ביותר שקיימת בדולר למיליון טוקני קלט, Step 5 Preview מוביל בלוח היחיד שמדד את שניהם, והוא ברירת המחדל הטובה יותר לעבודת הניסוי והטעייה שממלאת את רובו של לולאת סוכן — חילוץ, סיווג, פיגומי בדיקות, הקריאות השגרתיות שבין השתיים שחשובות. 99.8 הטוקנים שלו לשנייה גם מסיימים פלט מהר יותר מ-88.8 של DeepSeek V4 Pro, מה שמקצר את הלולאה עצמה ולא רק את החשבון.
המקרה המסובך הוא זה שרוב הצוותים נמצאים בו בפועל: אתם רוצים את המספר של Step 5 Preview, אבל אינכם יכולים להעלות על נתיב פרודקשן נקודת קצה של תצוגה מקדימה שנפתחה ביום ההשקה, בלי תקרת פלט מפורסמת. זו בעיית ניתוב, והיא זו שההשוואה הזו מסתיימת בה. אפשר להגיע אל DeepSeek V4 Pro דרך OrcaRouter במחיר של $0.66 ו-$1.98 למיליון טוקנים, המחצית שמחוץ לשעות העומס של מחירון DeepSeek של $1.32 ו-$3.96, ולצדם מודלי הטקסט שמסביב — מאחורי מפתח אחד ליותר מ-200 מודלים עם 0% תוספת מחיר, כך ששינוי מחירים של DeepSeek נוחת על החשבון שלכם באותו יום ולא בעת החידוש. כוונו את פרוסת התעבורה הניסיונית אל התצוגה המקדימה והשאירו את נתיב הפרודקשן על המודל שעומד מאחוריו רישיון, עם מעבר אוטומטי בין ספקים (failover) שעושה את העבודה שעקומת הקיבולת של נקודת קצה בתצוגה מקדימה מחייבת.

מה יפתור את זה?
שלושה דברים, וכל שלושתם ניתנים לבדיקה ולא לוויכוח.
הראשון הוא הרישיון. כשהצ׳קפוינט BF16 נוחת, מה המאגר אומר שעסק רשאי לעשות איתו? רישיון מתירני סוגר את רוב הפער הזה מעצמו, כי הוא הופך את היתרון של שמונה נקודות למשהו שאפשר להחזיק בבעלות ולא לשכור. רישיון מגביל מותיר את DeepSeek V4 Pro כמודל היחיד בזוג שעליו אפשר באמת לבנות מוצר.
השנייה היא תקרת הפלט. DeepSeek מפרסמת 384,000 טוקנים. ההודעה של StepFun אומרת הקשר של 1M ואינה מזכירה תקרת פלט, ותצורה חיצונית נפרדת שהופצה במהלך ההדלפה פירטה הקשר של 350,000 עם מקסימום פלט של 64,000. עבור עבודת סוכנים לטווח ארוך, שעבורה נמכרים שני המודלים, המספר הזה אינו הערת שוליים.
השלישי הוא האם המחיר מחזיק מעמד לאחר שהסיומת 'Preview' יורדת. מחיר תצוגה מקדימה הוא נתון לרכישת לקוחות; מחיר של גרסה משוחררת הוא מודל עסקי. רצפת המחיר של DeepSeek V4 Pro נקבעת על ידי שוק שירות תחרותי ואינה יכולה לזוז הרבה. הרצפה של Step 5 Preview יכולה לזוז ביום שלישי.
עד שתיינתנה תשובות לשתי השאלות הראשונות, הקריאה המעשית היא ש-DeepSeek V4 Pro הוא המודל שתפרוס ו-Step 5 Preview הוא המודל שמולו תבצע השוואת ביצועים — עם הסתייגות שנקודת קצה של תצוגה מקדימה בת ימים ספורים, שנמצאת שמונה נקודות מעל מודל דגל בוגר ברישיון MIT, היא תוצאה אמיתית, והסיבה ש-15 באוקטובר שווה רשומה ביומן ולא משיכת כתפיים.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
