
תאריך השקת DeepSeek V4 Pro: כבר פי 14 יותר זול מ-Kimi K3, עדיין לא חכם באותה מידה
- metaחדשMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekחדשDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxחדשMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים · 2110 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
- tencentTencent: Hy32026-07-0642אינטליגנציה59כתיבת קוד
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232אינטליגנציה42כתיבת קוד
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226אינטליגנציה39כתיבת קוד
- anthropicAnthropic: Claude Sonnet 52026-06-3055אינטליגנציה72כתיבת קוד
- klingKling: Kling 3.0 Turbo2026-06-1757אינטליגנציה52כתיבת קוד57מתמטיקה
ב-31 ביולי 2026 פרסמה החברה ערך ביומן השינויים, שבו הודיעה שהמודל הזול שלה ניצח את המודל היקר שלה. הערך עסק בDeepSeek V4 Flash, שכבת היעילות עם 284B פרמטרים, והטענה המרכזית הייתה "יכולות סוכן משופרות משמעותית, עם תוצאות מבחני השוואה שעולות בהרבה על V4-Pro-Preview." V4-Pro-Preview הוא DeepSeek V4 Pro — מודל הדגל עם 1.6 טריליון פרמטרים, זה שעולה פי שלושה יותר לכל טוקן. אותו ערך הסתיים במשפט אחד על כך: "השחרור הרשמי של DeepSeek-V4-Pro יגיע בקרוב." זהו ההקשר לתחזית שמסתובבת כעת, שלפיה כשהמודל האמיתי V4 Pro ינחת הוא יהיה ברמה של Kimi K3 אבל זול פי עשרה. מחצית מהתחזית כבר מדידה, והיא שגויה בכיוון שכמעט אף אחד לא מצפה לו.
הערה על מה שהמאמר הזה הוא ומה אינו. אין כאן כרטיס מערכת מודלף, אין אמת מידה פנימית, אין תאריך. התחזית שמסתובבת מגיעה מ‑@scaling01 ב‑X — "DeepSeek-V4 Pro יהיה להיט, כנראה גם ברמה של Kimi-K3 אבל זול פי 10" — והיא תחזית של איש מקצוע עם עוקבים רבים, לא חשיפה של מישהו שיש לו גישה. מי שמתייחס אליה כהדלפה – כך נכתב סיקור גרוע של תאריכי השקה. מה שאנחנו יכולים לעשות במקום זה הוא לקחת את שני החצאים הניתנים לבדיקה של הטענה ולבדוק אותם מול מספרים שכבר קיימים, כי ניתן לקרוא לגרסת התצוגה המקדימה כבר שלושה חודשים, וגם היא וגם Kimi K3 הופעלו על ידי מעבדה עצמאית. כל מה שלהלן מסומן לפי מקור: התיעוד של החברה עצמה, המדידות של Artificial Analysis, או חשבון שעשינו בעצמנו ואנחנו מציגים.
מה ש-DeepSeek באמת אמר, ומה שלא
ההיקף המאושר גדול יותר מכפי שמסגור "המודל שלא שוחרר" מרמז. V4 Pro אינו מוצר וירטואלי — אפשר לקרוא לו כבר עכשיו. מה שלא קרה הוא השחרור שהחברה עצמה מחשיבה לרשמי.
• ארכיטקטורה — מודל תערובת מומחים עם 1.6T פרמטרים בסך הכל ו-49B פעילים לכל טוקן, אושר על ידי החברה ומופיע באופן זהה ב-Artificial Analysis כ-1600B/49B.
• הקשר ופלט — חלון קלט של 1M אסימונים (1,048,576) עם עד 384K אסימוני פלט. קלט טקסט, פלט טקסט; ללא קלט תמונה, אודיו או וידאו.
• רישיון ומשקלים — MIT, עם משקלים שפורסמו ב-Hugging Face. זהו מודל דגל עם משקלים פתוחים, וזו כל הסיבה לכך שההשוואה ל-Kimi K3 מעניינת.
• מחיר מחירון — 0.435$ למיליון אסימוני קלט בהחמצת מטמון, 0.003625$ בפגיעת מטמון, ו-0.87$ למיליון אסימוני פלט, לפי דף התמחור של החברה עצמה.
• ממשקים — ChatCompletions בסגנון OpenAI ונקודות קצה בפורמט Anthropic, בתוספת רמות מאמץ חשיבה, קריאה לכלים ופלט מובנה.
• ציר הזמן עד כה — משפחת V4 הגיעה בתצוגה מקדימה ב-24 באפריל 2026; השמות המיושנים deepseek-chat ו deepseek-reasoner, שמות המודלים, הוסרו ב-24 ביולי 2026; Flash קיבל את הבנייה הרשמית שלו ב-31 ביולי 2026; Pro לא.
• 6 באוגוסט 2026DeepSeek הודיעה למפתחים כי היא מתכננת להעלות את התמחור הכולל של שירותי DeepSeek API "בעתיד הקרוב, עם עלייה משמעותית צפויה," וחזרה על כך שגרסת V4 Pro הרשמית תגיע לאחר מכן. לא פורסמו תעריפים חדשים ולא נקבע מועד כניסה לתוקף.
והחלקים שנותרו לא ידועים באמת, שזה רוב מה שאנשים מחפשים:
• תאריך ה-GA — עדיין לא הוכרז. "יבוא בקרוב" נותרה כולה ההתחייבות הרשמית של החברה. דיווחים עיתונאיים לא מאומתים מצביעים על חלון באמצע אוגוסט — כלי תקשורת אחד העלה את התאריך 10–20 באוגוסט, ודף המחירים של משווק עדכן את מחירי המטמון של V4 Pro ב-3 באוגוסט בדפוס שמבחינה היסטורית מקדים שחרור — אבל שום דבר מזה אינו דברי החברה. לא אושר תאריך.
• מה ישתנה בגרסת ה-GA — לא צוין. החברה לא אמרה אם ה-V4 Pro הרשמי הוא אימון חוזר נוסף על אותם משקלים, אימון מקדים חדש, או תמחור מחדש.
• האם המחיר ישרוד את זה — לא טופל, ויש סיבה ספציפית לדאוג בנוגע לכך, שנגיע אליה בהמשך.
יש תיקון אחד שכדאי לציין במפורש, משום שתוצאות החיפוש לשאלה זו מזוהמות: תמצאו דפים הטוענים שמשפחת V4 הגיעה לזמינות כללית ב-20 ביולי 2026. יומן השינויים של החברה עצמה, אחד-עשר יום לאחר תאריך זה, אומר שההשקה הרשמית של V4 Pro עדיין תלויה ועומדת, ומוסיף שעדכון ה-31 ביולי "משדרג רק את ה-DeepSeek-V4-Flash API. ה-DeepSeek-V4-Pro API והמודלים של APP/WEB לא השתנו." כאשר סיכום של צד שלישי ויומן השינויים הראשי של הספק אינם מסכימים, יומן השינויים מנצח.

טענת המחיר: "זול פי 10" היא הקריאה השמרנית.
Kimi K3 מתומחר ב-3.00 דולר למיליון טוקני קלט ו-15.00 דולר למיליון פלט, עם פגיעות קאש ב-0.30 דולר. V4 Pro מתומחר ב-0.435 ו-0.87 דולר, עם פגיעות קאש ב-0.003625 דולר. אם מריצים אותם זה מול זה, מגלים ש-"10x" הוא הקצה הנמוך של טווח, לא הכותרת:
• אסימוני קלט — $3.00 לעומת $0.435, כלומר V4 Pro זול פי 6.9. זהו הממד היחיד שבו הטענה מוגזמת.
• טוקני פלט — $15.00 לעומת $0.87, או זול פי 17.2. בפלט מודלים של חשיבה מוציאים את רוב העלות, ולכן זה המספר החשוב ביותר.
• תערובת קלט-פלט של 70/30 — $6.60 למיליון לעומת $0.5655, או פי 11.7.
• Artificial Analysis's 7:2:1 cache-hit/input/output blend — 2.31$ לעומת 0.18$, או פי 12.8.
• קלט במטמון — $0.30 לעומת $0.003625, בערך פי 83. מחיר קריאת המטמון של החברה מדורג במקום הרביעי מתוך 101 מודלים ש-Artificial Analysis עוקבת אחריהם, בהנחה של 99% לעומת תעריף החטאות במטמון שלה.
תערובות היפותטיות נתונות לוויכוח, אז הנה אחת מדודה. Artificial Analysis מפרסם מה הוא הוציא בפועל על הרצת מלוא מדד ה-Intelligence Index על כל מודל — אותה ערכת הערכה, אותו מתקן, ספירות טוקנים אמיתיות במקום יחס משוער. הערכת Kimi K3 עלתה $2,437.41. V4 Pro עלתה $176.34. זה פי 13.8, על עומס עבודה זהה, בדולרים שמישהו באמת שילם.
כדאי להבין מה הופך את הנתון הזה לנמוך מיחס של 17.2x בין מחיר לתפוקה, משום שזה המקום היחיד שבו הזילות של V4 Pro היא בחלקה פגיעה עצמית. V4 Pro מילולני: הוא שרף 180M אסימוני פלט במעבר על המדד, לעומת 130M של Kimi K3, ולעומת חציון של 100M בכיתה שלו. כלומר, הוא מוציא כ-38% יותר אסימונים כדי לומר את מה שיש לו לומר, וזה שוחק את היתרון שלו במחיר לאסימון. הנתון של 13.8x כבר כולל את זה; הנתון של 17.2x לא. אם אתה מתכנן תקציב, השתמש בנתון הנמדד.
זה גם החלק בסיפור שקל לבדוק בעצמך במקום לקבל על אמונה. מכיוון ש-OrcaRouter מעביר את מחירי המחירון של הספקים ישירות במרווח של 0%, המחירים לטוקן בדפי המודלים deepseek/deepseek-v4-pro ו-kimi/kimi-k3 שלנו הם של שני הספקים עצמם — K3 מציג $3.00/$15.00 בדף שלנו ו-$3.00/$15.00 בדף של Moonshot — לא תעריף שנמכר מחדש עם מרווח חבוי בתוכו — כלומר, החשבון שלמעלה משתחזר על חשבונית אחת, ואם אחד הספקים משנה מחיר, השינוי נוחת אצלנו באותו היום במקום אחרי מחזור חוזה.
טענת המודיעין: 13 נקודות, לא שוויון
"רמת Kimi K3" היא החצי של התחזית שלא שורד מגע עם המספרים הנוכחיים. במדד האינטליגנציה של Artificial Analysis, נכון ל-5 באוגוסט 2026, Kimi K3 מקבל ציון 57 ו-DeepSeek V4 Pro (חשיבה, מאמץ מקסימלי) מקבל ציון 44 — מדורג במקום ה-6 מתוך 101 מודלים, שזה מיקום חזק באמת, ועדיין 13 נקודות מהפער. שניהם נמדדים על ידי אותה מעבדה באותו מדד מורכב, שניהם במאמץ חשיבה מקסימלי, שניהם מול הקשר של 1M טוקנים.
מדדי הייחוס של הספקים מספרים סיפור שונה ומחמיא יותר, וזו בדיוק הסיבה שיש לתייג אותם. החברה מדווחת על V4 Pro-Preview עם 80.6% ב-SWE-bench Verified ו-90.1% ב-GPQA Diamond. Moonshot מדווחת על Kimi K3 עם 76.8% ב-SWE-bench Verified ו-93.5% ב-GPQA Diamond. אם מקבלים את הנתונים כפשוטם, V4 Pro מנצח במדד הקידוד באופן חד משמעי. אף אחת מתוצאות אלה לא שוחזרה באופן בלתי תלוי; הן הופקו על מערכות בדיקה שונות על ידי צוותים בעלי אינטרס בתוצאה, ובמדד המשולב היחיד שבו צד שלישי הריץ את שני המודלים בעצמו, הסדר מתהפך. זהו כל העניין לאי-אמון בהשוואות של מדד בודד בין ספקים.

שני דברים באשר למספר המדד ראויים להסתייגויות משלהם. ראשית, אם תמצאו כתבות ישנות שמצטטות את V4 Pro כ-52 במקום 44, הן לא טועות — המאמר שהתפרסם באפריל של Artificial Analysis עצמו אכן העמיד את V4 Pro (Max) על 52 וכינה אותו מודל ההיגיון מספר 2 בין מודלי המשקל הפתוחים. המדד עובר עדכונים, והעדכונים מזיזים את הציון של כל מודל. הכלל המעשי הוא שרק השוואות מאותה גרסת מדד משמעותן; 52 מאפריל ו-57 מאוגוסט אינם שייכים לאותו משפט. שנית, העמוד של Artificial Analysis מתוארך ל"פורסם באפריל 2026" ואינו מבחין בין גרסת התצוגה המקדימה לבין גרסה רשמית עתידית, כך שה-44 הוא מדידה של מה שהנקודה הסופית סיפקה, בכל זמן שבו נבדקה.
היכן ש-V4 Pro בהחלט מנצח את Kimi K3 הוא בצירים שאינם אינטליגנציה. הוא מייצר 66.5 אסימונים בשנייה לעומת 37.6 של K3, בקטגוריה שהחציון שלה הוא 65.9 — כך ש-V4 Pro נמצא בערך בממוצע של הקטגוריה שלו, ו-Kimi K3 איטי בצורה יוצאת דופן. הזמן לאסימון ראשון הוא 1.61 שניות לעומת 2.85. בלולאת סוכן אינטראקטיבית, ההבדל הזה מורגש בכל פנייה, והוא הטיעון החזק ביותר בעד גרסת התצוגה המקדימה כפי שהיא עומדת היום.
מה המבנה הרשמי של Flash מספר לנו על ה-Pro
הנה הדבר הקרוב ביותר לראיה אמיתית על המודל שטרם הושק, והוא מגיע מהאח שכבר עבר את התהליך.
יומן השינויים של החברה מ-31 ביולי מציין ש-"DeepSeek-V4-Flash-0731 שומר על אותה ארכיטקטורת מודל ואותו גודל כמו DeepSeek-V4-Flash-Preview, ועבר רק אימון מחדש (re-post-training)." אותו מספר משקלים, אותה ארכיטקטורה, אותו מחיר — רק אימון מחדש. Artificial Analysis דירגה את התוצאה ב-50, לעומת 40 עבור גרסת ה-Flash הקודמת. עשר נקודות במדד המשולב, רק מאימון מחדש, ללא עלות נוספת לכל טוקן. צריכת טוקני הפלט שלה במדד ירדה גם היא ב-12%, מ-~234M ל-~206M, כך שהיא נהייתה זולה יותר להפעלה באותו מחיר מחירון.
יישם את התקדים הזה ל-Pro, והחשבון הוא בלתי נמנע: 44 ועוד 10 זה 54. Kimi K3 נמצא על 57. גם אם ה-V4 Pro הרשמי יחזור על שדרוג הפוסט-אימון המוצלח ביותר שהחברה הדגימה בפומבי, הוא נוחת כשלוש נקודות מתחת ל"רמת Kimi K3" — בעוד שעלות ההפעלה שלו נמוכה בערך פי 14. זו תוצאה יוצאת דופן, והיא לא התוצאה שהתחזית ניבאה.
האזהרות הכנות לגבי אותה אקסטרפולציה, שהיא אריתמטית ולא תחזית: רווח של 10+ על מודל של 284B אומר מעט על מה שזמין במודל של 1.6T, והמרווח עשוי להיות גדול יותר או קטן בהרבה. החברה לא אמרה שה-build של Pro יהיה פוסט-אימון בלבד. והמדד הוא מורכב, כך ששלוש נקודות יכולות להיות ביצ'מרק אחד. הסיבה להריץ את המספר בכל זאת היא שזה התקדים הכמותי היחיד המאושר על-ידי ספק שקיים, וזה הרבה יותר ממה שהתחזית נשענת עליו.
עוד פרט אחד מיומן השינויים הזה ראוי להדגיש ולא רק לחזור עליו: הציונים האג'נטיים של Flash הופקו באמצעות "המצב המינימלי של Harness של החברה (שיושק בקרוב)" במאמץ מקסימלי, topp=0.95, temperature=1.0. ה-Harness שייצר את המספרים לא שוחרר לציבור — הוא נכנס לבטא סגורה בתחילת אוגוסט — כך שהנתונים האלה עדיין לא ניתנים לשחזור על ידי אף אחד מחוץ לחברה, אפילו עקרונית, לא בגלל שהם שגויים אלא בגלל שהכלי אינו זמין. צפו שגרסת ה-Pro תגיע עם אותו כוכבית.
הסעיפים שיכולים לסתור את תזת המודל הזול
במסמכי התמחור של החברה קבורה מדיניות שכמעט אין בה כיסוי למחירי קו V4. בלשון החברה, ה-API "יאמץ בקרוב" לוח זמנים שלפיו "בשעות השיא, המחירים יהיו פי 2 מהמחירים הרגילים, ויחולו על כל פריטי החיוב." שעות השיא מוגדרות בין 09:00–12:00 ובין 14:00–18:00 שעון בייג'ינג, מדי יום — שבע שעות ביממה, כל יום. מועד התחולה "כפוף להכרזה הרשמית," ונכון לכתיבת שורות אלה, התוספת אינה פעילה.
שימו לב לכיוון. בשעות שפל, החברה הפעילה היסטורית הנחות על V3 ו-R1; בשעות שיא, זהו תוספת מחיר על התעריף הרגיל. אם זה יופעל במכפיל הנקוב, מחירו של V4 Pro בשעות היום יהיה $0.87 עבור קלט ו-$1.74 עבור פלט, וצורת ההשוואה משתנה: היתרון המשולב של פי 11.7 על פני Kimi K3 יורד לפי 5.8, והיתרון הנמדד של פי 13.8 יורד לפי 6.9. עדיין זול. לא עוד "זול פי 10", ולא עוד זול בשעות שבהן צוות אירופי או אסייתי עובד בפועל.
ב-6 באוגוסט נפלה הנעל הגדולה יותר. DeepSeek הודיעה בפלטפורמת המפתחים שלה כי היא מתכננת להעלות את התמחור הכולל עבור שירותי DeepSeek API "בעתיד הקרוב, עם עלייה משמעותית צפויה". טרם פורסמו תעריפים חדשים או מועד כניסה לתוקף, והחברה לא אמרה אם העלייה תהיה נפרדת מתעריף שעות השיא או שתחול יחד איתו. העיתונות המסקרת את החברה פירשה את ההודעה כאות לכך שההשקה הרשמית של V4 Pro קרובה — לא מתמחרים מודל דגל שלא הושק באגרסיביות לתוך משטר הנחות שאתה עומד לעזוב. כל מי שבונה היום מודל עלויות על V4 Pro צריך להתחשב בשני התרחישים, וכל מי שקורא כותרת של "החברה זולה פי 14" — כולל הכותרת הזו — צריך לדעת שהיא מתארת רשימת מחירים עם תנאי תפוגה מוכרז. זוהי הדרך הסבירה ביותר שבה חלק המחיר של התחזית מפסיק להיות נכון, ואין לזה שום קשר למודל.
איך תדעו שהבילד הרשמי הגיע
יש פרט באופן שבו החברה שולחת את המוצרים שחשוב יותר מהתאריך, וזה סיכון תפעולי אמיתי.
מזהה מודל ה-API הוא deepseek-v4-pro. לא deepseek-v4-pro-preview, ולא מחרוזת build עם תאריך — אף על פי שלוג השינויים של החברה עצמה מתייחס ל-build הנוכחי בתור V4-Pro-Preview ול-build ה-Flash ששוחרר בתור V4-Flash-0731. כש-Flash הפך לרשמי, ההוראה הייתה: "שיטת הקריאה ל-API נותרה ללא שינוי — פשוט הגדר את שם המודל ל-deepseek-v4-flash כדי להשתמש בגרסה העדכנית ביותר." במילים אחרות, קיבוע מזהה המודל אינו מקבע את ה-build. אותה מחרוזת החלה בשקט לשרת קבוצה שונה של משקלים, עם התנהגות שונה מהותית ועשר נקודות אינדקס נוספות.
אז התשובה המעשית לשאלה "מתי V4 Pro משתחרר" היא שאם אתה קורא ל-deepseek-v4-pro בסביבת ייצור, ייתכן שתגלה על כך על ידי צפייה בשינוי הפלטים שלך. באופן קונקרטי, הדברים שכדאי לעקוב אחריהם הם: ערך חדש ומתוארך ביומן השינויים של ה-API של החברה, שהוא המקום שבו הופיע לראשונה השחרור של Flash; סיומת build כגון V4-Pro-0731 בניסוח של אותו ערך, גם כשמזהה ה-callable נשאר חשוף; ניקוד מחדש בעמוד V4 Pro של Artificial Analysis, שהוא האישור העצמאי הראשון שתקבל; העלייה המתוכננת במחיר שמתממשת בתעריפים בפועל, מכיוון ש-GA הוא הרגע הטבעי גם לזה וגם לכניסה לתוקף של לוח הזמנים לשעות השיא; וכן ה-Responses API של החברה, שהתיעוד שלו אומר שתמיכה ב-deepseek-v4-pro מתוכננת לתחילת אוגוסט — היעלמות המודל מרשימת ה"מתוכננים" והופעתו ברשימת הנתמכים היא בערך הדבר הקרוב ביותר לאות שחרור רשמי שהחברה מפרסמת. שני אותות שאיננו יכולים לאשר, ובכל זאת כדאי לדעת עליהם: עמוד המחירים של reseller שינה את מחירי ה-cache של V4 Pro ב-3 באוגוסט בתבנית שמבחינה היסטורית מקדימה שחרור, ומערכת ההערכה הפנימית של החברה נמצאת בבטא סגורה, מה שאומר שה-benchmarks של הספקים שלה ייתכן שסוף סוף יהיה אפשר לבדוק כשהיא תשוחרר. מחרוזת הדומה ל-deepseek-v4-pro-202606 גם הופצה כמזהה build שדלף; לא הצלחנו לאמת אותה מול אף נכס של החברה, ואין לייחס לה משקל עד שמישהו יוכל.
האם כדאי לך לבנות על התצוגה המקדימה היום?
עבור רוב האנשים שמעריכים את המודל הזה, תאריך ההשקה הוא השאלה הלא נכונה. התצוגה המקדימה ניתנת להפעלה, מתומחרת, מורשית ברישיון MIT, ונמדדה באופן בלתי תלוי במקום ה-6 מתוך 101 במבחני אינטליגנציה. השאלה האמיתית היא מה יעשה שחרור ה-GA הצפוי לעבודה שאתה בונה כעת, ויש שתי תשובות מובחנות.
אם אתם בוחרים בין V4 Pro ל-Kimi K3 על בסיס יכולות, הראיות הנוכחיות מראות ש-Kimi K3 מנצח במדד המשולב ב-13 נקודות, בעוד ש-V4 Pro מנצח בפערים ניכרים במהירות, זמן השהייה ועלות — וכי שדרוג עוקב בשלב הפוסט-אימון עשוי לצמצם את פער האינטליגנציה מבלי לסגור אותו. אם העבודה שלכם נמצאת בחזית החשיבה הקשה, אותן 13 נקודות הן כל המשחק, והמחיר הוא הסחת דעת. אם העבודה שלכם היא בהיקפים גדולים ורק קשה ברמה רגילה, קשה להצדיק תשלום של פי 14 עליה.
אם כבר בחרת ב-V4 Pro, הסיכון שצריך לנהל אינו תאריך ההשקה אלא ההחלפה השקטה: ה-build שמאחורי אותו מזהה מודל ישתנה מתחתיך, בדיוק כמו שקרה עם Flash, וה-evals שלך צריכים להיות מסוגלים לזהות זאת. שמרו על ערכת רגרסיה שתוכלו להריץ מחדש לפי דרישה, והשאירו מודל שני נגיש ללא שינוי קוד. זו הסיבה השגרתית שבגללה בנינו את ה-failover כפי שבנינו — V4 Pro, V4 Flash ו-Kimi K3 כולם יושבים מאחורי מפתח OrcaRouter אחד על נקודת קצה תואמת OpenAI, כך ש"הרצת ה-eval על כל השלושה ואז הסטת תעבורה" היא עריכת קונפיגורציה ולא תהליך רכש, ו-build GA גרוע הוא החלטת ניתוב במקום תקרית. לנסות מודל דגל לא מוכח הוא הרבה יותר קל כאשר ביטול הבחירה הזו אינו עולה כלום.

שאלות שאנשים באמת שואלים
האם DeepSeek V4 Pro שוחרר או לא?
שניהם, תלוי למה אתה מתכוון, ולכן תוצאות החיפוש סותרות. המודל נגיש לציבור לקריאות מאז השקת גרסת התצוגה המקדימה של V4 ב-24 באפריל 2026, עם תמחור מפורסם, משקלים פתוחים תחת רישיון MIT וכיסוי בלתי תלוי של בדיקות benchmark. אבל יומן השינויים של החברה עצמה מ-31 ביולי 2026 קובע במפורש שה-V4 Pro API "לא השתנה" ושההשקה הרשמית שלו "תגיע בקרוב", וב-6 באוגוסט דיפ-סיק אמרה שוב שהגרסה הרשמית תשוחרר בהקדם האפשרי תוך הכרזה על עליית מחיר גדולה ב-API. אז: זמין, עדיין לא רשמי. לא אושר תאריך; דיווחים לא מאושרים מצביעים על אמצע אוגוסט, מה שיהפוך את ההמתנה לקצרה.
האם הבנייה הרשמית תגרום לזה להיות טוב כמו Kimi K3?
בהתבסס על התקדים הכמותי היחיד הזמין, כנראה שלא ממש. הגרסה הרשמית של Flash צברה 10 נקודות במדד האינטליגנציה של Artificial Analysis רק מפוסט-טריינינג; V4 Pro עומד על 44 ו-Kimi K3 על 57, כך שרווח זהה נוחת על 54. האקסטרפולציה הזו עלולה להיות שגויה לשני הכיוונים — לדגם 1.6T עשוי להיות מרווח ראש שונה מאשר לדגם 284B, והחברה לא אמרה שההשקה של Pro תהיה פוסט-טריינינג בלבד. אבל מי שטוען היום לשוויון, טוען דבר ששום מדידה שפורסמה לא תומכת בו.
למה המודל הזול של DeepSeek מקבל כיום ציון גבוה יותר מהמודל הדגל שלו?
בגלל סדר ההשקות, לא בגלל ש-Flash הוא המודל הטוב יותר. Flash קיבל שדרוג פוסט-אימון ב-31 ביולי שהעלה אותו מ-40 ל-50 במדד; Pro לא קיבל את המקבילה שלו, ולכן הוא עדיין נמדד על הפוסט-אימון של אפריל. החברה אומרת זאת בעצמה, ומתארת את תוצאות ה-agentic של Flash-0731 כ"עולות בהרבה על V4-Pro-Preview". ההיפוך הוא תמונת מצב של השקה שלא הושלמה, וההשקה הממתינה של Pro היא בדיוק מה שיביא לסיומו.
האם המחיר $0.435 / $0.87 בטוח לבניית מודל עלות?
בתנאי, ופחות בטוח ממה שהיה לפני שבוע. זהו המחיר המחירון הציבורי הנוכחי של החברה, והוא כבר משקף הפחתה גדולה וקבועה מתעריפי ההשקה של V4. אבל ב-6 באוגוסט הכריזה DeepSeek שהיא מתכננת להעלות את תמחור ה-API בכללותו, "עם עלייה משמעותית צפויה," ועדיין לא פורסמו תעריפים או תאריך חדשים — נוסף על מדיניות שעות השיא שהוכרזה אך לא פעילה, שתכפיל את כל פריטי החיוב לשבע שעות ביום. מודל את שני התרחישים, וציין שגם במקרה המוכפל זה עדיין זול יותר מ-Kimi K3 בכפי 6 בערך.
הקריאה הכנה
התחזית שהתחילה את כל זה הייתה נכונה למחצה, והחצי שנקלט נכון הוא החלק שאנשים יתקשו ביותר להאמין בו. הביטוי „זול פי 10" ממעיט בערך ההפרש: באותו עומס עבודת הערכה שנמדד, גרסת התצוגה המקדימה של DeepSeek V4 Pro עלתה 176.34 דולר לעומת 2,437.41 דולר של Kimi K3, ובקלט שמור הפער אינו פי עשרה אלא בערך פי שמונים. „רמת Kimi K3" הוא החלק שעדיין לא הושג — 44 מול 57 במדד המשולב היחיד שמעבדה בלתי תלויה הריצה על שניהם, עם השלכה אופטימית מהתקדים הטוב ביותר של החברה עצמה, שמגיעה ל-54.
מה שעשוי לשנות את הקריאה הזו הוא ספציפי וכדאי לעקוב אחריו. אם הגרסה הרשמית של V4 Pro תגיע כשדרוג שלאחר אימון ו-Artificial Analysis תדרג אותה מחדש מעל 57, התחזית תאומת במלואה והמספר המרכזי של מאמר זה יתיישן. אם היא תגיע יחד עם תוספת התשלום בשעות השיא או עליית המחיר שהוכרזה ב-6 באוגוסט, טיעון המחיר ייחלש בחצי והשאלה המעניינת תהיה אם הנחה של פי 6 קונה פער של 13 נקודות. ואם החברה תשחרר את מערכת ההערכה שלה — שכבר נמצאת בבטא סגורה — מדדי הספק שכיום נוטים לטובת V4 Pro בקידוד יהפכו לניתנים לאימות בפעם הראשונה. עד שאחד מהדברים האלה יקרה, הסיכום המדויק של DeepSeek V4 Pro הוא שהוא מודל החשיבה הרציני המשתלם ביותר עם משקלים שאפשר להוריד, שהוא לא החכם ביותר, ושהספק שלו אמר לנו שהוא לא גמור.
השוואות במאמר הזה4
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
