
DeepSeek V4 Pro מול Kimi K3: מהירות ומחיר מול תקרת הסקה של 44 נקודות
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
DeepSeek V4 Pro ו-Kimi K3 הם שני דגלי הדגל של הסקה במשקלים פתוחים עם חלון של מיליון טוקנים, והתחרות ביניהם התייצבה לצורה יציבה לפני חודש: Kimi K3 (המודל של Moonshot AI עם 2.8T פרמטרים, ששוחרר ב-16 ביולי 2026) הוא מוביל האינטליגנציה, ו-DeepSeek V4 Pro (ששוחרר ב-13 באוגוסט 2026) הוא מוביל המהירות והמחיר. מה שחדש הוא שהחצי הזול של אותו צמד כמעט נמחק במחצית הראשונה של ספטמבר — DeepSeek הציבה את V4 Pro על מסלול פרישה ל-14 בספטמבר уже ב-8 בחודש, דחתה אותו, ואז ב-11 ביטלה את הפרישה לחלוטין, תוך התחייבות להמשיך לשרת את המודל בתמחור ללא שינוי. זה חשוב להשוואה הזו יותר מאשר לרוב, משום ש"זול, מהיר, הקשר של 1M, משקלים פתוחים" הוא שילוב שקשה להחליף כאשר האלטרנטיבה עולה פי חמישה.
נתונים בלתי־תלויים הם מדידות של Artificial Analysis. בנצ׳מרקי ההשקה של DeepSeek ו-Moonshot עצמם מסומנים כמדווחים על ידי הספק, מכיוון שאף אחד מהם לא שוחזר באופן בלתי תלוי.
Kimi K3 מנצח במדד; V4 Pro מנצח בחשבון
לוח התוצאות העצמאי חד-משמעי לגבי מי חכם יותר. Kimi K3 במאמץ מרבי מקבל 44 במדד הבינה של Artificial Analysis, ומדורג במקום ה-2 מבין מודלים דומים. DeepSeek V4 Pro מקבל 36, ומדורג במקום ה-7 בקטגוריה שלו. הפער הזה של תשע נקודות הוא הסיבה היחידה לכך שמישהו משלם את המחירים של Kimi K3. והמחירים הם הסיבה לכך שההתמודדות לא מוכרעת לפי המדד בלבד: Kimi K3 רשום במחיר של $3.00 למיליון טוקני קלט ו-$15.00 למיליון טוקני פלט, בעוד V4 Pro רשום במחיר של $0.66/$1.98 בשעות שפל ($1.32/$3.96 בשעות שיא). בפלט, זה בערך פי 7.5 — לפני הנחת המטמון. קריאות מטמון של V4 Pro עולות כ-$0.02 למיליון טוקנים בשעות שפל, הנחה של 97%; הנחת המטמון של 90% של Kimi K3 מתחילה מבסיס גבוה בהרבה. בעומס עבודה עתיר טוקנים, הפער האפקטיבי מתרחב לעבר פי עשרה.
• מדד האינטליגנציה — Kimi K3 44 (#2/113) לעומת V4 Pro 36 (#7/113)
• מחיר — Kimi K3 $3.00/$15.00 לכל 1M לעומת V4 Pro $0.66/$1.98 מחוץ לשעות שיא ($1.32/$3.96 בשעות שיא)
• מהירות — V4 Pro ~81 אסימונים לשנייה לעומת Kimi K3 ~35 אסימונים לשנייה
• הקשר — שניהם 1M טוקנים
• פרמטרים — Kimi K3 2.8T סה"כ / 104B פעילים לעומת V4 Pro 1.6T סה"כ / 49B פעילים
• משקלים — שניהם פתוחים (משקלים פתוחים של Kimi K3, V4 Pro MIT)
• קלט — Kimi K3 טקסט ותמונה לעומת V4 Pro טקסט בלבד
מהירות היא החלק שכולם ממעיטים בערכו
הפער שאיש לא מדבר עליו הוא תפוקה. V4 Pro פולט כ-81 טוקנים לשנייה לפי מדידה בלתי תלויה; Kimi K3 מסתדר עם כ-35. בלולאת סוכנים שבה המודל כותב כמה אלפי טוקנים בכל צעד, זהו ההבדל בין משימה שמסתיימת בדקות לבין אחת שנמשכת לאורך אחר הצהריים — ופער העלויות מחמיר זאת, משום שאתם משלמים 15 דולר למיליון טוקני פלט בבערך חצי מהמהירות. עבור עוזרי קידוד אינטראקטיביים, עיבוד מסמכים בכמות גדולה, וכל עומס עבודה שבו זמן שעון הוא סעיף תקציבי, השילוב של V4 Pro — מהירות גבוהה פי 2.3 בשביעית ממחיר הפלט — הוא התשובה המובילה.
כאשר תשע הנקודות שוות את זה
הטיעון ההוגן בעד Kimi K3 הוא תקרת ההיסק. עלות ההערכה שלו ב-Intelligence Index הייתה כ-3,658 דולר להרצה — שיקוף של שרשראות היסק ארוכות ויקרות באמת, ולא גחמה של תמחור. אם עומס העבודה שלך הוא היסק קשה — הוכחה מתמטית עמוקה, תכנון לטווח ארוך, משימות סוכניות של שעות רבות שבהן תשע נקודות מדד נוספות מתבטאות בפחות כשלים — Kimi K3 מצדיק את תוספת המחיר שלו. הטיעון ההוגן נגדו הוא כל השאר: התפוקה, כלכלת המטמון, המחיר הגלום לכל טוקן.
הסיבה האחרת שמהפך הספטמבר חשוב כאן: לפני חודש העצה הנבונה הייתה "אם אתה מתכוון לתקנן על המודל הפתוח הזול והמהיר, גדר סיכונים — ייתכן שהוא ייצא משימוש." נכון ל-15 בספטמבר, גידור הסיכונים הזה כבר לא רלוונטי. DeepSeek התחייבה בפומבי, עם הבטחה להודעה מוקדמת אם משהו ישתנה, להשאיר את V4 Pro ב-API, ורישיון MIT אומר שהמודל יישאר ניתן לפריסה על החומרה שלך ללא קשר למה ש-DeepSeek תעשה עם ה-API שלה. המשקלים הפתוחים של Kimi K3 נותנים את אותה חופש בצד השני, וזה מה שהופך את זה להשוואה אמיתית בין שני מודלים במשקלים פתוחים ולא לקרב בין שירות למוצר.

שני המודלים נמצאים ב-OrcaRouter — DeepSeek V4 Pro ו-Kimi K3 מנותבים שניהם דרך הפלטפורמה במפתח אחד, כאשר מחירי המחירון של הספקים מועברים הלאה ללא מרווח — וה-DSL של הניתוב הוא הדרך הטבעית לפצל את העימות הזה: נתבו את משימות ההסקה לטווח ארוך אל Kimi K3, שם תשע הנקודות משתלמות, ונתבו את עבודת התפוקה עתירת הטוקנים אל DeepSeek V4 Pro, שם פער המחיר של פי 7.5 ופער המהירות של פי 2.3 עושים את העבודה בשבילכם. השניים משלימים זה את זה לעתים קרובות לא פחות משהם מתחרים, והפלטפורמה הופכת את הרצת שניהם לכמות העבודה של הרצת אחד.


השורה התחתונה
Kimi K3 הוא המודל החכם יותר במשקלים פתוחים, ביתרון של תשע נקודות מדד, והפרמיום שלו — פי 7.5 על אסימוני פלט, בערך חצי מהמהירות — הוא עלות אמיתית, לא טעות עיגול. DeepSeek V4 Pro הוא סוס העבודה המהיר, הזול והעמיד, ואחרי ה-11 בספטמבר הוא כבר לא בגדר סיכון נטישה. התשובה המעשית היא זו ששתי עמודות המחיר מצביעות עליה: אם המשימות שלכם הן הסקה קשה, קנו את Kimi K3; אם הן עתירות אסימונים ורגישות לזמן, קנו את DeepSeek V4 Pro; ואם יש לכם משני הסוגים, הריצו את שניהם ונתבו לפי משימה.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
