
Kimi K3: רגע DeepSeek של קוד פתוח — או סתם הייפ?
- AlibabaחדשQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiחדשZ.ai: GLM 5.3 Flash2026-08-2658אינטליגנציה72כתיבת קוד
- DeepSeekחדשDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 לכל 1M טוקנים
- z-aiחדשZ.ai: GLM 5.32026-08-1860אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1552אינטליגנציה68כתיבת קוד
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
תוך שעות מ Kimi K3 ההופעה ב-Arena, ביטוי אחד המשיך לצוץ איתה: "רגע DeepSeek לקוד פתוח." הדגל החדש של Moonshot AI עם 2.8T פרמטרים — שהוכרז ב-16 ביולי 2026, עם הבטחה למשקלים פתוחים לפני 27 ביולי — גורם לבוחנים להכריז שמעבדות סיניות "כבר לא נמצאות 8 חודשים מאחורי החזית." האם זה מוצדק, או שמא זה אותו מחזור ההייפ שהקיף את DeepSeek לפני שנה וחצי? ניתוח זה מציג את הטיעונים בעד ונגד ביושר, ומפריד בין מה שבאמת השתנה לבין מה שאנשים *מרגישים* שהשתנה.
הערה לבונים: אלו בדיקות קהילתיות מוקדמות ולא מבוקרות, אז התייחסו אליהן כאל כיווניות, לא כציונים. OrcaRouter מציגה מודלים זמינים דרך API מאחורי נקודת קצה תואמת OpenAI, אז ברגע שה-Kimi K3's API יהיה זמין תוכלו לנסות אותו מול DeepSeek, Fable 5 ו-GPT-5.6 מבלי לחבר מספר SDKs.
TL;DR פסק דין.Kimi K3 הוא האות החזק ביותר במשקלים פתוחים מאז DeepSeek R1 — המודל הפתוח הגדול ביותר עד כה, קרוב לחזית במספר הערכות ציבוריות, והמשקלים הפתוחים יגיעו תוך ימים. אבל לקרוא לזה "DeepSeek moment" זה מוקדם מדי: המשקלים עדיין לא יצאו, המדד העצמאי עדיין ממקם אותו במקום רביעי (מאחורי שתי תצורות Fable 5 ו-GPT-5.6 Sol), זה המודל הסיני היקר ביותר אי פעם, והמעריצים שלו עצמם מודים שהוא "מייצר דברים פחות מעניינים." אות אמיתי, רגע לא מוכח.
נקודות עיקריות
• מספר בודקים הגיעו באופן עצמאי למונח "DeepSeek moment" — @synthwavedd, @chetaslua, @redkendl.
• בסיס העובדות חזק באמת: 2.8 טריליון פרמטרים MoE, הממוקם כמודל בעל המשקל הפתוח הגדול ביותר עד כה, AA Index 57 (מקום 4 מתוך 189), Arena frontend #1.
הספקנים מצביעים על נקודות תקפות גם כן: הרגע המקורי של DeepSeek "לא התממש" מבחינה מסחרית (@LinkesAuge82), פער תזמון השחרור עדיין קיים (@jmbollenbacher), והטוויסט במחיר ($3/$15) מערער את סיפור "המשבש הזול".
• אפילו bull @teortaxesTex לא בדק את זה בעצמו ומציין ש-K3 "לא הולך את המייל הנוסף".
• פסק הדין הכנה תלוי בדברים שעדיין לא קרו — משקלים, ביקורות, ומבחני סוכן רב-שלביים.
למה מתכוונים אנשים ב'רגע DeepSeek'
הביטוי הזה עושה עבודה רבה, ולכן כדאי להגדיר אותו במדויק. "רגע DeepSeek" הוא קיצור לאירוע ספציפי מ-2025: מעבדה סינית שחררה מודל במשקל פתוח שהגיע קרוב מספיק לחזית המערבית — בזול — עד כדי כך שהוא ערער את הקונצנזוס ש"בינה מלאכותית סינית נמצאת כ-8 חודשים מאחור" והזיז שווקים. כאשר בודקים מיישמים אותו על Kimi K3, הכוונה היא לשתי טענות בבת אחת: (1) K3 קרובה *לחזית הסגורה*, ו-(2) היא מגיעה *פתוחה*, כך שכל אחד יכול להריץ אותה.
שני החצאים חשובים. מודל סגור קרוב לחזית לא היה זוכה בתווית; גם לא מודל פתוח שפיגר מאוד. הטיעון של K3 הוא שהוא עושה את שניהם. האם זה עובר את הרף של "רגע" אמיתי — כזה שמשנה את התחום, לא רק את ציר הזמן — זו השאלה שעליה חלוקים שני המחנות.
המקרה ש-K3 הוא אחד
הטיעון של "השור" מבוסס על תגובות מתכנסות ובלתי תלויות בתוספת בסיס עובדתי אמיתי. @synthwavedd ניסח זאת בפשטות: "ככל שאני בודק את K3 יותר, כך הוא מרגיש כמו עוד רגע DeepSeek R1… לעיתים ברמת Fable, אולי קצת יותר גרוע, אבל באופן עקבי טוב יותר מ-5.6." הוא הוסיף ש-K3 "הולך להדהים כמה מאנשי '8 חודשים מאחור'." @chetaslua הרחיק לכת: "Kimi K3 יהיה רגע deepseek נוסף עבור OSS."
השורה המצוטטת ביותר מגיעה מ-@redkendl, שהשלים במכה אחת משחק מטוס נייר תלת‑ממדי וסיכם: "מעבדות הבינה המלאכותית הסיניות אינן מפגרות אחרי החזית ב‑8 חודשים יותר. הן ממש שם." ו‑@teortaxesTex — תוך כדי זהירות — ניסח את ההימור האסטרטגי: "כל מודל סיני שרק *שומר* על הפער… הוא הישג הרואי," ובנוגע לקידוד אג'נטי עם אדם בלולאה במשימות אובייקטיביות, "K3 צריך להגיע קרוב באופן בלתי סביר."

• תגובות מתכנסות — פרט: שלושה בודקים מגיעים באופן עצמאי ל'DeepSeek moment'; מקור: synthwavedd, chetaslua, redkendl
• המודל הפתוח הגדול ביותר — פרט: 2.8T-param MoE, מוצב כמודל בעל המשקל הפתוח הגדול ביותר נכון להיום; מקור: Moonshot (דווח על ידי הספק)
• משקלים פתוחים בקרוב — פרטים: הובטח לפני 27 ביולי 2026; מקור: Moonshot (דווח על ידי ספק)
• מדד עצמאי — פירוט: AA Intelligence Index 57, #4 מתוך 189 (מעל Opus 4.8, GLM 5.2); מקור: Artificial Analysis
• Arena frontend — פירוט: #1 ב-1679, מעל 1631 של Fable 5; ניצח ב-6 מתוך 7 קטגוריות; מקור: Arena / LMArena
• לעתים רחוקות נכשל — פרט: עבור קידוד סוכני אובייקטיבי, "צריך להתקרב קרוב באופן בלתי סביר"; מקור: teortaxes
יחדיו: מודל פתוח שמדורג 4 במדד ניטרלי ו-1 בלוח הקדמי של Arena, ממעבדה שזינקה ממקום 18 של K2.6, הוא בדיוק הצורה של "רגע".
הטיעון נגד
הספקנים לא חולקים על המדדים – הם חולקים על המסגור. הקלף החזק ביותר שלהם הוא ההיסטוריה. @LinkesAuge82 טען שהאירוע המקורי נמכר יתר על המידה: "רגע ה-'deepseek' היה הרבה תשומת לב תקשורתית אבל הוא באמת לא התממש… Deepseek לא תפס שום נתח שוק ראוי לציון." אם התבנית עצמה לא הזיזה נתח, התאמה לתבנית מוכיחה פחות ממה שזה נשמע.
התנגדות התזמון חדה לא פחות. @jmbollenbacher, בתגובה לטענת "ממש שם", ציין: "Fable/Mythos בן 6 חודשים. K3 רק סיים להתבשל. הפער עדיין אמיתי… מעבדות בארה״ב פשוט שומרות מודלים חדשים פנימיים ל־6+ חודשים." במילים אחרות, השוואת מודל טרי למודל ציבורי בן חצי שנה מחמיאה למתחרה החדש. @Camilogicly הוסיף כי "הפער לא מתרחב כי הם ממשיכים לזקק" — קרבה שתלויה בזיקוק תפוקות גבוליות אינה זהה להשוואה עצמאית.
• המשקלים עדיין לא יצאו. בעת ההכרזה, K3 היה זמין רק דרך API/אינטרנט; משקלים פתוחים *הובטחו* לפני 7/27, אך לא שוחררו. "רגע DeepSeek" עבור קוד פתוח דורש שהחלק הפתוח אכן יגיע.
• המדד עדיין מדרג אותו במקום הרביעי.AA Index 57 נמצא מאחורי שתי תצורות Fable 5 ו-GPT-5.6 Sol — קרוב לחזית, לא בתוכה.
• פער הטעם. אפילו bull @teortaxesTex אומר ש-K3 "עושה דברים פחות מעניינים ומפורטים, לא הולך את המייל הנוסף" — ומודה שהוא עדיין לא בדק את זה בעצמו.
• עדיין מאחור ב-agentic SWE. FrontierSWE 81.2 לעומת 86.6 של Fable 5; DeepSWE 67.5 לעומת 70.0 (vendor/benchmark מצטבר).
• טוויסט המחיר. ב $3 / $15 per 1M tokens, K3 הוא הדגם הסיני היקר ביותר עד כה (K2.6 היה $0.95/$4). השיבוש הזול היה חצי מהסיבה ש‑DeepSeek הפכה ל"moment".
מה בעצם השתנה: משקלים פתוחים, מחיר, והנקודה ש'Frontier גם מייצרת שטויות'
הסר את התווית ושלושה דברים השתנו באמת. ראשית, פתיחות בקנה מידה: מודל עם 2.8T פרמטרים ומשקלים פתוחים שהובטחו הוא צעד קדימה במה ש"פתוח" יכול להתכוון — אם יישלח כפי שהובטח, זהו מודל המשקלים הפתוחים הגדול ביותר עד כה, וזה לבדו ממסגר מחדש את התקרה עבור מעבדות אירוח עצמי.
שנית, הכלכלה התהפכה. הסיפור של DeepSeek היה באיכות קרובה לחזית הטכנולוגיה במחיר נמוך במיוחד. K3 שומר על המיתוג האיכותי אך הוא הדגם היקר ביותר של Moonshot אי פעם — עדיין בערך 1/3.3 מ-$10/$50 של Fable 5, אבל כבר לא תקציבי. גרוע מכך, שלו פלט מפורט (~2× אמצע הטוקנים של עמיתים) אוכל אפילו את היתרון הזה בעומסי עבודה אמיתיים. ה"רגע" כאן עוסק ביכולת, לא בשיבוש באמצעות מחיר.
שלישית, @teortaxesTex ניסח מחדש את רף האיכות עצמו: "אפילו Fable ו-Sol מייצרים כל כך הרבה SLOP… Kimi לא כל כך נכשלת בדברים… אלא מייצרת דברים פחות מעניינים ומפורטים." אם הגבול הסגור גם מייצר תפוקה בינונית הרבה מהזמן, אז "קרוב לגבול" הוא רף נמוך יותר ממה שהשיווק רומז — מה שעובד לשני הכיוונים עבור התזה הרגעית.

• משקלים פתוחים ב-2.8T — קריאה: המודל הפתוח הגדול ביותר עד כה, אם ישוחרר; אזהרה: לא שוחרר בהכרזה; לפני 7/27
• מיצוב מחיר — קריאה: הדגם הסיני היקר ביותר אי פעם ($3/$15); הסתייגות: מערער על סיפור "המפריע הזול"
• רב-מילים — קריאה: ~2× חציון עמיתים של אסימוני פלט; אזהרה: מצמצם את פער המחירים מול $10/$50 של Fable 5
• סרגל איכות — קריאה: Frontier "גם מייצרת בינוניות"; אזהרה: גם K3 — "לא הולכת את הקילומטר הנוסף"
מה לצפות
פסק הדין תלוי באמת בדברים שלא קרו. שימו לב ל:
• משקלים של 27 ביולי.האם הם נשלחים, באיזה רישיון, והאם מעבדות יכולות להריץ 2.8T MoE? מודל פתוח שלא נשלח אינו רגע קוד פתוח.
• בנצ'מארקים עצמאיים. מדד AA Index 57 ו-Arena #1 הם של צד שלישי, אך רוב טענות הבודקים הן התרשמויות חד-פעמיות מ-Arena. ריצות ניתנות לשחזור ומבוקרות יכריעו אם K3 עומד במבחן.
• בדיקות סוכן רב-שלביות. הספקן @sebuzdugan ציין "10 הנחיות לא יראו כישלון של kimi k3 בשימוש בכלים רב-שלבי." הפערים ב-FrontierSWE/DeepSWE מצביעים על כך שאמינות הסוכנים היא המבחן האמיתי.

שאלות נפוצות
האם Kimi K3 הוא קוד פתוח?
לא ממש, ו"משקלים פתוחים" הוא המונח המדויק יותר. Moonshot הבטיחה לשחרר את המשקלים של K3 לפני 27 ביולי 2026; בזמן ההכרזה זה היה זמין רק דרך API ו‑web. משקלים פתוחים מאפשרים לך להריץ ולפרוס את המודל, אבל זה לא זהה לקוד פתוח מלא (עם נתוני אימון ומתכונים).
האם Kimi K3 הוא "DeepSeek moment" עבור קוד פתוח?
יש לו את המרכיבים — ציונים ציבוריים קרובים לגבול ממודל פתוח — וכמה בודקים אומרים כך. אבל המשקלים עדיין לא פורסמו, המדד הנייטרלי עדיין מדרג אותו במקום הרביעי, ואפילו בולס מציינים שהוא "לא הולך את המייל הנוסף." איתות אמיתי, רגע לא מוכח.
האם Kimi K3 טוב יותר מ-DeepSeek?
במדד האינטליגנציה של AA, K3 קיבל ציון 57 (#4 מתוך 189), הרבה מעל המקום שבו נמצאים מודלי DeepSeek — אבל הם מדורות שונים. ההשוואה המועילה יותר היא ש-K3 מכונה האירוע הבא בסגנון DeepSeek, לא יריבה באותה רמה.
האם מודלי AI סיניים מדביקים את הפער?
בהערכות פומביות, הפער הצטמצם בחדות — @redkendl אומר "הם ממש שם". הספקנים טוענים שמעבדות בארה"ב שומרות מודלים חדשים פנימיים במשך 6+ חודשים (@jmbollenbacher), כך שהפער בין גרסאות שפורסמו מחמיא למצטרף החדש.
למה Kimi K3 כל כך יקר אם הוא המשבש?
ב-$3/$15 ל-1M טוקנים, זה הדגם היקר ביותר של Moonshot אי פעם (K2.6 היה $0.95/$4). זה עדיין בערך 1/3.3 מ-$10/$50 של Fable 5, אבל המסגור "דגם סיני זול" כבר לא תקף — ותפוקה מפורטת מצמצמת עוד יותר את הפער.
האם כדאי לי לבנות על Kimi K3 עכשיו?
אתה יכול לבחון את זה דרך API היום, אבל התייחס להייפ כאל כיווני. חכה למשקלים ולבנצ'מרקים של סוכנים עצמאיים לפני התחייבות לעומסי ייצור.
השורה התחתונה
ה רגע ה-Kimi K3 DeepSeekהמסגור הוא חצי ראוי: K3 הוא האתגר הפתוח-משקל הכי אמין מאז DeepSeek R1, עם בסיס עובדתי אמיתי — המודל הפתוח הגדול ביותר עד כה, AA Index #4, Arena frontend #1. אבל "רגע" דורש שהמשקלים באמת ישוחררו, ביקורות בלתי תלויות יתקיימו, ואמינות רב-סיבובית סוכנתית תתאים להדגמות — ואף אחד מזה לא מוכרע עדיין. מעבדות סיניות אולי לא בפיגור של 8 חודשים יותר, אבל "ממש שם" היא טענה מה-27 ביולי והמדדים עדיין צריכים להוכיח.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
