Kimi K3.1: מה הטענות בהדלפה — ומה שאושר בפועל
Guides & Insights

Kimi K3.1: מה הטענות בהדלפה — ומה שאושר בפועל

מחבר

jinhao song

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ראשית: זוהי הדלפה, לא הודעה רשמית. נכון ל-27 ביולי 2026, Moonshot AI לא פרסמה רשמית או אישרה "Kimi K3.1." כל מה שלהלן על K3.1 מגיע מפוסט אחד בודד ברשת חברתית שלא אומת ויש להתייחס אליו כאל שמועה עד ש‑Moonshot תשחרר משקלים או כרטיס מודל. מה שהוא מאושר הוא Kimi K3 — מודל המשקלים הפתוחים בעל 2.8 טריליון פרמטרים ש‑Moonshot שיחררה ב‑16 ביולי 2026. מאמר זה מפריד בין השניים: מה ההדלפה טוענת לגבי K3.1, ומה אנחנו יודעים כיום.

למה לכתוב את זה עכשיו? כי "Kimi K3.1" כבר נמצא בחיפוש, והגרסה הכנה של הסיפור הזה — תיוג ברור של שמועה לעומת עובדה — שימושית יותר מהתלהבות או משתיקה. נעדכן את הפוסט הזה אם וכאשר Moonshot תפרסם משהו רשמי.

תקציר. פוסט מ-26 ביולי 2026 ב-X (@Mr_Salio, שכותרתו "Kimi K3.1 Leak") מפרט רשימת תכונות משוערות לעדכון K3.1: ביצועים שמצמצמים את הפער מול GPT-5.6 ו-Claude Fable, הסקה מהירה יותר/בהשהיה נמוכה יותר, יעילות טובה יותר של טוקנים בחשיבה ארוכה, זרימות עבודה אמינות יותר בקוד ובסוכנים, פחות שלבי חשיבה מבוזבזים, יתרון מתמשך על Claude Opus 5במשימות קוד וסוכנים מסוימות, ושחרור מתמשך במשקל פתוח. שום דבר מזה לא אושר, אין מספרי benchmark, ואין תאריך שחרור רשמי. קו הבסיס המאושר הוא Kimi K3: 2.8T פרמטרים, משקל פתוח, #1 ב-Frontend Code Arena בהשקה.

נקודות עיקריות

• הדליפה לא מאומתת. פוסט יחיד ב-X, ללא מספרים, ללא תאריך, ללא אישור Moonshot. יש להתייחס כאל שמועה.

• הנושא השמועתי של K3.1 הוא יעילות, לא גודל חדש. הסקה מהירה יותר, השהיה נמוכה יותר, יעילות טוקנים טובה יותר, פחות שלבי חשיבה.

• המיצוב הנטען: לסגור את הפער עם GPT-5.6 Sol ו Claude Fable 5, לשמור על יתרון על Claude Opus 5 במשימות קידוד/סוכן מסוימות.

• נטען כי משקל פתוח ימשיך — תואם לשחרור ה-MIT המותאם של K3.

• מה שאמיתי היום הוא Kimi K3 (2.8T, open-weight, שוחרר ב-16 ביולי 2026), לא K3.1.

מה שההדלפה באמת אומרת

המקור הוא פוסט יחיד ב-X מאת @Mr_Salio, מתוארך ל-26 ביולי 2026, ובכותרת מפורשת "Kimi K3.1 Leak." הוא מפרט סט שמועות של נקודות (בניסוח חופשי, המיוחס לפוסט זה):

• ביצועים ש"סוגרים את הפער" עם GPT-5.6 ו-Fable.

שומר על היכולות המדווחות ברמה הגבוהה ביותר ("Mythos-level") — הניסוח של הפוסט; "Mythos" אינו מוגדר בהדלפה.

• הסקה מהירה יותר וזמן השהייה נמוך יותר.

• יעילות טובה יותר של אסימונים במשימות חשיבה ארוכות.

• קידוד אמין יותר ותהליכי עבודה של סוכן אמינים יותר.

• פחות שלבי חשיבה מיותרים.

• ממשיך לעלות על Claude Opus 5 במשימות קידוד וסוכן מרכזיות.

• נשאר במשקל פתוח, תוך שמירה על גישה חופשית לבינה מלאכותית ברמת החזית.

זהו כל תוכן ההדלפה. מה שבולט בהיעדרו: כל ציון בנצ'מרק, מספר פרמטרים, אורך הקשר, מחיר או תאריך שחרור. הפוסט אפילו מסתיים בשאלה פתוחה לקוראים ("האם לדעתכם הוא ינצח את Mythos?"), שזה סימן חזק לכך שמדובר בספקולציה, לא בהכרזה מתואמת.

עד כמה זה אמין?

בינוני-נמוך, והנה הקריאה הכנה. מצד אחד, הכיוון המשוער הוא סביר: מהדורות נקודתיות (a ".1") כמעט תמיד מתמקדות ביעילות ובאמינות — הסקת מסקנות מהירה יותר, כלכלת טוקנים טובה יותר, פחות צעדי חשיבה מבוזבזים — ולא בארכיטקטורה חדשה לגמרי, וזה בדיוק מה שהרשימה הזו מתארת. זה גם מתאים לאסטרטגיית המשקל הפתוח של Moonshot עם K3.

מצד שני, אין מה לאמת: מדובר בחשבון אנונימי למחצה אחד, ללא מספרים, ללא צילומי מסך של כרטיס מודל, ללא מאגר Hugging Face, וללא סיקור תומך בשום מקום אחר נכון למועד הכתיבה. מונחים לא מוגדרים כמו "Mythos-level" הופכים את הבדיקה לבלתי אפשרית. עד שמונשוט תפרסם משקלים, כרטיס מודל או טבלת מדדי ביצוע — או עד שגורם אמין יאשר זאת — יש להתייחס לכך כשמועה, לא כמפת דרכים.

מה שמאושר: Kimi K3

המודל האמיתי ששוחרר הוא Kimi K3, שוחרר ב-16 ביולי 2026 — מודל Mixture-of-Experts פתוח במשקל עם 2.8 טריליון פרמטרים, שנבנה לקידוד לטווח ארוך, חשיבה וזרימות עבודה של סוכן, עם קלט מולטימודלי טבעי וחלון הקשר של מיליון טוקנים. בהשקה הוא קפץ למקום הראשון ב-Frontend Code Arena העצמאית (דווח כ-1,679 Elo), לפני Claude Fable 5, GPT-5.6 Sol, ו-GLM-5.2, ודווח על 93.5% ב-GPQA Diamond וכ-91.2 ב-BrowseComp. Moonshot התחייבה לשחרר משקלים מלאים תחת רישיון MIT שונה. אלו המספרים שעליהם להתבסס — והבסיס הריאלי שכל 'K3.1' ייבנה ממנו.

(מקורות ל-K3: חומרי ההשקה של Moonshot ולוחות מובילים עצמאיים כולל Frontend Code Arena ו-Artificial Analysis; הנתונים הם כפי שדווחו בהשקה ועשויים להשתנות.)

אם ההדלפה נכונה, מה משמעות K3.1?

בקריאה נדיבה של הרשימה המשוערת, K3.1 תהיה יעילות ואמינות של שחרור, ולא קפיצת יכולת: בערך באיכות ברמת K3, אבל מהיר יותר, זול יותר למשימה (יעילות טוקנים טובה יותר), ויציב יותר בלולאות סוכן (פחות צעדי חשיבה מבוזבזים, שימוש אמין יותר בכלים). עבור צוותים שכבר מריצים K3, זהו סוג העדכון הכי יקר ערך — הוא מוריד עלות והשהיה מבלי לאלץ הערכה מחדש של איכות. הטענות "סגירת הפער מול GPT-5.6 ו-Fable" ו"יתרון על Opus 5 בכמה משימות קוד/סוכן" יהפכו, אם נכונות, את K3.1 לאופציה החזקה ביותר בעלת משקלים פתוחים עבור סוכני קוד. אבל שוב — אם זה נכון.

האם כדאי לחכות לזה?

לא — אל תתבסס על שמועה. אם אתה זקוק לדגם קוד מוביל במשקל פתוח כיום, Kimi K3 נשלח, פתוח, ועצמאית #1 ב-Frontend Code Arena. אם K3.1 יגיע עם שיפורי יעילות אמיתיים, אימוצו מאוחר יותר הוא טריוויאלי (אותה משפחה, משקלים פתוחים). המהלך הרציונלי הוא להשתמש ב-K3 כעת ולבחון מחדש אם ומתי K3.1 יישלח בפועל עם כרטיס דגם ומספרים. אל תעכב פרויקט בשביל ".1." לא מאושר.

איך לנסות את Kimi K3 היום

Kimi K3 הוא בעל משקל פתוח (open-weight) וזמין דרך ספקי אירוח, כולל דרך נקודת קצה התואמת ל-OpenAI ב-OrcaRouter (מודל Kimi K3). צוותים נייטרליים לספקים מנתבים את Kimi K3 לצד GPT-5.6 Sol, Claude Fable 5 ו-Claude Opus 5 מאחורי נקודת קצה אחת, כך שאם K3.1 (או כל מודל חדש) ישוחרר, המעבר הוא שינוי בשורה אחת במקום הגירה.

כיצד זה משתווה למובילים הנוכחיים

בתמונה המאושרת: Kimi K3 מוביל את Frontend Code Arena מבין כל הדגמים בהשקה והוא השחרור הפתוח-משקל החזק ביותר עד כה, בעוד שדגמי גבול סגורים כמו Claude Fable 5 (מוביל SWE-bench Verified) ו-Claude Opus 5 (#1 במדד Artificial Analysis Intelligence) עדיין מובילים בצירים אחרים. שמועה על K3.1 ש"סוגר את הפער" תהדק מירוץ שכבר צמוד — אך ההדלפה אינה מספקת מספרים למקם אותו, אז לא נמציא שום דבר.

שאלות נפוצות

האם Kimi K3.1 שוחרר?

לא. נכון ל-27 ביולי 2026, אין גרסה רשמית של Kimi K3.1 מ-Moonshot AI. המקור היחיד הוא פוסט הדלפה לא מאומת מיום 26 ביולי ב-X.

האם הדליפה אמינה?

התייחסו לזה כשמועה. זה פוסט בודד ברשתות חברתיות ללא מספרי אמת מידה, ללא כרטיס מודל, ללא תאריך השקה וללא אישור. הכיוון (גרסת נקודה ממוקדת ביעילות) הוא הגיוני אך לא מאושר.

מה ישתנה ב-K3.1 אם ההדלפה נכונה?

שמועות: הסקה מהירה יותר, חביון נמוך יותר, יעילות טוקים טובה יותר בהיגיון ארוך, זרימות עבודה אמינות יותר של קידוד/סוכנים, פחות צעדי היגיון מבוזבזים — תוך שמירה על משקל פתוח ורמת K3 בערך מבחינת איכות.

מה מאושר לגבי Kimi K3?

K3 הוא מודל אמיתי עם משקלים פתוחים של 2.8 טריליון פרמטרים (16 ביולי 2026), #1 ב-Frontend Code Arena בעת ההשקה, עם הקשר של מיליון טוקנים וציונים מדווחים של 93.5% ב-GPQA Diamond וכ-91.2% ב-BrowseComp.

מה זה 'Mythos'?

הדלפה מתייחסת ליכולות ברמת "Mythos" ושואלת האם K3.1 ינצח את "Mythos", אך לא מגדירה את המונח. אין לנו אפשרות לאמת למה הכוונה, לכן אנחנו מסמנים זאת במקום לנחש.

האם עלי לחכות ל-K3.1 לפני בחירת דגם?

לא. השתמש בקימי K3 (או דגם עדכני אחר) עכשיו; הערך מחדש אם K3.1 ישוחרר עם מפרט רשמי. אל תתכנן על בסיס שמועה.

איפה אפשר להריץ את Kimi K3?

באמצעות ספקים מארחים ובאמצעות ה-API התואם ל-OpenAI של OrcaRouter, לצד שאר המודלים המובילים להשוואה קלה.

השורה התחתונה

"Kimi K3.1" הוא, לעת עתה, הדלפה – פוסט יחיד ב-X מתאריך 26 ביולי המתאר עדכון של יעילות ואמינות (מהיר יותר, זול יותר למשימה, סוכנים יציבים יותר, עדיין במשקל פתוח) ללא מספרים, ללא כרטיס מודל וללא תאריך. זה אפשרי אך לא מאומת, לכן אנו מדווחים על כך כשמועה, לא כעובדה. המציאות המאושרת היא Kimi K3: מודל במשקל פתוח של 2.8T, מקום ראשון ב-Frontend Code Arena בהשקה, בו תוכלו להשתמש היום. אם וכאשר Moonshot תשחרר את K3.1 עם אמות מידה אמיתיות, נעדכן את הפוסט הזה – ותוכלו לבדוק אותו תוך דקות דרך נקודת קצה תואמת OpenAI אחת ב-OrcaRouter.

© 2026 OrcaRouter

לספקים

מפעילים פלטפורמת הסקה (inference)? הציגו את המודלים שלכם ב-OrcaRouter.

צרו קשר

הצטרפו לקהילה שלנו

DiscordEmailXGitHubYouTube