
Grok 4.7 לעומת Kimi K3: חצי מהמחיר, חצי מהקונטקסט, ואף לא אחד מהמשקלים
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 219 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 41 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
קחו חודש של 300 מיליון טוקנים של עבודת קידוד אג'נטית ותריצו אותו דרך שני המודלים בתעריפי המחירון שלהם, והבחירה מפסיקה להיראות כמו ויכוח על בנצ'מרק. Grok 4.7, ששוחרר על ידי SpaceXAI ב-21 בספטמבר 2026, גובה 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט. Kimi K3, ששוחרר על ידי Moonshot AI ב-16 ביולי 2026, גובה 3 ו-15 דולר. בחודש ההיפותטי הזה — נניח 200 מיליון טוקני קלט ו-100 מיליון טוקני פלט — Grok 4.7 מסתכם בכ-1,000 דולר ו-Kimi K3 בכ-2,100 דולר. הפער אינו הבדל של עיגול; מדובר בתקציב של מודל שלם נוסף. לעומת זאת, Kimi K3 נותן לכם חלון הקשר של 1,000,000 טוקנים במקום 500,000, קלט וידאו ילידי וכן תמונות, ומשקלים הניתנים להורדה. Grok 4.7 נותן לכם מודל סגור, מהיר וזול יותר, שאומן במפורש לעבודת טרמינל באופק ארוך שאליה מכוון גם Kimi K3. שניהם ברמת חזית. הם לא אותה רכישה.
שני המודלים, בקצרה
Grok 4.7 הוא מודל הקידוד ועבודת הידע החזיתי של SpaceXAI, הבנוי על מודל בסיס גדול יותר מאשר Grok 4.6, ואשר קיבל ריצת למידת חיזוק ארוכה יותר שמכוונת למשימות שעשויות להימשך שעות. הוא קנייני — ללא משקלים, ללא הורדה — משרת חלון הקשר של 500,000 טוקנים, קולט טקסט ותמונות ומחזיר טקסט, ותומך ברמות מאמץ חשיבה מ-low עד xhigh. הטענה המובילה שלו היא מהירות ומחיר: SpaceXAI מציגה אותו כמהיר בערך פי שניים ממודלים דומים במחיר של כמחצית בערך.
Kimi K3 הוא מודל הדגל הפתוח מסוג תערובת מומחים של Moonshot AI, המודל הפתוח הראשון בקטגוריית שלושת הטריליון פרמטרים: 2.8 טריליון פרמטרים בסך הכול, עם 104 מיליארד פעילים לכל טוקן, הבנוי על Kimi Delta Attention ומשקולות MXFP4 מודעות לכימות. הוא קולט טקסט, תמונות ווידאו, מספק הקשר של 1,000,000 טוקנים, מפעיל חשיבה במצב תמידי עם מאמץ הניתן להגדרה, והמשקולות שלו ניתנות להורדה תחת רישיון Kimi K3 — שימוש מסחרי מותר, עם מגבלות. הוא, מעצם תכנונו, המודל שאתה יכול לקחת איתך הביתה.
זהו כל ההבדל המבני ביניהם. האחד הוא נקודת קצה זולה, מהירה וסגורה. האחר הוא ארטיפקט יקר יותר, איטי יותר ופתוח, עם כמות כפולה של הקשר. כל מה שלהלן נובע מכך.
מה שהבנצ'מרקים באמת משווים
כאן רוב הכתבות על Grok 4.7 לעומת Kimi K3 טועות, ולכן כדאי להיות בוטים: המספרים שפורסמו של שני המודלים במידה רבה לא מודדים את אותם הדברים, ולפחות זוג אחד שנראה בר-השוואה אינו כזה.
התחל עם הצמד שמטעה באמת. חומר ההשקה של Kimi K3 מצטט ציון Terminal-Bench 2.1 של 88.3. חומר ההשקה של Grok 4.7 מצטט Terminal-Bench 4.0 ב-38.0%. אלו גרסאות שונות של מבחן עם מערכי משימות שונים וניקוד שונה, והצבתם זו לצד זו תרמוז ש-Kimi K3 הוא יותר מפי שניים טוב יותר כמודל סוכני. זו אינה פרשנות מוצדקת, ואף אחד לא צריך לחזור עליה. שני המספרים גם מדווחים על ידי הספק — אף אחד מהם לא שוחזר באופן עצמאי.
מה שאפשר להשוות הוא המדד המשולב העצמאי, ושם השניים קרובים. במדד Artificial Analysis Intelligence Index הנוכחי, גרסה v4.3.2, Kimi K3 מקבל ציון 44 — המקום השני מתוך 113 מודלים, המיקום הגבוה ביותר מבין מודלים עם משקלים פתוחים בדירוג. Grok 4.7 מקבל ציון 46, המקום השישה-עשר מתוך 655. בפער של שתי נקודות, כשהמיקום של Kimi K3 הושג במאמץ חשיבה מקסימלי. במדד המשולב המעורב, המודלים האלה שווי מעמד.
• ציון משולב עצמאי — Grok 4.7 עם 46 ב־AA Intelligence Index v4.3.2 לעומת Kimi K3 עם 44 באותה גרסה. תיקו בפועל.
• חלון הקשר — Grok 4.7 500,000 טוקנים לעומת Kimi K3 1,000,000 טוקנים. יתרון אמיתי וללא סייג ל-Kimi K3, וההבדל היחיד במפרט בלי הסתייגות.
• מודאליות קלט — Grok 4.7 טקסט ותמונה לעומת Kimi K3 טקסט, תמונה ווידאו. Kimi K3 רחב יותר, אם עומס העבודה שלך כולל וידאו.
• משקלים — Grok 4.7 קנייני, ללא הורדה, לעומת Kimi K3 עם משקלים פתוחים תחת רישיון Kimi K3. עבור דרישת התקנה מקומית (on-premise) או סביבה מבודדת מרשת (air-gapped), זו השורה היחידה שחשובה.
• מחיר למיליון טוקנים — Grok 4.7 $2 קלט / $6 פלט לעומת Kimi K3 $3 קלט / $15 פלט, כאשר תעריף הקלט השמור במטמון של Kimi הוא $0.30 למיליון. Grok 4.7 זול יותר בכל ציר, וזול באופן דרמטי בפלט.
• שליטה בעצמת החשיבה — Grok 4.7 מ־low עד xhigh לעומת Kimi K3 שפועל תמיד עם עצמה ניתנת להגדרה. מבחינה תפקודית דומים; ההבדל הוא ש־Grok 4.7 מאפשר לך להנמיך את החשיבה.
• עדויות סוכניות מדווחות על ידי הספק — Grok 4.7 Terminal-Bench 4.0 38.0%, CursorBench 4.0 46.3%, DeepSWE v1.1 71.0% (הכול מדווח על ידי הספק) לעומת Kimi K3 Terminal-Bench 2.1 88.3%, Frontend Code Arena מקום ראשון עם 1,679 Elo (מדווח על ידי הספק בעת ההשקה). לא ניתן להשוות — ראו לעיל.


לאן הכסף באמת הולך
המחירון ממעיט בפער, כי שני המודלים צורכים טוקנים באופן שונה. Grok 4.7 הוא מודל הסקה עתיר מילים — Artificial Analysis מדדה 240 מיליון טוקני פלט שנוצרו בזמן הרצת מדד האינטליגנציה שלה, לעומת חציון של 92 מיליון בקרב המודלים. Kimi K3 הוא הסוג ההפוך של יקר: הוא מודל הסקה גדול ופעיל תמיד, ובתעריף של 15 דולר למיליון טוקני פלט, המילוליות היא מה שאתם קונים.
אז מודל העלויות הכנה אינו "$2/$6 מול $3/$15". הוא טוקנים של פלט לכל משימה שהושלמה, כפול תעריף הפלט, ועוד טוקנים של קלט הכוללים כל ניסיון חוזר, כפול תעריף הקלט. מודל שפותר משימה במעבר ארוך אחד במחיר $6 למיליון יכול לנצח מודל שזקוק לשלושה ניסיונות במחיר $15 למיליון, והוא גם יכול להפסיד לו אם המעברים של המודל הזול ארוכים מספיק. זו מדידה שאתה מריץ על המאגר שלך, ולא כזו שמישהו מפרסם עבורך.
יש אסימטריה אחת שכדאי להכיר לפני שמריצים את זה: Grok 4.6, קודמו של Grok 4.7, מיישם צוק תמחור ב-200,000 אסימוני קלט, שבו בקשה שחוצה את הקו מתמחרת מחדש את כל הבקשה בכפול מהתעריף. עבודה עם הקשר ארוך בצד של Grok צריכה להיבדק מול מחירון התעריפים העדכני של המודל שאתם פורסים, כי חלון של 500,000 אסימונים וצוק של 200,000 אסימונים משפיעים זה על זה לרעה. התמחור של Kimi K3 הוא אחיד, וזה היתרון השקט יותר מבין השניים.
היכן כל אחד נשבר
לשני המודלים יש מצב כשל שחומר ההשקה אינו פותח בו, והם כשלים שונים.
אצל Kimi K3, הצד החלש הוא האמינות בעומס מתמשך. בדיקות קהילתיות ועצמאיות בעת ההשקה דיווחו שהביצועים האג'נטיים שלו נחלשים ככל שההרצות מתארכות — תוצאות חזקות בהרצה בודדת, אך שיעורי הצלחה חלשים יותר בהרצה מתמשכת — ושמהירות הפלט שלו נמצאת בסביבות 37 עד 38 טוקנים לשנייה, שזה איטי לקידוד אינטראקטיבי. Moonshot גם נאלצה להשהות מינויים חדשים לצרכנים זמן קצר לאחר ההשקה משום שהביקוש עלה על הקיבולת, מה שאומר משהו על מרווח הקיבולת לשירות בצד המאורח.
הצורה של Grok 4.7 היא ההפוכה: הוא מהיר, זול וסגור, מה שאומר שאינך יכול לבדוק אותו, אינך יכול להריץ אותו בעצמך, ואינך יכול לגדר את עצמך מפני הפסקת תמיכה. SpaceXAI כבר פרסמה בפומבי את סדר ההשקה של Grok 4.8, Grok 4.9 ו-Grok 5 אחרי מהדורה זו, ו-Grok 4.6 שרד כחמישה שבועות בלבד לפני שהוחלף. כל דבר שתבנה על Grok 4.7 צריך להיבנות כך שמזהה המודל יהיה ערך תצורה, ולא הנחה.
יש שיקול שלישי שאינו כשל של אף אחד מהמודלים: אף אחד מהם אינו התשובה הנכונה לריצה אוטונומית של שבועיים, ושתי הספקים הדגימו בדיוק את זה. ההדגמות שפורסמו לקידוד אוטונומי של 16 יום ו-48 שעות מבוצעות על ידי הספק, על משימות שהספק בחר, ללא שחזור בלתי תלוי. שווה להכיר אותן, אבל לא שווה לתכנן לפיהן.

להריץ את שניהם, ולמה זו התשובה האמיתית
פער העלות ופער ההקשר מצביעים לכיוונים מנוגדים, וזה הטיעון שלא לבחור באחד. Kimi K3 מצדיק את מחירו בעבודה בהיקף של מאגר קוד, שבו חלון של 1M אומר שאין צורך לפצל את הקלט, ובכל דבר שחייב להיות באירוח עצמי. Grok 4.7 מצדיק את מחירו בנפח — לולאות סוכנים עם מספר סבבים גבוה, צינורות עתירי קריאות לכלים, והפעלות מסוף ארוכות שבהן המהירות ועלות הפלט שולטות.
Kimi K3 נמצא ב-OrcaRouter, מה שהופך את הפיצול הזה להחלטת ניתוב ולא להחלטת רכש. הוא יושב בקטלוג במחיר המחירון של Moonshot, ומכיוון ש-OrcaRouter מעביר את מחירי המחירון של הספקים עם 0% תוספת, הורדת מחיר של ספק נכנסת לתוקף כאן באותו יום שבו היא מוכרזת, ולא בחידוש החוזה הבא. עבור עומסי עבודה שבהם מעבר בעל הקשר ארוך ומעבר ביצוע אמורים לשתף פעולה ולא להתחרות — מודל אחד שמחזיק את כל המאגר לנגד עיניו, ואחר שפועל לפיו — ה-DSL לניתוב מרכיב כמה מודלים לקריאה אחת, ומיזוג מודלים מאפשר לפאנל של מודלים להשיב יחד כאשר המשימה שווה את ההוצאה הנוספת. מפתח API אחד מכסה את Kimi K3 ועוד למעלה מ-200 מודלים אחרים, כך שחצי הביצוע של הפיצול הזה יכול להגיע מהמודל הזול והמהיר ביותר למשימה, ולא מזה שבמקרה מחזיק את ההקשר.
יש דבר אחד שצריך להיות ברור: המשקולות הפתוחות של Kimi K3 ניתנות להורדה, אבל נקודת הקצה המתארחת היא זו ש-OrcaRouter מנתב אליה. אם הדרישה שלך היא באמת הסקה בסביבה מקומית (on-premise), זהו פרויקט אירוח עצמי על החומרה שלך, ולא החלטת ניתוב — וזה התרחיש היחיד שבו להשוואה הזו יש תשובה נכונה אחת.
פסק הדין, והמספר האחד שכדאי לזכור
אם אתם בוחרים לפי עלות ומהירות, Grok 4.7 מנצח ובפער ניכר: חצי ממחיר הקלט, פחות ממחצית ממחיר הפלט, הגשה מהירה יותר, וחוגת חשיבה שאפשר להנמיך. אם אתם בוחרים לפי הקשר, רוחב המודאליות או היכולת להחזיק בבעלות על המודל, Kimi K3 מנצח באותם תנאים. אם אתם בוחרים לפי יכולת בלבד, המדד המשולב העצמאי אומר שהם במרחק של שתי נקודות זה מזה, וכדאי להחליט לפי ההערכה שלכם ולא לפי תרשים ההשקה של מי מהיצרנים.
המספר שצריך להחזיק בו הוא זה שמלמעלה: $2/$6 לעומת $3/$15. כל השאר בהשוואה הזו נתון למשא ומתן, והיחס הזה לא.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
