
Fugu Ultra v2 מול Kimi K3: שני ראוטרים, שתי גבהים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
שתי המערכות האלה הן נתבים, וזה הדבר הראשון שרוב הסיקור מפספס. Kimi K3הוא מודל Mixture-of-Experts עם 2.8 טריליון פרמטרים, שמפעיל בערך 104 מיליארד פרמטרים לכל טוקן — כלומר, על כל טוקן בודד שהוא מייצר, הוא מקבל החלטת ניתוב, ובוחר 16 מתוך 896 המומחים שלו שיעשו את העבודה. Fugu Ultra v2, שהוכרז על ידי Sakana AI ב-11 בספטמבר 2026, הוא נתב בגובה אחר לגמרי: הוא לוקח משימה נכנסת, מפרק אותה, ומפזר את החלקים בין מאגר של מודלים נפרדים. האחד מנתב בתוך מעבר קדימה; האחר מנתב על פני צי שלם. ההבנה שאלו אותו רעיון בשני קני מידה היא הדרך המהירה ביותר לראות מדוע תגי המחיר שלהם נבדלים פי 2 בקלט ופי 5 בפלט.
שני הראוטרים, זה לצד זה
• Kimi K3 — ספינת הדגל של Moonshot AI, שוחררה באמצע יולי 2026 עם משקולות פתוחות שפורסמו ב-27 ביולי 2026. הארכיטקטורה יוצאת דופן אפילו לפי הסטנדרטים של 2026: 69 שכבות Kimi Delta Attention המשולבות לסירוגין עם 24 שכבות Gated MLA, Attention Residuals, עיצוב "Stable LatentMoE", ומקודד ראייה MoonViT-V2 בעל 401 מיליון פרמטרים. המשקולות מגיעות ב-MXFP4 עם אקטיבציות MXFP8 תחת אימון מודע לכימות. ה-API המתארח שלה חושף מאמץ חשיבה עם בדיוק ערך נתמך אחד — max.
• Fugu Ultra v2 — שכבת תזמור בעלת יכולת שיא של Sakana AI, ולא מודל יסוד במובן המקובל. מדובר בנקודת קצה יחידה תואמת OpenAI שמפרקת משימות ומפזרת אותן על פני מאגר של מודלים במשקלים פתוחים ומודלים ייעודיים. Sakana מציינת ש-Claude Fable 5, Claude Fable 5.1 ו-GPT-6 Astra מוחרגים מאותו מאגר, ומציינת חתך אימון של 20260828. אין מספר פרמטרים מפורסם, מפני שאין פרמטרים לספור כפי שהיה עושים עבור K3 — היכולת טמונה במדיניות התזמון.
התוצאה היא ש-K3 הוא רכיב ו-Fugu Ultra v2 הוא מכלול. זה הופך את ההשוואה הזו ליוצאת דופן: השניים האלה אינם רק מתחרים, אלא מרכיבים פוטנציאליים. מודל כמו K3 הוא בדיוק סוג המערכת עם משקלים פתוחים, חלון הקשר ארוך והפעלת כלים שמתזמר עשוי לשכור באופן סביר. Sakana אינה מפרסמת מיהם החברים במאגר, כך שלא ידוע אם K3 נמצא בתוך Fugu Ultra v2 — אבל אם כן, חלק ממה שאתם משלמים עליו בתעריף של Fugu הוא טוקנים של K3 עם תוספת מחיר.
מהו פער המחירים בפועל
• קלט — Fugu Ultra v2 במחיר מדווח של $5.00 למיליון (רישומים של צד שלישי; עמוד ההכרזה של Sakana אינו מפרסם תעריפים משלו) לעומת Kimi K3 ב-$3.00 למיליון, עם פגיעות מטמון ב-$0.30.
• פלט — Fugu Ultra v2 במחיר מדווח של $30.00 למיליון טוקנים לעומת Kimi K3 ב-$15.00 למיליון טוקנים. חצי מהמחיר, עבור מודל שאפשר גם להוריד.
• קלט במטמון — Fugu Ultra v2 $0.50 לכל 1M לעומת Kimi K3 $0.30 לכל 1M בפגיעת מטמון. בלולאת סוכן ארוכה עם הנחיית מערכת יציבה, הפער הזה מצטבר בכל סיבוב.
• חלוקת ההקשר לרמות — Kimi K3 נשאר אחיד לאורך כל חלון 1,048,576 הטוקנים שלו, ללא קנס על הקשר ארוך. הרמה המדווחת של Fugu Ultra v2 מעל כ-272,000 טוקני קלט מעבירה את כל הבקשה לכ-10.00$ / 45.00$.
השורה האחרונה הזו היא זו שקובעת חשבונות אמיתיים. הרצת סוכן לטווח ארוך מבלה את רוב זמנה מעבר ל-272K טוקנים, ובדיוק שם התעריף האחיד של K3 נשאר אחיד, וזה של Fugu Ultra v2 מוכפל. אם עומס העבודה שלך נראה כך, הפער האפקטיבי בצד הקלט קרוב יותר ל-3.3× מאשר ל-1.7×.

המספר היחיד שהם חולקים
שני הספקים מדווחים על DeepSWE, וההשוואה פחות מחמיאה ל-Fugu ממה שמסגור ההשקה שלה מרמז. סאקאנה מציינת את Fugu Ultra v2 ב-74.3. מונשוט מציינת את Kimi K3 ב-67.5 — לפי דיווח הספק, מכרטיס המודל. זהו פער של 6.8 נקודות במדד לסוכני קוד, והוא אמיתי, אבל זהו מבחן אחד מתוך סט מפורסם גדול בהרבה, וזה אותו מבחן שסאקאנה מובילה בו ב-1.6 נקודות מול GPT-5.6 Sol. מדד שבו שלושה ספקים שונים כולם מתקבצים בטווח של שבע נקודות מודד משהו אמיתי אך אינו מבדיל ביניהם באופן מכריע.
מעבר לכך, השניים מפרסמים על מדפים שונים לחלוטין. הנתונים של K3 מבית Moonshot כוללים Terminal-Bench 2.1 עם 88.3, GPQA Diamond עם 93.5, HLE-Full עם 43.5 (56.0 עם כלים), SWE-Marathon עם 42.0, OSWorld-Verified עם 84.8 ו-MCPMark-Verified עם 94.5 — כולם מדווחים על ידי הספק, כולם בכרטיס המודל. שמונת הבנצ'מרקים של Sakana עבור Fugu Ultra v2 כוללים שני בנצ'מרקים פנימיים, SWEFish ו-Toolathon, שאיש מחוץ ל-Sakana לא יכול לשחזר.
באופן בלתי תלוי, רק אחד מהם נמדד בכלל. Kimi K3 משיג 44 במדד הבינה של Artificial Analysis Intelligence Index v4.3 — שני מבין מודלים בעלי משקלים פתוחים, אחרי GLM-5.3 עם 45 — ו-93.40% ב-SWE-bench Verified תחת הרנס הסוכני הסטנדרטי של Vals AI, אחרי Claude Opus 5 ו-DeepSeek V4 Pro אך קרוב. הוא גם מוביל את Frontend Code Arena עם 1679 Elo, לפני Fable 5 עם 1631 ו-GPT-5.6 Sol עם 1618. אם ראיתם את K3 מצוטט ב-57 או 60, זהו סולם המדד שהוחלף ואסור לחזור עליו.
ל-Fugu Ultra v2 אין ציון עצמאי מכל סוג שהוא. הוא הוכרז ב-11 בספטמבר 2026, ואף אחד מחוץ ל-Sakana לא הריץ אותו.
מהירות: אחת מדודה, ואחת לא
Kimi K3 איטי, וזה נמדד ולא רק נטען: Artificial Analysis מתעדת 37.9 טוקנים בשנייה עם זמן עד לטוקן הראשון של 3.80 שניות, ומסמנת אותו כמילולי במיוחד. עבור מודל שנבנה סביב קידוד סוכני לטווח ארוך, תפוקה היא אילוץ ממשי — מודל איטי בלולאה ארוכה עולה בזמן-קיר, לא רק בכסף.
Sakana אינה מפרסמת כלל נתוני השהיה או תפוקה עבור Fugu Ultra v2. עבור מתזמר, אפשר לטעון שזו כנות ולא התחמקות, משום שזמן התגובה תלוי לחלוטין באילו מודלים הוא מחליט לקרוא להם ובכמה מעברים הוא מבצע. אבל זה גם אומר שאי אפשר למדל את עלות הזמן הריאלי של מעבר אליו בלי למדוד אותה בעצמך. עבור Fugu Ultra הקודם, בודקים דיווחו בפומבי על ריצות שהתארכו לכיוון 30 דקות; זהו המודל מיוני 2026 ולא ראיה לגבי v2, אבל זה המספר שצריך להכות כשאתה מריץ בנצ'מרק.

משקלים פתוחים, עם הסתייגות שכדאי לקרוא
המשקולות של Kimi K3 ניתנות להורדה, וזהו הבדל אמיתי מהמודל שמוצע באירוח בלבד של Fugu Ultra v2 — אבל הרישיון צר יותר מכפי שהביטוי "משקולות פתוחות" מרמז בדרך כלל. K3 מופץ תחת רישיון Kimi K3, ולא תחת רישיון MIT או Apache מאושר OSI, והטענה הנפוצה שהוא "MIT מותאם" שנויה במחלוקת. התנאים דורשים הסכם נפרד עם Moonshot עבור עסקי מודל-כשירות עם הכנסות של מעל 20 מיליון דולר בכל תקופה של שנים-עשר חודשים רצופים, ובנוסף ייחוס עבור מוצרים עם יותר מ-100 מיליון משתמשים חודשיים או הכנסות חודשיות של 20 מיליון דולר. שימוש פנימי פטור.
אז הניסוח הכנה הוא: K3 נותן לך משקלים שאתה יכול להחזיק, לבדוק, לכוונן ולאחסן בעצמך, בכפוף לתנאי מסחרי תלוי-הכנסות. Fugu Ultra v2 לא נותן לך דבר מזה — אין משקלים, אין מאגר שניתן לבדוק, אין אירוח עצמי — אבל גם לא מטיל תנאי הכנסה, כי אין מה להעניק ברישיון. איזה מהם מתירני יותר תלוי לחלוטין בשאלה אם אתה סוג החברה שרישיון K3 מכוון אליה.
הסתייגות מעשית אחת אם אירוח עצמי הוא התוכנית: הצ'קפוינט של K3 הוא בערך 1.5 טרה-בייט, והיצרן ממליץ על 64 מאיצים או יותר. "משקלים פתוחים" כאן פירושו החלטה על אשכול הסקה, לא החלטה של מחשב נייד. עבור רוב הצוותים, ה-API הוא המסלול ההגיוני כך או כך — ולכן התמיכה ב-vLLM וב-SGLang מהיום הראשון חשובה יותר מההורדה עצמה.
מה שהתנועה שלנו עצמה אומרת
נקודת נתונים אחת שאף אחד מהספקים אינו מפרסם, ושווה יותר ממה שהיא נראית: ברחבי שער OrcaRouter, Kimi K3 הוא המודל הנמצא בשימוש הרב ביותר מבין כל אלה שנדונו במאמר זה, בפער ניכר, כשהוא מעביר כ-3.27 מיליארד טוקנים בשבעת הימים האחרונים.
זה אינו מבחן ביצועים וזה לא מכריע דבר לגבי איכות. אבל זהו מדגם גדול של מה שמפתחים בוחרים בו בפועל כאשר ההחלטה לא עולה להם דבר מלבד מחיר הטוקנים, והוא מעיד שהשילוב של K3 — חלון של 1M בתעריף קבוע, משקלים פתוחים ומיקום חזק בזירת הקידוד — כבר זכה לנתח משמעותי מעבודת סוכנים אמיתית עם הקשר ארוך. ל-Fugu Ultra v2 אין אות דומה, משום שהושק היום.

להגיע לכל אחד מהם
Kimi K3 זמין ב-OrcaRouter בתעריף של Moonshot עצמה — $3.00 למיליון טוקני קלט, $0.30 במקרה של פגיעה במטמון, $15.00 למיליון טוקני פלט — מועבר הלאה ללא תוספת מחיר, כך ששינוי מחיר של הספק מגיע לכאן באותו יום ולא לפי לוח זמנים של הגירה. הוא תואם ל-OpenAI באותה כתובת URL בסיסית כמו שאר הקטלוג, ומכיוון שהוא יושב מאחורי אותו שער כמו כל השאר, אפשר לשלב אותו בשרשרת failover או לנתב אליו באופן מותנה במקום לקודד ספק יחיד ישירות לתוך נתיב ייצור. זה חשוב כאן יותר מהרגיל: מודל עם 2.8T פרמטרים שמוגש בקצב של 37.9 טוקנים לשנייה הוא בדיוק מסוג התלות שראוי שיהיה מאחוריה גיבוי.
Fugu Ultra v2 אינו מנותב על ידינו. הוא זמין מה-API התואם OpenAI של Sakana AI עצמה, והחברה אומרת שאינטגרציות Fugu קיימות עוברות אליו בשינוי פרמטר אחד. שני המודלים מדברים באותו פורמט בקשה, כך שהערכה שמעמידה אותם מאחורי דגל אחד היא החלפת base-URL ולא שכתוב מחדש.
מה לבחור
Kimi K3 הוא הבחירה המוצדקת יותר עבור כמעט כל עומס עבודה. הוא מחצית מהמחיר של Fugu Ultra v2 גם בקלט וגם בפלט, אחיד על פני חלון של 1M ללא צוק של הקשר ארוך, עם ניקוד עצמאי של 44 במדד Artificial Analysis הנוכחי, ניתן לאירוח עצמי תחת רישיון המותנה בהכנסות, וכבר המודל עם התעבורה הגבוהה ביותר בהשוואה הזו בפער עצום. המחיר שלו הוא במהירות ובמילוליות: 37.9 טוקנים לשנייה זה באמת איטי עבור לולאות סוכניות, ולרישיון יש שיניים אם אתה עסק גדול של מודל כשירות.
Fugu Ultra v2 הוא הקנייה הנכונה אם אתה רוצה את התכונה הספציפית שסאקאנה מוכרת — שכבת יכולת שמפרקת עבודה קשה מרובת-שלבים על פני מאגר ששולל מבחינה מבנית את ספקי החזית, כך שלא ניתן לבטל, לתמחר מחדש או לנתק מתחתיך אף מודל במעלה הזרם. היתרון של DeepSWE על K3 הוא אמיתי ומדווח על ידי הספק; המיקום בשני המקומות הראשונים בשבעה מתוך שמונה מבחני ביצועים גם הוא מדווח על ידי הספק, ובמבחנים שחלקם לא קיימים בשום מקום אחר.
הדבר שיש לשים לב אליו הוא ששתי אלה הן החלטות ניתוב, ומבקשים ממך לבחור גובה. K3 מנתב טוקנים למומחים בתוך מודל שאתה יכול להוריד ולשלוט בו. Fugu Ultra v2 מנתב משימות למודלים שאתה לא יכול לראות. השנייה היא רעיון גדול וחזק יותר. היא גם זו שאפשר לקבל רק באמונה — וזה עולה פי חמישה לכל טוקן להאמין בה.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
