כרטיס הירו להתמודדות בין Fugu Ultra v2 ל-MiniMax M3, המציג את פער המחירים הגדול בין שכבת תזמור למודל מולטימודאלי בעל משקולות פתוחות ובעלות נמוכה.
Guides & Insights

Fugu Ultra v2 מול MiniMax M3: פי עשרים וחמישה ממחיר הפלט

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הציגו את שני תעריפי הפלט זה לצד זה, והמספר נראה כמו שגיאת הקלדה. MiniMax M3גובה 1.20 דולר למיליון טוקני פלט. Fugu Ultra v2, שהוכרז על ידי Sakana AI ב-11 בספטמבר 2026, מדווח על 30.00 דולר. זה פי 25 — ובקלט הפער הוא פי 16.7, 0.30 דולר מול 5.00 דולר מדווחים. MiniMax M3 גם מהיר יותר, מקבל וידאו באופן מובנה, ומשוחרר כמשקולות פתוחות להורדה. מול הטבלה הזו, התגובה הראשונה הסבירה היא ששכבת התזמור לא יכולה בשום אופן להצדיק את מחירה. השאלה המעניינת יותר היא מה יצטרך להיות נכון כדי שזה יצדיק את עצמו.

הפער, בניסוח פשוט

קלט — MiniMax M3 במחיר $0.30 ל-1M לעומת Fugu Ultra v2, שלפי הדיווח עומד על $5.00 ל-1M. התעריף של M3 מוצהר על ידי MiniMax כהנחה קבועה של 50%, ולא כמבצע עם תאריך תפוגה.

פלט — MiniMax M3 1.20$ ל-1M לעומת Fugu Ultra v2 עם 30.00$ מדווחים ל-1M.

קלט במטמון — MiniMax M3 במחיר $0.06 ל-1M לעומת Fugu Ultra v2 במחיר מדווח של $0.50 ל-1M. קריאת המטמון של M3 היא חמישית ממחיר הקלט שלה עצמה, מה שהופך לולאות סוכנים חוזרות על פרומפט יציב לזולות במיוחד.

קלט מעל 512K — MiniMax M3 מכפיל את עצמו ל-$0.60 / $2.40 / $0.12. השכבה המדווחת של Fugu Ultra v2 מעל כ-272K עוברת לכ-$10.00 / $45.00 / $1.00. שניהם מתמחרים מחדש את כל הבקשה; M3 מתחיל מאוחר יותר ומגיע לשבריר מהתעריף.

הקונטקסט — MiniMax M3 עם 1,048,576 טוקנים ומינימום של 512K מובטח על ידי הספק. הקונטקסט של Fugu Ultra v2 מדווח כ־1M לפי רישומים של צדדים שלישיים; עמוד ההכרזה של Sakana אינו מציין נתון.

הסתייגות אחת לגבי העמודה של Fugu, והיא לא קטנה: Sakana אינה מפרסמת את תעריפי הטוקנים של Fugu Ultra v2 בעמוד ההכרזה שלה עצמה. הנתונים $5.00 / $0.50 / $30.00 מגיעים מרשימות דגמים של צד שלישי ויש להתייחס אליהם כלא מאומתים עד שתבדקו את כרטיס התעריפים המעודכן בזמן אמת. לעומת זאת, העמודה של M3 מתועדת על ידי הספק. ההבדל הזה במקור המידע הוא עצמו חלק מההשוואה.

Two-column comparison scoreboard for Fugu Ultra v2 and MiniMax M3 covering type, release date, input price ($5.00 vs $0.30 per million tokens), output price ($30.00 vs $1.20), cached input ($0.50 vs $0.06) and input modes (text vs text, image and video).

מה ש-M3 עושה באופן מובנה ושאורקסטרטור צריך לנתב

MiniMax M3 מקבל קלט טקסט, תמונה ווידאו ומחזיר טקסט. הווידאו הוא זה הבולט. המודל אומן על מודאליות מעורבות מהשלב אפס, והוא בנוי על MiniMax Sparse Attention, ארכיטקטורה שהיצרן טוען שמספקת מילוי מקדים מהיר עד פי 9 ופענוח מהיר עד פי 15 בהקשר של 1M בהשוואה לקודמו, בערך ב־1/20 מהמחשוב לכל טוקן.

זה משנה בהתמודדות הזו מכיוון שזו יכולת ש-Fugu Ultra v2 לא מייחס לעצמו. התשובה של אורקסטרטור ל"טפל בסרטון הזה" היא לנתב את הסרטון למודל שיכול לראות אותו, מה שאומר תת-קריאה, מה שאומר עוד טוקנים שמחויבים בתעריף של האורקסטרטור. התשובה של M3 היא פשוט לקרוא אותו. בתעריף קלט של $0.30, שעה של ניתוח וידאו היא שגיאת עיגול; בתעריף קלט של $5.00 ועוד עלות הניתוב ככל שתהיה, זה סעיף תקציבי.

גם השוואת הארכיטקטורה מוטה בדרך אחרת. ב-MiniMax M3 יש בערך 428 מיליארד פרמטרים בסך הכול, עם כ-23 מיליארד פעילים לכל טוקן — עיצוב Mixture-of-Experts שבו הניתוב הדליל שומר על עלות שירות נמוכה. ל-Fugu Ultra v2 אין מספר פרמטרים מפורסם, מכיוון שהיכולת שלו נמצאת במדיניות תזמון מעל המודלים של חברות אחרות ולא במשקלים שאומנו על ידי Sakana. אחד מאלה הוא מודל. האחר הוא הליך קבלת החלטות.

ההשלכה הלא נוחה

הנה הדבר ששווה לחשוב עליו לעומק לפני שמשלמים פי 25 עבור פלט.

MiniMax M3 הוא בעל משקולות פתוחות, זול, מהיר, מולטימודלי ובעל הקשר ארוך. על הנייר, הוא תת-סוכן מצוין. אם היית בונה שכבת תזמור מאפס — מה ש-Fugu Ultra v2 הוא — מודל כמו M3 הוא כמעט הרכיב האידיאלי: זול מספיק כדי לקרוא לו באופן ספקולטיבי, מסוגל מספיק כדי לטפל בעיקר תת-המשימות המפורקות, ומסוגל לראות תמונות ווידאו בלי קפיצה שנייה.

Sakana אינה מפרסמת את מאגר המודלים של Fugu Ultra v2, כך שאיננו יכולים לומר אם M3 נמצא בו. מה שכן אפשר לומר הוא שההיגיון הכלכלי מסתדר רק באחת משתי דרכים. או ש-Fugu Ultra v2 לא קוראת למודלים כמו M3, ואז היא משאירה על השולחן את הקיבולת המסוגלת הזולה ביותר. או שהיא קוראת להם, ואז חלק משמעותי מהטוקנים שאתם מחויבים עליהם ב-$5.00 וב-$30.00 הם טוקנים של M3 שעולים $0.30 ו-$1.20 במעלה הזרם, והפרמיה היא מדיניות התזמור בתוספת מרווח.

אף אחת משתי הקריאות אינה קטלנית למוצר — מתזמן טוב יכול להיות שווה מכפיל גדול, ותשלום עבורו חוסך ממך את הצורך לבנות ולתחזק אותו. אבל זה כן אומר שהשאלה שצריך לשאול לגבי Fugu Ultra v2 אינה "האם הוא טוב יותר מ-M3". אלא "האם התזמון שווה יותר מהטוקנים". וזו שאלה שרק מדידות המשימות שלך עצמך יכולות לענות עליה.

אין בנצ'מרק משותף

שלא כמו כמה השוואות אחרות בסדרה הזו, אין אפילו מבחן ביצועים אחד ששני הספקים מפרסמים עבורו נתון.

הסט שפרסמה MiniMax עבור M3 רחב ולרוב ניתן לשחזור בצורתו: SWE-bench Verified ב-80.5%, SWE-bench Pro ב-59.0%, Terminal-Bench 2.0/2.1 ב-66, BrowseComp ב-83.5%, OSWorld-Verified ב-70.1%, ו-PostTrainBench ב-37.1 — מקום שלישי, אחרי Claude Opus 4.7 עם 42.4 ו-GPT-5.5 עם 39.3. הכול לפי דיווחי הספק. באופן בלתי תלוי, Artificial Analysis מדרגת את MiniMax M3 בציון 30 במדד ה-Intelligence Index v4.3 שלה, במקום ה-16 מתוך 113, עם תפוקה של 95.7 אסימונים לשנייה וזמן עד לאסימון הראשון של 1.95 שניות — מהיר, ובין המודלים בעלי השירות הטוב יותר בקטגוריה שלו. אם ראיתם את M3 מצוטט ב-44 או 45, זה מלפני הניסוח המחודש של המדד.

שמונת הבנצ'מרקים של Sakana עבור Fugu Ultra v2 — GDP.pdf, Chartography, SWEFish, DeepSWE ו-Toolathon ביניהם, עם התוצאה הטובה ביותר או הטובה ביותר במשותף בחמישה, ובשניים המובילים בשבעה — אינם חופפים לרשימה הזו כלל. שניים מהם, SWEFish ו-Toolathon, הם מבחנים פנימיים של Sakana. הטענות המרכזיות, Chartography עם 48.3 מול 27.3 של Opus 5 ו-29.5 של Fable 5, ו-DeepSWE עם 74.3, הן מדווחות על ידי הספק ופורסמו היום. שום דבר בנוגע ל-Fugu Ultra v2 לא אומת באופן עצמאי.

אז ההשוואה שכל אגרגטור יפיק בשבועיים הקרובים — טבלה של ציונים משותפים — אינה זמינה. הדבר היחיד ההגון לומר על היכולת הוא של-MiniMax M3 יש עמדה מדודה ועצמאית ול-Fugu Ultra v2 יש טענה.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

מהירות מול תצורה

המספרים של MiniMax M3 ידועים: 95.7 טוקנים לשנייה, 1.95 שניות עד לטוקן הראשון. זה בערך פי שניים וחצי מהתפוקה של Kimi K3, והוא בין המודלים המהירים ביותר מבין אלה הסמוכים לחזית שנמדדו, מה שמתאים לעיצוב שמוטב במפורש להגשה זולה של הקשר ארוך.

Fugu Ultra v2 לא מפרסמת נתון השהיה או תפוקה. כמו בתמחור, חלק מכך הוא מבני — זמן התגובה של אורקסטרטור תלוי באילו מודלים הוא בוחר ובכמה מעברים הוא מבצע, כך שמספר בודד יהיה מטעה. אבל זה אומר שהעלות בזמן שעון של אימוצו אינה נמדדת ואינה ניתנת למדידה מבחוץ. עבור Fugu Ultra הקודם, בודקים דיווחו בפומבי על ריצות שהתמשכו עד קרוב ל-30 דקות; מדובר במודל מיוני 2026 ולא ב-v2, וזה אינו ראיה לגבי המודל החדש — אבל אם אתם מוציאים פי 25 על פלט, לדעת כמה זמן אתם ממתינים אינו בגדר מותרות.

הרישיון, ומה שאומר הקטע בערבית

המשקלים של MiniMax M3 ניתנים להורדה תחת רישיון Min​iMax Community, שהוא משקלים פתוחים עם תנאים מסחריים נלווים — ובייחוד סף הכנסות שמעליו נדרש אישור בכתב. זה לא MIT, וכל עמוד שאומר לך שכן לא קרא את תג הרישיון. Fugu Ultra v2 לא נותן לך שום דבר שאפשר להעניק לו רישיון, כי אין מה להוריד.

ההתפתחות האחרונה המעניינת יותר עבור M3 היא מה שאנשים אחרים עושים עם המשקלים האלה. ב-3 בספטמבר 2026, HUMAIN — חברת ה-AI הנתמכת בידי קרן PIF הסעודית — השיקה דגם דגל ערבי שנבנה באמצעות אימון־משך של MiniMax M3 על יותר מטריליון טוקנים בערבית, עם 428B פרמטרים בסך הכול ו-23B פרמטרים פעילים, ודיווחה על 89.37% בשקלול שווה על פני שבעה בנצ'מרקים בערבית, והציבה אותו לפני GPT-5.6 Sol עם 87.30 ו-Claude Opus 5 עם 87.34. זו תצוגה מקדימה מחקרית, ואלה המספרים של HUMAIN עצמה.

הניגוד ל-Fugu Ultra v2 לא יכול להיות חד יותר כאמירה על מה שכל מוצר הוא. MiniMax M3 הוא בסיס שחברות אחרות בונות עליו מודלים ריבוניים. Fugu Ultra v2 הוא שער שקוראים דרכו, שאי אפשר לראות את הרכבו ואי אפשר להחזיק במשקולותיו. שניהם עמדות לגיטימיות. הם ממש לא אותו סוג של דבר.

Screenshot of the OrcaRouter model page for MiniMax M3 showing the minimax/minimax-m3 identifier, a 1M token context window, 512K maximum output, and pricing of $0.30 per million input tokens and $1.20 per million output tokens.

להתקשר לאחד מהם

MiniMax M3 זמין ב-OrcaRouter בתעריף של MiniMax עצמה — $0.30 למיליון טוקנים בקלט, $0.06 בפגיעה במטמון, $1.20 למיליון טוקנים בפלט — מועבר הלאה באפס תוספת מחיר, כך שאם MiniMax משנה את מבנה ההנחה זה מגיע לכאן באותו יום ולא בסבב הגירה. הוא תואם OpenAI על אותו base URL כמו שאר הקטלוג, כלומר אפשר לנתב אליו לפי כלל, להציב אותו מאחורי שרשרת failover, או לכלול אותו בפאנל מיזוג מודלים בלי חוזה נוסף ובלי שינוי בקוד. עבור מודל שכל הטיעון שלו הוא מחיר, ההעברה הזו היא החלק שחשוב: המסלול הזול ביותר נשאר הזול ביותר.

Fugu Ultra v2 אינו מנותב על ידינו. הוא זמין מה-API התואם ל-OpenAI של Sakana AI עצמה, והחברה אומרת שאינטגרציית Fugu קיימת עוברת אליו בשינוי פרמטר של שורה אחת. שניהם מדברים באותו פורמט בקשה, כך שהצבתם מאחורי דגל יחיד לצורך הערכה היא החלפת base-URL.

פסק הדין

עבור הרוב המכריע של עומסי העבודה, MiniMax M3מנצח בהשוואה הזו על סמך החשבון בלבד. הוא זול פי 16.7 בקלט ופי 25 בפלט, מהיר יותר בכל מדד שנמדד, מולטימודאלי באופן מובנה כולל וידאו, במשקולות פתוחות תחת רישיון שרוב החברות לעולם לא יגיעו לתקרתו, וקיבל ציון עצמאי של 30 במדד Artificial Analysis הנוכחי. חולשותיו אמיתיות אך צרות: הוא מפורט מדי, ציון הקטגוריה האג'נטית שלו בינוני ביחס לציוני הקידוד שלו, ומערך הבנצ'מרקים של הספק חזק בהנדסת תוכנה ודל יותר באוטונומיה לטווח ארוך.

בחר ב-Fugu Ultra v2רק אם אתה מאמין למה שסאקנה בעצם מוכרת — שכבת יכולת שיא שמפרקת משימות רב-שלביות קשות על פני מאגר שאף ספק חזית לא שולט בו, ומגיעה לתפוקה ברמת החזית בלי להיות תלויה במודלים של החזית — ויש לך מדידות ברמת המשימה שמראות שפירוק עדיף על מודל זול בודד בעבודה שלך. זו הצעה שונה בתכלית מכל מה ש-Min​iMax מציעה, וזו הסיבה לכך שה-25× קיים.

אבל ערכו את המדידה לפני הרכישה, לא אחריה. אם מודל שעולה $0.30 מסיים את המשימה שלכם בשני ניסיונות, ו-Fugu Ultra v2 מסיים אותה בניסיון אחד, Fugu עדיין יקר יותר. עומס העבודה היחיד שבו פי 25 הוא מציאה הוא כזה שבו המודל הזול לא מצליח להשלים כלל — וזו קבוצה קטנה בהרבה של משימות ממה שטקסט ההשקה מרמז.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית