כרטיס כותרת עבור Sakana Fugu Max, מודל התזמור שיצא ב-11 בספטמבר 2026, המציג ארבעה כרטיסי נתונים: קלט $2 לכל מיליון טוקנים, פלט $6 לכל מיליון טוקנים, הטוב ביותר בסך הכול ב-6 בנצ'מרקים, ומאגר של מודלים פתוחים וגם מודלים מיוחדים כולל NVIDIA Nemotron, עם כותרת תחתונה שמציינת שכל הנתונים מדווחים על ידי הספק.
Guides & Insights

Sakana Fugu Max: המתזמר ב-$2/$6 שבוחר את המודל הזול ביותר שעובד

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

רוב המודלים מתחרים על כמה הם מסוגלים לעשות. Sakana Fugu Max מתחרה על כמה מעט הוא מצליח לעשות ועדיין לצאת מזה. Sakana AI השיקה Sakana Fugu Max ב-11 בספטמבר 2026, לצד Sakana Fugu Ultra v2 — שני כיוונונים של ארכיטקטורת תזמור אחת, המכוונים לשני קצוות מנוגדים של עקומת העלות-ביצועים. Fugu Max אינו עונה בעצמו לבקשה שלך. הוא קורא את המשימה, בוחר את המודל הזול ביותר במאגר שלו שסביר שיכול להתמודד איתה, מנתב לשם, ומחזיר תשובה אחת. Sakana מתמחרת אותו ב-2 דולר למיליון טוקני קלט וב-6 דולר למיליון טוקני פלט.

החלק המעניין הוא מול מה נמדד המחיר הזה. Sakana טוענת שקצב התפוקה של Fugu Max נמוך ב-40–60% מזה של Claude Sonnet 5, GPT-5.6 Terra ו-Kimi K3. את הטענה הזו אפשר לבדוק, ובאופן לא שגרתי למדד של יום השקה, החשבון מחזיק מעמד: מול מחירי המחירון הנוכחיים של שלושת המודלים ש-Sakana מציינת, מחיר של 6 דולרים למיליון טוקנים בפלט נופל כמעט בדיוק באמצע הטווח הנקוב. מה שהרבה יותר קשה לבדוק הוא צד הביצועים, מפני ש-Sakana פרסמה את התוצאות של Fugu Max בתור תרשימי פיזור ולא כמספרים.

מהו Fugu Max בעצם

Fugu Max אינו צ'קפוינט. אין קובץ משקלים, אין מספר פרמטרים, ואין מה להוריד. Sakana מתארת אותו כ"ארכיטקטורה, לא מודל בודד" — אותו מנוע תזמור ליבה כמו Fugu Ultra v2, מכוונן לשאלה אחרת. Ultra v2 שואל מהי היכולת הגבוהה ביותר הזמינה. Fugu Max שואל מהו הפלט הטוב ביותר בעלות הנמוכה ביותר.

ההבחנה הזו חשובה מבחינה תפעולית. אינך יכול לכוונן עדין את Fugu Max, לארח אותו בעצמך, או לבדוק מדוע בחר במודל אחד על פני אחר. כמו כן, אינך יכול לראות את מלוא הרשימה שהוא מנתב ביניהם — Sakana אומרת שהמאגר מתרחב ל"מאגר המודלים הפתוחים והמתמחים הגדול ביותר שלנו עד כה" ומציינת במפורש את משפחת Nemotron של NVIDIA, שנוספה באמצעות שותפות NVIDIA ש-Sakana הכריזה עליה באוגוסט. שאר המאגר אינו נקוב בשם, ו-Sakana אינה מפרסמת רשומת ניתוב לכל בקשה.

מה שאפשר לראות הוא הצורה של הדבר. התרשים של הספק עצמו מציג את Fugu Max בראש התפצלות: מתזמר אחד, שורה של חריצי מודלים ברי-החלפה מאחוריו, ו-Sakana Namazu ו-Fugu Max עצמו בין היעדים. המאגר מתואר כבר-החלפה מעצם תכנונו, והמניע המוצהר הוא פוליטי לא פחות מכלכלי — Sakana ממסגרת את התזמור כהגנה מפני נעילת ספקים, ביטולי גישה ל-API ובקרות ייצוא, בטענה שמערכת שיכולה להחליף את הספקים שלה לא יכולה להיות מנותקת על ידי אף אחד מהם.

סאקנה פוגו עצמו אינו חדש. הוא הגיע לזמינות כללית ב-22 ביוני 2026, וציר הזמן של הספק עצמו נע מאפריל (בטא), יוני (GA בתוספת Fugu Ultra v1), יולי (Fugu-Cyber וממשק Claude Code), אוגוסט (Sakana Chat בתוספת השותפות עם NVIDIA), ועכשיו ספטמבר. Fugu Max הוא הצעד החודשי החמישי, לא הופעת בכורה — וכל מי שכבר מריץ Fugu משדרג אליו בשינוי פרמטר של שורה אחת מול אותה נקודת קצה תואמת OpenAI, ללא מיגרציה.

טענת התמחור שורדת מגע עם מחירי המחירון

הנתון של Sakana בדבר קלט של $2 / פלט של $6 מוצג במפורש בעמוד ההשקה. סיקור משני מוסיף תעריף של $0.25 למיליון טוקנים עבור קלט במטמון, שאותו עמוד ההשקה עצמו אינו מציין — התייחס לכך כאל מדווח ולא כמאומת. לשם השוואה, Fugu Ultra v2 הוא $5 קלט, $30 פלט, עם $0.50 קלט במטמון.

כעת הטענה בדבר 40–60%. שלושת המשווים הנקובים נמצאים כעת ב:

• GPT-5.6 Terra — $2 לקלט / $12 לפלט, לאחר שהקיצוץ של Open​AI ב-30 ביולי הוריד את הפלט מ-$15.

• Claude Sonnet 5 — $10 לפלט במחיר המבצעי של ההשקה, $15 במחיר הסטנדרטי. המקורות חלוקים בדעתם אם ההעלאה המתוכננת לספטמבר בוטלה או רק נדחתה, ולכן הטווח רחב.

• Kimi K3 — $3 קלט / $15 פלט, עם קלט במטמון ב-$0.30.

לעומת אלה, פלט של $6 נמוך ב-50% מ-Terra, ב-40% מהתעריף המבצעי של Sonnet 5, ב-60% מהתעריף הרגיל של Sonnet 5, וב-60% מ-Kimi K3. הטענה מתאמתת, והיא מתאמתת מול מחירי מחירון מפורסמים ולא מול מודל עלויות פנימי — מה שאי אפשר לומר על כל אחוז ביום ההשקה.

מספר אחד באותו מדור לא שורד את אותו טיפול. Sakana אומרת גם ש-Fugu Max מספק "ביצועים במרחק נגיעה ממודלים עילית, בעלות נמוכה פי שניים עד שישה." לעומת שלושת המודלים שהיא מציינת עבור הנתון של 40–60%, הפער הגולמי במחיר התפוקה קרוב יותר ל-1.7× עד 2.5×. המכפיל הרחב יותר נמדד ככל הנראה על פני מלוא החזית — כולל מודלים שעולים הרבה יותר מ-$12 — ולא לעומת השלושה שבמשפט. זו טענה ניתנת להגנה בכל הנוגע לעקומת פארטו, וטענה בלתי ניתנת להגנה בכל הנוגע למתחרים הנקובים בשמם, ודף ההשקה אינו מבדיל בין השתיים.

כאן שכבת ניתוב מצדיקה את קיומה בצד התמחור. OrcaRouter מעבירה מחירי מחירון של ספקים ללא תוספת, כך שכשספק משנה מחיר מחירון, המספר שאתם רואים משתנה באותו יום — וזה רלוונטי כאן מפני שכל ההנחה הבסיסית של Fugu Max היא שקיים מודל זול יותר איפשהו במאגר ושאליכם להגיע אליו בלי לחשוב על כך. אנחנו לא מארחים את Fugu Max; הוא פועל על ה-API של Sakana עצמה. אבל עקרון ההעברה החופפת הוא אותו עיקרון שהופך תעריף פלט של $6 למשהו ששווה לבדוק מול ספק קיים של $12, במקום להאמין לאף אחד מהמספרים בעיניים עצומות.

מה שסקאנה אומרת שהיא מנצחת, ומה שהיא לא תראה לך

Screenshot of the Sakana AI Fugu Max launch page showing ten Pareto frontier scatter charts plotting benchmark score against output price in US dollars per million tokens, covering Terminal Bench 2.1, HLE, DeepSWE, CharXiv Reasoning, Chartography, GDP.pdf, GPQA-D, AutomationBench, AA-LCR and SWEFish, with Fugu Max marked as a red point at the top-left of each plot and no numeric scores printed.

סעיף הבנצ'מרקים של הספק מעלה שלוש טענות ספציפיות עבור Fugu Max: הציון הכולל הטוב ביותר בשישה בנצ'מרקים — Terminal Bench 2.1, GPQA-D, AA-LCR, GDP.pdf, AutomationBench ו-SWEFish — הרחבה של חזית פארטו של עלות-ביצועים בשבעה מעשרה בנצ'מרקים, וביצועים "במרחק נגיעה ממודלים עילית" בשבריר מצריכת הטוקנים.

שלושה דברים לגבי הראיות האלה שכדאי לזכור לפני שאתם מצטטים מהן משהו.

הראשונה היא שסקאנה לא פרסמה שום מספרים. תוצאות Fugu Max מופיעות כעשרה תרשימי פיזור — ציון בציר האנכי, מחיר פלט בדולרים למיליון טוקנים בציר האופקי — כאשר Fugu Max מסומן כנקודה אדומה מצפון-מערב לשדה האפור. אפשר לראות שהוא יושב למעלה ולשמאל. אי אפשר לקרוא ממנו ציון. ל-Terminal Bench 2.1, ל-GPQA-D ול-AA-LCR יש לוחות דירוג ציבוריים שבהם מספר היה בר-השוואה ישירות, ולא ניתן שום מספר.

השנייה היא שאחד מששת הבנצ'מרקים הוא של Sakana עצמה. SWEFish מתואר בעמוד ההשקה כ"בנצ'מרק פנימי שלנו המשקף את אתגרי הקידוד ותרחישי השימוש של Sakana AI עצמה". זו דרך לגיטימית למדוד התאמה למוצר שלך, וזו אינה דרך להשוות מול מתחרה — ציון בבנצ'מרק שהספק עיצב, על משימות שהספק בחר, אינו ראיה לגבי המודל של מישהו אחר.

השלישי הוא שהמספרים החזקים ביותר בדף שייכים למודל האחר. Fugu Ultra v2 מקבל נתונים היכן ש-Fugu Max מקבל תרשימים: Chartography 48.3 מול Opus 5 עם 27.3 ו-Fable 5 עם 29.5, DeepSWE 74.3, הטוב ביותר או הטוב ביותר במשותף בחמישה מתוך שמונה מבחנים ובשני המקומות הראשונים בשבעה מתוך שמונה. Ultra v2 גם נושא תאריך חתך אימונים מוצהר של 2026-08-28 — קצת יותר משבועיים לפני ההשקה — ובאופן מודגש, הערה מפורשת ש-Fable 5, Fable 5.1 ו-GPT-6 Astra אינם במאגר שלו. Sakana טוענת שהיא מגיעה לשם בלי לשכור את הדגמים הספציפיים האלה, וזה כל טיעון הריבונות בהערת שוליים אחת.

שום דבר מכל זה לא הופך את טענותיה של Fugu Max לשקריות. זה הופך אותן לבלתי מאומתות, וזה הופך את הכותרת של ששת המבחנים לבטוחה לחזרה רק כשמצרפים אליה את התווית. הערכה בלתי תלויה של נקודת קצה חדשה לגמרי לתזמור היא נדירה, וטרם פורסם דבר.

Fugu Max לעומת Fugu Ultra v2: איזה מהם אתה באמת רוצה

A two-column scoreboard comparing Sakana Fugu Max and Sakana Fugu Ultra v2 across six shared dimensions: price ($2 in / $6 out versus $5 in / $30 out), cached input ($0.25 reported versus $0.50), objective (lowest cost per task versus highest capability), benchmark evidence (charts with no numbers versus Chartography 48.3 and DeepSWE 74.3), whether Fable 5 or GPT-6 Astra are in the pool (not stated versus explicitly excluded), and best fit (high-volume simple traffic versus agentic long-horizon work).

אלה אינם מוצרים מתחרים, והבחירה ביניהם אינה צמודה ברגע שרואים את המספרים זה לצד זה. Fugu Max הוא הזול: $2 קלט, $6 פלט, בנוי לנתב הרחק ממודלים יקרים בכל פעם שמודל זול יותר יכול לעשות את העבודה. Fugu Ultra v2 הוא החזק: $5 קלט, $30 פלט, $0.50 במטמון, בנוי לנתב לעבר יכולת בעבודה מורכבת מרובת שלבים גם כשזה עולה יותר.

החלוקה המעשית היא לפי צורת המשימה, לא לפי תקציב. אם התעבורה שלך היא בעיקר חיפושים, חילוץ, סיווג, יצירות קצרות וקריאות כלים פשוטות, כל העיצוב של Fugu Max נועד לזהות זאת ולהוציא כמה שפחות — והטענה של Sakana שהוא מרחיב את גבול היכולת בשבעה מתוך עשרה מדדים היא לפחות בכיוון הזה. אם התעבורה שלך כוללת ריצות סוכניות ארוכות, ריפקטורים רב-קבציים או משימות מחקר שנכשלות ביוקר כששלב משתבש, תעריף הפלט של $30 ב-Ultra v2 קונה משהו אמיתי: המיקום בשני המקומות הראשונים בשבעה מתוך שמונה מדדים הוא החלק בעמוד ההשקה שהכי דומה להצהרת יכולת ולא להצהרת עלות.

שניהם זמינים דרך אותו API תואם OpenAI דרך הקונסול של Sakana, ומסלול השדרוג מ-Fugu הקיים הוא שינוי פרמטר. חלות שתי הסתייגויות בנוגע לזמינות. דווח כי Fugu אינה זמינה באיחוד האירופי ובאזור הכלכלי האירופי (EEA) עד להשלמת עבודות GDPR, ואם זה עדיין תקף, הדבר מגביל היכן שניתן לפרוס כל אחד מהמודלים. ושניהם מערכות סגורות: אתם קונים נקודת קצה, והספק בוחר אילו מודלים עומדים מאחוריה — כולל, במקרה של Fugu Max, רשימה שהוא אינו חושף במלואה.

המלכוד: מתזמר שעדיין שוכר את החזית שלו

הביקורת החריפה ביותר על Fugu היא זו ש-Sakana מזמינה בכך שהיא מציגה אותה כתשתית ריבונות. שכבת תזמור שמנתבת בין ממשקי API של צד שלישי אינה מונעת את ביטולם של אותם ממשקי API. היא הופכת נקודת כשל יחידה לנקודה מגוונת, וזה שיפור אמיתי, אבל המודלים הבסיסיים עדיין שייכים למישהו אחר, עדיין נמצאים בהישג ידן של אותן בקרות יצוא ועדיין כפופים לאותם קיצוצי שירות פתאומיים. השותפות עם NVIDIA באוגוסט והתוספות של Nemotron הן התשובה הקונקרטית ביותר לכך עד כה — מודלים במשקלים פתוחים במאגר הם מודלים שאיש לא יכול לכבות — אבל Sakana לא אומרת כמה מהתעבורה של Fugu Max למעשה מגיעה אליהם.

יש פשרה שנייה, שקטה יותר. החלטות ניתוב מוסיפות השהיה ומבטלות את הדטרמיניזם. בקשה שמגיעה היום למודל קטן עשויה להגיע מחר למודל אחר אם המאגר או משקולות העלות משתנים, מה שהופך את ההתנהגות לקשה יותר לבדיקות רגרסיה וקשה יותר להסביר לכל מי שמבצע ביקורת על המערכת. התשובה של Sakana היא שהאורקסטרציה פנימית וה-API מתנהג כמו מודל יחיד. זה נכון בממשק ולא נכון מתחת לפני השטח, וצוותים עם דרישות שחזוריות מחמירות צריכים לבדוק זאת בקפידה לפני שזה נעשה קריטי לתלות בו.

אם אתם רוצים את החיסכון בעלויות בלי להפוך את המאגר לתלות היחידה שלכם, אותו דפוס עומד לרשותכם כדי להרכיב בעצמכם. ה-DSL לניתוב שלנו מאפשר לכם להגדיר פאנל של מודלים מאחורי נקודת קצה אחת ולהחליט איזה מהם מטפל באיזה סוג של בקשה, ומיזוג מודלים מריץ כמה מודלים על אותו פרומפט ומתאם בין התשובות במקרים שבהם ההסכמה חשובה יותר מהמחיר. מעבר אוטומטי בין ספקים (failover) פירושו שכאשר ספק נחלש — או נעלם — התעבורה עוברת למודל שאתם כבר סומכים עליו בלי שינוי בקוד. זו הגרסה השמרנית יותר של ההימור שסקאנה מבקשת מכם להמר באופן גורף.

Screenshot of the OrcaRouter models catalogue showing 196 models across 15 providers under one API key and one bill, an OpenAI-compatible chat completions endpoint, and per-model token rates including GPT-6 Astra at $10 input and $50 output, Claude Fable 5.1 at $10 and $50, Qwen3.8 Max at $2 and $6, and Gemini 3.8 Flash at $0.750 and $3.75.

כדאי להיות מדויקים לגבי מה שאנחנו כן מציעים ומה שלא. Sakana Fugu Max אינו נמצא בקטלוג שלנו — הוא אינו מודל שניתן לנתב אליו מצדנו, והוא פועל ב-API ובקונסולה של Sakana עצמה. הקטלוג שלנו הוא 196 מודלים מ-15 ספקים במפתח אחד ובחשבונית אחת, כאשר תעריפי התשלום לפי טוקן מודפסים על כל כרטיס וללא תוספת מחיר מעליהם. החפיפה הרלוונטית עם Fugu Max היא הרעיון, לא המלאי: שניהם טיעונים לכך שהתשובה הנכונה לשאלה "איזה מודל צריך לטפל בזה" היא בדרך כלל לא הגדול ביותר.

מי צריך לזוז, ומי צריך לחכות

Fugu Max הוא אחד מהשחרורים המעניינים יותר של החודש, בדיוק מפני שהוא לא מודל. אם אתם כבר על Sakana Fugu, השדרוג הוא שינוי של שורה אחת במחיר נמוך יותר ואין סיבה להתלבט. אם אתם מריצים תעבורה בנפח גבוה ומורכבות נמוכה על מודל בדרג ביניים ומשלמים עליו $10–$15 למיליון טוקני פלט, החישוב ש-Sakana מציעה שווה בדיקת בנצ'מרק משלכם — קחו שבוע של בקשות אמיתיות, הריצו אותן דרך Fugu Max, והשוו את האיכות למודל הנוכחי שלכם ולא לגרפי הפיזור.

אם אתה צריך מספרי בנצ'מרק שפורסמו לפני שאתה מתחייב, חכה. אין עדיין שום דבר בלתי תלוי על Fugu Max, ההוכחה של הספק עצמו היא גרף ולא טבלה, ואחד מששת מדדי הבנצ'מרק המרכזיים הוא של Sakana. זו לא סיבה לפסול אותו — זו סיבה לבחון אותו על התעבורה שלך, שהוא הבנצ'מרק היחיד שבכלל היה אמור לחזות את התוצאות שלך. ואם עומס העבודה שלך הוא אייג'נטי, ארוך טווח ויקר לטעות בו, המודל שכדאי להסתכל עליו בזוג הזה הוא Fugu Ultra v2, לא Fugu Max: הוא זה שצמודים לו מספרים.

שלנוה-DSL לניתוב מאפשר לך להגדיר פאנל של מודלים מאחורי נקודת קצה אחת ולקבוע איזה מהם מטפל באיזה סוג של בקשה, והיתוך מודלים מריץ כמה מודלים על אותו פרומפט ומתאים בין התשובות במקומות שבהם ההסכמה חשובה יותר מהמחיר.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית