כרטיס כותרת הירו עבור "Fugu Max מול GPT-5.6 Sol" עם כותרת המשנה "טענת התמחור הייתה מכוונת לאמצע המשפחה", שלושה תגים עגולים עם הכיתוב "$6.00 מול $20.00 פלט", "טענת 40-60% מול Terra", "שישה ניצחונות, בלי ציונים", שורת פוטר עם הכיתוב "Sakana AI מול OpenAI - ספטמבר 2026", והלוגו של OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

Fugu Max מול GPT-5.6 Sol: טענת התמחור הופנתה אל אמצע המשפחה

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Fugu Max's price justification names a G​PT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same Ope​nAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.

בדיקת הטענה מול המשפחה שאליה היא מצביעה

הנתון של Sakana, 40 עד 60 אחוז, ניתן לבדיקה, משום שלמודל שהיא מציינת יש תעריף מפורסם. GPT-5.6 Terra רשום במחיר $2.00 לקלט ו־$12.00 לפלט למיליון טוקנים. Fugu Max רשום במחיר $2.00 לקלט ו־$6.00 לפלט. בצעו את ההשוואה ושני דברים עולים ממנה. בפלט, $6.00 מול $12.00 הם קיצוץ של בדיוק 50 אחוז — בדיוק במרכז החלון המוצהר של 40 עד 60, וזה סימן שהחלון שורטט סביב ההשוואה הזו ולא התגלה מתוכה. בקלט, שני התעריפים זהים עד הסנט.

That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the G​PT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.

• מחיר קלט — Fugu Max ‏$2.00 ל־1M טוקנים לעומת GPT-5.6 Sol ‏$4.00 ל־1M טוקנים

• מחיר פלט — Fugu Max $6.00 ל-1M טוקנים לעומת GPT-5.6 Sol $20.00 ל-1M טוקנים

• קלט במטמון — Fugu Max $0.25 ל-1M טוקנים לעומת GPT-5.6 Sol, שהמטמון שלו מתומחר כהנחה על תעריף הקלט הבסיסי

• הקשר — Fugu Max לא פורסם לעומת GPT-5.6 Sol 1M טוקנים

• תקרת פלט — Fugu Max לא פורסם לעומת GPT-5.6 Sol 128K טוקנים

• מודאליות קלט — Fugu Max לא פורסם לעומת GPT-5.6 Sol טקסט, תמונה וקובץ

• תגי יכולות — Fugu Max לא פורסמו לעומת GPT-5.6 Sol: ראייה, שימוש בכלים, מצב JSON, הסקה

• נקודות קצה — Fugu Max: ממשק יחיד תואם OpenAI לעומת Chat Completions של GPT-5.6 Sol ו‑Responses API

• נתוני בנצ'מרק — שישה ניצחונות של Fugu Max נטענים ללא ציונים לעומת נתוני ספק שפורסמו של GPT-5.6 Sol, כולל Terminal-Bench 2.0 ב־91.9% ו-SWE-bench Pro ב־64.6%

למה המדרגה האמצעית היא המדרגה הנכונה לתת לה שם

יש גרסה ניתנת להגנה של הבחירה של Sakana, והיא ראויה להיאמר לפני הביקורת. מתזמר שמנתב כל משימה אל המודל הרזה ביותר שמסוגל לבצעה אינו מתחרה עם דגם דגל בעבודת דגל. הוא מתחרה עם מודל בינוני בעבודה בינונית, ומציע לבצע תת-קבוצה ממנה בזול יותר. אם המסר הוא "רוב התעבורה שלך לא זקוקה ל-Sol", אז Terra הוא המשווה הנכון, כי Terra הוא מה שרוב הצוותים באמת פונים אליו כשהם לא רוצים לשלם מחירי Sol. השוואה לשכבה שהלקוח שלך היה רוכש אלמלא כן היא ישרה יותר מהשוואה למודל היקר ביותר הזמין.

הבעיה היא שאותו משפט טוען גם לביצועים "במרחק נגיעה מדגמי עילית". שני החצאים האלה של המסר השיווקי מושכים לכיוונים מנוגדים. אם Fugu Max הוא תחליף ל-Terra, אז המסגור כדגם עילית עושה עבודת שיווק שאין לו בסיס, מפני ש-Terra אינה ממוצבת במפורש כעילית — היא ממוצבת כשכבת ה"מספיק טוב". אם Fugu Max באמת נמצא במרחק נגיעה מ-Sol, אז ההשוואה במחירים הייתה צריכה להיעשות מול Sol, שם הפער הוא הגדול והמחמיא ביותר. הכרזה שמשמיעה את טענת היכולת האגרסיבית ואת השוואת המחירים השמרנית באותה פסקה מנסה לאכול את העוגה ולהשאיר אותה שלמה, ולקורא אין דרך לדעת איזה חצי נושא את המשקל.

A two-column scoreboard titled "Fugu Max vs GPT-5.6 Sol - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Context not published, Modality not published, Benchmarks six wins with no figures. Right column GPT-5.6 Sol: Output price $20.00 / 1M, Input price $4.00 / 1M, Cached input discount on base rate, Context 1M tokens with 128K output, Modality text, image and file, Benchmarks 91.9% on Terminal-Bench 2.0. Footer reading "Fugu Max figures vendor-reported by Sakana AI. Sakana's 40-60% output claim names GPT-5.6 Terra at $2.00 / $12.00, not Sol.", with the OrcaRouter logo bottom-right.

שישה מבחני מידוד, בלי מספרים, ושם אחד שאמור להעלות שאלה

החצי העוסק ביכולות בפיץ' נשען על רשימה. Fugu Max "משיג את הציון הכולל הטוב ביותר" ב-Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench ו-SWEFish. שום ציונים לא מודפסים עבור אף אחד מהם. SWEFish הוא בנצ'מרק קידוד פנימי של Sakana עצמה, מה שאומר שאחד מששת הניצחונות מקבל ציון במבחן שהספק כתב ולא פרסם.

GPT-5.6 Sol מדווח נתונים. Sol מופיע עם 91.9% ב-Terminal-Bench 2.0 ועם 64.6% ב-SWE-bench Pro בנתוני השוואה של צד שלישי. שימו לב לאי-התאמת הגרסאות בבנצ'מרק הטרמינל: המספר שפורסם של Sol הוא עבור Terminal-Bench 2.0, בעוד Sakana טוענת לניצחון על 2.1, שהוא הערכה שונה ולא ניתן להעמיד אותו מולו. ראוי לסמן זאת, משום ששתי הטענות נראות סמוכות זו לזו בכותר, אך למעשה אינן ברות-השוואה.

ההשוואה הרלוונטית להתמודדות הזו תהיה Sol מול מודל Fugu בהערכה משותפת. דפי השוואה של צד שלישי אכן כוללים את GPT-5.6 Sol מול דור הבסיס של Sakana Fugu — Sol מוביל ב-Terminal-Bench 2.0 עם 91.9% מול 80.2% וב-SWE-bench Pro עם 64.6% מול 59% — אבל אלו נתונים של הדור המוקדם יותר, לא של Fugu Max, ואותם מקורות במפורש נמנעים מלהכריז על מנצח כולל כי הכיסוי של הבנצ'מרק המשותף דק מדי. אין שום השוואה מפורסמת בין Fugu Max ל-GPT-5.6 Sol. כל מי שטוען שיש כזו מסיק מסקנות מרחיקות לכת.

שום גורם בלתי תלוי לא העריך את Fugu Max, ולא קיימת רשומה ב-Artificial Analysis עבורו או עבור אף דגם Fugu. כל מספר בפרסום, כולל ששת הניצחונות, מקורו בספק. לעומת זאת, Sol זמין באופן כללי מאז 9 ביולי 2026 ומופיע בטבלאות דירוג של צד שלישי — רמת ביקורת חיצונית ש-Fugu Max לא זכה להזדמנות לקבל.

מה שאתה למעשה קונה בכל צד

הגדרת GPT-5.6 Sol היא עניין מוכר. הוא כולל חלון הקשר של 1M טוקנים, תקרת פלט של 128K, קלט טקסט, תמונות וקבצים, vision, שימוש בכלים, מצב JSON ו-reasoning כיכולות מתועדות, ושתי נקודות קצה — chat completions ו-responses API — כך שלשילוב קיים יש לאן לפנות. הוא מציג p50 של זמן עד לטוקן הראשון של 6.68 שניות על פני התעבורה שאנו משרתים, וזה איטי יותר מהמודלים המהירים ביותר בקטלוג שלנו, וכדאי לדעת זאת לפני שבונים עליו מוצר אינטראקטיבי.

הגדרת Fugu Max קרובה יותר לרכישת רמת שירות מאשר לרכישת מודל. אתה מקבל נקודת קצה אחת תואמת OpenAI, שינוי פרמטר בשורה אחת כדי לעבור אליה מ-Fugu קודם, ומתאם שמחליט אילו מודלים לקרוא. מה שאתה לא מקבל, מדף השחרור, הוא חלון הקשר, תקרת פלט, רשימת מודאליות, נתון השהיה או ציון בנצ'מרק. החלטות הניתוב של המתאם אינן נחשפות מעצם התכנון. מאגר המודלים התרחב במהדורה הזו כך שיכלול מודלים עם משקלים פתוחים ומודלים מיוחדים, כאשר משפחת NVIDIA Nemotron מוזכרת דרך שיתוף פעולה עם NVIDIA, ומלבד זאת אינו נחשף.

הנימוק המוצהר של Sakana לחוסר השקיפות הזה מוצדק — מאגר בלתי תלוי בספק שניתן להחליפו הוא הגנה מפני הוצאה משימוש, שינויי מחירים ונסיגות אזוריות. זהו גידור אמיתי, ותעריף הקלט המטמון של $0.25 מרמז ש-Sakana מצפה לעומסי עבודה עם הקשר ארוך וחזרתיות גבוהה, שבהם הגידור הזה יהיה המשמעותי ביותר. אבל זה כן אומר שהמפרט שאתה רוכש הוא הבטחה לגבי שרשרת אספקה ולא תיאור של מוצר.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

איך להריץ את הבדיקה

הדרך הנכונה להכריע בזה היא לא לקרוא את העמוד של אף אחד מהספקים. קחו דגימה מהתעבורה שלכם — כמה מאות בקשות אמיתיות, ובאופן אידיאלי כולל אלו שהצוות שלכם מעביר כרגע לדרג גבוה יותר — והריצו אותן מול שתי נקודות הקצה כשחשבונאות הטוקנים פועלת. חשבו את העלות שלהן לפי טוקנים למשימה שהושלמה ולא לפי טוקנים לקריאה, קבעו תקציב פלט לפני שתתחילו כדי ש-fan-out לא יפתיע אתכם, ומדדו איכות לפי האם אדם נוסף מסכים שהתשובה הייתה מקובלת. הניסוי הזה עונה על השאלה בתוך שבוע ועולה מעט.

החיכוך הוא ש-Fugu Max לא נמצא ב-OrcaRouter. הוא מגיע אליכם דרך ה-API התואם ל-OpenAI של Sakana עצמה וכמה פלטפורמות צד שלישי, מה שאומר אינטגרציה שנייה, סט הרשאות שני וחשבונית שנייה. GPT-5.6 Sol נמצא בקטלוג שלנו במחיר המחירון של Ope​nAI עם 0% תוספת — תעריף הספק מועבר כמו שהוא ולא בתוספת, כך ששינוי בתמחור של Ope​nAI נכנס לתוקף במפתח הקיים שלכם באותו יום, עם מעבר אוטומטי בין נתיבי ספקים כשאחד מהם מוגבל בקצב או לא זמין. הוא יושב מאחורי אותו מפתח כמו יותר מ-200 מודלים אחרים, כך שכשהפיילוט מסתיים אתם שומרים על האינטגרציה ומשנים מחרוזת אחת.

השורה התחתונה

GPT-5.6 Sol מנצח בהשוואה שסאקאנה סירבה לערוך. הוא עולה פי שניים על הקלט ויותר מפי שלושה על הפלט, ובתמורה מקבלים חלון הקשר מפורסם, תקרת פלט של 128K, קלט מולטימודלי מתועד, תגיות יכולות בעלות שם, שתי נקודות קצה, ובנצ'מרקים של הספק שצדדים שלישיים קיבלו חודשים לבחון. אם העבודה שלכם היא מהסוג שלשמו נבנה Sol — הסקה רב-שלבית עמוקה, הנדסת תוכנה בקנה מידה גדול, משימות סוכניות בטווח ארוך — פער המחיר הוא המחיר של לקנות משהו שאתם יכולים לפרט.

Fugu Max מנצח בהימור צר ומעניין באמת, והוא הזול מבין השניים בפער עצום: 50 אחוז פחות מ-GPT-5.6 Terra בפלט, 70 אחוז פחות מ-Sol, עם שיעור המטמון הנמוך ביותר מבין שני כרטיסי התעריפים. אם התעבורה שלכם בהיקף גבוה, טקסטואלית בלבד, ניתנת לאימות, ולרובה אינה זקוקה להסקה ברמת הדגל, אז מתזמר שמנתב למודל הרזה המספק היא תכנון קוהרנטי, ותעריף הפלט של $6.00 הוא המקום שבו טמון הערך. קחו את המסגור של ההשקה כפשוטו והריצו פיילוט שלה כתחליף ל-Terra ולא ל-Sol — ואם אתם רוצים את הדגל עם מחיר המחירון של הספק כפי שהוא, בלי שינויים, GPT-5.6 Sol נמצא במרחק מפתח אחד ב-OrcaRouter.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol, captured September 11, 2026, English UI), showing the Featured badge, the openai/gpt-5.6-sol model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-09, the /v1/chat/completions and /v1/responses endpoints, the pricing tiles reading INPUT $4.00 and OUTPUT $20.00 per 1M tokens with p50 TTFT 6.68s and 153.0M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית