
Fugu Max מול GPT-5.6 Sol: טענת התמחור הופנתה אל אמצע המשפחה
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
Fugu Max's price justification names a GPT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same OpenAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.
בדיקת הטענה מול המשפחה שאליה היא מצביעה
הנתון של Sakana, 40 עד 60 אחוז, ניתן לבדיקה, משום שלמודל שהיא מציינת יש תעריף מפורסם. GPT-5.6 Terra רשום במחיר $2.00 לקלט ו־$12.00 לפלט למיליון טוקנים. Fugu Max רשום במחיר $2.00 לקלט ו־$6.00 לפלט. בצעו את ההשוואה ושני דברים עולים ממנה. בפלט, $6.00 מול $12.00 הם קיצוץ של בדיוק 50 אחוז — בדיוק במרכז החלון המוצהר של 40 עד 60, וזה סימן שהחלון שורטט סביב ההשוואה הזו ולא התגלה מתוכה. בקלט, שני התעריפים זהים עד הסנט.
That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the GPT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.
• מחיר קלט — Fugu Max $2.00 ל־1M טוקנים לעומת GPT-5.6 Sol $4.00 ל־1M טוקנים
• מחיר פלט — Fugu Max $6.00 ל-1M טוקנים לעומת GPT-5.6 Sol $20.00 ל-1M טוקנים
• קלט במטמון — Fugu Max $0.25 ל-1M טוקנים לעומת GPT-5.6 Sol, שהמטמון שלו מתומחר כהנחה על תעריף הקלט הבסיסי
• הקשר — Fugu Max לא פורסם לעומת GPT-5.6 Sol 1M טוקנים
• תקרת פלט — Fugu Max לא פורסם לעומת GPT-5.6 Sol 128K טוקנים
• מודאליות קלט — Fugu Max לא פורסם לעומת GPT-5.6 Sol טקסט, תמונה וקובץ
• תגי יכולות — Fugu Max לא פורסמו לעומת GPT-5.6 Sol: ראייה, שימוש בכלים, מצב JSON, הסקה
• נקודות קצה — Fugu Max: ממשק יחיד תואם OpenAI לעומת Chat Completions של GPT-5.6 Sol ו‑Responses API
• נתוני בנצ'מרק — שישה ניצחונות של Fugu Max נטענים ללא ציונים לעומת נתוני ספק שפורסמו של GPT-5.6 Sol, כולל Terminal-Bench 2.0 ב־91.9% ו-SWE-bench Pro ב־64.6%
למה המדרגה האמצעית היא המדרגה הנכונה לתת לה שם
יש גרסה ניתנת להגנה של הבחירה של Sakana, והיא ראויה להיאמר לפני הביקורת. מתזמר שמנתב כל משימה אל המודל הרזה ביותר שמסוגל לבצעה אינו מתחרה עם דגם דגל בעבודת דגל. הוא מתחרה עם מודל בינוני בעבודה בינונית, ומציע לבצע תת-קבוצה ממנה בזול יותר. אם המסר הוא "רוב התעבורה שלך לא זקוקה ל-Sol", אז Terra הוא המשווה הנכון, כי Terra הוא מה שרוב הצוותים באמת פונים אליו כשהם לא רוצים לשלם מחירי Sol. השוואה לשכבה שהלקוח שלך היה רוכש אלמלא כן היא ישרה יותר מהשוואה למודל היקר ביותר הזמין.
הבעיה היא שאותו משפט טוען גם לביצועים "במרחק נגיעה מדגמי עילית". שני החצאים האלה של המסר השיווקי מושכים לכיוונים מנוגדים. אם Fugu Max הוא תחליף ל-Terra, אז המסגור כדגם עילית עושה עבודת שיווק שאין לו בסיס, מפני ש-Terra אינה ממוצבת במפורש כעילית — היא ממוצבת כשכבת ה"מספיק טוב". אם Fugu Max באמת נמצא במרחק נגיעה מ-Sol, אז ההשוואה במחירים הייתה צריכה להיעשות מול Sol, שם הפער הוא הגדול והמחמיא ביותר. הכרזה שמשמיעה את טענת היכולת האגרסיבית ואת השוואת המחירים השמרנית באותה פסקה מנסה לאכול את העוגה ולהשאיר אותה שלמה, ולקורא אין דרך לדעת איזה חצי נושא את המשקל.

שישה מבחני מידוד, בלי מספרים, ושם אחד שאמור להעלות שאלה
החצי העוסק ביכולות בפיץ' נשען על רשימה. Fugu Max "משיג את הציון הכולל הטוב ביותר" ב-Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench ו-SWEFish. שום ציונים לא מודפסים עבור אף אחד מהם. SWEFish הוא בנצ'מרק קידוד פנימי של Sakana עצמה, מה שאומר שאחד מששת הניצחונות מקבל ציון במבחן שהספק כתב ולא פרסם.
GPT-5.6 Sol מדווח נתונים. Sol מופיע עם 91.9% ב-Terminal-Bench 2.0 ועם 64.6% ב-SWE-bench Pro בנתוני השוואה של צד שלישי. שימו לב לאי-התאמת הגרסאות בבנצ'מרק הטרמינל: המספר שפורסם של Sol הוא עבור Terminal-Bench 2.0, בעוד Sakana טוענת לניצחון על 2.1, שהוא הערכה שונה ולא ניתן להעמיד אותו מולו. ראוי לסמן זאת, משום ששתי הטענות נראות סמוכות זו לזו בכותר, אך למעשה אינן ברות-השוואה.
ההשוואה הרלוונטית להתמודדות הזו תהיה Sol מול מודל Fugu בהערכה משותפת. דפי השוואה של צד שלישי אכן כוללים את GPT-5.6 Sol מול דור הבסיס של Sakana Fugu — Sol מוביל ב-Terminal-Bench 2.0 עם 91.9% מול 80.2% וב-SWE-bench Pro עם 64.6% מול 59% — אבל אלו נתונים של הדור המוקדם יותר, לא של Fugu Max, ואותם מקורות במפורש נמנעים מלהכריז על מנצח כולל כי הכיסוי של הבנצ'מרק המשותף דק מדי. אין שום השוואה מפורסמת בין Fugu Max ל-GPT-5.6 Sol. כל מי שטוען שיש כזו מסיק מסקנות מרחיקות לכת.
שום גורם בלתי תלוי לא העריך את Fugu Max, ולא קיימת רשומה ב-Artificial Analysis עבורו או עבור אף דגם Fugu. כל מספר בפרסום, כולל ששת הניצחונות, מקורו בספק. לעומת זאת, Sol זמין באופן כללי מאז 9 ביולי 2026 ומופיע בטבלאות דירוג של צד שלישי — רמת ביקורת חיצונית ש-Fugu Max לא זכה להזדמנות לקבל.
מה שאתה למעשה קונה בכל צד
הגדרת GPT-5.6 Sol היא עניין מוכר. הוא כולל חלון הקשר של 1M טוקנים, תקרת פלט של 128K, קלט טקסט, תמונות וקבצים, vision, שימוש בכלים, מצב JSON ו-reasoning כיכולות מתועדות, ושתי נקודות קצה — chat completions ו-responses API — כך שלשילוב קיים יש לאן לפנות. הוא מציג p50 של זמן עד לטוקן הראשון של 6.68 שניות על פני התעבורה שאנו משרתים, וזה איטי יותר מהמודלים המהירים ביותר בקטלוג שלנו, וכדאי לדעת זאת לפני שבונים עליו מוצר אינטראקטיבי.
הגדרת Fugu Max קרובה יותר לרכישת רמת שירות מאשר לרכישת מודל. אתה מקבל נקודת קצה אחת תואמת OpenAI, שינוי פרמטר בשורה אחת כדי לעבור אליה מ-Fugu קודם, ומתאם שמחליט אילו מודלים לקרוא. מה שאתה לא מקבל, מדף השחרור, הוא חלון הקשר, תקרת פלט, רשימת מודאליות, נתון השהיה או ציון בנצ'מרק. החלטות הניתוב של המתאם אינן נחשפות מעצם התכנון. מאגר המודלים התרחב במהדורה הזו כך שיכלול מודלים עם משקלים פתוחים ומודלים מיוחדים, כאשר משפחת NVIDIA Nemotron מוזכרת דרך שיתוף פעולה עם NVIDIA, ומלבד זאת אינו נחשף.
הנימוק המוצהר של Sakana לחוסר השקיפות הזה מוצדק — מאגר בלתי תלוי בספק שניתן להחליפו הוא הגנה מפני הוצאה משימוש, שינויי מחירים ונסיגות אזוריות. זהו גידור אמיתי, ותעריף הקלט המטמון של $0.25 מרמז ש-Sakana מצפה לעומסי עבודה עם הקשר ארוך וחזרתיות גבוהה, שבהם הגידור הזה יהיה המשמעותי ביותר. אבל זה כן אומר שהמפרט שאתה רוכש הוא הבטחה לגבי שרשרת אספקה ולא תיאור של מוצר.

איך להריץ את הבדיקה
הדרך הנכונה להכריע בזה היא לא לקרוא את העמוד של אף אחד מהספקים. קחו דגימה מהתעבורה שלכם — כמה מאות בקשות אמיתיות, ובאופן אידיאלי כולל אלו שהצוות שלכם מעביר כרגע לדרג גבוה יותר — והריצו אותן מול שתי נקודות הקצה כשחשבונאות הטוקנים פועלת. חשבו את העלות שלהן לפי טוקנים למשימה שהושלמה ולא לפי טוקנים לקריאה, קבעו תקציב פלט לפני שתתחילו כדי ש-fan-out לא יפתיע אתכם, ומדדו איכות לפי האם אדם נוסף מסכים שהתשובה הייתה מקובלת. הניסוי הזה עונה על השאלה בתוך שבוע ועולה מעט.
החיכוך הוא ש-Fugu Max לא נמצא ב-OrcaRouter. הוא מגיע אליכם דרך ה-API התואם ל-OpenAI של Sakana עצמה וכמה פלטפורמות צד שלישי, מה שאומר אינטגרציה שנייה, סט הרשאות שני וחשבונית שנייה. GPT-5.6 Sol נמצא בקטלוג שלנו במחיר המחירון של OpenAI עם 0% תוספת — תעריף הספק מועבר כמו שהוא ולא בתוספת, כך ששינוי בתמחור של OpenAI נכנס לתוקף במפתח הקיים שלכם באותו יום, עם מעבר אוטומטי בין נתיבי ספקים כשאחד מהם מוגבל בקצב או לא זמין. הוא יושב מאחורי אותו מפתח כמו יותר מ-200 מודלים אחרים, כך שכשהפיילוט מסתיים אתם שומרים על האינטגרציה ומשנים מחרוזת אחת.
השורה התחתונה
GPT-5.6 Sol מנצח בהשוואה שסאקאנה סירבה לערוך. הוא עולה פי שניים על הקלט ויותר מפי שלושה על הפלט, ובתמורה מקבלים חלון הקשר מפורסם, תקרת פלט של 128K, קלט מולטימודלי מתועד, תגיות יכולות בעלות שם, שתי נקודות קצה, ובנצ'מרקים של הספק שצדדים שלישיים קיבלו חודשים לבחון. אם העבודה שלכם היא מהסוג שלשמו נבנה Sol — הסקה רב-שלבית עמוקה, הנדסת תוכנה בקנה מידה גדול, משימות סוכניות בטווח ארוך — פער המחיר הוא המחיר של לקנות משהו שאתם יכולים לפרט.
Fugu Max מנצח בהימור צר ומעניין באמת, והוא הזול מבין השניים בפער עצום: 50 אחוז פחות מ-GPT-5.6 Terra בפלט, 70 אחוז פחות מ-Sol, עם שיעור המטמון הנמוך ביותר מבין שני כרטיסי התעריפים. אם התעבורה שלכם בהיקף גבוה, טקסטואלית בלבד, ניתנת לאימות, ולרובה אינה זקוקה להסקה ברמת הדגל, אז מתזמר שמנתב למודל הרזה המספק היא תכנון קוהרנטי, ותעריף הפלט של $6.00 הוא המקום שבו טמון הערך. קחו את המסגור של ההשקה כפשוטו והריצו פיילוט שלה כתחליף ל-Terra ולא ל-Sol — ואם אתם רוצים את הדגל עם מחיר המחירון של הספק כפי שהוא, בלי שינויים, GPT-5.6 Sol נמצא במרחק מפתח אחד ב-OrcaRouter.

השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
