כרטיס כותרת הירו עם הכיתוב 'Fugu Max מול Qwen3.8-Max', עם כותרת המשנה 'אותו מחיר, אותו מבחן, מספר אחד', שלושה תגי גלולה עם הכיתוב '$2.00 / $6.00 בשניהם', 'Terminal Bench 2.1: 86.6 מול לא צוין' ו'ציון עצמאי: אין מול 40', שורת פוטר עם הכיתוב 'Sakana AI, ספטמבר 2026 מול Alibaba, אוגוסט 2026', והלוגו של OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

Fugu Max מול Qwen3.8-Max: אותו מחיר, אותו בנצ'מרק, מספר מפורסם אחד

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Fugu Max ו-Qwen3.8-Max מופיעים באותו תעריף: 2.00 דולר למיליון אסימוני קלט ו-6.00 דולר למיליון אסימוני פלט. Sakana AI השיקה את Fugu Max ב-11 בספטמבר 2026 ו-Ali​baba מספקת את Qwen3.8-Max מאז תחילת אוגוסט, ושני הספקים הגיעו למחירון זהה מכיוונים מנוגדים — האחד מתמחר מדיניות ניתוב, והשני מתמחר מודל בעל 2.4 טריליון פרמטרים. התיקו מוציא את המחיר מההחלטה לחלוטין, וזה נקי באופן יוצא דופן. מה שנשאר הוא ראיות, ושם הצדדים נבדלים יותר מאשר בכל מקום אחר. שתי טבלאות הספקים מזכירות את Terminal Bench 2.1. Ali​baba מציגה 86.6 עבור Qwen3.8-Max. Sakana אומרת ש-Fugu Max משיג את הציון הכולל הטוב ביותר ב-Terminal Bench 2.1 ואינה מציגה נתון כלל — לא עבור המבחן הזה ולא עבור חמשת האחרים שהיא טוענת לזכות בהם.

המדד היחיד ששני הצדדים מציינים

זה כל המפגש דחוס לשורה אחת, ולכן כדאי לדייק לגביו.

ההודעה של Sakana מפרטת שישה מבחנים שבהם Fugu Max משיג את הציון הכולל הטוב ביותר: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench ו-SWEFish. חמישה מהם הם מבחנים ציבוריים מוכרים, והשישי, SWEFish, הוא מבחן הקידוד של Sakana עצמה. עבור אף אחד מהשישה ההודעה אינה מציינת ערך, פער או מספר של מתחרה שיוצב לצידו. הטענה המקבילה — ש-Fugu Max מרחיב את חזית הפרטו של עלות-ביצועים בשבעה מתוך עשרה מבחנים — היא אף היא אמירה על מיקום בגרף ולא על נקודה על ציר.

השורות שפרסמה Alibaba עבור Qwen3.8-Max כוללות את Terminal-Bench 2.1 בציון 86.6, OSWorld-Verified בציון 86.1, GPQA Diamond בציון 92.6 ו-SWE-bench Pro בציון 67.7. הכול מדווח על ידי הספק, הכול מספרים. לכן, במבחן היחיד ששתי החברות בחרו לציין בשמו, אחת פרסמה נתון והאחרת פרסמה דירוג. אי אפשר להסיק מכך איזו מערכת טובה יותר — "הטובה ביותר בסך הכול" של Sakana יכולה להיות 91 או 87. מה שכן אפשר להסיק הוא שנכון למועד הפרסום אין ראיות ציבוריות שעונות על השאלה, והספק שמציג את הטענה הגדולה יותר הוא זה שנמנע מלכמת אותה.

מחירים זהים, מבנה הפוך

• קלט — Fugu Max $2.00 לכל מיליון טוקנים לעומת Qwen3.8-Max $2.00 לכל מיליון טוקנים

• פלט — Fugu Max $6.00 לכל 1M טוקנים לעומת Qwen3.8-Max $6.00 לכל 1M טוקנים

• קלט במטמון — Fugu Max $0.25 לכל 1M טוקנים לעומת Qwen3.8-Max $0.25 לכל 1M טוקנים, ו-Artificial Analysis מודדת באופן עצמאי הנחת מטמון של 88 אחוזים בצד של Qwen

• תוספת תשלום עבור פרומפט ארוך — Fugu Max לא צוינה דרגה בפרסום לעומת Qwen3.8-Max תעריף אחיד עד החלון ללא תוספת

• הקשר ופלט — Fugu Max לא פרסם אף נתון, לעומת Qwen3.8-Max עם חלון של 1M טוקנים ותקרת פלט של כ-128K

• מודאליות קלט — טקסט של Fugu Max, עם היכולות של המאגר עצמו מאחוריו, לעומת טקסט, תמונה, וידאו ו-PDF של Qwen3.8-Max

• ארכיטקטורה — Fugu Max הוא מתאם מאומן מעל מאגר שלא נחשף, שהורחב עבור Max עם מודלים במשקלים פתוחים ומודלים ייעודיים, כולל משפחת NVIDIA Nemotron, באמצעות שיתוף פעולה עם NVIDIA, לעומת Qwen3.8-Max — מודל אחד של תערובת מומחים דלילה (sparse mixture-of-experts) עם כ-2.4 טריליון פרמטרים בסך הכול וכ-95 מיליארד פעילים לכל טוקן

• משקלים — Fugu Max סגור, חברות במאגר אינה נחשפת מעצם התכנון לעומת Qwen3.8-Max עם משקלים פתוחים שפורסמו עבור צ'קפוינט מדרגת Max תחת רישיון מותאם

• הערכה בלתי תלויה — עבור Fugu Max לא פורסמה כל הערכה, ולא קיים עמוד Artificial Analysis עבור אף מודל Fugu, לעומת Qwen3.8-Max, רשומה חיה ב-Artificial Analysis עם נתוני מהירות, מילוליות ועלות-למשימה שפורסמו

ארבע מהשורות האלה מציגות "לא פורסם" בצד של Fugu ונושאות נתון בצד של Qw​en. כאשר התעריפים זהים, זו כל ההשוואה: אותו כסף קונה מערכת אחת שאפשר לתאר ואחת שאי אפשר.

A two-column scoreboard titled 'Fugu Max vs Qwen3.8-Max - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, Terminal Bench 2.1 best with no figure, evidence vendor-reported only. Qwen3.8-Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context 1M with a 128K output ceiling, Terminal Bench 2.1 at 86.6, evidence Artificial Analysis Index 40 and $2.67 per task. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Qwen3.8-Max rows Alibaba-reported and per Artificial Analysis.' OrcaRouter logo bottom-right.

מאחורי עמודה אחת עומד צד שלישי

Artificial Analysis מדרגת את Qwen3.8-Max בציון 40 במדד ה-Intelligence Index v4.3 המחושב מחדש, והוא מדורג במקום ה-30 מתוך 200, בעלות של $2.67 לכל משימת Intelligence Index ו-37.8 טוקני פלט לשנייה — איטי מספיק כדי להיות מדורג במקום ה-154 מתוך 200 במהירות. אותה רשומה מתעדת 180 מיליון טוקני פלט שנוצרו לאורך המדד, יותר מפי שניים מ-89 מיליון של המודל החציוני, והנחת מטמון של 88 אחוזים.

שני תיקונים חלים לפני שכל זה מצוטט. הראשון הוא שהנתון הנפוץ של 58 — או 58.1, או 58.4 — עבור Qwen3.8-Max הוא מלפני ש-Artificial Analysis כיילה מחדש את המדד בספטמבר 2026, והעמוד החי נושא את תג "Updated" שמסמן ציון שנוסח מחדש. הכתבות הישנות יותר נשאו גם מס מאמץ שונה מהסקאלה הקודמת, 64 סיבובים למשימה לעומת 14 בדור Qwen הקודם בכ-$1.14 למשימת Intelligence Index; העמוד הנוכחי מציג $2.67. השני הוא אזהרה אמיתית ולא תוצר לוואי של סקאלה: Artificial Analysis מדדה בנפרד עלייה בשיעור ההזיות של Qwen3.8-Max מ-23 אחוז ל-40 אחוז לעומת הדור הקודם. עבור מודל שמשווק לעבודה אוטונומית רב-שלבית, זו עלות שמתקצבים עבורה במאמתים, לא הערת שוליים.

ל-Fugu Max אין רשומה עצמאית מכל סוג שהוא. כל נתון המשויך אליו מקורו ב-Sakana, ונכון לכתיבת שורות אלו לא קיים דף של Artificial Analysis עבור Fugu Max או עבור אף אחד מהדגמים האחים שלו. זו אינה האשמה — דגם שיצא לפני שעות לא יזכה לסיקור מצד צד שלישי — אבל המשמעות היא ששתי העמודות אינן ניתנות לבדיקה באותה מידה, וכך זה יישאר עד שמישהו מחוץ ל-Sakana יריץ את הדגם.

שתי דרכים להוציא יותר מדי

שתי המערכות האלה הרחיקו את עלות התשובה מעלות האסימון, והן עושות זאת בכיוונים מנוגדים. Qwen3.8-Max חסכנית באסימונים ופזרנית בתשובה: 180 מיליון אסימוני פלט ב-Intelligence Index, כפול מהחציון, ב-2.67 דולר למשימה. היא עובדת לאורך ולא בגודל, והנחת המטמון של 88 אחוז היא הידית ששולטת בחשבון — הרצת סוכן ארוכה שממשיכה לקרוא מחדש את אותו הקשר נשארת זולה, בעוד אחת שממשיכה לייצר טקסט חדש לא.

Fugu Max יקר לפי טוקן ובלתי צפוי לפי התשובה. המתאם שלו מוליד סוכני משנה, שכל אחד מהם כותב טקסט חשיבה ופלט המחויב ב-$6.00 למיליון, בתוספת הסינתזה של המתאם עצמו. Sakana מתחייבת שריצות מרובות סוכנים מחויבות בתעריף משולב אחד הצמוד למודל המשתתף ברמה הגבוהה ביותר, ושהוספת סוכנים אינה מכפילה את החשבון, מה שמסיר את התפוצצות ההתפשטות במקרה הגרוע שהופכת מערכות מרובות סוכנים נאיביות לבלתי משתלמות. זה לא מסיר את הנפח. ובשאלת הנפח, ההודעה שותקת באופן שמשנה: הסיקור של Sakana עצמה מציין שהחלפת מודלים באמצע משימה עשויה להפחית את השימוש החוזר במטמון ההקשר וליצור טוקני תזמור נוספים, ומאשר שהחברה לא חשפה את שיעור הפגיעות במטמון של Max או את עלות הטוקנים הכוללת למשימה.

אז אותו שיעור של $2.00 / $6.00 הוא מספר צפוי מצד אחד, ומכפיל בלתי חסום עם רצפה מצד שני. המילוליות של Qwen3.8-Max ניתנת למדידה לפני שאתם מתחייבים; זו של Fugu Max לא.

מבחן פתח המילוט

כאן הטיעון הרגיל בדבר נעילה מתהפך, וזה הדבר המועיל ביותר בציוות.

הטיעון של Sakana בעד Fugu Max הוא חוסן. מאגר שמקיף מודלים במשקלים פתוחים ומודלים ייעודיים, שהורחב עבור Max עם משפחת NVIDIA Nemotron, משמעו ששום הפסקת תמיכה, תמחור מחדש או נסיגה אזורית מצד ספק חזית בודד לא יכולים להפיל את המוצר שלך — גידור אמיתי, כזה שהחברה מצהירה במפורש שהיא מוכרת. אבל את הגידור הזה אי אפשר לאמת מבחוץ. אתה לא יכול לראות את המאגר, לא יכול לבחור להכניס או להוציא חבר ממנו, לא יכול לארח בעצמך שום חלק ממנו, ולא יכול להריץ אותו ב-EU/EEA בכלל. הבטחה לגבי מאגר שאינך רשאי לבדוק היא ערובה חלשה ממה שהיא נשמעת.

Qwen3.8-Max מציג את הטיעון בכיוון ההפוך. זהו מודל של ספק אחד, ולכן הוא חשוף להחלטותיו של ספק אחד — אך Alibaba פרסמה משקלים פתוחים עבור נקודת הצ'ק-פוינט Qwen3.8-2.4T-A95B מדרגת Max תחת רישיון מותאם, מה שאומר שפתח המילוט הוא אמיתי ולא רק רטורי: אם התמחור או התנאים ישתנו, ניתן להריץ את המודל מהתשתית שלכם. עבור צוות שהפחד האמיתי שלו הוא שספק ימשוך את השטיח מתחת לרגליו, צ'ק-פוינט שניתן להוריד עדיף על תיאור של מאגר.

מתקשר לאחד מהם

Qwen3.8-Max נמצא בקטלוג שלנו ב-$2.00 לקלט ו-$6.00 לפלט למיליון טוקנים, שזה מחיר המחירון של Ali​baba עם 0% תוספת שעוברת הלאה, כך ששינוי מחיר מצד הספק נוחת על אותו מפתח באותו יום ולא לפי לוח זמנים של מיגרציה. הוא תואם OpenAI על אותו base URL כמו שאר הקטלוג, מה שאומר שאתה יכול להציב אותו מאחורי כלל ניתוב מותנה, שרשרת failover, או פאנל מיזוג מודלים בלי חוזה נוסף או שינוי בקוד — ו-failover אוטומטי מכסה נתיב ספק שמוגבל בקצב או מדורדר. הוא העביר 127.7 מיליון טוקנים דרך השער בשבעת הימים האחרונים.

Fugu Max אינו זמין ב-OrcaRouter. הוא מגיע אליך דרך ה-API התואם ל-OpenAI של Sakana עצמה ומספר פלטפורמות צד שלישי, והחברה אומרת שאינטגרציית Fugu קיימת משתדרגת בשינוי פרמטר של שורה אחת. מכיוון ששניהם מדברים באותו פורמט בקשה, הדרך הזולה ביותר ליישב את פער הבנצ'מרק היא להפסיק לחכות שסקאנה תפרסם אותו: להריץ את שניהם מאחורי דגל אחד על עומס העבודה שלך ולספור אסימוני פלט לכל משימה שהושלמה. זו המדידה שאף אחד מהספקים לא סיפק.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the argument that the industry has raced along a single axis of bigger and more expensive foundation models while the frontier that matters is two-dimensional, capability on one axis and cost on the other.

איזה מהם, ומתי

Qwen3.8-Max הוא הבחירה שאפשר לבחון, לתמחר ולזנוח. לפי אותו מחירון בדיוק הוא נותן לך חלון של מיליון טוקנים בלי תוספת מחיר על פרומפטים ארוכים, קלט של תמונות, וידאו ו-PDF, צ'קפוינט בדרגת Max להורדה, רשומה עצמאית חיה שמודדת את הדברים שמשפיעים על החשבון שלך, והנחה של 88 אחוז על קלט שמור במטמון. העלויות שלו ספציפיות באותה מידה: הוא איטי בקצב של 37.8 טוקנים לשנייה, מדורג סמוך לתחתית התחום במהירות, הוא מפורט מאוד באופן קיצוני עם 180 מיליון טוקנים במדד, ושיעור ההזיות הנמדד שלו בערך הוכפל לעומת הדור הקודם — וזה חשש רציני בדיוק בגלל העבודה האוטונומית שלשמה הוא נמכר. נצלו את הנחת המטמון במלואה והקצו תקציב למאמת.

Fugu Max הוא ההימור שתיאום עדיף על יכולת. אם העבודה שלך היא ארוכת טווח וניתנת לבדיקה, ומתאם שמפעיל מאמת מסיים משימות שמודל בודד נכשל בהן פעמיים, אז טוקני התזמור זולים יותר מהניסיונות החוזרים ולוח התעריפים הזהה אינו תיקו כלל. מה שאתה קונה הוא התמדה, במערכת שאינך יכול לנעוץ את המאגר שלה, שחלון ההקשר שלה אינו מפורסם, ושש ניצחונותיה בבנצ'מרק אין להם ערכים מצורפים — מספק שבחר לנקוב בשם המבחן ולהסתיר את המספר.

שני המוצרים עולים אותו מחיר לכל טוקן. רק אחד מהם אומר לך מה אתה מקבל תמורתו.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (English UI, captured September 11, 2026), showing the Featured badge, the identifier qwen/qwen3.8-max, by Qwen dated 2026-08-03, vision, tools, JSON and reasoning capability tags, a 1M-token context window with text, image and video input, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, a p50 TTFT of 10.00 seconds, traffic of 127.7 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית