
Fugu Max מול Qwen3.8-Max: אותו מחיר, אותו בנצ'מרק, מספר מפורסם אחד
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
Fugu Max ו-Qwen3.8-Max מופיעים באותו תעריף: 2.00 דולר למיליון אסימוני קלט ו-6.00 דולר למיליון אסימוני פלט. Sakana AI השיקה את Fugu Max ב-11 בספטמבר 2026 ו-Alibaba מספקת את Qwen3.8-Max מאז תחילת אוגוסט, ושני הספקים הגיעו למחירון זהה מכיוונים מנוגדים — האחד מתמחר מדיניות ניתוב, והשני מתמחר מודל בעל 2.4 טריליון פרמטרים. התיקו מוציא את המחיר מההחלטה לחלוטין, וזה נקי באופן יוצא דופן. מה שנשאר הוא ראיות, ושם הצדדים נבדלים יותר מאשר בכל מקום אחר. שתי טבלאות הספקים מזכירות את Terminal Bench 2.1. Alibaba מציגה 86.6 עבור Qwen3.8-Max. Sakana אומרת ש-Fugu Max משיג את הציון הכולל הטוב ביותר ב-Terminal Bench 2.1 ואינה מציגה נתון כלל — לא עבור המבחן הזה ולא עבור חמשת האחרים שהיא טוענת לזכות בהם.
המדד היחיד ששני הצדדים מציינים
זה כל המפגש דחוס לשורה אחת, ולכן כדאי לדייק לגביו.
ההודעה של Sakana מפרטת שישה מבחנים שבהם Fugu Max משיג את הציון הכולל הטוב ביותר: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench ו-SWEFish. חמישה מהם הם מבחנים ציבוריים מוכרים, והשישי, SWEFish, הוא מבחן הקידוד של Sakana עצמה. עבור אף אחד מהשישה ההודעה אינה מציינת ערך, פער או מספר של מתחרה שיוצב לצידו. הטענה המקבילה — ש-Fugu Max מרחיב את חזית הפרטו של עלות-ביצועים בשבעה מתוך עשרה מבחנים — היא אף היא אמירה על מיקום בגרף ולא על נקודה על ציר.
השורות שפרסמה Alibaba עבור Qwen3.8-Max כוללות את Terminal-Bench 2.1 בציון 86.6, OSWorld-Verified בציון 86.1, GPQA Diamond בציון 92.6 ו-SWE-bench Pro בציון 67.7. הכול מדווח על ידי הספק, הכול מספרים. לכן, במבחן היחיד ששתי החברות בחרו לציין בשמו, אחת פרסמה נתון והאחרת פרסמה דירוג. אי אפשר להסיק מכך איזו מערכת טובה יותר — "הטובה ביותר בסך הכול" של Sakana יכולה להיות 91 או 87. מה שכן אפשר להסיק הוא שנכון למועד הפרסום אין ראיות ציבוריות שעונות על השאלה, והספק שמציג את הטענה הגדולה יותר הוא זה שנמנע מלכמת אותה.
מחירים זהים, מבנה הפוך
• קלט — Fugu Max $2.00 לכל מיליון טוקנים לעומת Qwen3.8-Max $2.00 לכל מיליון טוקנים
• פלט — Fugu Max $6.00 לכל 1M טוקנים לעומת Qwen3.8-Max $6.00 לכל 1M טוקנים
• קלט במטמון — Fugu Max $0.25 לכל 1M טוקנים לעומת Qwen3.8-Max $0.25 לכל 1M טוקנים, ו-Artificial Analysis מודדת באופן עצמאי הנחת מטמון של 88 אחוזים בצד של Qwen
• תוספת תשלום עבור פרומפט ארוך — Fugu Max לא צוינה דרגה בפרסום לעומת Qwen3.8-Max תעריף אחיד עד החלון ללא תוספת
• הקשר ופלט — Fugu Max לא פרסם אף נתון, לעומת Qwen3.8-Max עם חלון של 1M טוקנים ותקרת פלט של כ-128K
• מודאליות קלט — טקסט של Fugu Max, עם היכולות של המאגר עצמו מאחוריו, לעומת טקסט, תמונה, וידאו ו-PDF של Qwen3.8-Max
• ארכיטקטורה — Fugu Max הוא מתאם מאומן מעל מאגר שלא נחשף, שהורחב עבור Max עם מודלים במשקלים פתוחים ומודלים ייעודיים, כולל משפחת NVIDIA Nemotron, באמצעות שיתוף פעולה עם NVIDIA, לעומת Qwen3.8-Max — מודל אחד של תערובת מומחים דלילה (sparse mixture-of-experts) עם כ-2.4 טריליון פרמטרים בסך הכול וכ-95 מיליארד פעילים לכל טוקן
• משקלים — Fugu Max סגור, חברות במאגר אינה נחשפת מעצם התכנון לעומת Qwen3.8-Max עם משקלים פתוחים שפורסמו עבור צ'קפוינט מדרגת Max תחת רישיון מותאם
• הערכה בלתי תלויה — עבור Fugu Max לא פורסמה כל הערכה, ולא קיים עמוד Artificial Analysis עבור אף מודל Fugu, לעומת Qwen3.8-Max, רשומה חיה ב-Artificial Analysis עם נתוני מהירות, מילוליות ועלות-למשימה שפורסמו
ארבע מהשורות האלה מציגות "לא פורסם" בצד של Fugu ונושאות נתון בצד של Qwen. כאשר התעריפים זהים, זו כל ההשוואה: אותו כסף קונה מערכת אחת שאפשר לתאר ואחת שאי אפשר.

מאחורי עמודה אחת עומד צד שלישי
Artificial Analysis מדרגת את Qwen3.8-Max בציון 40 במדד ה-Intelligence Index v4.3 המחושב מחדש, והוא מדורג במקום ה-30 מתוך 200, בעלות של $2.67 לכל משימת Intelligence Index ו-37.8 טוקני פלט לשנייה — איטי מספיק כדי להיות מדורג במקום ה-154 מתוך 200 במהירות. אותה רשומה מתעדת 180 מיליון טוקני פלט שנוצרו לאורך המדד, יותר מפי שניים מ-89 מיליון של המודל החציוני, והנחת מטמון של 88 אחוזים.
שני תיקונים חלים לפני שכל זה מצוטט. הראשון הוא שהנתון הנפוץ של 58 — או 58.1, או 58.4 — עבור Qwen3.8-Max הוא מלפני ש-Artificial Analysis כיילה מחדש את המדד בספטמבר 2026, והעמוד החי נושא את תג "Updated" שמסמן ציון שנוסח מחדש. הכתבות הישנות יותר נשאו גם מס מאמץ שונה מהסקאלה הקודמת, 64 סיבובים למשימה לעומת 14 בדור Qwen הקודם בכ-$1.14 למשימת Intelligence Index; העמוד הנוכחי מציג $2.67. השני הוא אזהרה אמיתית ולא תוצר לוואי של סקאלה: Artificial Analysis מדדה בנפרד עלייה בשיעור ההזיות של Qwen3.8-Max מ-23 אחוז ל-40 אחוז לעומת הדור הקודם. עבור מודל שמשווק לעבודה אוטונומית רב-שלבית, זו עלות שמתקצבים עבורה במאמתים, לא הערת שוליים.
ל-Fugu Max אין רשומה עצמאית מכל סוג שהוא. כל נתון המשויך אליו מקורו ב-Sakana, ונכון לכתיבת שורות אלו לא קיים דף של Artificial Analysis עבור Fugu Max או עבור אף אחד מהדגמים האחים שלו. זו אינה האשמה — דגם שיצא לפני שעות לא יזכה לסיקור מצד צד שלישי — אבל המשמעות היא ששתי העמודות אינן ניתנות לבדיקה באותה מידה, וכך זה יישאר עד שמישהו מחוץ ל-Sakana יריץ את הדגם.
שתי דרכים להוציא יותר מדי
שתי המערכות האלה הרחיקו את עלות התשובה מעלות האסימון, והן עושות זאת בכיוונים מנוגדים. Qwen3.8-Max חסכנית באסימונים ופזרנית בתשובה: 180 מיליון אסימוני פלט ב-Intelligence Index, כפול מהחציון, ב-2.67 דולר למשימה. היא עובדת לאורך ולא בגודל, והנחת המטמון של 88 אחוז היא הידית ששולטת בחשבון — הרצת סוכן ארוכה שממשיכה לקרוא מחדש את אותו הקשר נשארת זולה, בעוד אחת שממשיכה לייצר טקסט חדש לא.
Fugu Max יקר לפי טוקן ובלתי צפוי לפי התשובה. המתאם שלו מוליד סוכני משנה, שכל אחד מהם כותב טקסט חשיבה ופלט המחויב ב-$6.00 למיליון, בתוספת הסינתזה של המתאם עצמו. Sakana מתחייבת שריצות מרובות סוכנים מחויבות בתעריף משולב אחד הצמוד למודל המשתתף ברמה הגבוהה ביותר, ושהוספת סוכנים אינה מכפילה את החשבון, מה שמסיר את התפוצצות ההתפשטות במקרה הגרוע שהופכת מערכות מרובות סוכנים נאיביות לבלתי משתלמות. זה לא מסיר את הנפח. ובשאלת הנפח, ההודעה שותקת באופן שמשנה: הסיקור של Sakana עצמה מציין שהחלפת מודלים באמצע משימה עשויה להפחית את השימוש החוזר במטמון ההקשר וליצור טוקני תזמור נוספים, ומאשר שהחברה לא חשפה את שיעור הפגיעות במטמון של Max או את עלות הטוקנים הכוללת למשימה.
אז אותו שיעור של $2.00 / $6.00 הוא מספר צפוי מצד אחד, ומכפיל בלתי חסום עם רצפה מצד שני. המילוליות של Qwen3.8-Max ניתנת למדידה לפני שאתם מתחייבים; זו של Fugu Max לא.
מבחן פתח המילוט
כאן הטיעון הרגיל בדבר נעילה מתהפך, וזה הדבר המועיל ביותר בציוות.
הטיעון של Sakana בעד Fugu Max הוא חוסן. מאגר שמקיף מודלים במשקלים פתוחים ומודלים ייעודיים, שהורחב עבור Max עם משפחת NVIDIA Nemotron, משמעו ששום הפסקת תמיכה, תמחור מחדש או נסיגה אזורית מצד ספק חזית בודד לא יכולים להפיל את המוצר שלך — גידור אמיתי, כזה שהחברה מצהירה במפורש שהיא מוכרת. אבל את הגידור הזה אי אפשר לאמת מבחוץ. אתה לא יכול לראות את המאגר, לא יכול לבחור להכניס או להוציא חבר ממנו, לא יכול לארח בעצמך שום חלק ממנו, ולא יכול להריץ אותו ב-EU/EEA בכלל. הבטחה לגבי מאגר שאינך רשאי לבדוק היא ערובה חלשה ממה שהיא נשמעת.
Qwen3.8-Max מציג את הטיעון בכיוון ההפוך. זהו מודל של ספק אחד, ולכן הוא חשוף להחלטותיו של ספק אחד — אך Alibaba פרסמה משקלים פתוחים עבור נקודת הצ'ק-פוינט Qwen3.8-2.4T-A95B מדרגת Max תחת רישיון מותאם, מה שאומר שפתח המילוט הוא אמיתי ולא רק רטורי: אם התמחור או התנאים ישתנו, ניתן להריץ את המודל מהתשתית שלכם. עבור צוות שהפחד האמיתי שלו הוא שספק ימשוך את השטיח מתחת לרגליו, צ'ק-פוינט שניתן להוריד עדיף על תיאור של מאגר.
מתקשר לאחד מהם
Qwen3.8-Max נמצא בקטלוג שלנו ב-$2.00 לקלט ו-$6.00 לפלט למיליון טוקנים, שזה מחיר המחירון של Alibaba עם 0% תוספת שעוברת הלאה, כך ששינוי מחיר מצד הספק נוחת על אותו מפתח באותו יום ולא לפי לוח זמנים של מיגרציה. הוא תואם OpenAI על אותו base URL כמו שאר הקטלוג, מה שאומר שאתה יכול להציב אותו מאחורי כלל ניתוב מותנה, שרשרת failover, או פאנל מיזוג מודלים בלי חוזה נוסף או שינוי בקוד — ו-failover אוטומטי מכסה נתיב ספק שמוגבל בקצב או מדורדר. הוא העביר 127.7 מיליון טוקנים דרך השער בשבעת הימים האחרונים.
Fugu Max אינו זמין ב-OrcaRouter. הוא מגיע אליך דרך ה-API התואם ל-OpenAI של Sakana עצמה ומספר פלטפורמות צד שלישי, והחברה אומרת שאינטגרציית Fugu קיימת משתדרגת בשינוי פרמטר של שורה אחת. מכיוון ששניהם מדברים באותו פורמט בקשה, הדרך הזולה ביותר ליישב את פער הבנצ'מרק היא להפסיק לחכות שסקאנה תפרסם אותו: להריץ את שניהם מאחורי דגל אחד על עומס העבודה שלך ולספור אסימוני פלט לכל משימה שהושלמה. זו המדידה שאף אחד מהספקים לא סיפק.

איזה מהם, ומתי
Qwen3.8-Max הוא הבחירה שאפשר לבחון, לתמחר ולזנוח. לפי אותו מחירון בדיוק הוא נותן לך חלון של מיליון טוקנים בלי תוספת מחיר על פרומפטים ארוכים, קלט של תמונות, וידאו ו-PDF, צ'קפוינט בדרגת Max להורדה, רשומה עצמאית חיה שמודדת את הדברים שמשפיעים על החשבון שלך, והנחה של 88 אחוז על קלט שמור במטמון. העלויות שלו ספציפיות באותה מידה: הוא איטי בקצב של 37.8 טוקנים לשנייה, מדורג סמוך לתחתית התחום במהירות, הוא מפורט מאוד באופן קיצוני עם 180 מיליון טוקנים במדד, ושיעור ההזיות הנמדד שלו בערך הוכפל לעומת הדור הקודם — וזה חשש רציני בדיוק בגלל העבודה האוטונומית שלשמה הוא נמכר. נצלו את הנחת המטמון במלואה והקצו תקציב למאמת.
Fugu Max הוא ההימור שתיאום עדיף על יכולת. אם העבודה שלך היא ארוכת טווח וניתנת לבדיקה, ומתאם שמפעיל מאמת מסיים משימות שמודל בודד נכשל בהן פעמיים, אז טוקני התזמור זולים יותר מהניסיונות החוזרים ולוח התעריפים הזהה אינו תיקו כלל. מה שאתה קונה הוא התמדה, במערכת שאינך יכול לנעוץ את המאגר שלה, שחלון ההקשר שלה אינו מפורסם, ושש ניצחונותיה בבנצ'מרק אין להם ערכים מצורפים — מספק שבחר לנקוב בשם המבחן ולהסתיר את המספר.
שני המוצרים עולים אותו מחיר לכל טוקן. רק אחד מהם אומר לך מה אתה מקבל תמורתו.

השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
