
Fugu Max מול Grok 4.6: כרטיסי תעריפים זהים, ציון מפורסם אחד
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
Fugu Max ו-Grok 4.6 עולים בדיוק אותו דבר. Sakana AI השיקה את Fugu Max ב-11 בספטמבר 2026, במחיר של $2.00 למיליון טוקני קלט ו-$6.00 למיליון טוקני פלט — וזה, שורה מול שורה, מחירון התעריפים ש-SpaceXAI גובה עבור Grok 4.6 מאז השקתו ב-12 באוגוסט. הצירוף המקרי הזה הוא העובדה השימושית ביותר בהתמודדות הזו, משום שהוא מוציא את המחיר מהמשוואה. כששני מוצרים מחויבים באופן זהה, השאלה היחידה שנותרת היא מה מקבלים תמורת הכסף, ושם דרכיהם נפרדות לחלוטין. Grok 4.6 הוא מודל יחיד שאפשר לנעול לפי גרסה, לקרוא עבורו טבלת בנצ'מרקים ולבדוק אותו מול מדד בלתי תלוי. Fugu Max הוא מתאם מאומן שמנתב כל משימה למודל הזול ביותר במאגר שלו, וההכרזה של Sakana טוענת שהוא משיג את הציון הכולל הטוב ביותר בשש בנצ'מרקים בלי לפרסם שום נתון מאף אחד מהם. אחת מהרכישות האלה ניתנת למדידה לפני שאתם מבצעים אותה. האחרת לא.
שני מוצרים, כרטיס תעריפים אחד
• קלט — Fugu Max 2.00 $ ל-1M טוקנים לעומת Grok 4.6 2.00 $ ל-1M טוקנים
• פלט — Fugu Max $6.00 לכל 1M טוקנים לעומת Grok 4.6 $6.00 לכל 1M טוקנים
• קלט במטמון — Fugu Max $0.25 למיליון טוקנים לעומת Grok 4.6 $0.50 למיליון טוקנים, השורה היחידה שבה שני המחירים נבדלים כלל
• חלון הקשר — Fugu Max לא פורסם על ידי הספק לעומת Grok 4.6 עם 500,000 טוקנים, ללא שינוי מ-Grok 4.5
• תמחור מחדש של פרומפטים ארוכים — ב-Fugu Max לא צוינה מדרגה בהודעה על ההשקה, לעומת Grok 4.6 שמכפיל את עצמו ל-$4.00 / $12.00 ברגע שבקשה בודדת חוצה 200,000 טוקנים, ומיושם על הבקשה כולה ולא רק על החריגה
• שליטה בהיסק — Fugu Max אינו חשוף לעומת Grok 4.6 עם ארבע רמות מאמץ, מ-low עד xhigh, כשברירת המחדל היא high ולא ניתן להשבית
• ארכיטקטורה — Fugu Max הוא מתאם מאומן מעל מאגר לא מפורסם הכולל מודלים במשקלים פתוחים ומודלים מתמחים, שהורחב עבור Max עם משפחת NVIDIA Nemotron באמצעות שיתוף פעולה עם NVIDIA, לעומת Grok 4.6 — מודל אחד בגרסה אחת
• הערכה בלתי תלויה — עבור Fugu Max לא פורסם דבר, ואין דף של Artificial Analysis עבור אף מודל Fugu, לעומת Grok 4.6 עם מדד אינטליגנציה חי של Artificial Analysis של 44, מדורג #20 מתוך 200
העמודה הזולה היא זו שאי אפשר לחזות.
תסתכלו היכן Fugu Max באמת מנצח במחיר: קריאת המטמון, במחצית מזו של Grok 4.6. זה יתרון אמיתי וזה בדיוק המקום הלא נכון לבנות מודל עלויות, כי תמחור מטמון משתלם רק ביחס ישר לשיעור הפגיעות במטמון שלכם — ו-Sakana לא מפרסמת כזה עבור Fugu Max. הודעת ההשחרור גם לא מציינת חלון הקשר, וגם לא דרגת הקשר ארוך, וגם לא תקרת פלט. אז העמודה היחידה שבה Fugu Max מתמחר נמוך מ-Grok 4.6 היא הנחה בגודל לא ידוע שמוחלת על נתח לא ידוע מהטוקנים שלכם.
החולשות של Grok 4.6 לפחות גלויות לעין. הסף של 200,000 טוקנים שלו אגרסיבי — הוא מתמחר מחדש את כל הבקשה, כך שפרומפט של 250,000 טוקנים מחויב בתעריף כפול מהטוקן הראשון, ולא מהטוקן ה-200,001. אבל אפשר לראות את הצוק, למדוד את הפרומפטים שלך מולו, ולהחליט אם לפצל למקטעים. זהו ההבדל בסוג כאן: מערכת אחת מפרסמת לוח מחירים עם צורה שאפשר לתכנן לפיה, והאחרת מפרסמת תעריף כותרת בלי שום לוח מחירים מצורף.
שישה ניצחונות ואף לא נקודה אחת
הבנצ'מרקים שסאקאנה מונה הם Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench ו-SWEFish. חמישה מהם הם הערכות ציבוריות מוכרות. השישי, SWEFish, הוא בנצ'מרק הקידוד של סאקאנה עצמה, מה שאומר שאחד מששת הניצחונות המוצהרים נמדד במבחן שהספק כתב וטרם פרסם. עבור חמשת האחרים, ההודעה אומרת ש-Fugu Max משיג את הציון הכולל הטוב ביותר ומסתפקת בכך — בלי ציון, בלי פער, בלי מספר של מתחרה שיוצב לצידו.
העמידו זאת מול הטבלה ש-SpaceXAI פרסמה עבור Grok 4.6, שמדווחת כולה על ידי הספק אך היא לכל הפחות טבלה: GDPVal-AA v2 ב-1,753, AA-Briefcase ב-1,577, DeepSWE v1.1 ב-65.9%, CursorBench v3.2 ב-69.9% ו-GPQA Diamond ב-94.9%. חומר ההשקה מדווח גם על כ-53 סבבים ועל כחצי מיליארד אסימוני קלט כדי לפתור משימות ארוכות טווח ב-AA-Briefcase, לעומת כ-103 סבבים וכשני מיליארד אסימונים עבור מודל חזית מתחרה — טיעון, שוב מדווח על ידי הספק, ש-Grok זול לכל עבודה שהושלמה אפילו בתעריף מתון לאסימון.
שניים מהמספרים האלה של Grok מחייבים התייחסות לפני שאתם מצטטים אותם. הראשון הוא שציון ה-GPQA Diamond המוביל שלו, 94.9%, מגיע מבנצ'מרק ש-Artificial Analysis הוציאה מאז משימוש בטענה שהוא רווי, ולכן הוא כבר לא מבדיל בין מודלי החזית כפי שהיה פעם. השני הוא המספר שתראו בסיקורים ישנים יותר: מדד Intelligence Index של Artificial Analysis בערך 61 עבור Grok 4.6. זו הייתה הסקאלה שלפני התיקון. Artificial Analysis כיילה מחדש את המדד בספטמבר 2026, והנתון העדכני הוא 44 במקום ה-20 מתוך 200, בעלות של $1.86 למשימת Intelligence Index. מי שמדרג את Grok 4.6 מול Claude Fable 5 או GPT-5.6 Sol על בסיס 61 משווה קריאות משני מכשירים שונים.

מה שמחיר הטוקן של מתזמר לא כולל
הסיקור של סקאנה עצמה על ההשקה מודה בבעיה המבנית. מכיוון ש-Fugu Max מחליף בין מודלים בתוך משימה בודדת, הוא "עשוי להפחית את השימוש החוזר במטמון ההקשר וגם ליצור טוקני תזמור נוספים" — והחברה לא חשפה את שיעור הפגיעות במטמון או את עלות הטוקנים הכוללת למשימה. כל סוכן שהמתאם יוצר כותב טקסט של הנמקה ופלט, וכל זה מחויב ב-6.00 דולר למיליון. התעריף זהה לזה של Grok 4.6. הנפח לא, והנפח הוא המשתנה שדף תמחור לא יכול להראות לך.
שני הספקים דוחפים אותך לאותו תיקון — להפסיק להשוות תעריפים, להתחיל להשוות עלות לכל עבודה מוגמרת — אבל רק אחד מהם נותן לך מספר להתחיל ממנו. Grok 4.6 מגיע עם פרופיל מפורסם של סבבים וטוקנים. Fugu Max מגיע עם הוראה למדוד אותו בעצמך.
יש קריאה הוגנת לשתיקה של Fugu Max, והיא ראויה להיאמר. Max הוא הדרג הממוטב-עלות של קו Fugu, ששוחרר באותו יום שבו שוחרר Fugu Ultra v2, שהוא מהלך חיזוק היכולות במחיר של $5.00 לקלט ו-$30.00 לפלט. הטיעון החזותי של Sakana עבור Max הוא תרשים פארטו — יכולת מול עלות — ובגרף פארטו ציון בנצ'מרק גולמי אינו העיקר; ציון לדולר הוא כל הטענה. אם זה הטיעון, הצגת שישה ציונים מנצחים בלי העלויות שלהם תהיה התרשים המטעה, לא התרשים החסר. מה שהשחרור עדיין חייב לקונה הוא מכנה, והוא אינו מספק אחד כזה.
איפה Grok 4.6 ממש חשוף
עבודת טרמינל היא התחום המפורסם החלש ביותר של Grok 4.6. הציון שלו ב-Terminal-Bench v3.0 עומד על 26%, הרחק מאחורי המובילים בתחום. היזהרו עם הנתון השכן: אותו מודל משיג 88.4% ב-Terminal-Bench v2.1, ואלה מבחנים שונים. תראו את השניים משולבים בסיקור, והשילוב מחמיא ל-Grok במידה ניכרת.
החשיפה השנייה היא שלא ניתן לכבות את החשיבה. אסימוני חשיבה מחויבים בכל בקשה, כך שהעלות האפקטיבית של הפלט של Grok 4.6 תלויה במידת המאמץ שהמודל מחליט להשקיע בחשיבה על הפרומפט שלך. חוגת המאמץ נותנת לך שליטה בקצה הנמוך, אבל אין הגדרה של אפס.
מנגד, ל-Grok 4.6 יש משהו ש-Fugu Max לא יכול להציע כיום בשום מחיר: מספר. כל שורה לעיל ניתנת לבדיקה על ידי צד שלישי, והרשומה של Artificial Analysis משמעה שכבר נערכה בדיקה כזו. ששת הניצחונות של Fugu Max פורסמו באותו יום שבו פורסם המודל, על ידי החברה שפיתחה אותו, ונכון לכתיבת שורות אלה, איש מחוץ ל-Sakana לא הריץ אותו.
מתקשר לאחד, מטיס את האחר
Grok 4.6 זמין ב-OrcaRouter במחיר המחירון של SpaceXAI — $2.00 למיליון טוקני קלט, $0.50 בעת פגיעה במטמון, $6.00 למיליון טוקני פלט — מועבר הלאה עם 0% תוספת מחיר, כך ששינוי מחיר מצד הספק מגיע לשער שלנו באותו יום ולא לפי לוח זמנים של מיגרציה. הוא תואם ל-OpenAI על אותו Base URL כמו שאר הקטלוג, מה שאומר שאפשר לשלב אותו בשרשרת failover או מאחורי כלל ניתוב מותנה במקום לקודד ספק באופן קשיח בנתיב ייצור, ואפשר להריץ עליו A/B מול מודל אחר בלי חוזה נוסף. הוא העביר 46.6 מיליון טוקנים דרך השער בשבעת הימים האחרונים.
Fugu Max אינו בקטלוג שלנו. הוא מגיע אליך דרך ה-API התואם ל-OpenAI של Sakana עצמה וכמה פלטפורמות צד שלישי, והחברה אומרת שאינטגרציית Fugu קיימת משתדרגת אליו בשינוי פרמטר אחד בלבד. מכיוון ששניהם מדברים באותו פורמט בקשה, הערכה שמעמידה אותם מאחורי דגל אחד היא החלפת base-URL ולא שכתוב — וזו הדרך הנכונה להכריע בוויכוח המסוים הזה, שכן הוויכוח הוא על טוקנים לכל משימה שהושלמה, ורק עומס העבודה שלך עצמך יכול להפיק את המספר הזה.

איזה אחד לקנות
Grok 4.6 הוא ברירת המחדל המוצדקת. בתעריף זהה לזה של Fugu Max, הוא מעניק לך חלון הקשר של 500K שאפשר לתכנן לפיו, גרסה שאפשר לנעוץ, ארבע רמות של שליטה בחשיבה, מיקום עצמאי במדד במקום 44 עם נתון עלות-למשימה לצידו, וחודשים של מדידה מצד שלישי. העלויות שלו ספציפיות וידועות: צוק התמחור מחדש של 200K, חשיבה שמחייבת תשלום תמיד, ופרופיל עבודת מסוף שמפגר אחרי השדה.
פוגו מקס הוא ההימור המעניין יותר, ולפי הראיות הקיימות, גם הפחות ניתן לבדיקה. הצידוק התכנוני מוצק — אם מתאם בוחר באופן מהימן את המודל הזול ביותר שיכול להשלים את המשימה שלך, העלות החציונית שלך לכל עבודה שהושלמה יורדת גם כאשר מחירון התעריפים שלך לא יורד. אבל בתעריף של $2.00 / $6.00, תעריף הטוקנים אינו המקום שבו טמון היתרון של Fugu Max; התעריף הזה הוא בדיוק זה של Grok 4.6. היתרון חייב לנבוע משימוש בפחות טוקנים, ו-Sakana לא פרסמה את המדידה שתראה שזה אכן קורה.
אז הרץ את ההשוואה כפי ששני הספקים מבקשים ממך. הצב את Grok 4.6 על השער שלך, קרא ל-Fugu Max מאחורי דגל תכונה, וספור אסימוני פלט לכל משימה שהושלמה בעבודה שנראית כמו שלך. אם Fugu Max מסיים בפחות אסימונים ממודל בודד באותו תעריף, הנחת המטמון והתיאום הם כסף אמיתי וההחלפה מוצדקת. אם לא, אתה משלם תעריפים זהים עבור מערכת שההרכב שלה יכול להשתנות מתחתיך בלי שמספר הגרסה שלה זז.
בכל מה שאתה יכול להחליט ברבעון הזה בלי המדידה ההיא, התחל עם המודל שיש לו לוח תוצאות.

השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
