
Fugu Ultra v2 לעומת DeepSeek V4 Pro: שאלת מחיר הפלט פי 34
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
Fugu Ultra v2 גובה בערך פי שלושים וארבעה ממחיר המחירון של DeepSeek V4 Pro עבור הטקסט שהוא כותב. זו אינה שגיאת הקלדה וזה אינו תוצר של עיגול: המתזמר החדש של Sakana AI רשום במחיר של $30.00 למיליון טוקנים בפלט, DeepSeek מדווחת על $0.87 למיליון, ובמדד היחיד ששני הספקים מפרסמים עבורו מספר, פער הביצועים אינו מתקרב לפי שלושים וארבעה. Sakana טוענת ל-74.3 ב-DeepSWE עבור Fugu Ultra v2, שיצא ב-11 בספטמבר 2026; DeepSeek מדווחת על 62.7 עבור DeepSeek V4 Pro, מודל המשקולות הפתוחות שהיא שחררה באוגוסט. יתרון של 11.6 נקודות כפי שמדווח על ידי הספק עבור מחיר פלט גבוה פי 34 הוא כל ההשוואה בשורה אחת — והשאלה הכנה אינה אם Fugu Ultra v2 טוב יותר, אלא אם הוא טוב יותר ב-19 דולר למיליון טוקנים, ולמי.
שתי תשובות לאותה בעיה, שנבנו משני קצוות מנוגדים
DeepSeek V4 Pro ו-Fugu Ultra v2 הם שניהם תגובות לאותה חרדה — תלות בספק יחיד וסגור שנמצא בחזית — ובשיטה שלהם הם שונים כמעט ככל האפשר.
DeepSeek V4 Pro הוא מודל. סיקור ההשקה מתארך את השקת ה-API של הגרסה הרשמית — בניית DeepSeek-V4-Pro-0813 — לסביבות 12–13 באוגוסט 2026, ומחליף את התצוגה המקדימה מ-24 באפריל. זוהי מערכת תערובת מומחים (mixture-of-experts) המדווחת כבעלת 1.5 עד 1.6 טריליון פרמטרים בסך הכול, עם כ-49 מיליארד פרמטרים פעילים לכל טוקן, חלון הקשר של 1M טוקנים ופלט מרבי של 384K טוקנים. היא מנמקת במצבי חשיבה ואי-חשיבה עם שלוש רמות מאמץ, מדברת הן בפרוטוקול ה-API של OpenAI והן בזה של Anthropic, והוסיפה Responses API מקורי המכוון ישירות אל מסגרות סוכנים בסגנון Codex. באופן קריטי, המשקולות פורסמו תחת רישיון MIT, מה שאומר שטיעון החוסן מוכרע על ידי החזקה: איש לא יכול לשלול ממך את העותק.
Fugu Ultra v2 אינו מודל. זהו מתאם מאומן, שדווח כי יש לו כ-7 מיליארד פרמטרים, שמפרק בקשה על פני מאגר של מודלים לא ידועים, מקצה תפקידי Thinker, Worker ו-Verifier, ומסנתז תשובה מאחורי נקודת קצה אחת תואמת OpenAI. טיעון החוסן שלו הוא ארכיטקטוני ולא משפטי: מכיוון שהמאגר ניתן להחלפה, המערכת יכולה לשרוד כל שינוי בתנאים של ספק בודד. גרסה 2.0, שהושקה לצד Fugu Max, העבירה את תאריך החיתוך של האימון ל-28 באוגוסט 2026, ו—יש לציין—הסירה את Claude Fable 5, Claude Fable 5.1 ו-GPT-6 Astra מהמאגר לחלוטין תוך שהיא עדיין טוענת לניצחונות עליהם.
אז ההשוואה היא בין בעלות לתיאום. DeepSeek מעמידה לרשותך מודל שתוכל להוריד, לבחון, לכוונן ולהריץ בעצמך בכל שולי רווח שהחומרה שלך מאפשרת. Sakana מעמידה לרשותך מערכת שמחליטה איך לתקוף כל בעיה, בתעריף שמממן הרצה של כמה מודלי חזית עבורך.

מה 34x בעצם קונה
בנצ'מרקים תחילה, כשהמקורות בחזית ובמרכז. כל נתון של DeepSeek להלן הוא של הספק עצמו ומתוארך לפני עדכון התמחור בשיא/מחוץ לשיא ש-DeepSeek הודיעה עליו לאמצע אוגוסט, שעל המספרים הסופיים שלו המקורות עדיין חלוקים — דיווח אחד מציב את תפוקת השיא בסביבות ¥27 למיליון, אחר בסביבות ¥12, מול בסיס של ¥6. ודאו מול כרטיס התעריפים המפורסם של DeepSeek לפני שאתם בונים תקציב. כל נתון של Fugu הוא של Sakana עצמה, ואף גורם בלתי תלוי לא שחזר אף אחד מהם; עדיין אין רשומה של Artificial Analysis לדגם Fugu.
• DeepSWE — Fugu Ultra v2 74.3 (לפי דיווח הספק) לעומת DeepSeek V4 Pro 62.7 (לפי דיווח הספק)
• Terminal Bench 2.1 — לא פורסם נתון עבור Fugu Ultra v2 על ידי Sakana לעומת DeepSeek V4 Pro 87.9 (מדווח על ידי הספק)
• SWE-bench (Vals) — אין נתון של Fugu Ultra v2 לעומת DeepSeek V4 Pro 96.4 (לפי דיווח הספק)
• Humanity's Last Exam — אין נתון עבור Fugu Ultra v2 v2.0 לעומת DeepSeek V4 Pro: 42.7 ללא כלים, 60.0 עם כלים (לפי דיווח הספק)
• GPQA Diamond — אין נתון של Fugu Ultra v2 v2.0 לעומת DeepSeek V4 Pro 92.8 (לפי דיווח הספק)
• מחיר פלט — Fugu Ultra v2 $30.00 ל-1M, עולה ל-$45.00 מעל הקשר של 272K לעומת DeepSeek V4 Pro כ-$0.87 ל-1M לפי מחירון, עם תעריף מדוד שהגיע גבוה יותר
שתי הסתייגויות לגבי שורת המחיר ההיא, מפני שכל ההשוואה נשענת עליה. ראשית, הנתון של DeepSeek הוא תעריף המחירון שדווח בסיקור ההשקה ומובא שוב בתיאור המודל שלנו, אבל התעריף הנמדד ברשומה שלנו עמד על $2.18 למיליון פלט ו-$0.73 למיליון קלט — התנהגות המטמון והתמהיל משנים את המספר האפקטיבי, כך שהמכפיל ההוגן נמצא אי־שם בין בערך פי 14 לבערך פי 34, תלוי בכמה מהקלט שלך נשמר במטמון. אפילו בתחתית הטווח הזה, הפלט עולה יותר מפי תריסר. שנית, DeepSeek כבר הודיעה על עדכון תמחור לשעות שיא/שפל, שהמקורות עדיין חלוקים לגבי המספרים הסופיים שלו — דיווח אחד מציב את פלט השיא קרוב ל־¥27 למיליון, ואחר קרוב ל־¥12, מול בסיס של ¥6. אמת מול כרטיס התעריפים המפורסם לפני שאתה מדגמן תקציב.
• מחיר קלט — Fugu Ultra v2 $5.00 ל-1M, מוכפל מעל 272K לעומת DeepSeek V4 Pro כ-$0.435 ל-1M בהחמצת מטמון, זול יותר פי כ-120 בפגיעת מטמון
• משקלים — Fugu Ultra v2 סגור, מאגר לא גלוי, ניתוב שאינו חשוף מעצם התכנון לעומת DeepSeek V4 Pro פתוח תחת MIT, ניתן לאירוח עצמי
• הקשר ופלט — Fugu Ultra v2 עם חלון הקשר של 1M, תקרת פלט לא מפורסמת לעומת DeepSeek V4 Pro עם חלון הקשר של 1M, תקרת פלט של 384K
בעיית החפיפה ברורה: שתי המערכות בקושי מופיעות באותן שורות. Sakana מפרסמת חמישה ניצחונות מתוך שמונה מבחנים שהיא בחרה; DeepSeek מפרסמת לוח רחב יותר שכולל כיסוי אג'נטי מעמיק — MCP Atlas 73.6, Toolathlon-Verified 74.1, CyberGym 83.3, NL2Repo 61.5, CorpusQA 62.0 בהקשר ארוך — שבהם ל-Fugu Ultra v2 אין מספר מפורסם בכלל. השורה היחידה שאפשר ליישר, DeepSWE, היא זו שבה Fugu טוענת ליתרון הגדול ביותר שלה בהנדסת תוכנה. קורא שמשווה בין שתי ההשקות משווה בין שני מבחנים שונים.
מכפיל המילוליות
מחיר הפלט אינו מס ליניארי על תזמור; הוא מכפיל על כמות שהתזמור מגדיל. Fugu Ultra v2 מפעיל סוכנים, שכל אחד מהם מפיק אסימוני חשיבה ופלט, לפני שמתאם מסנתז אותם. שאלות ותשובות נפוצות בנושא התמחור של Sakana מכילות התחייבות ידידותית באמת לצרכן — אתם משלמים תעריף משולב אחד המבוסס על המודל ברמה העליונה במאגר, והוספת סוכנים אינה מכפילה את החשבון — מה שמגביל את המקרה הגרוע ביותר. זה לא מגביל את הנפח. במחיר של 30 דולר למיליון אסימוני פלט, הרצה מרובת סוכנים שפולטת פי ארבעה טקסט מקריאה של מודל יחיד עולה פי ארבעה, והמכפיל מצטבר עם קצב פלט גבוה פי 34.
מבנה העלויות של DeepSeek V4 Pro מתגמל את ההתנהגות ההפוכה. פגיעת מטמון בקלט זולה בכ-שני סדרי גודל מהחמצה, מה שהופך עבודה חוזרת עם הקשר ארוך — אותו מאגר, אותה קבוצת מסמכים, אותה הנחיית מערכת — לזולה באופן דרמטי מהמחיר הרשמי שמשתמע ממנו. עבור לולאת סוכן שקוראת מחדש את אותו הקשר בכל תור, שם נוחתת העלות האפקטיבית, וזהו יתרון מבני שאף מתזמר לא יכול לעקוף.
חברו את השניים וההחלטה הופכת קונקרטית. אם Fugu Ultra v2 מספק יתרון של 11.6 נקודות ב-DeepSWE ופולט פי שלושה טוקני פלט מאשר קריאה בודדת, אתם משלמים בערך פי מאה יותר לכל משימה שהושלמה עבור שיפור של עשר עד חמש עשרה נקודות במדד אחד. העסקה הזו מוצדקת עבור מחקר ובעיות הנדסיות קשות באופן בלתי ניתן לצמצום, שבהן הנקודה השולית היא כל המשחק, ובלתי מוצדקת עבור צינור עיבוד שרץ מאה אלף פעמים ביום.

למי כל אחד מהם מיועד באמת
בחר ב-DeepSeek V4 Pro אם אחד מהדברים הבאים נכון: עומס העבודה שלך הוא בנפח גבוה ורגיש לעלויות; אתה זקוק לפלט ארוך מהתקרה שמתזמר ייתן לך; אתה דורש מערכת שתוכל לבקר, לכוונן או להריץ על החומרה שלך מטעמי מיקום נתונים; או שאתה צריך שהמחיר יהיה מספר שאתה יכול לחשב ולא מספר שאתה צופה בו. רישיון MIT הפתוח אינו תכונה שיווקית — זהו הצורה החזקה ביותר של טיעון החוסן שכל אחת מהמערכות מציגה, מכיוון שהוא אינו תלוי ברצון הטוב המתמשך של אף ספק. הוא גם, בערך ב-$0.87 למיליון פלט, זול מספיק כך שניסויים לא עולים דבר.
בחרו ב-Fugu Ultra v2 אם הנקודה השולית מצדיקה מכפיל, העבודה היא ארוכת טווח, וניתן לבדוק את הנכונות — כתיבת קוד עם חבילת בדיקות, הסקה מובנית על מסמכים, ניתוח רב-שלבי שבו תפקיד של מאמת יכול לתפוס שגיאה שמעבר בודד היה משגר. מחקרי המקרה של Sakana עצמה מצביעים בדיוק על כך: ריצת מחקר אוטונומית בת ארבע-עשרה שעות, פותר קובייה הונגרית שסיים את כל 300 הערבולים, בעוד שני קווי בסיס אנונימיים קרסו לחלוטין. קחו בחשבון שאותם קווי בסיס אנונימיים ונבחרו על ידי הספק, מה שמחליש אותם כראיה ואינו הופך אותם לשקריים. כמו כן, קחו בחשבון את האילוץ שמסיים את הדיון עבור צוותים מסוימים: Fugu Ultra v2 אינו נמכר באיחוד האירופי או באזור הכלכלי האירופי, ו-Sakana מציינת זאת במפורש.
הערה מעשית אחת אם בכוונתך להריץ את מי מהשניים. Fugu Ultra v2 אינו נמצא ב-OrcaRouter — הוא מגיע דרך ה-API התואם ל-OpenAI של Sakana עצמה ומספר פלטפורמות צד שלישי, ושדרוג מ-Fugu קודם הוא שינוי פרמטר בשורה אחת. DeepSeek V4 Pro נמצא ב-OrcaRouter במחיר המחירון של הספק עם 0% תוספת, וזה חשוב כאן יותר מהרגיל: DeepSeek כבר הודיעה על עדכון תמחור אחד במחזור הזה, ובראוטר מסוג pass-through שינוי מחיר של ספק הופך לפעיל באותו מפתח באותו יום ולא אחרי משא ומתן מחדש. אם ברצונך להשוות את שניהם מול עומס העבודה שלך לפני התחייבות, הצד הזול יותר של ההשוואה הוא זה שאתה יכול לקרוא לו במחיר מחירון עם failover אוטומטי מאחוריו.

פסק הדין
זו לא התמודדות צמודה מבחינה כלכלית, וגם לא הכרעה מובהקת מבחינת יכולת. DeepSeek V4 Pro הוא ברירת המחדל הטובה יותר בפער גדול: משקולות פתוחות שאפשר להחזיק, תקרת פלט של 384K, הקשר של 1M, ציוני הקשר ארוך שפורסמו, ומחיר של בערך 1/34 מזה של Fugu Ultra v2 בפלט. Fugu Ultra v2 הוא הכלי הטוב יותר למחלקה צרה של בעיות יקרות, והטענה של Sakana — שמאגר קבוע שמחריג את שלושת המודלים החזקים ביותר עדיין יכול לגבור עליהם בעבודה ניתנת לאימות — היא הטיעון הארכיטקטוני המעניין ביותר בתחום כרגע, וזה שנתמך בהכי פחות ראיות בלתי תלויות.
הפתרון המעשי אינו לבחור. הריצו את DeepSeek V4 Pro כברירת מחדל כי הוא זול, פתוח ומהיר, והחזיקו את Fugu Ultra v2 בעתודה למשימות שבהן עלייה של פי מאה בעלות עדיין קטנה מהעלות של לטעות. מה שאסור לכם לעשות הוא לקרוא את לוח שמונת-הבנצ'מרקים של Sakana כראיה לכך שהאורקסטרטור היקר החליף את המודל הפתוח והזול. בשורה היחידה שהם חולקים, הוא מקדים ב-11.6 נקודות בתמורה לפי 34 ממחיר הפלט. אם זה מציאה או מלכודת תלוי לחלוטין באיזו בעיה תכוונו אותו אליה.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
