כרטיס כותרת הירואי עבור Fugu Ultra v2 מול DeepSeek V4 Pro עם כתובית המשנה 'שאלת מחיר התפוקה פי 34', תגי גלולה עם הכיתוב 'DeepSWE 74.3 מול 62.7', 'פלט של $30.00 מול $0.87' ו'משקלים פתוחים מול סגורים', שורת כותרת תחתונה 'Sakana AI מול DeepSeek - ספטמבר 2026', והלוגו של OrcaRouter בפינה הימנית התחתונה.
Engineering & Research

Fugu Ultra v2 לעומת DeepSeek V4 Pro: שאלת מחיר הפלט פי 34

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Fugu Ultra v2 גובה בערך פי שלושים וארבעה ממחיר המחירון של DeepSeek V4 Pro עבור הטקסט שהוא כותב. זו אינה שגיאת הקלדה וזה אינו תוצר של עיגול: המתזמר החדש של Sakana AI רשום במחיר של $30.00 למיליון טוקנים בפלט, DeepSeek מדווחת על $0.87 למיליון, ובמדד היחיד ששני הספקים מפרסמים עבורו מספר, פער הביצועים אינו מתקרב לפי שלושים וארבעה. Sakana טוענת ל-74.3 ב-DeepSWE עבור Fugu Ultra v2, שיצא ב-11 בספטמבר 2026; DeepSeek מדווחת על 62.7 עבור DeepSeek V4 Pro, מודל המשקולות הפתוחות שהיא שחררה באוגוסט. יתרון של 11.6 נקודות כפי שמדווח על ידי הספק עבור מחיר פלט גבוה פי 34 הוא כל ההשוואה בשורה אחת — והשאלה הכנה אינה אם Fugu Ultra v2 טוב יותר, אלא אם הוא טוב יותר ב-19 דולר למיליון טוקנים, ולמי.

שתי תשובות לאותה בעיה, שנבנו משני קצוות מנוגדים

DeepSeek V4 Pro ו-Fugu Ultra v2 הם שניהם תגובות לאותה חרדה — תלות בספק יחיד וסגור שנמצא בחזית — ובשיטה שלהם הם שונים כמעט ככל האפשר.

DeepSeek V4 Pro הוא מודל. סיקור ההשקה מתארך את השקת ה-API של הגרסה הרשמית — בניית DeepSeek-V4-Pro-0813 — לסביבות 12–13 באוגוסט 2026, ומחליף את התצוגה המקדימה מ-24 באפריל. זוהי מערכת תערובת מומחים (mixture-of-experts) המדווחת כבעלת 1.5 עד 1.6 טריליון פרמטרים בסך הכול, עם כ-49 מיליארד פרמטרים פעילים לכל טוקן, חלון הקשר של 1M טוקנים ופלט מרבי של 384K טוקנים. היא מנמקת במצבי חשיבה ואי-חשיבה עם שלוש רמות מאמץ, מדברת הן בפרוטוקול ה-API של OpenAI והן בזה של Anthropic, והוסיפה Responses API מקורי המכוון ישירות אל מסגרות סוכנים בסגנון Codex. באופן קריטי, המשקולות פורסמו תחת רישיון MIT, מה שאומר שטיעון החוסן מוכרע על ידי החזקה: איש לא יכול לשלול ממך את העותק.

Fugu Ultra v2 אינו מודל. זהו מתאם מאומן, שדווח כי יש לו כ-7 מיליארד פרמטרים, שמפרק בקשה על פני מאגר של מודלים לא ידועים, מקצה תפקידי Thinker, Worker ו-Verifier, ומסנתז תשובה מאחורי נקודת קצה אחת תואמת OpenAI. טיעון החוסן שלו הוא ארכיטקטוני ולא משפטי: מכיוון שהמאגר ניתן להחלפה, המערכת יכולה לשרוד כל שינוי בתנאים של ספק בודד. גרסה 2.0, שהושקה לצד Fugu Max, העבירה את תאריך החיתוך של האימון ל-28 באוגוסט 2026, ו—יש לציין—הסירה את Claude Fable 5, Claude Fable 5.1 ו-GPT-6 Astra מהמאגר לחלוטין תוך שהיא עדיין טוענת לניצחונות עליהם.

אז ההשוואה היא בין בעלות לתיאום. ‏Deep​Seek מעמידה לרשותך מודל שתוכל להוריד, לבחון, לכוונן ולהריץ בעצמך בכל שולי רווח שהחומרה שלך מאפשרת. ‏Sakana מעמידה לרשותך מערכת שמחליטה איך לתקוף כל בעיה, בתעריף שמממן הרצה של כמה מודלי חזית עבורך.

A two-column scoreboard for Fugu Ultra v2 vs DeepSeek V4 Pro titled 'Fugu Ultra v2 vs DeepSeek V4 Pro - the scoreboard'. Left column Fugu Ultra v2: Output price $30.00 / 1M, Input price $5.00 / 1M, DeepSWE 74.3, Weights closed, Output ceiling not published, Context 1M. Right column DeepSeek V4 Pro: Output price $0.87 / 1M, Input price $0.435 / 1M, DeepSWE 62.7, Weights open, MIT, Output ceiling 384K, Context 1M. Footer 'Both columns vendor-reported; DeepSeek API rates as reported August 2026, pricing revision pending.', with the OrcaRouter logo bottom-right.

מה 34x בעצם קונה

בנצ'מרקים תחילה, כשהמקורות בחזית ובמרכז. כל נתון של DeepSeek להלן הוא של הספק עצמו ומתוארך לפני עדכון התמחור בשיא/מחוץ לשיא ש-DeepSeek הודיעה עליו לאמצע אוגוסט, שעל המספרים הסופיים שלו המקורות עדיין חלוקים — דיווח אחד מציב את תפוקת השיא בסביבות ¥27 למיליון, אחר בסביבות ¥12, מול בסיס של ¥6. ודאו מול כרטיס התעריפים המפורסם של DeepSeek לפני שאתם בונים תקציב. כל נתון של Fugu הוא של Sakana עצמה, ואף גורם בלתי תלוי לא שחזר אף אחד מהם; עדיין אין רשומה של Artificial Analysis לדגם Fugu.

• DeepSWE — Fugu Ultra v2 74.3 (לפי דיווח הספק) לעומת DeepSeek V4 Pro 62.7 (לפי דיווח הספק)

• Terminal Bench 2.1 — לא פורסם נתון עבור Fugu Ultra v2 על ידי Sakana לעומת DeepSeek V4 Pro 87.9 (מדווח על ידי הספק)

• SWE-bench (Vals) — אין נתון של Fugu Ultra v2 לעומת DeepSeek V4 Pro 96.4 (לפי דיווח הספק)

• Humanity's Last Exam — אין נתון עבור Fugu Ultra v2 v2.0 לעומת DeepSeek V4 Pro: 42.7 ללא כלים, 60.0 עם כלים (לפי דיווח הספק)

• GPQA Diamond — אין נתון של Fugu Ultra v2 v2.0 לעומת DeepSeek V4 Pro 92.8 (לפי דיווח הספק)

• מחיר פלט — Fugu Ultra v2 ‏$30.00 ל-1M, עולה ל-$45.00 מעל הקשר של 272K לעומת DeepSeek V4 Pro כ-$0.87 ל-1M לפי מחירון, עם תעריף מדוד שהגיע גבוה יותר

שתי הסתייגויות לגבי שורת המחיר ההיא, מפני שכל ההשוואה נשענת עליה. ראשית, הנתון של Deep​Seek הוא תעריף המחירון שדווח בסיקור ההשקה ומובא שוב בתיאור המודל שלנו, אבל התעריף הנמדד ברשומה שלנו עמד על $2.18 למיליון פלט ו-$0.73 למיליון קלט — התנהגות המטמון והתמהיל משנים את המספר האפקטיבי, כך שהמכפיל ההוגן נמצא אי־שם בין בערך פי 14 לבערך פי 34, תלוי בכמה מהקלט שלך נשמר במטמון. אפילו בתחתית הטווח הזה, הפלט עולה יותר מפי תריסר. שנית, Deep​Seek כבר הודיעה על עדכון תמחור לשעות שיא/שפל, שהמקורות עדיין חלוקים לגבי המספרים הסופיים שלו — דיווח אחד מציב את פלט השיא קרוב ל־¥27 למיליון, ואחר קרוב ל־¥12, מול בסיס של ¥6. אמת מול כרטיס התעריפים המפורסם לפני שאתה מדגמן תקציב.

• מחיר קלט — Fugu Ultra v2 $5.00 ל-1M, מוכפל מעל 272K לעומת DeepSeek V4 Pro כ-$0.435 ל-1M בהחמצת מטמון, זול יותר פי כ-120 בפגיעת מטמון

• משקלים — Fugu Ultra v2 סגור, מאגר לא גלוי, ניתוב שאינו חשוף מעצם התכנון לעומת DeepSeek V4 Pro פתוח תחת MIT, ניתן לאירוח עצמי

• הקשר ופלט — Fugu Ultra v2 עם חלון הקשר של 1M, תקרת פלט לא מפורסמת לעומת DeepSeek V4 Pro עם חלון הקשר של 1M, תקרת פלט של 384K

בעיית החפיפה ברורה: שתי המערכות בקושי מופיעות באותן שורות. Sakana מפרסמת חמישה ניצחונות מתוך שמונה מבחנים שהיא בחרה; DeepSeek מפרסמת לוח רחב יותר שכולל כיסוי אג'נטי מעמיק — MCP Atlas 73.6, Toolathlon-Verified 74.1, CyberGym 83.3, NL2Repo 61.5, CorpusQA 62.0 בהקשר ארוך — שבהם ל-Fugu Ultra v2 אין מספר מפורסם בכלל. השורה היחידה שאפשר ליישר, DeepSWE, היא זו שבה Fugu טוענת ליתרון הגדול ביותר שלה בהנדסת תוכנה. קורא שמשווה בין שתי ההשקות משווה בין שני מבחנים שונים.

מכפיל המילוליות

מחיר הפלט אינו מס ליניארי על תזמור; הוא מכפיל על כמות שהתזמור מגדיל. Fugu Ultra v2 מפעיל סוכנים, שכל אחד מהם מפיק אסימוני חשיבה ופלט, לפני שמתאם מסנתז אותם. שאלות ותשובות נפוצות בנושא התמחור של Sakana מכילות התחייבות ידידותית באמת לצרכן — אתם משלמים תעריף משולב אחד המבוסס על המודל ברמה העליונה במאגר, והוספת סוכנים אינה מכפילה את החשבון — מה שמגביל את המקרה הגרוע ביותר. זה לא מגביל את הנפח. במחיר של 30 דולר למיליון אסימוני פלט, הרצה מרובת סוכנים שפולטת פי ארבעה טקסט מקריאה של מודל יחיד עולה פי ארבעה, והמכפיל מצטבר עם קצב פלט גבוה פי 34.

מבנה העלויות של DeepSeek V4 Pro מתגמל את ההתנהגות ההפוכה. פגיעת מטמון בקלט זולה בכ-שני סדרי גודל מהחמצה, מה שהופך עבודה חוזרת עם הקשר ארוך — אותו מאגר, אותה קבוצת מסמכים, אותה הנחיית מערכת — לזולה באופן דרמטי מהמחיר הרשמי שמשתמע ממנו. עבור לולאת סוכן שקוראת מחדש את אותו הקשר בכל תור, שם נוחתת העלות האפקטיבית, וזהו יתרון מבני שאף מתזמר לא יכול לעקוף.

חברו את השניים וההחלטה הופכת קונקרטית. אם Fugu Ultra v2 מספק יתרון של 11.6 נקודות ב-DeepSWE ופולט פי שלושה טוקני פלט מאשר קריאה בודדת, אתם משלמים בערך פי מאה יותר לכל משימה שהושלמה עבור שיפור של עשר עד חמש עשרה נקודות במדד אחד. העסקה הזו מוצדקת עבור מחקר ובעיות הנדסיות קשות באופן בלתי ניתן לצמצום, שבהן הנקודה השולית היא כל המשחק, ובלתי מוצדקת עבור צינור עיבוד שרץ מאה אלף פעמים ביום.

A screenshot of the Sakana Fugu product page at sakana.ai/fugu (captured September 11, 2026, English UI), showing the 'Sakana Fugu' wordmark with the subtitle 'One Model to Command Them All', the description that Fugu dynamically orchestrates the world's best models behind a single API, and the notice reading 'Not yet available in the EU/EEA while we work toward compliance with GDPR and EU-specific regulations.'

למי כל אחד מהם מיועד באמת

בחר ב-DeepSeek V4 Pro אם אחד מהדברים הבאים נכון: עומס העבודה שלך הוא בנפח גבוה ורגיש לעלויות; אתה זקוק לפלט ארוך מהתקרה שמתזמר ייתן לך; אתה דורש מערכת שתוכל לבקר, לכוונן או להריץ על החומרה שלך מטעמי מיקום נתונים; או שאתה צריך שהמחיר יהיה מספר שאתה יכול לחשב ולא מספר שאתה צופה בו. רישיון MIT הפתוח אינו תכונה שיווקית — זהו הצורה החזקה ביותר של טיעון החוסן שכל אחת מהמערכות מציגה, מכיוון שהוא אינו תלוי ברצון הטוב המתמשך של אף ספק. הוא גם, בערך ב-$0.87 למיליון פלט, זול מספיק כך שניסויים לא עולים דבר.

בחרו ב-Fugu Ultra v2 אם הנקודה השולית מצדיקה מכפיל, העבודה היא ארוכת טווח, וניתן לבדוק את הנכונות — כתיבת קוד עם חבילת בדיקות, הסקה מובנית על מסמכים, ניתוח רב-שלבי שבו תפקיד של מאמת יכול לתפוס שגיאה שמעבר בודד היה משגר. מחקרי המקרה של Sakana עצמה מצביעים בדיוק על כך: ריצת מחקר אוטונומית בת ארבע-עשרה שעות, פותר קובייה הונגרית שסיים את כל 300 הערבולים, בעוד שני קווי בסיס אנונימיים קרסו לחלוטין. קחו בחשבון שאותם קווי בסיס אנונימיים ונבחרו על ידי הספק, מה שמחליש אותם כראיה ואינו הופך אותם לשקריים. כמו כן, קחו בחשבון את האילוץ שמסיים את הדיון עבור צוותים מסוימים: Fugu Ultra v2 אינו נמכר באיחוד האירופי או באזור הכלכלי האירופי, ו-Sakana מציינת זאת במפורש.

הערה מעשית אחת אם בכוונתך להריץ את מי מהשניים. Fugu Ultra v2 אינו נמצא ב-OrcaRouter — הוא מגיע דרך ה-API התואם ל-OpenAI של Sakana עצמה ומספר פלטפורמות צד שלישי, ושדרוג מ-Fugu קודם הוא שינוי פרמטר בשורה אחת. DeepSeek V4 Pro נמצא ב-OrcaRouter במחיר המחירון של הספק עם 0% תוספת, וזה חשוב כאן יותר מהרגיל: Deep​Seek כבר הודיעה על עדכון תמחור אחד במחזור הזה, ובראוטר מסוג pass-through שינוי מחיר של ספק הופך לפעיל באותו מפתח באותו יום ולא אחרי משא ומתן מחדש. אם ברצונך להשוות את שניהם מול עומס העבודה שלך לפני התחייבות, הצד הזול יותר של ההשוואה הוא זה שאתה יכול לקרוא לו במחיר מחירון עם failover אוטומטי מאחוריו.

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro, captured September 11, 2026, English UI), showing the Flagship and Featured badges, the '1.6T total / 49B active params, 1M context, top-tier reasoning + agentic tool use' summary, the 1M token context and 384K max output fields, the pricing tiles reading INPUT $0.73 and OUTPUT $2.18 per 1M tokens with p50 TTFT 919ms, and the description stating transparent pricing at $0.44 per 1 million input tokens and $0.87 per 1 million output tokens.

פסק הדין

זו לא התמודדות צמודה מבחינה כלכלית, וגם לא הכרעה מובהקת מבחינת יכולת. DeepSeek V4 Pro הוא ברירת המחדל הטובה יותר בפער גדול: משקולות פתוחות שאפשר להחזיק, תקרת פלט של 384K, הקשר של 1M, ציוני הקשר ארוך שפורסמו, ומחיר של בערך 1/34 מזה של Fugu Ultra v2 בפלט. Fugu Ultra v2 הוא הכלי הטוב יותר למחלקה צרה של בעיות יקרות, והטענה של Sakana — שמאגר קבוע שמחריג את שלושת המודלים החזקים ביותר עדיין יכול לגבור עליהם בעבודה ניתנת לאימות — היא הטיעון הארכיטקטוני המעניין ביותר בתחום כרגע, וזה שנתמך בהכי פחות ראיות בלתי תלויות.

הפתרון המעשי אינו לבחור. הריצו את DeepSeek V4 Pro כברירת מחדל כי הוא זול, פתוח ומהיר, והחזיקו את Fugu Ultra v2 בעתודה למשימות שבהן עלייה של פי מאה בעלות עדיין קטנה מהעלות של לטעות. מה שאסור לכם לעשות הוא לקרוא את לוח שמונת-הבנצ'מרקים של Sakana כראיה לכך שהאורקסטרטור היקר החליף את המודל הפתוח והזול. בשורה היחידה שהם חולקים, הוא מקדים ב-11.6 נקודות בתמורה לפי 34 ממחיר הפלט. אם זה מציאה או מלכודת תלוי לחלוטין באיזו בעיה תכוונו אותו אליה.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית