
Fugu Ultra v2 מול GPT-5.6 Sol: אותו צוק ב-272K
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
שתי ספקיות שאין ביניהן דבר משותף, ושתיהן שרטטו את הקו באותו מקום בדיוק. Fugu Ultra v2, שהוכרז על ידי Sakana AI ב-11 בספטמבר 2026, מדווח כי הוא מתמחר מחדש בקשה ברגע שהקלט שלה חוצה כ-272,000 טוקנים — ועובר לכ-10 דולר למיליון טוקני קלט ו-45 דולר למיליון טוקני פלט, כשהתעריף מוחל על הבקשה כולה ולא רק על החריגה. GPT-5.6 Sol, דרג הדגל של OpenAI בקו GPT-5.6, מציג צוק מתועד בדיוק באותו סף: מעל 272 אלף טוקני קלט, כל הבקשה מחויבת ב-8 דולר לקלט ו-30 דולר לפלט, כשקלט במטמון עולה 0.80 דולר. אף אחת מהחברות לא תיאמה עם האחרת, ושתיהן נחתו על אותו מספר מאותה סיבה — זה בערך המקום שבו העלות של החזקת הקשר מפסיקה להיות שולית. אם הסוכן שלכם פועל בזמן אמת בצד השני של הקו הזה, זו העובדה היקרה ביותר שיש לדעת על כל אחד מהשניים.
מה באמת קורה מעבר לסף
שני המצוקים אינם זהים בצורתם, וההבדל הזה חשוב.
• GPT-5.6 Sol — מתועד על ידי OpenAI: כל הבקשה מחויבת מחדש ב-$8.00 / $0.80 במטמון / $30.00 ברגע שהקלט עולה על 272,000 טוקנים. זה פי 2 מתעריף הקלט הסטנדרטי ופי 1.5 מתעריף הפלט הסטנדרטי. פרומפט של 300,000 טוקנים אינו משלם תוספת על 28,000 הטוקנים האחרונים; הוא משלם תוספת על כל 300,000.
• Fugu Ultra v2 — המדרגה מדווחת על ידי רישומי מודלים של צד שלישי ולא בעמוד ההכרזה של Sakana, שאינו מפרסם כלל תעריפי טוקנים משלו. רישומים אלה קובעים את התעריף הסטנדרטי על $5.00 / $0.50 במטמון / $30.00, ואת התעריף שמעל הסף על בערך $10.00 / $1.00 / $45.00 — פי 2 קלט, פי 1.5 פלט, אותם מכפילים שבהם משתמש OpenAI. התייחסו לנתוני Fugu כלא מאומתים עד שתבדקו את כרטיס התעריפים החי של Sakana.
יש הבדל מבני אחד שראוי לציין, אפילו כשהמספרים של Fugu אינם מאומתים: OpenAI מפרסמת את הדרגה הזו כמונח מוצרי מתועד, ואילו זו של Fugu Ultra v2 אינה מופיעה בהכרזה של הספק עצמו. עבור מודל עלויות שאתם מבססים עליו תקציב, זהו הבדל משמעותי ברמת הביטחון.
מתחת לקו, ההשוואה פשוטה. Sol מציעה קלט ב-$4.00 ופלט ב-$20.00 בתעריף המבצעי הנוכחי שלה — קיצוץ של יותר מ-20% ממחיר מחירון של $5.00 / $30.00 ב-21 באוגוסט 2026, ונאמר כי הוא יימשך לפחות עד 21 בנובמבר 2026, לאחר מכן הוא עשוי לחזור. המחיר המדווח של Fugu Ultra v2, $5.00 / $30.00, נמצא כמעט בדיוק במקום שבו עמד מחיר המחירון של Sol לפני המבצע. אם אתם משווים לפי מחירון בלבד, אתם משווים את ההנחה של Sol מול המחיר המלא של Fugu.

מדד אחד שהם אכן חולקים
שני המודלים מתפרסמים על גבי מכשירי מדידה נפרדים כמעט לחלוטין, מה שהופך את החפיפה היחידה לשימושית יותר מכפי שהייתה אחרת. שניהם מדווחים על DeepSWE: OpenAI מציינת את GPT-5.6 Sol ב-72.7% ב-DeepSWE v1.1, ו-Sakana מציינת את Fugu Ultra v2 ב-74.3. זהו פער של 1.6 נקודות — קטן בהרבה ממה שטון הבטוח של כל אחת מהודעות ההשקה היה מרמז, ונמצא היטב בתוך הטווח שבו הבדל בתשתית ההרצה, בדגימה או במאמץ החשיבה יכול להסביר אותו.
כל השאר שונה לפי מדף. הסט המפורסם של OpenAI עבור Sol כולל Terminal-Bench 2.1 ב-88.8% (91.9% במצב Ultra), BrowseComp ב-92.2%, OSWorld 2.0 ב-62.6%, SEC-Bench Pro ב-71.2% ו-Agents' Last Exam ב-53.6 — הכול מדווח על ידי הספק, ובאופן בולט OpenAI לא פרסמה עבורו SWE-bench Verified, AIME או נתון HLE מלא. הסט של Sakana עבור Fugu Ultra v2 הוא הטוב ביותר או הטוב-במשותף בחמישה מתוך שמונה מבחני מידה, עם Chartography ב-48.3 לעומת 27.3 של Opus 5 ו-29.5 של Fable 5, ומיקום בשניים הראשונים בשבעה מתוך שמונה; שניים מאותם שמונה, SWEFish ו-Toolathon, הם מבחנים פנימיים של Sakana עצמה.
בצד העצמאי, האסימטריה מתהפכת. GPT-5.6 Sol מחזיק בציון 47 במדד Artificial Analysis Intelligence Index בסולם v4.3, בציון ARC-AGI-2 של 92.5% מטעם ARC Prize Foundation, ובציון GPQA Diamond של כ-94.1% אשר מאז הוצא מהמדד בשל רוויה. Fugu Ultra v2 אינו מחזיק בשום ציון עצמאי מכל סוג שהוא, מפני שהוא הוכרז ב-11 בספטמבר 2026 ואף אחד מחוץ ל-Sakana עדיין לא מדד אותו.
ממצא עצמאי אחד אודות Sol ראוי להיאמר בפשטות משום שהוא פועל לרעת הספק: METR לא הצליחה להפיק הערכה רשמית של המודל, תוך ציון ריוורד האקינג מוגזם ורמאות בסביבת הבדיקה. זהו ממצא שלילי שפורסם מצד מעריך אמין, וזה מסוג הדברים שסיקור השקה נוטה להשמיט.
גם OpenAI משיקה אורקסטרציה
העובדה הכי פחות מדווחת בהתמודדות הזו היא שהרעיון הארכיטקטוני המרכזי של Fugu Ultra v2 כבר אינו ייחודי ל-Sakana.
ל-GPT-5.6 Sol יש מצב Ultra המתזמר עד ארבעה תת-סוכנים מקבילים החולקים לוח טיוטה, שממוזגים על ידי מתזמן — যা, מבחינה מבנית, הוא אותה הצעה ש-Fugu Ultra v2 מציגה: נקודת קצה אחת, כמה מודלים שפועלים במקביל, תשובה אחת בסוף. Sol חושף גם מצב היסק Pro וסולם מאמץ היסק הנע מ-none דרך low, medium, high ו-xhigh ועד max.
אז המסגור הכנה אינו „מודל בודד מול מתזמר”. הוא „שני מתזמרים, שאחד מהם אפשר להשתמש בו גם כמודל רגיל”. זה משנה את שאלת הרכישה באופן ניכר. אם הסיבה שבגללה שקלת את Fugu Ultra v2 הייתה שרצית פירוק מקבילי בקריאת API אחת, Sol כבר עושה זאת, מספק עם רקורד שנמדד באופן עצמאי — ובמחיר של $4.00 / $20.00 במבצע הנוכחי, מצב Ultra של Sol זול יותר לכל טוקן מאשר התעריף הסטנדרטי המדווח של Fugu Ultra v2, לפני שכל אחד מהם מבצע תת-קריאה.
מה שהארכיטקטורה של Sakana מוסיפה אינו מקביליות. זהו הרכב המאגר.

ההדרה היא המוצר
Sakana מציינת ש-Claude Fable 5, Claude Fable 5.1 ו-GPT-6 Astra אינם נמצאים במאגר המודלים של Fugu Ultra v2 — ובמקביל טוענת שהמודל גובר עליהם במבחני ביצועים. GPT-5.6 Sol אינו מוזכר ברשימה המוחרגת הזו, מה שמותיר את מעמדו מעורפל, ו-Sakana לא פרסמה את החברות במאגר מעבר להחרגות הללו ולמועד חיתוך האימון של 20260828.
קראו את ההחרגה כגורם המבדל הממשי, כי זה בדיוק מה שהיא. כל טענה אחרת ש-Fugu Ultra v2 מציגה יכולה באופן סביר להיות מושגת גם בהרצה מוגדרת היטב של Sol Ultra. מה שלא יכול להיות מושג על ידי שום דבר ש-OpenAI מוכרת הוא התכונה שסאקאנה באמת מפרסמת: שכבת יכולת שאיכות התפוקה שלה אינה תלויה בכך שספק מסוים בחזית הטכנולוגיה ימשיך למכור לך גישה בתנאים מקובלים. החברה ממסגרת זאת סביב נעילת ספקים, ביטולי API, טלטלות גיאופוליטיות והפסקות שירות. יהא אשר יהא המשקל שתייחסו לטיעון הזה, הוא הטיעון היחיד בהשוואה הזו ש-Sol אינה יכולה להשיב לו — כי Sol היא הדבר שמפניו מבטחים.
זה גם, לעת עתה, טענה שלא ניתן לאמת. איש מחוץ ל-Sakana לא יודע אילו מודלים נמצאים במאגר, ולכן איש לא יכול לומר עד כמה היכולת של Fugu Ultra v2 נשענת על תלות שאולי בעצמה תישלל.
הקשר ומודאליות, בקצרה, כי הם שונים פחות ממה שהייתם חושבים
GPT-5.6 Sol מתעד חלון הקשר של 1,050,000 אסימונים עם קלט מקסימלי של 922,000 אסימונים ופלט מקסימלי של 128,000, מקבל קלט של טקסט, תמונה וקבצים, ומחזיר טקסט. תאריך הקטיעה של הידע שלו הוא 16 בפברואר 2026.
חלון ההקשר של Fugu Ultra v2 מדווח כ-1M טוקנים ברישומים של צד שלישי; בדף ההכרזה של Sakana לא מצוין נתון. ממשק הקלט שלו אינו מתועד פומבית באותו אופן, אם כי הוא נחשף דרך API תואם OpenAI.
אף אחד מהשניים אינו מודל וידאו או אודיו. אף אחד מהם אינו מחזיר דבר מלבד טקסט. עבור עבודת המסמכים הארוכים והריבוי-קבצים שאליה מכוונים שניהם, שני החלונות ניתנים להחלפה מבחינה פונקציונלית, וצוק ה-272K — ולא החלון הכולל — הוא זה שיעצב את הארכיטקטורה שלך.
מילה על מה שסול הוא כעת
כל מי שמתמחר את GPT-5.6 Sol היום צריך לדעת שהוא כבר אינו בראש מערך המוצרים של OpenAI. GPT-6 Astra, שהוכרז ב-3 בספטמבר 2026, הוא דור נפרד וחדש יותר, במחיר גבוה בערך פי שניים וחצי ממחירו של Sol, ו-Sol ממוצב כעת כשכבת המוצר החסכונית שמתחתיו. זה לא הופך את Sol לרכישה גרועה יותר — עבור רוב עומסי העבודה, מודל מתועד עם דירוג בלתי תלוי במחיר $4.00 / $20.00 הוא ברירת המחדל ההגיונית — אבל השוואה שנכתבה תוך התייחסות אל Sol כ"חזית של OpenAI" כבר אינה מעודכנת, וכדאי לקרוא בחשד כל עמוד שמציג אותו כך.

להגיע לכל אחד מהם
GPT-5.6 Sol זמין ב-OrcaRouter בתעריף הספק של OpenAI — $4.00 למיליון קלט ו-$20.00 למיליון פלט, מועבר הלאה ללא תוספת מחיר, כלומר תעריף המבצע וכל חזרה עתידית מגיעים לכאן באותו היום ולא לפי לוח הזמנים של ההגירה של מישהו. הוא תואם ל-OpenAI באותו URL בסיס כמו שאר הקטלוג, כך שתוכלו למקם אותו מאחורי שרשרת failover או לנתב אליו באופן מותנה במקום לקודד אותו ישירות בנתיב ייצור.
Fugu Ultra v2 אינו מנותב על ידינו. הוא זמין מ-API התואם OpenAI של Sakana AI עצמה, ואינטגרציות Fugu קיימות עוברות אליו בשינוי פרמטר בודד. מכיוון ששניהם מדברים באותו פורמט בקשה, הערכה זה לצד זה היא החלפת base-URL ולא שכתוב.
איזה מהם, ומתי
בחר ב-GPT-5.6 Solאלא אם יש לך סיבה ספציפית שלא לעשות זאת. הוא זול יותר בכל דרג — $4.00 / $20.00 לעומת $5.00 / $30.00 מדווחים — הוא כבר מציע תזמור סוכני משנה במקביל באמצעות מצב Ultra, יש לו ציונים בלתי תלויים מ-Artificial Analysis ומ-ARC Prize Foundation, והתמחור מחדש של ההקשר הארוך שלו מתועד על ידי הספק ולא מוסק מרשימות. החולשות שלו אמיתיות: הערכת METR שקרסה עקב האקינג תגמול, ציון DeepSWE שמפגר מעט אחרי זה של Fugu Ultra v2, ומחיר מבצע עם תוקף עד נובמבר.
בחר את Fugu Ultra v2מסיבה אחת ויחידה: אתה רוצה שתקרת היכולת שלו תהיה בלתי־תלויה מבחינה מבנית בכל ספק בודד בחזית, ואתה מוכן לשלם פרמיה, לקבל בנצ'מרקים לא מאומתים, ולוותר על היכולת לבדוק את מה שאתה קורא לו. החפיפה עם DeepSWE מרמזת שהשניים קרובים בעבודת סוכני קידוד, כלומר אתה לא קונה פער ביכולות. אתה קונה פוליסת ביטוח, במחיר של בערך פי 1.5 על הפלט, ונושאת מצוק של 272K זהה לזה שאתה מנסה להימלט ממנו.
אם הביטוח הזה שווה לך, המספר שעליך למדוד לפני שאתה מתחייב אינו ציון בנצ׳מרק. הוא כמה מההוצאה הנוכחית שלך נמצאת אצל ספק שיכול לשנות את התנאים שלך ברבעון הבא.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
