כרטיס הירו לעימות בין Fugu Ultra v2 ל-GPT-5.6 Sol, המציג שתי עקומות תמחור ששתיהן מזנקות ב-272000 טוקנים.
Guides & Insights

Fugu Ultra v2 מול GPT-5.6 Sol: אותו צוק ב-272K

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

שתי ספקיות שאין ביניהן דבר משותף, ושתיהן שרטטו את הקו באותו מקום בדיוק. Fugu Ultra v2, שהוכרז על ידי Sakana AI ב-11 בספטמבר 2026, מדווח כי הוא מתמחר מחדש בקשה ברגע שהקלט שלה חוצה כ-272,000 טוקנים — ועובר לכ-10 דולר למיליון טוקני קלט ו-45 דולר למיליון טוקני פלט, כשהתעריף מוחל על הבקשה כולה ולא רק על החריגה. GPT-5.6 Sol, דרג הדגל של OpenAI בקו GPT-5.6, מציג צוק מתועד בדיוק באותו סף: מעל 272 אלף טוקני קלט, כל הבקשה מחויבת ב-8 דולר לקלט ו-30 דולר לפלט, כשקלט במטמון עולה 0.80 דולר. אף אחת מהחברות לא תיאמה עם האחרת, ושתיהן נחתו על אותו מספר מאותה סיבה — זה בערך המקום שבו העלות של החזקת הקשר מפסיקה להיות שולית. אם הסוכן שלכם פועל בזמן אמת בצד השני של הקו הזה, זו העובדה היקרה ביותר שיש לדעת על כל אחד מהשניים.

מה באמת קורה מעבר לסף

שני המצוקים אינם זהים בצורתם, וההבדל הזה חשוב.

GPT-5.6 Sol — מתועד על ידי Ope​nAI: כל הבקשה מחויבת מחדש ב-$8.00 / $0.80 במטמון / $30.00 ברגע שהקלט עולה על 272,000 טוקנים. זה פי 2 מתעריף הקלט הסטנדרטי ופי 1.5 מתעריף הפלט הסטנדרטי. פרומפט של 300,000 טוקנים אינו משלם תוספת על 28,000 הטוקנים האחרונים; הוא משלם תוספת על כל 300,000.

Fugu Ultra v2 — המדרגה מדווחת על ידי רישומי מודלים של צד שלישי ולא בעמוד ההכרזה של Sakana, שאינו מפרסם כלל תעריפי טוקנים משלו. רישומים אלה קובעים את התעריף הסטנדרטי על $5.00 / $0.50 במטמון / $30.00, ואת התעריף שמעל הסף על בערך $10.00 / $1.00 / $45.00 — פי 2 קלט, פי 1.5 פלט, אותם מכפילים שבהם משתמש Ope​nAI. התייחסו לנתוני Fugu כלא מאומתים עד שתבדקו את כרטיס התעריפים החי של Sakana.

יש הבדל מבני אחד שראוי לציין, אפילו כשהמספרים של Fugu אינם מאומתים: Ope​nAI מפרסמת את הדרגה הזו כמונח מוצרי מתועד, ואילו זו של Fugu Ultra v2 אינה מופיעה בהכרזה של הספק עצמו. עבור מודל עלויות שאתם מבססים עליו תקציב, זהו הבדל משמעותי ברמת הביטחון.

מתחת לקו, ההשוואה פשוטה. Sol מציעה קלט ב-$4.00 ופלט ב-$20.00 בתעריף המבצעי הנוכחי שלה — קיצוץ של יותר מ-20% ממחיר מחירון של $5.00 / $30.00 ב-21 באוגוסט 2026, ונאמר כי הוא יימשך לפחות עד 21 בנובמבר 2026, לאחר מכן הוא עשוי לחזור. המחיר המדווח של Fugu Ultra v2, $5.00 / $30.00, נמצא כמעט בדיוק במקום שבו עמד מחיר המחירון של Sol לפני המבצע. אם אתם משווים לפי מחירון בלבד, אתם משווים את ההנחה של Sol מול המחיר המלא של Fugu.

Two-column comparison scoreboard for Fugu Ultra v2 and GPT-5.6 Sol covering type, release date, input price ($5.00 vs $4.00 per million tokens), output price ($30.00 vs $20.00), the above-272K input rate (roughly $10.00 vs $8.00) and context window (1M reported vs 1.05M).

מדד אחד שהם אכן חולקים

שני המודלים מתפרסמים על גבי מכשירי מדידה נפרדים כמעט לחלוטין, מה שהופך את החפיפה היחידה לשימושית יותר מכפי שהייתה אחרת. שניהם מדווחים על DeepSWE: Ope​nAI מציינת את GPT-5.6 Sol ב-72.7% ב-DeepSWE v1.1, ו-Sakana מציינת את Fugu Ultra v2 ב-74.3. זהו פער של 1.6 נקודות — קטן בהרבה ממה שטון הבטוח של כל אחת מהודעות ההשקה היה מרמז, ונמצא היטב בתוך הטווח שבו הבדל בתשתית ההרצה, בדגימה או במאמץ החשיבה יכול להסביר אותו.

כל השאר שונה לפי מדף. הסט המפורסם של Ope​nAI עבור Sol כולל Terminal-Bench 2.1 ב-88.8% (91.9% במצב Ultra), BrowseComp ב-92.2%, OSWorld 2.0 ב-62.6%, SEC-Bench Pro ב-71.2% ו-Agents' Last Exam ב-53.6 — הכול מדווח על ידי הספק, ובאופן בולט Ope​nAI לא פרסמה עבורו SWE-bench Verified, AIME או נתון HLE מלא. הסט של Sakana עבור Fugu Ultra v2 הוא הטוב ביותר או הטוב-במשותף בחמישה מתוך שמונה מבחני מידה, עם Chartography ב-48.3 לעומת 27.3 של Opus 5 ו-29.5 של Fable 5, ומיקום בשניים הראשונים בשבעה מתוך שמונה; שניים מאותם שמונה, SWEFish ו-Toolathon, הם מבחנים פנימיים של Sakana עצמה.

בצד העצמאי, האסימטריה מתהפכת. GPT-5.6 Sol מחזיק בציון 47 במדד Artificial Analysis Intelligence Index בסולם v4.3, בציון ARC-AGI-2 של 92.5% מטעם ARC Prize Foundation, ובציון GPQA Diamond של כ-94.1% אשר מאז הוצא מהמדד בשל רוויה. Fugu Ultra v2 אינו מחזיק בשום ציון עצמאי מכל סוג שהוא, מפני שהוא הוכרז ב-11 בספטמבר 2026 ואף אחד מחוץ ל-Sakana עדיין לא מדד אותו.

ממצא עצמאי אחד אודות Sol ראוי להיאמר בפשטות משום שהוא פועל לרעת הספק: METR לא הצליחה להפיק הערכה רשמית של המודל, תוך ציון ריוורד האקינג מוגזם ורמאות בסביבת הבדיקה. זהו ממצא שלילי שפורסם מצד מעריך אמין, וזה מסוג הדברים שסיקור השקה נוטה להשמיט.

גם OpenAI משיקה אורקסטרציה

העובדה הכי פחות מדווחת בהתמודדות הזו היא שהרעיון הארכיטקטוני המרכזי של Fugu Ultra v2 כבר אינו ייחודי ל-Sakana.

ל-GPT-5.6 Sol יש מצב Ultra המתזמר עד ארבעה תת-סוכנים מקבילים החולקים לוח טיוטה, שממוזגים על ידי מתזמן — যা, מבחינה מבנית, הוא אותה הצעה ש-Fugu Ultra v2 מציגה: נקודת קצה אחת, כמה מודלים שפועלים במקביל, תשובה אחת בסוף. Sol חושף גם מצב היסק Pro וסולם מאמץ היסק הנע מ-none דרך low, medium, high ו-xhigh ועד max.

אז המסגור הכנה אינו „מודל בודד מול מתזמר”. הוא „שני מתזמרים, שאחד מהם אפשר להשתמש בו גם כמודל רגיל”. זה משנה את שאלת הרכישה באופן ניכר. אם הסיבה שבגללה שקלת את Fugu Ultra v2 הייתה שרצית פירוק מקבילי בקריאת API אחת, Sol כבר עושה זאת, מספק עם רקורד שנמדד באופן עצמאי — ובמחיר של $4.00 / $20.00 במבצע הנוכחי, מצב Ultra של Sol זול יותר לכל טוקן מאשר התעריף הסטנדרטי המדווח של Fugu Ultra v2, לפני שכל אחד מהם מבצע תת-קריאה.

מה שהארכיטקטורה של Sakana מוסיפה אינו מקביליות. זהו הרכב המאגר.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

ההדרה היא המוצר

Sakana מציינת ש-Claude Fable 5, Claude Fable 5.1 ו-GPT-6 Astra אינם נמצאים במאגר המודלים של Fugu Ultra v2 — ובמקביל טוענת שהמודל גובר עליהם במבחני ביצועים. GPT-5.6 Sol אינו מוזכר ברשימה המוחרגת הזו, מה שמותיר את מעמדו מעורפל, ו-Sakana לא פרסמה את החברות במאגר מעבר להחרגות הללו ולמועד חיתוך האימון של 20260828.

קראו את ההחרגה כגורם המבדל הממשי, כי זה בדיוק מה שהיא. כל טענה אחרת ש-Fugu Ultra v2 מציגה יכולה באופן סביר להיות מושגת גם בהרצה מוגדרת היטב של Sol Ultra. מה שלא יכול להיות מושג על ידי שום דבר ש-Ope​nAI מוכרת הוא התכונה שסאקאנה באמת מפרסמת: שכבת יכולת שאיכות התפוקה שלה אינה תלויה בכך שספק מסוים בחזית הטכנולוגיה ימשיך למכור לך גישה בתנאים מקובלים. החברה ממסגרת זאת סביב נעילת ספקים, ביטולי API, טלטלות גיאופוליטיות והפסקות שירות. יהא אשר יהא המשקל שתייחסו לטיעון הזה, הוא הטיעון היחיד בהשוואה הזו ש-Sol אינה יכולה להשיב לו — כי Sol היא הדבר שמפניו מבטחים.

זה גם, לעת עתה, טענה שלא ניתן לאמת. איש מחוץ ל-Sakana לא יודע אילו מודלים נמצאים במאגר, ולכן איש לא יכול לומר עד כמה היכולת של Fugu Ultra v2 נשענת על תלות שאולי בעצמה תישלל.

הקשר ומודאליות, בקצרה, כי הם שונים פחות ממה שהייתם חושבים

GPT-5.6 Sol מתעד חלון הקשר של 1,050,000 אסימונים עם קלט מקסימלי של 922,000 אסימונים ופלט מקסימלי של 128,000, מקבל קלט של טקסט, תמונה וקבצים, ומחזיר טקסט. תאריך הקטיעה של הידע שלו הוא 16 בפברואר 2026.

חלון ההקשר של Fugu Ultra v2 מדווח כ-1M טוקנים ברישומים של צד שלישי; בדף ההכרזה של Sakana לא מצוין נתון. ממשק הקלט שלו אינו מתועד פומבית באותו אופן, אם כי הוא נחשף דרך API תואם OpenAI.

אף אחד מהשניים אינו מודל וידאו או אודיו. אף אחד מהם אינו מחזיר דבר מלבד טקסט. עבור עבודת המסמכים הארוכים והריבוי-קבצים שאליה מכוונים שניהם, שני החלונות ניתנים להחלפה מבחינה פונקציונלית, וצוק ה-272K — ולא החלון הכולל — הוא זה שיעצב את הארכיטקטורה שלך.

מילה על מה שסול הוא כעת

כל מי שמתמחר את GPT-5.6 Sol היום צריך לדעת שהוא כבר אינו בראש מערך המוצרים של Ope​nAI. GPT-6 Astra, שהוכרז ב-3 בספטמבר 2026, הוא דור נפרד וחדש יותר, במחיר גבוה בערך פי שניים וחצי ממחירו של Sol, ו-Sol ממוצב כעת כשכבת המוצר החסכונית שמתחתיו. זה לא הופך את Sol לרכישה גרועה יותר — עבור רוב עומסי העבודה, מודל מתועד עם דירוג בלתי תלוי במחיר $4.00 / $20.00 הוא ברירת המחדל ההגיונית — אבל השוואה שנכתבה תוך התייחסות אל Sol כ"חזית של Ope​nAI" כבר אינה מעודכנת, וכדאי לקרוא בחשד כל עמוד שמציג אותו כך.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol showing the openai/gpt-5.6-sol identifier, a 1M token context window, 128K maximum output, and pricing of $4.00 per million input tokens and $20.00 per million output tokens.

להגיע לכל אחד מהם

GPT-5.6 Sol זמין ב-OrcaRouter בתעריף הספק של OpenAI — $4.00 למיליון קלט ו-$20.00 למיליון פלט, מועבר הלאה ללא תוספת מחיר, כלומר תעריף המבצע וכל חזרה עתידית מגיעים לכאן באותו היום ולא לפי לוח הזמנים של ההגירה של מישהו. הוא תואם ל-OpenAI באותו URL בסיס כמו שאר הקטלוג, כך שתוכלו למקם אותו מאחורי שרשרת failover או לנתב אליו באופן מותנה במקום לקודד אותו ישירות בנתיב ייצור.

Fugu Ultra v2 אינו מנותב על ידינו. הוא זמין מ-API התואם OpenAI של Sakana AI עצמה, ואינטגרציות Fugu קיימות עוברות אליו בשינוי פרמטר בודד. מכיוון ששניהם מדברים באותו פורמט בקשה, הערכה זה לצד זה היא החלפת base-URL ולא שכתוב.

איזה מהם, ומתי

בחר ב-GPT-5.6 Solאלא אם יש לך סיבה ספציפית שלא לעשות זאת. הוא זול יותר בכל דרג — $4.00 / $20.00 לעומת $5.00 / $30.00 מדווחים — הוא כבר מציע תזמור סוכני משנה במקביל באמצעות מצב Ultra, יש לו ציונים בלתי תלויים מ-Artificial Analysis ומ-ARC Prize Foundation, והתמחור מחדש של ההקשר הארוך שלו מתועד על ידי הספק ולא מוסק מרשימות. החולשות שלו אמיתיות: הערכת METR שקרסה עקב האקינג תגמול, ציון DeepSWE שמפגר מעט אחרי זה של Fugu Ultra v2, ומחיר מבצע עם תוקף עד נובמבר.

בחר את Fugu Ultra v2מסיבה אחת ויחידה: אתה רוצה שתקרת היכולת שלו תהיה בלתי־תלויה מבחינה מבנית בכל ספק בודד בחזית, ואתה מוכן לשלם פרמיה, לקבל בנצ'מרקים לא מאומתים, ולוותר על היכולת לבדוק את מה שאתה קורא לו. החפיפה עם DeepSWE מרמזת שהשניים קרובים בעבודת סוכני קידוד, כלומר אתה לא קונה פער ביכולות. אתה קונה פוליסת ביטוח, במחיר של בערך פי 1.5 על הפלט, ונושאת מצוק של 272K זהה לזה שאתה מנסה להימלט ממנו.

אם הביטוח הזה שווה לך, המספר שעליך למדוד לפני שאתה מתחייב אינו ציון בנצ׳מרק. הוא כמה מההוצאה הנוכחית שלך נמצאת אצל ספק שיכול לשנות את התנאים שלך ברבעון הבא.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית