بطاقة عنوان رئيسية لـ"Fugu Max vs GPT-5.6 Sol" مع عنوان فرعي يقول "كان ادعاء التسعير موجّهًا إلى منتصف العائلة"، وثلاث شارات كبسولية تقول "$6.00 مقابل $20.00 للإخراج"، و"ادعاء 40-60% مقابل Terra"، و"ستة انتصارات، بلا نتائج"، وسطر تذييل يقول "Sakana AI مقابل OpenAI - سبتمبر 2026"، وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

Fugu Max مقابل GPT-5.6 Sol: كان ادعاء التسعير يستهدف منتصف العائلة

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Fugu Max's price justification names a G​PT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same Ope​nAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.

التحقق من الادعاء مقابل العائلة التي يشير إليها

رقم ساكانا البالغ 40 إلى 60 بالمئة قابل للاختبار، لأن النموذج الذي تسميه له سعر منشور. يُدرج GPT-5.6 Terra بسعر 2.00 دولار للإدخال و12.00 دولار للإخراج لكل مليون رمز. ويُدرج Fugu Max بسعر 2.00 دولار للإدخال و6.00 دولار للإخراج. أجرِ المقارنة، فيظهر أمران. على صعيد الإخراج، إن 6.00 دولار مقابل 12.00 دولار تخفيض نسبته 50 بالمئة بالضبط — في منتصف النطاق المعلن بين 40 و60 تمامًا، وهو ما يشير إلى أن النطاق رُسم حول هذه المقارنة بدلًا من أن يُكتشف منها. أما على صعيد الإدخال، فالسعران متطابقان إلى السنت.

That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the G​PT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.

• سعر الإدخال — Fugu Max ‏2.00 دولار لكل مليون توكن مقابل GPT-5.6 Sol ‏4.00 دولار لكل مليون توكن

• سعر الإخراج — Fugu Max ‏6.00 دولارات لكل مليون رمز مقابل GPT-5.6 Sol ‏20.00 دولارًا لكل مليون رمز

• المدخلات المخزَّنة مؤقتًا — Fugu Max بسعر 0.25 دولار لكل مليون رمز مقابل GPT-5.6 Sol حيث يُسعَّر التخزين المؤقت كخصم على سعر المدخلات الأساسي

• السياق — Fugu Max لم يُنشر مقابل GPT-5.6 Sol بسعة 1M توكن

• سقف الإخراج — Fugu Max غير مُعلَن مقابل GPT-5.6 Sol ‏128K رمز

• نمط الإدخال — Fugu Max غير منشور مقابل GPT-5.6 Sol: نص وصورة وملف

• وسوم القدرات — Fugu Max: لم يُنشر أي منها، مقابل GPT-5.6 Sol: الرؤية، استخدام الأدوات، وضع JSON، الاستدلال

• نقاط النهاية — واجهة واحدة متوافقة مع OpenAI من Fugu Max مقابل إكمالات الدردشة وواجهة الاستجابات من GPT-5.6 Sol

• أرقام المعايير — يُزعم تحقيق Fugu Max لستة انتصارات دون أي درجات، مقابل أرقام المورّد المنشورة لـ GPT-5.6 Sol، بما في ذلك Terminal-Bench 2.0 عند 91.9% وSWE-bench Pro عند 64.6%

لماذا تُعدّ الدرجة الوسطى هي الدرجة الصحيحة للتسمية

هناك نسخة قابلة للدفاع عنها من خيار Sakana، وتستحق أن تُذكر قبل النقد. إن المنسّق الذي يوجّه كل مهمة إلى النموذج الأخف القادر على أدائها لا ينافس نموذجًا رائدًا في الأعمال المخصصة للنماذج الرائدة. بل ينافس نموذجًا من الفئة المتوسطة في أعمال الفئة المتوسطة، ويعرض إنجاز مجموعة فرعية منها بتكلفة أقل. وإذا كان العرض المطروح هو "معظم حركة الاستخدام لديك لا تحتاج إلى Sol"، فإن Terra هو المقارن الصحيح، لأن Terra هو ما تلجأ إليه معظم الفرق فعليًا عندما لا تريد دفع أسعار Sol. إن القياس مقابل الفئة التي كان عميلك سيشتريها لولا ذلك أكثر نزاهة من القياس مقابل أغلى نموذج متاح.

تكمن الصعوبة في أن الجملة نفسها تزعم أيضًا أداءً «على مسافة منافسة من النماذج النخبوية». وهذان النصفان من الطرح يشدّان في اتجاهين متعاكسين. فإذا كان Fugu Max بديلًا عن Terra، فإن تأطيره كنموذج نخبوي يؤدي وظيفة تسويقية لا يسندها الأساس، لأن Terra ليست مصنفة صراحة كنخبوية — بل مصنفة كفئة «الجيد بما يكفي». وإذا كان Fugu Max فعلًا على مسافة منافسة من Sol، فقد كان ينبغي إجراء مقارنة الأسعار مقابل Sol، حيث تكون الفجوة أكبر وأكثر إطراءً. إن الإصدار الذي يقدّم ادعاء القدرة الجريء والمقارنة السعرية المتحفظة في الفقرة نفسها يحاول أن يفوز من الجانبين، ولا سبيل للقارئ إلى معرفة أيّ الشقين هو الحامل للثقل.

A two-column scoreboard titled "Fugu Max vs GPT-5.6 Sol - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Context not published, Modality not published, Benchmarks six wins with no figures. Right column GPT-5.6 Sol: Output price $20.00 / 1M, Input price $4.00 / 1M, Cached input discount on base rate, Context 1M tokens with 128K output, Modality text, image and file, Benchmarks 91.9% on Terminal-Bench 2.0. Footer reading "Fugu Max figures vendor-reported by Sakana AI. Sakana's 40-60% output claim names GPT-5.6 Terra at $2.00 / $12.00, not Sol.", with the OrcaRouter logo bottom-right.

ستة اختبارات مرجعية، بلا أرقام، واسم واحد ينبغي أن يثير سؤالاً

نصف القدرات في العرض الترويجي يستند إلى قائمة. يحقق Fugu Max «أفضل نتيجة إجمالية» في Terminal Bench 2.1 وGPQAD وAA-LCR وGDP.pdf وAutomationBench وSWEFish. لا تُطبع أي نتائج لأي منها. SWEFish هو معيار برمجي داخلي خاص بـ Sakana، ما يعني أن أحد الانتصارات الستة يُحتسب بناءً على اختبار كتبه المورّد ولم ينشره.

يقدّم GPT-5.6 Sol أرقامًا. يُدرَج Sol عند 91.9% على Terminal-Bench 2.0 و64.6% على SWE-bench Pro في بيانات مقارنة من طرف ثالث. لاحِظ عدم تطابق الإصدار في اختبار الطرفية: الرقم المنشور لـ Sol يخص Terminal-Bench 2.0، بينما تدّعي Sakana تحقيق فوز في 2.1، وهو تقييم مختلف ولا يمكن مقارنته به. يستحق ذلك الإشارة لأن الادّعاءين يبدوان متجاورين في عنوان رئيسي، لكنهما غير قابلين للمقارنة في الواقع.

المقارنة ذات الصلة بهذه المواجهة ستكون بين Sol ونموذج Fugu في تقييم مشترك. تعرض صفحات المقارنة الخارجية بالفعل مقارنةً بين GPT-5.6 Sol والجيل الأساسي من Sakana Fugu — إذ يتقدم Sol في Terminal-Bench 2.0 بنسبة 91.9% مقابل 80.2%، وفي SWE-bench Pro بنسبة 64.6% مقابل 59% — لكن هذه أرقام تخص الجيل الأسبق، وليس Fugu Max، كما تمتنع المصادر نفسها صراحةً عن تسمية فائز إجمالي لأن تغطية المعايير المشتركة ضئيلة جدًا. لا توجد أي مقارنة منشورة من أي نوع بين Fugu Max وGPT-5.6 Sol. وأي شخص يزعم وجود واحدة فإنه يستقرئ ما لا تدعمه البيانات.

لم يقيّم أي طرف مستقل Fugu Max، ولا يوجد أي إدخال خاص بـ Artificial Analysis له أو لأي نموذج من نماذج Fugu. وكل رقم في البيان الصحفي، بما في ذلك الانتصارات الستة، مصدره المورّد. أما Sol، في المقابل، فقد أصبح متاحًا عمومًا منذ 9 يوليو 2026 ويظهر في لوحات المتصدرين التي يديرها أطراف ثالثة — وهو مستوى من التدقيق الخارجي لم تتح لـ Fugu Max فرصة لتلقّيه.

ما الذي تشتريه فعليًا على كل جانب

يُعد ضبط GPT-5.6 Sol أمرًا معروفًا. فهو يحمل نافذة سياق تبلغ مليون توكن، وسقف إخراج يبلغ 128 ألف توكن، وإدخال نص وصورة وملف، ورؤية، واستخدام أدوات، ووضع JSON، واستدلال كقدرات موثقة، ونقطتي نهاية — chat completions وresponses API — بحيث يكون لدى تكامل قائم مكان يتجه إليه. ويُظهر زمن وصول إلى أول توكن عند المئين 50 (p50) قدره 6.68 ثانية عبر حركة المرور التي نخدمها، وهو أبطأ من أسرع النماذج في كتالوجنا ويستحق معرفته قبل أن تبني منتجًا تفاعليًا عليه.

تكوين Fugu Max أقرب إلى شراء مستوى خدمة منه إلى شراء نموذج. تحصل على نقطة نهاية واحدة متوافقة مع OpenAI، وتغيير معامل من سطر واحد للانتقال إليه من إصدار Fugu أقدم، ومنسّق يقرر أي النماذج يستدعي. وما لا تحصل عليه، من صفحة الإصدار، هو نافذة سياق، أو سقف مخرجات، أو قائمة وسائط، أو رقم زمن استجابة، أو نتيجة معيار أداء. قرارات التوجيه الخاصة بالمنسّق غير مكشوفة بحكم التصميم. توسّعت المجموعة في هذا الإصدار لتشمل نماذج مفتوحة الأوزان ونماذج متخصصة، مع تسمية عائلة NVIDIA Nemotron عبر تعاون مع NVIDIA، وهي بخلاف ذلك غير معلنة.

المبرر المعلن من ساكانا لهذا الغموض قابل للدفاع عنه — فوجود مجموعة محايدة تجاه المورّدين وقابلة للاستبدال يمثل حماية من الإهمال وتغيرات الأسعار والانسحابات الإقليمية. إنه تحوط حقيقي، ويوحي سعر الإدخال المخزّن البالغ 0.25 دولار بأن ساكانا تتوقع أحمال العمل ذات السياق الطويل والتكرار العالي، حيث سيكون لهذا التحوط أكبر أهمية. لكنه يعني أن المواصفات التي تشتريها هي وعد يتعلق بسلسلة التوريد وليس وصفًا لمنتج.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

كيفية تشغيل الاختبار

الطريقة الصحيحة لحسم هذا الأمر ليست قراءة صفحة أيٍّ من المورّدين. خُذ عيّنة من حركة المرور الخاصة بك — بضع مئات من الطلبات الحقيقية، ويُفضَّل أن تتضمّن تلك التي يصعّدها فريقك حاليًا — وشغِّلها على كلا نقطتي النهاية مع تفعيل احتساب الرموز. احسب تكلفتها على أساس الرموز لكل مهمة مكتملة لا الرموز لكل استدعاء، وحدِّد ميزانية إخراج قبل أن تبدأ حتى لا يُفاجئك أي توسّع متشعّب، وقِس الجودة بما إذا كان شخص ثانٍ يوافق على أن الإجابة كانت مقبولة. هذه التجربة تحسم السؤال خلال أسبوع وتكلّف قليلاً.

The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at Ope​nAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to Ope​nAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.

خلاصة القول

GPT-5.6 Sol يفوز في المقارنة التي أحجمت Sakana عن عقدها. فهو يكلّف ضعف التكلفة على الإدخال وأكثر من ثلاثة أضعافها على الإخراج، وفي المقابل تحصل على نافذة سياق منشورة، وسقف إخراج يبلغ 128K، وإدخال متعدد الوسائط موثّق، ووسوم قدرات مسمّاة، ونقطتي نهاية، واختبارات أداء من المورّد أتيح للأطراف الثالثة أشهر لفحصها. وإذا كان عملك من النوع الذي بُني Sol من أجله — استدلال عميق متعدد الخطوات، وهندسة برمجيات واسعة النطاق، ومهام وكيلية بعيدة المدى — فإن فارق السعر هو ثمن شراء شيء يمكنك تحديده بدقة.

فاز Fugu Max برهان أضيق ومثير للاهتمام حقًا، وهو الأرخص بفارق واسع: أقل بنسبة 50 بالمئة من GPT-5.6 Terra على المخرجات، وأقل بنسبة 70 بالمئة من Sol، مع أدنى سعر للتخزين المؤقت في أي من قائمتي الأسعار. إذا كانت حركة المرور لديك كثيفة الحجم، نصية فقط، وقابلة للتحقق، ولا تحتاج في الغالب إلى استدلال بمستوى الرائد، فإن منظّمًا يوجّه الطلبات إلى النموذج الأكثر رشاقة وكفايةً يعد تصميمًا متماسكًا، وسعر المخرجات البالغ 6.00 دولارات هو موضع القيمة. خذ الإطار الذي قدّمته الإصدارة على محمل الجد وجرّبه كبديل لـ Terra لا لـ Sol — وإذا أردت النموذج الرائد بسعر القائمة الخاص بالمزوّد دون أي تغيير، فإن GPT-5.6 Sol على بُعد مفتاح واحد على OrcaRouter.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol, captured September 11, 2026, English UI), showing the Featured badge, the openai/gpt-5.6-sol model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-09, the /v1/chat/completions and /v1/responses endpoints, the pricing tiles reading INPUT $4.00 and OUTPUT $20.00 per 1M tokens with p50 TTFT 6.68s and 153.0M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا