بطاقة عنوان رئيسية مكتوب عليها "Fugu Ultra v2 مقابل Qwen3.8-Max" مع عنوان فرعي "لماذا بطاقة السعر هي الرقم الخاطئ"، وثلاث شارات على شكل كبسولة مكتوب عليها "الإخراج: $30.00 مقابل $6.00"، و"فوق 272K: يتضاعف المعدل" و"تقييم Fugu المستقل: لا يوجد"، وسطر تذييل مكتوب عليه "Sakana AI، 11 سبتمبر 2026 مقابل Alibaba، أغسطس 2026"، وشعار OrcaRouter في الزاوية اليمنى السفلى.
Guides & Insights

Fugu Ultra v2 مقابل Qwen3.8-Max: لماذا يُعدّ السعر المعلن الرقم الخاطئ

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

تبلغ تكلفة Fugu Ultra v2 نحو 30.00 دولارًا لكل مليون رمز إخراج. أما Qwen3.8-Max فتبلغ تكلفته 6.00 دولارات. هذه فجوة بنسبة خمسة إلى واحد، وإذا اخترت بين هذين النظامين الوكيليين بناءً على هذه النسبة فستختار خطأً — لأن أياً منهما لا تُحتسب فاتورته فعليًا بالطريقة التي يوحي بها قائمة أسعاره. وفق قياس Artificial Analysis نفسه، ولّد Qwen3.8-Max 180 مليون رمز إخراج لإكمال مؤشر الذكاء، أي أكثر من ضعف 89 مليونًا لدى النموذج الوسيط، بتكلفة 2.67 دولار للمهمة. إنه نموذج مقتصد بالرموز ومبذّر بالإجابة. أما Fugu Ultra v2 من Sakana AI، الذي أُطلق في 11 سبتمبر 2026، فله شكل معاكس: مجموعة غير معلنة من نماذج مختبرات أخرى يولّدها وينسّقها لكل طلب، وتُحتسب فاتورتها بسعر مدمج واحد تقول Sakana إنه لا يتضاعف مع إضافة الوكلاء. أحدهما نموذج واحد بمعاملات تبلغ 2.4 تريليون يطيل التفكير بصوت مسموع. والآخر منسّق صغير يستعين بمساعدة. ومقارنة أسعار رموزهما لا تكاد تخبرك بشيء عن أيهما أرخص في التشغيل.

طريقتان متعاكستان لكونك باهظ الثمن

ابدأ بالآلية، لأنها تشرح كل اختلاف آخر في هذه المقارنة.

Qwen3.8-Max هو نموذج خليط خبراء متناثر — 2.4 تريليون معامل إجمالي، ونحو 95 مليار معامل نشط لكل رمز — يحقّق نتائج قريبة من الطليعة عبر العمل لمدة أطول بدلًا من أن يكون أكبر. قاسته Artificial Analysis عند 37.8 رمز إخراج في الثانية، ما يضعه في المرتبة #154 من 200 نموذج من حيث السرعة، مع إصدار 180 مليون رمز إخراج عبر Intelligence Index (المرتبة #70 من 200 في الإسهاب). وتبلغ تكلفته لكل مهمة في Intelligence Index نحو 2.67 دولار، وخصم الذاكرة المؤقتة لديه عميق بشكل غير معتاد عند 88%، وهو الرافعة التي تتحكم فعليًا في الفاتورة هنا: تشغيل وكيل طويل يظل يعيد قراءة السياق نفسه يكون رخيصًا، أما تشغيل يظل يولّد نصًا جديدًا فليس كذلك.

يقدّم Fugu Ultra v2 مقاربة للمشكلة نفسها من الطرف الآخر. فهو منظّم — منسّق صغير مدرّب، يُقال إنه بنحو 7 مليارات معامل، يقرأ الطلب، ويجمّع فريق وكلاء وفق أدوار المفكر والعامل والمدقق من عمل TRINITY لدى Sakana، ثم يركّب إجابة. وفاتورة الرموز الخاصة به هي مجموع ما ينتجه وكلاؤه الفرعيون زائد نص التركيب الخاص بالمنسّق. وتلتزم Sakana في الأسئلة الشائعة حول التسعير بأنك تُحاسَب بسعر موحّد واحد مرتبط بالطراز الأعلى فئة المشارك، وأن إضافة وكلاء لا تضاعف الفاتورة، وهو ما يزيل الانفجار الكلاسيكي متعدد الوكلاء حيث يضاعف التشعّب التكلفة. لكن ما لا يزيله هو الحجم. عند 30.00 دولارًا لكل مليون رمز إخراج، فإن الرقم المهم هو عدد الوكلاء الذين عملوا وكم كتبوا، وهو رقم لا يمكنك أنت ولا Sakana التنبؤ به من صفحة التسعير.

ذلك هو التأطير الصادق لفارق السعر: إنه معدل، وليس إجمالًا. معدل أعلى خمس مرات يُطبَّق على عبء عمل لا يمكنك التنبؤ بحجم مخرجاته ليس تكلفة أعلى خمس مرات — بل مضاعف غير محدود مع حد أدنى يمكن توقعه.

A two-column scoreboard titled 'Fugu Ultra v2 vs Qwen3.8-Max Scoreboard' contrasting six dimensions. Fugu Ultra v2: price $5.00/$30.00 per 1M, context 1M tokens, above 272K input doubles to $10, AA Index none published, speed not measured, weights closed with pool undisclosed. Qwen3.8-Max: price $2.00/$6.00 per 1M, context 1M tokens, above 272K no surcharge, AA Index 40 ranked #30 of 200, speed 37.8 tokens/sec, weights open checkpoint published. Footer reads 'Fugu Ultra v2 figures vendor-reported; no independent evaluation. Qwen3.8-Max figures per Artificial Analysis, recalibrated scale.' OrcaRouter logo bottom-right.

ورقة المواصفات، والصف الواحد الذي يحسم الأمر

• السعر — Fugu Ultra v2 بسعر 5.00$ للإدخال / 30.00$ للإخراج لكل مليون رمز مقابل Qwen3.8-Max بسعر 2.00$ للإدخال / 6.00$ للإخراج

• الإدخال المخزّن مؤقتًا — Fugu Ultra v2 بسعر 0.50 دولار لكل مليون مقابل Qwen3.8-Max بسعر 0.25 دولار لكل مليون عملية قراءة، وخصم تخزين مؤقت بنسبة 88% وفق قياس Artificial Analysis

• رسوم إضافية للسياق الطويل — تتضاعف تكلفة إدخال Fugu Ultra v2 إلى 10.00 دولارات، والإخراج إلى 45.00 دولارًا فوق 272 ألف رمز، مقابل Qwen3.8-Max الذي لا يفرض رسومًا إضافية على المطالبات الطويلة، وبسعر ثابت حتى كامل نافذة السياق

• نافذة السياق — Fugu Ultra v2 بمليون رمز مقابل Qwen3.8-Max بمليون رمز

• الحد الأقصى للإخراج — لم يُنشَر Fugu Ultra v2 كرقم واحد مقابل Qwen3.8-Max بنحو 128K رمز

• نمط الإدخال — نص Fugu Ultra v2، مدعومًا بقدرات المجموعة الخاصة به، مقابل نص Qwen3.8-Max والصورة والفيديو وPDF

• الأوزان — أوزان Fugu Ultra v2 مغلقة، وعضوية المجموعة غير معلنة بحكم التصميم، مقابل أوزان Qwen3.8-Max المفتوحة المنشورة لنقطة تحقق من فئة Max بموجب ترخيص مخصص

• التوافر الإقليمي — Fugu Ultra v2 غير متاح للبيع في الاتحاد الأوروبي/المنطقة الاقتصادية الأوروبية مقابل Qwen3.8-Max المتاح دون قيود إقليمية

• تقييم مستقل — Fugu Ultra v2: لا يوجد أي تقييم منشور، ولا توجد صفحة Artificial Analysis لأي طراز من Fugu؛ مقابل Qwen3.8-Max، وهو مُدخل مباشر على Artificial Analysis مع أرقام منشورة للسرعة والإسهاب والتكلفة لكل مهمة

اقرأ الصفين الأخيرين معًا تزداد حدة المواجهة. Qwen3.8-Max نموذج يمكنك تثبيت إصداره، وقراءة ترخيصه، وتنزيل نقطة تحقق منه، والتحقق منه مقابل لوحة نتائج طرف ثالث. أما Fugu Ultra v2 فهو نظام لا يمكنك فحصه، ولا استضافته ذاتيًا، ولا شراؤه في أوروبا، ولا التحقق منه لدى أي جهة خارج Sakana. ويزيد رسم 272K الإضافي الأمر سوءًا: بعد هذا الحد، يتضاعف سعر إدخال Fugu Ultra v2 ويرتفع سعر إخراجه بالنصف، بينما لا يتحرك سعر Qwen3.8-Max. وبالنسبة لأعمال المستندات والمستودعات الطويلة الأفق التي بُني كلا النظامين من أجلها، فإن السعر المعلن الأرخص هو أيضًا الأكثر ثباتًا.

الرقم الذي يتداوله الجميع لـ Qwen3.8-Max أصبح قديمًا

إذا كنت قد قرأت عن هذا النموذج في أي مكان خلال الأسبوعين الماضيين، فمن المحتمل أنك رأيت مؤشر الذكاء من Artificial Analysis عند 58، أو 58.1، أو 58.4. كانت تلك الأرقام حقيقية، ولم تعد سارية. أعادت Artificial Analysis معايرة مؤشرها إلى v4.3 في 7 سبتمبر 2026، مما ضغط الدرجات على جميع المستويات، وتعرض صفحة Qwen3.8-Max المباشرة الآن 40، مما يضعها في المرتبة #30 من أصل 200 نموذج — مع شارة "Updated" التي تشير إلى درجة أُعيد بيانها. كما حملت المقالات الأقدم ضريبة الجهد المقيسة على المقياس السابق: 64 دورة لكل مهمة مقابل 14 للجيل السابق من Qwen، ونحو 1.14 دولار لكل مهمة في مؤشر الذكاء. تعرض الصفحة الحالية 2.67 دولار لكل مهمة، و37.8 توكن إخراج في الثانية، و180 مليون توكن إخراج في المؤشر.

يترتب على ذلك أمران. أولًا، على المقياس المُعاد معايرته، يقع Qwen3.8-Max في النطاق نفسه الذي تقع فيه بقية الطبقة الثانية من الطليعة، لا في مستواها نفسه؛ وأي مقارنة تقرأها تصنّفه في مواجهة Claude Opus 5 أو Kimi K3 عند 58 إنما تقارن لقطات من مقياسين مختلفين. ثانيًا، وبشكل أكثر فائدة لهذه المواجهة، التصحيح أحادي الاتجاه: لدى Qwen3.8-Max رقم يمكن أن يكون خاطئًا ثم يُصحَّح. أما Fugu Ultra v2 فليس لديه رقم. كل رقم يخص Fugu في هذا المقال يأتي من تقييم Sakana نفسه، واعتبارًا من 11 سبتمبر لا توجد صفحة Artificial Analysis لـ Fugu Ultra v2 أو أي نموذج Fugu آخر — الرابط يعطي خطأ 404. عندما ينشر مورّد لوحة نتائج ولا يكون أي طرف مستقل قد شغّل النموذج، فإن لوحة النتائج هي السجل بأكمله.

حيث يتداخلان فعليًا، وحيث لا يتداخلان

تُفيد ساكانا أن Fugu Ultra v2 هو الأفضل أو الأفضل مناصفةً في خمسة من ثمانية معايير — GDP.pdf، وChartography، وSWEFish، وDeepSWE، وToolathon — وفي المرتبتين الأوليين في سبعة من ثمانية. الرقمان الملموسان في البيان هما Chartography عند 48.3، مقابل 27.3 لـ Claude Opus 5 و29.5 لـ Claude Fable 5 في الجدول نفسه، وDeepSWE عند 74.3. تتضمن الصفوف المنشورة الخاصة بـ Alibaba لـ Qwen3.8-Max Terminal-Bench 2.1 عند 86.6، وOSWorld-Verified عند 86.1، وGPQA Diamond عند 92.6، وSWE-bench Pro عند 67.7.

لاحِظ القاسم المشترك بين هاتين القائمتين: لا شيء. لا يظهر أي معيار تقييم واحد في كلا جدولَي المورّدين. لا يوجد أي صف يمكنك فيه أن تضع رقم Sakana ورقم Ali​baba جنبًا إلى جنب وتحدد منه فائزًا، ما يعني أن الإجابة الأمينة عن سؤال «أيّهما أفضل في وكلاء البرمجة؟» هي أنه لا يوجد دليل منشور يجيب عنه. الموجود هو نظام واحد فيه ثمانية صفوف يختارها المورّد ودون تحقق خارجي، ونظام واحد فيه صفوف المورّد بالإضافة إلى مُدخَل مستقل يقيس التكلفة والسرعة بدلًا من مقارنة القدرة وجهًا لوجه. هذه فجوة في الأدلة، لا فجوة في النماذج، وينبغي أن تغيّر طريقة شرائك: لا يمكنك الاختيار بين هذين النظامين بناءً على المعايير، لذا اختر بناءً على الخصائص التي يمكنك التحقق منها فعلاً.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, with the opening paragraphs arguing that the frontier which matters is two-dimensional — capability against cost — and stating that Fugu Ultra v2 pushes peak performance higher without indispensable reliance on the frontier models it orchestrates.

الأوزان المفتوحة مقابل مجموعة غير مُفصح عنها

هنا تنقلب حجة الإغلاق المعتادة، وهذا هو أكثر ما يثير الاهتمام في هذا الاقتران.

يقوم عرض Sakana الترويجي لـ Fugu Ultra v2 على السيادة. فوجود مجموعة قابلة للتبديل من النماذج المفتوحة والمتخصصة يعني أن قرار تسعير أي مورّد واحد، أو جدول إيقاف الدعم، أو تغيّر سياساته، لا يمكن أن يُسقط منتجك، ويوضح الإصدار هذه النقطة صراحةً بالإشارة إلى أن تركيبة المجموعة قد تغيّرت في v2. كما تذكر الشركة بصراحة أن درجات Fugu Ultra v2 تحققت من دون Claude Fable 5 أو Claude Fable 5.1 أو GPT-6 Astra في مجموعة الوكلاء — مدّعية تحقيق انتصارات على أقوى ثلاثة نماذج متاحة بينما تؤكد أنها لا تستدعي أياً منها. ومهما كانت محتويات المجموعة، فهي ليست قمة السوق بحسب حسابات Sakana نفسها.

لكن للتحوّط تكلفة ليست مدرجة في قائمة الأسعار. لا يمكنك رؤية المجمّع، ولا يمكنك اختيار إدراج عضو في طبقة Ultra أو استبعاده منها، ولا يمكنك استضافة أي جزء منه ذاتيًا، ولا يمكنك تشغيله في الاتحاد الأوروبي/المنطقة الاقتصادية الأوروبية على الإطلاق — فالتنسيق القائم في سنغافورة فوق أوزان مختبرات أخرى يمثل ملفّ مخاطر مختلفًا عن امتلاك الأوزان. أما Qwen3.8-Max فيعكس ذلك تمامًا. فهو نموذج مورّد واحد، وبالتالي فهو معرّض لقرارات مورّد واحد، لكن Alibaba نشرت أوزانًا مفتوحة لنقطة تحقق Qwen3.8-2.4T-A95B من فئة Max بموجب ترخيص مخصّص، ما يعني أن منفذ النجاة حقيقي وليس مجرد بلاغة: إذا تغيّرت الأسعار أو الشروط، يمكن تقديم النموذج من بنيتك التحتية الخاصة. وبالنسبة لفريق يكون خوفه الفعلي هو أن يسحب مورّد البساط من تحت قدميه، فإن نقطة تحقق قابلة للتنزيل تشكّل ضمانًا أقوى من وعد بشأن مجمّع لا يُسمح لك بفحصه.

ثمة نقطة من الدرجة الثانية لأي شخص يشغّل وكلاء عبر كليهما.Qwen3.8-Max مُدرج في كتالوجنا بسعر 2.00 دولار للإدخال و6.00 دولار للإخراج، وهو السعر المعلن لدى Alibaba مع تمرير هامش ربح بنسبة 0% — فتغيّر سعر المورّد ينزل على المفتاح نفسه في اليوم نفسه، ويغطي التحويل التلقائي عند الفشل أي مسار مورّد محدود المعدّل أو متدهوr الأداء. أما Fugu Ultra v2 فليس على OrcaRouter. إنه يصلك عبر واجهة برمجة التطبيقات المتوافقة مع OpenAI الخاصة بـ Sakana وعدة منصات طرف ثالث، والانتقال من إصدار Fugu أسبق هو تغيير معامل في سطر واحد. الموجّه ليس بديلاً عن المنسّق، والمنسّق ليس بديلاً عن القدرة على التحويل عند الفشل؛ وإذا أردت الخاصيتين معًا فأنت تشغّل أنظمة مورّدين اثنين، وينبغي أن تضع في ميزانيتك فاتورتين.

أي واحد يجب أن تختاره؟

اختر Qwen3.8-Max إذا كنت بحاجة إلى نموذج يمكنك التنبؤ به والتحقق منه والإفلات منه. فهو يمثل ثلث معدل إنتاج Fugu Ultra v2 بالسعر المعلن، ولا يعاني من انهيار السياق الطويل، ويقبل الصور والفيديو وملفات PDF، بينما تعتمد وسائط مجموعة Fugu على ما يدعمه الوكلاء الأساسيون فعلاً، وينشر نقطة تفتيش يمكنك الرجوع إليها، ويُباع في كل مكان، ولديه إدخال مستقل مباشر يقيس الأشياء التي تحدد فاتورتك فعلاً — 37.8 رمزاً في الثانية ورقم تكلفة لكل مهمة يمكنك نمذجته قبل الالتزام. ونقاط ضعفه محددة بالقدر نفسه وتستحق التسمية: فهو بطيء، ويحتل المرتبة 154 من 200 في السرعة، وهو مطوّل بإفراط عند 180 مليون رمز في المؤشر، وقاس Artificial Analysis بشكل منفصل ارتفاع معدل الهلوسة لديه من 23% إلى 40% مقارنة بالجيل السابق، وهو مصدر قلق جدي تحديداً للعمل المستقل متعدد الخطوات الذي يُسوَّق من أجله. خصص ميزانية لمدقق، واستخدم خصم الذاكرة المؤقتة العميق بجرأة.

اختر Fugu Ultra v2 إذا كان عملك طويل الأفق وقابلاً للتحقق، وكانت ميزانيتك استكشافية لا إنتاجية، وكنت خارج الاتحاد الأوروبي/المنطقة الاقتصادية الأوروبية. الحجة البنيوية لوجود منسّق حقيقية، وأمثلة البائع نفسه تشير إليها باستمرار — تشغيل بحث آلي من 123 تجربة على مدى أربع عشرة ساعة على H100 واحدة، وحلّال مكعب روبيك بلغة Python خالصة أكمل جميع المكعبات الثلاثمئة المبعثرة حيث انهار خطا أساس أماميان مجهولا الهوية انهيارًا تامًا. هذه أمثلة اختارها البائع مع خطوط أساس مجهولة الهوية، وهي تثبت أقل مما تبدو عليه، لكن النمط متماسك: في المهام التي تكون فيها الصحة قابلة للتحقق ويكون الجزء الصعب هو المثابرة، فإن إنشاء مُتحقِّق يتفوق على مطالبة نموذج واحد ببذل جهد أكبر. ما تشتريه هو تلك المثابرة، بمعدل يعادل خمسة أضعاف سعر Qwen3.8-Max، في نظام لا يمكنك تدقيق جودته ولا يمكنك تثبيت مجموعة النماذج التي يستخدمها. جرّبه في نطاق محدود، وقِس رموز الإخراج لكل مهمة مكتملة بدلاً من قياسها لكل رمز، وحدّد سقفًا قبل التشغيل الأول.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (English UI, captured September 11, 2026), showing the model title, the 'Featured' badge, the identifier qwen/qwen3.8-max, vision, tools, JSON and reasoning capability tags, a 1M-token context window, text and image and video input, a p50 TTFT of 10.00 seconds, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, and an OpenAI-compatible base URL with Python and cURL code samples.

السبب في أن بطاقة السعر تحمل الرقم الخطأ هو أن هذين المنتجين قد نقل كلاهما كلفة الإجابة بعيدًا عن كلفة الرمز المميز. تفعل Fugu Ultra v2 ذلك عبر التفريع إلى نماذج لا تسمّيها. ويفعل Qwen3.8-Max ذلك عبر التفكير لمدة 180 مليون رمز مميز. إذا كنت تعرف بالفعل حجم الرموز المميزة لديك لكل مهمة، فالحساب تافه وينبغي أن تُجريه. لا تعرف معظم الفرق ذلك الرقم، وبالنسبة لها يتقلص القرار إلى شيء أبسط: Qwen3.8-Max هو الخيار الذي يمكنك تدقيقه وتسعيره والتخلي عنه، بينما Fugu Ultra v2 هو الخيار الذي يراهن على أن التنسيق يتغلب على القدرة. كلا الخيارين قابلان للدفاع عنهما. واحد فقط منهما يأتي مع الإيصالات.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا