بطاقة عنوان رئيسية مكتوب عليها 'Fugu Max مقابل Qwen3.8-Max' مع عنوان فرعي 'السعر نفسه، المعيار نفسه، رقم واحد'، وثلاث شارات على شكل كبسولة مكتوب عليها '$2.00 / $6.00 على كليهما'، و'Terminal Bench 2.1: 86.6 مقابل غير مُعلن' و'النتيجة المستقلة: لا يوجد مقابل 40'، وسطر تذييل مكتوب عليه 'Sakana AI، سبتمبر 2026 مقابل Alibaba، أغسطس 2026'، وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

Fugu Max مقابل Qwen3.8-Max: نفس السعر، نفس المعيار، رقم منشور واحد

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

تسعّر Fugu Max وQwen3.8-Max بالسعر نفسه: 2.00 دولار لكل مليون رمز إدخال و6.00 دولار لكل مليون رمز إخراج. أطلقت Sakana AI نموذج Fugu Max في 11 سبتمبر 2026، وتقدّم Alibaba خدمة Qwen3.8-Max منذ أوائل أغسطس، ووصل البائعان إلى قائمة أسعار متطابقة من اتجاهين متعاكسين — أحدهما يسعّر سياسة توجيه، والآخر يسعّر نموذجًا بـ2.4 تريليون معامل. تُلغي هذه المساواة السعر من القرار تمامًا، وهو أمر نظيف بشكل غير معتاد. ما يتبقى هو الأدلة، وهنا يختلف الجانبان أكثر من أي مكان آخر. يذكر جدولا البائعَين اختبار Terminal Bench 2.1. تطبع Alibaba الرقم 86.6 لـQwen3.8-Max. وتقول Sakana إن Fugu Max يحقق أفضل نتيجة إجمالية على Terminal Bench 2.1 ولا تطبع أي رقم على الإطلاق — لا لذلك الاختبار ولا للاختبارات الخمسة الأخرى التي تزعم الفوز بها.

المعيار الوحيد الذي يسمّيه الطرفان

هذه هي المواجهة بأكملها مضغوطة في صف واحد، لذا يجدر بنا أن نكون دقيقين بشأنها.

تسرد نشرة ساكانا ستة معايير تحقيق يحصل فيها Fugu Max على أفضل نتيجة إجمالية: Terminal Bench 2.1 وGPQAD وAA-LCR وGDP.pdf وAutomationBench وSWEFish. خمسة منها تقييمات عامة معترف بها، والسادس، SWEFish، هو معيار البرمجة الخاص بساكانا. ولا تذكر النشرة، لأي من الستة، قيمة ولا هامشًا ولا رقم منافس يوضع إلى جانبه. أما الادعاء الموازي — بأن Fugu Max يوسّع حدود باريتو للتكلفة والأداء على سبعة من عشرة معايير — فهو كذلك بيان عن الموضع على مخطط، لا عن نقطة على محور.

تتضمن الصفوف المنشورة لـ Aliibaba بشأن Qwen3.8-Max كلاً من Terminal-Bench 2.1 عند 86.6، وOSWorld-Verified عند 86.1، وGPQA Diamond عند 92.6، وSWE-bench Pro عند 67.7. جميعها مُبلَّغ عنها من البائع، وكلها أرقام. لذا في الاختبار الوحيد الذي اختارت كلتا الشركتين تسميته، نشرت إحداهما رقمًا ونشرت الأخرى ترتيبًا. لا يمكنك أن تستنتج من ذلك أي نظام أفضل — فقد تعني "الأفضل إجمالًا" لدى Sakana 91 أو 87. ما يمكنك استنتاجه هو أنه حتى وقت النشر لا يوجد دليل عام يجيب عن السؤال، والبائع الذي يقدم الادعاء الأكبر هو الذي يمتنع عن تحديده كميًا.

أسعار متطابقة، وبنية معاكسة

• الإدخال — Fugu Max ‏2.00 دولار لكل مليون رمز مقابل Qwen3.8-Max ‏2.00 دولار لكل مليون رمز

• الإخراج — Fugu Max ‏$6.00 لكل مليون رمز مقابل Qwen3.8-Max ‏$6.00 لكل مليون رمز

• المُدخل المُخزَّن مؤقتًا — Fugu Max ‏0.25 دولار لكل مليون رمز مقابل Qwen3.8-Max ‏0.25 دولار لكل مليون رمز، وتقيس Artificial Analysis بشكل مستقل خصمًا بنسبة 88 بالمئة على التخزين المؤقت في جانب Qwen

• رسم إضافي على المُحفِّز الطويل — Fugu Max لم تُذكر أي فئة في الإصدار مقابل Qwen3.8-Max بسعر ثابت حتى نافذة السياق دون أي رسم إضافي

• السياق والمخرجات — Fugu Max: لم يُنشر أيٌّ من الرقمين، مقابل Qwen3.8-Max: نافذة تبلغ مليون رمز مع سقف مخرجات يبلغ نحو 128 ألف رمز

• طريقة الإدخال — نص Fugu Max، مع قدرات المجموعة الخاصة الكامنة خلفه، مقابل Qwen3.8-Max: النص والصورة والفيديو وملفات PDF

• البنية المعمارية — Fugu Max منسّق مدرّب فوق مجموعة غير معلنة، موسّع من أجل Max بأوزان مفتوحة ونماذج متخصصة تشمل عائلة NVIDIA Nemotron من خلال تعاون مع NVIDIA مقابل Qwen3.8-Max، نموذج خليط خبراء متناثر واحد بنحو 2.4 تريليون معامل إجمالي وحوالي 95 مليار معامل نشط لكل رمز

• الأوزان — Fugu Max مغلق، وعضويته في المجموعة غير معلنة بحكم التصميم، مقابل Qwen3.8-Max بأوزان مفتوحة منشورة لنقطة التحقق من فئة Max بموجب ترخيص مخصص

• التقييم المستقل — Fugu Max: لم يُنشر أي تقييم، ولا توجد صفحة Artificial Analysis لأي نموذج Fugu، مقابل Qwen3.8-Max، وهو إدخال مباشر في Artificial Analysis مع أرقام منشورة للسرعة والإسهاب والتكلفة لكل مهمة

تُظهر أربعة من تلك الصفوف «غير منشور» في جانب Fugu، وتحمل رقمًا في جانب Qw​en. وعندما تكون المعدلات متطابقة، فهذه هي المقارنة بأكملها: المال نفسه يشتري نظامًا يمكنك وصفه وآخر لا يمكنك وصفه.

A two-column scoreboard titled 'Fugu Max vs Qwen3.8-Max - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, Terminal Bench 2.1 best with no figure, evidence vendor-reported only. Qwen3.8-Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context 1M with a 128K output ceiling, Terminal Bench 2.1 at 86.6, evidence Artificial Analysis Index 40 and $2.67 per task. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Qwen3.8-Max rows Alibaba-reported and per Artificial Analysis.' OrcaRouter logo bottom-right.

أحد الأعمدة يقف خلفه طرف ثالث.

تمنح Artificial Analysis نموذج Qwen3.8-Max درجة 40 على مؤشر الذكاء v4.3 المُعاد صياغته، في المرتبة #30 من 200، بتكلفة 2.67 دولار لكل مهمة من مهام مؤشر الذكاء و37.8 رمز إخراج في الثانية — بطيء بما يكفي ليحتل المرتبة #154 من 200 في السرعة. ويسجّل الإدخال نفسه 180 مليون رمز إخراج وُلّدت عبر المؤشر، أكثر من ضعف 89 مليونًا للنموذج الوسيط، وخصمًا بنسبة 88 بالمئة على التخزين المؤقت.

ينطبق تصحيحان قبل أن يُقتبس أي من ذلك. الأول أن الرقم 58 — أو 58.1، أو 58.4 — المتداول على نطاق واسع لـ Qwen3.8-Max يعود إلى ما قبل أن تعيد Artificial Analysis معايرة المؤشر في سبتمبر 2026، والصفحة الحية تحمل شارة «Updated» التي تشير إلى درجة أُعيد صياغتها. كما حملت الكتابات الأقدم ضريبة جهد مختلفة من المقياس السابق، هي 64 دورة لكل مهمة مقابل 14 للجيل السابق من Qwen بتكلفة نحو $1.14 لكل مهمة في Intelligence Index؛ أما الصفحة الحالية فتُظهر $2.67. والثاني تحذير حقيقي وليس أثرًا من آثار المقياس: فقد قاست Artificial Analysis بشكل منفصل ارتفاع معدل الهلوسة لدى Qwen3.8-Max من 23 بالمئة إلى 40 بالمئة مقارنةً بالجيل السابق. وبالنسبة إلى نموذج يُسوَّق للعمل الذاتي متعدد الخطوات، فهذه كلفة تُدرج في ميزانية المدقّقات، لا حاشية.

لا يملك Fugu Max أي مدخل مستقل من أي نوع. كل رقم يُنسب إليه يأتي من Sakana، واعتبارًا من وقت كتابة هذا لا توجد صفحة Artificial Analysis لـ Fugu Max أو أي من أشقائه. هذا ليس اتهامًا — فموديل صدر قبل ساعات لن يحظى بتغطية من طرف ثالث — لكنه يعني أن العمودين ليسا قابلين للتحقق بالقدر نفسه، وسيبقى الأمر كذلك حتى يشغّل شخص من خارج Sakana هذا الشيء.

طريقتان للإفراط في الإنفاق

لقد نقل هذان النظامان تكلفة الإجابة بعيداً عن تكلفة الرمز، وهما يفعلان ذلك في اتجاهين متعاكسين. Qwen3.8-Max مقتصد في الرموز ومسرف في الإجابة: 180 مليون رمز إخراج على مؤشر الذكاء، أي ضعف الوسيط، بتكلفة 2.67 دولار لكل مهمة. إنه يعمل مدة طويلة بدل أن يكون كبيراً، وخصم التخزين المؤقت البالغ 88 بالمئة هو الرافعة التي تتحكم في الفاتورة — فتشغيل وكيل طويل يظل يعيد قراءة السياق نفسه يبقى رخيصاً، أما التشغيل الذي يظل يولّد نصاً جديداً فلا.

Fugu Max باهظ الثمن من حيث التوكنات وغير قابل للتنبؤ من حيث الإجابة. يولّد منسّقه وكلاء فرعيين، يكتب كل منهم نص الاستدلال والمخرجات المفوتر بسعر 6.00 دولارات لكل مليون، إضافة إلى تخليق المنسّق نفسه. وتلتزم Sakana بأن تشغيلات الوكلاء المتعددين تُحتسب بسعر مختلط واحد مرتبط بأعلى طراز مشارك، وأن إضافة وكلاء لا تضاعف الفاتورة، ما يزيل الانفجار في أسوأ الحالات عند التوسّع التفريقي الذي يجعل أنظمة الوكلاء المتعددين الساذجة غير قابلة للتحمل ماليًا. لكنه لا يزيل الحجم. وبخصوص مسألة الحجم، يصمت البيان بطريقة مهمة: فحتى تغطية Sakana نفسها تذكر أن تبديل الطرازات في منتصف المهمة قد يقلل إعادة استخدام ذاكرة السياق المؤقتة ويولّد توكنات تنسيق إضافية، وتؤكد أن الشركة لم تفصح عن معدل إصابة الذاكرة المؤقتة لدى Max أو إجمالي تكلفة التوكنات لكل مهمة.

إذن فسعر 2.00 دولار / 6.00 دولار نفسه رقم يمكن التنبؤ به في جانب، ومضاعف غير محدود له حدّ أدنى في الجانب الآخر. فدرجة إسهاب Qwen3.8-Max قابلة للقياس قبل أن تلتزم؛ أما Fugu Max فليست كذلك.

اختبار مخرج الهروب

هنا تنقلب الحجة المعتادة حول الارتباط الإلزامي، وهذا هو الأمر الأكثر فائدة في هذا الاقتران.

حجة Sakana لصالح Fugu Max هي المرونة. مجموعة تمتد عبر النماذج ذات الأوزان المفتوحة والنماذج المتخصصة، موسّعة لـ Max مع عائلة NVIDIA Nemotron، تعني أن إلغاء أي مورّد رائد واحد أو إعادة تسعيره أو انسحابه الإقليمي لا يمكن أن يُسقط منتجك — تحوّط حقيقي، والشركة صريحة بشأن بيعه. لكن التحوّط غير قابل للتحقق من الخارج. لا يمكنك رؤية المجموعة، ولا يمكنك تضمين عضو أو استثنائه، ولا يمكنك استضافة أي منها ذاتيًا، ولا يمكنك تشغيله في EU/EEA على الإطلاق. وعد حول مجموعة غير مسموح لك بفحصها هو ضمان أضعف مما يبدو.

يقدّم Qwen3.8-Max الحجة في الاتجاه المعاكس. فهو نموذج يخص مورّدًا واحدًا، وبالتالي فهو معرّض لقرارات مورّد واحد — لكن Alibaba نشرت أوزانًا مفتوحة لنقطة تفتيش Qwen3.8-2.4T-A95B من فئة Max بموجب ترخيص مخصص، ما يعني أن مخرج الطوارئ حقيقي لا مجرد بلاغة: إذا تغيّرت الأسعار أو الشروط، يمكن تقديم النموذج من بنيتك التحتية الخاصة. وبالنسبة لفريق يتمثل خوفه الفعلي في أن يسحب مورّد البساط من تحت قدميه، فإن نقطة تفتيش قابلة للتنزيل تتغلب على وصف لمجمّع.

الاتصال بأي منهما

Qwen3.8-Max موجود في كتالوجنا بسعر 2.00 دولار للإدخال و6.00 دولار للإخراج لكل مليون رمز، وهو سعر Alibaba المعلن مع تمرير هامش ربح 0%، لذا يظهر تغيّر سعر المورّد على المفتاح نفسه في اليوم نفسه بدلًا من جدول ترحيل. وهو متوافق مع OpenAI على نفس عنوان URL الأساسي لباقي الكتالوج، ما يعني أنه يمكنك وضعه خلف قاعدة توجيه شرطية، أو سلسلة تجاوز فشل، أو لوحة دمج نماذج من دون عقد ثانٍ أو تغيير في الكود — ويغطي التجاوز التلقائي للفشل مسار مزوّد محدود المعدل أو متدهور. وقد نقل 127.7 مليون رمز عبر البوابة خلال الأيام السبعة الماضية.

Fugu Max ليس على OrcaRouter. فهو يصل إليك عبر واجهة برمجة التطبيقات الخاصة بـ Sakana المتوافقة مع OpenAI وعدة منصات طرف ثالث، وتقول الشركة إن تكامل Fugu الحالي يمكن ترقيته بتغيير معلمة واحدة في سطر واحد. ولأن كليهما يستخدمان صيغة الطلب نفسها، فإن أرخص طريقة لحسم فجوة القياس المعياري هي التوقف عن انتظار أن تنشرها Sakana: شغّل كليهما خلف عَلَم واحد على حمل العمل الخاص بك واحسب رموز الإخراج لكل مهمة مكتملة. هذا هو القياس الذي لم يقدمه أي من المورّدين.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the argument that the industry has raced along a single axis of bigger and more expensive foundation models while the frontier that matters is two-dimensional, capability on one axis and cost on the other.

أي واحد، ومتى؟

Qwen3.8-Max هو الخيار الذي يمكنك تدقيقه وتسعيره والتخلي عنه. وفق بطاقة الأسعار نفسها، يمنحك نافذة سعة 1M رمز دون رسوم إضافية على المطالبات الطويلة، وإدخال الصور والفيديو وPDF، ونقطة تحقق قابلة للتنزيل من فئة Max، ومدخلاً مستقلاً حياً يقيس العوامل التي تحدد فاتورتك، وخصماً بنسبة 88 بالمئة على الإدخال المخزّن مؤقتاً. وتكاليفه محددة بالقدر نفسه: فهو بطيء عند 37.8 رمزاً في الثانية، ويحتل مرتبة قريبة من ذيل المجال في السرعة، وهو مطوّل بشكل هائل عند 180 مليون رمز على المؤشر، كما تضاعف معدل الهلوسة المقاس لديه تقريباً مقارنة بالجيل السابق — وهو مصدر قلق جدي تحديداً للعمل المستقل الذي يُسوَّق من أجله. استفد من خصم التخزين المؤقت إلى أقصى حد، وخصص ميزانية لمدقّق.

Fugu Max هو الرهان على أن التنسيق يتفوق على القدرة. إذا كان عملك طويل الأفق وقابلًا للتحقق، وكان منسّق يولّد مدققًا ينجز مهامًا يفشل فيها نموذج واحد مرتين، فإن رموز التنسيق أرخص من إعادات المحاولة، وبطاقة الأسعار المتطابقة ليست تعادلًا على الإطلاق. ما تشتريه هو الاستمرارية، في نظام لا يمكنك تثبيت مجموعة موارده، ونافذة سياقه غير منشورة، وانتصاراته الستة في المعايير لا توجد قيم مرتبطة بها — من مورّد اختار أن يسمّي الاختبار ويحجب الرقم.

كلا المنتجين يكلّف نفس القدر لكل رمز. واحد فقط منهما يخبرك بما تحصل عليه مقابل ذلك.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (English UI, captured September 11, 2026), showing the Featured badge, the identifier qwen/qwen3.8-max, by Qwen dated 2026-08-03, vision, tools, JSON and reasoning capability tags, a 1M-token context window with text, image and video input, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, a p50 TTFT of 10.00 seconds, traffic of 127.7 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا