بطاقة رئيسية لمواجهة Fugu Ultra v2 ضد GLM 5.2، تُظهر نظام تنسيق مقابل نموذج واحد من نوع Mixture-of-Experts تحت عبارة "أنت تدفع مقابل التنسيق، لا المعاملات".
Guides & Insights

Fugu Ultra v2 مقابل GLM 5.2: أنت تدفع ثمن التنسيق، لا المعاملات

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ضع بطاقتي الأسعار جنبًا إلى جنب وستبدو المواجهة وكأنها خطأ. Fugu Ultra v2، الذي أعلنت عنه Sakana AI في 11 سبتمبر 2026، يحاسب بسعر 5 دولارات لكل مليون رمز إدخال و30 دولارًا لكل مليون رمز إخراج. GLM 5.2، الطراز الرائد من Z.ai بتاريخ 16 يونيو 2026، يحاسب بسعر 1.40 و4.40 دولار. كلاهما يدّعي نافذة سياق في نطاق المليون رمز. وكلاهما موجّه إلى المشتري نفسه تمامًا — الفريق الذي يدير أعمالًا وكيلية طويلة ومتعددة الخطوات وعلى نطاق مستودعات كاملة. سعر أحدهما نحو 3.6× سعر الإدخال و6.8× سعر الإخراج للآخر، والأرخص هو الذي يمكنك تنزيله والاحتفاظ به. لذا تختزل المقارنة كلها إلى سؤال واحد: ما الذي تشتريه فعلاً بالمال الإضافي، وهل يشتري شيئًا لا يستطيع نموذج واحد أن يكونه؟

إنهما ليسا من نفس نوع الكائن.

سبب وجود فجوة السعر هو أن هذين الأمرين يحلان المهام طويلة الأفق بآليات مختلفة تمامًا، ويظهر الفرق قبل أن تشغّل أي اختبار قياسي.

Fugu Ultra v2 — نظام تنسيق، وليس نموذجًا أساسيًا. إنه الطبقة المعظِّمة للقدرات من خط Fugu لدى Sakana AI: نقطة نهاية واحدة متوافقة مع OpenAI تقوم بتفكيك المهمة الواردة وتوزيع أجزائها على مجموعة من النماذج الأخرى، بعضها مفتوح الأوزان وبعضها متخصص. وفي توصيف Sakana نفسه، هو "يرفع الأداء الأقصى إلى مستوى أعلى من أي وقت مضى، دون الاعتماد الذي لا غنى عنه على النماذج الرائدة التي ينسّقها." أنت تشتري مُجدولًا، وتدفع مقابل كل رمز ينفقه ذلك المُجدول في التفكير، بما في ذلك رموز التنسيق الداخلية.

GLM 5.2 — نموذج واحد من مزيج الخبراء (Mixture-of-Experts). تنشره Z.ai كنموذج نص-إلى-نص بنافذة سياق قابلة للاستخدام فعليًا بحجم مليون رمز (1M) وحتى 128 ألف رمز إخراج، واستدلال هجين يُتحكم فيه عبر reasoning_effort، واستدعاء أدوات أصلي. البنية المُعلنة تبلغ نحو 753 مليار معامل إجمالي مع نحو 40 مليارًا نشطة لكل رمز، مع أن Z.ai لم تؤكد عدد المعاملات النشطة في 5.2 تحديدًا — تعامل مع هذا الرقم على أنه منقول من GLM-5.1.

هذا هو مفترق الطريق. أحدهما شيءٌ تستدعيه؛ والآخر شيءٌ يستدعي الأشياء.

ما الذي لن يخبرنا به Fugu Ultra v2

صفحة إعلان Sakana صريحة بشكل غير معتاد بشأن أمر واحد وصامتة بشكل غير معتاد بشأن أمر آخر، وكلاهما يهم عند اتخاذ قرار الشراء.

الجزء الصريح: تعلن الشركة صراحةً أن Claude Fable 5 وClaude Fable 5.1 وGPT-6 Astra ليست ضمن مجموعة نماذج Fugu Ultra v2، حتى مع ادعائها أنها تتفوق عليها في الاختبارات المعيارية. المبرر المعلن هو المرونة — مجموعة قابلة للتبديل من نماذج مفتوحة ومتخصصة لا يمكن سحبها أو إعادة تسعيرها أو قطعها من قِبَل مورّد أو تحوّل جيوسياسي. حدّ التدريب الزمني مُدرج على أنه 20260828. أيًّا كان رأيك في الحجة، فهو موقف معماري حقيقي، وهو أوضح سبب لاختيار Fugu Ultra v2 بدلًا من حزمة ركّبتها بنفسك.

الجزء الصامت: لا يذكر الإعلان نافذة سياق، ولا يذكر تسعير رموز Fugu Ultra v2 في الصفحة نفسها. تضع قوائم النماذج من جهات خارجية النافذة عند مليون رمز، والأسعار عند 5 دولارات / 0.50 دولار للمخزّن مؤقتًا / 30 دولارًا، مع فئة إعادة تسعير فوق ما يقارب 272 ألف رمز إدخال تنتقل إلى نحو 10 دولارات / 1.00 دولار / 45 دولارًا. هذه هي الأرقام التي يستخدمها باقي هذا المقال، لكنها قوائم، وليست وثائق المورّد — تحقق منها مقابل بطاقة الأسعار الحية لدى Sakana قبل أن تضع ميزانيتك بناءً عليها.

سؤال التكلفة الذي لا يجيب عليه أحد لكل رمز

التسعير لكل رمز هو الوحدة الخاطئة لهذه المقارنة، وكل صفحة تتصدّر نتائج البحث عنه حالياً ترتكب الخطأ نفسه. فاتورة المنسّق ليست حجم طلبك مضروباً في سعر؛ بل هي حجم طلبك، زائداً كل استدعاء فرعي يقرر القيام به، زائداً رموز الاستدلال للنماذج التي يستأجرها، وكل ذلك مضاف إليه هامش ربح بسعر المنسّق نفسه.

تقرّ Sakana بذلك صراحةً: إذ تُحاسَب رموز التنسيق المستهلكة داخليًا كرموز إدخال وإخراج عادية. وهذا يعني أن الطريقة الأمينة لمقارنة Fugu Ultra v2 بـ GLM 5.2 هي التكلفة لكل مهمة مكتملة، ولا ينشر أي من المورّدين هذا الرقم.

بعض النقاط البنيوية التي تظل صحيحة بغض النظر عن ذلك:

سعر الإدخال — Fugu Ultra v2 بسعر $5.00 / 1M مقابل GLM 5.2 بسعر $1.40 / 1M على OrcaRouter بسعر مزوّد Z.ai. تبلغ تكلفة Fugu 3.6 أضعاف قبل أن يُجري استدعاءً فرعيًا واحدًا.

سعر الإخراج — Fugu Ultra v2 بسعر 30.00 دولار / 1M مقابل GLM 5.2 بسعر 4.40 دولار / 1M. هذا هو الرقم الموجع، لأن الوكلاء يصدرون الكثير من الإخراج، ويصدر المنسّق إخراجًا لم تطلبه.

الإدخال المخزّن مؤقتًا — تُدرج Fugu Ultra v2 بسعر $0.50 / 1M؛ بينما يُخزّن GLM 5.2 مؤقتًا بسعر $0.26 / 1M، وهو خصم بنسبة 81% عن سعر الإدخال الخاص به. إن حلقات الوكيل المتكررة على موجه نظام ثابت هي حيث تتعاظم ميزة GLM 5.2 بأقصى قوة.

إعادة تسعير السياق الطويل — المستوى المعلن لـ Fugu Ultra v2 فوق ~272 ألف رمز إدخال ينقل الطلب بأكمله إلى ما يقارب ضعف سعر الإدخال و1.5× سعر الإخراج. ولا يعتمد GLM 5.2 أي تصنيف حسب السياق على الإطلاق: 1.40 دولار / 4.40 دولار بسعر ثابت، وصولاً إلى 1 مليون.

هذا الصف الأخير هو الذي ينبغي وضع دائرة حوله. تشغيل وكيل طويل الأفق يقضي معظم عمره بعد 272 ألف رمز. تعرفة GLM 5.2 الثابتة لها قيمة مالية حقيقية تحديدًا حيث تتضاعف تعرفة Fugu Ultra v2.

Two-column comparison scoreboard for Fugu Ultra v2 and GLM 5.2 covering type, release date, input price ($5.00 vs $1.40 per million tokens), output price ($30.00 vs $4.40), cached input ($0.50 vs $0.26) and long-context pricing (reprices above roughly 272K vs flat to 1M).

بالكاد تلامس مقاييس الأداء

إليك الأمر الغريب حقًا بشأن هذه المواجهة، والأمر الذي لا تذكره أي صفحة تصنيفات حالية بصراحة: لا يكاد هذان النموذجان يُقاسان على الاختبار نفسه.

تُفيد Sakana بأن Fugu Ultra v2 هو الأفضل أو الأفضل مناصفةً في خمسة من أصل ثمانية معايير — GDP.pdf وChartography وSWEFish وDeepSWE وToolathon — وضمن أفضل اثنين في سبعة من أصل ثمانية. والرقمان الرئيسيان اللذان تقدّمهما هما Chartography عند 48.3، مقابل Opus 5 عند 27.3 وFable 5 عند 29.5، وDeepSWE عند 74.3. أما SWEFish وToolathon فهما معياران داخليان خاصان بـSakana. وكل هذا مُبلَّغ عنه من المورّد، ولم يُعَد إنتاجه بشكل مستقل حتى وقت النشر.

تأتي أرقام Z.ai الخاصة بـGLM 5.2 من رف مختلف تمامًا: Terminal-Bench 2.1 عند 81.0، وSWE-bench Pro عند 62.1، وGPQA-Diamond عند 91.2، وAIME 2026 عند 99.2، وHLE عند 40.5 — وهي أيضًا مُبلَّغ عنها من المورّد. وعلى الجانب المستقل، يحمل GLM 5.2 مؤشر AA Coding Index بقيمة 68.8 ومؤشر Intelligence Index بقيمة 39 على صفحة إعادة التقييم لدى Artificial Analysis، حيث يُوسَم كتقدير مؤقت، في المرتبة #7 من 113. الاقتباسات الأقدم للرقم 51 أو 53 لـGLM 5.2 تأتي من مقياس مؤشر تم تجاوزه، ويجب ألا تُقتَبس.

لذا، إذا كنت تريد رقمًا نظيفًا لمقارنة مباشرة، فلا يوجد واحد. أقرب شيء إلى محور مشترك هو أن كليهما قوي في البرمجة الوكيلية، والقراءة الأمينة هي أن كل شركة نشرت نتائجها على الاختبارات التي تجيدها. وهذا سبب لإجراء تقييمك الخاص، لا لاختيار الرقم الأعلى.

أمر جدير بالملاحظة لكل من يتسوق لشراء GLM 5.2 اليوم: لم يعد أحدث طراز لدى Z.ai. وصل GLM-5.3 حوالي 14 أغسطس 2026 بالسعر المعلن نفسه، لكن بموجب ترخيص مخصص يقيّد مزوّدي الخدمات السحابية الكبار — مما يجعل GLM 5.2 آخر طراز مرخّص بالكامل بموجب MIT من الطرازات الرائدة لـ Z.ai، والسبب في أنه لا يزال له مبرر شراء مميز.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

الرخصة هي الفاصل الأكثر حدةً

ضع معايير القياس جانبًا، فسيبدو الفرق البنيوي أكثر حدةً من أي نتيجة.

تُطرح GLM 5.2 بأوزان مفتوحة بموجب رخصة MIT على Hugging Face، دون أي قيود إقليمية. يمكنك تنزيلها وتشغيلها على عتادك الخاص وضبطها الدقيق وتضمينها داخل منتج دون طلب إذن أي جهة أو دفع سعر لكل رمز على الإطلاق. درّبتها Z.ai — واللافت، وفقًا لادعاء الشركة نفسها، أنها استخدمت بالكامل مسرعات Huawei Ascend بدلًا من Nvidia.

لا يمنحك Fugu Ultra v2 أيًا من ذلك. إنه خدمة مستضافة: سياسة تنسيق فوق مجموعة من النماذج لم تصف Sakana عضويتها إلا على الأطراف. لا يمكنك تنزيله، أو فحصه، أو تثبيت إصداره، أو تشغيله في شبكة معزولة. ما تحصل عليه بدلًا من ذلك هو التجريد — نقطة نهاية واحدة يكون سلوكها، من حيث المبدأ، قادرًا على الصمود أمام اختفاء أي نموذج واحد من المنبع. هذه فائدة حقيقية لنظام إنتاجي لا يستطيع تحمل اختفاء إحدى التبعيات. وهي أيضًا تكلفة حقيقية، لأنك استبدلت التحكم مقابل الحصول عليها.

إذا كان قيدك هو "ألّا يتغير النموذج تحت يدي"، فإن واحدة فقط من هاتين الإجابتين تفي. وإذا كان قيدك هو "ألّا يستطيع شخص آخر إزالة النموذج"، فإن الأخرى فقط تفي.

السرعة، وما قاله المختبِرون عن النسخة الأخيرة

GLM 5.2 ليس سريعًا وفق القياسات: فقد سجّل Artificial Analysis نحو 66.3 رمزًا في الثانية مع زمن وصول إلى أول رمز يبلغ نحو 4.03 ثوانٍ، وهو معدل متواضع لنموذج من الفئة الرائدة، كما اشتكى مستخدمو Z.ai أنفسهم من ازدحام الخدمة خلال ساعات الذروة.

لا تنشر Sakana أي أرقام عن زمن الاستجابة أو الإنتاجية الخاصة بـ Fugu Ultra v2، وهذا بحد ذاته أمر ذو دلالة — فالنظام الذي يوزّع المهام على نماذج متعددة يكون ملف زمن الاستجابة لديه معتمدًا كليًا على ما يقرر استدعاءه، لذا فإن رقمًا واحدًا للإنتاجية سيكون قريبًا من انعدام المعنى. وفيما يخص Fugu Ultra السابق، أبلغ مختبرون علنًا عن عمليات تشغيل تمتد إلى نحو 30 دقيقة وعن تكاليف تتجاوز بكثير معدل نموذج واحد في المهمة نفسها. ذلك نموذج يونيو 2026 وليس دليلًا على v2 — لكنه نمط الفشل الذي ينبغي الاختبار بحثًا عنه، والسبب الذي يجعل مقارنة على أساس كل توكن تجامل المنسّقين.

Screenshot of the OrcaRouter model page for GLM 5.2 showing the z-ai/glm-5.2 identifier, a 1M token context window, 128K maximum output, and input pricing of $1.40 per million tokens with output at $4.40.

كيف ستستدعي كل واحد من هذه فعليًا

GLM 5.2 متاح على OrcaRouter اليوم بأسعار Z.ai نفسها كمزوّد — 1.40 دولار لكل مليون إدخال و4.40 دولار لكل مليون إخراج، تُمرَّر دون أي هامش ربح، لذا أي تخفيض تجريه Z.ai يصل إلى هنا في اليوم نفسه. وهو متوافق مع OpenAI، لذا فإن التبديل إليه يتطلب تغيير base-URL ومعرّف الموديل في SDK الذي لديك بالفعل، ويمكنك وضعه خلف سلسلة تجاوز الفشل أو قاعدة توجيه بدلًا من المراهنة بمسار إنتاجي على مزوّد واحد.

Fugu Ultra v2 ليس شيئًا نوجّهه. إنه متاح من واجهة برمجة التطبيقات الخاصة بـ Sakana AI المتوافقة مع OpenAI، وتغيير معامل واحد ينقل تكامل Fugu الحالي إليه. إذا كنت تقيّمه مقابل GLM 5.2، فالترتيب العملي هو إبقاء GLM 5.2 على البوابة الحالية لديك واستدعاء Fugu Ultra v2 مباشرة من Sakana بينما تقرر — فكلاهما متوافق مع OpenAI، لذا يمكن أن يقعا في مسار الشيفرة نفسه خلف علامة تشغيل.

أي واحدة تختار؟

اختر GLM 5.2 إذا كنت تريد خيارًا معروفًا بسعر معروف: أوزان مرخّصة بموجب MIT يمكنك استضافتها ذاتيًا غدًا، وتسعير ثابت قدره 1.40 دولار / 4.40 دولار دون أي عقوبة على السياق الطويل، ونافذة سياق بحجم 1 مليون قابلة للاستخدام فعليًا، وخصم يتراكم على حلقات الوكيل المخزنة مؤقتًا. تقبّل أنه نصّي فقط، وأنه متأخر بجيل عن GLM-5.3، وأن درجة تقييمه في المؤشر المستقل مؤقتة.

اختر Fugu Ultra v2 إذا كان ما تشتريه هو المرونة مضافًا إليها أقصى قدرة على العمل الشاق متعدد الخطوات، وكنت مستعدًا لدفع مقابل التنسيق حسب التوكن، والتخلي عن القدرة على فحص ما تستدعيه أو استضافته ذاتيًا. وادعاء المورّد نفسه هو أنه يحقق مخرجات بمستوى الحدود دون الاعتماد على نماذج حدودية — وهو طرح حقيقي وغير معتاد، ولم يتمكن حتى تاريخ اليوم أحد على الإطلاق خارج Sakana من التحقق منه.

ما لن نفعله هو الاختيار بينهما استنادًا إلى جدول المعايير. فالاختبارات بالكاد تتداخل، وقد نشر المورّدان نتائجهما في مجال قوتهما الأكبر، والرقم الحاسم — التكلفة لكل مهمة مكتملة طويلة الأفق — هو الرقم الذي لم تنشره أي من الشركتين على أي صفحة.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا