
فيغو ماكس مقابل GLM-5.3: نموذج القيمة يُقوَّض من نموذج الحجم
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
كان Fugu Max مسعّرًا ليفوز من حيث التكلفة، لكن GLM-5.3 أرخص على كلا المحورين. أُطلق منسّق Sakana AI في 11 سبتمبر 2026 بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولار لكل مليون رمز إخراج، وقد صُمم لتوجيه كل مهمة إلى النموذج الأقل تكلفة القادر على التعامل معها. أما GLM-5.3 من Z.ai، المدرج منذ 18 أغسطس 2026، فيبلغ سعره 1.26 دولار للإدخال و3.96 دولار للإخراج لكل مليون على OrcaRouter — أي أقل من Fugu Max بما يتراوح بين الثلث والخُمسين على كلا المقياسين، وهو نموذج نصي واحد فقط بنافذة سياق منشورة تبلغ 1M وسقف إخراج 128K. كما يصادف أن GLM-5.3 هو النموذج الأكثر استخدامًا في كتالوجنا بفارق كبير. وهذا المزيج — أرخص لكل رمز، ويحمل بشكل مثبت حركة مرور الإنتاج على نطاق واسع — يجعل هذه هي المواجهة التي يصعب فيها تبرير علاوة التنسيق إلى أقصى حد.
أرخص على كلا المحورين، مع نشر المواصفات
المقارنة محرجة لـ Fugu Max حتى قبل أن يدخل أي اختبار أداء في الصورة، لأنها ليست حالة من مقايضة القدرات بالسعر. فـ GLM-5.3 هو طراز رائد قريب من الطليعة بحد ذاته — تصفه Z.ai بأنه يحقق تحسنًا بنحو 50% في البرمجة مقارنة بـ GLM-5.2، ويضاهي Mythos 5 في قدرات مختارة للأمن السيبراني. إنه ليس نموذجًا اقتصاديًا يُطرح كبديل رخيص. إنه طراز رائد يصادف أن سعره أقل من منسّق مُحسّن من حيث التكلفة.
• سعر الإدخال — Fugu Max $2.00 لكل مليون رمز مقابل GLM-5.3 $1.26 لكل مليون رمز
• سعر الإخراج — Fugu Max بسعر $6.00 لكل مليون رمز مقابل GLM-5.3 بسعر $3.96 لكل مليون رمز
• الإدخال المخزَّن مؤقتًا — Fugu Max 0.25 دولار لكل مليون رمز مقابل تسعير التخزين المؤقت في GLM-5.3 كخصم على سعر الإدخال الأساسي
• السياق — Fugu Max غير منشور مقابل GLM-5.3 بـ 1M توكن
• سقف الإخراج — Fugu Max غير منشور مقابل GLM-5.3 بطاقة 128 ألف رمز
• الوسائط — Fugu Max غير منشور مقابل GLM-5.3 نصّي فقط، وموثّق على هذا النحو
• وسوم القدرات — Fugu Max: لم يُنشر أي منها مقابل GLM-5.3: استخدام الأدوات، وضع JSON، الاستدلال
• أرقام المعايير — يُزعم تحقيق Fugu Max ستة انتصارات دون درجات، مقابل DeepSWE المُبلّغ عنها من مورّد GLM-5.3 بنتيجة 46.2 إلى 66.9 مقارنةً بالجيل السابق، بالإضافة إلى درجة ذكاء منشورة من Artificial Analysis
• الأوزان — Fugu Max مغلق، والمجموعة غير معلنة مقابل GLM-5.3 من مختبر له إرث في الأوزان المفتوحة
• حركة المرور المرصودة على OrcaRouter — Fugu Max: لا شيء، غير مُحمَّلة مقابل 7,962.7 مليون رمز لـ GLM-5.3 خلال الأيام السبعة الماضية
لاحظ ما يفعله الصفّان الأخيران معًا. يأتي GLM-5.3 من سلالة ذات أوزان مفتوحة، وهو أقوى شكل متاح لحجّة الاستقلال عن المورّد التي تسوّقها Sakana باعتبارها الفرضية الكاملة لـ Fugu Max. وله رقم حركة مرور قابل للرصد يتجاوز بمرتبة قدرية معظم النماذج التي نخدمها. إذا كان السؤال هو "ما الذي أشغّله لأعمال إنتاجية كثيفة النصوص بسعر منخفض؟"، فالأدلة تشير إلى شيء آخر غير المنسّق.

حجة الحجم، ولماذا ليست مجرد مسابقة شعبية
رقم حركة المرور ليس رقم جودة، ولا ينبغي قراءته على هذا النحو. ما يثبته وجود 7.96 مليار توكن في سبعة أيام هو أن GLM-5.3 شُغِّل على نطاق الإنتاج من قبل فرق مستقلة عديدة، على أحمال عمل حقيقية، ولم يُحدث هجرة جماعية بعيدًا عنه. تلك إشارة ضعيفة بشأن الجودة وإشارة قوية بشأن الجدارة التشغيلية: زمن الاستجابة مستقر، والإنتاجية تصمد، وواجهة API تتصرف بشكل سليم تحت الحمل، وأنماط الفشل معروفة لدى عدد كبير بما يكفي من المستخدمين بحيث تظهر علنًا. النموذج الذي صدر في الأسبوع نفسه الذي صدر فيه Fugu Max لا يملك أيًّا من ذلك خلفه.
يُبرز صف زمن الاستجابة هذه النقطة بشكل أوضح. يُظهر GLM-5.3 زمنًا وسيطًا (p50) للوصول إلى أول رمز ممّا يبلغ 4.33 ثانية عبر حركة المرور التي نخدمها. بالنسبة للعمل القائم على الوكلاء — وهو عبء العمل الذي يستهدفه كلا هذين المنتجين — يتراكم زمن الوصول إلى أول رمز عبر كل دور لكل وكيل فرعي ينشئه المنسّق. ليس المنسّق الأرخص الذي ينشئ أربعة وكلاء أرخص إذا انتظر كل واحد منها عدة ثوانٍ قبل أن يُصدر أي شيء، وهذه التكلفة لا تظهر أبدًا على بطاقة الأسعار.
الحجة المضادة التي يطرحها Fugu Max هي أن منسّقه يوجّه الطلبات إلى النموذج القادر الأكثر خفة لكل طلب، مما يعني من حيث المبدأ أن كثيراً من المهام لا تلمس إطلاقاً أي نظام خلفي مكلف. وقد أضاف توسيع مجموعة Sakana في هذا الإصدار نماذج مفتوحة الأوزان ومتخصصة، بما في ذلك عائلة NVIDIA Nemotron عبر تعاون مع NVIDIA، لذا فإن الدرجات الرخيصة في ذلك السلم حقيقية. والسؤال هو ما إذا كانت هذه الدرجات أرخص من 3.96 دولارات لكل مليون رمز مُخرَج. بالنسبة لمعظم المهام النصية، ليست كذلك — فهذا عتبة منخفضة، والنماذج مفتوحة الأوزان التي تعمل بأسعار الاستضافة تتجاوزها عموماً بهامش ضئيل فقط.
أسئلة تستحق أن تُطرح قبل أن تختار
هل المنسّق أرخص من نموذج واحد مفتوح الأوزان؟ليس بالوضع الافتراضي، والحدس يسير في الاتجاه الخاطئ. يضيف التنسيق رموز التوليف الخاصة بالمنسّق، وفي التشغيلات متعددة الوكلاء يضيف مخرجات كل وكيل في الفريق. يزيل تسعير Sakana's Fugu أسوأ حالة عبر احتساب سعر مدمج واحد استنادًا إلى النموذج المشارك الأعلى مستوى بدلًا من تكديس الوكلاء، وهو تنازل حقيقي. لكن السعر الأساسي الذي تمزجه هو 6.00 دولارات للإخراج، والنموذج الواحد الذي كنت ستستدعيه لولا ذلك هو 3.96 دولارات. يوفر التنسيق المال عندما يمنع إعادات المحاولات، لا عندما يضيف توازيًا لمجرد التوازي.
هل يهم وجود قيد النص فقط بالنسبة لأي منهما؟ بالنسبة إلى GLM-5.3، فهو موثّق، لذا فهو قيد يمكنك التخطيط في ضوئه — لا رؤية، ولا صوت، ولا فيديو، وهذا ما يذكره الكتالوج. أما Fugu Max، فإن قدرته على التعامل مع الوسائط ببساطة غير منشورة. وهذا أسوأ من كونه مجرد قيد، لأنك لا تستطيع معرفة ما إذا كان خط معالجة يرسل ملف PDF سيعمل حتى تجربه. إن القيد غير المعلن ليس كالقيد الغائب.
ماذا يحدث لكل واحد منهما عندما تتغير النماذج الأساسية؟ GLM-5.3 نموذج واحد في إصدار واحد، دُرِّب ويُقدَّم من Z.ai. إذا غيّرت Z.ai تسعيرها، يصل التغيير إلى مفتاحك في اليوم نفسه عبر OrcaRouter بهامش ربح 0%، ويمكنك رؤيته والاستجابة له. سلوك Fugu Max دالة لمجموعة لا تكشف Sakana عن أعضائها، لذا فإن إيقاف مختبر حدودي لنموذج أو تغيير سعره يغيّر بصمت ما تشتريه دون أن يتغير اسم المنتج. تقدّم Sakana هذا على أنه مرونة. إنها مرونة للبائع وعدم شفافية للمشتري.

أين تُتخذ قرارات التوجيه فعليًا
كلا هذين، في الواقع، قرارا توجيه — يتخذهما Fugu Max داخل منسّق غير شفاف، وتتخذهما أنت في طبقة API. أما OrcaRouter فهو من النوع الثاني: واجهة API واحدة لأكثر من 200 نموذج مع لغة DSL للتوجيه تتيح لك التعبير عن السياسة بوضوح، وتجاوز الفشل التلقائي عندما يتدهور مسار أحد المزوّدين، ودمج النماذج عندما تريد الجمع بين المخرجات عن قصد بدلًا من الوثوق بصندوق أسود للقيام بذلك. يأتي GLM-5.3 في ذلك الكتالوج بسعر قائمة Z.ai مع هامش ربح 0%، وهو أمر يستحق أكثر من المعتاد لنموذج يقف خلفه هذا القدر من حركة المرور: فالسعر الذي تراه هو السعر الذي تنشره Z.ai، يمرّ كما هو دون مساس.
الفرق العملي هو قابلية التدقيق. عندما يختار Fugu Max نموذجًا لطلبك، فلا تعرف شيئًا عن أي نموذج كان ولا عن سبب اختياره. أما عندما تكتب سياسة التوجيه بنفسك، فالقرار يكون في مستودعك، وقابلًا للمراجعة من أي شخص يراجع الكود الخاص بك، وقابلًا للتغيير دون انتظار مورّد. وبالنسبة للفرق الخاضعة لأي شكل من أشكال التزامات الامتثال أو محاسبة التكاليف، فهذا ليس فرقًا فلسفيًا.
الحكم
يفوز GLM-5.3 في هذه المقارنة وفق المعايير الأكثر أهمية لفريق الإنتاج: فهو أرخص في الإدخال والإخراج، ونافذة السياق وسقف الإخراج لديه منشوران، وحدود الوسائط لديه معلنة، ويوفّر استخدام الأدوات ووضع JSON والاستدلال كقدرات موثّقة، وينحدر من سلالة مفتوحة الأوزان، ولديه رقم حركة مرور خلال سبعة أيام يقترب من ثمانية مليارات توكن. ولا توجد أي قراءة للأدلة العلنية يمكن أن تجعل Fugu Max الخيار الشرائي الأفضل دعمًا بالأدلة عند هذه الفئة السعرية.
تحتفظ Fugu Max بحجة واحدة، وهي حجة حقيقية: في المهام التي تلتقط فيها تمريرة ثانية من منسّق خطأً كانت تمريرة أولى قد أرسلته، يمكن أن تتغلب تكلفة المهمة المكتملة على تكلفة الرمز. وهذا يستحق تجربة محدودة النطاق إذا كان عملك قابلاً للتحقق، وكبير الحجم، وكنت خارج الاتحاد الأوروبي/المنطقة الاقتصادية الأوروبية — مع تحديد سقف لرموز الإخراج مسبقًا وقياس عدد الرموز لكل مهمة منتهية. وإلا، فإن النموذج الأوحد الذي يكلف أقل بمقدار الثلث ويعمل تحت حمل إنتاجي منذ شهر هو الجواب، وهو متاح على OrcaRouter بسعر Z.ai المعلن مع تمرير سعر المزوّد كما هو.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
