
DeepSeek V4.1 Flash مقابل GLM-5.2: نموذجان بترخيص MIT، إجابة واحدة مملة
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
DeepSeek V4.1 FlashوGLM-5.2 هما من نفس نوع الكائن، وهذا هو الجزء الذي تتجاهله معظم المقارنات. كلاهما نموذجان من نوع خليط الخبراء (mixture-of-experts)، وكلاهما يُنشر بموجب رخصة MIT مع أوزان قابلة للتنزيل، وكلاهما يستوعب مليون رمز من السياق، وكلاهما متاح عبر واجهة برمجة تطبيقات مستضافة من بائع لم يقم بتدريبهما. وصل GLM-5.2 أولاً وكان، عند إطلاقه، النموذج المفتوح الأوزان الأعلى تقييماً في مؤشر Artificial Analysis Index بنتيجة 51. وصل DeepSeek V4.1 Flash في 10 سبتمبر 2026 كالنموذج الأصغر والأحدث والأرخص في عائلة البنية الجديدة من DeepSeek. المقارنة المهمة بينهما ليست أيهما أذكى. بل أيهما يمكنك تشغيله، وبأي تكلفة، من أجل العمل الذي لديك فعلاً.
ما يتشاركون فيه، وهو معظمه
ابدأ من التداخل، لأنه يلغي معظم معايير القرار المعتادة. إذا كنت تختار بين نموذج مفتوح وآخر مغلق، فإنك تزن الارتباط الإجباري، وتزن القدرة على الضبط الدقيق، وتزن ما إذا كان بإمكان المورّد تغيير الشروط عليك. لا ينطبق أي من ذلك هنا. فكل من DeepSeek V4.1 Flash وGLM-5.2 مرخّصان بموجب MIT مع أوزان يمكنك سحبها وتشغيلها بنفسك. وكلاهما يستقبل مليون رمز من المدخلات. وكلاهما معماريتان من نوع MoE، ما يعني أن تشغيلهما رخيص نسبيًا مقارنة بإجمالي عدد معاملاتهما، لأن جزءًا فقط من الأوزان يُنشّط لكل رمز.
إذن، المقارنة ليست بين المفتوح والمغلق، وليست بين السياق الطويل والقصير. إنها مجموعة من أربعة أو خمسة أرقام، وهذه الأرقام تشير في اتجاه واحد من حيث التكلفة وفي الاتجاه الآخر من حيث النضج.
حيث يختلفان فعليًا
• السعر لكل مليون رمز — DeepSeek V4.1 Flash 0.15 دولار للإدخال / 0.60 دولار للإخراج خارج أوقات الذروة مقابل GLM-5.2 1.40 دولار للإدخال / 4.40 دولار للإخراج. وهذا يزيد قليلًا عن 9 أضعاف سعر الإدخال ويزيد قليلًا عن 7 أضعاف سعر الإخراج.
• الإدخال المخزّن مؤقتًا — V4.1 Flash بسعر 0.003 دولار لكل 1M خارج أوقات الذروة مقابل GLM-5.2 بسعر 0.26 دولار لكل 1M. أرخص بنحو 90 مرة، في البند الذي يهيمن على فاتورة حلقة الوكيل.
• المعاملات — V4.1 Flash بإجمالي 552B مع 8B نشطة عند الإدخال و16B عند الإخراج، مقابل GLM-5.2 بإجمالي يقارب 745B مع نحو 40B نشطة. وتُفعّل GLM-5.2 نحو مثليْ ونصف عدد المعاملات لكل رمز.
• الحد الأقصى للإخراج — V4.1 Flash 384 ألف توكن مقابل GLM-5.2 128 ألف توكن. ثلاثة أضعاف السقف.
• نافذة السياق — مليون رمز لكل منها. المستوى.
• درجة المؤشر المستقل — يسجّل GLM-5.2 نتيجة 51 في Artificial Analysis Index، وهي الأعلى بين أي نموذج مفتوح الأوزان عند إطلاقه. ولا يتوفر لـ DeepSeek V4.1 Flash حتى الآن رقم مؤشر منشور.
• زمن الوصول الملحوظ إلى أول رمز — V4.1 Flash 2.63 ث عند p50 و9.05 ث عند p95 مقابل GLM-5.2 2.36 ث عند p50 و10.00 ث عند p95، وفقًا لبيانات القياس عن بُعد الخاصة بـ OrcaRouter على مدى 7 أيام. الوسيطان على المستوى نفسه. أما الذيول فليست كذلك.
اتجاه السعر واتجاه النضج متعاكسان. GLM-5.2 هو النموذج ذو التقييم المستقل والسجل الأطول. DeepSeek V4.1 Flash هو النموذج ذو الرموز الأرخص، بتُسع سعر الإدخال وثلاثة أضعاف سقف الإخراج. لا توجد قراءة لهذه القائمة يهيمن فيها نموذج واحد ببساطة.

الذيل هو الخط المُستَهان به
تُقدّم معظم مقارنات النماذج مفتوحة الأوزان درجة المؤشر أولاً. لكن قياسات زمن الاستجابة تستحق الانتباه بدلاً من ذلك، ولكن ليس للسبب الذي تتوقعه: فالقيم الوسيطة متساوية. زمن GLM-5.2 عند p50 للوصول إلى أول رمز هو 2.36 ثانية مقابل 2.63 ثانية لدى V4.1 Flash، وهذا ليس فجوة، بل ضجيج على شبكة مشتركة. من يستشهد بميزة أول رمز للنموذج الأرخص فإنه يقرأ المئين الخطأ.
p95 هو النقطة التي يفترق عندها الاثنان، والاتجاه معاكس لما قد توحي به فجوة السعر. أطول انتظار في أسوأ الحالات لدى GLM-5.2 هو 10.00 ثانية؛ ولدى V4.1 Flash هو 9.05 ثانية. وهذا يهم أكثر مما يهم الوسيط، لأن الطلبات التي يلاحظها المستخدم هي الطلبات البطيئة. فالأداة التي تكون فورية عادةً وتتعطل أحيانًا لعشر ثوانٍ تبدو غير موثوقة بطريقة لا تبدو بها أداة تستغرق ثلاث ثوانٍ بانتظام، وفي حلقة وكيل توزّع عشر استدعاءات في كل دور، يكون p95 هو الرقم الذي يحدد ما إذا كان الدور يكتمل ضمن حدود صبر الشخص. ذيل GLM-5.2 ليس عيبًا؛ إنه نموذج أكبر ينشّط نحو 40 مليار معامل لكل رمز، ويكلّف ما يكلّفه. لكنه السبب في أن النموذج يناسب العمل غير المتزامن — طابور، ومهمة دفعية، ووكيل في الخلفية لا يراقبه أحد — أكثر مما يناسب واجهة طلب-استجابة.
لا ينشر أيٌّ من النموذجين رقمًا لمعدل الإنتاجية على الصفحات التي يمكننا رؤيتها، وهو أمر يستحق أن يُقال بصراحة بدلًا من ملء الفراغ بالتخمين. الزمن حتى أول رمز هو بُعد الكمون الوحيد الذي يمكن فيه مقارنة هذين النموذجين على بيانات مشتركة، وفي هذا البُعد فإن القراءة الأمينة هي أنهما متعادلان عند الوسيط ومتقاربان عند الذيل.
ما الذي تحسمه درجة المؤشر وما لا تحسمه
إن نتيجة GLM-5.2 البالغة 51 على مؤشر Artificial Analysis هي رقم حقيقي ومنتج بشكل مستقل، وهو أقوى حجة منفردة لصالح النموذج. وهو أيضًا مركب: رقم واحد يجمع عدة مجموعات تقييم، مما يجعله ملخصًا جيدًا للقدرة العامة ومؤشرًا ضعيفًا للأداء في أي مهمة محددة بعينها. النموذج الذي يسجل 51 والنموذج الذي ليس له نتيجة منشورة ليسا نفس الشيء مثل النموذج الذي يسجل 51 والنموذج الذي يسجل 40.
الموقف الصادق بشأن DeepSeek V4.1 Flash هو أن سجله المستقل ضعيف، والسبب هو عمره القصير. فقد أصبح متاحًا للعموم منذ اثني عشر يومًا. المسح الوحيد الحديث من طرف ثالث الذي يظهر فيه — لوحة Agents on Rails للبرمجة الوكيلية المنشورة في 21 سبتمبر 2026 — وضعته عند 17% بأقصى جهد، في منتصف المجال، فوق GLM-5.3 Flash عند 15% وتحت Gemini 3.8 Flash عند 23%. هذه لوحة واحدة تقيس أمرًا ضيقًا واحدًا، وهي ليست بديلاً عن درجة Index. أي شخص يدّعي أن V4.1 Flash يتفوق على GLM-5.2 في القدرات الآن إنما يستقرئ من البنية والسعر، لا يقدّم قياسًا.
حجة كل منها، بعبارة واضحة
DeepSeek V4.1 Flash هو النموذج الذي تُختار عند التعامل مع أحمال عمل ضخمة الحجم، أو حساسة لزمن الاستجابة، أو كثيفة الإخراج. إن سعر الإدخال الذي يبلغ تُسعه وسعر قراءة الذاكرة المؤقتة الذي يبلغ نحو واحد من تسعين يُعد ميزة هيكلية في حلقة وكيل تعيد قراءة السياق في كل دورة، كما أن سقف الإخراج البالغ 384K يعد فئة مختلفة من المخرجات مقارنة بـ128K. إذا كانت مهمتك هي التصنيف، أو الاستخراج، أو التوليد المنظم الطويل، أو المنفذ عالي الحجم داخل خط أنابيب وكيل، فإن فرق التكلفة ليس هامشيًا — بل هو الفرق بين خط أنابيب قابل للتطبيق وخط أنابيب غير قابل للتطبيق.
GLM-5.2 هو النموذج الذي تُلجأ إليه عندما تحتاج إلى رقم قدرة منشور ومُتحقَّق منه بشكل مستقل لتبرير قرار، أو عندما يكون العمل غير متزامن ويكون أسوأ انتظار محتمل مدته عشر ثوانٍ غير مرئي. إنه الخيار الناضج: النتيجة موجودة، والسلوك موثّق، وقد ظل النموذج في الإنتاج مدة كافية ليكتشف آخرون حدوده. في ذلك قيمة حقيقية، ولا يلتقطها عمود السعر.
حيث لا يكون أيٌّ من الخيارين صحيحًا بوضوح — كما في مساعد عامّ الغرض يتعامل مع حركة مختلطة — فإن الخطوة المفيدة ليست الانتقاء، بل إرسال الجزء الأكبر من الحركة إلى النموذج الرخيص، والاحتفاظ بالمكلف للطلبات التي تحتاجه.
تشغيل كليهما كنظام واحد
نظرًا لأن كلا النموذجين مفتوحا الأوزان وكلاهما مستضاف، فإن نمط التقسيم والتوجيه رخيص بشكل استثنائي للإعداد هنا، وهنا حيث تستحق طبقة التوجيه في OrcaRouter مكانها بدلاً من أن تكون عرضًا مُلحقًا. يقع كلا النموذجين خلف مفتاح واحد، لذا فإن قرار التوجيه هو تكوين وليس تكاملًا ثانيًا: قاعدة ترسل الطلبات القصيرة عالية الحجم إلى DeepSeek V4.1 Flash والمهام غير المتزامنة الطويلة إلى GLM-5.2 هي بضعة أسطر وليس فرعًا في كود تطبيقك.
هناك خاصيتان في المنصة تهمّان هذا الاقتران تحديدًا. OrcaRouterيمرّر أسعار المزوّدين المدرجة دون أي هامش ربح، لذا فإن الأرقام الواردة أعلاه هي أسعار المزوّدين أنفسهم، وينطبق جدول ذروة DeepSeek تمامًا كما تحدّده DeepSeek — الذروة من 01:00 إلى 04:00 ومن 06:00 إلى 10:00 بتوقيت UTC في أيام الأسبوع، مع بقاء عطلة نهاية الأسبوع خارج الذروة بالكامل، وهو قرار جدولة يستحق أن يُتّخذ صراحةً مع نموذج بهذا الرخص. كما تتيح لغة التوجيه (DSL) تركيب عدة نماذج في نداء واحد، وهي الطريقة الطبيعية لاستخدام نموذجين مفتوحَي الأوزان لا تتقاطع مواطن قوتهما: النموذج الرخيص يُنتج، والنموذج الأقوى يُراجع، ولا يرى المستدعي سوى استجابة واحدة. ويقف التحويل التلقائي عند الفشل خلف المسارين معًا، وهو أمر مهم عندما يكون عمر أحد النموذجين اثني عشر يومًا وسلوكه على بياناتك غير معروف بعد.
السبب في أن هذا هو الشكل الصحيح وليس حلًا وسطًا هو أن النموذجين يختلفان على محاور لا تتنافس. أحدهما سريع ورخيص؛ والآخر مُقيَّم وبطيء. إن خط المعالجة الذي يستخدم كليهما ليس تحوطًا، بل مطابقة بين الأدوات والمهام.

ماذا تشاهد
• رقم منشور في مؤشر Artificial Analysis الخاص بـ DeepSeek V4.1 Flash. وإلى أن يوجد هذا الرقم، تظل المقارنة في القدرات بين هذين الطرازين جدالًا لا قياسًا — وهو الدليل الوحيد الذي من شأنه أن يحسم المسألة.
• ما إذا كان ملف زمن الاستجابة لدى GLM-5.2 سيتحسّن. إن قيمة p95 البالغة 10.00 ث هي الرقم الأرجح للتغيّر مع تحسين مزوّدي الاستضافة، وهي حالياً أكبر فرق فردي مُقاس بين النموذجين — انتظار في الذيل، لا سعر.
• ما إذا كان جدول ساعات الذروة لدى DeepSeek يتغير. بالنسبة لنموذج بسعر $0.15 لكل مليون رمز إدخال، يُعدّ مضاعف الذروة أكبر متغير منفرد في نموذج التكلفة.
حتى يتحقق أول هذه الأمور، فإن الملخص الدقيق هو: إن DeepSeek V4.1 Flash أرخص بنحو تسع مرات في الإدخال وأرخص بنحو تسعين مرة في الإدخال المخزن مؤقتًا من GLM-5.2، ولديه ثلاثة أضعاف سقف الإخراج؛ GLM-5.2 هو النموذج ذو التقييم المستقل والسجل الأطول، ووسيط أول رمز لديه يعادل نظيره في النموذج الأرخص رغم أن أسوأ حالة لديه ليست كذلك. كلاهما بترخيص MIT. كلاهما على بعد مفتاح واحد. اختر حسب عبء العمل، لا حسب الفائز.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
