
GLM-5.3-FlashX مقابل DeepSeek V4.1 Flash: فئة السرعة التي هي أبطأ من الطراز الرخيص
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
فئة السرعة المتميزة لدى Z.ai تواجه مشكلة، واسمها DeepSeek V4.1 Flash. عندما أطلقت Z.ai GLM-5.3-FlashX في 18 سبتمبر 2026، روّجت للفئة الجديدة برقم واحد: ما يصل إلى 200 رمز إخراج في الثانية، أي نحو خمسة أضعاف إنتاجية GLM-5.3-Flash الذي بُني منه، مقابل 2.5 أضعاف السعر. القياس المستقل يضع نموذج DeepSeek الاقتصادي بالفعل عند 214.7 رمزًا في الثانية مع زمن 1.15 ثانية حتى الرمز الأول — أسرع في كلا المقياسين من السقف الذي تعلن عنه Z.ai، وبسعر لا يقترب منه FlashX. إذا كنت تشتري السرعة، فقد تحرّك السوق قبل وصول FlashX.
هذا التأطير غير منصف لـ FlashX في جانب واحد بعينه، ومنصف في كل جانب آخر. كلا النموذجين مشتقّان مفتوحا الأوزان بسياق 1M هُندسا من أجل التكلفة، وكلاهما جيد حقًا فيما صُنعا من أجله. لكنهما صُنعا من أجل نصفين مختلفين من المشكلة نفسها، والفجوة السعرية بينهما أصبحت الآن واسعة بما يكفي ليكون لسؤال «أيهما أفضل» جواب من سطر واحد لمعظم أحمال العمل.
أين يكون كل واحد منهما متقدّمًا في الواقع
• السعر، القائمة — GLM-5.3-FlashX بسعر 0.37$ / 1.25$ لكل مليون رمز إدخال/إخراج مقابل DeepSeek V4.1 Flash عند 0.15$ / 0.60$ خارج أوقات الذروة، و0.30$ / 1.20$ في أوقات الذروةbr> • الإدخال المخزّن مؤقتًا — FlashX عند 0.075$ لكل مليون مقابل DeepSeek عند 0.003$ خارج أوقات الذروة، وهو فارق قدره 25 ضعفًا يتراكم بقوة في حلقات الوكلاءbr> • الإنتاجية المقيسة — FlashX حتى 200 tok/s (ذروة المورّد، دون نشر رقم مستقل) مقابل DeepSeek 214.7 tok/s (Artificial Analysis، على واجهة DeepSeek البرمجية)br> • زمن أول رمز — غير منشور لـ FlashX مقابل 1.15 ثانية مقيسة لـ DeepSeek V4.1 Flashbr> • الذكاء المستقل — FlashX يرث 42 من GLM-5.3-Flash في مؤشر الذكاء من Artificial Analysis مقابل DeepSeek V4.1 Flash عند 40br> • البنية المعمارية — 320 مليار إجمالي / 18 مليار نشط MoE مقابل 552 مليار إجمالي مع نحو 8 مليار نشط في مرحلة prefill و16 مليار في مرحلة decodebr> • وسائط الإدخال — نص وصورة وفيديو وملفات مقابل نص وصورةbr> • الحد الأقصى للإخراج — 131,072 رمزًا مقابل نحو 384,000br> • الأوزان المفتوحة — GLM-5.3-Flash مرخّص بموجب MIT؛ وFlashX طبقة مستضافة لا تمتلك أوزانًا خاصة بها، وDeepSeek V4.1 Flash مرخّص بموجب MIT

اقرأ تلك القائمة مرتين، لأن شكلها هو القصة. تفوز FlashX بصفّين بالضبط، وكلاهما ضيّق: أفضلية بفارق نقطتين في مؤشر ذكاء مستقل، وإدخال الفيديو. وتفوز DeepSeek بالسعر، والسعر المخزّن مؤقتًا، والسرعة المقيسة، وطول المخرجات، واتساع الوسائط بالمعنى الذي يهم — فهو يستقبل الصور وينتج إجابات طويلة. فارق النقطتين في المؤشر يقع ضمن ضجيج جولة قياس واحدة، ولا ينبغي أن يكون هو ما يحدد معماريتك.
فئة السرعة الأبطأ من الطراز الرخيص
هذا هو الجزء الذي يستحق التوقف عنده. بنت Z.ai نظام FlashX لحل مشكلة حقيقية: GLM-5.3-Flash بطيء. قاست Artificial Analysis أداءه عند 98 رمز إخراج في الثانية، وهو أعلى من الوسيط بين النماذج مفتوحة الأوزان من حجمه، لكنه بعيد كل البعد عن التفاعلية. كان حل الشركة إعادة بناء حزمة الخدمة — نحو 100,000 مسرّع محلي، ومحرك قائم على SGLang، وتكميم W8A8، وذاكرة KV مؤقتة مختلطة الدقة، وبنية مفككة من الترميز والتعبئة المسبقة وفك التشفير — وتقول إنها تحقق نحو 3× من الإنتاجية من البداية إلى النهاية مقارنة بخط الأساس على العتاد نفسه.
حلّت DeepSeek المشكلة نفسها على مستوى البنية المعمارية، وسبقت إلى ذلك. إن تقسيم V4.1 Flash إلى مُرمِّز–مُفكِّك سببي (Causal Encoder–Decoder) يُنشّط نحو 8 مليارات معلمة عند التعبئة المسبقة (prefill) و16 مليارًا عند فك الترميز (decode) بدلًا من رقم ثابت، كما أن Compressed Sparse Attention 2 مع التخزين المؤقت FP4 KV يقلّص الذاكرة المؤقتة العالمية إلى 890 بايت لكل رمز — أي نحو ربع ذاكرة HBM وثُمن سعة تخزين SSD التي احتاجها سلفه. والنتيجة نموذج يعمل بسرعة 214.7 رمزًا في الثانية وفق قياس مختبر محايد، عبر واجهة برمجة التطبيقات الأصلية نفسها، دون الحاجة إلى فئة متميزة.
الرقم 200 الخاص بـ Z.ai هو ذروة معلنة من المورّد، بينما 214.7 الخاص بـ DeepSeek هو وسيط مستقل، وهذه أقل مقارنة ممكنة ملاءمةً لـ Z.ai، وهي السبب في التعامل معها دون جزم. فمن الممكن تمامًا أن يتفوق FlashX على DeepSeek في طلب دافئ قصير الإخراج وغير مزدحم. لكن لا يمكن معرفة ذلك، لأن لا أحد خارج Z.ai نشر أرقام إنتاجية FlashX. ما يمكن معرفته اليوم هو أن الطرازين في نطاق السرعة نفسه، وأن تكلفة أحدهما تبلغ ثلث تكلفة الآخر.

حيث تصبح ميزة السعر لدى DeepSeek هيكلية
تتقاضى DeepSeek V4.1 Flash مبلغ 0.15 دولار لكل مليون رمز إدخال و0.60 دولار لكل مليون رمز إخراج خارج أوقات الذروة، ليتضاعف المبلغان إلى 0.30 و1.20 دولار خلال فترتين في أيام الأسبوع (01:00–04:00 و06:00–10:00 UTC). أما FlashX فهي 0.37 و1.25 دولار بسعر ثابت. وعند مقارنتهما، يتضح أن التسعير الثابت الذي يبدو ميزة هو في الواقع البنية الأكثر تكلفة لأي شخص يمكنه جدولة العمل.
بند الإدخال المخزّن مؤقتًا هو ما يحدد أعباء عمل الوكلاء. تتقاضى DeepSeek 0.003 دولار لكل مليون رمز إدخال مخزّن مؤقتًا خارج أوقات الذروة؛ بينما تتقاضى FlashX 0.075 دولار، أي 25 ضعفًا. والوكيل الذي يعيد إرسال موجه نظام طويل ومخطط أدوات في كل خطوة يدفع هذا الفارق في كل خطوة، وهو البند الوحيد الأرجح لأن يهيمن على فاتورة حقيقية. تُدرج Z.ai تخزين الذاكرة المؤقتة كمجاني لفترة محدودة، وهو خصم على التخزين لا على عمليات القراءة التي تتراكم فعليًا.
ثمة ثقل موازن، وهو الصدق بشأن تكلفة أرقام DeepSeek نفسها. فالتقييمات التي أجراها المورّد وراء الدرجات الرئيسية لـ V4.1 Flash أُنتجت عند أقصى جهد استدلالي، وتوثّق DeepSeek أن الانتقال من الجهد 25 إلى الجهد 100 يرفع DeepSWE v1.1 من 66.0 إلى 74.2 مع استهلاك نحو 2.5× من رموز الإخراج. وعند 2.5× من الرموز، تصبح التكلفة الفعلية لإعداد الجهد العالي أقرب بكثير إلى FlashX مما يوحي به السعر المعلن — كما أن النموذج موثّق بكونه مطوّلًا جدًا في الكلام، إذ يولّد 250M رمز إخراج في Intelligence Index مقابل وسيط قدره 130M. السعر الرخيص لكل رمز على نموذج كثير الكلام ليس مثل مهمة رخيصة. وأي شخص يقارن هذين الاثنين من حيث السعر ينبغي أن يقارن التكلفة لكل مهمة مكتملة، لا التكلفة لكل مليون رمز، وعليه أن يتوقع القياس لا التقدير.
كيف تقرر، بشكل ملموس
إذا كان عبء العمل لديك وكيلًا يعمل لفترات طويلة ببادئة ثابتة، فإن DeepSeek V4.1 Flash هو الخيار، ونسبة الإدخال المخزَّن مؤقتًا وحدها هي التي تحسم الأمر. وإذا كنت تحتاج إلى فهم الفيديو أو إدخال الملفات في الاستدعاء نفسه، فإن FlashX هو الوحيد بين الاثنين الذي يدعمهما — وهذا فرق حقيقي في القدرات، وليس فرقًا في ورقة المواصفات. وإذا كنت تحتاج إلى مخرجات مُولَّدة طويلة، فإن حد المخرجات لدى DeepSeek البالغ نحو 384 ألفًا مقابل 131,072 لدى FlashX مهم لتوليد التقارير، وملفات الشيفرة الطويلة، وأي شيء يُولِّد بدل أن يجيب. وإذا كنت تحتاج إلى أقوى نتيجة مستقلة على مؤشر معياري واحد، فإن 42 مقابل 40 لدى FlashX فرق حقيقي لكنه أصغر من أن يُبنى عليه.
يمكن الوصول إلى كلا الطرازين من نقطة نهاية واحدة إذا كانت بنيتك التقنية موجّهة بالفعل، وهذه هي أرخص طريقة لحسم هذا الأمر. على OrcaRouter يُمرَّر سعر القائمة لدى المورّد دون أي هامش ربح، لذا يصل خصم DeepSeek خارج أوقات الذروة وأي تحرّك سعري مستقبلي من Z.ai في اليوم نفسه الذي يحدث فيه، والتبديل بين الاثنين هو مجرد سلسلة نصية للطراز بدلًا من عملية تكامل. يستحق التبديل التلقائي عند الفشل أن يكون موجودًا خصيصًا لـ FlashX: فهو طبقة تقديم عمرها ثلاثة أسابيع على عنقود جديد، ونمط الفشل الذي تحاول التأمين ضده هو سقف سعة، وليس طرازًا يتوقف عن العمل.
الخلاصة المباشرة: DeepSeek V4.1 Flash هو الخيار الافتراضي الأفضل لمعظم أعمال الإنتاج — أرخص لكل رمز، وأرخص لكل رمز مخزّن مؤقتًا، وأسرع وفق القياس، وقادر على مخرجات أطول. GLM-5.3-FlashX هو الخيار الصحيح في نطاق أضيق حيث تحتاج إلى إدخال فيديو أو ملف وتريد مؤشرًا مستقلًا أعلى بشكل طفيف خلفه. قدّرت Z.ai فئة السرعة بسعر مرتفع وطرحتها في سوق كان النموذج السريع الرخيص موجودًا فيه بالفعل. تلك هي المقارنة كاملة.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
