بطاقة عنوان رئيسية: DeepSeek V4.1 Flash مقابل DeepSeek V4 Pro — نفس المزوّد، أجيال مختلفة
Guides & Insights

DeepSeek V4.1 Flash مقابل DeepSeek V4 Pro: نفس المزوّد، أجيال مختلفة

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

الشيء المثير للاهتمام في وضع DeepSeek V4.1 Flash في مقابل DeepSeek V4 Pro هو أن النموذج الأحدث ليس الأكبر. DeepSeek V4 Pro هو نموذج مزيج الخبراء (MoE) بـ 1.6 تريليون معامل، مع 49 مليار معامل نشط، ولا يزال يقدَّم. DeepSeek V4.1 Flash هو نموذج MoE بـ 552 مليار معامل، مع 8 مليار معامل نشط عند الإدخال و16 مليار معامل نشط عند الإخراج، وهو النموذج الذي بنته DeepSeek ليحل محله. كلاهما على قائمة أسعار نفس المزود، وكلاهما يستوعب مليون رمز من السياق، وكلاهما يُصدر بموجب MIT. الاختيار بينهما ليس مسألة حجم. بل هو مسألة أي معمارية تريد أن تدفع مقابلها، وقد تغيرت الإجابة في 10 سبتمبر 2026.

ما الذي يختلف فعليًا، جنبًا إلى جنب

• المعاملات — V4.1 Flash بإجمالي 552 مليار معامل / 8 مليارات معامل نشطة عند الإدخال و16 ملياراً عند الإخراج، مقابل V4 Pro بإجمالي 1.6 تريليون / 49 مليار معامل نشطة. يبلغ V4 Pro نحو ثلاثة أضعاف إجمالي المعاملات وستة أضعاف عدد المعاملات النشطة على جانب الإدخال.

• البنية المعمارية — V4.1 Flash هو Causal Encoder-Decoder، بنية أساسية جديدة مقارنة بتصميم V4 Pro السابق. هذا هو الفرق الجوهري بين الاثنين، وهو السبب في أن ".1" ليس إصدار نقطة.

• سعر كل مليون توكن — V4.1 Flash ‏0.15 دولار للإدخال / 0.60 دولار للإخراج خارج أوقات الذروة مقابل V4 Pro ‏0.66 دولار للإدخال / 1.98 دولار للإخراج، وفق قوائم OrcaRouter.

• المدخلات المخزنة مؤقتًا — V4.1 Flash ‏$0.003 لكل مليون مقابل V4 Pro ‏$0.024 لكل مليون.

• ذاكرة KV المؤقتة لكل توكن — V4.1 Flash: 890 بايت مقابل بصمة V4 Pro الأكبر. عند سياق يبلغ مليون توكن، هذا هو البند الذي يحدد ما إذا كان سجل وكيل طويل سيبقى مقيمًا في الذاكرة.

• السياق والمخرجات — سياق 1M ومخرجات بحد أقصى 384K على كليهما. المستوى.

• زمن الاستجابة الملحوظ للوصول إلى أول رمز — V4.1 Flash 2.63 ثانية p50 مقابل V4 Pro 3.58 ثانية p50، وفق بيانات القياس عن بُعد لمدة 7 أيام من OrcaRouter، مع p95 عند 10.00 ثانية لـ V4 Pro.

• أنماط الإدخال — يستقبل V4.1 Flash النصوص والصور، مقابل V4 Pro الذي يقتصر على إدخال النصوص وإخراجها فقط، على القوائم نفسها. والنموذج الأحدث هو الأوسع بين الاثنين في الإدخال، فضلًا عن كونه الأقل تكلفة.

اقرأ القائمة دون تأطير المورّد، وسيبدو النمط غير معتاد. الخَلَف أرخص في كل سطر، وأسرع إلى أول توكن، وأوسع في الإدخال، وأصغر في كل سطر. هكذا يبدو تغيير معماري حقيقي عندما يتحقق، ولهذا يكون لسؤال "أيّهما أفضل" هنا جواب قصير، وتحته جواب أطول.

Two-column scoreboard: DeepSeek V4.1 Flash vs DeepSeek V4 Pro — total parameters 552B vs 1.6T, active parameters 8B input and 16B output vs 49B, architecture Causal Encoder-Decoder vs an earlier design, price per 1M tokens $0.15 input and $0.60 output vs $0.66 and $1.98, max output 384K tokens vs 384K tokens, and release date 2026-09-10 vs still served and not retired

الجدول الزمني لـ V4 Pro، لأنه يهم أي شخص لا يزال يشغّله

كان من المقرر إحالة DeepSeek V4 Pro إلى التقاعد. وكان من المزمع إيقاف واجهة API في 14 سبتمبر 2026 عند الساعة 12:00 بتوقيت بكين، مع توجيه حركة المرور إلى V4.1 Flash. لكن ذلك لم يحدث. وفي 11 سبتمبر، عكست الجهة الموردة هذا القرار، قائلة: «استجابةً لطلب المستخدمين، قررنا الاستمرار في تقديم خدمات API الخاصة بـ DeepSeek V4 Pro بعد 14 سبتمبر 2026، مع بقاء طريقة الفوترة دون تغيير.»

يترتب على ذلك أمران، وكلاهما جدير بأن نكون دقيقين بشأنه، لأن الموقف يغري بالمبالغة في التأويل.

الأول هو أن V4 Pro ليس مهملاً. إنه نموذج مدعوم بسعر لم يتغيّر، وهو النموذج الذي يوجّه إليه إشعار DeepSeek نفسه حركة V4 Pro الحالية. إذا كان لديك مسار إنتاجي مثبّت عليه، فلم يُسحب منك أي شيء.

والثاني هو أن DeepSeek V4.1 Pro غير موجود. أشار إشعار الإيقاف إلى أن حركة V4 Pro تُخدَم بواسطة V4.1 Flash "حتى إطلاق V4.1-Pro"، وهو ما أدى إلى قدر معيّن من التكهنات حول شقيق أكبر. اعتبارًا من 22 سبتمبر 2026، لا يوجد API لـ V4.1 Pro، ولا بطاقة نموذج، ولا أوزان، ولا إعلان. اقترح تقرير في 21 سبتمبر 2026 نموذجًا بمعاملات تريليونين من المتوقع أن يصدر في منتصف إلى أواخر أكتوبر، وهو ادعاء من مصدر واحد حول منتج غير معلن ويجب التعامل معه على هذا الأساس. أي شخص يخطط للسعة حول إطلاق V4.1 Pro فإنه يخطط بناءً على شائعة.

أيّ واحد يجب استدعاؤه فعليًا؟

حالة الترحيل واضحة ومباشرة، وهي الحالة التي أجرتها DeepSeek بنفسها عبر توجيه حركة V4 Pro إلى النموذج الجديد. وفقًا للأرقام أعلاه، فإن V4.1 Flash أرخص، وأسرع في الوصول إلى أول رمز، وأسرع في الحالة المستقرة، مع ذاكرة KV cache أصغر لكل رمز. إذا كان عبء العمل لديك عبء عمل V4 Pro لا يؤدي شيئًا لا يمكن لسوى 49B من المعلمات النشطة القيام به، فإن النموذج الأحدث هو الأداة الأفضل من حيث التكلفة وزمن الاستجابة، ولا توجد مقايضة يجب وزنها.

حجة البقاء على V4 Pro تدور حول ما يمنحك إياه عدد أكبر بكثير من المعلمات النشطة في الاستدلال الصعب والعمل الوكيلي الطويل الأفق، وهي حجة عليك تقديمها بتقييماتك الخاصة لا بورقة مواصفات. والسبب هو أن النموذجين لا يُقارنان على لوحة عامة مشتركة بطريقة تعزلهما: يظهر DeepSeek V4.1 Flash في مسح Agents on Rails بتاريخ 21 سبتمبر 2026 بنسبة 17% عند أقصى جهد، بينما V4 Pro ليس على تلك اللوحة. لا يوجد رقم مواجهة مباشرة للإشارة إليه. ما يوجد هو حجة معقولة مستمدة من البنية المعمارية — ستة أضعاف المعلمات النشطة قدرة كبيرة يُتخلى عنها — وهي حجة، لا قياس.

ملاحظتان عمليتان لكل من ينقل حركة المرور بينهما. أولًا، ينطبق جدول ساعات الذروة على كلا النموذجين، لذا فإن إجراء مقارنة تكلفة في الوقت الخطأ من اليوم سيكون خاطئًا بمعامل اثنين؛ الذروة هي 01:00–04:00 و06:00–10:00 بتوقيت UTC في أيام الأسبوع، وعطلات نهاية الأسبوع خارج الذروة بالكامل. ثانيًا، يتشارك النموذجان نافذة السياق وسقف الإخراج، لذا فإن الترحيل لا يغيّر ميزانية المطالبة لديك — مما يجعل التبديل منخفض المخاطر بشكل غير معتاد على جانب التطبيق.

تشغيل كليهما عبر نقطة نهاية واحدة

الحالة التي تريد فيها كليهما حقًا هي فترة الانتقال، وهي أكثر شيوعًا مما يبدو: فريق يريد الانتقال إلى V4.1 Flash لكن لديه خط معالجة واحد لم يتم التحقق بعد من سلوكه على البنية الجديدة. تشغيل الاثنين جنبًا إلى جنب عبر موردين منفصلين يعني عقدين ومجموعتين من المفاتيح لما هو، على مستوى النموذج، مزوّد واحد.

كلاهما على OrcaRouter تحت مفتاح واحد، ما يختصر ذلك إلى قرار توجيه. OrcaRouter يمرّر أسعار قوائم المزوّدين دون أي هامش ربح، لذا فإن الأرقام أعلاه هي أسعار DeepSeek نفسها لا أسعارنا، وينطبق جدول الذروة وخارج الذروة لدى DeepSeek تمامًا كما تحدّده DeepSeek — بما في ذلك تغيير سعر في منتصف الانتقال، وهو مفعّل من جانبنا في اليوم نفسه. يمكنك إرسال جزء من حركة المرور إلى النموذج الجديد ومقارنة المخرجات، أو التوجيه حسب نوع المهمة، ووضع تجاوز فشل تلقائي خلف المسار الجديد بحيث إذا فعل V4.1 Flash شيئًا غير متوقع ببياناتك، يصل الطلب إلى V4 Pro بدلًا من صفحة خطأ.

نظرًا لأن المورّد غيّر رأيه بالفعل مرة واحدة بشأن أي من هذه الطرازات سيتوقف، فإن إبقاء كليهما قابلين للوصول عبر تكامل واحد هو الخيار الذي لا يتطلب منك توقّع الانقلاب التالي.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, showing the model id with a flagship badge, 1M-token context, 384K max output, text input and text output, $0.66 input and $1.98 output per 1M tokens, a cache rate of $0.024, and observed time to first token of 3.58 s at p50 and 10.00 s at p95

ماذا تشاهد

• ما إذا كان سعر V4 Pro أو حالة إيقافه سيتغيران مرة أخرى. كان تراجع سبتمبر صريحًا بشأن بقاء الفوترة دون تغيير، وهذا هو الالتزام الذي يجب إلزام المورّد به.

• ما إذا كان V4.1 Pro سيصبح حقيقيًا. إلى أن تظهر بطاقة نموذج أو يتم إصدار أوزان، فإن قصة النموذج ذي الـ2T معامل مجرد شائعة لها مصدر واحد.

• تقييم مستقل يُشغّل كلا النموذجين على اللوحة نفسها. وإلى أن يوجد مثل هذا التقييم، فإن المقارنة الصادقة بين هذين الاثنين تنحصر في التكلفة وزمن الاستجابة والبنية، وهي أمور قابلة للقياس، إضافة إلى تخمين مُعلَّل بشأن القدرات، وهو أمر غير قابل للقياس.

حتى يصل الثالث من تلك، فإن الملخص الدقيق هو: DeepSeek V4.1 Flash هو البديل الأرخص والأسرع لـ DeepSeek V4 Pro، ولا يزال V4 Pro مدعومًا بسعر لم يتغير، ومسألة ما إذا كانت البنية الأحدث تتخلى عن القدرات هي مسألة لا يجيب عنها أي معيار عام حاليًا.

Screenshot of DeepSeek's own release page for DeepSeek-V4.1-Flash dated 2026/09/10, showing the 552B-parameter MoE architecture with 8B active for input and 16B for output, a KV-cache memory-reduction graphic, and DeepSeek's own four-benchmark comparison chart

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا