بطاقة العنوان الرئيسية التي تحمل «DeepSeek V4.1 Flash مقابل DeepSeek V4 Pro» مع العنوان الفرعي «التسليم المقرر، الذي أُلغي في 2026-09-11»، وبطاقتان تحملان «DeepSeek V4.1 Flash — مؤشر AA 40، $0.15 / $0.60» و«DeepSeek V4 Pro 0813 — مؤشر AA 36، $0.66 / $1.98»، وتذييل يحمل «مؤشر AA وفقًا لـ Artificial Analysis؛ الأسعار وفقًا لـ DeepSeek، خارج أوقات الذروة، لكل مليون توكن.»
Guides & Insights

DeepSeek V4.1 Flash مقابل DeepSeek V4 Pro: عملية التسليم التي جدولتها DeepSeek ثم ألغتها

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

صدر DeepSeek V4.1 Flash في 2026-09-10، وكان من المقرر أن يكون DeepSeek V4 Pro قد اختفى بحلول الآن. كانت الخطة، التي أُعلنت قبل يومين من إصدار Flash وتم تثبيتها في يوم الإصدار، أن في 2026-09-14 الساعة 12:00 بتوقيت بكين، كل طلب إلى deepseek-v4-pro سيُعاد توجيهه بهدوء إلى الأحدث والأرخص deepseek-flash وسيتم فوترته بسعر Flash. ألغت DeepSeek ذلك في 2026-09-11 بعد اعتراض المطورين، وفي 2026-09-14 مرّ الموعد النهائي وV4 Pro لا يزال قائماً وفوترته دون تغيير. إذاً هذه ليست مقارنة إطلاق — النموذج على اليسار عمره ثمانية أيام والنموذج على اليمين رائد عمره عام في شهره الرابع من التوفر العام. إنها مقارنة بين نموذجين نشرت الشركة المصنعة لهما معايير أداء تقول إن الأرخص فاز، ثم اكتشفت أن مستخدميها اختلفوا، فتراجعت. هذا التسلسل هو الشيء الأكثر فائدة نشره أي شخص عن أي من النموذجين هذا الشهر، لأنه بالضبط القرار الذي أنت على وشك اتخاذه بنفسك.

ما الذي حدث بالفعل، بالترتيب

أهمية الجدول الزمني هنا تتجاوز أي معيار منفرد، لأن التحوّل هو القصة، وكان الإعلان هادئًا عن قصد.

2026-09-09 — تُخبر DeepSeek المستخدمين بأنه قبل وصول V4.1 Pro، ستُوجَّه طلبات V4 Pro إلى V4.1 Flash وتُحاسَب بأسعار Flash. الرسالة هي أن Flash تفوقت بشكل شامل على Pro في الأداء والتكلفة والسرعة ووقت إنجاز المهام.

2026-09-10 — يتوفر DeepSeek V4.1 Flash بشكل عام على التطبيق والويب وواجهة API. تصل الأوزان إلى Hugging Face بموجب رخصة MIT. يصبح اسم نموذج API هو deepseek-flash. الجيل السابق deepseek-v4-flash وdeepseek-v4-flash-vision-exp يُسحبان نهائيًا، مع توجيه معرّفاتهما القديمة مؤقتًا إلى V4.1 Flash. تم تأجيل إيقاف Pro إلى 2026-09-14، 12:00 بتوقيت بكين (04:00 UTC).

2026-09-11 — تراجع DeepSeek. واستجابةً لمطالب المستخدمين، قالت إن خدمة V4 Pro API ستستمر بعد 2026-09-14 مع بقاء الفوترة دون تغيير، وإن التحويل التلقائي إلى V4.1 Flash قد أُلغي.

2026-09-14 — ينقضي الموعد النهائي. لا يزال V4 Pro يقدّم الخدمة بسعر $0.66 / $1.98 لكل مليون توكن خارج أوقات الذروة.

عدم التماثل في ذلك التسلسل هو المقال بأكمله. فقد جرى ترحيل مستخدمي Flash سواء أرادوا ذلك أم لم يريدوه — إذ يستجيب معرّف V4 Flash القديم الآن بطراز مختلف. أما مستخدمو Pro فقد نالوا مهلة، والسبب ليس أن V4 Pro يحقق نتائج أفضل في المعايير. بل لأن أنظمة الإنتاج كانت قد ضُبطت على أساسه: المطالبات، وهياكل الوكلاء، وأدوات التقييم، وافتراضات قابلية إعادة الإنتاج التي يبطلها تبديل الواجهة الخلفية دون أي تغيير في الشيفرة من جانب المستدعي. ولا تزال صفحة المقارنة لدى DeepSeek تُدرج كلا الطرازين اليوم، جنبًا إلى جنب، وهو ما يدل على أن الشركة تعتزم تقديم كليهما.

جنبًا إلى جنب: وحدتا SKU

كل ما يلي هو مواصفات DeepSeek المنشورة الخاصة بها ما لم يُذكر مصدر. الأسعار لكل مليون توكن، خارج أوقات الذروة، مع سعر الذروة بين قوسين — تبلغ DeepSeek ذروتها بين 01:00 و04:00، ومرة أخرى بين 06:00 و10:00 بالتوقيت العالمي المنسق (UTC)، من الاثنين إلى الجمعة، وجميع الساعات الأخرى خارج أوقات الذروة بنصف سعر الذروة.

اسم نموذج APIdeepseek-flash (DeepSeek-V4.1-Flash) مقابل deepseek-v4-pro (DeepSeek-V4-Pro-0813).

الإدخال، إخفاق ذاكرة التخزين المؤقت — $0.15 ($0.30) مقابل $0.66 ($1.32).

الإدخال، إصابة ذاكرة التخزين المؤقت — 0.003 $ (0.006 $) مقابل 0.022 $ (0.044 $).

المخرجات — $0.60 ($1.20) مقابل $1.98 ($3.96).

السياق / الحد الأقصى للمخرجات — مليون رمز / 384 ألف على كليهما. متطابقان.

إدخال الصور — مدعوم أصليًا على Flash؛ ومُدرَج كغير مدعوم على V4 Pro.

حد التزامن — 2,500 على Flash مقابل 500 على V4 Pro.

المعاملات المعلنة — Flash: 552B إجمالاً، رقم المورّد، مع اعتراض موثوق من المجتمع عليه (المزيد حول ذلك أدناه). V4 Pro: 1.6T إجمالاً، ~49B نشطة، وهو ما تدرجه Artificial Analysis أيضًا وتؤكده صفحة وصفة vLLM.

الميزانية النشطة لكل رمز — يُفعّل Flash نحو 8B عند التعبئة المسبقة و16B عند فك التشفير بحكم التصميم، وهذا هو جوهر هندسته المعمارية؛ أما Pro فيُفعّل نحو 49B لكل رمز.

الترخيص — أوزان مفتوحة بموجب MIT لكليهما.

تاريخ الإتاحة العامة — فلاش 2026-09-10؛ V4 Pro 0813 2026-08-13، بعد معاينة أبريل.

Two-column scoreboard comparing DeepSeek V4.1 Flash and DeepSeek V4 Pro 0813 across six dimensions: AA Intelligence Index 40 vs 36, input $0.15 vs $0.66 per 1M off-peak, output $0.60 vs $1.98 per 1M off-peak, output speed 214.4 vs 94.4 tokens/s, image input supported vs not supported, and concurrency limit 2,500 vs 500, with a footer reading 'AA Intelligence Index and output speed per Artificial Analysis; prices, image input and concurrency per DeepSeek, off-peak.'

الفارق السعري هو الحجة كاملة

تكلفة الإدخال أعلى بـ4.4× على Pro. والإخراج بـ3.3×. أما إصابات الذاكرة المؤقتة — وهي الفئة التي تهيمن على تشغيل طويل لوكيل بنص نظامي ثابت — فهي بـ7.3×. ولأن فئة الذروة تتضاعف في كل فئة على الجانبين، تظل النسبة متطابقة عند الذروة؛ فالفجوة ليست أثرًا من آثار الخصم.

ضع عليه عبئًا تشغيليًا. خذ وكيل برمجة يستهلك 10 ملايين توكن إدخال شهريًا بمعدل إصابة ذاكرة التخزين المؤقت 70% و2 مليون توكن إخراج. على V4.1 Flash في وقت خارج الذروة، يكون ذلك $0.45 من الإدخال الجديد، و$0.021 من الإدخال المخزَّن مؤقتًا، و$1.20 من الإخراج: $1.67. وعلى V4 Pro في وقت خارج الذروة يكون $1.98 و$0.154 و$3.96: $6.09. أي نحو 3.6×، على عبء عمل عادي عن قصد.

تلك هي قائمة DeepSeek الخاصة، وهي السعر الذي تدفعه فعليًا هنا: يمرّر OrcaRouter أسعار قوائم المزوّدين كما هي بهامش ربح 0%، لذا يصل أي تغيير في أسعار DeepSeek إلى جهتنا في اليوم نفسه بدلًا من إعادة تغليفه. يقع كلا الطرازين على المفتاح نفسه، وهو أمر مهم للقسم الوارد أدناه — ذاك المتعلق باختبار ترحيل لم يعد عليك القيام به.

Screenshot of DeepSeek's official Models & Pricing page showing deepseek-flash and deepseek-v4-pro side by side: vision supported for Flash and 'Not supported' for V4 Pro; cache-hit input $0.003 vs $0.022 off-peak; cache-miss input $0.15 vs $0.66; output $0.60 vs $1.98; concurrency limit 2500 vs 500; and a footnote stating that in response to user demand DeepSeek will continue providing V4 Pro API services after September 14, 2026 with billing unchanged.

حيث يتفوق DeepSeek V4.1 Flash فعليًا

أقوى دليل يدعم Flash ليس جدول المعايير الخاص بـ DeepSeek، بل هو Artificial Analysis، فهو مستقل ويمكن الاطلاع عليه مباشرةً من صفحات النماذج الخاصة به.

مؤشر الذكاء — يسجّل Flash (Reasoning, Max Effort) نتيجة 40، فيحتل المرتبة #6 من بين 113 نموذجًا. ويسجّل V4 Pro 0813 (Reasoning, Max Effort) نتيجة 36، فيحتل المرتبة #7. المؤشر نفسه، وإعداد الجهد نفسه، والفارق أربع نقاط فقط، مع تقدّم النموذج الأرخص.

سرعة الإخراج — 214.4 رمز/ثانية مقابل 94.4 رمز/ثانية. أي 2.3×، وهو قياس فعلي وليس ادّعاءً.

الوقت المستغرق حتى أول رمز — 1.21 ثانية مقابل 1.74 ثانية.

DeepSWE v1.1 — 74.2 لـ Flash على لوحة الصدارة المتتبعة، في المركز الأول، متقدماً على GPT-6 Astra عند 74.10، و Claude Opus 5 عند 74.00، و Gemini 3.8 Flash عند 73.70. نتيجة V4 Pro 0813 البالغة 62.7 على نفس المعيار هي رقم DeepSeek الخاص. الفارق في الصدارة هو 0.2 نقطة، وهو تعادل وليس فوزاً — لكن فجوة 11.5 نقطة عن Pro ليست تعادلاً.

كفاءة الخدمة — يستمد مفكك ترميز Flash KV العام الخاص به من الحالة المخفية النهائية للمشفّر بدلاً من إعادة حسابه لكل طبقة، وهذا ما ينتج التنشيط غير المتماثل 8B-prefill / 16B-decode. يضع ملف InferenceX من SemiAnalysis ذاكرة KV المؤقتة عند نحو 890 بايت لكل رمز — أي نحو ربع ما لدى V4 Flash — مع انخفاض تخزين KV الدائم إلى نحو الثمن. هذا هو سبب كون السعر كما هو، وهو أيضاً سبب إتاحة النموذج عند 2,500 تزامن بينما يقتصر Pro على 500.

الرؤية على واجهة API المُقدَّمة — وليس في الأوزان فقط. تُدرج صفحة التسعير الخاصة بـ DeepSeek إدخال الصور كمدعوم في Flash وغير مدعوم في V4 Pro، وتصفه DeepSeek بأنه أول نموذج رائد لديها بفهم أصلي متعدد الوسائط. هذا أول نموذج رائد من DeepSeek لا تتطلب فيه قراءة لقطة شاشة نقطة نهاية منفصلة.

كل الأرقام الرئيسية الأخرى التي ستراها مقتبسة — Terminal-Bench 2.1 عند 90.6، وGPQA Diamond عند 90.9، وCodeforces 3471 — هي أرقام DeepSeek الخاصة، لم نُعِد إنتاجها بأنفسنا، وينبغي قراءتها مع أخذ ذلك في الاعتبار.

حيث يظل DeepSeek V4 Pro هو الخيار الصحيح

سيكون من السهل استبعاد V4 Pro بعد أسبوع كهذا. لكن التراجع عن الإهمال يقول غير ذلك، وورقة المواصفات تقول غير ذلك أيضًا.

يحمل Pro ما مجموعه 1.6 تريليون معامل، ويُنشّط نحو 49 مليار معامل لكل رمز، مقابل 16 مليارًا لدى Flash عند فك الترميز. وأيًا كان ما يقوله المؤشر، فإن السعة لكل رمز مورد حقيقي، وأعباء العمل التي يظهر فيها هي ذات الأفق الطويل: تشغيلات وكلاء تمتد ساعات، وعمليات إعادة هيكلة كبيرة، ومهام تكلف فيها خطوة خاطئة مبكرة المسار بأكمله. فجوة أربع نقاط في المؤشر تقيس متوسط عشر تقييمات، لا ذيل التوزيع الخاص بك.

Pro هو أيضًا الخيار المعروف. إنه متاح بشكل عام منذ 2026-08-13 بعد معاينة في أبريل، وقد اكتسب إصدار 0813 أدائه من التدريب اللاحق لا من البنية — العدد نفسه من المعاملات، والشكل نفسه كما في المعاينة، وسلوك مختلف. وهذا يمثل أربعة أشهر من الأدوات المجتمعية، وأُطر تشغيل الوكلاء المنشورة، وأنماط التوجيه، وأنماط الفشل. أما Flash فقد أصبح متاحًا بشكل عام منذ ثمانية أيام، والمنظومة المحيطة به هزيلة بالمقابل. إذا كانت موثوقية فريقك مستمدة من معرفة الطريقة الدقيقة التي يفشل بها النموذج، فإن Pro هو المكان الذي تسكن فيه تلك المعرفة.

والخدمة لم تتوقف. التزام DeepSeek صريح، والفوترة لم تتغير، والأوزان بترخيص MIT، ولا يزال V4 Pro ضمن كتالوجنا بالسعر المدرج نفسه. إن الإهمال الملغى ليس وقفًا للتنفيذ — بل هو إعلان بأن DeepSeek تعتزم الاستمرار في خدمة هذه الفئة.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro showing the model ID deepseek/deepseek-v4-pro, the description 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context', 1M-token context and 384K max output, text-only input, $0.66 per 1M input tokens and $1.98 per 1M output tokens, and p50 TTFT of 5.79 seconds.

ثلاثة أمور تُؤخذ على كلا النموذجين

ضوابط حماية، لأن الخطأ في هذا القرار مكلف.

عدد المعاملات محل خلاف. 552B هو رقم DeepSeek. ويرى تحليل مجتمعي موثوق أن نقطة التحقق الصادرة تبلغ 748B — العمود الفقري للمحوّل 552B بالإضافة إلى جدول الذاكرة الشرطية Engram بنحو 196B، وهو بنية بحث يُرجَع إليها في نقطتين داخل الشبكة لا طبقة تمر الإشارة عبرها. التنزيل المنشور هو 510.3 GB موزعة على 48 جزء safetensors من أوزان كثيفة FP8 مع خبراء توجيه FP4. يمكن أن يكون كلا الرقمين صحيحًا في الوقت نفسه، اعتمادًا على ما إذا كنت تحسب الاسترجاع منفصلًا عن الحساب. اعتبر 552B رقمًا معلنًا من الجهة الموردة، وتحقّق من مساحة القرص قبل أن تخطط لعملية نشر.

درجة لوحة الصدارة هي شاشة، وليست عقدًا. يمثل 74.2 الخاص بـ DeepSWE v1.1 معيار قياس منصة. يزعم تدقيق ذاتي النشر من EyesTech Systems Lab أن درجات فئة Flash هذه تنهار عند نقلها إلى مستودعات معزولة وواقعية ومتعددة الملفات — مما يضع DeepSeek V4.1 Flash عند 31.4% في SWE-bench Pro مقابل 74.2% المعلنة، وهو انخفاض أكبر من النماذج الرائدة في مقارنته الخاصة. هذا التدقيق ليس مستقلاً — فالمؤلف يبيع أداة للكشف عن استغلال منصة التقييم الذي يصفه بالضبط — ولم نشهد أي إعادة إنتاج له. لا يزال الموقف الصحيح: تحقق من مستودعاتك الخاصة قبل الترحيل.

الإسهاب بند تكلفة. قاست Artificial Analysis توليد V4.1 Flash لنحو 250 مليون توكن إخراج خلال تشغيل Intelligence Index الخاص به، مقابل وسيط قدره 140 مليون لنماذج مفتوحة الأوزان مماثلة، وتصفه بأنه شديد الإسهاب. الإخراج هو الاتجاه المكلف في جدول الأسعار هذا، لذا فإن نموذجًا يفكر بصوت عالٍ يأكل من وفوراته. في عبء عمل كثيف الاستدلال، خطط لميزانية عدد التوكنات، وليس لسعر التوكن فقط.

شيء آخر، يُقال بوضوح حتى لا يخطط أحد بناءً على إشاعة: لم يتم إصدار DeepSeek V4.1 Pro. وُصِف الترحيل الملغى بأنه حل مؤقت "قبل إطلاق V4.1 Pro"، ولم يتغير أي شيء في ذلك.

اختر DeepSeek V4.1 Flash إذا

• عبء عملك ضخم الحجم، أو حساس لزمن الاستجابة، أو محدود التكلفة — التصنيف، والاستخراج، والتوجيه، والتلخيص، والمحادثة، ومعظم توليد الأكواد.

• تحتاج إلى إدخال الصور عبر نقطة النهاية نفسها المستخدمة للنص. هذا أول طراز رائد من DeepSeek يكون فيه ذلك استدعاءً واحدًا بدلًا من نموذج ثانٍ.

• موجّهاتك قابلة للتخزين المؤقت. عند 7.3× في حالات إصابة الذاكرة المؤقتة تكون الفجوة أوسع تحديدًا حيث يتركّز مرور الوكلاء، وموجّه نظام مستقر يمثّل معظم مدخلات التشغيل الطويل.

• أنت تبدأ من جديد هذا الأسبوع، وليس لديك منظومة مضبوطة على خصوصيات نموذج بعينه. لا يوجد شيء يستحق الحماية.

• أنت تريد سقف التزامن الأعلى. 2,500 مقابل 500 يعني فرقًا قدره خمسة أضعاف في حجم ما يمكنك تمريره قبل أن تبدأ في الانتظار في قائمة الانتظار.

اختر DeepSeek V4 Pro إذا

• لديك بالفعل بيئة إنتاج مضبوطة وفقًا له. الانعكاس يعني أن لديك وقتًا — استغله للاختبار بدلًا من تجنّب السؤال.

• مهامك طويلة الأفق ومكلفة الفشل، وقد قِسْتَ أن نحو 49B من المعاملات النشطة لكل رمز يمنحك شيئًا لا يمنحك إياه 16B الخاص بـ Flash، على بياناتك أنت لا على لوحة الصدارة.

• تحتاج إلى سلوك نصّي فقط يمكن التنبؤ به دون مسار رؤية يستدعي التفكير، أو لديك خطوط أساس للتقييم من شأن تبديل النموذج أن يُبطلها في منتصف الدراسة.

• نمط وصولك منخفض الحجم وعالي المخاطر، حيث إن 3.6× على فاتورة صغيرة ليس العامل الحاسم.

إذا سبق لك أن بنيت على DeepSeek V4 Pro

الشيء المفيد الذي تغيّر في 2026-09-11 هو أن ترحيلك توقف عن كونه موعدًا نهائيًا وأصبح قرارًا. هذا أفضل لك قطعًا وأسوأ قطعًا لصندوق الوارد لديك، لأن القرار لا يزال يتعين اتخاذه، والآن لا أحد يتخذه نيابة عنك.

ابدأ بتسعير الأمر. الفجوة البالغة 3.3–4.4× هي الرقم الذي تتركه على الطاولة، ويحوّله المثال العملي أعلاه إلى رقم شهري خلال دقيقة تقريبًا. ثم اختبره بالطريقة الوحيدة التي تُحتسب: انسخ شريحة من حركة الإنتاج إلى Flash، وأبقِ Pro على المسار الأساسي، وقارن الفروق في المخرجات على مهامك الخاصة. ولأن كلا النموذجين يجيبان على المفتاح نفسه بسعر قائمة المزوّد مع تحويل تلقائي عند الفشل، فإن ذلك التشغيل الظلّي هو تغيير في التوجيه بدلًا من تكامل ثانٍ، ويمكن للموجّه أن يعيد الطلب إلى Pro عند فشله دون أن تكتب أنت آلية الاحتياط. إن الفرق التي تحرق التوكنات في ترحيل لم تطلبه هي السبب الذي وُجدت طبقة التوجيه من أجله في المقام الأول.

لا تفترض أن Flash بديل جاهز. إنه بنية مختلفة — مشفّر-مفكّر سببي مكوّن من 40 طبقة مع تنشيط غير متماثل — وهو أكثر إسهابًا في الاستدلال. لن ينتقل السلوك على مستوى المطالبة بشكل نظيف في أي من الاتجاهين، لذا قِس الترحيل بناءً على المخرجات، وليس على المؤشر.

ماذا تشاهد

ثلاثة أمور تقرر كيف سيبدو هذا الاقتران بعد شهر. أولاً، ما إذا كان V4.1 Pro سيصدر ويعيد طبقة Pro حقيقية — فقد كانت عملية الترحيل الملغاة بأكملها صراحةً حلاً مؤقتاً له، لذلك لا تزال خريطة طريق DeepSeek تحوي فراغاً بحجم منتج رائد. ثانياً، ما إذا كانت هذه المهلة ستصمد أمام خطوة DeepSeek السعرية التالية؛ فشركة مستعدة لجدولة إعادة توجيه صامتة مرة واحدة قد تعلمت أنها لا تستطيع، لا أنه لا ينبغي لها. ثالثاً، ما إذا كان أي شخص خارج DeepSeek يعيد إنتاج أرقام معيار Flash على مستودعات غير معدّلة، وهو النتيجة الوحيدة التي ستحسم جدل الكفاءة مقابل السعة الذي تدور حوله هذه المقارنة كلها. حتى ذلك الحين، الموقف الصادق هو الذي يستلزمه التراجع نفسه: Flash هو الخيار الافتراضي الأفضل لأي شيء جديد، وPro هو الرهان الأفضل لأي شيء مبني بالفعل، وقد أخبرتك DeepSeek للتو أنها ستخدم كليهما بينما تحدد أيّهما أنت.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا