بطاقة عنوان رئيسية لمقارنة بين DeepSeek V4 Pro و Qwen3.8 Max، بعنوان فرعي "متخصص في الاستدلال مقابل الصيني متعدد الاستخدامات".
Guides & Insights

DeepSeek V4 Pro ضد Qwen3.8 Max: أخصائي الاستدلال ضد المنافس الصيني متعدد المواهب

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

بفارق عشرة أيام، أُطلق النموذجان الأكثر متابعةً في الصين: أصدرت Alibaba Qwen3.8 Max في 3 أغسطس 2026 — نموذجًا رئيسيًا من نوع sparse-MoE يضم 2.4 تريليون معامل، تصفه بأنه متعدد الاستخدامات للوكلاء والأعمال المكتبية والفهم متعدد الوسائط — وأصدرت D​eepSeek النسخة الرسمية من DeepSeek V4 Pro في 12 أغسطس، نموذجه المتخصص في الاستدلال والبرمجة بإجمالي معاملات 1.6T وسعر يبلغ تقريبًا سُبع تكلفة Q​wen على توكنات الإخراج. يستهدف النموذجان محافظ المطوّرين نفسها لكنهما يختلفان حول الغرض من النموذج الرئيسي. تريد Qwen3.8 Max أن تكون النموذج الوحيد الذي توجّه إليه كل شيء؛ بينما تريد DeepSeek V4 Pro أن تكون النموذج الذي تصعّد إليه المهام الصعبة.

The OrcaRouter DeepSeek V4 Pro model page showing the flagship MoE badge, 1M-token context, 384K max output, per-million pricing and an OpenAI-compatible code sample.

النقاط الرئيسية

• Qwen3.8 Max هو النموذج الأعلى قدرةً خامًا على لوحات المتصدرين الصينية العامة (SuperCLUE #1، يوليو) والحزمة الأقوى متعددة الوسائط/المؤسسية — إدخال الفيديو، والأدوات المدمجة، والمخرجات المنظمة، كل ذلك في واجهة برمجة تطبيقات واحدة.

DeepSeek V4 Pro أرخص بشكل كبير (~7× على المخرجات)، وهو مفتوح الأوزان بالفعل، ويحمل الآن الادعاءات الأعلى في البرمجة/الوكلاء — Terminal-Bench 2.1 عند 87.9 مقابل 86.6 كما أبلغ بائع Q​wen.

• انتبه إلى تكلفة الإسهاب: تُظهر عمليات التشغيل المستقلة أن Qwen3.8 Max يبلغ متوسطها ~64 دورة و~1.14 دولارًا لكل مهمة وكيلية — وهي مشكلة تكلفة فعلية تُخفيها ورقة المواصفات.

العنوان الصادق: Qwen3.8 Max هو الرائد في «حرب القدرات» الذي يطابق تسعير النماذج المغلقة الأمريكية؛ بينما DeepSeek V4 Pro هو الردّ على صعيد التكلفة مقابل الأداء.

فلسفتان في جدول مواصفات واحد

• إجمالي المعلمات — Qwen3.8 Max 2.4T (MoE متفرق، ~95B نشط) مقابل DeepSeek V4 Pro 1.6T (MoE، ~49B نشط)

• السياق / الحد الأقصى للإخراج — كلاهما بسياق 1M؛ يبلغ الحد الأقصى لإخراج Q​wen حوالي 128–131K مقابل 384K لـ D​eepSeek

• المدخلات — يقبل Qwen النصوص والصور والفيديو؛ بينما يقبل DeepSeek V4 Pro النصوص والصور، مع قدرة جديدة على التفكير في الصور بشكل أصلي في النسخة الرسمية.

• الأوزان المفتوحة — DeepSeek V4 Pro: تم إصداره (MIT)؛ Qwen3.8 Max: موعود به لأسبوع 10 أغسطس، أول Qwen من فئة Max يُفتح مصدره على الإطلاق

• إضافات API — توفر Qwen أدوات مدمجة ومخرجات منظمة بشكل افتراضي؛ بينما توفر DeepSeek V4 Pro مفاتيح تبديل للتفكير، وJSON منظم، وواجهة برمجة تطبيقات للاستجابات (Responses API)، وتوافقًا مع Codex.

• السعر — Qwen3.8 Max بسعر $2.00 / $6.00 لكل مليون توكن ($0.25 للنسخة المخزّنة مؤقتًا) مقابل DeepSeek V4 Pro بسعر ~$0.42 / $0.87 ($0.0035 للنسخة المخزّنة مؤقتًا)

Scoreboard contrasting DeepSeek V4 Pro (Terminal-Bench 2.1 87.9 official, output price $0.87 per 1M, 1.6T total params, MIT open weights out now, 384K max output, text+image input) with Qwen3.8 Max (86.6 vendor, $6.00, 2.4T params, weights promised, ~128K max output, text+image+video input).

أين يتفوق Qwen3.8 Max

على المحور العام، يتقدم Qwen3.8 Max وتتفق البيانات المستقلة على ذلك. تصنّفه Artificial Analysis بمؤشر ذكاء يبلغ 58، ومؤشر برمجة يبلغ 71.8، ومؤشر قدرات وكيلة يبلغ 58 — وهو أقرب ما بلغه أي مختبر صيني إلى قمة لوحة صدارة الوكلاء تلك. وفي تصنيف SuperCLUE لشهر يوليو الخاص باللغة الصينية، يحتل المركز الأول برصيد 71.48 بينما يحتل DeepSeek-V4-Pro المركز الخامس برصيد 64.4. أما العروض التجريبية التي أطلقتها Alibaba — تشغيل برمجة ذاتي لمدة 16 يومًا، وإعادة إنتاج ورقة بحثية تفوقت على نتيجة AIME24 في الورقة الأصلية — فهي أقوى دليل في دورة الإصدار بأكملها على أن هذا وكيل حقيقي قادر على المهام طويلة المدى.

بالنسبة للمطوّر، المكاسب العملية تأتي على هيئة تكامل: إدخال الفيديو، استدعاء الأدوات المدمج، مخرجات منظمة دون إعدادات، ونظام بيئي (Model Studio ومجموعة أدوات Qwen) لا يحاول DeepSeek مجاراته. إذا كان عبء العمل يعتمد على المستندات، أو متعدد الوسائط، أو يحتاج إلى قصة تكامل مؤسسي، فإن Qwen3.8 Max هو النموذج الذي يتجه إليه السوق الصيني حاليًا افتراضيًا.

أين يتفوق DeepSeek V4 Pro

في ما يخص البرمجة والتكلفة، فإن الإصدار الرسمي V4 Pro هو الرد. تذكر D​eepSeek أن البناء الرسمي سجّل 87.9 على Terminal-Bench 2.1 (ارتفاعًا من 72.1 في النسخة الأولية) و62.7 على DeepSWE — مقابل 86.6 على Terminal-Bench وفقًا لما أبلغت به Q​wen. كانت النسخة الأولية قد حققت بالفعل 80.6 على SWE-bench Verified و90.1 على GPQA Diamond و93.5 على LiveCodeBench، وهي أعلى نتيجة في البرمجة التنافسية بين النماذج مفتوحة المصدر، وتتركز تغييرات البناء الرسمي تحديدًا في المهام الوكيلية ومهام الاستدلال التي تنتمي إليها تلك الأرقام.

ثم هناك السعر. بسعر 0.42 دولار/0.87 دولار لكل مليون توكن، فإن DeepSeek V4 Pro أرخص بحوالي 4.8× في الإدخال و6.9× في الإخراج مقارنةً بأسعار Qwen3.8 Max البالغة 2 دولار/6 دولارات. كما أشارت D​eepSeek في 6 أغسطس إلى أن زيادة الأسعار قادمة، مما يجعل السعر الحالي نافذة وليس وعدًا — المزيد عن ذلك أدناه.

An infographic summarizing the official DeepSeek V4 Pro release: Terminal-Bench 2.1 at 87.9 (preview 72.1), DeepSWE 62.7 (preview 12.8), AutomationBench 31.8 (preview 12.8), with native image reasoning, 1M context, 384K output and $0.87 per 1M output.

قم بإجراء الحسابات لمهمة وكيلية حقيقية.

التشغيلات المستقلة الوكلائية هي حيث يتوقف السعر المعلن لـ Qwen عن كونه السعر الحقيقي. في مهام Artificial Analysis الوكلائية، حقق Qwen3.8 Max متوسط ~64 دورة لكل مهمة بتكلفة ~1.14 دولار للمهمة، مقارنة بـ ~0.53 دولار للجيل السابق — النموذج مطول ويخطط كثيرًا. شغّل نفس شكل المهمة على DeepSeek V4 Pro بسعر 0.87 دولار لكل مليون ناتج، وستصل تكلفة المهمة الواحدة إلى أقل بحوالي مرتبة من حيث الحجم. إذا كان منتجك حلقة تستدعي النموذج مئة مرة يوميًا لكل مستخدم، فهذا الفرق هو هامش ربحك.

تحذيرات الموثوقية على كلا الجانبين

إن الصدق في التوريد سلاح ذو حدين هنا. الاختبار المستقل أشار إلى ارتفاع معدل هلوسة Qwen3.8 Max من 23% إلى 40% وانخفاض درجة AA-Omniscience بمقدار عشر نقاط — النموذج أصبح أكثر قدرة وأقل جدارة بالثقة في نفس الإصدار. معاينة D​eepSeek حملت معدل إجابة دائمًا موثقًا بنسبة 94% على AA-Omniscience، مما يعني أنها تميل إلى إنتاج إجابة سواء كانت تعرفها أم لا. كلا المؤشرين مهمان للإنتاج؛ ولا يُعد أي منهما مانعًا لأحمال العمل التي تستهدفها هذه النماذج.

لماذا يغيّر توقيت الأوزان المفتوحة حسابات السعر

إصدار الأوزان المفتوحة من Qwen3.8 Max، عندما يُطرح، سيغيّر اقتصاديات هذه المواجهة خلال أسبوع — سيحصل المستضيفون الذاتيون على نموذج رائد بحجم 2.4T، وسيكون ضغط أسعار API حقيقيًا. هذا هو بالضبط السيناريو الذي يُبقيك فيه نموذج التسعير بالتمرير المباشر (pass-through) صادقًا. يمرّر OrcaRouter سعر قائمة المزود كما هو دون أي هامش ربح، فبمجرد أن يحرّك Alibaba أو D​eepSeek سعرًا — صعودًا أو هبوطًا — يصبح التغيير ساريًا على مفتاح واحد في نفس اليوم، دون إعادة تفاوض أو عقدٍ ثانٍ لقراءته. توجّه إلى أيهما يفضّله تقييمك الحالي من Qwen3.8 Max أو DeepSeek V4 Pro، ويظل التسعير مطابقًا لما يفرضه المزود فعليًا.

أي واحد لقرار بناء واجهة برمجة التطبيقات الخاصة بك؟

اختر Qwen3.8 Max عندما تتطلب المهمة السطح الكامل — مدخلات متعددة الوسائط، مخرجات منظمة، أدوات مدمجة، جودة اللغة الصينية في صدارة التصنيفات الحالية — وكان نموذج التكلفة لديك يتحمل عمليات الوكيل المطولة. اختر DeepSeek V4 Pro عندما تكون المهمة ثقيلة في الاستدلال أو البرمجة، أو حجم الرموز كبير، أو كانت الأوزان المفتوحة مهمة للامتثال أو الاستضافة الذاتية، أو كان خط الميزانية هو القيد الملزم. القراءة الأوضح لهذه المواجهة هي ما تشير إليه الشركتان نفساهما: Qwen3.8 Max هو الرائد الذي تقيس كل شيء مقابله، وDeepSeek V4 Pro هو الذي يجعل المعيار يبدو مكلفًا.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube