بطاقة مقال رئيسية تعرض 'OpenAI o3 مقابل DeepSeek V4 Pro' مع شارة 'مقارنة النماذج' والعنوان الفرعي 'عصر الاستدلال المتميز ينتهي حيث تتسع فجوة الأسعار'، مع أيقونة علامة متميزة على اليسار وأيقونة عملات معدنية على اليمين، وشعار OrcaRouter في أسفل اليمين.
Guides & Insights

OpenAI o3 مقابل DeepSeek V4 Pro: عصر الاستدلال المتميّز ينتهي حيث تبدأ فجوة الأسعار.

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

المواجهة بين Ope​nAI o3 وDeepSeek V4 Pro هي في الحقيقة اصطدام رقمين. كان إصدار Ope​nAI o3 الصادر في 16 أبريل 2025 هو النقطة المرجعية للاستدلال المتميز — الطراز الذي كنت تدفع مقابله أكثر عندما كانت تكلفة الإجابة الخاطئة أعلى من تكلفة الرموز. أما DeepSeek V4 Pro، الذي أصبح متاحًا رسميًا (GA) كبناء 0813 في 13 أغسطس 2026 بعد إصدار مسائي هادئ وطرح تضمن إعلانًا مسحوبًا وأوزانًا أعيد رفعها، فهو الطراز الذي جعل ذلك التميّز يبدو كخطأ تصنيفي: مؤشر مستقل يتفوق على مؤشر o3، بسعر يبلغ تقريبًا خُمس السعر، مع أوزان مفتوحة فوق ذلك. والاصطدام موقوت زمنيًا، لأن Ope​nAI o3 سيغادر ChatGPT في 26 أغسطس 2026، وستتبعها لقطات API في 11 ديسمبر، وكل أسبوع من المقارنة يُرجّح كفة الطراز الذي لن يذهب إلى أي مكان.

نموذجان تم إطلاقهما بفارق عام في الفلسفة

{{1}}o3{{/1}} هو النموذج الرائد في الاستدلال الخالص: نموذج مغلق مدرَّب على التفكير مطوَّلاً قبل الإجابة، بنافذة سياق تبلغ 200 ألف رمز، وإخراج يصل إلى 100 ألف رمز، وإدخال صور مدمج في سلسلة تفكيره. وفقًا لأرقام Ope​nAI الخاصة، فقد وضع معيار عام 2025 — 96.7٪ على AIME 2024، و87.7٪ على GPQA Diamond، و69.1٪ على SWE-bench Verified دون سقالات، و2727 على Elo الخاص بـ Codeforces — ثم خفضت Ope​nAI سعره لاحقًا من 10$/40$ إلى 2$/8$ لكل مليون رمز، وهو المستوى الذي ما زال عليه. {{2}}DeepSeek V4 Pro{{/2}} هو اقتصاد مختلف تمامًا: نموذج خليط من الخبراء يضم 1.6 تريليون معلمة، مع نحو 49 مليار معلمة نشطة لكل رمز، ونافذة سياق تبلغ مليون رمز، وإخراج أقصى يبلغ 384 ألف رمز، ومدخلات نصية فقط، — وهو الجديد في إصدار 0813 GA — حزمة معالجة لاحقة أعيد بناؤها وتكامل أصلي مع Responses-API وCodex مما جعل درجات وكيله تقفز من 12.8 في المعاينة إلى 62.7 على DeepSWE. كما أنه مفتوح الأوزان: نقطة التفتيش DeepSeek-V4-Pro-0813 قابلة للتنزيل على Hugging Face بموجب ترخيص MIT، بعد أول 24 ساعة فوضوية شهدت سحب شارة الإصدار واختفاء الأوزان لفترة وجيزة بصفحة 404 قبل إعادة إدراجها بإعدادات مصححة.

فجوة التكلفة بالأرقام الحقيقية

تقوم بطاقات الأسعار بمعظم الجدال من تلقاء نفسها:

OpenAI o3 — 2.00 دولار لكل مليون رمز إدخال، و8.00 دولارات لكل مليون رمز إخراج، و0.50 دولار للإدخال المخزن. تُحتسب توكنات الاستدلال كإخراج، لذا فإن السؤال الصعب يستهلك توكنات التفكير قبل الإجابة.

• DeepSeek V4 Pro — 0.435 دولار لكل مليون إدخال (عند فقدان الكاش)، 0.003625 دولار عند إصابة الكاش، و0.87 دولار لكل مليون مخرجات اليوم. الإخراج أرخص بنحو 4.6 مرات من o3، والإدخال عند إصابة الكاش مجاني فعليًا.

التحذير المرتبط بتاريخ — زيادة أسعار DeepSeek المقررة في 17 أغسطس ترفع سعر مخرجات V4 Pro من 6 يوانات إلى 27 يوانًا لكل مليون خلال ساعات الذروة (13.5 خارج الذروة)، وسعر الإدخال غير المُخزَّن مؤقتًا من 3 إلى 9 يوانات. وحتى بسعر الذروة الجديد، تظل المخرجات جزءًا صغيرًا من تكلفة 8 دولارات الخاصة بـ o3. النافذة المتاحة للبناء بالأسعار الحالية تُقاس بالأيام، وهذا بحد ذاته جزء من معادلة الترحيل.

اقتصاديات الإجابة الصحيحة تُبرز النقطة بدقة. رموز التفكير الخفية في o3 تعني أن تكلفتها الحقيقية لكل إجابة صعبة تعادل عدة أضعاف معدل إخراجها. كما أن DeepSeek V4 Pro يفكر أيضًا، وتُحتسب أفكاره كإخراج أيضًا، لكن بسعر 0.87 دولار فإن الإنفاق المطلق يعد خطأً تقريبيًا بجانب جلسة o3 التي تفكر لدقيقة ونصف. تأطير تكلفة الوكيل الذي استخدمته DeepSeek عند الإطلاق — أي فجوة تبلغ حوالي 45 ضعفًا في سعر كل مهمة مقارنة بالنماذج المغلقة الرائدة — يبالغ في التقدير ضد o3 تحديدًا، لكن الاتجاه غير قابل للجدل: هذه فجوة تتراوح بين 4 إلى 10 أضعاف في التكلفة الفعلية اعتمادًا على عبء العمل.

أين تقف فجوة الجودة فعليًا

النتيجة الأهم هي النتيجة المستقلة. في مؤشر الذكاء الخاص بـ Artificial Analysis، يسجّل DeepSeek V4 Pro 53 نقطة ويحتل المرتبة #2 من بين 104 نماذج يدرجها المؤشر حاليًا؛ بينما يقع o3 حول 30 — أي فجوة تزيد عن 20 نقطة على نفس المنصة. هذا هو الملخص الأوضح لما آلت إليه مكانة الرائد المتميز في التفكير بعد عامين من التقدم: لم يعد يُنافس على السعر فقط؛ بل يُهزم في التقييم المستقل.

صورة كل معيار على حدة أكثر فوضوية وتحتاج إلى توصيف صادق. أرقام الوكيل الرئيسية لـ DeepSeek V4 Pro — Terminal-Bench 2.1 عند 87.9، وCyberGym عند 83.3، وDeepSWE عند 62.7، وAutomationBench متقدمًا على النماذج الحدودية المغلقة — هي ادعاءات DeepSeek الخاصة منذ إطلاق 0813، ولم تُعاد إنتاجها بشكل مستقل حتى وقت كتابة هذا التقرير، كما أن حادثة الإعداد الخاطئ أثناء الطرح تعني أنه لا يمكن لأحد الجزم بأن واجهة برمجة التطبيقات كانت تقدم الأوزان المصححة النهائية عندما جُمعت الأرقام المبكرة من جهات خارجية. معايير إطلاق o3 هي أيضًا مبلغ عنها من قِبل البائع، لكنها تحققت جزئيًا من خلال إعادة اختبار مستقلة في عام 2025، عندما تصدرت فعليًا لوحات صدارة الاستدلال. في الرياضيات والاستدلال الخالص، لا يزال السجل المنشور لـ o3 يبدو أفضل من سجل DeepSeek V4 Pro — نقاط قوة DeepSeek تكمن في استخدام الأدوات الوكيلية والبرمجة والمهام طويلة الأفق، وهي مجموعة اختبار مختلفة عن أولمبيادات الرياضيات التي هيمن عليها o3.

A two-column scoreboard for OpenAI o3 vs DeepSeek V4 Pro: left column o3 shows $2/$8 pricing, 200K context, closed weights, Artificial Analysis Index around 30, math-and-reasoning strength, retiring August 26 2026; right column DeepSeek V4 Pro shows $0.44/$0.87 pricing today, 1M context, MIT open weights, Artificial Analysis Index 53 (#2 of 104), agentic-and-coding strength, GA August 13 2026. Footer: o3 figures partly independent; DeepSeek agent benchmarks vendor-reported. OrcaRouter logo bottom-right.

ما الذي لا يزال o3 يفعله بشكل أفضل

أمران يخرجان من المقارنة سالمين. أولاً، الرياضيات والاستدلال الدقيق: لا تزال نتائج o3 في AIME (96.7%) وGPQA (87.7%) أعلى من أي شيء نشرته DeepSeek V4 Pro، وإذا كان عملك يتمثل في برهان صعب أو مسألة مسابقات، فإن o3 — ما دام لا يزال يعمل — هو الخيار الأكثر أمانًا. ثانيًا، الاستدلال البصري: يمكن لـ o3 التفكير في لقطة شاشة أو مخطط داخل سلسلة تفكيره، بينما DeepSeek V4 Pro نصّية فقط؛ لم يُضِف إصدار 0813 أي مُرمِّز بصري، وإذا كانت مهمتك تتطلب أن يقرأ النموذج صورة، فإن DeepSeek V4 Pro ليست بديلاً عن o3 في هذا الجانب. لا تُعد أي من الميزتين سببًا للبقاء على نموذج يُحال إلى التقاعد، لكن كلتيهما سبب للاعتراف بصدق أن الترحيل ليس ترقية خالصة.

الأمر الآخر الجدير بالملاحظة هو الفرق في الأوزان المفتوحة، وهو ليس معيارًا مرجعيًا على الإطلاق. كان o3 نموذجًا مغلقًا، ويُدمج الآن حتى يختفي من الوجود؛ لا يمكنك إبقاءه يعمل على أجهزتك الخاصة. نقطة التحقق 0813 من DeepSeek V4 Pro هي ملكك بشكل دائم، بموجب ترخيص MIT — نفس الأوزان، نفس النموذج ذي 1.6 تريليون معامل، مع استضافة ذاتية إذا كان لديك ~1.5 تيرابايت من العتاد لتشغيله. أما بالنسبة للفرق التي احترقت بسبب اعتمادها على نموذج مغلق يمكن لمورّد أن يوقف تشغيله، فهذه إجابة بنيوية للمشكلة نفسها التي يطرحها تقاعد o3.

ترحيل عبء العمل

بالنسبة لفريق API القادم من o3، يُعتبر DeepSeek V4 Pro الخيار الأرخص للاستقرار عليه، وفي أعمال الوكلاء والبرمجة التي تمثل معظم الاستخدام الفعلي لـAPI، نادرًا ما يكون خطوة للوراء. أما المزالق الحقيقية فهي تشغيلية وليست متعلقة بالجودة: V4 Pro محدود بـ500 طلب متزامن على واجهة API الرسمية، وهو سقف ستصل إليه مع أسطول من الوكلاء، كما أن تسعيره يتغير في 17 أغسطس. وهذان الأمران هما بالضبط ما صُممت طبقة التوجيه للتعامل معه.

على OrcaRouter، تُقدَّم DeepSeek V4 Pro بسعر القائمة لدى المزوّد مع تمريره بهامش ربح 0% — لذا فإن سعر اليوم $0.44/$0.87 يكون متاحًا هنا في اليوم نفسه الذي يتوفّر فيه لدى DeepSeek، وعندما يدخل جدول الذروة/خارج الذروة في 17 أغسطس حيّز التنفيذ، ينعكس هنا في اليوم نفسه أيضًا. مفتاح واحد يتيح أيضًا الوصول إلى بقية نماذج هذه المجموعة البديلة لـ o3، والتحويل التلقائي عند الفشل هو الحل الأمثل لسقف 500 عملية متزامنة: وجّه مسارًا إنتاجيًا إلى V4 Pro مع نموذج ثانٍ على المفتاح نفسه ودَع الموجّه يمتص السقف. أما Ope​nAI o3 نفسه فليس على هذا المفتاح — بل يبقى متاحًا عبر واجهة Ope​nAI الخاصة وعدة منصات خارجية حتى الموعد النهائي للقطة في 11 ديسمبر.

Screenshot of the Artificial Analysis model page for o3 showing its rank of #107/182 on the Intelligence Index, a score of 31 (below the median of 35), a 200K-token context window, $2.00 per 1M input and $8.00 per 1M output pricing, and a 118 tokens-per-second speed reading.

من ترجّحه الأرقام

بالنسبة لأي شخص تكون مهامه على o3 هي البرمجة، أو حلقات الوكلاء (agent loops)، أو معالجة السياق الطويل، فإن الحسابات ليست متقاربة: DeepSeek V4 Pro يتفوق على o3 في المؤشر المستقل، وتكلفته جزء بسيط من التكلفة، وأوزانه المفتوحة تعني أن هذا الاعتماد المعيّن لا يمكن سحبه من تحتك. الفرق التي لديها سبب حقيقي لإبقاء o3 حيًا في الوقت الحالي هي الفرق الضيقة — الاستدلال الرياضي الصرف الصعب، وأي شيء مبني على تفكير o3 في الصور — وحتى تلك الفرق يجب أن تختبر البدائل مقابل أعباء عمل حقيقية قبل ديسمبر، لأن الموعد النهائي لا يهتم بحالتك الخاصة. عصر الاستدلال المتميز الذي عرّفه o3 انتهى بإعلان تقاعده؛ وDeepSeek V4 Pro يصادف أنه المكان الذي يوجد فيه أرخص مقعد في العصر القادم.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro showing a 1M-token context window, 384K max output, $0.44 per 1M input and $0.88 per 1M output tokens, and Tools/JSON/Reasoning capability chips.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube