
OpenAI o3 مقابل DeepSeek V4 Pro: عصر الاستدلال المتميّز ينتهي حيث تبدأ فجوة الأسعار.
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianجديدQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenجديدQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekجديدDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokجديدSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
- openaiOpenAI: GPT-5.6 Terra2026-07-0957الذكاء77البرمجة
- openaiOpenAI: GPT-5.6 Sol2026-07-0961الذكاء77البرمجة
المواجهة بين OpenAI o3 وDeepSeek V4 Pro هي في الحقيقة اصطدام رقمين. كان إصدار OpenAI o3 الصادر في 16 أبريل 2025 هو النقطة المرجعية للاستدلال المتميز — الطراز الذي كنت تدفع مقابله أكثر عندما كانت تكلفة الإجابة الخاطئة أعلى من تكلفة الرموز. أما DeepSeek V4 Pro، الذي أصبح متاحًا رسميًا (GA) كبناء 0813 في 13 أغسطس 2026 بعد إصدار مسائي هادئ وطرح تضمن إعلانًا مسحوبًا وأوزانًا أعيد رفعها، فهو الطراز الذي جعل ذلك التميّز يبدو كخطأ تصنيفي: مؤشر مستقل يتفوق على مؤشر o3، بسعر يبلغ تقريبًا خُمس السعر، مع أوزان مفتوحة فوق ذلك. والاصطدام موقوت زمنيًا، لأن OpenAI o3 سيغادر ChatGPT في 26 أغسطس 2026، وستتبعها لقطات API في 11 ديسمبر، وكل أسبوع من المقارنة يُرجّح كفة الطراز الذي لن يذهب إلى أي مكان.
نموذجان تم إطلاقهما بفارق عام في الفلسفة
{{1}}o3{{/1}} هو النموذج الرائد في الاستدلال الخالص: نموذج مغلق مدرَّب على التفكير مطوَّلاً قبل الإجابة، بنافذة سياق تبلغ 200 ألف رمز، وإخراج يصل إلى 100 ألف رمز، وإدخال صور مدمج في سلسلة تفكيره. وفقًا لأرقام OpenAI الخاصة، فقد وضع معيار عام 2025 — 96.7٪ على AIME 2024، و87.7٪ على GPQA Diamond، و69.1٪ على SWE-bench Verified دون سقالات، و2727 على Elo الخاص بـ Codeforces — ثم خفضت OpenAI سعره لاحقًا من 10$/40$ إلى 2$/8$ لكل مليون رمز، وهو المستوى الذي ما زال عليه. {{2}}DeepSeek V4 Pro{{/2}} هو اقتصاد مختلف تمامًا: نموذج خليط من الخبراء يضم 1.6 تريليون معلمة، مع نحو 49 مليار معلمة نشطة لكل رمز، ونافذة سياق تبلغ مليون رمز، وإخراج أقصى يبلغ 384 ألف رمز، ومدخلات نصية فقط، — وهو الجديد في إصدار 0813 GA — حزمة معالجة لاحقة أعيد بناؤها وتكامل أصلي مع Responses-API وCodex مما جعل درجات وكيله تقفز من 12.8 في المعاينة إلى 62.7 على DeepSWE. كما أنه مفتوح الأوزان: نقطة التفتيش DeepSeek-V4-Pro-0813 قابلة للتنزيل على Hugging Face بموجب ترخيص MIT، بعد أول 24 ساعة فوضوية شهدت سحب شارة الإصدار واختفاء الأوزان لفترة وجيزة بصفحة 404 قبل إعادة إدراجها بإعدادات مصححة.
فجوة التكلفة بالأرقام الحقيقية
تقوم بطاقات الأسعار بمعظم الجدال من تلقاء نفسها:
• OpenAI o3 — 2.00 دولار لكل مليون رمز إدخال، و8.00 دولارات لكل مليون رمز إخراج، و0.50 دولار للإدخال المخزن. تُحتسب توكنات الاستدلال كإخراج، لذا فإن السؤال الصعب يستهلك توكنات التفكير قبل الإجابة.
• DeepSeek V4 Pro — 0.435 دولار لكل مليون إدخال (عند فقدان الكاش)، 0.003625 دولار عند إصابة الكاش، و0.87 دولار لكل مليون مخرجات اليوم. الإخراج أرخص بنحو 4.6 مرات من o3، والإدخال عند إصابة الكاش مجاني فعليًا.
التحذير المرتبط بتاريخ — زيادة أسعار DeepSeek المقررة في 17 أغسطس ترفع سعر مخرجات V4 Pro من 6 يوانات إلى 27 يوانًا لكل مليون خلال ساعات الذروة (13.5 خارج الذروة)، وسعر الإدخال غير المُخزَّن مؤقتًا من 3 إلى 9 يوانات. وحتى بسعر الذروة الجديد، تظل المخرجات جزءًا صغيرًا من تكلفة 8 دولارات الخاصة بـ o3. النافذة المتاحة للبناء بالأسعار الحالية تُقاس بالأيام، وهذا بحد ذاته جزء من معادلة الترحيل.
اقتصاديات الإجابة الصحيحة تُبرز النقطة بدقة. رموز التفكير الخفية في o3 تعني أن تكلفتها الحقيقية لكل إجابة صعبة تعادل عدة أضعاف معدل إخراجها. كما أن DeepSeek V4 Pro يفكر أيضًا، وتُحتسب أفكاره كإخراج أيضًا، لكن بسعر 0.87 دولار فإن الإنفاق المطلق يعد خطأً تقريبيًا بجانب جلسة o3 التي تفكر لدقيقة ونصف. تأطير تكلفة الوكيل الذي استخدمته DeepSeek عند الإطلاق — أي فجوة تبلغ حوالي 45 ضعفًا في سعر كل مهمة مقارنة بالنماذج المغلقة الرائدة — يبالغ في التقدير ضد o3 تحديدًا، لكن الاتجاه غير قابل للجدل: هذه فجوة تتراوح بين 4 إلى 10 أضعاف في التكلفة الفعلية اعتمادًا على عبء العمل.
أين تقف فجوة الجودة فعليًا
النتيجة الأهم هي النتيجة المستقلة. في مؤشر الذكاء الخاص بـ Artificial Analysis، يسجّل DeepSeek V4 Pro 53 نقطة ويحتل المرتبة #2 من بين 104 نماذج يدرجها المؤشر حاليًا؛ بينما يقع o3 حول 30 — أي فجوة تزيد عن 20 نقطة على نفس المنصة. هذا هو الملخص الأوضح لما آلت إليه مكانة الرائد المتميز في التفكير بعد عامين من التقدم: لم يعد يُنافس على السعر فقط؛ بل يُهزم في التقييم المستقل.
صورة كل معيار على حدة أكثر فوضوية وتحتاج إلى توصيف صادق. أرقام الوكيل الرئيسية لـ DeepSeek V4 Pro — Terminal-Bench 2.1 عند 87.9، وCyberGym عند 83.3، وDeepSWE عند 62.7، وAutomationBench متقدمًا على النماذج الحدودية المغلقة — هي ادعاءات DeepSeek الخاصة منذ إطلاق 0813، ولم تُعاد إنتاجها بشكل مستقل حتى وقت كتابة هذا التقرير، كما أن حادثة الإعداد الخاطئ أثناء الطرح تعني أنه لا يمكن لأحد الجزم بأن واجهة برمجة التطبيقات كانت تقدم الأوزان المصححة النهائية عندما جُمعت الأرقام المبكرة من جهات خارجية. معايير إطلاق o3 هي أيضًا مبلغ عنها من قِبل البائع، لكنها تحققت جزئيًا من خلال إعادة اختبار مستقلة في عام 2025، عندما تصدرت فعليًا لوحات صدارة الاستدلال. في الرياضيات والاستدلال الخالص، لا يزال السجل المنشور لـ o3 يبدو أفضل من سجل DeepSeek V4 Pro — نقاط قوة DeepSeek تكمن في استخدام الأدوات الوكيلية والبرمجة والمهام طويلة الأفق، وهي مجموعة اختبار مختلفة عن أولمبيادات الرياضيات التي هيمن عليها o3.

ما الذي لا يزال o3 يفعله بشكل أفضل
أمران يخرجان من المقارنة سالمين. أولاً، الرياضيات والاستدلال الدقيق: لا تزال نتائج o3 في AIME (96.7%) وGPQA (87.7%) أعلى من أي شيء نشرته DeepSeek V4 Pro، وإذا كان عملك يتمثل في برهان صعب أو مسألة مسابقات، فإن o3 — ما دام لا يزال يعمل — هو الخيار الأكثر أمانًا. ثانيًا، الاستدلال البصري: يمكن لـ o3 التفكير في لقطة شاشة أو مخطط داخل سلسلة تفكيره، بينما DeepSeek V4 Pro نصّية فقط؛ لم يُضِف إصدار 0813 أي مُرمِّز بصري، وإذا كانت مهمتك تتطلب أن يقرأ النموذج صورة، فإن DeepSeek V4 Pro ليست بديلاً عن o3 في هذا الجانب. لا تُعد أي من الميزتين سببًا للبقاء على نموذج يُحال إلى التقاعد، لكن كلتيهما سبب للاعتراف بصدق أن الترحيل ليس ترقية خالصة.
الأمر الآخر الجدير بالملاحظة هو الفرق في الأوزان المفتوحة، وهو ليس معيارًا مرجعيًا على الإطلاق. كان o3 نموذجًا مغلقًا، ويُدمج الآن حتى يختفي من الوجود؛ لا يمكنك إبقاءه يعمل على أجهزتك الخاصة. نقطة التحقق 0813 من DeepSeek V4 Pro هي ملكك بشكل دائم، بموجب ترخيص MIT — نفس الأوزان، نفس النموذج ذي 1.6 تريليون معامل، مع استضافة ذاتية إذا كان لديك ~1.5 تيرابايت من العتاد لتشغيله. أما بالنسبة للفرق التي احترقت بسبب اعتمادها على نموذج مغلق يمكن لمورّد أن يوقف تشغيله، فهذه إجابة بنيوية للمشكلة نفسها التي يطرحها تقاعد o3.
ترحيل عبء العمل
بالنسبة لفريق API القادم من o3، يُعتبر DeepSeek V4 Pro الخيار الأرخص للاستقرار عليه، وفي أعمال الوكلاء والبرمجة التي تمثل معظم الاستخدام الفعلي لـAPI، نادرًا ما يكون خطوة للوراء. أما المزالق الحقيقية فهي تشغيلية وليست متعلقة بالجودة: V4 Pro محدود بـ500 طلب متزامن على واجهة API الرسمية، وهو سقف ستصل إليه مع أسطول من الوكلاء، كما أن تسعيره يتغير في 17 أغسطس. وهذان الأمران هما بالضبط ما صُممت طبقة التوجيه للتعامل معه.
على OrcaRouter، تُقدَّم DeepSeek V4 Pro بسعر القائمة لدى المزوّد مع تمريره بهامش ربح 0% — لذا فإن سعر اليوم $0.44/$0.87 يكون متاحًا هنا في اليوم نفسه الذي يتوفّر فيه لدى DeepSeek، وعندما يدخل جدول الذروة/خارج الذروة في 17 أغسطس حيّز التنفيذ، ينعكس هنا في اليوم نفسه أيضًا. مفتاح واحد يتيح أيضًا الوصول إلى بقية نماذج هذه المجموعة البديلة لـ o3، والتحويل التلقائي عند الفشل هو الحل الأمثل لسقف 500 عملية متزامنة: وجّه مسارًا إنتاجيًا إلى V4 Pro مع نموذج ثانٍ على المفتاح نفسه ودَع الموجّه يمتص السقف. أما OpenAI o3 نفسه فليس على هذا المفتاح — بل يبقى متاحًا عبر واجهة OpenAI الخاصة وعدة منصات خارجية حتى الموعد النهائي للقطة في 11 ديسمبر.

من ترجّحه الأرقام
بالنسبة لأي شخص تكون مهامه على o3 هي البرمجة، أو حلقات الوكلاء (agent loops)، أو معالجة السياق الطويل، فإن الحسابات ليست متقاربة: DeepSeek V4 Pro يتفوق على o3 في المؤشر المستقل، وتكلفته جزء بسيط من التكلفة، وأوزانه المفتوحة تعني أن هذا الاعتماد المعيّن لا يمكن سحبه من تحتك. الفرق التي لديها سبب حقيقي لإبقاء o3 حيًا في الوقت الحالي هي الفرق الضيقة — الاستدلال الرياضي الصرف الصعب، وأي شيء مبني على تفكير o3 في الصور — وحتى تلك الفرق يجب أن تختبر البدائل مقابل أعباء عمل حقيقية قبل ديسمبر، لأن الموعد النهائي لا يهتم بحالتك الخاصة. عصر الاستدلال المتميز الذي عرّفه o3 انتهى بإعلان تقاعده؛ وDeepSeek V4 Pro يصادف أنه المكان الذي يوجد فيه أرخص مقعد في العصر القادم.

مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
