
GPT-6.1 Sol مقابل DeepSeek V4 Pro: ثلاثة مقاييس، ثلاث إجابات مختلفة
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
اسأل عن مدى تباعد GPT-6.1 Sol وDeepSeek V4 Pro، والجواب الصادق هو أنه يعتمد على أي مقياس تقرأ، والمقاييس الثلاثة تختلف فيما بينها أكثر مما تختلف معظم مقارنات النماذج حول كل شيء. من حيث السعر لكل مليون رمز، ممزوجًا بنسبة 3:1 بين المدخلات والمخرجات، هما 4.00 دولارات مقابل 0.99 دولار — أي بمعامل أربعة. ومن حيث التكلفة الفعلية لتشغيل مجموعة التقييم نفسها، هما 0.72 دولار مقابل 0.67 دولار لكل مهمة — سبعة بالمئة. وعلى مؤشر الذكاء Artificial Analysis Intelligence Index هما 51.8 مقابل 36 — ستة عشر نقطة، وهو ما يبدو حاسمًا حتى تنظر إلى مَن قُورن به كل رقم، لأن منهجية ذلك المُقيِّم نفسه تضع النموذجين في مستويين مختلفين. أُطلق GPT-6.1 Sol في 29 سبتمبر 2026 بسعر 2.00 دولار للمدخلات و10.00 دولارات للمخرجات مع نافذة رموز تبلغ 1,050,000 رمز. وDeepSeek V4 Pro نموذج رائد مرخّص بموجب MIT من نوع خليط الخبراء، بـ1.6 تريليون معامل منها 49 مليارًا نشطة، أُطلق في 13 أغسطس 2026 بسعر 0.66 دولار و1.98 دولار مع نافذة رموز تبلغ 1,048,576 رمزًا. أحدهما نموذج نصي يمكنك تنزيله. والآخر يرى الصور. وتحديد أيّ من المقاييس الثلاثة ينبغي أن تسترشد به فعليًا هو المهمة بأكملها.
صف الفهرس ليس المقارنة التي يبدو عليها
ابدأ بالرقم الذي يُقتبس أكثر من غيره، لأنه أكثر ما يُقتبس على نحو خاطئ.
تنشر Artificial Analysis منهجيتها إلى جانب لوحة الصدارة الخاصة بها، وهناك جملتان فيها تهمّان هنا. تقول إن النماذج مفتوحة الأوزان تُقارن فقط بنماذج أخرى مفتوحة الأوزان من نفس فئة الحجم — صغيرة جدًا، صغيرة، متوسطة، كبيرة، مع الحد الفاصل عند 150 مليار معامل. أما النماذج المملوكة فتُقارن عبر نطاق سعري بدلاً من ذلك، بنسبة مدمجة 3:1 بين المدخلات والمخرجات. هاتان مجموعتان مختلفتان من النظراء. إن DeepSeek V4 Pro 0813 مفتوح الأوزان — تقول الأسئلة الشائعة الخاصة بالمقيّم ذلك، وتشير إلى الأوزان المنشورة — وهو بإجمالي 1.6 تريليون معامل يقع في فئة الحجم الكبيرة للنماذج مفتوحة الأوزان. أما GPT-6.1 Sol فهو مملوك ويُقيَّم مقابل نماذج في نطاقه السعري الخاص.
إن وجود 51.8 و36 في صفين متجاورين من الجدول نفسه ليس مواجهة مباشرة. فهما نتيجتان مقابل مجموعتين مختلفتين من الأقران، ولهذا السبب تحديدًا تكون أرقام التكلفة لكل مهمة قابلة للمقارنة بينما أرقام المؤشر الخام ليست كذلك. إذا أردت معرفة ما إذا كان DeepSeek V4 Pro جيدًا لنموذج قابل للتنزيل، فإن 36 هو الرقم الذي يجيب عن ذلك. وإذا أردت معرفة أدائه مقابل نموذج حدودي مُستضاف، فلن يخبرك عمود المؤشر بذلك، وهذه حالة يكون فيها التصرف الصادق هو قول ذلك بدلًا من طرح 36 من 51.8 وتسمية الناتج فجوة.
ما يمكن مقارنته بوضوح: بطاقات الأسعار، وحدود السياق والإخراج، وقوائم الوسائط، وتكلفة تشغيل مجموعة التقييم نفسها — لأن ذلك الرقم الأخير هو حساب لعمل متطابق، وليس درجة.
ما تقوله العدادات الخام

• سعر الإدخال — GPT-6.1 Sol 2.00 $ مقابل DeepSeek V4 Pro 0.66 $ لكل مليون توكن
• سعر الإخراج — GPT-6.1 Sol 10.00 دولار مقابل DeepSeek V4 Pro 1.98 دولار، ليتدرّج إلى 1.32 دولار و3.96 دولار ضمن نافذتين زمنيتين مدتهما أربع ساعات بتوقيت UTC في أيام الأسبوع
• قراءة الذاكرة المؤقتة — GPT-6.1 Sol $0.10 مقابل DeepSeek V4 Pro $0.022 لكل مليون رمز؛ كلاهما يستخدم التخزين المؤقت، والجانب الأرخص أرخص مرة أخرى بواقع 4.5×
• تكلفة كل مهمة فهرسة — GPT-6.1 Sol 0.72 دولار مقابل DeepSeek V4 Pro 0.67 دولار
• رموز الإخراج المُصدَرة على مجموعة اختبارات الفهرس — GPT-6.1 Sol 67M مقابل DeepSeek V4 Pro 160M
• الحد الأقصى للإخراج — DeepSeek V4 Pro 384,000 توكن مقابل GPT-6.1 Sol 128,000 توكن
• الوسائط — GPT-6.1 Sol يستقبل النصوص والصور والملفات؛ أما DeepSeek V4 Pro فيستقبل النصوص فقط
السطران الرابع والخامس هما الثنائي المثير للاهتمام. يُصدر DeepSeek V4 Pro رموزًا أكثر بمقدار 2.4 مرة على نفس المجموعة، ومع ذلك يكون أرخص بنسبة 7% لكل مهمة، لأن سعر إخراجه خُمس سعر GPT-6.1 Sol. هكذا يبدو النموذج المدفوع بالسعر عندما تقيس الإخراج بدلًا من السعر: الإسهاب حقيقي، وهو لا يمحو الميزة. النافذة الزمنية هي النجمة. فترتان مدة كل منهما أربع ساعات في أيام الأسبوع — 40 من أصل 168 ساعة في الأسبوع — تضاعفان السعر المعلن إلى 1.32 دولار و3.96 دولار، ويُطبَّق ذلك الرسم الإضافي على نفس الرموز التي كانت ستكون الأرخص على أي من البطاقتين.
ما لا يفعله الطراز الأرخص
ثلاثة أمور، وكل واحد منها حدّ صارم وليس مقايضة.
إنه لا يرى. DeepSeek V4 Pro نصّي الإدخال ونصّي الإخراج. لا لقطات شاشة، ولا ملفات PDF ممسوحة ضوئيًا، ولا قراءة رسوم بيانية، ولا قراءة مخططات داخل تذكرة. مهام استخدام الحاسوب وسير العمل المكثّف بالمستندات — وهي بالضبط أعباء العمل التي وُضِع GPT-6.1 Sol من أجلها — غير واردة بأي ثمن. إذا كان خط الأنابيب لديك يوجّه الصور بالفعل إلى نموذج رؤية، فهذه ليست مشكلة؛ وإن لم يكن يفعل ذلك، فهذا هو القيد الحاسم.
ليس له إيقاع إصدار يمكنك التخطيط حوله. لقد ظل الاسم "deepseek-v4-pro" يشير إلى بناء 0813 منذ أغسطس، ولم يكن الوصول إلى ذلك هادئًا: أعلن المورّد إحالة البناء إلى التقاعد في 14 سبتمبر، ثم سحب الإعلان قبل الموعد بيومين، وواصل تقديم الـAPI مع بقاء الفوترة دون تغيير. لا يزال دليلنا الخاص يدرجه كالطراز الرائد بالسياق نفسه، وسقف الإخراج نفسه، وحد التزامن نفسه. المورّد الذي يستطيع سحب إشعار إهلاك خلال يومين يستطيع أيضًا أن يمتنع عن ذلك؛ والخلاصة التشغيلية ليست أن النموذج غير مستقر، بل أن الاسم مجرد مؤشر، وأن تثبيت السلوك على معرّف بناء بدلًا من اسم مسار هو التأمين الرخيص.
إنه لا يحمل المعرفة المحيطة. GPT-6.1 Sol عمره ثمانية أيام، وقد نُشر له بالفعل إعداد مستقل واحد؛ أما DeepSeek V4 Pro فلديه تاريخ تقييم أطول وقاعدة ممارسين أكبر بكثير، تشمل حزمة تقديم منشورة وأعمال إنتاجية من جهات خارجية. بالنسبة لنشر مستضاف ذاتيًا، فإن هذه الكتلة من المواد تساوي أكثر من صف الفهرس، لأنها ما ترجع إليه عندما يتصرف النموذج بغرابة على عتادك وليس على مقارنة معيارية.
عندما يكون العدّاد الأرخص بأربع مرات هو العدّاد الخاطئ
إذا كان النموذج الرخيص أسوأ ببساطة في كل شيء، لكان هذا مقالًا قصيرًا. لكن الحقيقة المحرجة هي أن الفارق بينهما 7% لكل مهمة عند أداء العمل نفسه، و2.4× في مقدار ما يكتبانه للوصول إلى ذلك. وهذا يعني أن مقياس الرموز المدمجة — ذاك الذي يقول 4× — يقيس فرقًا لا تدفعه في الغالب، لأنه يسعّر مزيجًا من الرموز قد لا ترسله أبدًا. أما مقياس المؤشر، ذاك الذي يقول 16 نقطة، فإنه يقيس عبر مجموعتين نظيرتين ولا يمكن طرحه.
إذن، التقسيم العملي ليس «نموذج حدودي للأعمال الصعبة، ونموذج رخيص للأعمال السهلة». بل هو تقسيم حسب الوسائط وتقسيم حسب الحجم. أي شيء يحتوي على صورة يُوجَّه إلى GPT-6.1 Sol، وكذلك أي شيء تكون الإجابة فيه قصيرة والاستدلال هو الجزء المكلف — مستويات الجهد الخمسة فيه، من low إلى max مع medium كافتراضي، تتيح لك شراء الاستدلال دون شراء النص، كما أن الإدخال المخزَّن مؤقتًا بسعر $0.10 يجعل المطالبة الطويلة المكررة رخيصة. أي شيء نصي فقط، عالي الحجم، ويتحمّل إجابة أطول — التصنيف، والاستخراج، والتلخيص، والتوليد بالجملة مقابل ميزانية إخراج تبلغ 384,000 توكن — يُوجَّه إلى DeepSeek V4 Pro، والأفضل خارج النافذتين الزمنيتين بتوقيت UTC.
كلاهما على مفتاح واحد، والانقسام هو سطر إعدادات.
كلا الطرازين متاحان على OrcaRouter بأسعار مزوّديهما المنشورة نفسها، دون أي إضافة: GPT-6.1 Sol بسعر $2.00 / $10.00، ليرتفع إلى $4.00 / $15.00 فوق 272,000 رمز مطالبة، وDeepSeek V4 Pro بسعر $0.66 / $1.98 مع الإبقاء على النافذتين الزمنيتين كما هو مذكور. مفتاح واحد، وفاتورة واحدة، ونقطة نهاية واحدة متوافقة مع OpenAI لكليهما.
هذا هو السبب في أن التقسيم أعلاه يستحق التدوين بدلًا من الجدال حوله. يمكن التعبير عن تقسيم الوسائط كقاعدة توجيه، فتذهب الطلبات التي تحمل صورًا إلى نموذج الرؤية، ويذهب النص الأكبر حجمًا إلى النموذج الرخيص دون تغيير في التطبيق؛ وإذا تدهور مسار، تنقل آلية تجاوز الفشل الاستدعاء بدلًا من إفشاله. ولأن كليهما على نفس نقطة النهاية، فإن مقارنة السعر التي تهم فعلًا — مقارنتك أنت، على حركة مرورك، وبتوليفة التوكنات لديك — يمكن إنتاجها من فواتيرك الخاصة بدلًا من متوسط مجموعة معايير الأداء.


الحكم، في سطر واحد، هو أن القراءة الأرخص بأربع مرات هي التي يجب عدم الثقة بها، والقراءة البالغة سبعة بالمئة هي التي يجب التحقق منها. أربع مرات هو ما يقوله المقياس المدمج عن مزيج رموز قد لا ترسله. سبعة بالمئة هو ما كلفه التقييم نفسه على كليهما، ويأتي معه فرق إسهاب مقداره 2.4× مضمّن فيه. النقاط الست عشرة حقيقية، وهي أيضًا موزعة على مجموعتين من الأقران، والقيد الذي يقرر فعليًا معظم عمليات نشر هذا الزوج ليس رقمًا على الإطلاق: أحد هذين النموذجين يستطيع قراءة لقطة شاشة بينما الآخر لا يستطيع.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
