بطاقة رئيسية مُولَّدة لـ GPT-6.1 Sol مقابل DeepSeek V4 Pro بعنوان "ثلاثة مقاييس، ثلاث إجابات مختلفة"، مع ثلاث بطاقات مقاييس تقرأ "السعر المُدمج ×4"، و"التكلفة لكل مهمة على المؤشر ×1.07"، و"مؤشر الذكاء 16 نقطة"، وسطر يقرأ "أحدهما مملوك ويرى الصور. والآخر أوزان مفتوحة برخصة MIT ونصّي فقط."، وتذييل يقرأ "الأسعار وفق OpenAI وDeepSeek؛ أما أرقام المؤشر والتكلفة لكل مهمة فوفق Artificial Analysis، التي تقارن النماذج مفتوحة الأوزان بالنماذج المملوكة ضمن مجموعات نظير مختلفة."، وشعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

GPT-6.1 Sol مقابل DeepSeek V4 Pro: ثلاثة مقاييس، ثلاث إجابات مختلفة

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

اسأل عن مدى تباعد GPT-6.1 Sol وDeepSeek V4 Pro، والجواب الصادق هو أنه يعتمد على أي مقياس تقرأ، والمقاييس الثلاثة تختلف فيما بينها أكثر مما تختلف معظم مقارنات النماذج حول كل شيء. من حيث السعر لكل مليون رمز، ممزوجًا بنسبة 3:1 بين المدخلات والمخرجات، هما 4.00 دولارات مقابل 0.99 دولار — أي بمعامل أربعة. ومن حيث التكلفة الفعلية لتشغيل مجموعة التقييم نفسها، هما 0.72 دولار مقابل 0.67 دولار لكل مهمة — سبعة بالمئة. وعلى مؤشر الذكاء Artificial Analysis Intelligence Index هما 51.8 مقابل 36 — ستة عشر نقطة، وهو ما يبدو حاسمًا حتى تنظر إلى مَن قُورن به كل رقم، لأن منهجية ذلك المُقيِّم نفسه تضع النموذجين في مستويين مختلفين. أُطلق GPT-6.1 Sol في 29 سبتمبر 2026 بسعر 2.00 دولار للمدخلات و10.00 دولارات للمخرجات مع نافذة رموز تبلغ 1,050,000 رمز. وDeepSeek V4 Pro نموذج رائد مرخّص بموجب MIT من نوع خليط الخبراء، بـ1.6 تريليون معامل منها 49 مليارًا نشطة، أُطلق في 13 أغسطس 2026 بسعر 0.66 دولار و1.98 دولار مع نافذة رموز تبلغ 1,048,576 رمزًا. أحدهما نموذج نصي يمكنك تنزيله. والآخر يرى الصور. وتحديد أيّ من المقاييس الثلاثة ينبغي أن تسترشد به فعليًا هو المهمة بأكملها.

صف الفهرس ليس المقارنة التي يبدو عليها

ابدأ بالرقم الذي يُقتبس أكثر من غيره، لأنه أكثر ما يُقتبس على نحو خاطئ.

تنشر Artificial Analysis منهجيتها إلى جانب لوحة الصدارة الخاصة بها، وهناك جملتان فيها تهمّان هنا. تقول إن النماذج مفتوحة الأوزان تُقارن فقط بنماذج أخرى مفتوحة الأوزان من نفس فئة الحجم — صغيرة جدًا، صغيرة، متوسطة، كبيرة، مع الحد الفاصل عند 150 مليار معامل. أما النماذج المملوكة فتُقارن عبر نطاق سعري بدلاً من ذلك، بنسبة مدمجة 3:1 بين المدخلات والمخرجات. هاتان مجموعتان مختلفتان من النظراء. إن DeepSeek V4 Pro 0813 مفتوح الأوزان — تقول الأسئلة الشائعة الخاصة بالمقيّم ذلك، وتشير إلى الأوزان المنشورة — وهو بإجمالي 1.6 تريليون معامل يقع في فئة الحجم الكبيرة للنماذج مفتوحة الأوزان. أما GPT-6.1 Sol فهو مملوك ويُقيَّم مقابل نماذج في نطاقه السعري الخاص.

إن وجود 51.8 و36 في صفين متجاورين من الجدول نفسه ليس مواجهة مباشرة. فهما نتيجتان مقابل مجموعتين مختلفتين من الأقران، ولهذا السبب تحديدًا تكون أرقام التكلفة لكل مهمة قابلة للمقارنة بينما أرقام المؤشر الخام ليست كذلك. إذا أردت معرفة ما إذا كان DeepSeek V4 Pro جيدًا لنموذج قابل للتنزيل، فإن 36 هو الرقم الذي يجيب عن ذلك. وإذا أردت معرفة أدائه مقابل نموذج حدودي مُستضاف، فلن يخبرك عمود المؤشر بذلك، وهذه حالة يكون فيها التصرف الصادق هو قول ذلك بدلًا من طرح 36 من 51.8 وتسمية الناتج فجوة.

ما يمكن مقارنته بوضوح: بطاقات الأسعار، وحدود السياق والإخراج، وقوائم الوسائط، وتكلفة تشغيل مجموعة التقييم نفسها — لأن ذلك الرقم الأخير هو حساب لعمل متطابق، وليس درجة.

ما تقوله العدادات الخام

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, credited to DeepSeek and dated 2026-04-24, showing the model identifier, text-only input with tools, JSON and reasoning, a 1M-token context window with a 384K maximum output, and a rate row reading $0.66 input and $1.98 output per million tokens alongside a 1.92-second median latency and a 1030.7M seven-day traffic figure.

• سعر الإدخال — GPT-6.1 Sol ‏2.00 $ مقابل DeepSeek V4 Pro ‏0.66 $ لكل مليون توكن

• سعر الإخراج — GPT-6.1 Sol ‏10.00 دولار مقابل DeepSeek V4 Pro ‏1.98 دولار، ليتدرّج إلى 1.32 دولار و3.96 دولار ضمن نافذتين زمنيتين مدتهما أربع ساعات بتوقيت UTC في أيام الأسبوع

• قراءة الذاكرة المؤقتة — GPT-6.1 Sol $0.10 مقابل DeepSeek V4 Pro $0.022 لكل مليون رمز؛ كلاهما يستخدم التخزين المؤقت، والجانب الأرخص أرخص مرة أخرى بواقع 4.5×

• تكلفة كل مهمة فهرسة — GPT-6.1 Sol ‏0.72 دولار مقابل DeepSeek V4 Pro ‏0.67 دولار

• رموز الإخراج المُصدَرة على مجموعة اختبارات الفهرس — GPT-6.1 Sol 67M مقابل DeepSeek V4 Pro 160M

• الحد الأقصى للإخراج — DeepSeek V4 Pro 384,000 توكن مقابل GPT-6.1 Sol 128,000 توكن

• الوسائط — GPT-6.1 Sol يستقبل النصوص والصور والملفات؛ أما DeepSeek V4 Pro فيستقبل النصوص فقط

السطران الرابع والخامس هما الثنائي المثير للاهتمام. يُصدر DeepSeek V4 Pro رموزًا أكثر بمقدار 2.4 مرة على نفس المجموعة، ومع ذلك يكون أرخص بنسبة 7% لكل مهمة، لأن سعر إخراجه خُمس سعر GPT-6.1 Sol. هكذا يبدو النموذج المدفوع بالسعر عندما تقيس الإخراج بدلًا من السعر: الإسهاب حقيقي، وهو لا يمحو الميزة. النافذة الزمنية هي النجمة. فترتان مدة كل منهما أربع ساعات في أيام الأسبوع — 40 من أصل 168 ساعة في الأسبوع — تضاعفان السعر المعلن إلى 1.32 دولار و3.96 دولار، ويُطبَّق ذلك الرسم الإضافي على نفس الرموز التي كانت ستكون الأرخص على أي من البطاقتين.

ما لا يفعله الطراز الأرخص

ثلاثة أمور، وكل واحد منها حدّ صارم وليس مقايضة.

إنه لا يرى. DeepSeek V4 Pro نصّي الإدخال ونصّي الإخراج. لا لقطات شاشة، ولا ملفات PDF ممسوحة ضوئيًا، ولا قراءة رسوم بيانية، ولا قراءة مخططات داخل تذكرة. مهام استخدام الحاسوب وسير العمل المكثّف بالمستندات — وهي بالضبط أعباء العمل التي وُضِع GPT-6.1 Sol من أجلها — غير واردة بأي ثمن. إذا كان خط الأنابيب لديك يوجّه الصور بالفعل إلى نموذج رؤية، فهذه ليست مشكلة؛ وإن لم يكن يفعل ذلك، فهذا هو القيد الحاسم.

ليس له إيقاع إصدار يمكنك التخطيط حوله. لقد ظل الاسم "deepseek-v4-pro" يشير إلى بناء 0813 منذ أغسطس، ولم يكن الوصول إلى ذلك هادئًا: أعلن المورّد إحالة البناء إلى التقاعد في 14 سبتمبر، ثم سحب الإعلان قبل الموعد بيومين، وواصل تقديم الـAPI مع بقاء الفوترة دون تغيير. لا يزال دليلنا الخاص يدرجه كالطراز الرائد بالسياق نفسه، وسقف الإخراج نفسه، وحد التزامن نفسه. المورّد الذي يستطيع سحب إشعار إهلاك خلال يومين يستطيع أيضًا أن يمتنع عن ذلك؛ والخلاصة التشغيلية ليست أن النموذج غير مستقر، بل أن الاسم مجرد مؤشر، وأن تثبيت السلوك على معرّف بناء بدلًا من اسم مسار هو التأمين الرخيص.

إنه لا يحمل المعرفة المحيطة. GPT-6.1 Sol عمره ثمانية أيام، وقد نُشر له بالفعل إعداد مستقل واحد؛ أما DeepSeek V4 Pro فلديه تاريخ تقييم أطول وقاعدة ممارسين أكبر بكثير، تشمل حزمة تقديم منشورة وأعمال إنتاجية من جهات خارجية. بالنسبة لنشر مستضاف ذاتيًا، فإن هذه الكتلة من المواد تساوي أكثر من صف الفهرس، لأنها ما ترجع إليه عندما يتصرف النموذج بغرابة على عتادك وليس على مقارنة معيارية.

عندما يكون العدّاد الأرخص بأربع مرات هو العدّاد الخاطئ

إذا كان النموذج الرخيص أسوأ ببساطة في كل شيء، لكان هذا مقالًا قصيرًا. لكن الحقيقة المحرجة هي أن الفارق بينهما 7% لكل مهمة عند أداء العمل نفسه، و2.4× في مقدار ما يكتبانه للوصول إلى ذلك. وهذا يعني أن مقياس الرموز المدمجة — ذاك الذي يقول 4× — يقيس فرقًا لا تدفعه في الغالب، لأنه يسعّر مزيجًا من الرموز قد لا ترسله أبدًا. أما مقياس المؤشر، ذاك الذي يقول 16 نقطة، فإنه يقيس عبر مجموعتين نظيرتين ولا يمكن طرحه.

إذن، التقسيم العملي ليس «نموذج حدودي للأعمال الصعبة، ونموذج رخيص للأعمال السهلة». بل هو تقسيم حسب الوسائط وتقسيم حسب الحجم. أي شيء يحتوي على صورة يُوجَّه إلى GPT-6.1 Sol، وكذلك أي شيء تكون الإجابة فيه قصيرة والاستدلال هو الجزء المكلف — مستويات الجهد الخمسة فيه، من low إلى max مع medium كافتراضي، تتيح لك شراء الاستدلال دون شراء النص، كما أن الإدخال المخزَّن مؤقتًا بسعر $0.10 يجعل المطالبة الطويلة المكررة رخيصة. أي شيء نصي فقط، عالي الحجم، ويتحمّل إجابة أطول — التصنيف، والاستخراج، والتلخيص، والتوليد بالجملة مقابل ميزانية إخراج تبلغ 384,000 توكن — يُوجَّه إلى DeepSeek V4 Pro، والأفضل خارج النافذتين الزمنيتين بتوقيت UTC.

كلاهما على مفتاح واحد، والانقسام هو سطر إعدادات.

كلا الطرازين متاحان على OrcaRouter بأسعار مزوّديهما المنشورة نفسها، دون أي إضافة: GPT-6.1 Sol بسعر $2.00 / $10.00، ليرتفع إلى $4.00 / $15.00 فوق 272,000 رمز مطالبة، وDeepSeek V4 Pro بسعر $0.66 / $1.98 مع الإبقاء على النافذتين الزمنيتين كما هو مذكور. مفتاح واحد، وفاتورة واحدة، ونقطة نهاية واحدة متوافقة مع OpenAI لكليهما.

هذا هو السبب في أن التقسيم أعلاه يستحق التدوين بدلًا من الجدال حوله. يمكن التعبير عن تقسيم الوسائط كقاعدة توجيه، فتذهب الطلبات التي تحمل صورًا إلى نموذج الرؤية، ويذهب النص الأكبر حجمًا إلى النموذج الرخيص دون تغيير في التطبيق؛ وإذا تدهور مسار، تنقل آلية تجاوز الفشل الاستدعاء بدلًا من إفشاله. ولأن كليهما على نفس نقطة النهاية، فإن مقارنة السعر التي تهم فعلًا — مقارنتك أنت، على حركة مرورك، وبتوليفة التوكنات لديك — يمكن إنتاجها من فواتيرك الخاصة بدلًا من متوسط مجموعة معايير الأداء.

A screenshot of OpenAI's developer model page for GPT-6.1 Sol, headed 'GPT-6.1 Sol' with the tagline 'Near-Astra performance for complex work at a lower cost', showing a 1,050,000-token context window, 128,000 max output tokens, an Apr 30, 2026 knowledge cutoff, a price row reading $2 input and $10 output per million tokens, and the note that reasoning.effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.A generated scoreboard titled 'GPT-6.1 Sol vs DeepSeek V4 Pro — the scoreboard' showing two columns on six shared rows: input price $2.00 against $0.66 per million tokens; output price $10.00 against $1.98; cache read $0.10 against $0.022; cost per index task $0.72 against $0.67; maximum output 128,000 against 384,000 tokens; modalities text, image and file against text only. A footer reads 'Prices per OpenAI and DeepSeek as listed on OrcaRouter; cost-per-task figures per Artificial Analysis, whose index compares open-weights and proprietary models in different peer groups.'

الحكم، في سطر واحد، هو أن القراءة الأرخص بأربع مرات هي التي يجب عدم الثقة بها، والقراءة البالغة سبعة بالمئة هي التي يجب التحقق منها. أربع مرات هو ما يقوله المقياس المدمج عن مزيج رموز قد لا ترسله. سبعة بالمئة هو ما كلفه التقييم نفسه على كليهما، ويأتي معه فرق إسهاب مقداره 2.4× مضمّن فيه. النقاط الست عشرة حقيقية، وهي أيضًا موزعة على مجموعتين من الأقران، والقيد الذي يقرر فعليًا معظم عمليات نشر هذا الزوج ليس رقمًا على الإطلاق: أحد هذين النموذجين يستطيع قراءة لقطة شاشة بينما الآخر لا يستطيع.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا