
كلود سونيت 5.5 مقابل ديب سيك V4 برو: 20 نقطة مؤشر، وقراءة ذاكرة تخزين مؤقت بسعر 0.022 دولار
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 984 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 195 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
ضع بطاقتي الأسعار جنبًا إلى جنب، وتبدو المقارنة محسومة قبل أن تبدأ. Claude Sonnet 5.5، المتاح عمومًا منذ 28 سبتمبر 2026، تبلغ تكلفته 2.00 دولار لكل مليون توكن إدخال و10.00 دولارات لكل مليون توكن إخراج. DeepSeek V4 Pro، الذي صدر في 24 أبريل 2026، تبلغ تكلفته 0.66 دولار و1.98 دولار. الإخراج هو البند الذي يهم في عمل الوكلاء، و10.00 دولارات مقابل 1.98 دولار فجوة خمسة إلى واحد — دولار مقابل عشرين سنتًا لكل مئة ألف توكن. ثم انظر إلى جانب القدرات، حيث تضع Artificial Analysis كلاً من Claude Sonnet 5.5 عند 56 على Intelligence Index v4.3 وDeepSeek V4 Pro عند 36، فجوة قدرها عشرون نقطة على نفس أداة القياس. هذا هو جوهر التوتر: نموذج DeepSeek يقع عند خُمس سعر الإخراج ونحو ثلثي القدرة المقيسة، ولا تتحول الحقيقتان إلى توصية واحدة دون معرفة ما يفعله عبء العمل لديك فعليًا بالتوكن.
ما هو كل نموذج، على وجه الدقة
التسمية هي أول موضع يخطئ فيه هذا المقارنة، لذا صحّحها هنا. إنّ DeepSeek V4 Pro كما نُدرجه هو deepseek/deepseek-v4-pro، وصدر في 24 أبريل 2026، وهو نموذج بسياق 1,048,576 رمزًا وحدّ أقصى للمخرجات يبلغ 384,000 رمز، ومدخلات نصية فقط. وتتتبّع Artificial Analysis نسخةً تُسمّيها DeepSeek V4 Pro 0813 — إصدار 13 أغسطس — والأرقام المذكورة أدناه مأخوذة من ذلك الصف. أما جانب Sonnet فهو anthropic/claude-sonnet-5.5 من Anthropic، بمدخلات نصية وصورية وملفات، وسياق 1M، وحدّ أقصى للمخرجات 128K. إذا كنت تقارن صفحة مورّد بصفحة مُقيِّم ولم تتطابق الأرقام، فتحقّق من لاحقة الإصدار قبل أن تستنتج أن أحدهما مخطئ.
يدعم DeepSeek V4 Pro إدخال النصوص فقط. بينما يستقبل Claude Sonnet 5.5 الصور والملفات أيضًا. هذا هو أول فرق جوهري في البنية، وهو ليس فرقًا هامشيًا: فأي منظومة معالجة تستقبل لقطات الشاشة أو ملفات PDF أو المخططات لا يمكنها ببساطة استبدال أحدهما بالآخر، لأن أحدهما لا يستطيع الرؤية.
بطاقة الأسعار، سطرًا بسطر
• المدخلات — 0.66 دولار لكل مليون لـ DeepSeek V4 Pro مقابل 2.00 دولار لـ Claude Sonnet 5.5؛ DeepSeek أرخص بنسبة 67%
• الإخراج — 1.98 دولار لكل مليون مقابل 10.00 دولارات؛ DeepSeek أرخص بنسبة 80%، وهي أوسع فجوة فردية في هذه المقارنة
• قراءة ذاكرة التخزين المؤقت — 0.022 دولار لكل مليون مقابل 0.20 دولار؛ DeepSeek أرخص بنسبة 89% في البند الذي يهيمن على حلقات الوكيل الطويلة
• كتابة ذاكرة التخزين المؤقت — $2.50 لكل مليون للنافذة البالغة خمس دقائق على Claude Sonnet 5.5؛ لا يتضمن صف الكتالوج الخاص بـ DeepSeek V4 Pro أي سطر منفصل لكتابة ذاكرة التخزين المؤقت
• السياق — 1,048,576 توكنًا مقابل 1,000,000؛ DeepSeek أطول بشكل هامشي، وهو فرق لا تترتب عليه أي نتيجة عملية
• الحد الأقصى للإخراج — 384,000 توكن مقابل 128,000؛ يتفوق DeepSeek بثلاثة أضعاف على السقف الذي يقيّد التوليد الضخم
• طريقة الإدخال — نص فقط مقابل النص والصورة والملف
• الاستدلال — يستخدم كلاهما جهد استدلال قابلاً للضبط بدلاً من ميزانية تفكير ثابتة، لذا فإن العمق معامل في الطلب في كل منهما
هناك تفصيل جدولة على جانب DeepSeek ستُخفيه مقارنة بطاقة الأسعار. يحمل صف الكتالوج لدينا نافذة تسعير زمنية: بين 01:00 و04:00 UTC، ومرة أخرى بين 06:00 و10:00 UTC، تُضرب الأسعار المدرجة في اثنين. في تلك الساعات، تكلفة V4 Pro هي 1.32 دولارًا للإدخال و3.96 دولارًا للإخراج — ولا يزال أرخص من Claude Sonnet 5.5 بنسبة 34% و60% على التوالي، لكن ليس بالهوامش التي توحي بها الأرقام الرئيسية. أحمال العمل الدفعية التي يمكن جدولتها تستحق الجدولة، والأحمال التي لا يمكن جدولتها تستحق التسعير بسعر الذروة بدلًا من المتوسط. وهذا أيضًا من النوع الذي لا يظهر إلا إذا قرأت الكتالوج بدلًا من صفحة التسويق، وهي الحجة لوضع كل نموذج مرشح خلف نقطة نهاية واحدة بدلًا من ثلاثة حسابات بائعين.
رقمان للقدرة، أحدهما ليس مستقلاً
على جانب الطرف الثالث، الترتيب لا لبس فيه. يمنح Artificial Analysis كلاً من Claude Sonnet 5.5 درجة 56 وDeepSeek V4 Pro درجة 36 على Intelligence Index v4.3، وكلاهما في وضع استدلال بأقصى جهد. ويضع المقيّم نفسه Claude Opus 5 عند 51 وGemini 3.1 Pro Preview عند 30، لذا فإن 36 التي حصل عليها V4 Pro تضعه دون الطراز الرائد السابق من Anthropic وفوق فئة Pro من Google — موقع محترم لنموذج بسعر يعادل خُمس السعر، وعلى مسافة بعيدة من القمة.
يظهر انعكاس التكلفة لكل مهمة هنا أيضًا، وفي هذه المواجهة يأخذ الاتجاه المعاكس لما حدث في المواجهة السابقة. تبلغ تكلفة تقييم DeepSeek V4 Pro على مجموعة المؤشر 0.67 دولار. بينما تبلغ تكلفة Claude Sonnet 5.5 7.60 دولار. هذا ليس خطأ مطبعيًا ولا ناتجًا عن تقريب: فالنموذج الأحدث من Anthropic يُصدر 410 ملايين توكن عبر المجموعة مقابل وسيط يبلغ 88 مليونًا، ولا يقترب إسهاب نموذج DeepSeek من سد فجوة سعرية بهذا الحجم. وفي المهام المفتوحة النهاية غير المقيّدة، يكون النموذج الأرخص أرخص بمرتبة قدرية في الممارسة العملية، وليس على قائمة الأسعار فحسب.
تحتاج أرقام الموردين إلى معالجة بمزيد من العناية. تنشر DeepSeek رقمًا مقداره 96.2 في τ²-Bench من أجل V4 Pro، وهو رقم قوي، لكنه مُبلَّغ عنه من المورّد، وقد أُزيل τ²-Bench منذ ذلك الحين من مؤشر Artificial Analysis في مراجعته v4.3 — لذا فهو رقم لا يمكن وضعه بشكل مستقل على المقياس نفسه الذي تنشره Anthropic لأي شيء. كما يحمل جدول الإطلاق الخاص بـ Anthropic لـ Claude Sonnet 5.5 تحفظاته الخاصة، بما في ذلك حاشية مفادها أن إعداد الجهد Max يسجّل أقل من Xhigh على FrontierCode، وملاحظة أن اثنين من المعايير أُجريا على نشر ما قبل الإصدار مع خلل في المخرجات المهيكلة. ضع جدولي الموردين جنبًا إلى جنب فلن تحصل إلا على وثيقتين تسويقيتين، لا على تصنيف. الأرقام الوحيدة في هذا المقال التي تنتمي إلى محور واحد هي درجتا المؤشر، والتكلفتان لكل مهمة، لأن مُقيّمًا واحدًا أنتج الأربعة جميعًا.
لماذا يُعد سقف الإنتاج أهم من السعر
الرقم الذي يحظى بأقل اهتمام في هذه المقارنة هو الذي يغيّر البنية المعمارية: 384,000 رمز إخراج مقابل 128,000.
سقف الإخراج ليس ميزة راحة. إنه يحدد ما إذا كانت المهمة استدعاءً واحدًا أم سلسلة. توليد ملف مصدر كبير، أو إصدار مستند كامل، أو إنتاج تقرير منظَّم طويل، أو ترجمة فصل من كتاب — أي شيء يكون فيه الناتج أكبر من 128,000 رمز — لا يمكن إنجازه في استدعاء واحد إلى Claude Sonnet 5.5، ويجب تفكيكه إلى تسلسل تُنقل الحالة فيه بين الاستدعاءات. يعني التفكيك إعادة إرسال مزيد من رموز الإدخال في كل خطوة، وقراءات ذاكرة مؤقتة أكثر، وكود تنسيق أكثر، وفئة جديدة من الأعطال حيث تكون الوصلات بين الأجزاء هي موضع الأخطاء. وقد يكون نموذج بسعر خمسة أضعاف يزيل طبقة تنسيق كاملة أرخص من حيث ساعات الهندسة قبل أن يكون أرخص من حيث الرموز، وفي الاتجاه المعاكس، المهمة التي تتسع في استدعاء واحد هي مهمة لا يدخل فيها السقف في الحساب إطلاقًا.
إذن، مسألة السقف تأتي قبل مسألة السعر. إذا كان أطول أثر لديك يتسع ضمن 128,000 توكن، فتجاهل هذا القسم وقارن على أساس التكلفة لكل مهمة منتهية. وإذا لم يكن كذلك، فسعّر خط الأنابيب الذي سيتعين عليك بناؤه، وليس التوكنات فقط.
تكلفة التحول ومشكلة الاحتياطي
الترحيل في أي من الاتجاهين يتعلق في معظمه بصياغة المطالبات أكثر من الكود، مع استثناء واحد يستحق تخصيص ميزانية له.
كلا النموذجين يضبطان الاستدلال من خلال معامل جهد، لكنهما معاملان من بائعين مختلفين، بمستويات مختلفة وإعدادات افتراضية مختلفة. لا ينتقل الموجّه المضبوط على إعداد جهد عالٍ من Anthropic إلى إعداد جهد DeepSeek كاستبدال متماثل؛ بل ينتقل كإعادة قياس. توقّع أن تقضي يومًا لكل عبء عمل لإعادة تأسيس الجودة قبل أن تثق في توقع التكلفة، على أي من جانبي الانتقال.
الاستثناء هو الرؤية. يقرأ Claude Sonnet 5.5 الصور والملفات؛ بينما يقرأ DeepSeek V4 Pro النص فقط. أي جزء من خط المعالجة لديكم يمرّر إلى نموذج لقطة شاشة أو صفحة ممسوحة ضوئيًا أو مخططًا مُصيَّرًا ليس له مقابل في DeepSeek، لذا فإن الترحيل الكامل متاح فقط للجزء ذي الشكل النصي من حركة المرور لديكم. هذا خط فاصل ينبغي رسمه مبكرًا، لأنه عادةً ما يعني أن الإجابة ليست نموذجًا واحدًا بل انقسامًا.
كلاهما قابل للتوجيه على OrcaRouter اليوم — deepseek/deepseek-v4-pro وanthropic/claude-sonnet-5كلاهما مُدرَج في الكتالوج الحي، بسعر قائمة المزوّد مع هامش ربح 0%، باستخدام بيانات اعتماد واحدة. وهذا يهم أكثر في هذا النوع من المقارنات تحديدًا، حيث لا يكون العامل الحاسم هو أي نموذج أفضل في المجرد، بل إلى أي نموذج ينبغي أن يذهب طلب معيّن. إن التقسيم الذي يرسل الأعمال النصية الضخمة إلى النموذج الرخيص وأعمال الرؤية إلى النموذج المكلف هو قاعدة توجيه، وهيأسهل بكثير في التعبير عندما يستجيب كلا الطرفين للمفتاح نفسه وسياسة تجاوز الفشل نفسها. Claude Sonnet 5.5 نفسه ليس بعد مسارًا على منصتنا، لذا فإن نسخة اليوم من ذلك التقسيم تقرننموذج Anthropic مع DeepSeek V4 Pro بدلًا من أن تحل محله.
القرار، بصياغة قاعدة
أرسله إلى Claude Sonnet 5.5 عندما تحتاج المهمة إلى الرؤية — الصور، وملفات PDF، ولقطات الشاشة، والمخرجات المعروضة — أو عندما يكون المُخرَج أطول من صفحة من النثر وتريد أن يكتبه نموذج طليعي، أو عندما تكون فجوة عشرين نقطة في المؤشر هي الفرق بين مسودة يتعيّن على الإنسان إعادة كتابتها وأخرى يستطيع تسليمها.
أرسله إلى DeepSeek V4 Pro عندما يكون عبء العمل نصًا داخلًا ونصًا خارجًا، وبحجم كبير، ويتسامح مع سقف أقل لجودة الاستدلال: التصنيف، والاستخلاص، والتلخيص، وإعادة الصياغة بالجملة، وتحويل الشيفرة وفق مواصفة واضحة، وأي شيء كنت ستدفع فيه عشرة دولارات لكل مليون رمز مخرَج لمجرد نقل الكلمات من مكان إلى آخر. خصم قراءة ذاكرة التخزين المؤقت بنسبة 89% يجعل المهام ذات السياق الطويل على هذا النموذج رخيصة بنيويًا بطريقة لا يضاهيها أي شيء آخر في المقارنة.
الحكم الصادق: هذه ليست سباق قدرات يخسره DeepSeek، بل هي قرار تخصيص موارد تخطئ فيه معظم الفرق في اتجاه شراء قدرات لا تستخدمها. إذا كانت حركة البيانات لديك نصية وكان معيار جودتك هو "جيد بما يكفي للمراجعة" وليس "جيد بما يكفي للشحن دون قراءة"، فإن V4 Pro بسعر 20% من سعر الإخراج وقراءات ذاكرة مؤقتة بـ 0.022 دولار هو الخيار الافتراضي الصحيح، ونقاط المؤشر العشرون هي ضريبة تدفعها طوعًا حاليًا.



مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
