
Claude Opus 5.5 مقابل Claude Opus 5: مستويات الجهد لا تعني الشيء نفسه
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
أول ما ينبغي معرفته قبل مقارنة Claude Opus 5.5بـClaude Opus 5هو أن النموذجين لا يتشاركان مقياس الجهد نفسه، وأن كل مقارنة مباشرة تقريبًا ستقرأها هذا الأسبوع تتجاهل ذلك. فالقيمة الافتراضية لـ Opus 5 هي مرتفع من الجهد. أما القيمة الافتراضية لـ Opus 5.5 فهي متوسط، وعند المستوى نفسه بالاسم فإنه يفكّر أكثر في كل دور مما كان يفعل سلفه. لذا فإن "Opus 5.5 عند الإعداد الافتراضي مقابل Opus 5 عند الإعداد الافتراضي" ليس تجربة مضبوطة — بل مقارنة بين مقدارين مختلفين من التفكير. وتقول الشركة المورّدة ذلك صراحةً في دليل الترحيل الخاص بها: اختبر عدة مستويات للجهد، ولا تُعِد استخدام إعدادات Opus 5، لأن المستويات التي تحمل الأسماء نفسها لا تقابل الميزانية نفسها من التفكير. وبمجرد أن تتحكم في ذلك، تضيق الفجوة بين النموذجين في بعض المواضع وتتسع في أخرى، ويتوقف قرار الترقية على شيء آخر غير القدرة الخام — التكلفة لكل مهمة مكتملة، وأربعة تغييرات في الـ API ستُعطّل شيفرة تعمل اليوم على Opus 5.
ما الذي يختلف فعليًا، مواصفةً بمواصفة

الموديلان أقرب على الورق مما توحي به أرقام الإصدارات:
• السعر — Claude Opus 5.5 بسعر 4.00 دولار للإدخال / 20.00 دولارًا للإخراج لكل مليون توكن، مقابل Claude Opus 5 بسعر 5.00 / 25.00
• قراءة الذاكرة المؤقتة — 0.20 دولار لكل مليون مقابل 0.50 دولار لكل مليون، خفض بنسبة 60% على بند التكلفة الذي يهيمن على عمليات التشغيل الوكيلية
• كتابة الذاكرة المؤقتة — 5 دولارات لكل مليون لنافذة الـ5 دقائق، و8 دولارات لنافذة الساعة الواحدة على 5.5، مقابل 6.25 دولار على Opus 5
• السياق والإخراج — مليون رمز من السياق و128 ألفًا من الإخراج على كليهما؛ ويصل كلاهما إلى 300 ألف من الإخراج على Batch API خلف output-300k-2026-03-24 ترويسة تجريبية
• الجهد الافتراضي — متوسط على Opus 5.5 مقابل مرتفع على Opus 5
• التفكير — تكيّفي ومفعّل دائمًا في كليهما، لكن على Opus 5.5 لم يعد من الممكن تعطيله إطلاقًا
• تاريخ قطع المعرفة — يونيو 2026 مقابل مايو 2026
• زمن الاستجابة — تُصنّف Anthropic طراز Opus 5.5 بأنه "متوسط" مقابل التشكيلة الحالية، وتقول إنه يولّد المخرجات أسرع بنسبة تتجاوز 30% من Opus 5
• التقاعد — ليس قبل 22 سبتمبر 2027 لـ Opus 5.5، وليس قبل 24 يوليو 2027 لـ Opus 5
لاحظ ما ليس مختلفًا: نافذة السياق، وسقف الإخراج، وخصم الدفعات، ونموذج التفكير التكيفي الدائم التشغيل. Opus 5.5 ليس نموذجًا بسياق أكبر أو إخراج أطول؛ بل نموذج أرخص وأسرع وأكثر كفاءة في استهلاك الرموز ضمن النطاق نفسه.
المقاييس المرجعية، وعلامة النجمة الخاصة بالجهد على كل واحد منها

هذه الأرقام من مواد إطلاق Anthropic — مُبلَّغ عنها من المورّد، وأُجريت على نماذجها الخاصة — وإعداد الجهد يهم هنا أكثر من اسم النموذج:
• Terminal-Bench 4.0 — 66.4% مقابل 52.3%، مع تشغيل Opus 5.5 بمستوى جهد xhigh بدلاً من الإعداد الافتراضي
• FrontierCode v1.1 (الرئيسي) — 54.4% مقابل 48.0%، و54.6% لـ Opus 5.5 عند الجهد المتوسط الافتراضي
• CursorBench 4.0 — 57.8% مقابل 46.6%، و52.5% عند المستوى المتوسط
• GDPval-AA v2.1 — 1846 إيلو مقابل 1708
• AutomationBench — 40.0% مقابل 26.9%
• Humanity's Last Exam، مع الأدوات — 67.7% مقابل 63.6%
• Terminal-Bench-Science 0.1 — 58.7% مقابل 29.0%، وهي أوسع فجوة في المجموعة
• OSWorld 2.0 — 81.8% جزئي مقابل 74.0%
• رسم المخططات، باستخدام الأدوات — 89.0% مقابل 83.4%
نتيجة FrontierCode هي الجديرة بالدراسة. يسجّل Opus 5.5 نسبة 54.4% عند xhigh و54.6% عند medium — وهما إحصائيًا الرقم نفسه، بجزء يسير من ميزانية التفكير. وأي تحسين أجرته Anthropic، فهو في ذلك المعيار لا يأتي من التفكير بجهد أكبر. أما CursorBench فيسير في الاتجاه المعاكس: 57.8% عند xhigh مقابل 52.5% عند medium، وهو فارق خمس نقاط يقول إن الجهد لا يزال يشتري دقة حقيقية في بعض المهام. العبرة ليست "استخدم medium" أو "استخدم xhigh"؛ بل إن مستوى الجهد الصحيح أصبح قياسًا خاصًا بكل عبء عمل، وأن العادة القديمة بترك Opus 5 على إعداده الافتراضي المرتفع لم تعد تخبرك بأي شيء عن النموذج الجديد.
تضيف Anthropic تحفظًا يستحق التكرار: عند هذا المستوى من القدرات، تُعد هوامش المعايير القياسية "دليلًا أقل موثوقية على الفروق الواقعية"، وتقول الشركة إن الفجوة الداخلية بينها وبين Claude Fable 5.1 أضيق مما توحي به الدرجات المنشورة. هذا مورّد يخبرك ألا تقرأ أكثر مما ينبغي في جدوله الخاص.
التكلفة لكل مهمة مكتملة هي المقارنة التي تحسم القرار.
سعر التوكن الواحد هو الوحدة الخاطئة لقياس الوكيل، وهذه المواجهة هي حيث يتضح ذلك. المثال العملي الذي قدمته أنثروبيك نفسها: تحليل اندماج استغرق Opus 5.5 مدة 63 دقيقة وكلف 50% أقل من المهمة ذاتها على Opus 5، التي استغرقت 93 دقيقة. وتفسّر بطاقة الأسعار جزءًا من ذلك — خفض بنسبة 20% على الإدخال والإخراج، و60% على قراءات الذاكرة المؤقتة — لكن ليس كل ذلك. أما الباقي فهو استخدام النموذج توكنات أقل وجولات أقل للوصول إلى النتيجة ذاتها. واقتباسات العملاء المنشورة مع الإطلاق تشير في الاتجاه نفسه: تُبلّغ Box عن ثلث التوكنات وإجابات أقل إسهابًا بنحو 40%، وKiro عن نحو نصف التوكنات مع استدعاءات أقل بنسبة 40%، وFactory عن توكنات إخراج أقل بنسبة 20–25%، وGitHub من بين الأقل في التوكنات والخطوات التي قاستها.
تلك بيانات عملاء ينشرها البائعون، وليست نتائج مدققة، وعبارة المجمل «أرخص بنحو 40% في أحمال العمل النموذجية» هي توصيف Anthropic لمتوسط عبر أحمال عمل اختارتها. النسخة الصادقة لتخطيطك الخاص هي: افترض أن خفض السعر المعلن بنسبة 20% حقيقي ويمكن الاعتماد عليه، وتعامل مع الـ20% الإضافية كفرضية يمكنك اختبارها في فترة ما بعد الظهر بتشغيل المهمة نفسها على كلا النموذجين وعدّ الرموز (tokens).
ملاحظة هيكلية واحدة حول سبب تحقيق خفض أسعار الذاكرة المؤقتة أثرًا يفوق حجمه. الوكيل الذي يعيد إرسال موجّه نظام طويل وشجرة ملفات في كل دور يدفع أسعار قراءة الذاكرة المؤقتة على الجزء الأكبر من مدخلاته، لا أسعار الإدخال الجديد. وإنزال ذلك من $0.50 إلى $0.20 لكل مليون يغيّر اقتصاديات الجلسات طويلة التشغيل أكثر بكثير مما يفعله السعر المعلن — وهو السبب في أن عبء عمل كان مجديًا بشكل هامشي على Opus 5 يمكن أن يصبح مجديًا بوضوح على Opus 5.5 دون أي تغيير في الموجّهات الخاصة بك.
التغييرات الأربعة الكاسرة، كقائمة تحقق للترحيل
أوبس 5.5 هو نموذج جديد، وليس أوبس 5 مُعاد تسميته، وتُدرج ملاحظات الترحيل الخاصة بـ Anthropic أربعة تغييرات من شأنها أن تُعطّل الشيفرة التي تعمل بالفعل في بيئة الإنتاج:
• لا يمكن تعطيل التفكير. أي مسار برمجي كان يوقف التفكير سيؤدي إلى خطأ أو يغيّر السلوك، ويُتحكَّم في العمق الآن فقط عبر المعامل effort.
• يؤدي الاستخدام القسري للأداة إلى ظهور خطأ. إنّ tool_choice الذي يفرض أداة مُسمّاة غير مدعوم.
• كتل التفكير مرتبطة بالنموذج الذي أنتجها وبالمحادثة، لذا لا يمكن إعادة تشغيلها عبر النماذج بالطريقة التي تفترضها بعض خطوط المعالجة.
• أداة استخدام الكمبيوتر السابقة computer_20251124 غير مقبولة على Claude API أو على Google Cloud.
هناك تغيير خامس لا يُفشل أي شيء، ولذلك فهو أكثر خطورة. النص الواقع بين استدعاءات الأدوات يُعاد الآن داخل كتل تفكير نصها فارغ عند إعداد العرض الافتراضي. إذا كان تطبيقك يبث ذلك النص إلى المستخدمين كتحديثات تقدّم، فسيصمت بين استدعاءات الأدوات حتى تضبط قيمة عرض تُعيد النص. تنجح كل الاختبارات؛ لكن الواجهة تتوقف فحسب عن السرد.
تنطبق الثلاثة الأولى أيضًا على Claude Fable 5.1، لذا فإن الفريق الذي انتقل بالفعل إلى هذا النموذج قد أنجز جزءًا من هذا العمل. أما الفريق الذي لا يزال يعمل على Opus 5 فلم يفعل ذلك.
متى يظل Opus 5 هو الخيار الصحيح
الترقية ليست تلقائية، وهناك أربعة أسباب حقيقية للبقاء:
• إمكانية التنبؤ بالتكلفة. إن Opus 5 نموذج سبق أن وثّقت خصائصه. فإذا كانت ميزانيتك مبنية على استهلاكه للرموز، فإن الانتقال إلى نموذج يفكّر بمقدار مختلف عند المستوى نفسه المسمّى من الجهد يُبطل صلاحية النموذج حتى تعيد القياس.
• التوافق. إذا كان أي جزء من حزمة التقنيات لديك يعتمد على تعطيل التفكير، أو إجبار استخدام أداة، أو أداة استخدام الحاسوب الأقدم، فإن الترحيل يُعد عملًا برمجيًا، وليس مجرد تبديل نصي.
• توجيه الضمانات. يأتي Opus 5.5 مزوّدًا بضمانات من فئة Fable 5.1، ما يعني أن معظم طلبات الأمن السيبراني تُعاد توجيهها إلى Claude Opus 4.8، وأن الأعمال البيولوجية تُحوَّل احتياطيًا إلى Claude Opus 5 ما لم يكن حسابك موثّقًا. إذا كان منتجك ضمن أي من هذين المجالين، فقد تعني "الترقية" أن يحصل مستخدموك على إجابات من نموذج أصغر. لا يمتلك Opus 5 ذلك التوجيه.
• طول العمر. لن يختفي Opus 5 قريبًا — إذ تحدّد Anthropic موعد إيقافه في موعد لا يسبق 24 يوليو 2027، أي بعد عشرة أشهر من الآن.
بالنسبة لجميع الآخرين، الحساب واضح ومباشر: إمكانات أكبر، سعر أقل، رموز أقل، وقائمة تحقق للترحيل يمكن لمهندس واحد إنجازها في يوم واحد.
تشغيل كليهما أثناء التبديل

الجزء الصعب في أي ترحيل رئيسي هو المنتصف: تريد Opus 5.5 على حركة مرور جديدة دون المخاطرة بمسار الإنتاج على نموذج لم تُجرِ توصيفه وفق إعدادات الجهد الخاصة بك، وتريد إبقاء Opus 5 في الخدمة بينما تكتشف الأمر. هذه مشكلة توجيه وليست مشكلة إعادة بناء منصة، ويجدر بنا أن نكون دقيقين بشأن ما يقع أين. Claude Opus 5 متاح على OrcaRouter اليوم بسعر القائمة الخاص بـ Anthropic نفسه مع هامش 0% — سعر القائمة للمزوّد يُمرَّر مباشرةً، لذا يصبح تغيير سعر المورّد ساريًا من جانبنا في اليوم نفسه بدلًا من بعد مزامنة. Claude Opus 5.5 ليس أحد مساراتنا بعد؛ إنه متاح عبر API الخاصة بـ Anthropic والسحابات الكبرى. عندما يصل سيصبح مسارًا إضافيًا على المفتاح نفسه بدلًا من عقد ثانٍ وSDK ثانٍ، وهذا ما يتيح لك وضع نسبة مئوية من حركة المرور على النموذج الجديد بينما التجاوز التلقائي عند الفشل يبقي الباقي على النموذج الذي قمت بتوصيفه بالفعل. تركيب استدعاء عبر كليهما — مسودة من أحدهما وتمريرة تحقق من الآخر — هو سطر من routing-DSL.
كن دقيقًا بشأن ما يمنحك إياه ذلك. فهو لا يمنحك معيارًا مرجعيًا مستقلًا لـ Opus 5.5؛ فلا شيء يفعل ذلك بعد، لأن المقارنات المباشرة المنشورة الوحيدة هي مقارنات Anthropic نفسها، ولا يزال المتتبعون المستقلون يستقرون على إعدادات الجهد. ما يمنحك إياه هو القياس الوحيد الذي يمكنه فعلًا التنبؤ بفاتورتك، على مطالباتك، عند مستوى الجهد الذي ستطرحه.
قاعدة القرار
إذا كنت تبدأ شيئًا جديدًا، استخدم Claude Opus 5.5 وابدأ بمتوسط جهد، ثم قِس ما إذا كان منخفض يصمد في مهمتك — تُفيد Anthropic أن منخفض يقترب من إعداداته الأعلى في العديد من تقييمات البرمجة بتكلفة أقل بكثير، وتشير أرقام FrontierCode أعلاه إلى أن الإعداد الافتراضي لا يترك الكثير على الطاولة.
إذا كنت تشغّل Claude Opus 5 في بيئة الإنتاج، فإن ما يستدعي الترحيل ليس جدول المقارنات المعيارية، بل ما إذا كان بإمكانك استيعاب أربعة تغييرات في واجهة API، وما إذا كان عبء عملك يقع في مجال الأمن السيبراني أو الأحياء، حيث سيُحيل توجيه الضمانات بهدوء جزءًا من حركة مرورك إلى نموذج أصغر. وكل ما عدا ذلك في هذا الترقية ليس سوى تخفيض سعر يرتدي ثوب إصدار نموذج، وهذه التخفيضات تستحق الأخذ بها.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
