بطاقة عنوان لدليل واجهة برمجة تطبيقات Claude Opus 5.5، نصّها «معرّف الطراز، وأربعة تغييرات جذرية، والخامس الصامت»، مع شريط مواصفات يعرض معرّف الطراز claude-opus-5-5، ونافذة سياق بحجم 1M، ومخرجات 128K، و4$ / 20$ لكل مليون رمز.
Engineering & Research

دليل واجهة برمجة تطبيقات Claude Opus 5.5: معرّف الطراز، وأربعة تغييرات كاسرة، والخامس الصامت

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

غيّر سلسلة الطراز من claude-opus-5 إلى claude-opus-5-5 وسيظل كودك يُترجَم، ويجتاز فحص الأنواع، ويجتاز ما يُعتبر مجموعة اختبارات. ثم يعيد الخطأ 400 في بيئة الإنتاج. أربعة أشكال من الطلبات كان Claude Opus 5 يقبلها ترفضها رفضًا قاطعًا Claude Opus 5.5، وتغيير خامس لا يكسر شيئًا على الإطلاق — وهذا بالضبط سبب كونه التغيير الذي سيصل إلى مستخدميك. هذا هو مرجع التكامل الخاص بالطراز: المعرّف، والأسطح التي تخدمه، وعقد الطلبات، والأخطاء الأربعة، والخامس الصامت، وكيفية عمل معامل effort الآن. وحيثما يتطابق السلوك مع Claude Fable 5.1، فقد أنجز الفريق الذي هاجر إلى هناك بالفعل جزءًا من العمل، لذا يوضّح كل تغيير أدناه ما إذا كان ينطبق على ذلك الطراز أيضًا.

كل ما هنا مأخوذ من وثائق Claude الخاصة بـ Anthropic بتاريخ 2026-09-24، بعد يومين من إطلاق النموذج. تُوصَف ادعاءات المورّد بأنها ادعاءات مورّد، والأرقام المستقلة بأنها مستقلة، ولا يُعرض الاثنان أبدًا عند إعداد الجهد نفسه وكأنهما قابلان للمقارنة.

معرّف النموذج، وأين يتم تقديمه

المعرّف هو claude-opus-5-5 — معرّف نموذج ثابت بلا لاحقة تاريخية، وفق النمط نفسه المتبع مع claude-opus-5. ولا يوجد شكل منفصل للقطة مثبّتة يمكن تبنّيه، ولا أي اسم مستعار يُحلّ إلى شيء آخر.

تعرض نظرة عامة على نماذج Anthropic خمس واجهات، مع هذه السلاسل النصية الدقيقة:

• Claude API — claude-opus-5-5، متاحة لجميع العملاء.

• أمازون بيدروك — anthropic.claude-opus-5-5 (الواجهة الوحيدة التي تضع بادئة المورّد).

• منصة Claude على AWS — claude-opus-5-5، باستخدام معرّفات Claude API بدلًا من المعرّفات بنمط Bedrock.

Google Cloud — claude-opus-5-5.

• Microsoft Foundry — claude-opus-5-5؛ اسم النشر هو ما ترسله، ويتبع Foundry الجدول الزمني لدورة حياة Claude API.

اثنان من هؤلاء الخمسة يهمّان أكثر من بقية هذا القسم. فـ Amazon Bedrock وGoogle Cloud يحدّدان تواريخ دورة الحياة والتقاعد الخاصة بهما، و—كما تُظهر التغييرات الكاسرة أدناه—لا يزال Bedrock أيضًا المنصة الوحيدة التي ما زالت فيها أداة استخدام الكمبيوتر القديمة تعمل. إذا كنت تستخدم Bedrock، فأنت لست في المسار نفسه من الترحيل الذي يخوضه الجميع.

ما الذي يجب أن يستوفيه كل طلب الآن

يورد دليل الترحيل الخاص بـ Anthropic هذا العقد على هيئة قائمة، والقائمة قصيرة بما يكفي لتفحص عميلك الخاص في مقابلها. وأيًّا كان النموذج الذي تأتي منه، فإن أي طلب موجَّه إلى claude-opus-5-5 يجب أن:

• أرسل إما بدون thinking حقل أو thinking: {"type": "adaptive"} — الاثنان متكافئان، لأن التفكير التكيفي مفعّل دائمًا.

• تحكّم في عمق التفكير عبر effort، وهو معامل الطلب الوحيد الذي يفعل ذلك؛ جميع المستويات الخمسة مدعومة والافتراضي هو medium.

• استخدم tool_choice بالقيمة {"type": "auto"} (وهي القيمة الافتراضية) أو {"type": "none"}. أما فرض أداة فيُرفض.

• احذف temperature، وtop_p وtop_k، أو اتركها على قيمها الافتراضية. تُرفض أي قيمة أخرى، على هذا النموذج كما على كل شيء بدءًا من Claude Opus 4.7 فصاعدًا.

• لا تُنهِ الرسائل بدور مساعد معبّأ مسبقًا؛ فقد رُفض ذلك بالفعل في Opus 4.6 والإصدارات اللاحقة.

• الإعلان عن استخدام الحاسوب باعتباره computer_toolset_20260801 مجموعة الأدوات على Claude API وGoogle Cloud.

• لا ترسل أي ترويسة بيتا لنافذة السياق. نافذة السياق بحجم 1M هي الافتراضية، وأي ترويسة مكتوبة لنموذج أقدم ليس لها أي تأثير.

حيث يذكر الدليل أن إعدادًا ما مرفوض، تُعيد واجهة API استجابة HTTP 400. هذا هو نمط الفشل الكامل للانتقال إلى هذا النموذج: ليس مخرجات متدهورة، ولا تحذيرًا في سجل — بل طلب لا يُنفَّذ أبدًا.

Anthropic's Migrating to Claude Opus 5.5 documentation page, showing the 'What every request to Claude Opus 5.5 must satisfy' list: the claude-opus-5-5 model id with no date suffix, thinking adaptive-only, the effort parameter with five levels low through max defaulting to medium, tool_choice auto or none, sampling parameters at their defaults, no prefilled assistant turn, the computer_toolset_20260801 toolset on the Claude API and Google Cloud, and a 1M-token context window requiring no beta header.

التغييرات الكاسرة الأربعة

1. لا يمكن تعطيل التفكير

التفكير التكيفي مفعّل دائمًا. thinking: {"type": "disabled"} يُرجع 400، وكذلك الميزانية اليدوية — thinking: {"type": "enabled", "budget_tokens": N}. يسمّي نص الخطأ النوع الذي أرسلته ثم يسمّي البديل:

• "thinking.type.disabled" غير مدعوم لهذا النموذج. استخدم "thinking.type.adaptive" و"output_config.effort" للتحكم في سلوك التفكير.

• "thinking.type.enabled" غير مدعوم لهذا النموذج. استخدم "thinking.type.adaptive" و"output_config.effort" للتحكم في سلوك التفكير.

النتيجة العملية ليست الخطأ، بل ما يحدث بعد إصلاحه. في Claude Opus 4.8 والإصدارات الأقدم، كان الطلب الذي لا يحتوي على حقل التفكير يعمل دون تفكير. في Claude Opus 5.5، يفكّر كل طلب، وmax_tokens يظل حدًا صارمًا يغطي التفكير إضافة إلى نص الاستجابة. تُحتسب رموز التفكير كرموز إخراج حتى عندما لا يُعاد إليك نص التفكير. لذلك، قد تُنتج نقطة نهاية كانت تعمل سابقًا دون تفكير رموزَ إخراج أكثر لكل طلب بعد "الإصلاح" مما كانت تنتجه قبل ذلك. إرشادات Anthropic هي خفض مستوى الجهد حيث كنت تعطّل التفكير، و—عند مستوى xhigh أو الجهد الأقصى—أن تبدأ max_tokens عند 64k وتضبطها من هناك.

يتغير شكل الاستجابة أيضًا. يمكن أن تبدأ الاستجابة بواحدة أو أكثر من كتل التفكير قبل أول كتلة نصية، لذا فإن الشيفرة التي تقرأ الرد حسب الموضع — content[0].text، أو معالج بث يتعامل مع أول content_block_start كنص — تتعطل مع هذه الاستجابات حتى عندما ينجح الطلب. حدِّد الكتل حسب type الخاص بها بدلاً من ذلك.

2. استخدام الأداة الإجباري يُرجع خطأ

tool_choiceأنواع any و tool تُرجع 400، وينطبق التحقق نفسه على نقطة النهاية الخاصة بعد الرموز، لذا يفشل العد المسبق بالطريقة نفسها التي يفشل بها الاستدعاء الفعلي:

• tool_choice: النوعان "tool" و"any" غير مدعومين لهذا النموذج.

لا يتأثر Auto وnone. البديل الموثّق هو الإبقاء على tool_choice: {"type": "auto"}، ووسم الأدوات بـ strict: true لوسائط صالحة وفق المخطط، أو نقل المخطط إلى المخرجات المنظمة — وأن تذكر في المطالبة متى تنطبق الأداة، لأن auto لا يضمن الاستدعاء. يقبل الاستخدام الصارم للأداة مجموعة فرعية من JSON Schema: يجب أن تضبط كل كائنات في input_schema الخاصة بالأداة additionalProperties: false، لذا تحقق من كل مخطط قبل تبديل العلامة. ولاحظ الفجوة التي يخلّفها هذا: إذا كان كودك يعتمد على فرض استدعاء بدلًا من مجرد السماح به، فإن auto يستعيد الإذن وليس الضمان. تحقق من أن كتلة tool_use قد عادت فعلاً.

3. كتل التفكير مرتبطة بالنموذج وبالمحادثة

كل كتلة تفكير تسجّل أيّ نموذج أنتجها، ويقرأ كل نموذج كتله الخاصة إضافة إلى مجموعة محدّدة من كتل النماذج الأخرى. تنطبق القواعد في الاتجاهين:

• يمكن لـ Claude Opus 5.5 قراءة كتل التفكير من Claude Opus 5 وطرازات Opus وSonnet وHaiku الأقدم — ولكن ليس من طرازات Claude Fable أو Claude Mythos.

• على واجهة Claude API، يقرأ كلٌّ من Claude Fable 5.1 وClaude Mythos 5.1 كتل Claude Opus 5.5. ولا يفعل ذلك أي نموذج آخر.

• أي محادثة تنتقل من Claude Opus 5.5 إلى أي شيء غير هذين الاثنين تُشغّل أدوارها اللاحقة دون الاستدلال السابق.

يُعدّ الموجِّه أو آلية الاحتياط التي تنقل محادثة الطريقة الواضحة لتحقيق ذلك. والجزء الأكثر خفاءً هو أن الكتلة مرتبطة أيضًا ببادئة المحادثة — موجه النظام، والأدوات، وكل رسالة تسبقها. تفرض Anthropic فحص البادئة افتراضيًا للحسابات المُنشأة في 2026-08-31 00:00 UTC أو بعده، على Claude API وعلى المنصات السحابية: أعد تشغيل كتلة بعد تعديل موجه النظام، أو قائمة الأدوات، أو رسالة سابقة فسيُعيد الطلب الرمز 400. يوجد مخرجان. أرسل thinking-binding-controls-2026-08-01 ترويسة beta واضبط thinking.block_binding.prefix_mismatch_behavior على "drop_block" لإسقاط الكتل المتأثرة بدلًا من إفشال الطلب. أو أبقِ المحادثة قابلة للإلحاق فقط وغيّر التعليمات برسالة نظام في منتصف المحادثة بدلًا من التعديل — وهو ما تفعله بالفعل Claude Code وclaude.ai وClaude Managed Agents وClaude Agent SDK.

هناك خبر سار واحد يسهل تفويته: عندما يحمل الطلب كتلة لا يستطيع النموذج الهدف قراءتها، تُسقطها واجهة API قبل أن يراها النموذج. ينجح الطلب، ولا تُحتسب رسوم على الكتل المُسقطة.

4. أداة استخدام الكمبيوتر الأقدم مرفوضة على Claude API وGoogle Cloud

يعيد إدخال أدوات من النوع computer_20251124 خطأ 400 على Claude API وGoogle Cloud. تذكر الرسالة النوع المرفوض ثم تسرد الأنواع التي يقبلها النموذج:

• 'claude-opus-5-5' لا يدعم أنواع الأدوات: computer_20251124.

البديل هو computer_toolset_20260801 لمجموعة الأدوات: احذف computer-use-2025-11-24 من ترويسة الإصدار التجريبي، وأرسل مدخل الأدوات دون اسم ودون أبعاد العرض. هذا ليس مجرد تغيير في الطلب — بل تتغيّر معه حلقة الوكيل. تصل الإجراءات ككتل tool_use للأعضاء بدلًا من أداة حاسوب واحدة، وقد يكون هناك عدة إجراءات في الدور الواحد، ويكون الإجراء هو اسم الكتلة name بدلًا من input.action، ويجب أن تُعيد كل نتيجة toolset_name مرة أخرى. وعلى Amazon Bedrock، يظل computer_20251124 يعمل تمامًا كما يعمل على Claude Opus 5 دون أي تغيير.

أيٌّ من الأربعة ينطبق أيضًا على Claude Fable 5.1؟

تذكر Anthropic أن الثلاثة الأولى تنطبق على Claude Fable 5.1 أيضًا — التفكير المفعّل دائمًا، ولا اختيار مفروض للأدوات، وكتل تفكير مرتبطة بالطراز والمحادثة. أما تغيير استخدام الحاسوب فلا ينطبق: فهو خاص بهذا الطراز على Claude API وGoogle Cloud. لذا فإن فريقًا انتقل بالفعل إلى Claude Fable 5.1 قد تخلّى عن مسارات الشيفرة المعطّلة التفكير وعن اختياراته المفروضة للأدوات، ولديه نمط محادثة قائم على الإضافة فقط؛ وما يتبقى هو معرّف الطراز ومجموعة أدوات استخدام الحاسوب. فريق قادم من Claude Opus 5 يواجه الأربعة كلها دفعة واحدة. هذا هو الترحيل الجدير بالجدولة، وهو قدر مختلف من العمل حسب نقطة البداية.

التغيير الخامس: لا تحدث أي أخطاء، ويهدأ موجز تقدّمك

في Claude Opus 5، تعود الملاحظات القصيرة التي يكتبها النموذج بين استدعاءات الأدوات ككتل نصية عادية. وفي Claude Opus 5.5 — كما في Claude Fable 5.1 — تعود تلك السردية ككتل تفكير لتحديث التقدم، بحد أقصى واحدة قبل كل استدعاء أداة. وthinking.displayتكون قيمته الافتراضية "omitted"، لذا تصل تلك الكتل بحقل تفكير فارغ إلى جانب توقيعها.

لا يفشل أي طلب. ولا يُسجَّل أي خطأ. إن التطبيق الذي يبثّ النص الواقع بين الأدوات إلى مستخدميه كمؤشر تقدّم يتوقف ببساطة عن إظهار التقدم بين استدعاءات الأدوات، ويبدأ في عدم إظهار أي شيء. العَرَض المرئي هو واجهة مستخدم تبدو متجمدة خلال الفترة نفسها من العمل التي يكون فيها المستخدم في أشد الحاجة إلى الطمأنينة، وسيُبلَّغ عنها كمشكلة أداء أو مشكلة شبكة أو تعليق — وليس كخطأ ترحيل. هذا هو التغيير الذي يُشحن إلى الإنتاج.

الإصلاح هو إعداد عرض، بالإضافة إلى قراءة تطابقه:

• اضبط thinking.display على "updates" — نسخة تجريبية، خلف ترويسة thinking-display-updates-2026-08-18 — لاستعادة تحديثات التقدّم بينما يظل الاستدلال نفسه مخفيًا. هذا هو الإعداد الذي يريده موجز التقدّم.

• أو اضبطه على "ملخّص" لتلقّي تحديثات التقدّم وملخّصات الاستدلال ممزوجةً معًا في الكتل نفسها.

• ثم اقرأ النص من كتل التفكير بدلاً من كتل النص، واعرض كل كتلة تفكير غير فارغة قبل كتلة tool_use التي تأتي بعدها، وأعِد تمرير الكتل دون تغيير مع بقية دور المساعد.

تجدر الإشارة من حيث الروح إلى ملاحظة Anthropic نفسها حول هذا الأمر: من المتوقع أن تقوم الواجهة التي تعرض نصًا بين استدعاءات الأدوات بتعيين قيمة عرض بدلًا من الاعتماد على القيمة الافتراضية. وإذا كان تكاملك يتجاهل كتل التفكير بالكامل اليوم، فهذا هو الموضع الوحيد الذي تكون فيه القيمة الافتراضية آمنة.

A single-column scoreboard titled 'Claude Opus 5.5 — the migration at a glance' listing six rows: thinking always on and cannot be disabled; forced tool use returning a 400 error; thinking blocks bound to the model and the conversation; the old computer tool rejected on the Claude API and Google Cloud; progress text hidden by default; and the fix of setting thinking.display to summarized. Footer reads: per Anthropic's Claude Opus 5.5 migration guide, read 2026-09-24; vendor-reported.

الجهد هو سطح واجهة برمجة التطبيقات.

مع تعذُّر تعطيل التفكير،output_config.effortيصبح المقبض الوحيد الذي يحدد مقدار استدلال النموذج، وبالتالي المقبض الوحيد الذي يحدد التكلفة وزمن الاستجابة عند مهمة معينة. وهناك أربعة أمور عنه يجدر معرفتها قبل أن تنسخ أي إعداد من النموذج القديم.

تغيّر الوضع الافتراضي. أصبح Claude Opus 5.5 يعمل افتراضيًا بمستوى جهد متوسط، بينما كان Claude Opus 5 وطرازات Opus الأقدم تعمل افتراضيًا بمستوى جهد مرتفع. إن الطلب الذي يُحذف منه الجهد يعمل الآن بمستوى أدنى مما كان عليه قبل التبديل. وتوثّق Anthropic أيضًا أن النموذج يميل إلى التفكير أكثر في كل دور عند إعداد جهد معيّن مقارنةً بما كان عليه Claude Opus 5، خصوصًا عند xhigh وmax. يدفع هذان التأثيران في اتجاهين متعاكسين، ولهذا تحديدًا توصي الشركة المورّدة بإجراء مسح جديد لمستويات الجهد على تقييماتك الخاصة بدلًا من نقل إعداد من سياق إلى آخر.

المقياس هو low / medium / high / xhigh / max، والخمسة كلها مدعومة هنا. المستوى المسمّى ليس ميزانية رموز ثابتة في المقام الأول — إذ تصف Anthropic الجهد بأنه إشارة سلوكية، لا ميزانية صارمة — وقد تغيّر تخصيص الرموز وراء كل مستوى بين النماذج، لذا فإن "high" على Claude Opus 5.5 ليس هو "high" على Claude Opus 5. ضبط الجهد على الوضع الافتراضي للنموذج يعادل إغفاله.

تفصيلان تشغيليان، لأن كليهما يكلف مالًا عند إغفالهما. أولًا، تغيير قيمة الجهد على المستوى الأعلى بين الطلبات يُبطل ذاكرة التخزين المؤقت للمطالبات: اختر مستوى واحدًا واحتفظ به ثابتًا داخل محادثة تعتمد على إصابات ذاكرة التخزين المؤقت، ونوّع المستوى بين أحمال العمل بدلًا من ذلك. ثانيًا، يدعم هذا النموذج جهدًا لكل رسالة (ترويسة تجريبية mid-conversation-output-config-2026-07-01)، وهو ما يغيّر المستوى بدءًا من دور لاحق دون إعادة تشغيل ذاكرة التخزين المؤقت. الحد الأدنى لذاكرة التخزين المؤقت للمطالبات هنا هو 512 رمزًا، انخفاضًا من 1,024 في الجيل السابق، لذا يمكن للمطالبات التي كانت قصيرة جدًا على التخزين المؤقت سابقًا أن تنشئ مدخلات الآن دون أي تغيير في الشيفرة.

حدود الإخراج: 128K في الوضع المتزامن، و300K عبر Batch

تحدّ واجهة Messages API المتزامنة من الإخراج عند 128 ألف رمز. وتصل واجهة Message Batches API إلى 300 ألف رمز إخراج خلف output-300k-2026-03-24 (ترويسة بيتا) — هذا النص بالضبط. الإدخال هو نافذة السياق الكاملة البالغة مليون رمز افتراضيًا دون الحاجة إلى أي ترويسة.

القراءة العملية: سقف 128K لم يتغير عن Claude Opus 5، لذا لا شيء في التكامل المتزامن يحتاج إلى إعادة ضبط الميزانية على هذا المحور وحده. ما يحتاج فعلاً إلى إعادة ضبط الميزانية هو التفكير داخله. وبما أن max_tokens يغطي الآن التفكير بالإضافة إلى النص في كل طلب، فإن قيمة كانت مريحة لنص الاستجابة على Claude Opus 5 صارت أضيق هنا — وعند الجهد xhigh أو max يقترح المورّد البدء من 64k ثم الضبط. وإذا كانت مهمة طويلة التشغيل قد قُدِّرت على أساس سقف 128K المتزامن وصارت الآن تُقتطع، فليس السقف هو ما تحرّك.

توجيه Safeguard جزء من المواصفات.

هذه حقيقة خاصة بالتكامل، وليست حاشية سياسة: في بعض المطالبات، لا تصف سلسلة النموذج التي ترسلها ما الذي أجاب.

يأتي Claude Opus 5.5 مزوَّدًا بمصنِّفات الأمان، ويُعاد الطلب المرفوض بحالة HTTP 200 مع stop_reason: "refusal" وكائن stop_details يحدد مجال السياسة. يغطي هذا الطراز فئات أكثر من Claude Opus 5 — توقّع bio، frontier_llm وreasoning_extraction إلى جانب الفئة المألوفة cyber. أما رفض reasoning_extraction فيُحظر كليًا بدلًا من إعادة المحاولة: فالاحتياطي من جانب الخادم لدى Anthropic لا يعيد المحاولة، ويُعاد إليك الرفض.

بالنسبة للفئات التي تعيد المحاولة، تكون الآلية عبارة عن معامل. اضبط fallbacks على "default" مع server-side-fallback-2026-07-01 ترويسة بيتا، وتعيد واجهة برمجة التطبيقات (API) تشغيل طلب مرفوض على النموذج الذي توصي به Anthropic لتلك الفئة، داخل استدعاء واحد، وتعيد استجابة واحدة. ويسمي مركز المساعدة التابع لـ Anthropic التوجيه لهذا النموذج مباشرةً: طلبات الأمن السيبراني المعلَّمة ترتد إلى Claude Opus 4.8، وتصنيفاتها البيولوجية — المجموعة بنمط Fable-5 — تسبب انتقالًا احتياطيًا إلى Claude Opus 5 للعمل في علوم الحياة مزدوج الاستخدام. كما تُوجَّه مجموعة ضيقة من قدرات تطوير النماذج اللغوية الضخمة الرائدة إلى Claude Opus 5 أيضًا. وتلاحظ Anthropic أيضًا أن الفحوصات تراجع كل ما يقرؤه النموذج، وليس رسالتك الأخيرة فقط، لذا يمكن للذاكرة ومحتوى الموصلات ونتائج البحث والملفات أن تسبب تبديلًا.

ثلاثة أمور تترتب على تكاملك. اقرأ حقل النموذج العلوي في كل استجابة، لأنه يبلّغ عن النموذج الذي أنتج الرسالة فعليًا، والاحتياط كتلة محتوى تشير إلى كل نقطة تسليم. تحقق من حدود المعدل الخاصة بآلية الاحتياط نفسها، لأن آلية الاحتياط المقيّدة بالمعدل لا تُجرَّب ويُعاد الرفض بدلًا من ذلك — تتحول آليات الاحتياط إلى رفض تحت الحمل. وتعامل مع أي تشغيل معياري منشور مع تمكين الضمانات باعتباره قياسًا للنظام الموجّه، وليس لـ Claude Opus 5.5 وحده، وهو بالضبط ما تقوله Anthropic عن أرقامها أدناه.

الاحتياطي من جانب الخادم هو ميزة تجريبية (بيتا) ومتاح في Claude API فقط: فهو غير مدعوم في Message Batches API، وغير متاح على Amazon Bedrock أو Google Cloud أو Microsoft Foundry، حيث يكون البرمجيات الوسيطة SDK هي المسار الموثّق بدلاً من ذلك. وعلى جانب التحقق، توجد مسارات وصول لكل من الفئتين — برنامج التحقق السيبراني Cyber Verification Program وبرنامج التحقق في علوم الحياة Life Sciences Verification Program — ولكن لاحظ عدم التماثل الذي يوثّقه مركز مساعدة Anthropic وقت كتابة هذا النص: إذ لا يظهر Claude Opus 5.5 حالياً في برنامج التحقق السيبراني، في حين يُوصف برنامج علوم الحياة بأنه يمنح المؤسسات المتحقَّق منها إمكانية الوصول إلى أقدر النماذج.

السياق، وحد القطع، والتقاعد، والوضع السريع

بقية المغلّف، من صفحة النموذج وجدول الإهمال:

• نافذة السياق — 1 مليون رمز، افتراضي، بدون ترويسة بيتا.

• الحد الزمني للمعرفة — يونيو 2026، وهو أيضًا الحد النهائي لبيانات التدريب.

• الإيقاف — لن يحدث قبل 2027-09-22 على المنصات التي تشغّلها Anthropic، مع إشعار قبل 60 يومًا على الأقل. وتحدّد Amazon Bedrock وGoogle Cloud تواريخهما الخاصة. ويظل Claude Opus 5 نشطًا حتى 2027-07-24 على الأقل، لذا لا يوجد تحوّل إجباري.

• بطاقة الأسعار — $4.00 لكل مليون إدخال، و$20.00 لكل مليون إخراج، و$5.00 لكل مليون عملية كتابة إلى الذاكرة المؤقتة لمدة 5 دقائق، و$8.00 لكل مليون عملية كتابة إلى الذاكرة المؤقتة لمدة ساعة واحدة، و$0.20 لكل مليون قراءة من الذاكرة المؤقتة. الدفعة بنصف السعر في كلا الاتجاهين عند $2.00 / $10.00.

• قراءات الذاكرة المؤقتة هي الحالة الشاذة الجديرة بالملاحظة: 0.20 دولار هو 5% من الإدخال الأساسي، حيث تأتي معظم نماذج Claude بنسبة 10% و Claude Fable 5.1 بنسبة 2.5%. أعباء العمل المختلطة مع إعادة استخدام كثيفة للذاكرة المؤقتة تعتبر ذلك خصمًا حقيقيًا.

• الوضع السريع — لا يزال موثقًا كمعاينة بحثية، Claude API فقط، ويُسعّر بشكل منفصل بسعر 8.00 دولار للمدخلات / 40.00 دولار للمخرجات لكل مليون. فعّله باستخدام speed: "fast" و fast-mode-2026-02-01 رأس beta. إنه غير متاح على Bedrock، أو Claude Platform على AWS، أو Google Cloud، أو Microsoft Foundry، ولا مع Batch API، ولا مع التزام Priority Tier. لاحظ أن Claude Opus 5.5 لا يدعم Priority Tier على الإطلاق.

ما تقوله اختبارات الأداء، وعند أي إعداد

إعدادات الجهد هي السبب في تعذّر مقارنة جدول المورّد وجدول مستقل صفًا بصف، وفي أن كل رقم أدناه يحمل إعداده.

مُبلَّغ عنه من قِبل المورّد، باستخدام أداة التقييم الخاصة بـ Anthropic. تنص مذكرة إطلاق Anthropic على أنه، ما لم يُذكر خلاف ذلك، فإن جميع نتائج Claude Opus 5.5 تستخدم التفكير التكيّفي عند أقصى جهد؛ والاستثناء هو Terminal-Bench 4.0، المُبلَّغ عنه عند xhigh لـ Claude Opus 5.5 وhigh لـ GPT-6 Astra لأن هذين هما أعلى نتيجة لكل نموذج. وعلى هذا الأساس يُبلغ المورّد عن Terminal-Bench 4.0 بنسبة 66.4%، وFrontierCode v1.1 Main بنسبة 54.4%، وCursorBench 4.0 بنسبة 57.8%، وGDPval-AA v2.1 عند 1,846 نقطة Elo، وAutomationBench بنسبة 40.0%، وHumanity's Last Exam مع الأدوات بنسبة 67.7%، وTerminal-Bench-Science 0.1 بنسبة 58.7%، وOSWorld 2.0 بنسبة 81.8% جزئيًا، وChartography مع الأدوات بنسبة 89.0%. وعند الجهد المتوسط الافتراضي للنموذج يذكر المورّد FrontierCode بنسبة 54.6% وCursorBench بنسبة 52.5%. ولاحظ ما تكشفه المذكرة نفسها: أُجريت التقييمات مع تفعيل ضمانات الإنتاج، وعندما فعّلت تلك الضمانات، أُنجزت مهام الأمن السيبراني بواسطة Claude Opus 4.8 ومهام الأحياء وتطوير النماذج الحدودية بواسطة Claude Opus 5 — وتقول Anthropic إن هذا على الأرجح يقلل من أداء Claude Opus 5.5 في تلك المعايير. لذا فإن الدرجات المنشورة في التقييمات المتأثرة ليست قياسات خالصة لهذا النموذج.

مستقل، Artificial Analysis.على Intelligence Index v4.3.2، يسجّل Claude Opus 5.5 58 في الإعداد الذي تصنّفه Artificial Analysis باسم "الاستدلال التكيّفي، الجهد الأقصى، التراجع الافتراضي" — وهي أعلى درجة مقيسة له بفارق عدة نقاط، ويتصدّر ستة من التقييمات العشرة المكوّنة. على المؤشر نفسه وبأداة القياس نفسها، يسجّل Claude Fable 5.1 درجة 53، ويسجّل Claude Opus 5 درجة 51. وتنشر Artificial Analysis سلّم الجهد الكامل، وهو أكثر عنصر مستقل فائدة هنا: الأقصى 58، xhigh 56، عالٍ 54، متوسط 51، منخفض 42. وتضع قياساتها الخاصة Claude Opus 5.5 عند نحو 119,000 رمز مخرجات لكل مهمة مؤشر عند الجهد الأقصى، مقابل نحو 73,000 لـ Claude Opus 5، و78,000 لـ Claude Fable 5.1، و27,000 لـ GPT-6 Astra — رموز تُحتسب كرموز مخرجات — وتذكر صفحتها تكلفة $5.98 لكل مهمة مؤشر. كما تقيس Terminal-Bench 4.0 عند 59.6% وHumanity's Last Exam عند 61.4%، مقابل 66.4% و67.7% للمورّد عند الجهد الأقصى على أداة قياس مختلفة.

اقرأ هاتين الفقرتين مقابل بعضهما البعض، والاستنتاج الصادق ضيق. نسبة 66.4% في Terminal-Bench من البائع ونسبة 59.6% المستقلة هما نفس المعيار الذي أجراه أشخاص مختلفون بإعدادات ليس مضمونًا تطابقها، ولا أي منهما دليل على عبء العمل الخاص بك. سلّم الجهد هو النتيجة القابلة للنقل: على مؤشر مستقل، تتراوح إعدادات هذا النموذج نفسه على ست عشرة نقطة، وهو مدى أوسع من الفجوة بينه وبين سابقه. اختيار مستوى الجهد يهم أكثر من الاختيار بين هذه النماذج، وعبارة "Default Fallback" في تلك التسمية تمثل توجيه الحماية الموصوف أعلاه، وليس أثرًا من آثار المعيار.

الكفاءة المُبلَّغ عنها من المورّد، منسوبة إليه. تقول Anthropic إن Claude Opus 5.5 يقدّم أداءً بمستوى Claude Fable 5.1 في معظم المهام وبتكلفة تشغيل تقل بنحو 40%، وإن أعباء العمل المعتادة تكلّف أقل بنحو 40% مما هي عليه في Claude Opus 5 مقابل خفض في السعر المعلن بنسبة 20%. كما أن الإخراج أسرع بأكثر من 30%. هذه توصيفات من المورّد لمتوسطات عبر أعباء عمل اختارها المورّد. وتصريحات العملاء عند الإطلاق من النوع نفسه من الأدلة: تقول Box إنها سجّلت ثلث الرموز وإن الإجابات أقل إسهابًا بنحو 40%، وتقول Kiro إن الرموز انخفضت إلى النصف تقريبًا والاستدعاءات بنحو 40%، وتقول Factory إن رموز الإخراج انخفضت بنسبة 20–25%، وتقول GitHub إنها من أقلّ ما قاسته من الرموز والخطوات. وتذكر Anthropic أيضًا اختبارًا داخليًا للتحقق من الوقائع نجحت فيه 16 من 18 تقريرًا لها في تجاوز حدّ جودة لم يجتزه أي من Claude Fable 5.1 أو Claude Opus 5 في أي محاولة. كل ذلك مُبلَّغ عنه من المورّد ولا شيء منه مُدقَّق. والقيد المُفصح عنه صريح على نحو غير معتاد ويستحق التضمين: تقول Anthropic إن Claude Opus 5.5 "غالبًا ما يشتبه في أنه يخضع للتقييم".

أخيرًا، الطرازان الشقيقان: تقول Anthropic إن Claude Sonnet 5.5 وClaude Haiku 5.5 سيصلان "خلال الأسابيع المقبلة". لم يُطرح أيٌّ منهما بعد، ولم يُحدَّد سعر أيٍّ منهما، ولا يتوافر أيٌّ منهما على أي واجهة اليوم.

اختبار التغييرات الأربعة دون إجراء تحول كامل

خطر الترحيل هنا ليس الجودة — بل إن مسارًا برمجيًا لم تشغّله في بيئة التجهيز هو الذي يعيد 400 في الإنتاج. التغييرات الكاسرة الأربعة كلها تغييرات في شكل الطلب، ما يعني أنها تفشل بشكل حتمي وفوري، والسبيل الوحيد للعثور على المسارات التي فاتتك هو تمرير حركة مرور حقيقية عبرها.

Claude Opus 5.5 متاح على OrcaRouter بمعرّف anthropic/claude-opus-5.5 بسعر قائمة Anthropic نفسه دون أي هامش ربح (0%) — إذ يُمرَّر سعر قائمة المزوّد كما هو، لذا يظهر أي تغيير في سعر المورّد هنا في اليوم نفسه.

The OrcaRouter model page for Claude Opus 5.5, showing the identifier anthropic/claude-opus-5.5, input at $4.00 and output at $20.00 per 1M tokens, a 1M-token context window, 128K max output, text plus image and file input, and OpenAI-compatible and Anthropic Messages endpoints served from api.orcarouter.ai.

يتيح لك ذلك توجيه نسبة مئوية من حركة الإنتاج إلى النموذج بينما يستمر الباقي في العمل على Claude Opus 5، ومراقبة الطلبات التي تفشل ولماذا، وإصلاحها واحداً تلو الآخر. الأخطاء الأربعة وصفية ذاتياً: كل منها يذكر المعلمة التي رفضها، وفي ثلاث من الحالات الأربع يذكر المعلمة البديلة. يغطي التحويل التلقائي عند الفشل الفجوة بينما لا يزال أحد المسارات معطلاً — فالطلب الذي يفشل مقابل نموذج لم توصفه بشكل كامل يتراجع إلى نموذج تعرفه، بدلاً من إظهار الخطأ 400 للمستخدم.

ترتيب عملي للعمل: استبدل معرّف النموذج واضبط effort صراحةً أولاً، لأن القيمة الافتراضية انتقلت إلى medium؛ ثم أزل مسارات thinking-disabled وforced-tool-choice بعد ذلك؛ ثم أصلح قارئ البث — اختيار الكتل حسب النوع وإعداد thinking.display — لأنه هو الذي يفشل بصمت لا بصوت عالٍ؛ واترك ترحيل مجموعة أدوات computer-use إلى الأخير إذا كنت على Bedrock، لأنه هو الذي لا ينطبق هناك. وكل ما عدا ذلك — السعر، ونافذة السياق، ومعدلات التخزين المؤقت، والافتراضي 1M-token — ما زال حيث تركته.

وجّه نسبة من حركة المرور الحيّة إلى النموذج الجديد دون تحوّل كامل: Claude Opus 5.5 على OrcaRouter يعمل بسعر Anthropic المعلن مع تجاوز فشل تلقائي إلى نموذج سبق أن وثّقت خصائصه.

مقارنات في هذه المقالة4

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا