بطاقة عنوان مُولَّدة لـ Claude Opus 5.5 مقابل Claude Fable 5.1، بعنوان فرعي «الطراز الأرخص فاز بالمؤشر المستقل»، مع شعار OrcaRouter الحقيقي مركَّبًا في أسفل اليمين، وسطر تذييل نصّه «المؤشر وفق Artificial Analysis عند أقصى جهد؛ والأسعار وفق Anthropic.»
Guides & Insights

كلود أوبس 5.5 مقابل كلود فيبل 5.1: الطراز الأرخص فاز بالمؤشر المستقل

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

تبيع Anthropic الآن نموذجين في قمة تشكيلتها، والنموذج الذي يكلّف ضعفين ونصف المبلغ ليس هو المتصدّر في الجدول. Claude Opus 5.5، الذي صدر في 22 سبتمبر 2026 بسعر 4 دولارات لكل مليون رمز إدخال و20 دولارًا لكل مليون رمز إخراج، يسجّل 58 على مؤشر الذكاء من Artificial Analysis. Claude Fable 5.1، الذي يحتفظ بمكانة الرائد منذ 1 سبتمبر بسعر 10 دولارات للإدخال و50 دولارًا للإخراج، يسجّل 53. كلا الرقمين صادر عن المقيّم نفسه، وكليهما قيس في عائلة التكوين نفسها، والفارق يسير في الاتجاه المعاكس لأسعار البطاقات. هذه هي الحقيقة التي يجب أن تبدأ منها هذه المقارنة، لأن كل مقال إطلاق تقريبًا من الأسبوع الماضي يقدّم Opus 5.5 بوصفه النسخة المخفّضة السعر من Fable 5.1 — نموذجًا أرخص "يضاهي" النموذج الغالي في معظم المهام. أما الرقم المستقل فيقول إن النموذج الأرخص متقدّم.

وما إذا كان ينبغي لذلك أن يغيّر ما تنشره هو سؤال آخر، والإجابة لا تعتمد على الفارق البالغ خمس نقاط بقدر ما تعتمد على إعدادين لا يضع أحدٌ أيًّا منهما في العنوان الرئيسي: مستوى الجهد الذي يعمل به كل نموذج افتراضيًا، وأيّهما يمكن جعله سريعًا.

الأرقام المستقلة، والشيء الوحيد الذي يجمعها

A two-column scoreboard comparing Claude Opus 5.5 and Claude Fable 5.1 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 53, ranked #4), price in and out ($4.00 / $20.00 per million against $10.00 / $50.00), context window (1M tokens on both), default effort (medium against high), knowledge cutoff (Jun 2026 on both) and fast mode (supported at $8.00 / $40.00 against not supported). The footer reads 'Index figures per Artificial Analysis at max effort; prices, effort defaults and fast-mode support per Anthropic.'

تنشر Artificial Analysis تهيئةً واحدة لكل نموذج، وبالنسبة لكليهما فهي تحمل التسمية "الاستدلال التكيفي، أقصى جهد، الاحتياطي الافتراضي". التسمية نفسها، والمقيّم نفسه، والتشغيل نفسه — وهذا ما يجعلها أنظف مواجهة مباشرة يحظى بها أي من النموذجين:

• مؤشر الذكاء — Claude Opus 5.5 عند 58، في المرتبة #1 من أصل 210 مقابل Claude Fable 5.1 عند 53، في المرتبة #4

• سرعة الإخراج — Claude Fable 5.1: ‏65.8 رمز/ثانية، أي دون وسيط اللوحة البالغ 71.0، مقابل Claude Opus 5.5 الذي لم يُنشر بعد على اللوحة

• الزمن حتى أول رمز — Claude Fable 5.1: 274.43 ثانية مقابل وسيط اللوحة البالغ 3.83 ثانية؛ Claude Opus 5.5 لم يُنشر بعد

• الإسهاب في المؤشر — أنتج Claude Opus 5.5 نحو 260 مليون رمز إخراج، مقابل وسيط بلغ 88 مليونًا على مستوى الجميع

• السعر — Claude Opus 5.5 بسعر 4.00 / 20.00 دولار لكل مليون مقابل Claude Fable 5.1 بسعر 10.00 / 50.00 دولار

صفّان من تلك الصفوف يحتاجان إلى القراءة لا إلى الاقتباس. الأول هو تسمية «أقصى جهد»: لا تعكس نتيجة أي من النموذجين إعداداته الافتراضية عند الإطلاق، والافتراضيان ليسا متماثلين — المزيد عن ذلك أدناه. والثاني هو صف الإسهاب، وهو يتعارض مع الطريقة التي رُوّج بها لـ Opus 5.5. قصة الكفاءة لدى Anthropic هي أن النموذج يصل إلى الإجابة نفسها بعدد أقل من الرموز، وتشير مواد الإطلاق إلى شركاء أفادوا بانخفاض رموز الإخراج بمقدار الثلث إلى النصف. في المؤشر، بالقياس لا بالاقتباس، أصدر Opus 5.5 260 مليون رمز مقابل وسيط لوحة قدره 88 مليونًا — أي أكثر إسهابًا بنحو ثلاثة أضعاف من النموذج النموذجي الذي يُقارن به. يمكن أن يكون الأمران صحيحين: فقد يستخدم رموزًا أقل من Claude Opus 5 مع بقائه نموذجًا مسهبًا بالقيم المطلقة. لكن إذا وضعت ميزانيتك بناءً على عبارة «رموز أقل» وليس بناءً على فاتورتك أنت، فإن القياس المستقل هو ما ينبغي التحقق منه.

ماذا يشتري الـ{{1}}$6{{/1}} الإضافية لكل مليون

A screenshot of Anthropic's Claude Platform Docs page for Claude Opus 5.5 showing its 'How it compares' table: Claude Fable 5.1 and Claude Opus 5.5 both at 1M context and 128K max output with a Jun 2026 cutoff, Fable 5.1 at $10 / $50 with high default effort and slower latency against Opus 5.5 at $4 / $20 with medium default effort and moderate latency, with Claude Sonnet 5 at $2 / $10 and a Jan 2026 cutoff and Claude Haiku 4.5 below them. The Opus 5.5 pricing panel underneath lists $4 input, $20 output, $5 and $8 cache writes, $0.20 cache read and a 50% batch discount.

إذا استبعدنا مقاييس الأداء، فما يتبقى هو قائمة أسعار فحسب. كل ما هنا مستمد من صفحة الأسعار المنشورة الخاصة بـ Anthropic، ويمكن التحقق منه اليوم:

• الإدخال — 4.00 دولار لكل مليون على Opus 5.5 مقابل 10.00 دولار على Fable 5.1

• المخرجات — 20.00 دولار لكل مليون مقابل 50.00 دولار

• قراءة الذاكرة المؤقتة — 0.20 دولار لكل مليون على Opus 5.5 مقابل 0.25 دولار على Fable 5.1

• مضاعف الذاكرة المؤقتة — يحتسب Opus 5.5 إصابات الذاكرة المؤقتة بسعر 0.05x من الإدخال الأساسي؛ بينما يحتسبها Fable 5.1 بسعر 0.025x، وهو مضاعف أفضل على أساس أعلى

• كتابة الذاكرة المؤقتة — 5 دولارات لكل مليون لنافذة مدتها 5 دقائق و8 دولارات للساعة على Opus 5.5، مقابل 12.50 دولارًا و20 دولارًا على Fable 5.1

• Batch API — Opus 5.5 تنخفض إلى النصف لتصل إلى $2.00 / $10.00؛ Fable 5.1 تنخفض إلى النصف لتصل إلى $5.00 / $25.00

• الوضع السريع — يدعمه Opus 5.5 بسعر $8.00 / $40.00 مقابل سرعة إخراج تصل إلى نحو 2.5 ضعف؛ أما Fable 5.1 فلا يدعم الوضع السريع إطلاقًا

سطر التخزين المؤقت هو ما يستحق النظر إليه مرتين، لأن النموذجين يعكسان النمط المعتاد. يمتلك Fable 5.1 المضاعف الأكثر جرأة — 2.5% من الإدخال الأساسي مقابل 5% لدى Opus 5.5 — لكن لأن قاعدته هي 10 دولارات بدلاً من 4 دولارات، فإن قراءة ذاكرته المؤقتة لا تزال الأغلى بين الاثنين بالدولار المطلق. لا توجد أي تهيئة يفوز فيها النموذج المتميز على رمز واحد من السياق المخزّن مؤقتًا. والمضاعف ليس شيئًا يمكن نقله: حلقة وكيل مضبوطة على سلوك التخزين المؤقت لدى Fable 5.1 ستدفع أكثر لكل إصابة في ذاكرة التخزين المؤقت على Opus 5.5 بشكل تناسبي، حتى وإن دفعت أقل لكل رمز جديد.

الوضع السريع هو التفاوت الأكثر حدة. تُدرِج وثائق Anthropic الوضع السريع الخاص بـ Claude Opus 5.5 وClaude Opus 5 وClaude Opus 4.8 — أما Fable 5.1 فهو غائب عن تلك القائمة. لذا يمتلك الطراز الأرخص رافعة لزمن الاستجابة لا يملكها الطراز الأغلى ببساطة، عند $8/$40، وهو لا يزال أدنى من سعر الإخراج القياسي لدى Fable 5.1 البالغ $10/$50. إذا كان عبء عملك تفاعليًا بما يكفي لدرجة أن بطء أول توكن يمثل مشكلة في المنتج، فاعلم أن زمن الوصول المقاس إلى أول توكن لدى Fable 5.1 هو 274 ثانية. هذا الرقم ناتج عن الاستدلال بأقصى جهد، وليس عيبًا، لكنه الرقم الذي سجله أحد المقيّمين.

الإعدادات الافتراضية ليست هي نفسها، وهذا هو الفخ

يضع توثيق Anthropic الخاص بالنماذج النموذجين جنبًا إلى جنب، والصف الذي يحسم معظم المقارنات الحقيقية ليس السعر. بل مستوى الجهد الافتراضي: متوسط لـ Claude Opus 5.5، مرتفع لـ Claude Fable 5.1. يعمل كلاهما بتفكير تكيّفي لا يمكن إيقافه؛ ويُتحكَّم في العمق فقط عبر معامل الجهد، على مقياس يمتد من منخفض إلى متوسط إلى مرتفع إلى xhigh إلى الأقصى.

هذا هو السبب في أن عبارة الإطلاق «يتطابق Opus 5.5 مع Fable 5.1 في معظم المهام» وجداول الاختبارات المعيارية الواقعة تحتها تبدو وكأنها متعارضة. فكثيرًا ما تكون الصفوف المباشرة التي تضعها Anthropic لـ Opus 5.5 موسومة بإعداد جهد أعلى من الافتراضي — فقد شُغّل رقم Terminal-Bench 4.0 البالغ 66.4% مقابل 55.8% لـ Fable 5.1 بإعداد جهد xhigh، وليس بالإعداد المتوسط. وفي المقابل، أُنتجت أرقام Fable 5.1 الخاصة به عند الافتراضي الأعلى لديه. والنموذجان اللذان تتم المقارنة بينهما عند إعدادي جهد مختلفين لا تتم المقارنة بينهما فعليًا على الإطلاق، وAnthropic تقول هذا صراحةً في مواد الإطلاق الخاصة بها حين تحذّر من أن هوامش الاختبارات المعيارية عند هذا المستوى من القدرة تعد دليلًا أقل موثوقية على الفرق في العالم الواقعي مما توحي به الدرجات.

عملياً، يحوّل ذلك القرار إلى تمرين ضبط بدلاً من عملية اختيار. إذا انتقلت من Fable 5.1 إلى Opus 5.5 ونقلت إعداد الجهد الخاص بك دون تغيير، فقد غيّرت بصمت مقدار التفكير الذي يقوم به النموذج، وكل رقم جودة وتكلفة تنتجه بعد ذلك يصبح مشوّشاً. إرشادات Anthropic هي اختبار مستويات جهد متعددة بدلاً من نقل إعدادات النموذج القديم. هذا رخيص التنفيذ ولا يكاد أحد يفعله، لأنه يعني تشغيل تقييماتك الخاصة مرتين.

المكان الوحيد الذي يبرّر فيه الاقتران وجوده

النمط الذي يبرر الإبقاء على كليهما هو حلقة المستشار: Opus 5.5 يقوم بالعمل، وFable 5.1 يُستشار في القرارات الصعبة. قاسته Anthropic، وهو يضيف بالفعل دقة — بتكلفة أعلى وزمن استجابة أطول، وهي المقايضة التي تتوقعها عند إدخال النموذج الأبطأ في الحلقة. ما تغيّر هو الحساب الكامن وراء ذلك. عندما كانت فجوة القدرات أوسع، كان دفع $10/$50 للإشراف على عامل بتكلفة $5/$25 يستحق ذلك بوضوح. والآن بعد أن يتفوق العامل على المستشار في المؤشر المستقل، تضيق مساهمة المستشار لتقتصر على المهام المحددة التي تتفوق فيها تقييماته الخاصة على Opus 5.5، وتلك هي المهام التي عليك تحديدها بنفسك. لا تزال الحلقة منطقية لمجموعة فرعية صعبة؛ لكنها تكف عن كونها منطقية كإعداد شامل.

كلاهما على بُعد مفتاح واحد

التفصيل المتعلق بالترحيل الذي يفاجئ الفرق هنا ليس واجهة الـ API — بل إن هذه نماذج المورّد نفسه بمقاييس جهد مختلفة، ومضاعِفات تخزين مؤقت مختلفة، وإعدادات افتراضية مختلفة، ومقارنتها بإنصاف تعني تشغيل كليهما على مطالباتك الخاصة بإعدادات متطابقة. Claude Opus 5.5 متاح على OrcaRouter بسعر Anthropic نفسه البالغ 4.00 / 20.00 دولارًاClaude Fable 5.1 متاح على OrcaRouter بسعر 10.00 / 50.00 دولارًا — سعر القائمة من المزوّد يُمرَّر بهامش ربح 0%، لذا يتحرك كلا الرقمين في اليوم الذي تُحرّكهما فيه Anthropic، ولا يحمل أيٌّ منهما عقدًا ثانيًا أو SDK ثانيًا.

A screenshot of OrcaRouter's own model page for anthropic/claude-fable-5.1, headed 'Claude Fable 5.1' and credited to Anthropic, showing $10.00 input and $50.00 output per 1M tokens and a PERFORMANCE panel with 65.8 output tokens per second, a 274.43s time to first token, 88M output tokens over 7 days and a 0.00% error rate.

وهذا ما يجعل هذا التقسيم عملياً لا نظرياً. إن إرسال الجزء الأكبر من حركة المرور لديك إلى Opus 5.5 وتثبيت قاعدة توجيه تصعّد الحالات الصعبة حقاً إلى Fable 5.1 هو إعداد على نقطة نهاية واحدة، لا تكاملان منفصلان — كما أن تركيب استدعاء بحيث يقوم أحد النموذجين بالصياغة الأولية بينما يتحقق الآخر ليس سوى سطر في routing-DSL، وليس خط أنابيب عليك بناؤه وصيانته. وإذا تبيّن أن مسار التصعيد غير مناسب لعبء العمل لديك، فإن التجاوز التلقائي عند الفشل يُبقي الطلب متجهاً إلى نموذج سبق أن توصّفت خصائصه بدلاً من أن يفشل فشلاً كاملاً.

ما الذي سيحسم الأمر؟

الوضع الصادق لهذه المقارنة هو أن Anthropic نشرت جدولاً واحداً يفوز فيه النموذج الأرخص في معظم الصفوف، ونشرت Artificial Analysis آخر يفوز فيه فوزاً كاسحاً، وكلاهما شُغِّل بإعدادات جهد لا تطرحها أنت. ولا هذه ولا تلك مقارنة مواجهة مضبوطة عند الإعدادات الافتراضية المتطابقة، ولم يُجرِ أي طرف ثالث واحدة. والفجوة التي تظل قائمة بعد كل ذلك — أن Claude Opus 5.5 أرخص بدرجة ملموسة في كل بند من بنود بطاقة الأسعار، ويدعم وضعاً سريعاً لا يدعمه Fable 5.1، وليس أدنى في النتيجة المستقلة الوحيدة المتاحة لكلا النموذجين — كبيرة بما يكفي لكي ينتقل عبء الإثبات. إذا كنت تعتمد Fable 5.1 افتراضياً، فلم يعد السؤال ما إذا كان Opus 5.5 جيداً بما يكفي؛ بل أي المهام المحددة في عبء عملك تفشل عند جهد متوسط، لأنها الوحيدة التي تدفع من أجلها علاوة السعر.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا