بطاقة رئيسية مُولّدة للمقال 'Reflection Beam مقابل Claude Opus 5.5: واحد يمكنك الاتصال به اليوم، وآخر عليك الانتظار'، بعنوان 'Reflection Beam مقابل Claude Opus 5.5' ووصف فرعي 'واحد يمكنك الاتصال به اليوم، وآخر عليك الانتظار'، وثلاث شرائح نصها 'قائمة الانتظار مقابل متاح للعموم'، و'لا سعر مقابل $4 / $20'، و'نص فقط مقابل متعدد الوسائط'.
Guides & Insights

Reflection Beam مقابل Claude Opus 5.5: أحدهما يمكنك استدعاؤه اليوم، والآخر عليك أن تنتظره

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Reflection Beam وClaude Opus 5.5 ليسا حقًا متنافسين بعد، والسبب إداري لا تقني. أُعلن عن Beam، أول نموذج من Reflection، في 5 أكتوبر 2026، وهو نموذج خليط خبراء متناثر بمعاملات تبلغ 501 مليار معامل، يُنشِّط 23 مليار معامل لكل رمز — لكن لا يمكن الوصول إليه إلا عبر قائمة انتظار، وأوزانه موعودة في وقت لاحق من هذا الشهر بموجب Apache 2.0، ولم يُنشر أي سعر في أي مكان. وصدر Opus 5.5 في 22 سبتمبر 2026 باعتباره النموذج الرائد من Anthropic: نافذة بمليون رمز، وإدخال نصي وصوري وملفات، وسعر مُدرج قدره 4.00 دولارات لكل مليون رمز إدخال و20.00 دولارًا لكل مليون رمز إخراج. لذا فإن النسخة الصادقة من هذه المقارنة هي أنه يمكنك وضع أحد هذين النموذجين في الإنتاج بعد ظهر اليوم بتكلفة معروفة، أما الآخر فلا يمكنك — وكل ما تبقى هنا هو توقّع لما سيحدث عندما تصل الأوزان.

الإجابة المختصرة

إذا كان السؤال هو أي نموذج يجب البناء عليه هذا الأسبوع، فإن الجواب هو Opus 5.5 دون جدال يُذكر: فهو متاح بشكل عام، مُقيَّم بشكل مستقل، متعدد الوسائط، له سعر، ويُقدَّم عبر API يمكنك الاتصال به في غضون خمس دقائق. لا تقوم حجة Beam على التغلب على Opus 5.5 — فلا شيء في مواد Reflection الخاصة يدّعي ذلك. إنها ترتكز على فرضية أضيق بكثير: أنه عند درجة استدلال معينة، يستهلك Beam حوالي ربع الطاقة الحاسوبية للاستدلال. إذا ثبت ذلك عندما يقيسه شخص من خارج Reflection، يصبح Beam مثيرًا للاهتمام للأعمال ذات الحجم الكبير حيث يجب أن تكون الإجابة جيدة ولكن ليس الأفضل. إذا لم يحدث ذلك، فإن Beam هو نموذج مفتوح من الفئة المتوسطة مع قائمة انتظار.

ما يلي يفصل بين أجزاء هذه المواجهة التي هي حقائق اليوم والأجزاء التي هي رهانات.

ما هو كل نموذج، على وجه الدقة

Opus 5.5 هو الخلف المغلق والمستضاف لـ Claude Opus 5، وتضعه Anthropic لتغييرات متعددة الخطوات عبر قواعد شيفرة كبيرة، ومراجعة الشيفرة، وجلسات مستقلة طويلة. يقبل النصوص والصور والملفات، ويعيد النصوص، ويوفر نافذة سياق تبلغ 1,000,000 رمز مع ما يصل إلى 128,000 من رموز الإخراج، ويكشف عن التفكير الموسّع بجهد استدلال قابل للضبط. وهو ليس بأوزان مفتوحة، ومعرفته محدودة بحد التدريب لدى Anthropic بدلاً من أي شيء تتحكم به.

Reflection Beam هو البناء المعاكس. يبلغ إجمالي معاملاته 501 مليار معامل، منها 23 مليارًا نشطة — نحو 4.6 في المئة من النموذج نشطة لكل توكن، وهي نسبة عدوانية حتى مقارنة بنحو 5.4 في المئة لدى GLM 5.2 — وقد صُمّم ليكون رخيص الخدمة بدلًا من رخيص التدريب. وهو نصّي فقط. سياق API الخاص به هو 256,000 توكن مع حاشية تحذيرية بأن الرقم قد يتغير أثناء النسخة التجريبية، وأقصى مخرجات له 128,000 توكن. نقطة النهاية متوافقة مع OpenAI عند api.reflection.ai/openai/v1 وتتيح Chat Completions إضافة إلى قائمة Models ولا شيء آخر. تقبل المعلمة reasoning_effort خمس قيم، وقيمتها الافتراضية medium، ولا يمكن تعطيلها.

• السعر — Claude Opus 5.5 بسعر 4.00 دولارات للإدخال و20.00 دولارًا للإخراج لكل مليون توكن، مع قراءات الذاكرة المؤقتة عند 0.20 دولار وكتابات الذاكرة المؤقتة عند 5.00 دولارات، مقابل Reflection Beam: غير منشور في تدوينة المدونة أو التوثيق أو قائمة النماذج.

• التوافر — Opus 5.5 متاح عمومًا اليوم؛ Beam عبارة عن قائمة انتظار لنسخة تجريبية، مع وعود بتوفير الأوزان والتقرير الفني وبطاقة النموذج في وقت لاحق من هذا الشهر.

• الوسائط — يستقبل Opus 5.5 النصوص والصور والملفات؛ أما Beam فيستقبل النصوص فقط.

• السياق — 1,000,000 رمز مقابل 256,000، مع رقم Beam الذي يحمل تحفظًا تجريبيًا (بيتا).

• أوزان مفتوحة — لا بالنسبة إلى Opus 5.5، وُعدت بموجب Apache 2.0 من أجل Beam، ولم تُسلَّم بعد.

• درجة مستقلة — Opus 5.5 يحمل واحدة؛ أما Beam فلا.

A generated two-column scoreboard titled 'Reflection Beam vs Claude Opus 5.5 — the scoreboard'. Left column 'Reflection Beam': Availability waitlisted beta; Price not published; Context 256,000 tokens (beta); Input text only; Open weights promised Apache 2.0, not out; Independent score none yet. Right column 'Claude Opus 5.5': Availability generally available; Price $4.00 / $20.00; Context 1,000,000 tokens; Input text, image, file; Open weights no; Independent score AA index 57.6. Footer reads 'Beam figures vendor-reported and unaudited. Opus 5.5 price is the provider list rate; its index is Artificial Analysis, read 6 October 2026.'

السعر هو الجزء الذي لا يُقارَن

إنّ مبلغي 4.00 $ و20.00 $ الخاصين بـ Opus 5.5 هما السعر المدرج لدى المزوّد، وفي الكتالوج لدينا يُمرَّران كما هما دون تغيير ودون أي إضافة. قراءات الذاكرة المؤقتة بسعر 0.20 $ وكتابات الذاكرة المؤقتة بسعر 5.00 $ بالغة الأهمية لعبء العمل الذي يُباع Opus 5.5 من أجله — جلسة وكيلية طويلة تعيد قراءة قاعدة الشيفرة نفسها البالغة 200,000 رمز، دورًا بعد دور، فتدفع سعر الذاكرة المؤقتة على معظمها تقريبًا، لا سعر الإدخال. هذه رافعة حقيقية وكثيرًا ما يُقلَّل من تقديرها، ويجدر بنمذجتها قبل أن تستنتج أن نموذجًا متقدمًا خارج الميزانية.

لا يملك Beam رقمًا قابلًا للمقارنة. لا يوجد سعر قائمة تُقارَن به، ولا طبقة ذاكرة تخزين مؤقت يمكن نمذجتها، ولا سعر معلن للنسخة التجريبية. ولم توضح Reflection ما إذا كان Beam سيُباع لكل رمز، أو يُحاسَب لكل مقعد، أو يُمنح مجانًا مع الأوزان. أي شخص يذكر تكلفة لكل مليون لـ Beam اليوم فهو يختلقها.

النتيجة العملية: مقارنة السعر ليست «Opus 5.5 غالٍ وBeam أرخص». بل هي «أحدهما له سعر والآخر له موعد». وبالنسبة لفريق يقرر اليوم، فإن هذا التفاوت يحسم أكثر مما تحسمه المقاييس المعيارية.

المعايير المرجعية: الرقمان المتداخلان، ولماذا لا يزالان غير قابلين للمقارنة

لا تتضمن جداول الإطلاق الخاصة بـ Reflection الطراز Opus 5.5، ولا أي نموذج مغلق من الطراز المتقدّم. فمجموعة المقارنة لديها مفتوحة بالكامل أو شبه مفتوحة: Inkling وNemotron 3 Ultra وGLM 5.2 وGLM 5.3 وKimi K3 وQwen 3.8-Max وDeepSeek V4.1 Flash. لذا فإن أي جدول يقارن Beam بـ Opus لا بد أن يُجمَّع يدويًا، وتجميعه بأمانة يعني تسمية اختلافات منظومة التقييم بدلًا من التغطية عليها.

يوجد بالضبط معياران فقط يمتلك فيهما كلا النموذجين رقمًا منشورًا، ولا يخضع أيّ من الاقترانين للتحكم.

• Humanity's Last Exam — يُفيد Reflection بأن Beam عند 36.2 دون أدوات؛ وتُسجّل Artificial Analysis أن Opus 5.5 عند 61.4. منظومتا اختبار مختلفتان، وإعدادان مختلفان — رقم Opus 5.5 ليس موسومًا بأنه دون أدوات — وفجوة مقدارها خمس وعشرون نقطة تقول عن النماذج أقل مما تقوله عن طريقة الإعداد.

• SciCode — يُفيد Reflection بأن Beam بلغ 49، بينما تسجّل Artificial Analysis الرقم 66.9 لـ Opus 5.5. الاختبار المرجعي نفسه، والمشكلة نفسها: أحد الرقمين نتاج تشغيل المورّد نفسه، والآخر نتاج منصّة اختبار تابعة لطرف ثالث.

كل ما تبقى لا يتقاطع على الإطلاق. جدول Beam مبني على Terminal-Bench v2.1، بينما مؤشر Artificial Analysis الحالي يعمل على Terminal-Bench 4.0 — وهي نسخة مختلفة من المجموعة نفسها، ولهذا فإن نتيجة Beam البالغة 80.1 ونتيجة Opus 5.5 البالغة 59.6 على تلك اللوحة ليستا مقارنة ولا ينبغي أبدًا طباعتهما جنبًا إلى جنب. أما على المؤشر نفسه، فإن Artificial Analysis يضع Opus 5.5 عند 57.6 في إعداد Max / Default Fallback، في المرتبة الرابعة من بين 147 نموذجًا في تلك الجولة. ولا يوجد لـ Beam أي صف في المؤشر: فصفحات النموذج تُرجع 404، ولا تحمل لوحة الصدارة أي إدخال لـ Beam حتى صباح اليوم.

التصريح المستقل حقًا الوحيد المسجَّل بشأن Beam هو ما قالته Artificial Analysis في 5 أكتوبر، إن Reflection كانت قد منحتها حق الوصول، وإنها كانت تقيّم النموذج بشكل مستقل — وإن المؤشرات المبكرة تشير إلى أن Beam سيكون واحدًا من أكثر النماذج المفتوحة كفاءةً في استخدام الرموز التي رأتها بالنسبة إلى مستوى ذكائه. هذه جملة قوية من المصدر الصحيح، لكنها لا تزال جملة بلا رقم. والرقم هو ما سيحسم هذه المواجهة.

A screenshot of the OrcaRouter model page for Claude Opus 5.5 (anthropic/claude-opus-5.5), captured 6 October 2026, showing the model name and id, Imtokens context, Max output 128K, input text + image + file, Vision & Tools and JSON Reasoning tags, the INPUT $4.00 and OUTPUT $20.00 pricing tiles, p50 TTFT 5.81 s, p95 TTFT 10.00 s, 48.5M tokens of 7-day traffic, the benchmark provenance lines 'Public benchmarks by Anthropic - 2026-09-22' and 'AI Analysis', and a code sample using base_url https://api.orcarouter.ai/v1.

حيث يُلقي ادّعاء الكفاءة بثقله الفعلي

حجة Reflection ليست أن Beam أذكى من نموذج رائد. بل إن Beam تحقق نتائج مماثلة لـ GLM 5.2 بينما تستخدم حوسبة استدلال أقل بمقدار 3 إلى 4 أضعاف، وإن الفجوة تتسع في مواجهة النماذج من فئة التريليوني معامل التي يقع ضمنها Qwen 3.8-Max. ويقدّر المخطط الكامن خلف ذلك عمليات FLOPs المولّدة على أنها ضعف عدد المعاملات النشطة مضروبًا في متوسط الرموز المولّدة في كل محاولة، ويقرّ الشرح التوضيحي الخاص به بأن هذا يستبعد التعبئة المسبقة للموجّه، والانتباه، والأعباء الإضافية للخدمة.

إذا أخذنا ذلك على ظاهره، فإن الهدف المثير للاهتمام ليس Opus 5.5 على الإطلاق — بل منتصف السوق. يتنافس Opus 5.5 على القدرة لكل مهمة ويفوز في المهام التي تحتاج إلى حكم: إعادة الهيكلة متعددة الخطوات، ومراجعة الشيفرة، والعمل الذي تكلف فيه إجابة خاطئة أكثر من الرموز. أما النموذج الذي يكون فيه 4.6 في المائة فقط مستيقظًا لكل رمز، فيتنافس على التكلفة لكل مهمة ويفوز حيث يكون الحجم هو المسيطر وحيث يكون معيار الجودة "جيدًا بما يكفي ويُتحقق منه في المراحل اللاحقة". هذان منتجان مختلفان، والمقارنة التي تضع Beam في مواجهة Opus 5.5 على لوحة نتائج واحدة تقيس الشيء الخطأ.

ثمة أثر من الدرجة الثانية يستحق التسمية. إذا صحّ ادعاء الكفاءة الخاص بـ Beam، فإن موطنه الطبيعي هو نوع أعباء العمل التي لولا ذلك لأنفقت فيها رموز نموذج متقدم على مهمة يفوقها قدرةً. هذا قرار توجيه، لا اختيار نموذج، وهو السبب في أن مسألة السعر تهم أكثر من مسألة المعيار المرجعي هنا: فلا يمكنك التوجيه بناءً على التكلفة إلى نموذج بلا تكلفة.

تشغيلهما جنبًا إلى جنب، عندما يكون Beam قابلاً للاستدعاء

Opus 5.5 متاح في كتالوجنا اليوم بسعر 4.00 و20.00 دولار لكل مليون رمز، بسعر القائمة كما هو دون أي إضافة، وهو يأتي إلى جانب أكثر من 200 طراز آخر خلف مفتاح واحد متوافق مع OpenAI على api.orcarouter.ai/v1. إذا أردت إجراء اختبار A/B لعبء عمل بين طراز رائد وطراز مفتوح رخيص، فهذا هو شكل الإعداد: معرّفا طرازين، ومفتاح واحد، ولا عقد ثانٍ ولا تغيير في الشيفرة — كما أن التحويل التلقائي عند الفشل في التوجيه يعني أن تعثّر مزوّد ما لن يجرّ خط أنابيبك معه.

لا يمكن أن يكون Beam جزءًا من ذلك بعد، ولن نتظاهر بغير ذلك. Reflection Beam ليس أحد مساراتنا، ولن نوجهك إلى أي جهة قد تعيد بيعه. عندما تنزل الأوزان بموجب Apache 2.0، ستتمكن من استضافته بنفسك وتوجيه الطلبات إلى نقطة النهاية الخاصة بك؛ وحتى ذلك الحين، المسار الوحيد هو قائمة انتظار Reflection.

بالنسبة لعبء عمل يتطلب حقًا نموذجًا رائدًا، فإن المقارنة التي ينبغي إجراؤها ليست مع Beam. بل مع كل ما عداه في الكتالوج: GLM 5.3 بسعر $1.26 و$3.96، وQwen 3.8-Max بسعر $2.00 و$6.00، وDeepSeek V4.1 Flash بسعر $0.15 و$0.60، وكلها قُرئت مباشرة هذا الصباح. هذه هي الفئة التي سيحل فيها Beam إذا سعّر بشكل تنافسي، وهي محيط أصعب بكثير مما يوحي به مخطط الإطلاق.

A generated single-column card titled 'Reflection Beam — the state of play, 6 October 2026', used as the article's closing fact sheet. Rows read 'Total / active parameters: 501B / 23B', 'Pre-training: 23.8T tokens on 6,144 GB300, under four weeks', 'RL campaign: 10.5K GB300, 4 weeks, 100M+ rollouts', 'API context: 256,000 tokens, beta footnote', 'Reasoning effort: five levels, default medium, no off switch', 'Price: not published anywhere' and 'Independent score: none yet - no Artificial Analysis row'. The footer reads 'Vendor-reported; nothing independently reproduced. Weights, tech report and model card promised later this month.'

ما الذي قد يغيّر هذا الحكم؟

ثلاثة أمور، مرتبة حسب مدى أهميتها.

صف Artificial Analysis الخاص بـ Beam. ليس الإعلان بأن واحدًا قادم — بل الصف نفسه. إذا استقر المؤشر قرب 57.6 الخاصة بـ Opus 5.5 بينما يصمد ادعاء كفاءة التوكن عند اختباره بأداة تقييم خارجية، فإن وسط السوق يصبح غير مريح حقًا، ويغدو Beam الخيار الافتراضي لكثير من الأعمال عالية الحجم. وإذا استقر أقرب إلى مجموعة الأوزان المفتوحة في الأربعينيات المنخفضة، فسيكون Beam نموذجًا رخيصًا متينًا ولا شيء أكثر.

سعر. لا يمكن لنموذج بلا سعر قائمة أن يفوز في جدال التكلفة، لأنه لا يوجد ما يُقارَن به. إذا جاء Beam بأقل من فئة GLM 5.3، فإن قصة الكفاءة تتحول إلى قصة ميزانية بسرعة كبيرة. وإذا جاء أعلى من سعرَي DeepSeek V4.1 Flash البالغين 0.15 دولار و0.60 دولار دون تفوق في القدرات، فسيواجه صعوبة في العمل ذي الحجم الكبير الذي صُمّم من أجله.

الأوزان. إلى أن توجد، فإن «الأوزان المفتوحة» تصريح بشأن رخصة لم تُمنح، ولا يستطيع أحد التحقق من حساب FLOPs لكل نقطة مقابل نموذج يستطيعون تشغيله فعليًا. هذا هو الفحص الذي دعت إليه Reflection ولم تجعله ممكنًا بعد.

حتى يتحقق أحد هذه على الأقل، ليس الخيار العملي متقاربًا. Opus 5.5 هو النموذج الذي يمكنك التفكير فيه، وحساب تكلفته، والشحن عليه. أما Beam فهو النموذج الذي تراقبه.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا