بطاقة رئيسية مُنشأة بعنوان Claude Sonnet 5.5 vs Muse Glimmer، وبعنوان فرعي: نموذج حاسوب محمول بسعة 30B مقابل Sonnet الجديد، مع ثلاث بطاقات إحصائية: مؤشر الذكاء 56 مقابل 17، ونافذة السياق 1M مقابل 131K رمزًا، والأوزان مغلقة مقابل Apache 2.0، مع تذييل نصه: المؤشر وفق Artificial Analysis v4.3.2؛ ومواصفات Muse Glimmer وفق Meta.
Guides & Insights

Claude Sonnet 5.5 مقابل Muse Glimmer: نموذج 30B لحاسوب محمول في مواجهة Sonnet الجديد

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

السؤال التأطيري لهذه الصفحة هو ما إذا كانت المقارنة مشروعة أصلاً، والجواب الصادق هو أن Claude Sonnet 5.5 و Muse Glimmer ليسا متنافسين بالمعنى العادي. في مؤشر الذكاء Intelligence Index من Artificial Analysis، الإصدار v4.3.2، يسجّل Claude Sonnet 5.5 نتيجة 56 ويسجّل Muse Glimmer نتيجة 17، وهذه الفجوة ليست ضجيجاً — إنها تقريباً المسافة بين نموذج عام طليعي ونموذج صغير جيد جداً. وما يجعل هذا الاقتران جديراً بالقراءة على أي حال هو أن Muse Glimmer يمتلك خاصية واحدة لا يستطيع الآخر شراءها بأي ثمن: فهو نموذج مفتوح الأوزان بـ30 مليار معامل، نشرته M​eta في 10 أغسطس 2026 بموجب Apache 2.0، ومُكمَّم إلى 4 بتات بحيث يتسع في أقل من 20 GB من VRAM، ومصمّم ليعمل والشبكة غير موصولة. وصل Claude Sonnet 5.5 في 28 سبتمبر 2026 بوصفه أسرع وأذكى Sonnet من المورّد، بسعر 2.00 دولار لكل مليون رمز إدخال و10.00 دولار لكل مليون رمز إخراج، ولا يمكن الوصول إليه إلا عبر الشبكة. القرار الحقيقي ليس أي النموذجين أفضل. بل أين تريد أن تعمل الرموز.

نموذجان، وتعريفان للوظيفة

يأتي Muse Glimmer من Meta Superintelligence Labs بوصفه نموذجًا بمعاملات 30B دُرِّب عبر تقطير logits من معلّم Meta الأكبر Muse Spark، ثم ضُبِط ضبطًا دقيقًا على بيانات وكيلية طويلة السياق وعُزِّز لاستخدام الأدوات. أطلقته Meta وهو مكمَّم بالفعل: إذ ينقل التكميم 4-بت البصمة الذاكرية من أكثر من 55 GB عند الدقة الكاملة إلى أقل من 20 GB، وهو ما يضعه ضمن نطاق GPU استهلاكي بسعة 24 GB أو 32 GB. اختبرته Meta على Nvidia RTX 5090 وعلى شرائح Apple M4 Max وM5 Max. يستقبل مدخلات نصية وصورية، ويعيد نصًا، ويعمل بنافذة سياق تبلغ 131,072 رمزًا تقول Meta إنه يمكن تمديدها إلى 262,144، ويحمل حدًا معرفيًا بتاريخ يناير 2026.

Artificial Analysis model page for Muse Glimmer (high), an open-weights model released August 2026, showing an Intelligence Index of 17, an output speed of 143.8 tokens per second, $0.325 per million input tokens and $1.35 per million output tokens, $0.06 per Intelligence Index task, 59M output tokens generated during the Index evaluation, a 131K-token context window and a January 2026 knowledge cutoff.

Claude Sonnet 5.5 هو النموذج الثاني في الجيل 5.5 من A​nthropic، وهو النموذج الذي تصفه الشركة بأنه أفضل توليفة بين السرعة والذكاء في تشكيلتها. يعمل بنافذة تبلغ 1,000,000 رمز، وبحد أقصى 128,000 رمز إخراج بشكل متزامن و300,000 عبر واجهة Message Batches API خلف الترويسة output-300k-2026-03-24، ويقبل النصوص والصور والملفات، ويقدّم تفكيرًا تكيّفيًا بجهد قابل للاختيار مع تاريخ قطع في يونيو 2026، وهو متاح مع عدم الاحتفاظ بالبيانات منذ الإطلاق. تبلغ تكلفة التخزين 0.20 دولار لكل مليون رمز عند قراءات الذاكرة المؤقتة و2.50 دولار لكل مليون عند الكتابة إليها. وتقول A​nthropic إنه يعمل بسرعة تفوق Claude Sonnet 5 بنسبة 30% ويكلّف أقل بنسبة تصل إلى 30% لكل مهمة بالأسعار نفسها — وهي ادعاءات من المورّد، لم يُعَد إنتاجها بشكل مستقل.

يستحق تباين المواصفات أن يُرى دفعة واحدة، لأن كل سطر تقريبًا يمثل نوعًا مختلفًا من الأشياء لا شيئًا أفضل أو أسوأ:

• الأوزان — Muse Glimmer Apache 2.0، قابل للتنزيل، مُكمَّم إلى 4 بت مقابل Claude Sonnet 5.5 المغلق

• أين يعمل — Muse Glimmer على وحدة معالجة الرسومات الخاصة بك، دون اتصال، مقابل Claude Sonnet 5.5 على البنية التحتية لـ A​nthropic

• المعاملات — إجمالي Muse Glimmer 30B، أقل من 20 غيغابايت عند 4-بت مقابل Claude Sonnet 5.5 غير معلن

• السياق — Muse Glimmer ‏131,072 رمزًا، قابل للتوسيع إلى 262,144، مقابل Claude Sonnet 5.5 ‏1,000,000 رمز

• السعر لكل مليون — Muse Glimmer بدون رسوم لكل رمز، عتادك مقابل Claude Sonnet 5.5 $2.00 إدخال / $10.00 إخراج

• مؤشر الذكاء v4.3.2 — Muse Glimmer 17 مقابل Claude Sonnet 5.5 56

• التكلفة لكل مهمة Index كما تم قياسها — Muse Glimmer 0.06 دولار مقابل Claude Sonnet 5.5 7.60 دولار

هناك رقمان في تلك القائمة يستحقان التفكيك، لأن كليهما فخ. الأول هو رقم $0.06 لكل مهمة: فهو ما أنفقته Artificial Analysis عند استدعاء Muse Glimmer (high) عبر نقطة نهاية مستضافة بتكلفة $0.325 لكل مليون من رموز الإدخال و$1.35 لكل مليون من رموز الإخراج، لذا فهو يقيس اقتصاديات استئجار هذا النموذج، لا تشغيله. عند الاستضافة الذاتية، تختفي التكلفة الحدية لكل رمز وتُستبدل بوحدة GPU تملكها بالفعل أو يتعين عليك شراؤها. والثاني هو فجوة Index نفسها — إذ يجري تقييم نموذج بحجم 30B مكمَّم إلى 20 GB بالمسطرة نفسها المستخدمة للنماذج الرائدة، وتقول لوحة الصدارة الشيء نفسه عندما تضع Muse Glimmer ضمن أفضل مجموعة صغيرة من النماذج مفتوحة الأوزان مع الإشارة إلى أنه مكلف بالنسبة إلى حجمه.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Muse Glimmer, the scoreboard, contrasting weights closed vs Apache 2.0, where it runs Anthropic infrastructure vs your own GPU offline, parameters undisclosed vs 30B at 4-bit, context window 1,000,000 vs 131,072 tokens, AA Index 56 vs 17, and output speed 138.7 vs 143.8 tokens per second, with a footer reading AA Index and speed per Artificial Analysis v4.3.2; Muse Glimmer specifications per Meta.

حيث يكون Muse Glimmer جيدًا حقًا، وحيث تنهار الأمور

النتيجة المركبة أكثر تبسيطًا من أن تكون الإجابة الكاملة، لأن Muse Glimmer ليست سبعة عشر بشكل موحّد. إنها سريعة — يقيس Artificial Analysis 143.8 توكن إخراج في الثانية، متقدمة على 138.7 لدى Claude Sonnet 5.5 — وموجزة، إذ تولّد 59 مليون توكن عبر تقييم Index مقابل 410 ملايين لدى Claude Sonnet 5.5. وفي أحد التقييمات تكون قريبة من الطليعة: استدعاء السياق الطويل، حيث تسجّل 83.3% مقابل 82.7% لدى Claude Sonnet 5.5. إن نموذجًا بحجم 30 مليار يضاهي Sonnet الحدودي الجديد تمامًا في استرجاع السياق الطويل هو أكثر سطر مفاجئ في هذه الصفحة، وهو متسق مع الطريقة التي درّبتها بها Meta — بيانات وكيلية للسياق الطويل، وتقطير من معلّم أكبر بكثير.

النتائج الوكيلية هي حيث يظهر سقف النموذج، وعندها يتوقف الترتيب عن كونه مُجاملًا. في Terminal-Bench 4.0، يسجل Muse Glimmer نسبة 0.5% مقابل 63.6% لـ Claude Sonnet 5.5. ودرجته في اختبار الأداء الآلي هي 0.068 مقابل 0.713. Humanity's Last Exam: 22.0% مقابل 55.0%. إن إخراجًا بهذا الحجم الصغير في اختبار أداء تنفيذي يعني أن النموذج لا يكمل المهام، ولا يوجد توفير من الاستضافة المحلية يجعل مهمة لا تنتهي أبدًا أرخص.

الأدبيات البحثية صريحة بشأن هذا أيضًا، ويستحق التصريح به بدلًا من دفنه: دراسة مُحكّمة حول تنسيق وكلاء متعددين، كان Muse-Glimmer-30B أحد النماذج المُختبرة فيها، وجدت أنه لم يسترجع أيًا من مرشحيه. جدول القياس المرجعي الخاص بـ M​eta لهذا النموذج هو مستند مورّد ومُوسم على هذا النحو هنا؛ أرقام Artificial Analysis أعلاه هي قياسات مستقلة، وهي التي يعتمد عليها هذا المقال.

إذن فالفصل واضح. Muse Glimmer قوي بالنسبة لحجمه في قراءة مُدخل طويل والإجابة عنه، وسريع، ورخيص التشغيل، ويتّسع في وحدة معالجة رسومات من فئة الحواسيب المحمولة. لكنه ليس النموذج الذي تُسلّمه مهمة برمجية متعددة الخطوات ثم تنصرف. هذا هو الحد الصادق، والمقارنة المكتوبة حول الدرجات المركّبة وحدها ستخفيه.

ما الذي تشتريه فعلاً بسعر الحدود القصوى

تشتري العلاوة السعرية لـ Claude Sonnet 5.5 القدرة أولاً، وفجوة السبعة عشر نقطة في المؤشر هي أبرز تجلٍّ لذلك. لكن ثمة ثلاثة أمور أخرى تأتي مع سعر الإخراج البالغ $10.00 ولا تظهر على أي لوحة صدارة.

الأول هو النافذة. مليون رمز يعادل تقريبًا سبع مرات ونصف مقدار 131,072 لدى Muse Glimmer، وتتقاضى Anthropic السعر القياسي على كامل ذلك، مع قراءات ذاكرة التخزين المؤقت بعُشر سعر الإدخال، بحيث يصبح حمل سياق كبير عبر العديد من الاستدعاءات ميسور التكلفة وليس نظريًا فقط. لا يتسع موجّه بحجم مستودع في النافذة الأصغر على الإطلاق، لذا فإن هذا فرق في القدرات وليس تفضيلًا.

الثاني هو دقة الأدوات. تغيّرت خمسة سلوكيات بين Claude Sonnet 5 وClaude Sonnet 5.5، وكلها تتعلق باستخدام الأدوات والاستدلال: معاملات أخذ العينات غير الافتراضية تُرجع الآن 400، thinking: {"type": "disabled"} تُرجع الآن 400 وتصبح between_tools، اختيار الأداة القسري لـ "any" أو أداة مُسمّاة يُرفض لذا يجب أن تنتقل الحلقات إلى auto مع استخدام صارم للأدوات، الأداة الأقدم computer_20251124 تُرفض على Claude API وGoogle Cloud، كما أصبحت كتل التفكير مرتبطة بالنموذج والحساب المُنتِجين. هناك تغيير سادس لا يُفشل شيئًا لكنه يصمت: يعود النص بين نداءات الأدوات داخل كتل التفكير، لذا يتوقف تطبيق بثّي عن إظهار المخرجات حتى يضبط قيمة عرض أو يوقف التفكير المسبق. هذا يوم من عمل الترحيل لأي شخص يستخدم Sonnet 5، وهو ثمن الدخول إلى الموثوقية الوكيلية التي تقيسها صفوف المعايير أعلاه.

الثالث هو المصدرية والتعامل مع البيانات. يتوفر الاحتفاظ الصفري بالبيانات منذ الإطلاق، وتنشر Anthropic حدًا أدنى للإيقاف هو 28 سبتمبر 2027، والنموذج متاح على Claude API وBedrock وGoogle Cloud وMicrosoft Foundry. بالنسبة للمشتري الخاضع للتنظيم، هذه حقائق شرائية تحسم قرار الشراء قبل أن تفعل ذلك اختبارات الأداء.

العمل دون اتصال شرطٌ، وليس توفيرًا للتكاليف

سببُ انتماء هذا الاقتران إلى صفحة واحدة هو أنه بالنسبة لفئة محددة من عمليات النشر، لا يكون Muse Glimmer خيارًا أرخص، بل الخيار الوحيد. طلبٌ لا يمكن أن يغادر الجهاز، أو أرضية مصنع أو موقع ميداني بلا اتصال، أو بيئة معزولة شبكيًا يُعدّ فيها استدعاء API انتهاكًا للامتثال، أو ميزانية زمن استجابة صارت فيها رحلة الذهاب والإياب مكلفة أكثر من اللازم: لا شيء من هذه الحالات يُحلّ بنموذج أفضل يقف خلف شبكة. أوزان Apache 2.0 التي تقلّ عن 20 GB وتعمل دون اتصال هي الإجابة الكاملة، وClaude Sonnet 5.5 بأي سعر لا يشارك في المعادلة.

تُعد اختبارات Meta المنشورة على شرائح RTX 5090 وApple M4 Max وM5 Max هي المرجع العملي لمعنى «التشغيل محليًا» هنا، والتكميم بدقة 4 بت هو ما يجعل هذه الأهداف قابلة للتحقيق من الأساس — إذ يتجاوز حجم البصمة بالدقة الكاملة 55 GB. ينبغي لأي شخص يخطط لعملية نشر أن يتعامل مع أرقام العتاد على أنها أرقام Meta وليست مقيسة هنا.

بالنسبة لكل الآخرين، النموذجان مكمّلان لبعضهما وليسا بديلين، والجزء العملي المحرج هو أن امتلاك نموذج Anthropic API ونموذج Meta المستضاف ذاتيًا يعني عادةً حزمتين منفصلتين تمامًا. يضع OrcaRouter أكثر من 200 نموذج خلف نقطة نهاية واحدة متوافقة مع OpenAI مع تمرير سعر قائمة المزوّد كما هو دون إضافة هامش، التبديل التلقائي عند الفشل بين مزوّدي المنبع وDSL لتوجيه الطلبات لتأليف الاستدعاءات — وهو ما يغطي النصف المستضاف من هذا الترتيب، و معلّم Meta الأكبر Muse Spark 1.2 قابل للتوجيه هنا باسم meta/muse-spark-1.2 بسعر 1.25 دولار للإدخال و4.25 دولار للإخراج لكل مليون رمز ضمن نافذة سعة 1,048,576 رمزًا، مع قراءات ذاكرة مؤقتة بسعر 0.15 دولار. وهو يحمل 42.8 مليون رمز من حركة المرور أسبوعيًا عبر هذا الكتالوج، وهو الجزء المفيد من الترتيب: المعلّم المستضاف على المفتاح نفسه مثل كل شيء آخر، والنموذج الذي تشغّله محليًا لا يضطر أبدًا إلى لمس أي شبكة على الإطلاق.

ثلاث ملاحظات صريحة، لأن من السهل أن يُخطئ فيها. Muse Glimmer نفسه ليس أحد مساراتنا — لا توجد بطاقة الطراز في كتالوجنا، وهذه الصفحة تقول ذلك صراحةً بدلًا من الإيحاء بخلاف ذلك. اللقطة أدناه هي صفحة الطراز الموجود فعلًا، Muse Spark 1.2، وهو نقطة التحقق التي استُخلص منها Muse Glimmer وليس Muse Glimmer نفسه. كما أن Claude Sonnet 5.5 ليس في كتالوجنا أيضًا، بعد يوم واحد من إطلاقه؛ والمسار إليه هو واجهة A​nthropic البرمجية الخاصة به، وأصبح Claude Sonnet 5 قابلًا للتوجيه هنا منذ 30 يونيو بسعر 2.00 دولار و10.00 دولار لمن يريد هدف النشر التجريبي.

OrcaRouter model page for meta/muse-spark-1.2, dated 2026-08-05, showing $1.25 input and $4.25 output per million tokens, a p50 time to first token of 2.05 s, a 1,048,576-token context window, and 42.8M tokens of recent traffic.

كيف تقرر

ابدأ من القيد، لا من الدرجة. إذا كان الطلب لا يمكن أن يغادر جهازًا أو شبكة، فإن Muse Glimmer هو الجواب وفجوة Index ليست ذات صلة — نموذج 30B برخصة Apache 2.0 يعمل دون اتصال ويضاهي نموذجًا رائدًا في استدعاء السياق الطويل هو، لهذه المهمة، أفضل ما هو متاح. وإذا كان على الطلب إنجاز مهمة برمجية متعددة الخطوات، فإن نموذجًا بحجم 30B يسجل نصف في المئة على Terminal-Bench ليس في السباق بغض النظر عن العتاد الذي تملكه بالفعل.

بين هذين القطبين، العامل الحاسم هو القياس لا الرأي: عدد الرموز لكل مهمة مكتملة على عبء العمل الخاص بك، مسعّرة مرتين — مرة بسعر Claude Sonnet 5.5 البالغ 2.00 دولار و10.00 دولارات، ومرة بالتكلفة المطفأة لوحدة معالجة الرسوميات (GPU). الرقم الوحيد الذي يعيد تأطير المقارنة بأكملها، 0.06 دولار لكل مهمة Index مقابل 7.60 دولار، هو رقم استئجار مستضاف لنموذج سيشغّله معظم الناس بأنفسهم، واقتباسه كما لو كان توفيرًا مماثلًا سيكون الخطأ السهل الذي توجد هذه الصفحة لتجنبه.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا