
Claude Sonnet 5.5 مقابل Muse Glimmer: نموذج 30B لحاسوب محمول في مواجهة Sonnet الجديد
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 931 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 192 tok/s
- OrcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- xAISpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
السؤال التأطيري لهذه الصفحة هو ما إذا كانت المقارنة مشروعة أصلاً، والجواب الصادق هو أن Claude Sonnet 5.5 و Muse Glimmer ليسا متنافسين بالمعنى العادي. في مؤشر الذكاء Intelligence Index من Artificial Analysis، الإصدار v4.3.2، يسجّل Claude Sonnet 5.5 نتيجة 56 ويسجّل Muse Glimmer نتيجة 17، وهذه الفجوة ليست ضجيجاً — إنها تقريباً المسافة بين نموذج عام طليعي ونموذج صغير جيد جداً. وما يجعل هذا الاقتران جديراً بالقراءة على أي حال هو أن Muse Glimmer يمتلك خاصية واحدة لا يستطيع الآخر شراءها بأي ثمن: فهو نموذج مفتوح الأوزان بـ30 مليار معامل، نشرته Meta في 10 أغسطس 2026 بموجب Apache 2.0، ومُكمَّم إلى 4 بتات بحيث يتسع في أقل من 20 GB من VRAM، ومصمّم ليعمل والشبكة غير موصولة. وصل Claude Sonnet 5.5 في 28 سبتمبر 2026 بوصفه أسرع وأذكى Sonnet من المورّد، بسعر 2.00 دولار لكل مليون رمز إدخال و10.00 دولار لكل مليون رمز إخراج، ولا يمكن الوصول إليه إلا عبر الشبكة. القرار الحقيقي ليس أي النموذجين أفضل. بل أين تريد أن تعمل الرموز.
نموذجان، وتعريفان للوظيفة
يأتي Muse Glimmer من Meta Superintelligence Labs بوصفه نموذجًا بمعاملات 30B دُرِّب عبر تقطير logits من معلّم Meta الأكبر Muse Spark، ثم ضُبِط ضبطًا دقيقًا على بيانات وكيلية طويلة السياق وعُزِّز لاستخدام الأدوات. أطلقته Meta وهو مكمَّم بالفعل: إذ ينقل التكميم 4-بت البصمة الذاكرية من أكثر من 55 GB عند الدقة الكاملة إلى أقل من 20 GB، وهو ما يضعه ضمن نطاق GPU استهلاكي بسعة 24 GB أو 32 GB. اختبرته Meta على Nvidia RTX 5090 وعلى شرائح Apple M4 Max وM5 Max. يستقبل مدخلات نصية وصورية، ويعيد نصًا، ويعمل بنافذة سياق تبلغ 131,072 رمزًا تقول Meta إنه يمكن تمديدها إلى 262,144، ويحمل حدًا معرفيًا بتاريخ يناير 2026.

Claude Sonnet 5.5 هو النموذج الثاني في الجيل 5.5 من Anthropic، وهو النموذج الذي تصفه الشركة بأنه أفضل توليفة بين السرعة والذكاء في تشكيلتها. يعمل بنافذة تبلغ 1,000,000 رمز، وبحد أقصى 128,000 رمز إخراج بشكل متزامن و300,000 عبر واجهة Message Batches API خلف الترويسة output-300k-2026-03-24، ويقبل النصوص والصور والملفات، ويقدّم تفكيرًا تكيّفيًا بجهد قابل للاختيار مع تاريخ قطع في يونيو 2026، وهو متاح مع عدم الاحتفاظ بالبيانات منذ الإطلاق. تبلغ تكلفة التخزين 0.20 دولار لكل مليون رمز عند قراءات الذاكرة المؤقتة و2.50 دولار لكل مليون عند الكتابة إليها. وتقول Anthropic إنه يعمل بسرعة تفوق Claude Sonnet 5 بنسبة 30% ويكلّف أقل بنسبة تصل إلى 30% لكل مهمة بالأسعار نفسها — وهي ادعاءات من المورّد، لم يُعَد إنتاجها بشكل مستقل.
يستحق تباين المواصفات أن يُرى دفعة واحدة، لأن كل سطر تقريبًا يمثل نوعًا مختلفًا من الأشياء لا شيئًا أفضل أو أسوأ:
• الأوزان — Muse Glimmer Apache 2.0، قابل للتنزيل، مُكمَّم إلى 4 بت مقابل Claude Sonnet 5.5 المغلق
• أين يعمل — Muse Glimmer على وحدة معالجة الرسومات الخاصة بك، دون اتصال، مقابل Claude Sonnet 5.5 على البنية التحتية لـ Anthropic
• المعاملات — إجمالي Muse Glimmer 30B، أقل من 20 غيغابايت عند 4-بت مقابل Claude Sonnet 5.5 غير معلن
• السياق — Muse Glimmer 131,072 رمزًا، قابل للتوسيع إلى 262,144، مقابل Claude Sonnet 5.5 1,000,000 رمز
• السعر لكل مليون — Muse Glimmer بدون رسوم لكل رمز، عتادك مقابل Claude Sonnet 5.5 $2.00 إدخال / $10.00 إخراج
• مؤشر الذكاء v4.3.2 — Muse Glimmer 17 مقابل Claude Sonnet 5.5 56
• التكلفة لكل مهمة Index كما تم قياسها — Muse Glimmer 0.06 دولار مقابل Claude Sonnet 5.5 7.60 دولار
هناك رقمان في تلك القائمة يستحقان التفكيك، لأن كليهما فخ. الأول هو رقم $0.06 لكل مهمة: فهو ما أنفقته Artificial Analysis عند استدعاء Muse Glimmer (high) عبر نقطة نهاية مستضافة بتكلفة $0.325 لكل مليون من رموز الإدخال و$1.35 لكل مليون من رموز الإخراج، لذا فهو يقيس اقتصاديات استئجار هذا النموذج، لا تشغيله. عند الاستضافة الذاتية، تختفي التكلفة الحدية لكل رمز وتُستبدل بوحدة GPU تملكها بالفعل أو يتعين عليك شراؤها. والثاني هو فجوة Index نفسها — إذ يجري تقييم نموذج بحجم 30B مكمَّم إلى 20 GB بالمسطرة نفسها المستخدمة للنماذج الرائدة، وتقول لوحة الصدارة الشيء نفسه عندما تضع Muse Glimmer ضمن أفضل مجموعة صغيرة من النماذج مفتوحة الأوزان مع الإشارة إلى أنه مكلف بالنسبة إلى حجمه.

حيث يكون Muse Glimmer جيدًا حقًا، وحيث تنهار الأمور
النتيجة المركبة أكثر تبسيطًا من أن تكون الإجابة الكاملة، لأن Muse Glimmer ليست سبعة عشر بشكل موحّد. إنها سريعة — يقيس Artificial Analysis 143.8 توكن إخراج في الثانية، متقدمة على 138.7 لدى Claude Sonnet 5.5 — وموجزة، إذ تولّد 59 مليون توكن عبر تقييم Index مقابل 410 ملايين لدى Claude Sonnet 5.5. وفي أحد التقييمات تكون قريبة من الطليعة: استدعاء السياق الطويل، حيث تسجّل 83.3% مقابل 82.7% لدى Claude Sonnet 5.5. إن نموذجًا بحجم 30 مليار يضاهي Sonnet الحدودي الجديد تمامًا في استرجاع السياق الطويل هو أكثر سطر مفاجئ في هذه الصفحة، وهو متسق مع الطريقة التي درّبتها بها Meta — بيانات وكيلية للسياق الطويل، وتقطير من معلّم أكبر بكثير.
النتائج الوكيلية هي حيث يظهر سقف النموذج، وعندها يتوقف الترتيب عن كونه مُجاملًا. في Terminal-Bench 4.0، يسجل Muse Glimmer نسبة 0.5% مقابل 63.6% لـ Claude Sonnet 5.5. ودرجته في اختبار الأداء الآلي هي 0.068 مقابل 0.713. Humanity's Last Exam: 22.0% مقابل 55.0%. إن إخراجًا بهذا الحجم الصغير في اختبار أداء تنفيذي يعني أن النموذج لا يكمل المهام، ولا يوجد توفير من الاستضافة المحلية يجعل مهمة لا تنتهي أبدًا أرخص.
الأدبيات البحثية صريحة بشأن هذا أيضًا، ويستحق التصريح به بدلًا من دفنه: دراسة مُحكّمة حول تنسيق وكلاء متعددين، كان Muse-Glimmer-30B أحد النماذج المُختبرة فيها، وجدت أنه لم يسترجع أيًا من مرشحيه. جدول القياس المرجعي الخاص بـ Meta لهذا النموذج هو مستند مورّد ومُوسم على هذا النحو هنا؛ أرقام Artificial Analysis أعلاه هي قياسات مستقلة، وهي التي يعتمد عليها هذا المقال.
إذن فالفصل واضح. Muse Glimmer قوي بالنسبة لحجمه في قراءة مُدخل طويل والإجابة عنه، وسريع، ورخيص التشغيل، ويتّسع في وحدة معالجة رسومات من فئة الحواسيب المحمولة. لكنه ليس النموذج الذي تُسلّمه مهمة برمجية متعددة الخطوات ثم تنصرف. هذا هو الحد الصادق، والمقارنة المكتوبة حول الدرجات المركّبة وحدها ستخفيه.
ما الذي تشتريه فعلاً بسعر الحدود القصوى
تشتري العلاوة السعرية لـ Claude Sonnet 5.5 القدرة أولاً، وفجوة السبعة عشر نقطة في المؤشر هي أبرز تجلٍّ لذلك. لكن ثمة ثلاثة أمور أخرى تأتي مع سعر الإخراج البالغ $10.00 ولا تظهر على أي لوحة صدارة.
الأول هو النافذة. مليون رمز يعادل تقريبًا سبع مرات ونصف مقدار 131,072 لدى Muse Glimmer، وتتقاضى Anthropic السعر القياسي على كامل ذلك، مع قراءات ذاكرة التخزين المؤقت بعُشر سعر الإدخال، بحيث يصبح حمل سياق كبير عبر العديد من الاستدعاءات ميسور التكلفة وليس نظريًا فقط. لا يتسع موجّه بحجم مستودع في النافذة الأصغر على الإطلاق، لذا فإن هذا فرق في القدرات وليس تفضيلًا.
الثاني هو دقة الأدوات. تغيّرت خمسة سلوكيات بين Claude Sonnet 5 وClaude Sonnet 5.5، وكلها تتعلق باستخدام الأدوات والاستدلال: معاملات أخذ العينات غير الافتراضية تُرجع الآن 400، thinking: {"type": "disabled"} تُرجع الآن 400 وتصبح between_tools، اختيار الأداة القسري لـ "any" أو أداة مُسمّاة يُرفض لذا يجب أن تنتقل الحلقات إلى auto مع استخدام صارم للأدوات، الأداة الأقدم computer_20251124 تُرفض على Claude API وGoogle Cloud، كما أصبحت كتل التفكير مرتبطة بالنموذج والحساب المُنتِجين. هناك تغيير سادس لا يُفشل شيئًا لكنه يصمت: يعود النص بين نداءات الأدوات داخل كتل التفكير، لذا يتوقف تطبيق بثّي عن إظهار المخرجات حتى يضبط قيمة عرض أو يوقف التفكير المسبق. هذا يوم من عمل الترحيل لأي شخص يستخدم Sonnet 5، وهو ثمن الدخول إلى الموثوقية الوكيلية التي تقيسها صفوف المعايير أعلاه.
الثالث هو المصدرية والتعامل مع البيانات. يتوفر الاحتفاظ الصفري بالبيانات منذ الإطلاق، وتنشر Anthropic حدًا أدنى للإيقاف هو 28 سبتمبر 2027، والنموذج متاح على Claude API وBedrock وGoogle Cloud وMicrosoft Foundry. بالنسبة للمشتري الخاضع للتنظيم، هذه حقائق شرائية تحسم قرار الشراء قبل أن تفعل ذلك اختبارات الأداء.
العمل دون اتصال شرطٌ، وليس توفيرًا للتكاليف
سببُ انتماء هذا الاقتران إلى صفحة واحدة هو أنه بالنسبة لفئة محددة من عمليات النشر، لا يكون Muse Glimmer خيارًا أرخص، بل الخيار الوحيد. طلبٌ لا يمكن أن يغادر الجهاز، أو أرضية مصنع أو موقع ميداني بلا اتصال، أو بيئة معزولة شبكيًا يُعدّ فيها استدعاء API انتهاكًا للامتثال، أو ميزانية زمن استجابة صارت فيها رحلة الذهاب والإياب مكلفة أكثر من اللازم: لا شيء من هذه الحالات يُحلّ بنموذج أفضل يقف خلف شبكة. أوزان Apache 2.0 التي تقلّ عن 20 GB وتعمل دون اتصال هي الإجابة الكاملة، وClaude Sonnet 5.5 بأي سعر لا يشارك في المعادلة.
تُعد اختبارات Meta المنشورة على شرائح RTX 5090 وApple M4 Max وM5 Max هي المرجع العملي لمعنى «التشغيل محليًا» هنا، والتكميم بدقة 4 بت هو ما يجعل هذه الأهداف قابلة للتحقيق من الأساس — إذ يتجاوز حجم البصمة بالدقة الكاملة 55 GB. ينبغي لأي شخص يخطط لعملية نشر أن يتعامل مع أرقام العتاد على أنها أرقام Meta وليست مقيسة هنا.
بالنسبة لكل الآخرين، النموذجان مكمّلان لبعضهما وليسا بديلين، والجزء العملي المحرج هو أن امتلاك نموذج Anthropic API ونموذج Meta المستضاف ذاتيًا يعني عادةً حزمتين منفصلتين تمامًا. يضع OrcaRouter أكثر من 200 نموذج خلف نقطة نهاية واحدة متوافقة مع OpenAI مع تمرير سعر قائمة المزوّد كما هو دون إضافة هامش، التبديل التلقائي عند الفشل بين مزوّدي المنبع وDSL لتوجيه الطلبات لتأليف الاستدعاءات — وهو ما يغطي النصف المستضاف من هذا الترتيب، و معلّم Meta الأكبر Muse Spark 1.2 قابل للتوجيه هنا باسم meta/muse-spark-1.2 بسعر 1.25 دولار للإدخال و4.25 دولار للإخراج لكل مليون رمز ضمن نافذة سعة 1,048,576 رمزًا، مع قراءات ذاكرة مؤقتة بسعر 0.15 دولار. وهو يحمل 42.8 مليون رمز من حركة المرور أسبوعيًا عبر هذا الكتالوج، وهو الجزء المفيد من الترتيب: المعلّم المستضاف على المفتاح نفسه مثل كل شيء آخر، والنموذج الذي تشغّله محليًا لا يضطر أبدًا إلى لمس أي شبكة على الإطلاق.
ثلاث ملاحظات صريحة، لأن من السهل أن يُخطئ فيها. Muse Glimmer نفسه ليس أحد مساراتنا — لا توجد بطاقة الطراز في كتالوجنا، وهذه الصفحة تقول ذلك صراحةً بدلًا من الإيحاء بخلاف ذلك. اللقطة أدناه هي صفحة الطراز الموجود فعلًا، Muse Spark 1.2، وهو نقطة التحقق التي استُخلص منها Muse Glimmer وليس Muse Glimmer نفسه. كما أن Claude Sonnet 5.5 ليس في كتالوجنا أيضًا، بعد يوم واحد من إطلاقه؛ والمسار إليه هو واجهة Anthropic البرمجية الخاصة به، وأصبح Claude Sonnet 5 قابلًا للتوجيه هنا منذ 30 يونيو بسعر 2.00 دولار و10.00 دولار لمن يريد هدف النشر التجريبي.

كيف تقرر
ابدأ من القيد، لا من الدرجة. إذا كان الطلب لا يمكن أن يغادر جهازًا أو شبكة، فإن Muse Glimmer هو الجواب وفجوة Index ليست ذات صلة — نموذج 30B برخصة Apache 2.0 يعمل دون اتصال ويضاهي نموذجًا رائدًا في استدعاء السياق الطويل هو، لهذه المهمة، أفضل ما هو متاح. وإذا كان على الطلب إنجاز مهمة برمجية متعددة الخطوات، فإن نموذجًا بحجم 30B يسجل نصف في المئة على Terminal-Bench ليس في السباق بغض النظر عن العتاد الذي تملكه بالفعل.
بين هذين القطبين، العامل الحاسم هو القياس لا الرأي: عدد الرموز لكل مهمة مكتملة على عبء العمل الخاص بك، مسعّرة مرتين — مرة بسعر Claude Sonnet 5.5 البالغ 2.00 دولار و10.00 دولارات، ومرة بالتكلفة المطفأة لوحدة معالجة الرسوميات (GPU). الرقم الوحيد الذي يعيد تأطير المقارنة بأكملها، 0.06 دولار لكل مهمة Index مقابل 7.60 دولار، هو رقم استئجار مستضاف لنموذج سيشغّله معظم الناس بأنفسهم، واقتباسه كما لو كان توفيرًا مماثلًا سيكون الخطأ السهل الذي توجد هذه الصفحة لتجنبه.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
