
Step 5 Preview مقابل Muse Glimmer: واجهة برمجة التطبيقات Frontier ونموذج الحاسوب المحمول
- OrcaجديدOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 لكل مليون رمز
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 113 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
على لوحة المتصدرين، Step 5 Preview وMuse Glimmer ليسا متقاربين: 44 مقابل 17 على مؤشر Artificial Analysis Intelligence Index — فجوة قدرها سبعة وعشرون نقطة على مقياس يقع متصدره الحالي في الخمسينيات العليا — لا يمكن لأي قدر من الضبط أن يسدّها. أما بالنسبة للسؤال الذي يجب على الفريق فعلاً الإجابة عنه — أين تعمل التوكنات الخاصة بي — فهما منافسان مباشران. Step 5 Preview هو الطراز الرائد لدى StepFun، أُعلن في 20 سبتمبر 2026، بنحو 600 مليار معامل إجمالي مع 27 مليار معامل نشط، وسياق بسعة 1M توكن، بسعر 1.00 دولار لكل مليون توكن إدخال و2.70 دولار لكل مليون توكن إخراج، ولا يمكن الوصول إليه إلا عبر الشبكة. Muse Glimmer هو نموذج وكيلي مفتوح الأوزان من Meta Superintelligence Labs بعدد معاملات 30 مليار، صدر في 10 أغسطس 2026 بموجب Apache 2.0، ويُشحن مكمَّماً إلى 4 بت بحيث يتسع في أقل من 20 GB من الذاكرة ويعمل على وحدة معالجة رسومات استهلاكية واحدة مع فصل الشبكة. الطريقة الصحيحة لقراءة هذا الاقتران ليست «أيهما أذكى». بل «أي القيدين — القدرة أم الحدود — هو الذي لا يستطيع عبء عملك تحريكه».
تُعدّ هذه المقارنة أيضًا تصحيحًا مفيدًا لعادة اكتسبها هذا السوق: التعامل مع درجة مؤشر مركّب كأنها كل قيمة النموذج. فجوة السبعة والعشرين نقطة حقيقية، وهي ليست الرقم الوحيد في الملف. وفي الاسترجاع الطويل السياق، تضع اللوحة المستقلة نفسها Muse Glimmer في نطاق نصف نقطة من نماذج مفتوحة الأوزان من فئة أوزان أكبر بكثير، كما أن اختبارات Meta الوكيلية الخاصة بها محترمة لنموذج يعمل على حاسوب محمول. وفي المقابل، فإن الضعف الأكثر ذكرًا لدى Step 5 Preview ليس القدرة على الإطلاق بل الإسهاب، وهو مغلق حتى تصل أوزانه الموعودة في 15 أكتوبر.
نموذجان، شيئان مختلفان تمامًا
Step 5 Preview هو نظام مزيج من الخبراء يعمل من بنية StepFun التحتية: نحو 600 مليار معامل إجمالي، و27 مليار معامل نشط لكل رمز، وإدخال نصي وصوري، ونافذة سياق بسعة مليون رمز، ودرجة مستقلة في مؤشر الذكاء قدرها 44 مقابل وسيط 26 للنماذج المماثلة. تعمل مخرجاته بسرعة 87 رمزًا في الثانية مقابل متوسط 78 في قياس اللوحة نفسها، وقد ولّد نحو 160 مليون رمز مخرجات عبر مجموعة مهام المؤشر حيث ينتج النموذج الوسيط نحو 82 مليونًا — أي ضعف النص تقريبًا لكل وحدة عمل، بتكلفة 2.70 دولار لكل مليون. كان قد وُعد بأوزان BF16 في 15 أكتوبر 2026 وهي ليست في المستودع بعد، لذا اليوم لا يتاح لك النموذج إلا عبر API.
Muse Glimmer هو الكائن المعاكس. إنه نموذج بـ 30 مليار معامل، دُرّب عبر تقطير logit من المعلّم الأكبر Muse Spark التابع لـ Meta، ثم ضُبط بدقة على بيانات وكيلية طويلة السياق وعُزّز لاستخدام الأدوات. تشحنه Meta مكمَّمًا إلى 4 بت، مما يقلل الذاكرة من أكثر من 55 جيجابايت عند الدقة الكاملة إلى أقل من 20 جيجابايت — ضمن نطاق VRAM سعة 24 جيجابايت أو 32 جيجابايت — وقد اختبرته Meta على Nvidia RTX 5090 وعلى شرائح Apple M4 Max و M5 Max. يستقبل مدخلات نصية وصورية عبر أكثر من مئة لغة، ويدعم سياقًا من 131,072 رمزًا قابلًا للتمديد إلى 262,144، ومصمم ليتلقى هدفًا، ويقسّمه إلى خطوات، ويستدعي الأدوات، ويعيد محاولة استدعاء فاشل بدلًا من التوقف. إنه Apache 2.0، ويعمل دون اتصال.
• درجة مستقلة — Step 5 Preview: 44 مقابل وسيط قدره 26 في فئته، مقابل Muse Glimmer: 17 على المؤشر نفسه في تكوينه العالي.
• المقياس — Step 5 Preview: حوالي 600 مليار إجمالًا، 27 مليارًا نشطًا وفقًا لـ StepFun مقابل Muse Glimmer: 30 مليارًا إجمالًا، مكمَّم إلى 4 بتات في أقل من 20 غيغابايت.
• نافذة السياق — Step 5 Preview: مليون رمز مقابل Muse Glimmer: 131,072 قابلة للتوسيع إلى 262,144، وفقًا لميتا.
• السعر — Step 5 Preview: 1.00 دولار للإدخال / 2.70 دولار للإخراج لكل مليون رمز، مُعلَن مقابل Muse Glimmer: لا رسوم لكل رمز؛ أنت توفّر وحدة معالجة الرسوميات (GPU).
• أين يعمل — معاينة الخطوة 5: خوادم المورّد، عبر HTTP مقابل Muse Glimmer: العتاد الخاص بك، دون اتصال.
• الترخيص — Step 5 Preview: معاينة مغلقة، الأوزان الموعودة في 15 أكتوبر 2026 مقابل Muse Glimmer: Apache 2.0، متاح للتنزيل الآن.
• استرجاع السياق الطويل — تحقق Muse Glimmer درجة 80.0 في تقييم الاستدلال بالسياق الطويل الخاص بـ index board، بفارق نصف نقطة عن نماذج تبلغ عدة أضعاف فئتها السعرية، وقريب بما يكفي من قراءة Step 5 Preview بحيث لا يكون الفرق ذا أهمية في اتخاذ القرار لأعمال العثور على الحقائق.
النقاط السبع والعشرون، وما لا تقيسه
نموذج بحجم 30B مُقطَّر ليعمل في ذاكرة سعة 20 GB سيخسر أمام نموذج رائد بحجم 600B في مؤشر للذكاء العام، ومواد Meta نفسها لا تدّعي خلاف ذلك — فأحد صياغاتها صريح في أن Glimmer غير مصمم ليعادل قوة الاستدلال الخام لنماذج سحابية كاملة الحجم. لذا فإن نتيجة 17 ليست حكمًا على الهندسة؛ بل هي النتيجة المتوقعة لترجيح هدف مختلف. والسؤال الصحيح هو أيٌّ من مهامك تغطيه هذه الفجوة فعلاً.
إن القراءة طويلة السياق هي الموضع الذي يقترب فيه الاثنان إلى أقصى حد، وهو الموضع الذي ينهار فيه الحدس. تسجّل Muse Glimmer درجة 80.0 في تقييم الاستدلال طويل السياق الخاص بلوحة الصدارة — درجة قد لا تكون ملحوظة لنموذج طليعي، لكنها ملحوظة لنموذج يعمل على وحدة معالجة رسومات استهلاكية. إذا كان عبء عملك هو الاسترجاع أو التلخيص أو الاستخراج من مستندات طويلة، فإن نموذجًا محليًا عند هذا المستوى ليس من الواضح أنه الأداة الخاطئة، وكون الطلب لا يغادر جهازك أبدًا ميزة لا يمكنك شراؤها من واجهة برمجة تطبيقات (API) بأي ثمن.
ثم هناك الجزء من المقارنة الذي لا تُظهره أرقام Meta. دراسة محكّمة حول تنسيق الوكلاء المتعددين اختبرت Muse-Glimmer-30B في إعداد مُتحكَّم فيه — نفس المهمة، نفس أداة الاختبار، نفس المستشارين — ووجدت أنها لم تسترجع أيًّا من المرشحين الذين أنتجتهم نماذج حدودية أكبر، وفشلت في المحاولات الثلاث كلها في كل إعداد. تلك دراسة واحدة لتكوين واحد، وهي نوع الأدلة التي لا تُبرزها صفحة النموذج أبدًا. بالنسبة لخطوط أنابيب الوكلاء حيث يتعين على منسّق أضعف أن يتعافى من فشل نموذج أقوى، فهي النتيجة الأكثر صلة بالقرار في هذا المقال، ويجدر قراءتها قبل أي من المعايير التي أبلغ عنها البائع Meta.
تلك المعايير، من باب الاكتمال، هي معايير Meta الخاصة ولم يُعَد إنتاجها: 76.0% على SWE-Bench Verified، و51.2% على SWE-Bench Pro، و51.7% على TerminalBench 2.1، و65.9% على OSWorld-Verified، و83.5% على GPQA Diamond، و22% على Humanity's Last Exam، و75.5 على MCP-Atlas. وهي مقيسة مقابل نماذج من فئتها الحجمية نفسها، وتصف وكيلًا محليًا قادرًا لا مفكّرًا رائدًا.

أين يقع الحد فعليًا
الميزة البنيوية لـ Step 5 Preview هي أنه يقوم بالعمل الذي لا يمكنك القيام به محليًا. سياق يبلغ مليون رمز، وإدخال صور، ودرجة مُقاسة قريبة من الحدود المتقدمة، و87 رمزًا مُخرَجًا في الثانية دون شراء أي عتاد: للصياغة، والتخطيط، ومراجعة الشيفرة عبر مستودع كبير، أو أي شيء حيث يكون سقف النموذج هو عنق الزجاجة، تتفوق واجهة API وتكون النقاط السبع والعشرون هي الحجة بأكملها. وتكلفة ذلك هي عكس تكلفة Muse Glimmer: المطالبات تغادر محيطك، ويُعاد تطبيق السعر على كل رمز، وإسهاب النموذج يجعل أحمال العمل ذات المخرجات الطويلة أكثر تكلفة مما يوحي به سعر 2.70 دولار.

تتمثل ميزة Muse Glimmer في أنها تقوم بالعمل الذي لا يمكن أن يخرج. إذا كانت البيانات خاضعة للتنظيم، أو إذا كانت ميزانية زمن الاستجابة بضعة مللي ثانية، أو إذا كانت الآلة غير متصلة بالإنترنت، أو إذا كان لا بد أن تكون التكلفة الحدية للطلب المليون صفراً، فلا توجد أي واجهة برمجة تطبيقات (API) مرشحة — لا هذه، ولا أي منها. ثمن ذلك هو القدرة: أنت تختار 17 حيث يوجد 44، وفي التنسيق الوكيلي قد تختار منسقاً لا يستطيع التعافي من أخطاء نموذج أقوى.
بالنسبة لمعظم الفرق، الجواب ليس اختيارًا بل انقسام، والانقسام يحتاج إلى مكان يوجد فيه. OrcaRouter يوجّه أكثر من 200 نموذج خلف مفتاح API واحد وفاتورة واحدة بهامش ربح 0% مع تمرير سعر قائمة المزوّد كما هو، إضافة إلى تجاوز الفشل التلقائي ولغة DSL للتوجيه لإرسال حركة المرور حسب المهمة أو التكلفة أو زمن الاستجابة. لا Step 5 Preview ولا Muse Glimmer ضمن ذلك الكتالوج — فنموذج StepFun الرائد لا نوجّهه نحن، وGlimmer تنزيل محلي — لذا فالقيمة المعروضة ليست الوصول إلى أي من النموذجين. بل هي المجموعة التي ستقيس أداءهما مقابلها، وقابلة للاستدعاء بمفتاح واحد اليوم، حتى يُحسم قرار المحلي مقابل البعيد حسب توزيع مهامك أنت لا حسب صفحة أي بائع قرأتها آخر مرة.

كيف تقرر
اختر Step 5 Preview عندما يكون السقف هو القيد. إذا كانت مهامك مفتوحة النهاية، أو متعددة الوسائط، أو ذات سياق طويل، أو وكيلية بمعنى أنها تحتاج إلى مُخطِّط قادر، فإن نموذج API هو الوحيد بين الاثنين القادر على أدائها، وسعره منخفض بما يكفي لفئته بحيث يصبح تجريبه بندًا في الميزانية لا مشروعًا قائمًا بذاته. خصِّص ميزانية للإسهاب، وخطِّط لتأخُّر موعد الأوزان في 15 أكتوبر، وأبقِ خارج ذلك أعباء العمل التي يجب ألا تغادر المبنى.
اختر Muse Glimmer عندما يكون المحيط هو القيد. إذا تعذّر إرسال بياناتك، أو إذا كنت بحاجة إلى التشغيل على متن طائرة أو داخل مصنع، أو إذا كانت أحجامك تجعل التسعير لكل توكن غير معقول، فإن نموذجًا بحجم 30B برخصة Apache-2.0 يتّسع في 20 GB هو الخيار العملي، ونتيجة الاسترجاع طويلة السياق لديه جيدة بما يكفي بحيث لن تظهر فجوة القدرات في كل عبء عمل. اختبره في التنسيق قبل أن تثق به هناك، لأن هذا هو الموضع الذي تكون فيه الأدلة المستقلة أضعف.
إذا قيّدك القيدان معًا في آنٍ واحد، فشغّلهما معًا: المحلي للبيانات التي لا يمكن نقلها، وواجهة API للمهام التي تحتاج إلى نموذج أكبر، واجعل قرار التوجيه تغييرًا في الإعدادات لا عملية ترحيل. المقارنة المهمة ليست بين 44 و17، بل أيّ من طلباتك يمكنه تحمّل مغادرة الجهاز، وهذا سؤال لا يجيب عنه إلا حركة المرور الخاصة بك.
