بطاقة عنوان رئيسية للخبر بأن Muse Spark 1.3 مع أقصى تفكير أصبح متاحًا الآن. النص العلوي: "Meta Superintelligence Labs — 4 سبتمبر 2026"، العنوان الرئيسي: "Muse Spark 1.3 مع أقصى تفكير أصبح متاحًا الآن"، والنص الفرعي يشير إلى أن Meta اجتازت اختبارات السلامة بعد يومين من الإطلاق، وفعّلت وضع التفكير المسؤول عن نتائجها اللافتة في Muse Code وMeta Model API بالسعر نفسه. الشارات: "جهد التفكير: أقصى"، "سعر القائمة نفسه: $1.25 / $4.25"، و"الإعداد وراء DeepSWE 75.4". التذييل: "متاح الآن للاختيار على muse-spark-1.3 — رموز التفكير تُدفع كمخرجات". شعار OrcaRouter مُركَّب أسفل اليمين.
Guides & Insights

أصبح استدلال Muse Spark 1.3 Max متاحًا الآن: الإعداد الذي حقق أعلى النتائج لـ Meta أصبح مُتاحًا للجميع

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

موس سبارك 1.3 — نموذج الاستدلال المتقدم الذي أصدرته مختبرات ميتا الخارقة للذكاء في 2 سبتمبر — حصل للتو على الوضع الذي بُني عليه سجلّ نتائجه الخاص. في 4 سبتمبر، بعد يومين إضافيين من اختبارات السلامة، فتحت ميتا إعداد التفكير الأكثر استهلاكًا للحوسبة لدى النموذج، وهو وضع "max"، أمام المطوّرين عبر Meta Model API وفي Muse Code، وكيل البرمجة الطرفي التابع لها. أعلن كبير مسؤولي الذكاء الاصطناعي ألكسندر وانغ عن الطرح عبر منصة X، وأكّد حساب الشركة @AIatMeta ذلك؛ فما كان في البداية إعدادًا مقتصرًا على ميتا ومعاينة شركاء أصبح الآن مستوى تفكير يمكن لأي مطوّر اختياره.

هذا التسلسل مهم لأن العديد من الأرقام التي هيمنت على تغطية إطلاق Muse Spark 1.3 — 75.4 على DeepSWE v1.1، و66.9 على OSWorld 2.0، و1,754 على GDPval-AA v2 — جاءت من الإعداد الأقصى (max)، بينما النموذج الذي كان بإمكان المطورين استدعاؤه فعليًا جاء مع جهد الاستدلال مقيّدًا عند "xhigh". وقد أوضحت Meta عند الإطلاق أن الإعداد الأقصى ما زال قيد اختبارات السلامة، لكن هذا الانقسام عنى أن لوحة النتائج الرئيسية والنموذج القابل للاستدعاء كانا شيئين مختلفين لمدة يومين. إصدار الخميس يزيل هذه الفجوة، ويفعل ذلك دون المساس بسعر كل رمز (token). أرقام المعايير في تلك القائمة هي أرقام Meta الخاصة، وما تزال غير مُعاد إنتاجها بواسطة بيئة اختبار مستقلة؛ وكل ما ورد في هذا المقال بوصفه من تقارير البائعين مُعلَّم على هذا النحو.

ما الذي تم حجبه — وماذا تغيّر في 4 سبتمبر

سُلَّم الاستدلال في Muse Spark 1.3 ظلّ على نفس الشكل منذ فتح واجهة البرمجة المدفوعة للعائلة: الاستدلال يعمل دائمًا، ومعامل الجهد للنموذج في واجهة Meta Model API يأخذ القيم minimal، low، medium، high، وxhigh، حيث ينفق النموذج المزيد من ميزانيته الإخراجية على التفكير كلما ارتفع المستوى. ويأتي Max فوق xhigh — قدرة حسابية أكثر، ورموز استدلال أكثر، ووفقًا لرواية ميتا، أداء أقوى بشكل ملحوظ في الأعمال الوكيلة طويلة الأمد. عند إطلاق الثاني من سبتمبر، طرحت ميتا جميع المستويات حتى xhigh، لكنها أبقَت max خارج واجهة البرمجة العامة بانتظار ما سمّته اختبارات أمان إضافية، وشاركت به فقط مع مجموعة محدودة من الشركاء — ما يكفي لإجراء تقييم مستقل، لكنه لا يكفي لعبء عمل إنتاجي.

في الرابع من سبتمبر، قال وانغ إن الاختبار قد اكتمل. أصبح Max الآن إعدادًا قابلًا للتحديد في Muse Code — نص التثبيت موجود على dev.meta.ai/install.sh — وعلى معرّف النموذج muse-spark-1.3 عبر Meta Model API، حيث يقبل معامل الجهد الآن max. وصف وانغ التأخير لمدة يومين بأنه طريقة Meta للتحكم في الوصول "على مستوى الإعدادات"، وأخبر Axios أن Meta لم تضطر إلى إيقاف عملها الأوسع بسبب مخاوف تتعلق بالسلامة. كانت النافذة قصيرة، لكنها سابقة حقيقية: أصبحت Meta الآن مستعدة لإبقاء نمط استدلال محدد خلف مراجعة السلامة بينما تطلق بقية نقطة الفحص على الفور.

تحذير عملي واحد لأي شخص يستدعي النموذج عبر بوابة بدلاً من نقطة نهاية Meta الخاصة: العديد من صفحات الوثائق التابعة لجهات خارجية وقوائم التجميع كُتبت في يوم الإطلاق وما زالت تعدد جهد الاستدلال حتى xhigh فقط. القيمة القصوى هي طرح من جانب Meta، لذا تحقق من أن المسار الذي تستدعي من خلاله قد حدّث سطح معلماته قبل افتراض أن max يمكن الوصول إليها — فقد يرفض وسيط تحقق من قيمه المقبولة في 2 سبتمبر قيمة "max" حتى يلحق بها المشرفون عليه.

ما الذي يشتريه "ماكس" فعلاً — وأين لا يفيد

مواد Meta الصادرة يوم الخميس تتضمن تقسيمًا صريحًا بين الإعداد الأقصى (max) والإعداد العالي جدًا (xhigh) في المعايير التي تشغّلها، وهذا هو أكثر شيء مفيد نشرته عن النموذج حتى الآن. كل ذلك مُبلَغ عنه من قِبل البائع، ويُنتَج داخل إطار عمل Muse Code الخاص بـ Meta، وتقول Meta إن مقارناتها ضد Claude Opus 5 وGPT-5.6 Sol كانت عمليات تشغيل "بأفضل جهد" عند الإعدادات القصوى لتلك المنافسات، وقد "لا تعكس الأداء المحسَّن من قِبل المزوّد". مع هذا التحفّظ، يروي التقسيم قصة اتجاهية واضحة:

• OSWorld 2.0 (مهام وكيل استخدام الكمبيوتر) — 66.9 عند max مقابل 57.2 عند xhigh

• GDPval-AA v2 (Elo لوكيل العمل المعرفي) — 1,754 عند max مقابل 1,709 عند xhigh

• JobBench (مهام احترافية طويلة المدى) — 64.9 عند max مقابل 61.2 عند xhigh

• DeepSearchQA — تعادل عند 89.4

• Terminal-Bench 2.1 (ترميز وكيل الطرفية) — 89.2 عند xhigh مقابل 88.8 عند max، وهي المجموعة الوحيدة التي يفوز فيها التكوين الذي صدر في 2 سبتمبر.

A comparison scoreboard titled 'Muse Spark 1.3 — max vs xhigh, the split'. Left column Max (released Sept 4, 2026): OSWorld 2.0 66.9, Terminal-Bench 2.1 88.8, GDPval-AA v2 (Elo) 1,754, JobBench 64.9, DeepSearchQA 89.4, Available to all developers. Right column Xhigh (released Sept 2, 2026): OSWorld 2.0 57.2, Terminal-Bench 2.1 89.2, GDPval-AA v2 (Elo) 1,709, JobBench 61.2, DeepSearchQA 89.4, Available to all developers. Footer: 'Benchmark splits per Meta's Sept 4 release materials — vendor-reported, not independently reproduced. Xhigh wins Terminal-Bench 2.1.' OrcaRouter logo bottom-right.

هذا النمط يستحق القراءة بعناية. يساعد Max أكثر ما يكون عندما تكون المهمة حلقةً وكيليةً طويلة — تشغيل جهاز كمبيوتر، أو تنفيذ موجز عمل معرفي، أو إدارة جدول من المهام الفرعية على نحو ما يفعله JobBench. أما في معيار طرفية أحادي الجولة فلم يضف شيئًا وكلف قليلًا: Terminal-Bench هو التذكير بأن «المزيد من الاستدلال» ليس ترقيةً أحادية الاتجاه، وهو السبب في مقارنة A/B بين إعداد max وإعداد xhigh على عبء عملك الخاص، بدلًا من افتراض أن الإعداد الأعلى هو الأفضل في كل مكان. كما تشير Meta إلى نتيجة DeepSWE v1.1 البالغة 75.4 — العنوان الرئيسي في اليوم الأول، والمرتفعة من 59.3 التي أعلنتها Meta عن Muse Spark 1.2 قبل ستة أسابيع — باعتبارها رقمًا لإعداد max. وهذا هو الرقم الذي سيعيد المقيّمون المستقلون تشغيله أولًا.

القراءة المستقلة بدأت تلحق بالركب

ما كان ناقصًا عند الإطلاق هو أي قياس مستقل، وهذه الفجوة بدأت تُغلَق وفق جدول زمني يتزامن مع طرح max. مؤشر Coding Agent Index من Artificial Analysis — الذي يقيّم كل نموذج داخل بيئة عميل الترميز الأصلية الخاصة به ويمزج مهام DeepSWE وTerminal-Bench وSWE-Atlas — وضع Muse Spark 1.3 (max) في بيئة Muse Code بدرجة 68 هذا الأسبوع، في المرتبة الثانية على اللوحة خلف Claude Opus 5 (xhigh) في Claude Code، ومتقدّمًا على Claude Fable 5 (max) بدرجة 67 وGPT-5.6 Sol (max) بدرجة 65. اللوحة نفسها تمنح إصدار xhigh المتاح للشحن درجة 64 في بيئة Muse Code نفسها، وهي أوضح قراءة للمقارنة المباشرة حتى الآن لما يضيفه max — حوالي أربع نقاط مؤشر — على مجموعة مهام مستقلة. صف اللوحة هذا نُشر بينما كان max لا يزال في معاينة الشركاء؛ والإعداد الذي يصفه هو نفسه الذي أصبح متاحًا للعموم في 4 سبتمبر.

أصدرت Artificial Analysis أيضًا تحديثًا لبطاقة النموذج الخاصة بها للتكوين الأقصى منذ طرحه. خلال فترة المعاينة، كانت البطاقة لا تذكر أي مزوّد ولا أي سعر؛ أما البطاقة المباشرة الآن فتذكر Meta بالسعر القياسي 1.25 دولار لكل مليون رمز إدخال و4.25 دولار لكل مليون رمز إخراج — وهو نفس السعر المعلن لـ Muse Spark 1.2 — مع إضافة ملاحظة تحذيرية بشأن الإسهاب: استهلك تشغيل تقييم AA ما يقارب 130 مليون رمز مقابل متوسط 79 مليون رمز، وبلغت تكلفته الإجمالية حوالي 1,335 دولارًا، ويقترب من 0.95 دولار لكل مهمة وفقًا لتقدير AA لكل مهمة، بمعدل يبلغ حوالي 190 رمز إخراج في الثانية.

رقم واحد من التغطية السابقة يستحق التحقق من الإصدار. حدّثت Artificial Analysis مؤشر Intelligence Index الخاص بها إلى v4.2 هذا الأسبوع — في نفس الأسبوع الذي شحن فيه max — مع إعادة تقييم الساحة وتحويل القيم الوسيطة. على البطاقة الحالية، يقرأ إعداد max قيمة 53 مقابل وسيط النماذج المماثلة البالغ 29؛ أما الرقم 62 الذي تداولته تغطية أسبوع الإطلاق فقد قيس على النسخة السابقة من المؤشر، والاثنان غير قابلين للمقارنة. تقسيم Meta الخاص بين xhigh وmax أعلاه مستقل عن مؤشر AA ولا يتأثر بالتحديث.

A screenshot of the Artificial Analysis model page for Muse Spark 1.3 (max), showing a score of 53 on the Artificial Analysis Intelligence Index against a comparable-model median of 29, input pricing of $1.25 and output pricing of $4.25 per 1M tokens with an 88% cache discount, a per-task cost estimate near $0.95, about 190 output tokens per second, a 1M-token context window, and a note that the configuration is 'somewhat verbose' after generating roughly 130M tokens against a 79M median.

ما التكلفة القصوى — الفاتورة تُحتسب بالتوكنز، وليس وفق قائمة الأسعار

لا تنشر Meta سعرًا منفصلاً للتكوين الأقصى، ولا تحليلاً مخصصًا لزمن الاستجابة أيضًا. سعر الرمز الواحد مطابق لـ Muse Spark 1.2 ولأي مستوى جهد آخر على Muse Spark 1.3: 1.25 دولار لكل مليون رمز إدخال، و4.25 دولار لكل مليون رمز إخراج، و0.15 دولار للإدخال المخزَّن مؤقتًا على المستوى القياسي. تُحتسب رموز الاستدلال كرموز إخراج وتُخصم من ميزانية الإخراج، لذا فإن اختيار الإعداد الأقصى ليس زيادة في سعر البند المستقل — بل هو وعد بإنفاق المزيد من تلك الميزانية في التفكير قبل الإجابة.

هذا يجعل مسألة التكلفة الحقيقية مرتبطة بحجم التوكنات، وتشير البيانات المبكرة إلى أن max باهظ التكلفة تحديدًا حيث يكون xhigh اقتصاديًا. استهلك تشغيل AA المُجهَّز بالأدوات نحو 130 مليون توكن في تقييم واحد للتكوين. بالنسبة لمطوّر يدير بالفعل حلقات وكيلية طويلة على xhigh، فإن اختبار A/B المهم ليس «هل يجتاز max مهام أكثر؟» بل «هل يجتاز max مهامًا إضافية كافية لتعويض فاتورة توكنات أكبر بشكل ملموس على نفس عبء العمل؟»

طبقة المساهم من Meta — 0.10 دولار للإدخال و0.20 دولار للإخراج لكل مليون رمز، مقابل السماح لـ Meta بالتدريب على استفساراتك وإكمالاتك — تنطبق على نفس نقطة التحقق، وتقول Meta إن نسبة مئوية معنوية من خانتين من المطورين تختارها. شروط المساهم تجعل كل إرسال بمثابة بيانات تدريب، وحدود معدلاتها ضيقة، لذا فهو خيار افتراضي سيئ للتوزيع الواسع في الإنتاج، لكنه وسيلة مشروعة لتشغيل تجارب قصوى مكلفة بتكلفة منخفضة إذا كانت مقايضة البيانات مقبولة لديك.

نقطة الارتكاز في تسعير كل هذا يسهل التحقق منها دون الأخذ بكلام ميتا، لأن إصدار Muse Spark 1.3 مُسعَّر بسعر مطابق لما هو مُدرَج بالفعل على OrcaRouter بسعر ميتا المعلن نفسه: إصدار Muse Spark 1.2 متاح على OrcaRouter بسعر 1.25 دولار للإدخال و4.25 دولار للإخراج لكل مليون توكن دون أي هامش ربح، وبهذا يمكن التحقق من ادعاء «السعر دون تغيير» من خلال صفحة حية تعرض هذه الأرقام بالضبط. أما إصدار Muse Spark 1.3 نفسه فليس على OrcaRouter بعد. وعندما يبدأ مزوّد من المزوّدين الذين نتعامل معهم بتقديمه بخيار max، فإن السعر الذي يظهر لدينا سيكون سعر ميتا المعلن منقولًا مباشرة — فنحن لا نضيف أي هامش على أسعار المزوّدين — وأي تخفيض من المورّد يدخل حيز التنفيذ في اليوم نفسه الذي تصدره ميتا. وبالنسبة لإصدار كهذا، حيث تكمن الجوانب الاقتصادية المهمة في حجم التوكنات لا في السعر الرئيسي، فإن هذا النقل المباشر هو ما يُبقي المبلغ الذي تُحاسَب عليه فعليًا مساويًا للمبلغ الذي تنشره ميتا.

A screenshot of the OrcaRouter model page for Muse Spark 1.2, the checkpoint Muse Spark 1.3 is priced identically to, showing header stats $1.25 input and $4.25 output per million tokens, p50 time-to-first-token 7.84 s, p50 total 10.00 s and 48.9M, the description 'Muse Spark 1.2 is Meta's reasoning model for complex agentic tasks... a drop-in upgrade rather than a new tier', and the 'Get the Muse Spark 1.2 API' and 'Try in playground' buttons.

من يجب أن يتحول إلى max

ينقسم القرار بشكل واضح:

• بدّل إلى أعباء العمل الوكيلة طويلة المدى — استخدام الحاسوب، وملخصات العمل المعرفي، وحلقات الأدوات متعددة الخطوات في Muse Code — حيث تُظهر كل من تجزئة Meta ولوحة وكيل البرمجة من AA أكبر المكاسب القصوى. اختبره بأسلوب A/B مقابل xhigh على عينة من مهامك الفعلية أولًا، لأن الإسهاب حقيقي.

ابقَ على xhigh للمكالمات عالية الحجم أو الحساسة لزمن الاستجابة أو القصيرة أحادية الدورة، حيث يضيف max رموزًا بشكل أساسي. Terminal-Bench هو الدليل على أنه لا يضيف دائمًا قدرة.

راقب ثلاثة أمور من الآن: إصدار الأوزان المفتوحة الذي وعده زوكربيرغ دون تحديد موعد، والطرح الاستهلاكي لـ Muse Spark 1.3 على إنستغرام وفيسبوك وMeta AI في الأسابيع المقبلة، وما إذا كانت لوحة وكلاء البرمجة في Artificial Analysis ستبدأ بتسعير الصف الأقصى الآن بعد أن أصبح التكوين متاحًا بشكل عام.

تبيّن أن البوابة التي استمرت يومين كانت قصيرة، لكنها أثارت نقطة تدوم أطول من الإطلاق نفسه: أقوى أرقام Meta لنموذج Muse Spark 1.3 لم تكن سرابًا أبدًا — بل كانت تنتظر مراجعة السلامة فقط. اعتبارًا من 4 سبتمبر، أصبح النموذج الذي يمكن للمطوّر استدعاؤه والنموذج الموجود على لوحة النتائج أخيرًا النموذج نفسه. وما إذا كان max يستحق رموزه أصبح الآن سؤالًا تجريبيًا يمكن لأي مطوّر الإجابة عليه، عبر واجهة برمجة تطبيقات Meta أو عبر أي مسار يستخدمونه بالفعل للوصول إلى عائلة Muse Spark.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا