
Muse Spark 1.2 مقابل GPT-5.6 Luna: ثلاث نقاط مؤشر مقابل 4.6x سعر التوكن
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2658الذكاء72البرمجة
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
أجرت Artificial Analysis نفس مجموعة الاختبارات التسعة على كلا النموذجين واحتفظت بالإيصالات. تشغيل Muse Spark 1.2 من خلاله كلّف 637.85 دولارًا. تشغيل GPT-5.6 Luna من خلاله كلّف 174.06 دولارًا. وبالنسبة لذلك الفارق البالغ 3.7 أضعاف في الإنفاق، تقدّم نموذج Meta بثلاث نقاط — 54 مقابل 51 على مؤشر Intelligence Index. وما إذا كانت هذه صفقة جيدة هو السؤال برمته، والإجابة تعتمد بشكل أقل بكثير على المعيار مقارنةً بشيئين لا يكتب عنهما أحد تقريبًا: كيفية تعامل إطار عمل الوكلاء الخاص بك مع التخزين المؤقت للموجّهات، وما إذا كانت أعباء عملك تحتاج أبدًا إلى سماع أو مشاهدة أي شيء.
كل رقم أدناه إمّا قياس مستقلّ من Artificial Analysis، أو قائمة API مباشرة، أو بيانات الإنتاج الخاصة بـ OrcaRouter — وآخرها يستحقّ الإشارة إليه مقدمًا لأنه يتعارض مع أرقام المعايير بطريقة مفيدة. لا يوجد هنا أي ادّعاء من بائع مُلبَّس كأنه نتيجة؛ حيثما يكون البائع هو المصدر الوحيد، توضح الجملة ذلك.
لوحة النتائج أقرب مما يوحي به السعر
يسجل Muse Spark 1.2 درجة 54 على مؤشر Artificial Analysis Intelligence Index عند إعداد التفكير xhigh الخاص به، ليحتل المرتبة 13 من بين 185 نموذجًا مقابل وسيط فئة يبلغ 32. ويسجل GPT-5.6 Luna درجة 51 عند أقصى جهد، بفارق ثلاث نقاط على مركب من GDPval-AA v2 وτ³-Banking وTerminal-Bench v2.1 وSciCode وHumanity's Last Exam وGPQA Diamond وCritPt وAA-Omniscience وAA-LCR.
ثلاث نقاط حقيقية لكنها صغيرة، والنتائج الفرعية الموجودة للجيل السابق تشير إلى مصدرها. أرقام "Artificial Analysis" حسب الأبعاد تضع Muse Spark 1.1 عند مؤشر برمجة 71.3 ومؤشر وكيل 37.5؛ بينما GPT-5.6 Luna عند 71.4 و45.6. كانت البرمجة متعادلة تقريبًا، وتقدمت Luna بثماني نقاط في العمل الوكيل — وهو البعد الذي أعادت Meta كتابة وصف منتج 1.2 لتدّعيه. انتقل المؤشر المركب بثلاث نقاط لصالح Meta. لم ينشر أحد بعد تحليلًا حسب الأبعاد لـ 1.2، لذا ما إذا كانت الفجوة الوكيلة قد أُغلقت فعلًا غير مؤكد.

فيما يخص السعر الممزوج للرموز، الفجوة ليست طفيفة. يضع معدل التحليل الاصطناعي الممزوج Muse Spark 1.2 عند 0.78 دولار لكل مليون رمز، وGPT-5.6 Luna عند 0.17 دولار. أسعار القائمة: 1.25 دولار للإدخال و4.25 دولار للإخراج لـ Muse Spark 1.2، و0.20 دولار للإدخال و1.20 دولار للإخراج لـ Luna.
نظرًا لأن التسعير يعتمد على وحدة العمل وليس على الرمز المميز (token)، فإن خطوة واحدة لوكيل البرمجة التي تقرأ 60,000 رمزًا من السياق وتكتب 3,000 رمزًا من المخرجات تكلف حوالي 8.8 سنتًا على Muse Spark 1.2 وحوالي 1.6 سنتًا على GPT-5.6 Luna. وبمعدل ألف خطوة يوميًا، يكون الفارق 88 دولارًا مقابل 16 دولارًا — أي فرق يقارب 26,000 دولار سنويًا لحلقة وكيل واحدة.
التخزين المؤقت هو النقطة التي تُغلق عندها الفجوة أو تتضاعف.
كلا النموذجين يبيعان بمعدلات إدخال مخزّن مؤقتًا (cached input) تنافسية، والنسبة بينهما ليست هي نفسها النسبة بين أسعارهما المعلنة. يقرأ Muse Spark 1.2 الإدخال المخزّن مؤقتًا بسعر 0.15 دولارًا لكل مليون، بخصم 88% عن سعره البالغ 1.25 دولارًا. يقرأ GPT-5.6 Luna الإدخال المخزّن مؤقتًا بسعر 0.01 دولار لكل مليون، بخصم 95% عن سعره البالغ 0.20 دولارًا.
أعد تشغيل نفس خطوة الوكيل مع بادئة من 60,000 رمز تُقدَّم دافئة: ينخفض سعر Muse Spark 1.2 من 8.8 سنتًا إلى حوالي 2.2 سنت. وينخفض سعر Luna من 1.6 سنت إلى حوالي 0.4 سنت. تضيق الفجوة المطلقة من 7.2 سنت إلى 1.8 سنت لكل خطوة، لكن المضاعف يبقى نفسه تقريبًا — التخزين المؤقت لا يُنقذ النموذج الأكثر تكلفة، بل يجعل كليهما أرخص بعوامل متشابهة. ما يتغيّر فعلًا هو أي بند في التكلفة يهيمن: في حالة التخزين المؤقت، تكلفة Muse Spark 1.2 هي 59% لرموز الإخراج بدلًا من 85% لرموز الإدخال، لذا تبدأ إسهابية النموذج في الأهمية أكثر من حجم سياقه.
هذه ليست مسألة افتراضية هنا. لقد أنتج Muse Spark 1.2 عدد 95 مليون رمز إخراج عبر مؤشر الذكاء (Intelligence Index)، مقابل متوسط 65 مليونًا. ويصف ملخص Artificial Analysis نفسه النموذج بأنه "إسهابي إلى حد ما". أما Luna فقد استهلكت 130 مليون رمز، وهو رقم يبدو أسوأ حتى تضربه في 1.20 دولار بدلاً من 4.25 دولار.
يدّعي النص التسويقي لمنتج ميتا أن التخزين المؤقت للمطالبات يمكن أن يقلل التكلفة الفعلية بنسبة 60–80% اعتمادًا على مقدار تكرار السياق. هذا تقدير من البائع، وليس قياسًا، لكن الحسابات أعلاه تقع ضمن النطاق.
زمن الاستجابة: المحور الذي يعكس فيه المعيار الحقيقة
إذا قرأت أرقام زمن الاستجابة من Artificial Analysis فقط، فستستنتج أن Muse Spark 1.2 هو الأكثر استجابة. الوقت حتى أول رمز: 26.12 ثانية لـ Muse Spark 1.2، و126.99 ثانية لـ GPT-5.6 Luna. أسرع بنحو خمس مرات.
كلا هذين القياسين مأخوذان عند أغلى إعداد استدلال لكل نموذج — xhigh لـ Muse Spark، وmax لـ Luna. وليس أي منهما ما ستراه. على OrcaRouter، خلال أسبوع من حركة المرور الحقيقية وبأي مستوى جهد يطلبه المتصلون فعليًا، يُظهر GPT-5.6 Luna زمن p50 حتى أول رمز يبلغ 1.84 ثانية وp95 يبلغ 9.68 ثانية. يُظهر Muse Spark 1.1 نفس زمن p50 البالغ 1.84 ثانية مع p95 أضيق يبلغ 6.00 ثانية. لا توجد بيانات تيليمتري للإنتاج لـ 1.2 بعد لأنه جديد جدًا.

الفرق البنيوي أكثر فائدة من أيٍّ من الرقمين. استدلال GPT-5.6 Luna اختياري — يمتد مؤشر الجهد من لا شيء مرورًا بالمنخفض والمتوسط والمرتفع والمرتفع جدًا وصولًا إلى الأقصى، ويمكنك حقًا إيقاف التفكير للتصنيف أو التوجيه أو الاستخراج. استدلال Muse Spark 1.2 هو إجباري. ينخفض المؤشر إلى الحد الأدنى، ولا يوجد إعداد يمنحك الأوزان دون أن تدفع مقابل التفكير. وبالنسبة لأي شيء عالي الحجم وحساس لزمن الاستجابة، فهذا قيد تصميمي وليس معلمة ضبط.
الإنتاجية المستدامة متقاربة: 165.0 رمزًا في الثانية لـ Muse Spark 1.2 مقابل 177.9 لـ Luna، وكلاهما أعلى بكثير من متوسط الفئة البالغ 71.
حاشية التسعير التي سيتعثر بها الجميع
سعر GPT-5.6 Luna مدرج حاليًا بشكل مختلف في أماكن مختلفة، وإذا كنت تبني نموذج تكلفة، فيجب أن تعرف ذلك قبل أن تقتبس رقمًا. يعرض كل من كتالوج Artificial Analysis وOrcaRouter 0.20 دولار لكل مليون إدخال و1.20 دولار لكل مليون مخرجات — وهو المعدل الذي تبع تخفيض سعر GPT-5.6 في يوليو، والمعدل الذي استخدمته Artificial Analysis لحساب فاتورة التقييم البالغة 174.06 دولار أعلاه. تعرض بعض قوائم السوق حاليًا 0.10 دولار و0.60 دولار مع طبقة أعلى منفصلة تبدأ بعد 272,000 رمز مطالبة. الخطوة الآمنة هي التحقق من السعر على نقطة النهاية التي تستدعيها فعليًا بدلاً من السعر في مقال المقارنة.
تفصيل التسعير المتدرج حقيقي أيًا كان معدل الأساس المطبق، وهو بحق لا يحظى بالتغطية الكافية: يقفز سعر Luna بمجرد أن يتجاوز الطلب الواحد نحو 272,000 توكن إدخال. يتضاعف سعر الإدخال تقريبًا، ويزيد سعر الإخراج بنسبة 50%، وتتزايد قراءات الكاش بالنسبة نفسها. إذا كان سبب نظرك إلى Luna هو نافذة السياق التي تبلغ 1.05 مليون توكن، فلاحظ أنك تفقد السعر المعلن بعد استخدام نحو ربع النافذة تقريبًا. يتمتع Muse Spark 1.2 بسعر ثابت عبر كامل 1,048,576 توكن دون أي رسوم إضافية على السياقات الطويلة — وبالنسبة للطلبات الفردية الطويلة حقًا، تضيق الفجوة الفعلية بين الاثنين بشكل كبير.
ما لا تستطيع لونا فعله بأي ثمن
الاختلاف في النمط هو أنقى سبب لاختيار أحدهما على الآخر، وهو لا يظهر في أي لوحة صدارة.
• المدخلات — يقبل Muse Spark 1.2 النصوص والصور والفيديو والصوت ومستندات PDF وفقًا لقائمة Meta. يقبل GPT-5.6 Luna النصوص والصور والملفات. لا صوت، لا فيديو. إذا كانت خطوط الإنتاج لديك تتعلق بالتسجيلات أو اللقطات، فإن Luna ليست مرشحة على الإطلاق.
• أقصى إخراج — تعلن Luna عن سقف إكمال يبلغ 128,000 رمز. لا تحدد نقطة نهاية Muse Spark 1.2 حدًا أقصى لطول الإكمال، وهو أمر غير معتاد بما يكفي لدرجة أنه يجب عليك اختباره بدلاً من التخطيط بناءً عليه.
• حد المعرفة — يُنشر حد معارف Luna بتاريخ 16 فبراير 2026. لا تنشر Meta أي حد لمعرفة Muse Spark 1.2، لذا خصص ميزانية للاسترجاع في كلتا الحالتين.
• التقديم — لونا متاحة عمومًا في جميع أنحاء العالم عبر مسارات متعددة. يتم تقديم Muse Spark 1.2 بواسطة مزود واحد فقط: Meta. نقطة نهاية واحدة، وسياسة منطقة واحدة، وشيء واحد قد يتعطل.
• الإشراف — كلاهما نقطتا نهاية خاضعتان للإشراف.
تحفظ صريح بشأن ميزة تعدد الوسائط: بطاقة المواصفات التقنية من Artificial Analysis لـ Muse Spark 1.2 تذكر أن ما قامت بتقييمه هو إدخال النص والصور، وليس السطح الكامل بخمس وسائط الذي تروّج له Meta. واجهة البرمجة (API) تقبل أكثر مما اختبره أي طرف مستقل.

الاعتماد، لأنه قابل للقياس
تخبرك المعايير بما يمكن أن يفعله النموذج؛ ويخبرك حركة المرور بما يثق به الناس. على مدار أسبوع متجدد على OrcaRouter، نقلت GPT-5.6 Luna 4,679.4 مليون توكن. مووس سبارك 1.1 — نفس سياق 1M، ودرجة مؤشر قابلة للمقارنة، وأقدم بأربعة أسابيع في الكتالوج — نقلت 4.4 مليون. أي بمعامل ألف تقريبًا.
جزء من ذلك يعود إلى التوزيع: لونا هو الخيار الافتراضي في عدد أكبر من الأدوات، وهو متاح عمومًا (GA) في جميع أنحاء العالم لفترة أطول، بينما عائلة Muse Spark أُطلقت في الولايات المتحدة فقط. لكن فجوة ألف إلى واحد على جهاز توجيه يكون فيه كلاهما على بُعد سلسلة نماذج واحدة من الآخر ليست مجرد قصة توزيع. إنها السبب العملي وراء كون لونا الخيار الافتراضي الأكثر أمانًا، وكون Muse Spark 1.2 هو الشيء الذي تدرسه بتأنٍّ.
تجدر الإشارة إلى ما يمكنك وما لا يمكنك استئجاره اليوم: GPT-5.6 Luna موجود في كتالوج OrcaRouter بسعر 0.20 دولار و1.20 دولار، وهي نفس الأرقام الموجودة في قائمة أسعار المزود نفسه، لأننا لا نطبق أي هامش ربح (0٪) ونمرر سعر القائمة الخاص بالمزود مباشرة. Muse Spark 1.1 موجود هناك بسعر 1.25 دولار و4.25 دولار على نفس الأساس. Muse Spark 1.2 غير موجود في الكتالوج بعد — وهو يُقدَّم مباشرةً من Meta. لذا فإن أرخص طريقة لإجراء هذه المقارنة بأمانة اليوم هي استخدام Luna مقابل Muse Spark 1.1 على مفتاح واحد، مع تغيير سلسلة نصية واحدة بين عمليات التشغيل، ثم إعادة الاختبار مقابل 1.2 عند توفره.
اختر واحدًا
اختر GPT-5.6 Luna إذا كان عبء العمل عالي الحجم وذو طابع نصي: محادثة، تصنيف، استخراج، توجيه، استخدام أدوات خفيفة. سعره ربع السعر الموزون، ويتيح لك إيقاف التفكير تمامًا، ووقت استجابته p50 البالغ 1.84 ثانية رقم إنتاجي مُقاس فعلًا وليس نتاج معايير القياس، وهو النموذج الذي تقف خلفه حركة مرور حية أكبر بألف مرة. ثلاث نقاط مؤشر لا تصمد أمام هذه الحسابات.
اختر Muse Spark 1.2 إذا كان عبء العمل يتضمن برمجة وكيلة طويلة المدى — إعادة هيكلة ملفات متعددة، وتصحيح أخطاء مطوّل، وعمل على مستوى المستودع بالكامل — أو إذا كان يتضمن إدخال صوت أو فيديو، حيث لا يمكن لـ Luna منافسته ببساطة. كما أنه الخيار الأفضل للطلبات الفردية الضخمة حقًا، لأن معدله ثابت عبر المليون رمز كامل بينما يتدرج سعر Luna في الارتفاع بعد 272K.
خذ كلاهما إذا كنت صادقًا بشأن كيفية بناء أنظمة الوكلاء في الواقع. النمط الرابح باستمرار هو نموذج رخيص يتولى أغلبية المكالمات الروتينية ونموذج مكلف يُحجز للخطوات التي تدفع الجودة ثمنها بنفسها. كلا النموذجين يعملان خلف نقطة وصول واحدة متوافقة مع OpenAI، لذا فإن هذا التقسيم قاعدة توجيه وليس علاقة مع مزود ثانٍ — وإذا تعطل الذراع المكلف في منتصف التشغيل، فإن التبديل التلقائي يعني أن تقييمك لا يسمم نفسه بصمت بنصف مجموعة البيانات.
الشيء الذي يجب مراقبته خلال الشهر القادم هو التفصيل حسب الأبعاد. الفكرة الأساسية لـ Muse Spark 1.2 هي القدرة الوكيلية، وفي الجيل السابق كان هذا هو البعد الذي تقدمت فيه Luna بثماني نقاط. وإلى أن ينشر شخص ما مؤشرًا وكيليًا لـ 1.2، فإن المكسب الإجمالي المركب البالغ ثلاث نقاط هو الدليل الوحيد على أن Meta قد سدت الفجوة.
