
MiMo-V2.6-Pro مقابل Grok 4.6: كلا المورّدين نشرا أرقام DeepSWE، ولا يظهر أيٌّ منهما على لوحة الصدارة
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
مورّدان، معيار واحد، ورقمان لا يمكن طرح أحدهما من الآخر. تفيد مواد SpaceXAI الإطلاقية الخاصة بـ Grok 4.6 بتحقيقه 65.9% على DeepSWE v1.1. وتفيد مواد Xiaomi الخاصة بـ MiMo-V2.6-Pro بتحقيقه 72.57 على DeepSWE v1.1. وعند قراءتهما معًا، يوحيان بأن النموذج الأرخص مفتوح الأوزان يتفوق على النموذج الاحتكاري الرائد بنحو سبع نقاط. وعند قراءتهما بعناية، فإنهما لا يقولان شيئًا تقريبًا، لأن أحدهما نسبة مئوية من عرض إطلاق على أداة التقييم الخاصة بالمورّد، والآخر متوسط ثلاث نتائج من تشغيل تعلّم معزّز على مُقيّم Xiaomi الخاص، ولم يُقدَّم أي منهما إلى لوحة DeepSWE العامة. المقارنة بين MiMo-V2.6-Pro و Grok 4.6 التي تصمد أمام التدقيق موجودة على المؤشر المستقل، وهناك تكون الإجابة معاكسة لأرقام المورّد: 46 مقابل 44، لصالح Xiaomi، بفارق نقطتين.
صدر Grok 4.6 في 12 أغسطس 2026 عن SpaceXAI، وهو النموذج المهيمن الحالي هنا — نموذج حدودي تم إطلاقه وتقديمه على نطاق واسع، مع قائمة أسعار موثّقة وأشهر من القياسات المستقلة وراءه. وأصبح Xiaomi MiMo-V2.6-Pro متاحًا للعموم في 22 سبتمبر 2026، مع ظهور مستودعات نقاط تفتيش التعلم المعزز الخاصة به في اليوم السابق، وهو الوافد الجديد. كلاهما قادر على الاستدلال، وكلاهما مصمم للعمل الوكيلي طويل الأمد، والفجوة السعرية بينهما كبيرة بما يكفي لدرجة أن قلة خبرة الوافد الجديد هي الشيء الوحيد الذي يمنع المقارنة من التقدم.
ما هو كل نموذج في الواقع
Grok 4.6 خاص، ويستقبل إدخالًا نصيًا وصوريًا ويُرجع نصًا، وله تاريخ قطع معرفي هو 1 فبراير 2026. نافذة السياق لديه 500,000 رمز، أي نصف حجم نافذة منافسيه الرئيسيين، وهي المواصفة الأكثر تأثيرًا على ورقة مواصفاته. أسعار قائمته هي 2.00 دولار لكل مليون رمز إدخال، و0.50 دولار لكل مليون إدخال مخزّن مؤقتًا، و6.00 دولارات لكل مليون رمز إخراج لما دون 200,000 رمز موجّه، مع حد فاصل حاد عند هذه العتبة: عند 200 ألف أو أكثر تصبح الأسعار 4.00 و1.00 و12.00 دولارًا، وتُحتسب الطبقة الأعلى على الطلب بأكمله بدلًا من الجزء الذي يتجاوز الحد. تضاعف المعالجة ذات الأولوية السعر القياسي. قاسَت Artificial Analysis معدل 63.0 رمز إخراج في الثانية و42.79 ثانية حتى أول رمز عند أقصى جهد، و2,351.83 دولارًا لتشغيل المؤشر الكامل.
Xiaomi MiMo-V2.6-Pro هو نموذج خليط خبراء متناثر بإجمالي 1.02 تريليون معلمة و42 مليار معلمة يتم تنشيطها لكل رمز، مع نافذة سياق تبلغ 1 مليون رمز وتعدد الوسائط الأصلي عبر النص والصورة والفيديو والصوت. وهو مرخص بموجب MIT مع أوزان قابلة للتنزيل، وأبقت شاومي على تسعير الجيل السابق بدلاً من إعادة تسعير نقطة التحقق الجديدة إلى أعلى — $0.43 لكل مليون رمز إدخال و$0.87 لكل مليون رمز إخراج، وخصم 99% على الذاكرة المؤقتة، وسعر مختلط قدره $0.18 عند مزيج 7:2:1 من إصابة الذاكرة المؤقتة/الإدخال/الإخراج. قاس Artificial Analysis 134.3 رمز إخراج في الثانية، و2.15 ثانية إلى أول رمز، و$206.66 لتشغيل المؤشر — $0.13 لكل مهمة.
• الأوزان — MiMo-V2.6-Pro مرخّص بموجب MIT وقابل للتنزيل؛ Grok 4.6 احتكاري، عبر API فقط
• المعاملات — MiMo-V2.6-Pro إجمالي 1.02T / 42B نشطة؛ Grok 4.6 غير معلنة
• السياق — MiMo-V2.6-Pro بنافذة 1M من الرموز؛ Grok 4.6 بنافذة 500K، مع منحدر سعري عند 200K من المدخلات
• الوسائط — يستقبل MiMo-V2.6-Pro النص والصورة والفيديو والصوت؛ أما نطاق الإدخال المنشور لـ Grok 4.6 فهو النص والصورة
• درجة المؤشر — MiMo-V2.6-Pro 46؛ Grok 4.6 44، وكلاهما وفق Artificial Analysis v4.3.2
• سعر القائمة — MiMo-V2.6-Pro 0.43$ / 0.87$ لكل مليون؛ Grok 4.6 2.00$ / 6.00$، ويتضاعف عند تجاوز 200 ألف من المدخلات
• السعر المدمج — MiMo-V2.6-Pro 0.18 دولار لكل مليون؛ Grok 4.6 1.35 دولار
• تكلفة تشغيل المؤشر — MiMo-V2.6-Pro 206.66 دولارًا؛ Grok 4.6 2,351.83 دولارًا
• السرعة — MiMo-V2.6-Pro: 134.3 رمز إخراج/ثانية؛ Grok 4.6: 63.0
• الوقت المستغرق للوصول إلى أول رمز — MiMo-V2.6-Pro 2.15 ثانية؛ Grok 4.6 42.79 ثانية
• تاريخ انتهاء المعرفة — MiMo-V2.6-Pro لم يُنشر؛ Grok 4.6 في 1 فبراير 2026

الاختبار المعياري الذي أجراه كلا المورّدين، ولماذا لا يقبل المقارنة
DeepSWE v1.1 هو تقييم حقيقي وعام لوكيل برمجة من طرف ثالث، تديره Datacurve، وهو عائلة المهام الوحيدة التي اختارت الشركتان النشر بناءً عليها. وهذا ما يجعله مغريًا. لكن لا ينبغي استخدامه كمقارنة مباشرة وجهًا لوجه، والسبب ليس أن أيًا من المورّدين يكذب — بل إن الرقمين يصفان قياسين مختلفين لنفس اسم المهمة.
إن 72.57 الخاصة بـ Xiaomi هي متوسط ثلاث نتائج على أداة التقييم الخاصة بها مع mini-swe-agent، أُنتِجت أثناء تشغيل تعلّم معزّز بدلًا من مرشّح إصدار مُجمّد، وأُبلغ عنها إلى جانب رقم بداية قدره 58.4. وُثّق التشغيل على أنه 30 خطوة ونحو 750,000 مسار لكل نموذج، واكتمل في أقل من ستة أيام بتكلفة معلنة تبلغ نحو 2.62 مليون دولار لنموذج Pro. ولم يُقدَّم إلى لوحة Datacurve. أما نسبة 65.9% الخاصة بـ SpaceXAI لـ Grok 4.6 فهي رقم من عرض الإطلاق مستمد من مجموعة التقييم الخاصة بالمورّد، وأُبلغ عنه إلى جانب مكاسب على Grok 4.5 بلغت 11.9 نقطة في المعيار نفسه — بينما تحمل اللوحة العامة تهيئة مُقدَّمة لـ Grok 4.6 عند نحو 67%، وهو قريب بما يكفي من رقم المورّد ليوحي بأن أداة التقييم متوافقة تقريبًا على الأقل. وهذا لا ينطبق على رقم Xiaomi، الذي ليس له نظير عام على الإطلاق.
إذن، القول الصادق هو هذا: في اللوحة العامة، Grok 4.6 موجود وMiMo-V2.6-Pro غائب. وفي المُركَّب المستقل، جرى تقييمهما فعليًا من قبل المُقيِّم نفسه، ويتقدّم طراز Xiaomi بنقطتين. هاتان الحقيقتان ليستا في تعارض. إنهما ببساطة تقيسان أمرين مختلفين، والثانية هي التي ينبغي الاقتباس بها.
سياق 500K هو المواصفة التي تقرر أحمال العمل الحقيقية
نصف مليون رمز هو نافذة سياق كبيرة وفق أي معيار عادي، وصغيرة بالنسبة لعام 2026. النماذج التي تُصنَّف MiMo-V2.6-Pro معها جميعها عند 1M، والنتيجة العملية تظهر بالضبط في أعباء العمل التي يُسوَّق لها Grok 4.6. وكيل برمجي طويل التشغيل يحتفظ بمستودع، وسجل أدوات، وخطة متراكمة سيتجاوز 200,000 رمز من الموجِّه في جلسة واحدة — وعند هذا الحد، تتضاعف أسعار Grok 4.6 وتُطبَّق بأثر رجعي على الطلب بأكمله. الجلسة نفسها على MiMo-V2.6-Pro تمتد إلى مليون رمز دون تغيير في الفئة.
هذا فرق في المواصفات وفرق في هيكل التسعير في الوقت نفسه، ومن السهل تفويت الثاني عند مقارنة الأسعار المعلنة. السعر المدمج البالغ 1.35 دولار لـ Grok 4.6 مقابل 0.18 دولار لـ MiMo-V2.6-Pro يمثل فجوة تبلغ 7.5 أضعاف. وفي مطالبة تتجاوز 200K، تتسع الفجوة لتصبح أقرب إلى 15 ضعفًا، لأن سعر Grok يتضاعف بينما سعر Xiaomi لا يتحرك.
الحجة المضادة مسجّلة أيضًا، وهي جديرة بذلك. كانت أطروحة إطلاق Grok 4.6 هي كفاءة الجولات لا السياق الخام: في التقييم الوكيلي حيث جرى قياسه مقابل Claude Opus 5 على مهام متطابقة، أنهى المهمة في نحو 53 جولة وحوالي 500 مليون رمز إدخال مقابل نحو 103 جولات وملياري رمز للنموذج الآخر، بتكلفة تقديرية 0.84 دولار لكل مهمة — وهو أدنى رقم بين النماذج الرائدة في تلك المقارنة. النموذج الذي يدور في الحلقة نصف عدد المرات لا يحتاج إلى سياق بالقدر نفسه، ولا يستهلك العدد نفسه من الرموز. هذه ميزة معمارية حقيقية، وهي أقوى حجة لصالح Grok 4.6 في مواجهة أي بديل أرخص لكل رمز، بما في ذلك هذا البديل.

الوصول إلى كل واحد منها
Grok 4.6 متاح على OrcaRouter باسم grok/grok-4.6، ويمكن الوصول إليه عبر نقطة نهاية واحدة متوافقة مع OpenAI بسعر قائمة المزوّد وبهامش ربح 0% — لذا فإن أي تغيير في سعر SpaceXAI، بما في ذلك تغيير ذلك الحد البالغ 200K، يكون سارياً من جانبنا في اليوم نفسه. إن Xiaomi MiMo-V2.6-Pro غير متاح على OrcaRouter. ولا أي طراز من Xiaomi، والسبيل إليه اليوم هو منصة Xiaomi نفسها أو أحد كتالوجات الطرف الثالث التي تدرجه. إن قول ذلك بصراحة أنفع من ترك صفحة طراز توحي بغير ذلك.
قيمة هذا التباين عمليًا تتمثل في تجربة رخيصة. Grok 4.6 هو النموذج الذي قد تكون تدفع مقابله بالفعل. MiMo-V2.6-Pro هو تحسين بمقدار نقطتين في المؤشر بجزء يسير من السعر، أُطلق هذا الأسبوع، وله مسار خدمة واحد خلفه. السؤال الجدير بالإجابة ليس أيهما أفضل نظريًا، بل كم من حركة مرور Grok لديك يمكن لنموذج Xiaomi أن يستوعبه على مطالباتك الخاصة — والإجابة عنه بفتح عقد ثانٍ ومفتاح ثانٍ وعلاقة فوترة ثانية هي الاحتكاك الذي يمنع الاختبار من الحدوث. مع نقطة نهاية واحدة وتحويل تلقائي عند الفشل عبر المزودين، تصبح المقارنة تغييرًا في الإعدادات، والشق المتعلق بالتحويل عند الفشل يهم أكثر من المعتاد هنا: نموذج صدر هذا الأسبوع وأدرجه مزود API واحد عندما رصده Artificial Analysis ليس شيئًا يُوضع في مسار إنتاجي دون مسار بديل للرجوع إليه.

أي واحد تختار؟
اختر Grok 4.6 عندما تكون كفاءة الدور هي ما تحسنه — حلقات الوكيل الطويلة حيث تكون قدرة النموذج على الإنهاء في نصف الخطوات أكثر قيمة من معدل تكلفته لكل رمز — أو عندما تريد نموذجًا له شهور من القياسات المستقلة وراءه وليس أسبوعًا. إن سرعته البالغة 63 رمزًا في الثانية وزمنه البالغ 42.79 ثانية للوصول إلى أول رمز تجعله نموذجًا للعمل الدفعي وأحمال العمل غير المتصلة من الناحية التفاعلية، كما أن سياقه البالغ 500 ألف مع منحدر سعري عند 200 ألف يستدعي إبقاء المطالبات قصيرة.
اختر MiMo-V2.6-Pro عندما تُشغّل حلقات تكرارية كثيفة السياق قد تتجاوز حد Grok البالغ 200K، وعندما تحتاج إلى زمن وصول أول رمز منخفض بما يكفي لينتظره إنسان، وعندما تريد الأوزان داخل بنيتك التحتية الخاصة، أو عندما يجعل الحجم فجوة المعدل المدمج البالغة 7.5x هي الرقم الحاسم. تقدمه بمقدار نقطتين في المؤشر صغير بما يكفي بحيث لا ينبغي أن يكون السبب بمفرده؛ إن تكلفة 206.66 دولارًا مقابل 2,351.83 دولارًا لتشغيل مجموعة التقييم نفسها سبب أفضل.
ما سيحسم السؤال المفتوح هو تهيئة DeepSWE مُقدَّمة لـ MiMo-V2.6-Pro. ولدى Grok 4.6 واحدة بالفعل. بمجرد أن يظهر نموذج Xiaomi على اللوحة العامة مع إطار اختبار مُعلَن، وفترة ثقة، وتكلفة لكل مهمة، يكفّ 72.57 عن كونه رقم مورّد، وتصبح المقارنة أعلاه مقارنة حقيقية — وبالنظر إلى فارق النقطتين على المؤشر، فقد تميل الكفة إلى أي من الجانبين.
يضع OrcaRouter أكثر من 200 نموذج خلف نقطة نهاية واحدة متوافقة مع OpenAI بسعر قائمة المزوّد دون أي هامش ربح بنسبة 0%، لذا يصبح أي تغيير في سعر المورّد ساريًا في اليوم نفسه.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
