بطاقة رئيسية بعنوان «MiMo-V2.6-Pro مقابل MiMo-V2.6-Flash» مع عنوان فرعي «فارق سعري بمقدار 3 أضعاف، وما الذي لا يفسّره»، ولوحتان: لوحة يسرى بعنوان «MiMo-V2.6-Pro» مكتوب فيها «0.435 دولار / 0.87 دولار لكل مليون» و«42 مليار معامل نشط»، ولوحة يمنى بعنوان «MiMo-V2.6-Flash» مكتوب فيها «0.14 دولار / 0.28 دولار لكل مليون» و«15 مليار معامل نشط»، وفوق تذييل مكتوب فيه «كلاهما مرخّص بموجب MIT · كلاهما بسياق 1M · الفهرس منشور لـ Pro فقط».
Guides & Insights

MiMo-V2.6-Pro مقابل MiMo-V2.6-Flash: فجوة سعرية بثلاثة أضعاف لا يفسّرها معياران

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

في جداول التقييم الخاصة بشركة Xiaomi، يتفوّق MiMo-V2.6-Flash على MiMo-V2.6-Pro. الصف هو CyberGym، والفارق هو 95.1 مقابل 94.0. وهو صف واحد من أصل خمسة عشر صفًا، وهو ما يستدعي قراءة بقية هذه المقارنة بعناية بدلًا من افتراض أن الطراز الرائد هو دائمًا الخيار الأفضل — لأن MiMo-V2.6-Flash يكلّف نحو ثلث ما يكلّفه MiMo-V2.6-Pro، وفي معظم الصفوف لا يفصل بين الاثنين سوى بضع نقاط.

نُشر الطرازان كمستودعات على Hugging Face في 21 سبتمبر 2026، بموجب رخصة MIT، بفارق ثماني عشرة ثانية، كعمليتي تدريب منفصلتين لا كدرجتين على سلّم واحد. Xiaomi MiMo-V2.6-Pro هو فئة التريليون معلمة. MiMo-V2.6-Flash هو فئة الكفاءة. والسؤال الذي تجيب عنه هذه الصفحة هو: أيهما ينتمي إلى مسارك الإنتاجي؟ والجواب الصادق يعتمد على رقم غير موجود في أي من الإصدارين.

ما هو كل واحد

• المعاملات — Xiaomi MiMo-V2.6-Pro بإجمالي 1.02T مع 42B نشط لكل رمز، مقابل Xiaomi MiMo-V2.6-Flash بنحو 309B إجمالاً مع 15B نشط
• البنية — كلاهما مزيج خبراء متناثر مع إدخال أصلي متعدد الوسائط بالكامل؛ Flash موثّق بـ 48 طبقة، و39 نافذة منزلقة و9 انتباه كامل، وحجم مخفي 4096، و256 خبيرًا موجّهًا مع 8 نشطة وبدون خبراء مشتركين، إلى جانب محوّل رؤية بحجم 681M، ومرمّز صوتي بحجم 308M، ومرمّز رقع صوتية بحجم 127M
• السياق — 1M رمز على كليهما، مع ما يصل إلى 128,000 رمز إخراج على كليهما
• الترخيص — MIT على كليهما، والأوزان غير مقيّدة على كليهما
• السعر — 0.435 دولار للإدخال و0.87 دولار للإخراج لكل مليون رمز لـ Pro، مقابل 0.14 دولار و0.28 دولار لـ Flash: فجوة 3.1x على جانبي البطاقة
• الإدخال عند إصابة الذاكرة المؤقتة — 0.0036 دولار لكل مليون على Pro، و0.0028 دولار على Flash
• الإنفاق على التدريب — تذكر Xiaomi نحو 2.62 مليون دولار لتشغيل التعلم المعزز لـ Pro و854 ألف دولار لـ Flash، واكتمل كل منهما في أقل من ستة أيام عبر 30 خطوة تعلم معزز ونحو 750,000 مسار
• درجة المؤشر المستقل — 46 لـ Xiaomi MiMo-V2.6-Pro على مؤشر Artificial Analysis Intelligence Index v4.3.2؛ ولا توجد درجة منشورة لـ MiMo-V2.6-Flash

هذا السطر الأخير هو الذي يجب التمسك به. وكل ما فوقه، باستثناء نتيجة Pro، مُبلَّغ عنه من Xiaomi.

حيث لا يشتري ثلاثة أضعاف السعر شيئًا تقريبًا

يضع الجدول 3 من Xiaomi الاثنين جنبًا إلى جنب عبر أدوات الاختبار التي دُرّبت عليها السلسلة، وفي العمل الوكيلي طويل الأفق تكون الفوارق ضئيلة:

• DeepSWE v1.1 — Pro 71.9، Flash 67.9
• MiMo Code Bench — Pro 63.2، Flash 61.2
• AutomationBench v1.0.6 — Pro 53.1، Flash 52.3
• Toolathlon-Verified — Pro 76.9، Flash 73.6
• Terminal Bench 2.1 — Pro 89.9، Flash 87.6
• OSWorld-Verified — Pro 82.0، Flash 80.8
• JobBench — Pro 62.0، Flash 61.2
• MiMo Visual Coding — Pro 72.3، Flash 71.5
• CyberGym — Pro 94.0، Flash 95.1
• MiMo Cyber Bench — Pro 80.2، Flash 77.2

اقرأ ذلك العمود من الأعلى إلى الأسفل، وستجد أن تفوق الطراز الرائد يتراوح في معظمه بين نقطة وأربع نقاط، مع خسارة صف واحد بالكامل. في سير عمل يكون فيه الفرق بين 67.9 و71.9 هو الفرق بين إتمام مهمة وفشل مهمة، فإن دفع ثلاثة أضعاف السعر يعد رخيصًا. أما في سير عمل يكون فيه الفرق بين إجابتين مقبولتين، فإنه ليس رخيصًا. إن جداول المورّدين ذات الخانات العشرية كهذه تدعو إلى دقة زائفة — فلم يقم أحد خارج Xiaomi بتشغيلها، كما أن فارق نقطتين على أداة تقييم داخلية يقع تمامًا داخل النطاق الذي يمكن لمقيّم مختلف أو سياسة إعادة محاولة مختلفة أن يحرّكه.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash — the scoreboard'. The left column, MiMo-V2.6-Pro, reads Active params 42B, Price $0.435 / $0.87, DeepSWE v1.1 71.9, CyberGym 94.0, ExploitGym 17.8, Independent index 46. The right column, MiMo-V2.6-Flash, reads Active params 15B, Price $0.14 / $0.28, DeepSWE v1.1 67.9, CyberGym 95.1, ExploitGym 6.0, Independent index none published. A footer reads 'All benchmark figures are Xiaomi's own runs; only the Pro index score is independent.'

حيث يشتري الكثير

هناك مجموعة متقاربة من الصفوف حيث تتوقف الفجوة عن كونها مجرد مسألة تقريب. كل صف منها عمل أمني:

• ExploitGym — Pro 17.8، Flash 6.0
• ExploitBench — Pro 47.9، Flash 25.3
• SEC Bench Pro — Pro 66.3، Flash 47.5
• Agents' Last Exam — Pro 31.6، Flash 27.6
• Terminal Bench 4.0 — Pro 34.9، Flash 28.8

على ExploitGym، تبلغ النتيجة عند الطراز الرائد ثلاثة أضعاف النتيجة عند النموذج الأرخص، وهو المعامل نفسه الخاص بالسعر، وعلى SEC Bench Pro تبلغ 1.4 ضعف. هذا النمط هو ما تتوقعه من نموذج لديه 42 مليار معامل نشط مقابل نموذج آخر لديه 15 مليارًا: فالمهمة التي تحتاج إلى سلسلة طويلة من الاستدلال دون أي احتساب جزئي هي نوع المهمة التي تظهر فيها السعة الإضافية، أما وقوع CyberGym في الاتجاه المعاكس فهو الاستثناء الذي يثبت أن التشغيلين تعلمَ أشياء مختلفة لا الشيء نفسه بأحجام مختلفة.

إذن، هذا الانقسام يعكس حدًا حقيقيًا في عبء العمل، لا حدًا تسويقيًا. العمل عالي الحجم للوكلاء مع معيار نجاح متسامح — الاسترجاع، والتصنيف، والتعديلات الروتينية، والاستدعاءات التي يمكن أن تنقذها إعادة المحاولة — هو نطاق Flash. أما العمل الذي تكون فيه الإجابة الخاطئة مكلفة والإجابة الجزئية بلا قيمة — تطوير الاستغلال، ومراجعة الأمان، وجلسات الطرفية ذات الحالة متعددة الخطوات — فهو حيث يستحق مستوى Pro مضاعف السعر.

الرقم الذي لا وجود له

لا تمتلك MiMo-V2.6-Flash صفحة نموذج على Artificial Analysis. أما نظيرها فيمتلك واحدة. هذا التفاوت هو أهم شيء في هذه الصفحة، لأنه يعني أن الرقم الوحيد المقيس بشكل مستقل في أي مكان ضمن سلسلة MiMo-V2.6 هو الرقم 46 بجانب Xiaomi MiMo-V2.6-Pro. كل رقم يخص Flash ورد أعلاه — بما في ذلك صف CyberGym الذي يفوز به — يأتي من بيئة اختبار تابعة لـ Xiaomi، ومُقيّم تابع لـ Xiaomi، وتشغيل دون اتصال تابع لـ Xiaomi.

هناك حجة معقولة بأن هذا مؤقت: فالنموذج عمره يوم واحد وقت الكتابة، ويستغرق التقييم من طرف ثالث وقتًا. وهناك أيضًا حجة معقولة بأنه بنيوي، لأن Flash هو فئة الحجم، وفئات الحجم تجذب انتباهًا أقل إلى قياس الأداء. في كلتا الحالتين، النتيجة العملية اليوم هي أنه لا يمكنك مقارنة Flash بأي شيء خارج عائلته بنفس الثقة التي يمكنك بها مقارنة Pro. إذا كنت تختار بين Flash ونموذج غير Xiaomi على أساس السعر مقابل الجودة، فأنت تقارن رقمًا من مورّد مقابل رقم مُقاس من جهة أخرى.

تحمل بطاقتا النموذجين التحذير الثاني نفسه. لا ينشر أي مزوّد استدلال أيًّا من المستودعين — تقول Hugging Face ذلك صراحةً في كل صفحة، وأحصت Artificial Analysis مزوّد API واحدًا فقط لـ Pro. نحن لا نستضيف أيًّا من نقطتي الحفظ، لذا لا يمكن توجيه أيٍّ منهما عبرنا. والسبيل إلى كليهما هو منصة Xiaomi الخاصة والكتالوجات الخارجية التي تحملهما.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Flash-RL, showing the MIT licence tag and multimodal tags including 8-bit precision and fp8, a Safetensors panel reporting a model size of 159B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a model tree listing one finetune and six quantizations, and a collection block headed MiMo-V2.6 holding three items.

الثمن الذي تدفعه يكون في العتاد، لا في الرموز.

سعر الرمز الواحد ليس سوى نصف ما تكلفك به نقطة الحفظ، والاثنان يختلفان على القرص اختلافًا أحدّ بكثير مما يظهران عليه في بطاقة الأسعار. ينشر MiMo-V2.6-Flash أوزان FP8 بحجم 172.9 GB موزعة على 65 شظية. أما Xiaomi MiMo-V2.6-Pro فيحمل نحو ثلاثة أمثال عدد المعاملات، مما يضع تنزيله الخام في نطاق نصف تيرابايت قبل أي تكميم — ويُبلغ مستودعه الخاص عن حجم نموذج Safetensors يبلغ 524B معامل، وهو رقم لا يتوافق مع الإجمالي 1.02T ولا مع عدد المعاملات النشطة البالغ 42B.

هذه الفجوة تغيّر شكل القرار. فلاش عند 172.9 جيجابايت نموذج يستطيع فريق صغير استضافته ذاتيًا على سعة مستأجرة والتعامل معه كسلعة. أما Pro عند نحو ثلاثة أضعاف ذلك فهو قرار على مستوى العنقود — فقد قدّرت التغطية المحيطة بالإطلاق جولتي التدريب عند نحو 4,000 و8,000 من وحدات معالجة الرسوميات المكافئة لـ H200 على التوالي. إذا كان سبب نظرك في الأوزان المفتوحة هو أنك تريد خيار التوقف عن الدفع مقابل كل رمز، فإن نقطتي التفتيش تقدّمان ذلك الخيار على مقياسين مختلفين جدًا من الالتزام.

الاختيار بينهما

القاعدة التي تظل صالحة بعد التحفظات أعلاه هي الاختيار حسب فئة عبء العمل لا حسب متوسط نتائج المعايير القياسية. استخدم Flash مع أي شيء تكون مرتاحًا لإعادة المحاولة فيه؛ واستخدم Pro مع أي شيء لا تنقذك فيه إعادة المحاولة. ثم قِس، لأن أياً من النموذجين ليس لديه درجة مستقلة على المعايير القياسية التي تهمك فعلاً.

قياس نقطتي تحقق جنبًا إلى جنب هو المكان الذي يقوم فيه الموجّه بشيء لا يستطيع عقد خاص بكل نموذج القيام به. وضع طبقة رخيصة على الجزء الأكبر من حركة المرور الخاصة بك وتصعيد الحالات الصعبة فقط إلى الطبقة المكلفة هو نفس القرار الموجود في هذه الصفحة، معبّرًا عنه كتكوين بدلًا من إعادة كتابة — وهذا التركيب هو بالضبط ما توجد طبقة التوجيه من أجله. كما أنه مهم بالنسبة للسعر نفسه: نمرر سعر قائمة المزوّد كما هو دون هامش ربح بنسبة 0%، لذا إذا خفّضت Xiaomi السعر على أي من نقطتي التحقق، فإن الرقم من جانبنا يتغير في نفس اليوم وليس عند تجديد العقد التالي. ينطبق ذلك على النماذج التي نوفرها. بالنسبة لزوج MiMo-V2.6 تحديدًا، اليوم، ما زلت تشتري مباشرة من Xiaomi.

ما الذي سيحسم الأمر؟

هناك أمران من شأنهما تحويل هذا من مسألة تقديرية إلى مسألة حسابية. إن صفحة Artificial Analysis الخاصة بـ MiMo-V2.6-Flash ستضع كلا نقطتي التحقق على المحور نفسه للتكلفة لكل مهمة، وهو المحور الذي يضع Pro حالياً عند $0.133 لكل مهمة Intelligence Index، وستحلّ المقارنة نفسها بنفسها. أما إعادة إنتاج من طرف ثالث للمجموعة الأمنية — ExploitGym وExploitBench وSEC Bench Pro — فستؤكد ما إذا كانت الفجوة البالغة 3 أضعاف في تلك الصفوف خاصيةً في النموذج أم خاصيةً في المُقيِّم.

حتى ذلك الحين، الموقف القابل للدفاع عنه هو أن Xiaomi MiMo-V2.6-Flash هو الخيار الأفضل لمعظم الفرق في معظم الأوقات، وأن Xiaomi MiMo-V2.6-Pro هو الخيار الأفضل للفئة الضيقة من الأعمال التي يكون فيها الفشل هو النتيجة المكلفة. والصف الوحيد الذي يتفوق فيه Flash لا يبطل ذلك — لكنه تذكير مفيد بأن العلاوة السعرية للطراز الرائد هي ادعاء بشأن عبء عمل، وليس بشأن نموذج.

Screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, showing the Xiaomi attribution and 'Released September 2026', an Intelligence card reading 46 ranked #1 of 114, a Speed card reading 125.2 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.13 cost per Intelligence Index task, and a Verbosity card reading 140M output tokens, with a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.