بطاقة عنوان رئيسية تقرأ "صدر Xiaomi MiMo-V2.6-Flash" فوق عنوان فرعي "309B من الأوزان المفتوحة، رخصة MIT، سياق 1M رمز - نُشر في 21 سبتمبر 2026"، مع أربع شارات: "إجمالي 309B / نشط 15B"، و"173 GB من أوزان FP8"، و"سياق 1M رمز" و"يتضمن تقريراً فنياً".
Guides & Insights

Xiaomi MiMo-V2.6-Flash صدر الآن: نموذج مفتوح بحجم 309 مليار معامل تستضيفه بنفسك

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

لم يعد MiMo-V2.6-Flash مهمة تدريب في 21 سبتمبر 2026 عند الساعة 15:39 UTC، عندما نشر فريق MiMo التابع لشاومي نقطة الحفظ باسم XiaomiMiMo/MiMo-V2.6-Flash-RL على Hugging Face — غير مقيّد، بترخيص MIT، والتقرير الفني مرفق، و65 جزءًا من الأوزان في الفهرس. XiaomiMiMo/MiMo-V2.6-Pro-RL جاء بعده بثمانية عشر ثانية. وقبل أسبوع، كان كلا النموذجين بطاقتين موسومتين بـ"متوقف" على لوحة تحكم تدريب عامة، وكان القول الشائع المتكرر عنهما أنه لا توجد أوزان. الآن هما ملفات يمكن لأي شخص تنزيلها وتشغيلها. هذا تغيير حقيقي في ما يمكنك فعله بالنموذج، وهو أمر مختلف عن إعلان عنه.

ابدأ بالطابع الزمني، لأن الإصدار وصل دون الاستعراض المعتاد من المورّد. مدونة Xiaomi نفسها، عند فحصها في 22 سبتمبر، لا تزال تُظهر إطلاق MiMo-V2-Flash في ديسمبر 2025 كأحدث منشور لها. لا توجد مقالة إطلاق لـ V2.6، ولا قائمة أسعار منشورة للجيل الجديد، ولا معرّف نموذج قابل للاستدعاء أعلنت عنه Xiaomi لأي من نقطتي التحقق. ما يوجد هو مستودع، وتقرير تقني، ووصفات نشر، ومجموعة من جداول المعايير التي يشغّلها المورّد — إضافة إلى تفصيل صغير خبيث في بطاقة النموذج لا يهم إلا الأشخاص الذين يخططون لتحميل هذا الشيء فعليًا.

البطاقتان اللتان يمكنك حملهما

كلا نقطتي الحفظ أصليتان ومتعددتا الأنماط كليًّا، مع سياق مُعلَن يبلغ مليون رمز، وكلتاهما تحملان رخصة MIT — قابلة للاستخدام التجاري، وقابلة للضبط الدقيق، وقابلة لإعادة التوزيع، بلا عتبة إيرادات ولا بند بحثي. تصف البطاقة Flash بأنه «نقطة الحفظ المتوازنة من حيث الكفاءة» في السلسلة، وتصف Pro بأنه الرائد؛ والجزء المثير هو كيف يختلفان عندما تنظر إلى التكوينات بدلًا من الجملة التسويقية.

• عدد المعاملات — MiMo-V2.6-Flash بإجمالي 309 مليار مع تنشيط 15 مليار لكل رمز؛ MiMo-V2.6-Pro بإجمالي 1.02 تريليون مع تنشيط 42 مليار. كلاهما من نوع مزيج الخبراء المتناثر.

• Backbone — Flash يتكون من 48 طبقة (39 نافذة منزلقة، 9 انتباه عالمي)، حجم مخفي 4096، 256 خبيرًا موجّهًا مع 8 مُنشّطين، نافذة منزلقة بحجم 128 رمزًا، لا يوجد خبراء مشتركون. الكتلة الأولى هي انتباه عالمي مع شبكة تغذية أمامية كثيفة؛ كل ما يأتي بعدها يتشابك.

• المُشفِّرات — نموذج {{1}}MiMo ViT{{/1}} بـ 681 مليون معلمة (28 طبقة، 24 نافذة منزلقة بالإضافة إلى 4 كاملة)، ومُرمِّز صوتي بـ 308 ملايين معلمة، ومُشفِّر رقع صوتية بـ 127 مليون معلمة، بحيث تدخل النصوص والصور والفيديو والصوت جميعها إلى النموذج نفسه بدلاً من ثلاث مسارات منفصلة ومربوطة معاً.

• الفكّ التخميني — مُصمِّم مسودّات للتنبؤ متعدد الرموز من خمس طبقات، على طراز DFlash، يُوصف في البطاقة بأنه يتنبأ بسبعة رموز مقدمًا في كل تمريرة أمامية من أجل تحقق متوازٍ.

• التخزين — يُفيد الفهرس المنشور بوجود 172.9 غيغابايت من بيانات الأوزان موزّعة على 65 شظية، بصيغة FP8 (e4m3) مع مخطط تنشيط ديناميكي. اقرأ ذلك على أنه نحو تسعة بايتات لكل معامل: لقد شحنت Xiaomi النموذج الكبير، لا نسخةً مُكمَّمة بحجم حاسوب محمول.

ثلاثة أرقام لا تتوافق

هذا جدير بأن يُقال بوضوح، لأن الثلاثة جميعًا تؤثر في قرار نشر لا في حجة تتعلق بقياس الأداء، ولا شيء منها مريب — فهي تبدو كانحراف في التوثيق بين المقال، وصفحة المستودع، والملفات المُشحونة.

الأول هو مفكك الترميز التخميني. يقول ملخص النموذج إن رأس MTP هو مُسوّد من خمس طبقات يتنبأ بسبعة رموز في كل تمريرة. إن ملف config.json في المستودع نفسه يضبط num_nextn_predict_layers على 3. لا يمكن أن يصف الرقمان الأثر نفسه، وملف الإعدادات هو ما سيقرأه وقت التشغيل. إذا كنت تحدد حجم الذاكرة اللازمة لفك الترميز التخميني، فاعتمد على الإعدادات وتحقق بعد التحميل.

الثاني أكثر خفاءً، وليس خطأً على الإطلاق بقدر ما هو اصطلاح تسمية يبدو كأنه خطأ. يُسمّى المستودع MiMo-V2.6-Flash-RL، مما يغري بافتراض أنه مهايئ تعلم معزز وليس نموذجًا. إنه النموذج. -RL لاحقة تشير إلى سلسلة ما بعد التدريب — نقطة التحقق هذه هي ناتج تشغيل التعلم المعزز المختلط الذي بثّته Xiaomi، وليست LoRA تستقر فوق قاعدة أخرى. يؤكد ذلك فهرس الأوزان: عشرات الآلاف من الموترات تغطي العمود الفقري الكامل، ومشفّر الرؤية، ومكدس الصوت، والمُسوِّد.

الرقم الثالث هو أول ما تصادفه إذا حددت متطلبات العتاد من صفحة المستودع بدلاً من البطاقة. تعرض كتلة Safetensors في تلك الصفحة 159B معامل. وهذا ليس أياً من الرقمين المذكورين في البطاقة — لا الإجمالي 309B ولا النشط 15B — وهو الرقم الأرجح أن ينسخه مخطط السعة، لأنه يقع بجانب زر التنزيل. لم تشرح Xiaomi الفرق، ولا يمكننا حسمه من الخارج؛ التفسير الأرجح هو اصطلاح عدّ على الموترات المكمّمة وليس نموذجاً مختلفاً. الخطوة الآمنة هي تقدير الحجم من بيانات الأوزان المنشورة بدلاً من ذلك: 172.9 GB من FP8 موزعة على 65 جزءًا هو رقم يجب تحمّل تكلفته في VRAM بغض النظر عن كيفية عدّ المعاملات.

ما تقوله المعايير، ومن أجراها

كل رقم أدناه مصدره جداول التقييم الخاصة بشركة شاومي في بطاقة النموذج. لم يُعَد إنتاج أيٍّ منها بشكل مستقل، ولا يظهر أيٌّ منها على لوحة صدارة عامة، وأعمدة المقارنة هي تشغيلات المورّد نفسه لأدوات الاختبار ذاتها في مواجهة نماذج شركات أخرى. تعامل مع شكل النتائج باعتباره معبّرًا، ومع المنازل العشرية باعتبارها زخرفة.

• وكيل برمجي — DeepSWE v1.1: Flash 67.9، Pro 71.9، مقابل Claude Opus 5 عند 74.0، GPT-5.6 Sol عند 73.0 وClaude Fable 5 عند 70.0. في Terminal Bench 2.1، يبلغ Flash 87.6 مقابل 89.1 لـ Opus 5 — وهي فجوة صغيرة بما يكفي لأن إطار التقييم، وليس النموذج، قد يكون هو ما يحددها.

• وكيل عام — AutomationBench v1.0.6 يضع Flash عند 52.3، متقدمًا على كل من GPT-5.6 Sol (45.8) وClaude Opus 5 (50.3) في تشغيل Xiaomi. Toolathlon-Verified: Flash 73.6، وPro 76.9، وOpus 5 80.6.

• الأمن السيبراني — العمود الأكثر اختلالًا في الجدول. CyberGym: Flash 95.1، متقدمًا على نظيره الأكبر عند 94.0، بينما MiMo-V2.5-Pro عند 40.0. ثم ينهار الحد الأدنى: ExploitGym 6.0 لـ Flash مقابل 22.1 لـ Opus 5، وExploitBench 25.3 مقابل 70.0، وSEC Bench Pro 47.5 مقابل 79.1 لـ GPT-5.6 Sol.

• وكيل بصري — MiMo VisualCoding: Flash 71.5، Pro 72.3، Opus 5 70.0.

هناك رقم واحد يستحق إبرازه لأنه من النوع الذي يخفيه عادةً منشور إطلاق. نشرت لوحة قيادة RL الخاصة بـ Xiaomi أن Flash حقق 65.68 على DeepSWE v1.1 — وبطاقة النموذج الآن تطبع 67.9 للاختبار المرجعي نفسه على نقطة التحقق النهائية. هذان ليسا القياس نفسه. كان رقم لوحة المعلومات موسومًا بـ mini-swe-agent، avg@3، على لقطة تدريبية؛ أما جدول بطاقة النموذج فهو التقييم غير المتصل الذي أجراه المورّد للأوزان الصادرة. الفرق البالغ نقطتين هو المكسب من الجزء الأخير من التشغيل مضافًا إليه كل ما تغيّر في إعداد التقييم، ولا يستطيع أي شخص خارج Xiaomi حاليًا الفصل بين الاثنين. إذا كنت تقتبس 65.68 منذ الأسبوع الماضي، فهو الآن رقم قديم يخص ناتجًا مختلفًا.

A screenshot of the XiaomiMiMo/MiMo-V2.6-Flash-RL repository page on Hugging Face, showing the MIT licence tag, the Safetensors block reporting 'Model size 159B params' and 'This model isn't deployed by any Inference Provider', and the repository file listing that includes the technical report and the weight shards.

ما تكلفة تشغيله فعليًا

الأوزان المفتوحة رخصة، لا فاتورة، وهنا يصبح هذا الإصدار أقل احتفالية. يوصي قسم النشر في البطاقة نفسها بـ SGLang (توازٍ موتري 16، توازٍ بياناتي 2، مع تمكين المسار التخميني متعدد الطبقات بنمط EAGLE) أو وصفة vLLM عند توازٍ موتري 8، ويشير إلى أن vLLM المستقر قد يتخلف عن البنية. تلك مهمة تقديم متعددة العقد لطراز بحجم 309B تشغل أوزانه نحو 173 GB قبل أن تضيف ذاكرة KV المؤقتة لسياق بطول 1M رمز. أخذ العينات الموصى به هو temperature 1.0، وtop_p 0.95.

إذن، الصياغة الصادقة لـ«المفتوح المصدر» هنا هي: أزالت شاومي حاجز الترخيص وأبقت حاجز العتاد في مكانه تمامًا. صار الضبط الدقيق لـFlash على بيانات التتبع الخاصة بك قانونيًا وممكنًا الآن؛ أما القيام بذلك على أي شيء أصغر من عقدة GPU جادة فليس كذلك. ذلك عرض حقيقي ومختلف عن نقطة نهاية مستضافة، ولهذا فإن طريقتَي استخدام هذا الجيل لا تتنافسان — فهما تغطيان ميزانيتين مختلفتين.

إذا أردت الحصول على القدرة دون العقدة، فإن النماذج التي تقيس Xiaomi نفسها مقابلها في ذلك الجدول هي البديل العملي: GPT-5.6 Sol وClaude Opus 5 وClaude Fable 5 كلها قابلة للاستدعاء اليوم، وهي مفتاح API واحد بسعر قائمة المزوّد مع هامش 0% يُمرَّر عبر OrcaRouter، لذا فالقرار الذي تتخذه فعليًا هو «شراء عقدة» مقابل «قياس الاستدعاءات». وإذا أردت أن ترى كيف تقارن الفئة القابلة للاستدعاء في مهام البرمجة نفسها قبل الالتزام بأي من الطريقين، فإن لوحة البرمجة قراءة أسرع من جدول المورّد. وما لا يمكنك فعله على أي موجّه اليوم هو استدعاء MiMo-V2.6-Flash نفسه — فنحن لا نوجّه أي نموذج من Xiaomi، وسطر التوفّر في بطاقة Xiaomi نفسها يشير إلى قنوات Xiaomi الخاصة: منصة MiMo API، وAI Studio، وMiMo Code، وتطبيق سطح المكتب.

A single-column scoreboard headed 'MiMo-V2.6-Flash - the numbers that decide a deployment', listing 309B total and 15B activated parameters, a 1M-token context, text/image/video/audio modalities, the MIT licence with no revenue cap, 172.9 GB of FP8 weights across 65 shards, DeepSWE v1.1 at 67.9 against 74.0 for Claude Opus 5, CyberGym at 95.1, and SGLang tp16/dp2 or vLLM tp8 serving with no vendor price published.

مسألة التسعير لا تزال مفتوحة

لم تنشر شاومي سعرًا لكل توكن لـ MiMo-V2.6-Flash. تشير التقارير عن الإطلاق إلى أن السلسلة ستحتفظ بتسعير API الخاص بـ MiMo-V2.5، وهذا ادعاء صحفي وليس قائمة أسعار رسمية من المورد — كانت الأسعار المنشورة خارجيًا لجيل V2.5 حوالي عُشر دولار لكل مليون توكن مدخل، مع كون المدخلات المخزنة مؤقتًا أرخص بعشر مرات، لكن لا شيء على موقع شاومي يؤكد أن نقاط التفتيش الجديدة ترثها. حتى تظهر قائمة أسعار، فإن أي رقم تراه لنقطة نهاية MiMo-V2.6 هو استنتاج شخص ما.

لا يزال هناك أمران آخران مفقودان، وكلاهما مدرج على قائمة مهام Xiaomi نفسها وليس على قائمة أي جهة أخرى. كان تصريح لو فولي خلال البث المباشر لـ RL أن بيئات التدريب وكود RL سيُتاحان كمصدر مفتوح، وتكرر مواد الإطلاق هذا الالتزام؛ أما المستودعات فتُتيح حاليًا الأوزان وتقريرًا تقنيًا وتعليمات النشر، لا حزمة التدريب. ولا يوجد تقييم مستقل: لا إرسال إلى لوحة المتصدرين، ولا إعادة تشغيل من طرف ثالث لأعمدة DeepSWE أو CyberGym. هذه هي الفجوة الأكثر أهمية لأي شخص يحاول أن يقرر ما إذا كان نموذج بحجم 309B بميزانية نشطة تبلغ 15B يستحق عقدة.

ما الذي قد يغيّر الصورة؟

ثلاث إشارات تستحق المتابعة، بترتيب تقريبي حسب مقدار تأثيرها في قرار ما. قائمة أسعار منشورة تحوّل هذا من مشروع استضافة ذاتية إلى بند يمكنك مقارنته بالطليعة المستضافة. وتشغيل من طرف ثالث على نفس أطر الاختبار — DeepSWE أو Terminal Bench، مُقدَّم بدلًا من أن يكون مُبلَّغًا ذاتيًا — سيحسم ما إذا كانت 67.9 موقعًا حقيقيًا أم تهيئة مواتية. وبيئات التعلم المعزز، إذا وصلت، ستكون المخرَج الأكثر إثارة للاهتمام لمعظم الفرق، لأنها ما ستحتاجه لإعادة إنتاج حلقة التحسين الذاتي على بياناتك الخاصة.

حتى ذلك الحين، فإن القراءة العملية لهذا الإصدار ضيقة وواضحة. إن MiMo-V2.6-Flash نموذج وكيل متعدد الوسائط مفتوح الأوزان ومرخّص بموجب MIT، بحجم يفترض وجود عنقود حوسبي — وهو أول نقطة تحقق في جيل MiMo-V2.6 يمكنك أن تمسكها بيديك، وهو أكثر مما كان يمكن قوله عنه الأسبوع الماضي.

A screenshot of Xiaomi's MiMo blog, captured 22 September 2026, showing the site navigation and the December 16, 2025 post 'Introducing MiMo-V2-Flash' as the newest entry, with the line 'Today, we are releasing and open-sourcing MiMo-V2-Flash', the availability note listing Hugging Face, the API Platform and AI Studio, and a 'Benchmark Comparison' table with columns for SWE-Bench Verified, SWE-Bench Multilingual, Tau2-Bench, AIME25, GPQA-Diamond, HLE and Arena-Hard.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا