بطاقة عنوان لمقارنة MiMo-V2.6-Pro مقابل Qwen3.8-Max، تعرض بطاقتَي مواصفات متقابلتين: Xiaomi MiMo-V2.6-Pro عند 46 على مؤشر الذكاء v4.3.2، و42B معامل نشط لكل توكن، و134.3 توكن/ثانية و$0.18 لكل مليون مدمج، مقابل Qwen3.8-Max عند المؤشر 45، و95B نشط لكل توكن، و39.2 توكن/ثانية و$1.18.
Guides & Insights

MiMo-V2.6-Pro مقابل Qwen3.8-Max: نقطة مؤشر واحدة، ستة أضعاف السعر

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Qwen3.8-Max هو نموذج يضم 2.4 تريليون معامل، يُنشّط 95 مليارًا منها لكل توكن، ويعمل عبر مزوّد واحد. أما Xiaomi MiMo-V2.6-Pro فهو نموذج يضم 1.02 تريليون معامل، يُنشّط 42 مليارًا لكل توكن، ويسجّل نقطة واحدة أعلى في المؤشر المستقل نفسه، وتكلفة استدعائه تبلغ نحو سُدس تكلفة استدعاء Qwen3.8-Max. تجتمع هذه الحقائق معًا على نحو غير مريح، والطريقة التي توفّق بها بينها هي القرار كله بين النموذجين. الخلاصة القصيرة: على مؤشر Artificial Analysis Intelligence Index v4.3.2، يسجّل Xiaomi MiMo-V2.6-Pro نتيجة 46 ويسجّل Qwen3.8-Max نتيجة 45 — تعادل داخل نطاق الضجيج — بينما تظهر قائمة الأسعار 0.43 دولار و0.87 دولار لكل مليون توكن مقابل 2.00 دولار و6.00 دولار.

ما هو كل نموذج في الواقع

Qwen3.8-Max هو الطراز الرائد لدى Alibaba، متاح عمومًا منذ 3 أغسطس 2026، وكان أكبر نموذج طرحته سلسلة Qwen عند إطلاقه. وهو خليط متناثر من الخبراء مبني على معمارية Qwen 3.5 بإجمالي 2.4 تريليون معامل مع نحو 95 مليار معامل نشط لكل رمز، ونافذة سياق تبلغ مليون رمز، وحتى 131,000 رمز من الإخراج، وإدخال متعدد الوسائط يشمل النص والصورة والفيديو. خفّضت Alibaba السعر الدولي إلى 2.00 دولار لكل مليون رمز إدخال و6.00 دولار لكل مليون رمز إخراج، مع إدخال مخزّن مؤقتًا عند 0.25 دولار، وروّجت لذلك بوصفه نحو 40% من سعر الإدخال لدى Claude Opus 5. تبعه تحديث نقطي، Qwen3.8-Max-0902، في 2 سبتمبر 2026، وهو ما تقيسه حاليًا Artificial Analysis عند 45.

أصبح Xiaomi MiMo-V2.6-Pro متاحًا بشكل عام في 22 سبتمبر 2026، قبل ثلاثة أيام من كتابة هذه المقارنة، مع ظهور مستودعات نقاط التحقق الخاصة بالتعلم المعزز في اليوم السابق. وهو عبارة عن خليط متناثر من الخبراء بإجمالي 1.02 تريليون معلمة و42 مليار معلمة نشطة لكل رمز، مع نفس نافذة السياق البالغة مليون رمز، وتعدد وسائط أصلي عبر النص والصورة والفيديو والصوت، وأوزان منشورة بموجب رخصة MIT. حافظت Xiaomi على تسعير الجيل السابق بدلاً من إعادة تسعير نقطة التحقق الجديدة بالرفع، ولهذا السبب تظهر بسعر 0.43 دولار و0.87 دولار مع خصم ذاكرة تخزين مؤقت بنسبة 99% وسعر مدمج 0.18 دولار.

• الحوسبة النشطة لكل رمز — Qwen3.8-Max 95B؛ Xiaomi MiMo-V2.6-Pro 42B، أقل من النصف

• إجمالي المعاملات — Qwen3.8-Max 2.4T؛ Xiaomi MiMo-V2.6-Pro 1.02T

• درجة المؤشر — Xiaomi MiMo-V2.6-Pro 46؛ Qwen3.8-Max 45، وكلاهما على Artificial Analysis v4.3.2

• سرعة الإخراج — Xiaomi MiMo-V2.6-Pro ‏134.3 رمزًا/ثانية؛ Qwen3.8-Max ‏39.2، مقابل وسيط الفئة البالغ 72.5

• زمن الوصول إلى أول رمز — Xiaomi MiMo-V2.6-Pro ‏2.15 ثانية؛ Qwen3.8-Max ‏2.93

• سعر القائمة — Xiaomi MiMo-V2.6-Pro $0.43 / $0.87 لكل مليون؛ Qwen3.8-Max $2.00 / $6.00

• السعر المُدمج — Xiaomi MiMo-V2.6-Pro ‏0.18 دولار لكل مليون عند نسبة 7:2:1 لإصابة الذاكرة المؤقتة/الإدخال/الإخراج؛ Qwen3.8-Max ‏1.18 دولار

• الأوزان — Xiaomi MiMo-V2.6-Pro مرخّص بموجب MIT وقابل للتنزيل؛ قُدّم Qwen3.8-Max كنقطة نهاية مملوكة، مع إصدار مفتوح الأوزان نصي فقط يلغي سياق 1M وإدخال الرؤية

• إمكانية الوصول — يُحتسب مزود API واحد لكل منها على Artificial Analysis

النتيجة متعادلة. أما السرعة فلا.

نقطة واحدة على مركّب من عشر تقييمات ليست فرقًا ينبغي لأي أحد أن يتصرّف بناءً عليه، والإشارة الأكثر فائدة هي ما حدث تحت ذلك. النموذج الذي يمتلك أقل من نصف المعاملات النشطة لكل رمز سجّل درجة أعلى بشكل هامشي، وولّد مخرجات أسرع بثلاث مرات ونصف — 134.3 رمزًا في الثانية مقابل 39.2، حيث الوسيط لنماذج الاستدلال المماثلة هو 72.5. Qwen3.8-Max هو الأبطأ بين نماذج فئة الطليعة المقيسة على تلك الصفحة، وهذا نتيجة تصميمية لتنشيط 95 مليار معامل لكل رمز، وليس حادثًا عارضًا في الخدمة.

يكشف زمن الاستجابة قصة معاكسة لتلك التي توحي بها أعداد المعاملات. يصل Qwen3.8-Max إلى أول رمز له في 2.93 ثانية مقابل 2.15 لدى Xiaomi، والفجوة أصغر بكثير من فجوة معدل الإنتاجية — فـ Qwen3.8-Max بطيء بمجرد أن يبدأ الكتابة، وليس بطيئًا في البدء. في واجهة دردشة يكون فيها الجواب قصيرًا، بالكاد يظهر هذا الفرق. أما في حلقة وكيل تولّد عشرات الآلاف من رموز الإخراج، فإن معدل الإنتاجية هو الزمن الفعلي بأكمله، وفجوة بمقدار 3.4× تتراكم عبر كل دورة من دورات التشغيل.

A two-column comparison scoreboard for Xiaomi MiMo-V2.6-Pro and Qwen3.8-Max covering Intelligence Index v4.3.2 (46 vs 45), active parameters (42B vs 95B per token), output speed (134.3 vs 39.2 tokens/second), time to first token (2.15s vs 2.93s), blended rate ($0.18 vs $1.18 per 1M) and weight availability (MIT, full multimodal vs a text-only release without the 1M context).

عندما تتعارض جداول المورّدين، ولماذا لا يُعدّ ذلك تناقضًا

نشرت علي بابا جدولاً شاملاً لـ Qwen3.8-Max وهو قوي حقاً: Terminal-Bench 2.1 عند 86.6، وSWE-bench Pro عند 67.7، وPaperBench عند 93.0، وGPQA Diamond عند 92.6، وIFBench عند 82.8، وOSWorld-Verified عند 86.1، وHumanity's Last Exam عند 43.6. هذه أرقام شغّلتها الجهة المورّدة على أدوات الاختبار الخاصة بعلي بابا، وبعضها على معايير علي بابا الخاصة، لذا فهي ادعاءات وليست قياسات — لكنها ادعاءات على معايير مستخدمة على نطاق واسع، مما يجعلها أكثر قابلية للمقارنة بين المختبرات من نتيجة أداة اختبار مخصصة.

الرقم الرئيسي لـ Xiaomi هو 72.57 على DeepSWE v1.1، مرتفعًا من خط أساس قدره 58.4، مقيسًا باستخدام mini-swe-agent بمتوسط ثلاث محاولات على أداة التقييم الخاصة بـ Xiaomi، خلال تجربة تعلّم معزّز وثّقتها Xiaomi على أنها ثلاثون خطوة ونحو 750,000 مسار، بتكلفة معلنة تبلغ نحو 2.62 مليون دولار. لم يُقدَّم إلى لوحة صدارة DeepSWE العامة، ولم يُعِد إنتاجه أي طرف ثالث. ووضع 72.57 في مقابل 67.7 الخاص بـ Qwen على SWE-bench Pro وإعلان فوز Xiaomi بخمس نقاط سيكون قراءة عبر معيارين مختلفين وأداتَي تقييم مختلفتين وقاعدتَي تسجيل مختلفتين. هناك مسطرة واحدة بالضبط خضع لها كلا النموذجين على يد جهة غير مصنّعهما، وهي تقول 46 مقابل 45.

اثنان من الأرقام الأكثر تأثيرًا في Qwen3.8-Max ليسا درجات على الإطلاق. أعلنت علي بابا أن الأوزان ستُتاح مفتوحة المصدر إلى جانب Qwen3.8-27B، لكن نقطة التفتيش التي صدرت نصية فقط، ولا تحمل سياق 1M رمز الكامل ولا مدخلات الرؤية التي تمتلكها نقطة نهاية Max المُخدَّمة. لذا فإن «Qwen3.8-Max أوزان مفتوحة» و«Qwen3.8-Max نقطة نهاية متعددة الوسائط بسياق 1M» عبارتان صحيحتان عن أثرين مختلفين، وخطة نشر مبنية على الأولى مع توقع الثانية لن تصمد عند أول تلامس مع الواقع. وفي الأثناء، نقل الإصدار الفرعي 0902 النموذج إلى قمة إحدى ساحات تطوير الويب العامة دون تغيير رقم الإصدار — وهذا تذكير بأن النموذج الذي قيّمته في أغسطس ليس بالضرورة النموذج الذي يخدم طلباتك في سبتمبر.

هل يعني توفّر الأوزان المفتوحة أنه يمكنك الاستضافة الذاتية لأيٍّ منهما؟

بالنسبة لـ Xiaomi MiMo-V2.6-Pro، من حيث المبدأ نعم: رخصة MIT، دون حاجة إلى اتفاق تجاري. عملياً، نقطة حفظ بحجم 1.02 تريليون معامل مع 42 مليار معامل نشط تحتاج إلى عنقود خدمة متعدد العقد، وهو مستوى مختلف من الالتزام عن استدعاء API. نشر الأوزان يجعل الاستضافة الذاتية قانونية، وليست رخيصة.

بالنسبة إلى Qwen3.8-Max، الجواب أضيق مما توحي به السمعة. الإصدار المفتوح نصي فقط وبدون نافذة السياق الكاملة، لذا فإن استضافته ذاتيًا تمنحك نموذجًا أصغر بدرجة ملموسة من النموذج الذي قيست عليه الـ45. إذا كان ما تريده هو التكوين المُقاس مرجعيًا، فإن نقطة النهاية المخدومة هي المنتج، ونقطة النهاية احتكارية.

استدعاء أيٍّ منهما، والحساب الذي يحدد ذلك

يُحتسب كلا الطرازين لدى مزوّد API واحد في Artificial Analysis، وهو أمر غير معتاد بالنسبة لطرازين رائدين، ويجعل التحوّل الاحتياطي مسألة عملية لا مجرد رفاهية. Qwen3.8-Max متاح على OrcaRouter باسم qwen/qwen3.8-maxنقطة نهاية واحدة متوافقة مع OpenAI بسعر Alibaba المعلن نفسه وبدون أي هامش ربح، لذا فإن سعري 2.00 و6.00 دولار المذكورين أعلاه يُمرَّران دون تغيير، وأي تغيير في السعر من جانب Alibaba يصبح ساريًا لدينا في اليوم نفسه. وتُظهر قياساتنا الخاصة أن p50 لنقطة النهاية يبلغ نحو 3.3 ثانية، وهو الرقم الذي ينبغي التخطيط على أساسه لا أفضل حالة نظرية، كما أن سلسلة الاحتياط تعني أن الطلب المتعثر يُعاد إلى مزوّد آخر قبل أن يبدأ الرد. أما Xiaomi MiMo-V2.6-Pro فليس متاحًا على OrcaRouter؛ فلا يوجد أي طراز من Xiaomi هناك، والطريق إليه اليوم هو منصة Xiaomi نفسها والكتالوجات الخارجية التي تُدرجه.

حساب التكلفة هو حيث تُحسم هذه المواجهة فعليًا، وهو ليس الحساب الذي توحي به الأسعار المعلنة. عند مزيج 7:2:1 من إصابة الذاكرة المؤقتة/المدخلات/المخرجات، تبلغ الأسعار المدمجة 0.18 دولار و1.18 دولار لكل مليون — أي فجوة قدرها 6.6×، وهي أوسع من فجوتي المدخلات البالغة 4.6× والمخرجات البالغة 6.9×، لأن خصم الذاكرة المؤقتة لدى شاومي البالغ 99% أعمق من خصم علي بابا البالغ 88%. كما تسجّل Artificial Analysis تكلفة قدرها 0.13 دولار لكل مهمة في مؤشر الذكاء لـ Xiaomi MiMo-V2.6-Pro، مقيسة بالطريقة نفسها عبر كل نموذج في القائمة. شغّل عبء العمل نفسه عبر كليهما، وستجد أن النموذج الأرخص هو الذي سجّل نتيجة أعلى، وهو أمر غير معتاد أن يتاح لك كتابته، وهو السبب في أن هذه المقارنة ليست إجراءً شكليًا.

The OrcaRouter model page for qwen/qwen3.8-max, showing the model's vendor, capability tags, context window and the per-million-token input and output rates passed through from Alibaba's list price.

من ينبغي أن يبدّل، ومن لا ينبغي له

إذا كنت تستخدم Qwen3.8-Max اليوم وهو يعمل بكفاءة، فلا توجد حاجة عاجلة للانتقال. فجوة المؤشر نقطة واحدة، وسلوك الرؤية والسياق الطويل مُثبت في عبء عملك، وما زالت علي بابا تطوّر هذا الخط — وتحديث 0902 يظهر ذلك. أما مبرر الانتقال فهو الإنتاجية والتكلفة المدمجة، وهو مبرر قوي فقط إذا كانت حركة المرور لديك ثقيلة على المخرجات أو طويلة الأفق: الوكلاء، وتوليد الشيفرة، وأي شيء يكتب أكثر بكثير مما يقرأ.

إذا كنت تبدأ من الصفر، فمن الصعب مجادلة هذا الترتيب في ضوء الأدلة المنشورة. نموذج Xiaomi أسرع، وأرخص على كل المحاور، ومرخّص بموجب MIT، ومتقدم بشكل طفيف في المجمّع المستقل الوحيد الذي يغطي كليهما. لكن العوامل الموازنة حقيقية ومحددة: ثلاثة أيام من السجل في بيئة الإنتاج، ومسار خدمة واحد، ولا يوجد مدخل عام في اختبارات الأداء يمكن فحصه. وتشير هذه التركيبة إلى تقييمه في مسار موازٍ إلى جانب حل قائم بدلًا من استبداله — وهذا ما تُستخدم من أجله تهيئة التوجيه، ولهذا فإن الخطوة المفيدة هي وضع المرشّح والحل القائم خلف مفتاح واحد بدلًا من اختيار فائز من لوحة النتائج.

The Artificial Analysis model page showing the Intelligence Index v4.3.2 scores, output speed, latency and per-task cost that both models in this comparison are measured on.

ما الذي سيغيّر هذه الإجابة؟

ثلاثة أمور. وجود مزوّد ثانٍ وثالث لـ Xiaomi MiMo-V2.6-Pro سيزيل الاعتراض البنيوي الوحيد عليه، ويحوّل الفجوة السعرية إلى قرار حيّ لا إلى قرار مُغْرٍ فحسب. وتشغيل مستقلّ لإعداد DeepSWE إما أن يؤكد 72.57 أو يُلغيه، وأي من النتيجتين تستحق أكثر من الرقم نفسه. كما أن التفصيلات حسب التقييم على v4.3.2 ستُظهر أيّ من التقييمات العشرة يفوز به كل نموذج — فالمركّب مركّب، والنموذج الذي يتصدّر في البرمجة الوكيلية وآخر يتصدّر في الإجابة على الأسئلة كثيفة الاسترجاع يمكن أن يسجّلا المؤشر نفسه مع كونهما غير مناسبين لمهام أحدهما الآخر.