
MiMo-V2.6-Pro مقابل GPT-5.6 Sol: نقطة مؤشر واحدة تكلف خمسة عشر ضعفًا أكثر لكل مهمة
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 36 tok/s
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 181 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
على مؤشر Artificial Analysis Intelligence Index v4.3.2، وفق قراءة بتاريخ 25 سبتمبر 2026، يسجل GPT-5.6 Sol بأقصى جهد 47 درجة، ويسجل MiMo-V2.6-Pro من شاومي 46 درجة. نقطة واحدة. الرقم الذي يفصل بينهما فعليًا ليس النتيجة، وليس سعر الرمز الواحد — بل هو تكلفة مهمة مؤشر واحدة، والتي تنشرها Artificial Analysis بمبلغ 1.99 دولارًا لـ GPT-5.6 Sol و0.13 دولارًا لـ MiMo-V2.6-Pro. خمسة عشر ضعف المال مقابل نقطة واحدة. واعتبارًا من هذه القراءة، تحمل صفحة المُقيِّم الخاصة بذلك الطراز إشعار إهمال، لأن GPT-6 Sol قد حل محله.
نشرت Xiaomi أوزان MiMo-V2.6-Pro وتقريره الفني في 21 سبتمبر 2026، قبل أربعة أيام من هذه القراءة؛ وأطلقت OpenAI نموذج GPT-5.6 Sol في 9 يوليو 2026. كلا الحقيقتين أعلاه جديدتان منذ آخر مرة كُتبت فيها هذه المقارنة الثنائية، وهما تشدّان في اتجاهين متعاكسين. يقول إشعار التقادم إن المقارنة تجري مع نموذج تجاوزته OpenAI بالفعل. ويقول الرقم الخاص بكل مهمة إن ما بدا وكأنه خطأ تقريب عندما سُعّر النموذجان بسعر القائمة هو، على عبء عمل حقيقي، القرار بأكمله. أي الأمرين يهم يعتمد على ما إذا كنت تشتري نموذجًا أم تستبدل واحدًا.
ما تقوله الصفحتان الآن
تم إصدار GPT-5.6 Sol في 9 يوليو 2026 بصفته الرائد في عائلة GPT-5.6. سعره المعلن هو 4.00 دولارات لكل مليون رمز إدخال و20.00 دولارًا لكل مليون رمز إخراج على واجهة برمجة التطبيقات الخاصة بالجهة الأولى من OpenAI، مع خصم بنسبة 90% على الذاكرة المؤقتة، وتسجّل الصفحة 90 مليون رمز إخراج تم توليدها عبر تشغيل الفهرس مقابل وسيط قدره 88 مليونًا. وقد قاس 73 رمز إخراج في الثانية، وهو ما تصفه الصفحة نفسها بأنه أسرع من المتوسط مقابل وسيط قدره 72 رمزًا/ث. ويقع إدخاله في الفهرس عند المرتبة 19 من أصل 210 نماذج في فئته.
Xiaomi MiMo-V2.6-Pro هو نقطة تحقق لمزيج خبراء متناثر بإجمالي 1.02 تريليون معامل و42 مليار معامل نشط، مرخّص بموجب MIT، مع نافذة سياق تبلغ 1M رمز، ومدخلات من النص والصورة والكلام والفيديو مقابل مخرجات نصية. وهو مُسعّر عند 0.43 دولار و0.87 دولار لكل مليون رمز مع خصم ذاكرة مؤقتة بنسبة 99% — أي عُشر سعر إدخال Sol وواحد من ثلاثة وعشرين من سعر إخراجه. وقد أنتج 140 مليون رمز إخراجي في تشغيل الفهرس، وقاس 43.6 رمز إخراجي في الثانية، وهو ما تصفه صفحته بأنه بطيء بشكل ملحوظ مقابل وسيط قدره 67.1 t/s.
• تكلفة مهمة الفهرس — MiMo-V2.6-Pro 0.13 دولار؛ GPT-5.6 Sol 1.99 دولار — الفجوة 15× • سعر القائمة — MiMo-V2.6-Pro 0.43 / 0.87 دولار لكل مليون؛ GPT-5.6 Sol 4.00 / 20.00 دولار • خصم التخزين المؤقت — MiMo-V2.6-Pro 99%؛ GPT-5.6 Sol 90% • رموز الإخراج في تشغيل الفهرس — MiMo-V2.6-Pro 140M؛ GPT-5.6 Sol 90M • سرعة الإخراج — MiMo-V2.6-Pro 43.6 t/s، مقابل وسيط 67.1؛ GPT-5.6 Sol 73 t/s، مقابل وسيط 72 • السياق والأوزان — MiMo-V2.6-Pro 1M ومرخّص بموجب MIT؛ GPT-5.6 Sol 1M ومملوك

إشعار الإهمال هو السطر الأكثر تأثيرًا
تفتح Artificial Analysis الآن صفحة GPT-5.6 Sol بإشعار مؤطّر: «هذا الطراز مهمل. نواصل فقط قياس الأداء الخاص بحمل عمل الإدخال الافتراضي البالغ 10 آلاف رمز»، تليه جملة مفادها أن OpenAI أطلقت طرازًا أحدث، هو GPT-6 Sol (max)، وأنه ينبغي النظر إليه بدلًا منه. لذا فإن الرقم 47 على المؤشر هو قراءة لطراز لم يعد هو الخيار الذي يُشترى. هذا لا يجعل القراءة خاطئة — فقد قيست على المؤشر نفسه، وفي اليوم نفسه، وبإعداد الجهد نفسه الذي قيست به قراءة 46 — لكنه يغيّر الغرض من المقارنة. لم تعد المقارنة تعني «أي طراز رائد ينبغي أن أستخدم؟»، بل تعني «ما تكلفة قمة لوحة النماذج المغلقة، في اللحظة التي كانت فيها في القمة؟».
إعادة التأطير هذه أهم مما تبدو، لأن إشعارات التقادم في صفحات المقيّمين هي أحد الأماكن القليلة التي تظهر فيها وتيرة إصدارات منتجات المورّد كتغيّر في البيانات لا كبيان صحفي. الدرجة مجمّدة؛ والنموذج غير مطروح. أي شيء تبنيه بالاعتماد على 47 إنما تبنيه بالاعتماد على لقطة مجمّدة.

لماذا يُعد الرقم الخاص بكل مهمة هو الذي ينبغي أن تُبنى عليه النمذجة
تجمّل الأسعار لكل رمز النماذج الرخيصة وتضلّل بشأن أحمال العمل غير المحايدة تجاه الرموز. تكلفة مهمة المؤشر قياس مختلف: فهي ما أنفقه المُقيِّم فعلاً للحصول على إجابة واحدة من كل نموذج، وهي تجمع بين السعر وعدد الرموز التي اختار النموذج إخراجها. يُخرج MiMo-V2.6-Pro رموزاً أكثر من Sol في تشغيل المؤشر — 140 مليون مقابل 90 مليون، أي نحو 1.6 مرة — ومع ذلك تبلغ تكلفته 0.13 دولار للمهمة مقابل 1.99 دولار. ميزة السعر نحو ثلاثة وعشرين ضعفاً في الإخراج؛ وعقوبة الإسهاب 1.6×؛ والحاصل هو الفجوة البالغة خمسة عشر ضعفاً لكل مهمة.
هذا هو الحساب الذي ينبغي أن يُبنى عليه نموذج تكلفة، وهو الحساب الذي يصبح غير مرئي إذا قارنت $0.87 بـ$20.00 وتوقفت. وهو يخبرك أيضًا بما قد يُبطل هذا الاستنتاج. إذا كان عبء العمل لديك تهيمن عليه مخرجات قصيرة جدًا، فإن عدد رموز Sol ينكمش ليقترب من عدد رموزك، وتؤدي فجوة المعدل البالغة ثلاثة وعشرين ضعفًا معظم العمل، لذا يتحرك المضاعف الحقيقي نحو فجوة المعدل لا بعيدًا عنها. وإذا كان عبء العمل لديك تهيمن عليه مسارات استدلال طويلة، فإن إسهاب MiMo-V2.6-Pro البالغ 1.6× يتراكم، ويصبح $0.13 هو السقف لا التقدير. الرقم المنشور هو قياس لشكل معيار أداء واحد، وليس عرض سعر يمكنك تسليمه إلى الإدارة المالية.
خط الكمون هو الثقل الموازن الصادق
عند 43.6 رمزًا مُخرَجًا في الثانية، يُعد MiMo-V2.6-Pro أبطأ من GPT-5.6 Sol الذي قيس في اليوم نفسه عند 73 — وأبطأ من النماذج التي تقارنه صفحته بها، والتي يبلغ وسيطها 67.1. وتقول صفحته ذلك صراحةً: «بطيء بشكل ملحوظ». بالنسبة إلى خط معالجة دفعي، هذه كلفة إنتاجية يمكن تسعيرها. أما بالنسبة إلى وكيل تفاعلي، فهذا قرار منتج، وكونه أرخص خمس عشرة مرة لكل مهمة لا يجعل نموذجًا بطيئًا سريعًا. إذا كان قيدك يتمثل في ميزانية لكل دور بدلًا من فاتورة شهرية، فإن النسبة المهمة هي 43.6 مقابل 73، وMiMo-V2.6-Pro يخسرها.
أين يستقر هذا على جهاز توجيه
الشكل المفيد لهذا الاقتران ليس "اختر واحدًا". بل هو أن كلا النموذجين يجيبان على المؤشر نفسه، وينشر المُقيِّم تكلفة لكل مهمة لكلٍّ منهما، بحيث يمكن إجراء التقسيم بناءً على التكلفة المقيسة لا على فئات المورّدين. على OrcaRouter تمتد الفهرسة إلى أكثر من 200 نموذج خلف مفتاح واحد بسعر قائمة كل مزوّد مع هامش ربح 0% — فيصل تخفيض سعر المورّد إلى فاتورتك في اليوم نفسه، دون عقد ثانٍ لإعادة التفاوض — كما تتيح لغة التوجيه DSL لعبء العمل إرسال الاستدعاءات الرخيصة عالية الحجم إلى نموذج واحد والصعبة إلى نموذج آخر حسب المهمة لا حسب العلامة التجارية. ويغطي التحويل التلقائي عند الفشل الحالة التي يكون فيها المسار الأرخص متدهورًا. لا يتوفر Xiaomi MiMo-V2.6-Pro على مساراتنا — فنحن لا نُدرج أي نموذج قبل أن يقوم مزوّد بضمّه — لذا فبالنسبة لهذا الجانب من المقارنة، الإجابة الصادقة هي واجهة API الخاصة بالمورّد نفسه أو أي منصة مستضافة تربطك بها علاقة بالفعل.

ما الذي ينبغي فعله بهذا بحلول الأسبوع المقبل؟
تغير شيءان في 25 سبتمبر 2026 وواحد فقط منهما يتعلق بالسعر. يحمل GPT-5.6 Sol إشعار إيقاف على المؤشر حيث قُيس عند 47، وهذا يُخرجه من كونه قرار شراء ويتركه كمرجع للمعايرة. يُقاس MiMo-V2.6-Pro عند 0.13 دولار لكل مهمة مؤشر مقابل 1.99 دولار لـ Sol، وهو ما يعادل خمسة عشر ضعف المال مقابل نقطة مؤشر واحدة — وهو 43.6 توكن في الثانية، وهو أبطأ من النموذج الذي يُقارن به وأبطأ من وسيط فئته الخاصة. شغّل الرقمين مقابل حركة المرور الخاصة بك قبل أن يصبح أي من الرقمين قرارًا: تكلفة المهمة الواحدة هي قياس، وليست معدلًا، والكمون هو قياس، وليس رأيًا. إذا كانت مخرجاتك قصيرة وغير تفاعلية، فإن الحجة لصالح نقطة التحقق المفتوحة أقوى مما توحي به فجوة المؤشر. إذا كانت مخرجاتك طويلة أو كان مستخدموك ينتظرون، فإن التوفير بمقدار خمسة عشر ضعفًا يشتري لك منتجًا أبطأ، وهذه مقايضة لا يمكن إلا لعبء العمل الخاص بك تسعيرها.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
