
Ming-Image-0.1-Design مقابل MAI Image 2.5 Pro: سقف الميغابكسل يحسم الأمر
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 177 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1323 tok/s
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
الرقم الأكثر أهمية في مقارنة بين Ming-Image-0.1-Design و MAI Image 2.5 Proليس نتيجة Elo. إنه 1,048,576. هذا هو سقف الإخراج الذي توثّقه Microsoft لـ MAI Image 2.5 Pro — نحو 1024 x 1024 — بينما توصي Ming-Image-0.1-Design من inclusionAI بدقة 2048 x 2048 ولن تُصيّر عند الأحجام الوسيطة على الإطلاق، بل تُثبّت الطلب على فئة 1024 أو فئة 2048. كلا النموذجين بارعان حقًا في وضع نص مقروء داخل الصورة، ولهذا يظلان يظهران في المحادثات نفسها. واحد منهما فقط سيمنحك تخطيطًا بدقة 4 ميغابكسل، وواحد منهما فقط مسعّر لكل رمز على الطبقة المميزة لدى مزوّد سحابي فائق النطاق.
Ming-Image-0.1-Design هو نموذج تحويل النص إلى صورة بحجم 6B تابع لـ inclusionAI، مرخّص بموجب MIT، ونُشرت أوزانه في 17 سبتمبر 2026. MAI Image 2.5 Pro هو فئة الجودة لدى Microsoft AI، وهو في معاينة عامة على Microsoft Foundry منذ 23 يوليو 2026. لم يُعَد إنتاج أي من الادعاءين بشأن تصيير النص لديهما خارج المختبر الذي صدر عنه — لكن أحدهما مرّ عبر ساحة اختبار، وهذا التمييز يتخلل كل ما يلي.
ما صُمِّم له كل واحد منها
MAI Image 2.5 Pro هو الطراز الأعلى في عائلة MAI-Image-2.5 من مايكروسوفت، ويأتي فوق MAI-Image-2.5 للأعمال المتوازنة وMAI-Image-2.5-Flash للكميات الكبيرة، بينما يوجد MAI-Image-2.6 بالفعل في معاينة خاصة اعتبارًا من 19 أغسطس. وتصفه مايكروسوفت بأنه أعلى طراز للصور من حيث الدقة حتى الآن، ويستهدف الصور الرئيسية والتحرير التفصيلي والعرض الدقيق للنص داخل الصورة. وهو مبني حول الإدخال متعدد الصور: إذ تُفيد الشركة بتحقيق اتساق بنسبة 94% في الأحرف عبر عمليات التوليد، وتضعه في موقع مناسب لسير العمل الذي تأخذ فيه أصلًا موجودًا، وتغيّر شيئًا واحدًا، ثم تُطلقه.
Ming-Image-0.1-Design هو مُولِّد من الصفر، وليس محررًا. تُدخِل المطالبة، وتحصل على الصورة، دون الحاجة إلى صورة مرجعية. مجاله التصميم الجرافيكي الكثيف نصيًا — نماذج واجهات المستخدم، ولوحات المعلومات، والإنفوجرافيك، والملصقات — وسمته الميكانيكية المميزة أنه يُخرِج RGBA أصليًا عندما تبدأ المطالبة بإحدى عبارات الشفافية الموثّقة. والنموذج المرافق، Ming-Image-0.1-Design-Layer، يفكك تصميمًا مسطحًا إلى 2–9 ملفات PNG RGBA منفصلة يُعاد تركيبها لتكوين الأصل.
• سقف الإخراج — يُوصى بـ Ming-Image-0.1-Design 2048 x 2048، أو 1024 x 1024، مع تثبيت الأحجام الوسيطة على أحد هذين الحجمين مقابل MAI Image 2.5 Pro المقيّد عند 1,048,576 بكسل، أي حوالي 1024 x 1024
• الوضع الأساسي — التوليد المعتمد على المُوجّه فقط مقابل التحرير متعدد الصور مع اتساق الشخصيات عبر المراجع
• الشفافية — RGBA أصلي من أداة أخذ العينات، بالإضافة إلى تفكيك من 2–9 طبقات عبر النموذج المرافق مقابل عدم توثيق أي منها
• الترخيص والوصول — أوزان MIT التي تستضيفها بنفسك مقابل معاينة تجارية على Microsoft Foundry
• وحدة الفوترة — وقت GPU الخاص بك، بطاقة واحدة بسعة 80 GiB مقابل الاحتساب على أساس كل توكن، تُحتسب على Foundry
• ترتيب مستقل في مجال تحويل النص إلى صورة — Ming-Image-0.1-Design في المرتبة #45، بإيلو 995، و21,342 عينة مقابل MAI Image 2.5 Pro في المرتبة #12، بإيلو 1,098، و13,521 عينة
• موضع التحرير المستقل — لا يوجد إدخال مقابل MAI Image 2.5 Pro في المرتبة #10، Elo 1,106، 13,581 عينة
اقرأ رقمَي الأرينا معًا
تقول لوحات Artificial Analysis، كما قُرئت في 24 سبتمبر 2026، شيئًا أكثر تحديدًا من «أن نموذجًا واحدًا أفضل».
على لوحة تحويل النص إلى صورة، يحتل MAI Image 2.5 Pro المرتبة 12 بدرجة إيلو قدرها 1,098 وفاصل ثقة 95% قدره ±8 عبر 13,521 صوتاً. ويحتل Ming-Image-0.1-Design المرتبة 45 بدرجة 995 إيلو، و±8، عبر 21,342 صوتاً. هذه فجوة مقدارها 103 نقاط إيلو في لوحة يعني فيها الفاصل الضيق أنها ليست مجرد تشويش. على لوحة تحرير الصور، يحتل MAI Image 2.5 Pro المرتبة 10 بدرجة 1,106 إيلو عبر 13,581 صوتاً؛ أما Ming-Image-0.1-Design فليس لها أي إدخال هناك على الإطلاق.
ثم تنقلب الصورة في الشريحة الوحيدة التي تهم فريق التصميم. في شريحة UI/UX Design من اللوحة نفسها، يحتل MAI Image 2.5 Pro المرتبة 10 بـ 1,131 من نقاط Elo عبر 1,241 صوتًا في الشريحة، بينما يحتل Ming-Image-0.1-Design المرتبة 16 بـ 1,084 من نقاط Elo عبر 2,100 صوت. تضيق الفجوة من 103 Elo إلى 47، والنموذج الذي لم يخضع قط لاختبار أداء في التحرير يقطع معظم المسافة بمجرد أن تصبح المطالبات مطالبات تصميم.
هذا هو شكل الاختيار. MAI Image 2.5 Pro هو نموذج الصور العام الأفضل والمحرر الأفضل، وفق القياس. Ming-Image-0.1-Design هو متخصص يؤدي أداءً يتجاوز بكثير تصنيفه الإجمالي عندما تكون المهمة متعلقة بالتخطيط، وهو الوحيد بين الاثنين الذي يوفّر مسارًا للخلفية الشفافة.
تحفّظ واحد على مجموعتي الأرقام: هذه أرقام شرائح، والشرائح تتحرك. عدد الأصوات البالغ 13,521 لـ MAI Image 2.5 Pro على اللوحة الكاملة كبير بما يكفي ليكون نطاقه ضيقًا، لكن شريحة حالة استخدام يقف خلفها ألف صوت ونيف هي رقم أقل صلابة، كما أن مزاعم المورّد التي تقف خلف كلا الطرازين لم يتحقق منها أحد.

ما تدّعيه مايكروسوفت، وما تكلفته
أرقام مايكروسوفت الخاصة بـ MAI Image 2.5 Pro، وكلها مُبلَّغ عنها من المورّد، ولم يتم إعادة إنتاج أي منها بشكل مستقل:
• دقة عرض النص 96.8%، مصنّفة على أنها تغطي الصينية والإنجليزية واليابانية والكورية والإسبانية — على الرغم من أن نفس الوثائق تحدّ من الإخراج عند حوالي ميغابكسل، لذا فإن عبارة "8K" المرتبطة بالادعاء يُفضَّل قراءتها على أنها تسويق
• التزام بالمطالبات أفضل بنسبة 27% مقارنةً بـ GPT-Image-1.5 في التقييمات الداخلية لدى Microsoft
• اتساق الشخصية بنسبة 94% في الصور المتعددة عبر عمليات التوليد
• خفض يصل إلى 84–89% في تكلفة GPU مقارنةً بنماذج GPT في سيناريوهات محددة لدى مايكروسوفت مثل PowerPoint وOneDrive — وهو رقم خاص بسيناريو بعينه، وليس رقمًا عامًا
تؤكد ورقة المواصفات الموثّقة تلك الادعاءات: إدخال نصي يصل إلى 32,000 رمز، ونافذة سياق تبلغ 131 ألفًا، و4,096 رمز إخراج، وإدخال صور JPEG وPNG، وحد إخراج يبلغ 1,048,576 بكسل. هذا الحد مشكلة المشتري. فالمحرر عالي الجودة الذي لا يستطيع تجاوز ميغابكسل واحد هو أداة لأصول التواصل الاجتماعي والويب، وليس أداة طباعة، ولا يغيّر أي قدر من دقة عرض النص عدد البكسلات.
التسعير في Foundry قائم على قياس الرموز (tokens): 5 دولارات لكل مليون رمز إدخال نصي، و8 دولارات لكل مليون رمز إدخال صور، و106 دولارات لكل مليون رمز إخراج صور. لا تنشر Microsoft عدد الرموز لكل صورة، لذا فإن أي رقم لكل صورة هو عملية حسابية وليس عرض سعر. وباستخدام تحويل Artificial Analysis، تصل صورة بدقة 1024 × 1024 إلى نحو 108.50 دولارات لكل 1000 صورة — أي نحو 2.3× النموذج الشقيق MAI-Image-2.5 عند نحو 48 دولارًا لكل 1000 صورة، و5.4× MAI-Image-2.5-Flash عند نحو 20 دولارًا لكل 1000 صورة. فئة Pro تمثل علاوة سعرية متعمدة. كما أن تسعير Preview ليس تسعير GA، وقد تتغير قائمة الأسعار قبل الإتاحة العامة.
لا تملك Ming-Image-0.1-Design بطاقة أسعار من مورّد للمقارنة بها، لأنه لا توجد نقطة نهاية مستضافة. وتُدرجه لوحة Artificial Analysis بسعر 30.00 دولارًا لكل 1000 صورة، وهو عمود مشتق من اللوحة وليس سعرًا معلنًا من المورّد — فشركة inclusionAI تشحن الأوزان ووصفة تشغيل، لا واجهة برمجة تطبيقات. تكلفته الحقيقية هي وحدة معالجة رسومات CUDA واحدة بذاكرة VRAM سعة 80 GiB، ودقة BF16، و12 خطوة أخذ عينات عند CFG 1.0، ومخرجات موصى بها بدقة 2048 بكسل. إن اثنتي عشرة خطوة عند التوجيه 1.0 تمثل مُعيّنًا مقطّرًا أو خاليًا من التوجيه، وهو ما يجعل تصييرًا بدقة 2048 بكسل ميسور التكلفة عند هذا العدد من الخطوات، كما تشغّل الوصفة الموصى بها في البطاقة نموذجًا لغويًا بصريًا أمام نموذج الانتشار لإعادة كتابة مطالبة قصيرة إلى تخطيط JSON منظم على غرار Figma يتضمن إحداثيات وتسلسلًا هرميًا ومواصفات ألوان ونصًا حرفيًا.
هناك أمران يستحقان الدقة من جانبنا. نحن لا نوجّه أيًا من النموذجين: لا يظهر أي نموذج صور من Microsoft ولا أي نموذج من inclusionAI في كتالوج OrcaRouter، لذا يعني كلاهما مسار المورّد الخاص أو العتاد الخاص بك. ما تُخصص له طبقة التوجيه فعليًا هو الجانب القائم في المقارنة — نقطة نهاية واحدة متوافقة مع OpenAI عبر أكثر من 200 نموذج، وسعر قائمة المورّد يُمرَّر دون أي هامش ربح (0%) بحيث يصبح تغيير سعر المورّد ساريًا في اليوم نفسه، وتحويل تلقائي عند الفشل عبر المورّدين. تشغيل نفس مجموعة المطالبات مقابل نموذج صور مستضاف تثق به بالفعل ومقابل أيٍّ من هذين هو مهمة بمفتاح واحد وليس مهمة شرائية.
![Screenshot of the Artificial Analysis Text to Image Leaderboard captured 24 September 2026, cropped to the rows around both models. MAI-Image-2.5-Pro appears at row 12, creator Microsoft AI, Elo 1,098, range 8-13, 13,521 samples, July 2026, $108.5 per 1k imgs. Nano Banana 2 Lite appears at row 13 with Elo 1,092. Ming-Image-0.1-Design appears at row 45, creator InclusionAI, Elo 995, range 39-50, 21,342 samples, September 2026, $30.0 per 1k imgs, with the Open Weights badge. The Open Weights badge also appears on Ideogram 4.0 (Quality) at row 34 and on FLUX.2 [dev] at row 40.](https://cms.orcarouter.ai/api/media/file/3-1276.png)
سؤال الحجم الذي لا يطرحه أحد
ثمة رقم ثانٍ يزيد من تعقيد جانب التنزيل في هذه المقارنة، ويجدر ذكره لأن النموذج يُسوَّق بوصفه 6B. يبلغ محوّل الانتشار الخاص بـ Ming-Image-0.1-Design 6.15 مليار معامل. تبلغ الحزمة نحو 52.88 GB، لأن المشفّر النصي متعدد الوسائط يبلغ 17.01 مليار معامل، ويضيف الموصل 3.09 مليار — أي نحو 26 مليار معامل عند BF16 إجمالًا. أما محوّل رفيق Layer فيبلغ ضعفه عند 12.31 مليار معامل، وحزمته أكبر مجددًا عند نحو 65.20 GB. إن متطلب VRAM البالغ 80 GiB ناتج عن كل ما يقيم إلى جانب المحوّل، وليس عن رقم 6B.
يمتلك MAI Image 2.5 Pro سمات معاكسة: لا شيء لتنزيله، ولا شيء لتشغيله كخدمة، وسقف صارم على ما يمكنك إنتاجه باستخدامه. أي من هاتين المشكلتين أسوأ يعتمد كليًا على ما إذا كان فريقك يشغّل GPUs بالفعل.

اختيار واحد
• أنت تُحرّر صورًا موجودة بجودة عالية ويمكنك العمل ضمن حدود ميغابكسل واحد — MAI Image 2.5 Pro. فله موضع حقيقي في لوحة التحرير عند المرتبة 10، وعدد أصوات كبير يسند نتيجة توليده، وخط أنابيب موثّق متعدد الصور مع رقم اتساق مُبلَّغ عنه من المورّد. والسعر يعكس كل ذلك.
• أنت تُنشئ تخطيطات كثيفة النصوص وتحتاج إلى الشفافية أو طبقات قابلة للتحرير — Ming-Image-0.1-Design. لا تُعدّ ميزة RGBA الأصلية وخاصية التفكيك إلى 2–9 طبقات من الميزات التي يقدّمها MAI Image 2.5 Pro بأي سعر، كما أن الإخراج بمقاس 2048 x 2048 يمثّل أربعة أضعاف ميزانية البكسل.
• أنت بحاجة إلى مخرجات بدقة الطباعة — لا هذا ولا ذاك. أحدهما يقتصر على ميغابكسل واحد، والآخر لا يتجاوز 2048 بكسل مربّعًا.
• أنت بحاجة إلى رقم يمكنك الدفاع عنه في مراجعة — MAI Image 2.5 Pro على اللوحات الكاملة، وMing-Image-0.1-Design على شريحة واجهة المستخدم/تجربة المستخدم، ولا أيٌّ منهما على دقة عرض النصوص، حيث إن مجموعتي الادعاءات مُبلَّغ عنهما من المورّدين وغير مُعاد إنتاجهما.
الخاتمة الصادقة هي أن هذين النموذجين لا يتنافسان فعلياً. فـ MAI Image 2.5 Pro محرر مستضاف متميز بسقف دقة وسعر على قدر ذلك؛ أما Ming-Image-0.1-Design فهو تنزيل مجاني يتصدر مجال الأوزان المفتوحة في شريحة من ساحة مخصصة للتصميم، ويطلب بطاقة بسعة 80 GiB في المقابل. وما يستحق المتابعة هو ما إذا كانت Microsoft سترفع سقف الميغابكسل قبل الإتاحة العامة (GA)، وما إذا كانت inclusionAI ستضيف يوماً نقطة وصول إلى هذه الأوزان — لأن أياً من هاتين الخطوتين سيجعل هذه مواجهة مباشرة حقيقية بدلاً من مقارنة بين نوعين مختلفين من الالتزام.
