بطاقة العنوان الرئيسية نصها «Ming-Image-0.1-Design يتصدر لوحة صدارة تصميم واجهات المستخدم للنماذج مفتوحة الأوزان»، والعنوان الفرعي «النموذج الأعلى تقييمًا من بين النماذج مفتوحة الأوزان في شريحة UI/UX Design من Artificial Analysis، عند 1,084 Elo»، مع بطاقة أيقونة كأس مكتوب عليها «النموذج الأعلى تقييمًا من بين النماذج مفتوحة الأوزان» وبطاقة أيقونة شاشة مكتوب عليها «المتصدر في UI/UX Design». وشعار OrcaRouter مركّب في الزاوية السفلية اليمنى.
Guides & Insights

Ming-Image-0.1-Design يتصدر لوحة تصميم واجهات المستخدم للنماذج مفتوحة الأوزان — والأرقام تؤكد ذلك

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

الادعاء المتداول مع Ming-Image-0.1-Design هو أن نموذج inclusionAI بحجم 6B هو أفضل نموذج نص إلى صورة مفتوح الأوزان لأعمال واجهات المستخدم وتجربة المستخدم، إذ يحتل المرتبة الأولى في عرض الأوزان المفتوحة من لوحة صدارة Artificial Analysis لتصميم UI/UX عند 1,082 إيلو. عادةً ما تكون لقطات شاشة لوحات صدارة المورّدين أضعف أنواع الأدلة، لذا فإن أول ما يستحق فعله هو قراءة اللوحة المباشرة. واعتبارًا من 24 سبتمبر 2026، فإن ذلك يصمد، مع تحفّظ مهم لا تحمله لقطة الشاشة: 1,082 هي شريحة حالة استخدام، وليست اللوحة نفسها، وعلى لوحة صدارة النص إلى صورة الكاملة يحتل النموذج نفسه المرتبة 45 بإيلو قدره 995.

كلا الرقمين حقيقيان، وهما يأتيان من الساحة نفسها، ويصفان الأوزان نفسها. ما يفصل بينهما هو المطالبات التي أُدليت الأصوات بشأنها.

ما تقوله اللوحة المباشرة فعليًا

تُدير {{1}}Artificial Analysis{{/1}} ساحةً واحدةً للمقارنة الثنائية العمياء، ثم تُصفّي مجموعة الأصوات نفسها إلى شرائح بحسب حالات الاستخدام. شريحة تصميم واجهات وتجربة المستخدم (UI/UX Design) هي الشريحة المهمة بالنسبة لنموذج مُصمَّم للوحات المعلومات وشاشات التطبيقات والملصقات والرسوم المعلوماتية، وهي المجال الذي يقدّم فيه Ming-Image-0.1-Design أفضل أعماله:

• لوحة النص إلى الصورة الإجمالية — Ming-Image-0.1-Design في المرتبة #45، Elo 995، فاصل ثقة 95% ±8، 21,342 عينة، أُدرج في سبتمبر 2026، 30.00 دولار لكل 1,000 صورة، موسوم بأوزان مفتوحة

• شريحة تصميم واجهة/تجربة المستخدم — Ming-Image-0.1-Design في المرتبة #16، بتقييم Elo 1,084، و2,100 عينة في الشريحة

• الإدخال الأعلى ترتيبًا من فئة الأوزان المفتوحة في تلك الشريحة — Ming-Image-0.1-Design؛ والنماذج التالية من فئة الأوزان المفتوحة خلفه هي Ideogram 4.0 (Quality) عند #22 و1,047، وIdeogram 4.0 عند #31 و1,018، وHunyuanImage 3.0 Instruct عند #40 و1,005

• في صدارة فئة واجهة المستخدم/تجربة المستخدم — GPT Image 2.5 Flare (max) عند 1,226، GPT Image 2.5 Sunburst (max) عند 1,215، GPT Image 2 (high) عند 1,204، Grok Imagine Image 2.0 عند 1,183

• مقابل لقطة شاشة المورّد نفسه — نشرت inclusionAI ‏1,082 لـ Ming مقابل Ideogram 4.0 (Quality) عند 1,052 وFLUX.2 [dev] عند 1,000؛ وتظهر الشريحة المباشرة الآن 1,084 و1,047 و1,000 على الترتيب.

إذن، العنوان دقيق وفق شروطه الخاصة. Ming-Image-0.1-Design هو النموذج الأعلى تقييمًا بين النماذج مفتوحة الأوزان في شريحة تصميم واجهات المستخدم/تجربة المستخدم، وهو النموذج الوحيد مفتوح الأوزان ضمن أفضل عشرين في تلك الشريحة. كما أنه متأخر بـ142 إيلو عن متصدر تلك الشريحة، ويقع في منتصف المجموعة عندما لا يكون المُوجّه مُوجّهًا تصميميًا. النموذج الذي يتفوق في لوحات المعلومات ويصل إلى 995 إجمالًا هو متخصص، لا شامل، والرقمان لا يتناقضان إلا إذا قرأت أحدهما على أنه القصة كاملة.

يستحق عدد العينات البالغ 21,342 على اللوحة الكاملة الملاحظة أيضًا لما لا يعنيه. هذا عدد أصوات كبير، ولهذا فإن فترة الثقة ضيقة عند ±8 Elo، لكن عدد العينات ليس مثل استقلالية المنهج. الساحة تعتمد على تفضيل بشري أعمى، لذا لم يكتب أحد في inclusionAI النتيجة — هذا الجزء حقيقي. ما تقيسه النتيجة هو "أي من هاتين الصورتين فضّل المصوّت"، والمصوّتون الذين يُطلب منهم الحكم على لقطة شاشة لواجهة المستخدم يميلون إلى مكافأة النص المقروء والتخطيط المتماسك. وهذا بالضبط هو المحور الذي دُرِّب عليه هذا النموذج.

Screenshot of the Artificial Analysis Text to Image Leaderboard captured 24 September 2026, cropped to the lower rows. Ming-Image-0.1-Design is row 45, creator InclusionAI, with an Elo of 995, row range 39-50, 21,342 samples, a September 2026 release and $30.0 per 1k imgs, carrying the Open Weights badge. Neighbouring rows include P-Image-Ideogram (High) at 44 and 995, Cosmos3-Super-Text2Image (agentic) at 46 and 994, and Ideogram 4.0 at row 38 and 1,004, also Open Weights.

ما هو Ming-Image-0.1-Design

‏Ming-Image-0.1-Design هو نموذج نص-إلى-صورة من inclusionAI، المختبر الذكي المرتبط بمجموعة Ant Group، صدر بموجب رخصة MIT مع نشر الأوزان في 17 سبتمبر 2026، وحلول حزمة الإصدار الكاملة في 22 سبتمبر. وهو يولّد من مُوجَّه نصي وحده — دون الحاجة إلى صورة مرجعية — ويستهدف التصميم الجرافيكي كثيف النصوص بدلًا من التصوير الفوتوغرافي: نماذج واجهات المستخدم، ولوحات المعلومات، والإنفوجرافيك، والملصقات، وأي شيء يجب أن يظل فيه النص المعروض مقروءًا بالحجم الذي سيُقرأ به.

إن تهيئة الاستدلال الموثّقة محددة ورخيصة بشكل غير معتاد لكل خطوة:

• الدقة — يُوصى بـ 2048 × 2048، أو 1024 × 1024 لإنشاء أسرع، مع تقريب الأحجام الوسيطة إلى إحدى هاتين الفئتين

• خطوات أخذ العينات — 12

• الإرشاد — مقياس CFG 1.0

• الدقة — BF16

• العتاد — وحدة معالجة رسومات CUDA واحدة بسعة 80 GiB من VRAM، موصوفة بأنها التكوين المعتمد

اثنتا عشرة خطوة عند مقياس توجيه 1.0 هي السمة المميزة لأداة معاينة مُقطَّرة أو خالية من التوجيه. وهذا ما يجعل مخرجات بدقة 2048 بكسل ميسورة التكلفة عند عدد خطوات لا تحاول معظم نماذج الانتشار بلوغه، وهو السبب الرئيسي وراء كون هذا النموذج مثيرًا للاهتمام لأي شخص يشغّل توليد الصور بكميات كبيرة بدلًا من صورة واحدة في كل مرة.

السمة البنيوية الأخرى هي الشفافية. يستطيع Ming-Image-0.1-Design إنتاج RGBA أصلي، لذا تخرج الخلفية الشفافة من أداة أخذ العينات بدلًا من تمريرة فصل الاستخلاص (matting)، وذلك عندما يبدأ التوجيه النصي بواحدة من عبارات الشفافية الموثّقة. ويذهب نموذج مرافق، هو Ming-Image-0.1-Design-Layer، إلى أبعد من ذلك: فهو يأخذ تصميمًا مسطّحًا مع خطة طبقات ويعيد ملفات PNG بصيغة RGBA منفصلة — نص، وبطاقات، والعنصر الرئيسي، والخلفية — تُعاد تركيبها لتكوين الأصل. هذا هو الفرق بين نموذج تصميم ونموذج صور. فملف PNG المسطّح صورةٌ لتخطيط ما؛ أما الطبقات المنفصلة فهي تخطيط لا يزال بإمكانك تحريره.

Screenshot of the inclusionAI/Ming-Image-0.1-Design model card on Hugging Face, captured 24 September 2026. The header shows 188 likes, 3,067 followers, tags including text-to-image, difusers, safetensors, image-generation, graphic-design, text-rendering and License: mit, and a safetensors panel reading Model size 6B params, Tensor type BF16. The card's UI/UX Design leaderboard image is embedded in the body, showing Ming-Image-0.1-Design first at 1,082 above Ideogram 4.0 (Quality) at 1,052 and FLUX.2 [dev] at 1,000. The right rail states 'This model isn't deployed by any Inference Provider', and the Quick Start block shows the infer.py command with --resolution 2048 and a note that prompt enhancement can use Ling-3.0-flash-VL or qwen3.8-27B.

تسمية 6B وتنزيل 26B

«6B» دقيق بشأن الجزء الذي يقصده معظم الناس، ومضلّل بشأن الجزء الذي يحدد ما إذا كان بإمكانك تشغيله. يبلغ محوّل الانتشار 6.15 مليار معامل. أما الحزمة التي تنزّلها فعليًا فتبلغ نحو 52.88 غيغابايت، لأن مشفّر النص متعدد الوسائط يبلغ 17.01 مليار معامل، ويضيف الموصّل 3.09 مليار — أي نحو 26 مليار معامل عند BF16 في الإجمالي. محوّل نموذج Layer يبلغ ضعف محوّل النموذج الأساسي عند 12.31 مليار، وحزمته أكبر مرة أخرى عند نحو 65.20 غيغابايت.

هذا مهم لسببين عمليين. أولًا، متطلب ‏80 GiB من VRAM لا يتعلق بمحوّل 6B؛ بل يتعلق بكل ما يجب أن يبقى مقيمًا إلى جانبه. ثانيًا، أي مقارنة مع نموذج يُوصف بأنه "6B" تحتاج إلى التحقق من أي 6B المقصود. فمحوّل انتشار 6B مزوّد بمشفّر نصوص 20B يمثّل مشكلة نشر مختلفة تمامًا عن نموذج 6B من البداية إلى النهاية.

التعامل مع المُطالبات هو الأمر الآخر الذي تُفصح عنه البطاقة بدلًا من إخفائه: الوصفة الموصى بها تُجري خطوة إعادة كتابة أولًا، باستخدام نموذج لغوي بصري لتوسيع مُطالبة قصيرة إلى وصف تخطيط JSON منظّم بأسلوب Figma، يتضمن إحداثيات وتسلسلًا هرميًا ومواصفات ألوان ونصًا حرفيًا. تُسمّي بطاقات النموذج Ling-3.0-flash-VL أو Qwen3.8-27B لهذه المهمة. بعبارة أخرى، خط الأنابيب الذي يقيسه المورّد هو خط أنابيب من نموذجين. إذا استدعيت Ming-Image-0.1-Design بمُطالبة من سطر واحد وبدون خطوة إعادة كتابة، فأنت لا تشغّل الإعداد الذي أنتج 1,084 في شريحة UI/UX.

أين يضع هذا مسار التصميم

الخلاصة الصادقة بشأن Ming-Image-0.1-Design هي أنه يحل مشكلة محددة ومكلفة — توليد تخطيطات كثيفة النصوص تصمد عند النظر إليها — وهو يفعل ذلك في صدارة مجال الأوزان المفتوحة على اللوحة الوحيدة التي تقيس تلك المشكلة. وهو لا يتصدر لوحة الصور العامة، ولا يلغي الحاجة إلى VLM أمامه، ويتطلب GPU جادًا.

ما يغيّره هو منتصف سير عمل التصميم. إذا كان خط أنابيبك الحالي يولّد صورة مسطّحة ثم يدفع لأحد البشر أو لنموذج تقسيم مقابل تقطيعها إلى أجزاء، فإن نموذجًا يُصدر RGBA بشكل أصلي ورفيقًا يُصدر من 2 إلى 9 طبقات مُسمّاة يزيلان مرحلة. هذا يستحق أكثر من عمود Elo، وهو الجزء الذي لا تقيسه أي لوحة صدارة.

بالنسبة للفرق التي تريد اختباره دون الالتزام بالبنية التحتية، يجدر بنا أن نكون دقيقين بشأن هذا الفصل. إن Ming-Image-0.1-Design هو تنزيل مرخّص بموجب MIT، لذا فهو يعمل على أجهزتك أو لا يعمل إطلاقًا — OrcaRouter لا يوجّه أي نموذج من inclusionAI بأي إصدار، وادّعاء خلاف ذلك سيكون ادّعاءً لا يمكننا الوفاء به. ما تمنحه لك طبقة التوجيه فعلاً هو السطح المحيط: نقطة نهاية واحدة متوافقة مع OpenAI عبر أكثر من 200 نموذج، وتجاوز تلقائي للفشل بين المزوّدين، وسعر قائمة المزوّد يُمرَّر دون أي هامش ربح بنسبة 0%، لذا فإن أي تغيير في سعر بائع لأي نموذج تتصل به يكون مباشرًا لدينا في اليوم نفسه. إذا كنت تنشئ مسارًا لتصميم وتريد إجراء مقارنة A/B بين هذا النموذج ونموذج مستضاف تثق به بالفعل، فإن تلك المقارنة تعمل بمفتاح واحد بدلاً من عقدين.

A rendered summary card headed 'The two numbers' and titled 'One model, two readings', listing five figures: Overall Text to Image board #45, Elo 995, 95% CI 8, 21,342 samples; UI/UX Design slice #16, Elo 1,084, 2,100 samples in the slice; open-weights standing in that slice #1, next is Ideogram 4.0 (Quality) at #22 and 1,047; leader of the same slice GPT Image 2.5 Flare (max), Elo 1,226, a 142-point gap; board-listed API pricing $30.00 per 1,000 images, flagged Open Weights.

ما الذي قد يغيّر الصورة؟

ثلاثة أمور ستنقل Ming-Image-0.1-Design من متخصّص قوي بأوزان مفتوحة إلى خيار افتراضي. أولاً، إعادة إنتاج مستقلة أولى لأرقام Crello الخاصة بنموذج Layer — إذ تُفيد البطاقة بخطأ RGB L1 قدره 0.0574 و alpha soft IoU قدره 0.8923 عند 1024، ولم تُجرِها أي مجموعة خارجية. ونقطة نهاية مستضافة تُزيل متطلّب 80 GiB. وثالثًا، شريحة حالة استخدام ثانية يحقق فيها النموذج نتائج جيدة بقدر ما يحققها في UI/UX Design، لأن النموذج الذي لا يفوز إلا في شريحة واحدة من لوحة واحدة هو نموذج لم تثبت عموميته بعد.

حتى ذلك الحين، الجملة الدقيقة هي الجملة الضيقة: على شريحة التصميم UI/UX في Artificial Analysis، بتاريخ 24 سبتمبر 2026، يُعد Ming-Image-0.1-Design من inclusionAI النموذج الأعلى تقييماً مفتوح الأوزان من النص إلى الصورة، بـ 1,084 إيلو من 2,100 صوت — وعلى اللوحة الكاملة لنفس الساحة، يحتل المرتبة 45 بـ 995. كلاهما يمثلان النموذج. لا يمثل أي منهما ادعاء إطلاق، لأن هذا النموذج لم يكن له إطلاق؛ كان له مستودع.