بطاقة عنوان رئيسية لـ MAI-Image-2.6، نموذج مايكروسوفت رقم 2 لتحويل النص إلى صورة على Arena، تُظهر نتيجة Arena البالغة 1,336، والمرتبة رقم 2، وزيادة +79 في Elo مقارنة بـ MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview: #1 في تحرير الصور، #2 في تحويل النص إلى صورة

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

نموذج "Microsoft's MAI-Image-2.6-Preview" لم يعد مجرد إدخال في لوحة صدارة Arena لا يمكنك الوصول إليه — بل أصبح الآن متصدراً مستقلاً للوحة الصدارة. في 25 أغسطس، صنفت "Artificial Analysis"، الجهة المستقلة لقياس الأداء، نفس الإصدار التجريبي في المركز الأول على لوحة صدارة تحرير الصور، وفي المركز الثاني في تحويل النص إلى صورة. وضعه في صدارة التحرير يجعله يتفوق على نموذج "MAI-Image-2.5-Pro" التابع لمايكروسوفت (المتصدر السابق)، و"Reve 2.1"، و"GPT Image 2" من OpenAI، مما يمنح مايكروسوفت المركزين الأولين على تلك اللوحة. وقد دخل النموذج مرحلة المعاينة الخاصة على "MAI Playground" و"Microsoft Foundry" في 19 أغسطس، وفقاً لإعلان مايكروسوفت — وصوله محصور بدعوات، ولا يزال بدون واجهة برمجة تطبيقات عامة، وبدون بطاقة أسعار.

اللافت هو المسار، وليس مجرد الترتيب. الإدخال الذي بلغ ذروته في المركز الثاني على لوحة النص إلى صورة في Arena اسمه حرفيًا "mai-image-2.6-preview"، وحصل على ما يقارب 3,500 صوت في تلك اللقطة، وصعد ثمانية مراكز بزيادة +79 نقطة Elo عن MAI-Image-2.5 في خطوة واحدة. ومنذ ذلك الحين، اكتملت الصورة بسرعة: فُتح الوصول إلى المعاينة الخاصة على MAI Playground وMicrosoft Foundry في 19 أغسطس، ورفعت لوحة تحرير الصور في Arena النسخة إلى المركز الثالث، والآن أصبح Artificial Analysis يضعها في المركز الأول في تحرير الصور والمركز الثاني في النص إلى صورة. وهذا يجعل منها أقوى إشارة مستقلة حتى الآن على أن جهود Microsoft الداخلية في مجال الصور قد أغلقت الفجوة مع OpenAI — ولا تزال واجهة API العامة غير متاحة للعموم.

الأرقام الرئيسية

• ترتيب Arena لتحويل النص إلى صورة: المرتبة الثانية — النتيجة 1,336±11، مبدئية، ~3,488 صوتًا

• الفجوة عن المركز الأول (GPT Image 2 Medium): 45 Elo

• التقدم على رقم 3 (Grok Imagine Image 2.0): 20 Elo

• تجاوز MAI-Image-2.5: +79 Elo إجمالاً، +91 Elo في عرض النصوص

• موقع السابق: MAI-Image-2.5 في المركز 10 (1,256)

• ترتيب تحرير الصور: المركز الثالث في "Single Image Edit" على Arena — 1,420 نقطة، بعد أن كان في المركز الخامس

• ترتيب Artificial Analysis لتحرير الصور: المرتبة الأولى — متقدمًا على MAI-Image-2.5-Pro (المرتبة الأولى السابقة)، وReve 2.1، وGPT Image 2؛ مايكروسوفت تحتل المركزين الأولين

• ترتيب Artificial Analysis في تحويل النص إلى صورة: المركز الثاني — خلف GPT Image 2 فقط؛ الأول في 5 من 19 لوحة فئات

• معاينة خاصة:أُعلن عنها في 19 أغسطس على MAI Playground وMicrosoft Foundry — وفقًا لما ذكره البائع، الوصول بدعوة فقط، ولا توجد تسعيرة بعد

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

ما هو MAI-Image-2.6

MAI-Image-2.6 هو أحدث نموذج في خط توليد الصور الداخلي لمايكروسوفت، الذي تم بناؤه تحت إشراف Microsoft AI التابع لمصطفى سليمان. تطورت العائلة بسرعة: كان MAI-Image-1 هو الأساس، وقدّم MAI-Image-2 (مارس 2026) قفزة في الواقعية الفوتوغرافية وعرض النصوص، وأضاف MAI-Image-2.5 (يونيو 2026) مخرجات وتحريرًا بجودة احترافية وأصبح المحرك داخل Bing Image Creator وPowerPoint وOneDrive، وأضاف MAI-Image-2.5-Pro (يوليو 2026) طبقة متميزة بدقة 8K — والآن يصل 2.6 بعد حوالي ستة أسابيع من سابقه.

الإيقاع مهم بقدر أهمية النموذج نفسه. تطلق Microsoft تحسينات الصور بدورة زمنية تتراوح بين ستة وثمانية أسابيع، وهو أقرب إلى الطريقة التي تطلق بها مختبرات الحدود نماذج النصوص منه إلى الطريقة التي تحرك بها سوق الصور تاريخيًا. {{1}}ظهور في المرتبة الثانية على Arena عند الإطلاق،{{/1}} {{2}}وبمرتبة ثالثة في التحرير{{/2}} {{3}}بعد أسبوع واحد،{{/3}} {{4}}هذا هو شكل الإيقاع عندما يتراكم أثره.{{/4}}

نتائج لوحة المتصدرين، اقرأها بعناية

آرينا (التي أعيدت تسميتها LMArena) ترتّب نماذج الصور حسب التفضيل البشري الأعمى: حيث يرى المصوّتون صورتين مولدتين من نفس التلقين (البرومبت) ويختارون الأقوى. تُجري Artificial Analysis النوع نفسه من ساحة التفضيل الأعمى المستقل مع تقييمات Elo الخاصة بها. كلاهما مقاييس مستقلة لما يفضّله الناس فعلياً بدلاً من معايير يديرها البائعون — ولهذا فإن الظهور الأول في المركز الثاني يحمل وزناً حقيقياً، ولهذا فإن اتفاق لوحتين منفصلتين على النموذج نفسه يهمّ أكثر من أي رقم بمفرده. ولهذا أيضاً تحتاج الأرقام إلى تحفظات: نتيجة آرينا البالغة 1,336 أولية، وتستند إلى نحو 3,500 صوت مقابل أكثر من 70,000 صوت للنموذج في المركز الأول، والإدخال مُصنَّف على أنه «معاينة». يتغيّر تقييم Elo مع الأصوات المبكرة؛ تعامل مع الاتجاه على أنه ثابت والرقم الدقيق على أنه مؤقت.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

حيث تتركز المكاسب هو أكثر إثارة للاهتمام من الرقم الرئيسي. صنّفت Arena نموذج MAI-Image-2.6 في المرتبة الأولى في التصوير والنمذجة ثلاثية الأبعاد (بعد أن كان سادسًا) والثانية في الكرتون/الأنمي/الفانتازيا (بعد أن كان ثامنًا)، وتصميم المنتجات والعلامات التجارية والتصميم التجاري (بعد أن كان سابعًا)، وعرض النصوص (بعد أن كان ثامنًا، مع زيادة +91 نقطة إيلو)، والفن (بعد أن كان رابعًا). تقول مايكروسوفت إنه تحسّن في كل فئة تم قياسها. هذا الانتشار — التصميم التجاري، وثلاثي الأبعاد، والنصوص، والفن — هو سمة نموذج صور متعدد الأغراض وليس تخصصًا وحيد المهارة.

ثم وصلت نقطتا بيانات إضافيتان. لوحة تحرير الصور في Arena — فئة "Single Image Edit" — تُدرج نفس إصدار mai-image-2.6-preview في المركز الثالث برصيد 1,420 نقطة، بعد أن كان في المركز الخامس، متقدمًا بـ19 نقطة على MAI-Image-2.5، مع تحرير النصوص كأكبر مكسب منفرد (+43 نقطة). وفي 25 أغسطس، ذهبت Artificial Analysis إلى أبعد من ذلك: لوحة تصنيف تحرير الصور لديها تضع الإصدار التجريبي في المركز الأول، منتزعًا القمة من نموذج مايكروسوفت الخاص MAI-Image-2.5-Pro (الذي كان في المركز الأول سابقًا بـ1,272 Elo)، ومتفوقًا على Reve 2.1 وGPT Image 2 من OpenAI — أصبحت مايكروسوفت الآن تملك المركزين الأولين في تلك اللوحة. ووصف مصطفى سليمان، رئيس قسم الذكاء الاصطناعي في مايكروسوفت، الإصدار 2.6 بأنه "أفضل نموذج لتحرير الصور على AA"، وقال إن مايكروسوفت تملك ثلاثة من المراكز الخمسة الأولى — هذا تأطير من البائع؛ أما التصنيفات الأساسية فهي ملك Artificial Analysis نفسها. لم تُنشر درجة تحرير الصور من AA للإصدار التجريبي نفسه، وكلا اللوحتين مبكرتان وقليلة الأصوات، لذا تعامل مع الاتجاه على أنه ثابت والأرقام الدقيقة على أنها مؤقتة.

ما الجديد فعليًا (وفقًا لما ذكره المورّد)

فيما يتعلق بالقدرات، فإن أوصاف مايكروسوفت الخاصة لـ MAI-Image-2.6 هي:

• عرض نصوص أقوى، وصور شخصية، ورسومات ثلاثية الأبعاد

• مخرجات تجارية وواقعية فوتوغرافية أكثر احترافية عبر حالات استخدام المنتجات والعلامات التجارية والسينما

• العمل عبر صور مرجعية متعددة في توليد واحد

• تأصيل أغنى — التزام أفضل بتفاصيل المطالبة

• تحكم أكبر في الاستدلال والتنسيق والدقة

كل واحد من هذه الأمور مبلَّغ عنه من البائع ولم تتم إعادة إنتاجه بشكل مستقل بعد. الدليل المستقل هو لوحتا الصدارة معًا: المركز الثاني في تحويل النص إلى صورة على كلٍّ من Arena وArtificial Analysis، والمركز الثالث على لوحة التحرير في Arena، والمركز الأول على لوحة التحرير في Artificial Analysis — وكلها نتائج أولية. إلى أن يتوفر MAI-Image-2.6 على نطاق واسع وتتمكن أطراف ثالثة من إجراء تقييمات مضبوطة، تعامل مع قائمة القدرات باعتبارها ادعاءً من Microsoft واعتبر لوحتي الصدارة بمثابة المؤشر العملي.

عندما يمكنك استخدامه فعليًا

انتقلت MAI-Image-2.6 من "Arena فقط" إلى "Arena بالإضافة إلى معاينة رسمية" هذا الأسبوع. في 19 أغسطس، أعلنت Microsoft أن النموذج متاح في معاينة خاصة على MAI Playground وMicrosoft Foundry. هذا هو بيان البائع نفسه، والوصول إلى المعاينة يتم بدعوة وليس عبر تسجيل عام — لذلك لا تزال هناك بطاقة أسعار ولا واجهة برمجة تطبيقات للدفع لكل رمز. المؤشر العملي الذي يجب مراقبته: عندما أصبحت MAI-Image-2.5 الخيار الافتراضي في Bing Image Creator وتم طرحها في PowerPoint وOneDrive، كان ذلك يعني أن Microsoft تعتبرها آمنة للإنتاج. طرح مماثل لنسخة 2.6 في تلك الأسطح — أو إزالة وسم "معاينة" — سيكون الإشارة إلى أنها جاهزة لأعباء العمل الإنتاجية.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

ما قد تبلغ تكلفته

لم يُنشر أي تسعير للإصدار 2.6 — فالمعاينة الخاصة لا تتضمن بطاقة أسعار. والمرجع هو بقية العائلة، وكلها كما وردت من البائع:

• MAI-Image-2.5: 5 دولارات لكل مليون رمز إدخال نصي، و8 دولارات لإدخال الصور، و47 دولارًا لإخراج الصور

MAI-Image-2.5-Flash: 1.75 دولار / 1.75 دولار / 19.50 دولار — الطبقة ذات الحجم الكبير

• MAI-Image-2.5-Pro (يوليو 2026): $5 / $8 / $106 — إخراج بدقة 8K، دقة عرض النصوص 96.8%

هذا فارق خمسة أضعاف بين أدنى وأعلى معدلات إخراج الصور التي تبيعها مايكروسوفت بالفعل، لذا ستتوقف تكلفة إنتاج 2.6 على الشريحة التي يُصنَّف ضمنها. وبمعدل إخراج 2.5 البالغ 47 دولارًا لكل مليون، فإن صورة تستهلك ما يقارب ألف توكن إخراج تبلغ تكلفتها نحو خمسة سنتات — لكن مايكروسوفت لا تنشر عدد التوكنات لكل صورة، فاعتبر ذلك مجرد حساب تقريبي، لا عرضَ سعر.

التسعير هو أيضًا المجال الذي تُثبت فيه طبقة التوجيه قيمتها بمجرد وصول النموذج إلى واجهة برمجة تطبيقات عامة. على OrcaRouter، كل ما تفرضه Microsoft يُمرَّر بهامش ربح 0% — سعر القائمة من المزوّد دون أي إضافات — لذا فإن أي خصم إطلاق أو تخفيض سعر لاحق يقع على جانبك من الفاتورة في اليوم نفسه الذي يُعلَن فيه. لا إعادة تفاوض ولا عقد ثانٍ؛ يظهر النموذج على نفس المفتاح المستخدم لكل شيء آخر.

أين يترك هذا سباق نماذج الصور؟

في صدارة لوحة Arena لتوليد الصور من النصوص حاليًا: {{1}}{{KEEP}}GPT Image 2{{/KEEP}} (Medium) برصيد 1,381، وMAI-Image-2.6 برصيد 1,336، وGrok Imagine Image 2.0 برصيد 1,316، وReve 2.1 برصيد 1,302، وMuse Image من Meta برصيد 1,282{{/1}}. خمسة نماذج تفصل بينها نحو 100 نقطة Elo في القمة. وتتوصل Artificial Analysis إلى النتيجة الإجمالية نفسها — {{2}}المرتبة الثانية في توليد الصور من النصوص، خلف GPT Image 2 فقط{{/2}} — وتضيف تفاصيل الفئات: يحقق الإصدار التجريبي المركز الأول في 5 من أصل 19 فئة لتوليد الصور من النصوص ({{3}}المواد، والمعرفة، والحدود الأمامية، والتجزئة والتجارة الإلكترونية، والتسويق والإعلان{{/3}})، بينما يتصدر GPT Image 2 بقية الفئات. أن تشير لوحتان مستقلتان تعتمدان على تفضيلات المستخدمين إلى الاتجاه نفسه هو أقوى مؤشر يمكن الحصول عليه على نموذج بهذه الحداثة. الفجوة في الجودة التي كانت تفصل المتصدر عن البقية تضاءلت إلى حد أضحى معه سؤال «{{4}}أفضل نموذج صور{{/4}}» غير مفيد بعد الآن — بل إن {{5}}التحرير والالتزام بالنص والسرعة والسعر{{/5}} هي ما يهم.

رهان مايكروسوفت أوسع من أي تتويج على قمة أي لوحة تصنيفات: حزمة نماذج داخلية تمتد عبر الصورة والصوت والبرمجة والاستدلال، تُوزَّع عبر كوبايلوت وبينج وأوفيس. تصنيفات Arena هي دليل العمل؛ أما التوزيع فهو المنتج الفعلي.

كيفية تجربة ذلك دون المخاطرة بالإنتاج

معاينة Arena مجانية — جرّبها اليوم إذا كنت تريد الإشارة الخام. إذا كان لديك وصول إلى المعاينة الخاصة، فإن نقاط دخول MAI Playground وMicrosoft Foundry تتيح لك تشغيل أعباء عمل حقيقية قبل الالتزام. بالنسبة للبقية، الطريقة الحكيمة لتبني نموذج جديد تمامًا بنتيجة "أولية" هي توجيه جزء من حركة المرور إليه مع إبقاء نموذجك المُثبت كخيار احتياطي. هذا هو بالضبط نمط الفشل الذي صُممت طبقة التوجيه لمعالجته: على OrcaRouter، يمكنك توجيه نقطة نهاية واحدة إلى MAI-Image-2.6 بمجرد استضافته على مزود خارجي، والسماح للتحويل التلقائي بالتغلب على الحالات الطرفية التي لا يستطيع تقييم لوحة الصدارة منخفض الأصوات رؤيتها. مفتاح API واحد، أكثر من 200 نموذج، أسعار المزودين تمر مباشرة.

ماذا تشاهد بعد ذلك

• ما إذا كانت مرتبة التحرير رقم 1 في Artificial Analysis ورقم 3 في Arena ستصمدان مع تراكم الأصوات — فكلتا اللوحتين ما زالتا في مرحلة مبكرة وقليلة الأصوات.

• سعر واجهة برمجة التطبيقات العامة والفئة التي ستندرج فيها — لا تزال النسخة التجريبية الخاصة بدون بطاقة أسعار

• ما إذا كان Bing Image Creator وCopilot يبدلان الإعداد الافتراضي من 2.5 إلى 2.6

• مقاييس أداء مستقلة بمجرد فتح الواجهة البرمجية

هل سيُزال وسم "معاينة" — الإشارة إلى أن مايكروسوفت واثقة بما يكفي لبيعه

الأسئلة الشائعة

متى يمكنني فعلاً استخدام MAI-Image-2.6؟

حاليًا عبر Arena، {{1}}وهو مجاني{{/1}}. اعتبارًا من 19 أغسطس، دخل أيضًا في مرحلة المعاينة الخاصة على MAI Playground وMicrosoft Foundry — {{2}}وفقًا لإعلان Microsoft الرسمي، لذا يكون الوصول مقيّدًا بالدعوات بدلًا من التسجيل العام{{/2}}. {{3}}لا تزال لا توجد واجهة برمجة تطبيقات (API) عامة بنظام الدفع لكل رمز ولا سعر مُعلَن{{/3}}.

ما مدى قوة نتيجة تعديل الصورة؟

على لوحة تصنيف تحرير الصور في Artificial Analysis، يحتل MAI-Image-2.6-Preview المركز الأول، متقدمًا على MAI-Image-2.5-Pro وReve 2.1 وGPT Image 2 — ومايكروسوفت تحتل المركزين الأولين. على لوحة "تحرير صورة واحدة" في Arena يحتل المركز الثالث بـ 1,420 نقطة، بعد أن كان في المركز الخامس. كلتا النتيجتين مستقلتان وتفضيل أعمى، لكنهما مبكرتان ومنخفضتا الأصوات، ولم تُنشر بعد درجة تحرير AA للإصدار التجريبي.

ما مدى قربه من GPT Image 2 Medium؟

45 إيلو على لقطة منصة المقارنة الحالية لتحويل النص إلى صورة — قريبة بما يكفي ليكون الفرق بين المركز الثاني والأول ضمن ما يمكن أن يحركه تدفق الأصوات، والنماذج الخمسة الأوائل جميعها ضمن حوالي 100 إيلو.

هل رتب Arena موثوقة؟

إنها نتائج مستقلة لتقييم أعمى للتفضيلات البشرية، وهذا بالضبط ما يجعلها ذات معنى — لكن كلاهما مبدئي (حوالي 3500 صوت على لوحة النص إلى صورة) ومرتبط بنسخة معاينة. ثق بالاتجاه، لا بالأرقام الدقيقة.

الخلاصة: MAI-Image-2.6-Preview هو أول نموذج من Microsoft في مجال الصور يستحق فعلاً أن يكون ضمن النماذج الرائدة — وقد وصل إلى هناك بسرعة: المركز الثاني على لوحة توليد الصور من النص في Arena عند إطلاقه، والمركز الأول في تحرير الصور على Artificial Analysis بحلول 25 أغسطس، ومعاينة خاصة على أسطح Microsoft الخاصة قبل أي واجهة برمجية عامة. الآن تتقارب لوحتان مستقلتان على نفس القراءة. إذا استقر السعر النهائي في أي مكان قريب من مستوى Flash، سيصبح واحداً من أكثر الخيارات إثارة للاهتمام من حيث القيمة في توليد الصور هذا العام. ترتيبات التحرير والمعاينة تجيبان على سؤال «هل هذا حقيقي؟». الواجهة البرمجية العامة وسعرها سيجيبان على سؤال «هل يستحق البناء عليه؟».