بطاقة العرض الرئيسية للمواجهة بين MAI-Image-2.5-Pro و GPT Image 2، وهما أفضل نموذجي الصور المستضافة المتميزين.
Guides & Insights

MAI-Image-2.5-Pro مقابل GPT Image 2: تاج الصور أصبح الآن منقسماً

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

إنّ الطريقة الأنظف لتلخيص MAI-Image-2.5-Pro مقابل GPT Image 2 هي أنّ «أفضل نموذج للصور» لم يعد سؤالًا واحدًا. ففي Image Editing Arena التابع لموقع Artificial Analysis، يحتل MAI-Image-2.5-Pro من Microsoft المركز الأول بتقييم Elo 1,272؛ وفي Text-to-Image Arena على الموقع نفسه، يحتل GPT Image 2 من Ope​nAI المركز الأول بتقييم Elo 1,369؛ وعلى لوحة الصدارة الكبرى الأخرى — LMArena، التي تُعرف الآن باسم Arena — ما زال GPT Image 2 يهيمن على تحرير الصور بشكل مطلق، متصدّرًا جميع فئات المطالبات السبع. كلا النموذجين من الفئة المميزة، وكلاهما واجهتا API مستضافتان تُحتسب رسومهما على أساس الرموز (token-metered)، والإجابة الصادقة عن «أيهما يفوز» تعتمد كليًا على المهمة التي تحدّدها: فتحرير الصور يفضّل الوافد الجديد من Microsoft، أمّا توليد الصور والالتزام بالمطالبات المعقّدة فيفضّلان النموذج المخضرم من Ope​nAI.

انقسام لوحة المتصدرين، اقرأ بعناية

التحرير (Artificial Analysis): MAI-Image-2.5-Pro رقم 1 — 1,272 إيلو، حوالي 6,100 عينة. GPT Image 2 (high) رقم 4 — 1,256 إيلو.

نص إلى صورة (Artificial Analysis):GPT Image 2 (high) رقم 1 — 1,369 Elo، ~14,500 عينة. MAI-Image-2.5-Pro رقم 7 — 1,292 Elo، ~11,500 عينة.

التحرير (Arena):يتصدر GPT Image 2 بنحو 1,463 Elo مع أكبر تقدم مُقاس في كل فئة — أقوى نتيجة مستقلة لأي من النموذجين.

لوحتا التقييم المتعارضتان ليستا تناقضًا؛ بل هما ساحتان مختلفتان بمدخلات نماذج مختلفة ومجموعات ناخبين مختلفة. تختبر Artificial Analysis المستوى «العالي» المحدد من GPT Image 2 مباشرةً ضد النسخة التجريبية من MAI-Image-2.5-Pro، ونموذج Microsoft يفوز هناك. وتختبر Arena البناء المتوسط في مجال أوسع، وتفوز OpenAI بهامش أكبر. كلاهما حقيقي، وكلاهما مستقل، ولا يكفي تفوق أي من اللوحتين لاعتبار لقب التحرير محسومًا.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 ahead of Reve 2.1, MAI-Image-2.5, and GPT Image 2

فيما يجيد كل واحد

MAI-Image-2.5-Pro هو محرر متخصص. بنته مايكروسوفت لإجراء تغييرات دقيقة وجراحية — استبدال كائن، تحديث نص داخل الصورة، تنظيف الشوائب — مع الحفاظ على اتساق بقية الصورة، وادعاءها بدقة اتساق الشخصيات بنسبة 94% عبر صور متعددة (كما أفاد البائع) هو هدف التصميم في رقم. قدرته الرئيسية هي عرض النص: تدّعي مايكروسوفت دقة 96.8% عبر الإنجليزية والصينية واليابانية والكورية والإسبانية، رغم أن المستندات نفسها تحدّ من الإخراج إلى حوالي ميغابكسل، لذا فإن صياغة "8K" في ذلك الادعاء هي تسويق يجب تجاهله. ما لا يمثله النموذج هو كونه رائدًا في الإنشاء من لوحة فارغة: ترتيبه السابع في تصنيف النص إلى صورة يقول ذلك مباشرة.

GPT Image 2 هو نموذج عام مزوّد بمحرك تفكير. لقد كان أول نموذج صور من Ope​nAI يمتلك وضع تفكير مدمجًا — فهو يخطط للتخطيط، ويمكنه البحث في الويب عن مراجع، ويقوم بالفحص الذاتي قبل الرسم — ولهذا يُعتبر الرائد المعترف به في المطالبات المعقدة ومتعددة القيود وفي فئات التحرير على منصة Arena. كما أنه يعرض النصوص متعددة اللغات بشكل جيد (بما في ذلك اللغات ذات الحروف الصينية واليابانية والكورية CJK)، ويدعم دقة تصل إلى 4K مع حد أقصى لنسبة العرض إلى الارتفاع يبلغ 3:1، ويوفر ثلاث مستويات من الجودة. وتتمثل نقاط ضعفه في انعكاس نقاط قوته: فهو مكلف عند الجودة العالية، ويقوم بإعادة التوليد بدلاً من الحفاظ الدقيق على التفاصيل — فالـ“تحرير” أشبه بإعادة تصيير وفقًا لتعليمات معينة، وهذا هو المجال الذي يحاول فيه MAI-Image-2.5-Pro التمييز من خلال تقديم الاتساق.

السعر

كلاهما يقاس بالرموز المميزة، ولا ينشر أي منهما عدد الرموز المميزة لكل صورة، لذا فإن الأرقام الخاصة بكل صورة هي تحويلات، وليست عروض أسعار.

MAI-Image-2.5-Pro — 5 دولارات لكل مليون توكن إدخال نصي، و8 دولارات لكل مليون توكن إدخال صور، و106 دولارات لكل مليون توكن إخراج صور. حسب تحويل Artificial Analysis: ≈ 108.50 دولارًا لكل 1,000 صورة بدقة 1024×1024.

GPT Image 2 — 5 دولارات لكل مليون رمز نصي، و8 دولارات لكل مليون رمز للصور، و30 دولارًا لكل مليون رمز لمخرجات الصور. وتتفاوت تكلفة الصورة الواحدة حسب مستوى الجودة: نحو 0.006 دولار للجودة المنخفضة، و0.05 دولار للمتوسطة، و0.21 دولار للعالية بدقة 1024×1024 — أي ما يعادل $211 لكل 1,000 صورة بجودة عالية.

إذن، عند المستويات التي يستخدمها المشترون فعليًا، فإن MAI-Image-2.5-Pro يساوي تقريبًانصف سعر الصورة في GPT Image 2 عالي الجودة — وهذا فرق حقيقي عند الحجم الكبير، ويتوافق مع ادعاء Microsoft الخاص (المقدَّم من البائع والمخصص لسيناريو محدد) بخفض تكلفة GPU بنسبة تصل إلى 84% مقارنة بنماذج G​PT في PowerPoint وOneDrive. لكن ثمة تحفّظ: تُظهر لوحة الصدارة المستوى "العالي" من GPT Image 2، وإذا خفضت GPT Image 2 إلى الجودة المتوسطة، ينخفض سعره ليقترب من سعر MAI-Image-2.5-Pro بينما ينخفض مستوى Elo أيضًا.

Comparison scoreboard for MAI-Image-2.5-Pro and GPT Image 2: editing Elo 1,272 versus 1,256; text-to-image Elo 1,292 versus 1,369; price per 1k USD 108.50 versus USD 211 at high quality; text rendering 96.8% claimed versus multilingual; output cap ~1 megapixel versus 4K; availability Foundry preview versus public API

الدقة والصيغ

سقف الإخراج: MAI-Image-2.5-Pro محدد بحوالي 1 ميغابكسل (ما يعادل 1024×1024، الحد الأدنى للجانب 768 بكسل) — مناسب للويب ومعظم الصور المرئية للمنتجات، لكنه حد صارم للطباعة. أما GPT Image 2 فيصل إلى 4K (أقصى حافة 4,000 بكسل، إجمالي البكسلات حتى ~8.3M) مع سقف نسبة أبعاد 3:1.

المدخلات:كلاهما يقبل صور JPEG/PNG بالإضافة إلى النص. توثّق MAI-Image-2.5-Pro إدخالًا نصيًا يبلغ 32k رمزًا ونافذة سياق تبلغ 131k؛ ويُعد وضع الاستدلال في GPT Image 2 هو العامل المميز على جانب الإدخال.

التنسيقات: لا يدعم GPT Image 2 الخلفيات الشفافة عند الإطلاق؛ ولم يُذكر موقف مايكروسوفت من الشفافية لمستوى Pro بأي شكل.

إذا كان إخراجك يحتاج إلى الحجم الكبير — الملصقات، المطبوعات، اللوحات الإعلانية — فإن سقف 4K في GPT Image 2 يُعد ميزة حاسمة اليوم. أما إذا كان إخراجك مخصصًا للويب، فإن الحد الأقصى للميغابكسل نادرًا ما يكون القيد الحاسم.

التوفر وزاوية التوجيه

كلاهما واجهتا برمجة تطبيقات مستضافتان، لكنهما ليستا بنفس درجة التوافر. GPT Image 2 متاح بشكل عام منذ 21 أبريل 2026 عبر واجهة برمجة تطبيقات Ope​nAI، ويمكن توجيهه عبر OrcaRouter اليوم — مفتاح واحد، سعر القائمة من المزود يُمرَّر دون أي هامش ربح (0%)، مع تجاوز تلقائي للفشل بين المزودين. MAI-Image-2.5-Pro هو معاينة عامة في 23 يوليو 2026 على Microsoft Foundry وMAI Playground؛ ولا يزال غير قابل للوصول عبر طبقة توجيه خارجية، وقد يتغير سعر المعاينة عند الإتاحة العامة (GA).

هذا التباين يستحق ملاحظة قرار لأي شخص يقارن بين هذين الاثنين في خط أنابيب حقيقي. يمكنك توجيه جزء من حركة المرور إلى GPT Image 2 وجزءًا إلى نموذج آخر على نقطة النهاية نفسها اليوم، وتبديل سلسلة النموذج عندما تصبح معاينة Microsoft قابلة للاستدعاء على نطاق واسع. سير العمل الذي تريده — مقارنة المحررين على صورك الخاصة، والاحتفاظ بالمُجرَّب كخيار احتياطي بينما يكتسب الجديد الثقة — هو بالضبط ما توفره طبقة التوجيه، ولا يكلف شيئًا إضافيًا على OrcaRouter لأن سعر المزود هو السعر.

Screenshot of the OrcaRouter model page for gpt-image-2, showing the OpenAI image model routable through one API key with provider pricing

الحكم

إذا كانت مهمتك تحرير الصور الموجودة وكان ناتجك بحجم مناسب للويب، فإن {{1}}MAI-Image-2.5-Pro{{/1}} هو الخيار الأفضل قيمةً والرقم 1 المستقل حاليًا على لوحة تحرير Artificial Analysis — بسعر يقارب نصف سعر الصورة الواحدة في النسخة العالية من {{2}}GPT Image 2{{/2}}. أما إذا كانت مهمتك التوليد من لوحة فارغة، أو مطالبات معقدة متعددة القيود، أو مخرجات كبيرة الحجم، فإن {{3}}GPT Image 2{{/3}} هو الأداة الأفضل، وترتيبه الأول في توليد الصور من النص وهيمنته على التحرير في Arena يؤكدان ذلك. كلاهما نموذجان متميزان ويستحقان التوفر؛ واللوحة المنقسمة ليست تعادلًا تسويقيًا — بل تخصصان مختلفان حقًا. ولأن كلاهما مستضاف، فإن طبقة التوجيه هي الطريقة السليمة لتشغيلهما جنبًا إلى جنب على صورك الخاصة قبل أن تلتزم بمسار إنتاج لأيٍّ منهما.

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube