بطاقة رئيسية للمواجهة بين MAI-Image-2.5-Pro، المتاح حاليًا في المعاينة على Microsoft Foundry، وFlux 3، النموذج الأساسي متعدد الوسائط من Black Forest Labs الذي لم تُطرح طبقة الصور الخاصة به بعد.
Guides & Insights

MAI-Image-2.5-Pro مقابل Flux 3: أسبوع إطلاق واحد، حقيقتان مختلفتان

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

MAI-Image-2.5-ProوFlux 3تم الإعلان عنهما في نفس الأسبوع — 23 يوليو 2026. بعد شهر واحد، أصبحا في عالمين مختلفين. MAI-Image-2.5-Pro، نموذج الصور من فئة الجودة من Microsoft، متاح في المعاينة العامة على Microsoft Foundry وقد ارتقى إلى المركز الأول في Artificial Analysis Image Editing Arena (Elo 1,272 من حوالي 6,100 تصويت أعمى). أما Flux 3، نموذج الأساس الموحد متعدد الوسائط من Black Forest Labs، فقد أطلق مستوى واحدًا فقط من مستوياته — الفيديو — ولا يوجد لنموذج الصور الخاص به أي نقطة وصول عامة، ولا سعر، ولا معايير يمكن لأي شخص تشغيلها. القارئ الذي يسأل "أي نموذج صور يجب أن أستخدم؟" ليس لديه مرشحان هنا؛ بل لديه منتج واحد ووعد واحد.

ما هو كل واحد منها في الحقيقة

MAI-Image-2.5-Pro — نموذج متخصص ومملوك لتوليد الصور وتحريرها، وهو الطراز الأعلى دقةً في عائلة MAI-Image-2.5 المطوّرة داخليًا لدى Microsoft. يعمل بنظام عدّ الرموز (Token-metered)، ومستضاف على Foundry، ومصمَّم للصور الرئيسية، والتحرير التفصيلي، وعرض النصوص داخل الصور. هذا هو النموذج بأكمله: صور.

Flux 3 — نموذج أساسي متعدد الوسائط موحّد تم تدريبه بشكل مشترك على الصور والفيديو والصوت (بالإضافة إلى التنبؤ بأفعال الروبوت)، مبني على طريقة مطابقة التدفق التي تسميها BFL "Self-Flow". تم الإعلان عن خمسة إصدارات: Flux 3 Video وFlux 3 Image وFlux 3 Action وFlux-mimic للروبوتات وFlux 3 Dev (مع خطط لإتاحة الأوزان مفتوحة المصدر لاحقًا في 2026). الصورة ليست سوى نمط واحد ضمن رهان أكبر، وليست المنتج بحد ذاته.

هذا الاختلاف البنيوي أهم من أي مواصفات. نموذج الصور المتخصص يوجّه كامل طاقته إلى الصور الثابتة؛ بينما النموذج متعدد الوسائط يوزّع طاقته عبر الوسائط المختلفة. MAI-Image-2.5-Pro صُمم ليتفوق في تحرير الصور. أما Flux 3 فصُمم ليكون نموذجًا واحدًا يقوم بكل شيء، ومستوى الصور فيه هو الجزء من تلك الرؤية الذي لم يكتمل بعد.

التوفر: المقارنة الكاملة

اعتبارًا من منتصف أغسطس 2026، عدم التماثل مطلق:

MAI-Image-2.5-Pro — معاينة عامة على Azure AI Foundry في سبع مناطق عالمية، بالإضافة إلى MAI Playground المجاني. يمكنك استدعاؤه اليوم بحساب Microsoft؛ وهو بالفعل أعلى مستوى جودة في عائلة تشغّل Bing Image Creator وPowerPoint وOneDrive.

Flux 3 Image — لم يُطرح بعد. لا تذكر وثائق BFL أي نقطة نهاية للصور؛ لا يزال خط الصور القابل للاستدعاء حاليًا هو FLUX.2 (Pro, Dev, Flex, Klein). تحمل صفحة Flux 3 علامة "قريبًا" مع نموذج طلب بدلاً من زر البدء. قالت BFL إن الوصول المبكر للصور سينفتح "في الأسابيع التالية" بعد إعلان 23 يوليو؛ حتى الآن، لا يوجد معرّف نموذج، ولا مواصفات للصور، ولم يُنشر أي حد للمطالبات. فقط Flux 3 Video وصل إلى التوفر العام (4 أغسطس، يتم الفوترة بالثانية).

إذن، الإجابة العملية على سؤال "أي واحد يمكنني الاعتماد عليه لتحرير الصور اليوم" تحتوي على اسم واحد فقط.

الأدلة التي يمكن لكل جانب إظهارها

تُقاس قوة تحرير MAI-Image-2.5-Pro بشكل مستقل. إلى جانب كونه الأول في تصنيف Elo للتحرير، فإن ترتيبه في تحويل النص إلى صورة هو رقم 7 بتقييم 1,292 Elo — جيد، لكنه ليس الرائد، وهذه هي الطريقة الصادقة لتقييم نموذج متخصص. تنشر مايكروسوفت أيضًا ادعاءات مقدّمة من البائع: دقة عرض النص بنسبة 96.8% (مشار إليها على أنها تغطي خمس لغات)، والالتزام بالتعليمات أفضل بنسبة 27% من GPT Image 1.5 في التقييمات الداخلية، واتساق الشخصيات عبر الصور المتعددة بنسبة 94%. صنّف كل هذه الأرقام باعتبارها أرقام مايكروسوفت الخاصة؛ فلوحة الصدارة هي الجزء المستقل.

لا يوجد أي دليل علني حول Flux 3 Image. لا توجد معايير للصور، لأنه لا يوجد endpoint للصور لاختباره. الأرقام الوحيدة المبلغ عنها من BFL ضمن العائلة هي لـ Flux 3 Video — Elo داخلي يبلغ 1,135 للنص-إلى-فيديو و1,051 للصورة-إلى-فيديو، وتدعي BFL أنها تتفوق على Omni Flash وH3 وSeedance 2.0 — وهذه الأرقام مقدّمة من البائع، وغير مُعاد إنتاجها، ولا تُنقل إلى مستوى الصور على أي حال. أي شيء تقرؤه "يقيس" جودة Flux 3 Image إنما هو استقراء من أرقام الفيديو أو من خط FLUX.2 الأقدم.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 ahead of Reve 2.1, MAI-Image-2.5, and GPT Image 2Comparison scoreboard for MAI-Image-2.5-Pro and Flux 3: availability in preview on Microsoft Foundry versus image tier unreleased; image editing rank No. 1 at 1,272 Elo versus no image benchmarks; scope focused image model versus unified multimodal; text rendering 96.8% claimed versus roadmap claim of multilingual accuracy; price USD 108.50 per 1k versus no image price published; callable today versus coming soon

ما الذي يعد به Flux 3 للصور (خارطة طريق البائع، وليست مواصفات)

إن ادعاءات خارطة طريق BFL بخصوص مستوى الصور جديرة بالمعرفة بدقة لأنها مجرد ادعاءات:

• تركيب الصور وتحريرها عبر الأنماط، ونسب الأبعاد، والدقة

تحسين التعامل مع الاستفسارات المعقدة وعرض النصوص متعددة اللغات بدقة عالية

• نقل النمط بدون تدريب من صورة مرجعية، مع دمج مراجع نمط متعددة في تمريرة واحدة

• اتساق الشخصية والعلامة التجارية عبر الأجيال دون ضبط دقيق

• التحرير غير الإتلافي — الحفاظ على الأنسجة، والحبيبات، والإضاءة، والخلفية بحيث لا تتدهور جودة التعديلات المتعددة

تلك النقطة الأخيرة هي الادعاء المثير للاهتمام: إنها نفس خاصية "التحرير دون إعادة توليد المشهد" التي يعتمد عليها تصميم التحرير الجراحي في MAI-Image-2.5-Pro ويحقق نتائج فيها بالفعل. إذا قدّم Flux 3 Image هذه القدرة، فسوف ينافس مباشرةً ما يفعله MAI-Image-2.5-Pro بالفعل. كلمة "إذا" هي الكلمة المفصلية — كل ما في تلك القائمة غير مؤكد حتى وجود نقطة النهاية.

التكلفة

MAI-Image-2.5-Pro — 5 دولارات لكل مليون رمز إدخال نصي، و8 دولارات لكل مليون رمز إدخال صورة، و106 دولارات لكل مليون رمز إخراج صورة. بحسب تحويل Artificial Analysis، تبلغ تكلفة صورة 1024×1024 حوالي $108.50 لكل 1,000. تسعير المعاينة؛ قد يتغير عند الإتاحة العامة.

Flux 3 Image — لا يوجد سعر، فلا توجد نقطة وصول. التسعير الوحيد المنشور لـ Flux 3 هو للفيديو: 0.17 دولار/ثانية (HD) و0.29 دولار/ثانية (FHD) للعرض الكامل. وكمرجع لخط صور FLUX.2 القابل للاستدعاء، تفرض BFL حوالي 0.04 دولار لكل صورة لـ Flux Pro و0.015 دولار لـ Flux Dev — لكن هذا هو الجيل السابق، وليس توقعًا.

لا يمكنك مقارنة سعر مقابل سطر فارغ. مقارنة التكلفة اليوم هي سعر MAI-Image-2.5-Pro المميز مقابل لا شيء على الإطلاق.

Screenshot of Microsoft's announcement of MAI-Image-2.5-Pro and MAI-Voice-2-Flash, showing the preview launch and positioning as Microsoft's highest-fidelity image model

أي واحد نبني عليه؟

إذا كان مخرَجك النهائي صورًا في عام 2026، فالإجابة هي MAI-Image-2.5-Pro (أو أحد المحرِّرات المستضافة الأخرى — لا يزال GPT Image 2 يتصدّر تحويل النص إلى صورة ومجال التحرير الرئيسي الآخر). وهو قابل للاستدعاء، وله درجة تحرير مستقلة في المرتبة #1، والحد الأقصى للدقة عند حوالي ميغابكسل هو الأمر الرئيسي الذي يجب التحقق منه وفقًا لحالة استخدامك. أما Flux 3 فهو عنصر يستحق الترصُّد: عندما يُطلَق مستوى الصور، ستستحق ادعاءاته بشأن التحرير غير المُتلِف واتساق العلامة التجارية اختبارًا جادًا في مواجهة النموذج الذي تصنّفه Microsoft في المرتبة #1 حاليًا.

هناك أيضًا طريقة شبيهة بالتوجيه للتفكير في الانتظار. عندما تحصل Flux 3 Image أخيرًا على نقطة وصول، فإن الطريقة منخفضة المخاطر لاعتماد نموذج جديد كليًا ولا يعتمد على معايير مرجعية هي توجيه جزء من حركة المرور إليه وإبقاء النموذج المُثبت كخيار احتياطي تلقائي — نقطة وصول واحدة، أسعار المزود تمرّ دون أي هامش ربح (0%)، والنموذج غير المُثبت يكسب مكانه على حركة المرور الحية بدلاً من شريحة في خارطة الطريق. هذا هو النمط الذي وُجد OrcaRouter من أجله، وهو نفسه النمط الذي يجعل النماذج ذات الطبقة التجريبية مثل MAI-Image-2.5-Pro قابلة للاعتماد قبل وصولها إلى التوفر العام.

الحكم

نفس أسبوع الإطلاق، وبعد شهر واحد: MAI-Image-2.5-Pro هو محرر مُصنّف رقم 1 يمكنك استدعاؤه اليوم، وFlux 3 هو نموذج أساسي متعدد الوسائط لا تزال طبقة الصور فيه مجرد وعد مع خارطة طريق. مقارنتهما في جودة الصور تشبه مقارنة ملاكم بمقاتل لم يدخل الحلبة بعد. استخدم MAI-Image-2.5-Pro لأعمال الصور الآن، وأبقِ Flux 3 Image على قائمة الأشياء التي يجب إعادة تقييمها في اليوم الذي تُتاح فيه نقطة الوصول الخاصة به فعليًا.

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

providers@orcarouter.ai

انضم إلى مجتمعنا

Discordsupport@orcarouter.aiXGitHubYouTube