بطاقة عنوان رئيسية مولّدة تحمل العنوان الرئيسي "Qwen-Image-2.1 يتصدّر كلا ساحتَي الصور"، والعنوان الفرعي "ما يخفيه لقب المصدر المفتوح رقم 1"، وتعرض بطاقتَي لوحة صدارة تحملان تسمية Image Edit Arena مع شريحة ترتيب تقرأ "16 من 56" وشريحة نتيجة تقرأ "1367"، وText-to-Image Arena مع شريحة ترتيب تقرأ "17 من 79" وشريحة نتيجة تقرأ "1228"، فوق وسم يحمل النص "qwen-research licence".
Guides & Insights

Qwen-Image-2.1 تتصدر كلا ساحتَي الصور: ما الذي يخفيه لقب المصدر المفتوح رقم 1

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

شكر الفريق القائم على Qwen-Image-2.1 منصّة Arena على هذا التقدير، والتقدير حقيقي. Qwen-Image-2.1 هو النموذج الأعلى تقييمًا على كلتا لوحتَي الصور في Arena اللتين لا تصنّفهما المنصّة بوسم Proprietary: 1,367 في تحرير الصور و1,228 في تحويل النص إلى صورة، وفق لقطة 22 سبتمبر 2026. وكل صف يعلوه على اللوحتين يحمل وسم Proprietary. وثلاث وقائع لا يحملها الإعلان قابلة للتحقق بقدر ما هو الادّعاء نفسه — الترتيب الإجمالي الذي تشتريه هاتان الدرجتان، ومبدئي العَلَم الذي يأتي به كلا الصفين، وسلسلة ترخيص تقول qwen-research بدلًا من Apache 2.0 في نماذجه الصورية الأسبق. الادّعاء يصمد عند الاحتكاك باللوحات. لكنه يقول أقل مما يوحيه العنوان.

قراءة اللوحتين جنبًا إلى جنب

درجات Arena هي تقييمات على نمط Elo مبنية على تصويتات زوجية عمياء: يرى الشخص مخرجين اثنين، ولا يعرف أي نموذج أنتج أيًا منهما، ثم يختار. وهذا صنف أدلة مختلف فئويًا عن معيار قياس خاص بمورّد، ولهذا فإن أي ادعاء يستند إليه جديرٌ بالتحقق لا بالتكرار. وقد جُمع كلا اللوحين في 22 سبتمبر 2026، وقُرئا صفًا صفًا لا قراءةً سريعةً من الرسم البياني للترتيب.

A screenshot of the LMArena Image Edit Arena leaderboard, captured September 22 2026, showing the board header reading 29,902,508 votes and 56 models, with ranks 13 to 22 visible: gemini-3-pro-image-preview at 1385, reve-2.1 at 1375, gpt-image-1.5-high-fidelity at 1370, qwen-image-2.1 at rank 16 with 1367 and a confidence interval of plus or minus 9 and 4,841 votes marked Preliminary, reve-2.0 at 1358, uni-1.1-max at 1334, grok-imagine-image at 1329, uni-1.1 at 1315, gemini-3.1-flash-lite-image at 1314 and qwen-image-2.0-pro-2026-06-22 at 1304, with every row above qwen-image-2.1 labelled Proprietary.

لوحة Image Edit تسرد 56 نموذجًا و29,902,508 صوتًا. يحتل Qwen-Image-2.1 المرتبة 16 بدرجة 1,367، وفترة ثقة ±9، و4,841 صوتًا. الصفوف الخمسة عشر التي فوقه — من gpt-image-2.5-sunburst عند 1,526 نزولاً إلى gpt-image-1.5-high-fidelity عند 1,370 — كلها مملوكة. وكذلك الصفان اللذان يقعان تحته مباشرة، reve-2.0 عند 1,358 و uni-1.1-max عند 1,334.

A screenshot of the LMArena Text-to-Image Arena leaderboard, captured September 22 2026, showing the board header reading 6,258,152 votes and 79 models, with ranks 14 to 21 visible: gemini-3-pro-image-2k at 1246, gpt-image-1.5-high-fidelity at 1239, gemini-3-pro-image-preview at 1232, qwen-image-2.1 at rank 17 with 1228 and a confidence interval of plus or minus 11 and 2,843 votes marked Preliminary, ideogram-4.0-quality at 1204 labelled Ideogram Open Model, qwen-image-2.0-pro-2026-06-22 at 1191, uni-1.1-max at 1188 and mai-image-2 at 1183, with Proprietary labelling on every row above qwen-image-2.1.

تسرد لوحة تحويل النص إلى صورة في اليوم نفسه 79 نموذجًا و6,258,152 صوتًا. يحتل Qwen-Image-2.1 المرتبة 17 عند 1,228 مع فاصل ثقة ±11 و2,843 صوتًا. النمط نفسه: الصفوف الستة عشر التي تعلوه مملوكة، وأول صف غير مملوك أسفله هو ideogram-4.0-quality عند 1,204، موسومًا بـ Ideogram Open Model.

ثمة تفصيلان من تلك الصفوف يستحقان الإبراز، لأنهما يتناقضان مع الطريقة التي عادةً ما يُكرَّر بها الادعاء.

الترتيب والنتيجة يرويان قصتين مختلفتين — 1,367 هو أفضل رقم غير مملوك على لوحة تحرير الصور، وهو أيضًا المركز السادس عشر، متأخرًا 159 نقطة عن المتصدر وبفارق 3 نقاط عن المركز الخامس عشر.
على إحدى اللوحتين، يفوز النموذج المغلق الخاص بعلي بابا — qwen-image-3.0-pro، المصنّف كمملوك، يقع عند 1,254 على لوحة النص إلى الصورة، بفارق ست وعشرين نقطة فوق 1,228 الخاص بـ qwen-image-2.1. وعلى لوحة التحرير، يتفوق النموذج المفتوح على النموذج المملوك الأسبق qwen-image-2.0-pro-2026-06-22 عند 1,304. بطل الدار ليس النموذج نفسه على اللوحتين.
الفجوة إلى النموذج المفتوح التالي واسعة على إحدى اللوحتين وضيقة على الأخرى — على لوحة تحرير الصور، الصف التالي غير المملوك هو hunyuan-image-3.0-instruct عند 1,302، متأخرًا خمسة وستين نقطة؛ وعلى لوحة النص إلى الصورة، إنه ideogram-4.0-quality عند 1,204، متأخرًا أربعًا وعشرين نقطة.

سلسلة الترخيص تؤدي عملًا أكثر من الترتيب

كل صف في Arena يحمل تسمية المؤسسة والترخيص. ويقرأ Qwen-Image-2.1 Alibaba · qwen-research على كلتا اللوحتين. وهذا ليس تصنيف Apache 2.0 على نماذج الصور الأقدم لدى Alibaba: qwen-image-edit عند 1,241 و qwen-image-edit-2511 عند 1,235 على لوحة التحرير، وكلاهما موسومان بـ Apache 2.0، وينطبق الأمر نفسه على qwen-image-2512 عند 1,125 و qwen-image عند 1,057 على لوحة النص إلى الصورة. وتُغلق تدوينة البائع الحلقة نفسها، بنشر الأوزان بموجب اتفاقية ترخيص Qwen Research المؤرخة في 20 سبتمبر 2026، التي تسمح بالبحث والتقييم وليس بالاستخدام التجاري.

إذن، القراءة الصادقة لـ"#1 نموذج مفتوح المصدر" أضيق مما تبدو عليه. على التقسيم الثنائي الخاص باللوحة — مملوك أم لا — Qwen-Image-2.1 هو الأول. وفق تعريف OSI للمصدر المفتوح، الذي لا يقبل تقييد مجال الاستخدام، فهو ليس مفتوح المصدر على الإطلاق، وكذلك معظم النماذج التي يُقارن بها: تحمل نفس اللوحات صفوفًا مصنّفة flux-non-commercial-license، tencent-hunyuan-community، krea-2-community-license و Ideogram Open Model. إن مرشح "المصدر المفتوح" في Arena هو مفتاح تقريبي بين المملوك وغير المملوك. إنه مفيد. لكنه ليس مراجعة تراخيص.

هذا التمييز يهم هنا أكثر من هوامش النقطتين، لأنه الشيء الوحيد الذي لا يمكن أن يتغير مع أسبوع آخر من التصويت. إذا أردت اليوم نموذج صور مرخّصًا بترخيص متسامح من هذه العائلة، فإن صفّي Apache 2.0 هما qwen-image-edit وqwen-image-edit-2511 — وكلاهما أقدم، وكلاهما أقل بأكثر من مئة وعشرين نقطة على نفس لوحة التحرير (1,241 و1,235 مقابل 1,367). أفضل نموذج Qwen للصور المفتوح التسمية من حيث النقاط والنموذج Qwen للصور القابل للاستخدام التجاري ليسا التنزيل نفسه.

المبدئي يعني أن الرقم لا يزال قابلاً للتغيير

يحمل كلا صفّي Qwen-Image-2.1 علامة اللوحة مبدئي، وهي التي تطبّقها Arena عندما لا يكون قد تجمّع لصفٍّ ما عدد أصوات كافٍ لتُعتبر نتيجته نهائية. وعدد الأصوات هو السبب: 4,841 صوتًا مقابل إجمالي 29,902,508 على Image Edit، و2,843 مقابل 6,258,152 على Text-to-Image. وبالمقارنة، تحمل الصفوف المحيطة به عددًا أكبر بكثير — فصف gpt-image-1.5-high-fidelity لديه 589,013 صوتًا على لوحة التحرير، وqwen-image-2.0-pro-2026-06-22 لديه 307,705 على لوحة Text-to-Image.

فترتا ثقة ب±9 و±11 لنموذج عمره ثلاثة أيام ليستا علامة تحذير؛ بل هكذا يبدو الإصدار الجديد. لكنهما تعنيان أن الترتيب المحدد في قمة المستوى المفتوح قد يتغير مع تراكم الأصوات، لا سيما في تحويل النص إلى صورة حيث يبلغ الفارق عن الصف المفتوح التالي أربعًا وعشرين نقطة.

ما هو الطراز، على ورقة المورّد الخاصة به

تصف وثيقة علي بابا الخاصة نموذجًا موحّدًا للتحويل من النص إلى الصورة والتحرير، مزوّدًا بمكوّن توليد بصري بـ7 مليارات معامل مبنيّ من 32 طبقة DiT أحادية التدفق، مع توليد وتحرير أصليين للصور الشفافة، ودعم يصل إلى 10 صور مرجعية، وسقف إخراج أصلي بدقة 2048×2048 — ويبلغ حجم تنزيل خط الأنابيب الكامل نحو 33 غيغابايت. ويُعدّ دعم الشفافية العنصر الأقل شيوعًا في تلك القائمة؛ فلوحة التحرير في Arena لا تقيسه بشكل واضح، لذا فإن ترتيب اللوحة ليس دليلًا في أي من الاتجاهين على تلك القدرة تحديدًا.

المقياس الرئيسي الذي يبرزه المورّد هو Qwen-Image-Bench، حيث يُذكر أن النموذج سجّل 60.28، متقدماً على Nano Banana 2.0 عند 59.82 وGPT Image 1.5 عند 59.65. هذا تقييم يديره المورّد ولا يوجد له تكرار من طرف ثالث، كما أن الفروق أقل من نقطة واحدة — وهو فارق لن يصمد إذا تغيّرت مجموعة المطالبات. يجدر القول بوضوح: أرقام Arena المذكورة أعلاه هي أصوات آخرين، بينما أرقام Qwen-Image-Bench هي أرقام Alibaba نفسها. وهما ليستا من النوع نفسه من الأدلة، ولا ينبغي حسابهما في متوسط واحد لتكوين انطباع واحد عن النموذج.

جاء دعم النشر مع الإصدار لا بعده: تكاملات اليوم الأول للنموذج متوفرة في ComfyUI وSGLang وvLLM-Omni وLightX2V ومكتبة Diffusers، ما يعني أن السؤال العملي لدى معظم الفرق ليس ما إذا كان يمكن تقديم النموذج، بل ما إذا كانت تكلفة تقديمه تناسب الميزانية.

إلى أين يصل ادعاء كهذا إذا كنت بحاجة إلى واجهة برمجة تطبيقات للصور هذا الأسبوع

أن نكون دقيقين بشأن موقفنا نحن مهم هنا. لا يقوم OrcaRouter بتوجيه Qwen-Image-2.1، أو أي نموذج Qwen-Image من أي إصدار. إذا كانت نتائج Arena هي ما أقنعك، فإن النموذج يمكن الوصول إليه عبر واجهة API الخاصة بالمورّد وعدة منصات تابعة لجهات خارجية، أو كتنزيل مستضاف ذاتيًا — وليس عبرنا. ليس لدينا أي مسار لصور Qwen لنبيعه لك، ورتبة لوحة الصدارة ليست سببًا للتظاهر بخلاف ذلك.

ما نوجّهه هو بقية طبقة الصور التي تصنّفها تلك اللوحات، وعدة صفوف أعلى من Qwen-Image-2.1 موجودة عليه. تتوفر GPT-Image-2 وGPT-Image-1.5 وGPT-Image-1-mini من OpenAI، وكذلك طبقات Imagen 4 من Google ونقاط نهاية معاينة الصور من Gemini، ونقطة نهاية الصور Grok Imagine من xAI. هذا المزيج هو الجواب العملي على ادعاء مثل هذا. لو كانت Arena قد وضعت نموذجًا مفتوحًا في القمة مباشرةً، لكان التبديل تغييرًا بسطر واحد من الشيفرة على مفتاح واحد. لكنها لم تفعل ذلك — فقمة كلتا اللوحتين احتكارية، والقرار المثير هو الاختيار بين تنزيل بترخيص بحثي ونقطة نهاية مستضافة يمكنك استدعاؤها اليوم.

ثلاث خصائص في المنصة تهمّ لهذا القرار. يتم التوجيه عبر نقطة نهاية واحدة متوافقة مع OpenAI بين أكثر من 200 نموذج، لذا فإن مقارنة الصفوف المستضافة بعضها ببعض لا تعني عقدًا ثانيًا أو SDK ثانيًا. ويُمرَّر سعر قائمة المزوّد دون أي هامش ربح، ما يعني أن تغيير سعر البائع يصل إلى فاتورتك في اليوم نفسه الذي يُعلن فيه بدلًا من موعد تجديد العقد التالي. ويعني التحويل التلقائي عند الفشل بين المزوّدين أن نموذجًا جديدًا قليل الأصوات يمكن أن يقع خلف نموذج راسخ في سلسلة احتياطية بدلًا من أن يصبح اعتمادًا إنتاجيًا في اليوم الثالث — وهو تقريبًا الوضع الذي يوجد فيه Qwen-Image-2.1 الآن.

الادعاء صحيح، وهو أرقُّ مما يبدو عند قراءته.

ما نشره Alibaba قابل للتحقق: في لقطة 22 سبتمبر 2026 لكلتا لوحتَي الصور في Arena، يكون Qwen-Image-2.1 هو النموذج الأعلى تقييمًا غير الموسوم بـ Proprietary. وما يختزله المنشور هو كل ما يضع عليه تحفظات — المرتبة السادسة عشرة والسابعة عشرة إجمالًا، ونتيجة أولية مبنية على بضعة آلاف من الأصوات، ورخصة بحثية تنوب عن رخصة المصدر المفتوح التي تستدعيها العبارة إلى الذهن.

A generated scoreboard titled Qwen-Image-2.1 - the scoreboard, with rows reading Image Edit Arena score 1367 at rank 16 of 56, Text-to-Image Arena score 1228 at rank 17 of 79, row status Preliminary on both boards, licence qwen-research non-commercial, Apache 2.0 sibling qwen-image-edit at 1241, and vendor benchmark Qwen-Image-Bench 60.28 unreproduced, above a footer reading Arena figures per the LMArena boards captured September 22 2026; Qwen-Image-Bench figure vendor-reported, no third-party reproduction.

لا شيء من هذا يجعل النتيجة صغيرة. فكونه الصف الأول غير الاحتكاري على كلا اللوحتين، بعد ثلاثة أيام من الإصدار، تغيير حقيقي في موقع الطبقة المفتوحة — فنماذج Qwen للصور ذات الترخيص المتسامح التي تسبقه تتخلف بأكثر من مئة وعشرين نقطة على لوحة التحرير نفسها. لكنه ليس التصريح نفسه الذي تقوله عبارة «أفضل نموذج صور مفتوح المصدر»، والفرق هو سطر ترخيص وعمود ترتيب لا يستغرق فحصهما نحو دقيقة.