بطاقة عنوان مُولّدة تحمل نص «AREX-2 مقابل Qwen3.8-Max - ركيزة وما يعمل عليها»، مع لوحتين. اللوحة اليسرى، التي تعلوها Qwen3.8-Max، تسرد: متاح منذ 3 أغسطس 2026؛ سياق 1M رمز، متعدد الوسائط؛ 2 دولار إدخال / 6 دولار إخراج لكل 1M؛ قابل للاستدعاء اليوم. اللوحة اليمنى، التي تعلوها AREX-2، تسرد: أُنشئ المستودع في 29 سبتمبر 2026؛ لا أوزان، لا بطاقة نموذج؛ لا قائمة أسعار في أي مكان؛ غير قابل للاستدعاء في أي مكان. يقرأ تذييل «أُجري تدريب لاحق للجيل الأول من AREX على بنية Qwen الأساسية.» شعار OrcaRouter مُدمَج في الزاوية السفلية اليمنى.
Guides & Insights

AREX-2 مقابل Qwen 3.8: أحدهما ركيزة، والآخر مبنيّ عليها على الأرجح.

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

المواجهة بين AREX-2 وQwen3.8-Max تبدو وكأنها معركة مباشرة بين نظامين رائدين من مختبرين صينيين، لكنها ليست كذلك — لا لأن AREX-2 غير مُثبت الجدارة، رغم أنه كذلك، بل لأن الاثنين يقعان في طبقتين مختلفتين من المنظومة نفسها. Qwen3.8-Max متاح منذ 3 أغسطس 2026، بسعر دولارين لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج مع نافذة سياق تبلغ مليون رمز؛ وأشقّاؤه مفتوحو الأوزان، Qwen3.8-27B وQwen3.8-Flash، صدرا في 13 و26 أغسطس مع مقاييس أداء منشورة وأسعار منشورة. AREX-2 هو مستودع أنشأته BAAI على Hugging Face في 29 سبتمبر 2026 عند 17:56 UTC، ويحتوي على .gitattributes ولا شيء آخر. والسبب في أن الاثنين ليسا متنافسين يكمن في الحقيقة الكامنة التي لا يعلنها أي من المزوّدين بصوت عالٍ: كل نموذج AREX أصدرته BAAI حتى الآن مبني على عمود فقري Qwen.

هذا ليس تكهنًا بشأن AREX-2. إنه موثّق للجيل الموجود. AREX-Base هو مزيج خبراء بمعاملات تبلغ 122 مليارًا مع 10 مليارات معامل نشط، مبني على Qwen3.5-122B-A10B، وAREX-Turbo هو نموذج كثيف بـ4 مليارات معامل مبني على Qwen3.5-4B؛ وقد أُطلق كلاهما في 23 يوليو 2026 بموجب Apache 2.0. لذا فالشكل الصادق لهذه المقارنة ليس وكيلًا مقابل طراز رائد. بل هو: ماذا تشتري لك ركيزة علي بابا اليوم، وماذا تضيف طبقة الوكلاء لدى BAAI فوق ذلك، وكم من السؤال الثاني يمكن الإجابة عنه قبل أن ترفع BAAI ملفًا؟

ما الذي أصبح متاحًا فعليًا على جانب Qwen، وكم تبلغ تكلفته

جيل Qwen3.8 سهل الاستدلال عليه بشكل غير معتاد لأنه محدد بالكامل ومسعّر علنًا، على ثلاث فئات متمايزة.

• Qwen3.8-Max — صدر في 3 أغسطس 2026. نافذة سياق تبلغ مليون رمز، وإدخال أصلي للنصوص والصور والفيديو، ووضع التفكير، واستدعاء الدوال والمخرجات المنظمة، وثلاث صيغ اتصال (متوافقة مع OpenAI، ومتوافقة مع Anthropic، وDashScope الأصلية) عبر خمس مناطق. 2.00 دولار لكل مليون رمز إدخال و6.00 دولار لكل مليون رمز إخراج، وقراءات التخزين المؤقت بسعر 0.25 دولار.

• Qwen3.8-27B — صدر في 13 أغسطس 2026. كثيف، 27 مليار معامل، سياق 256 ألف (262,144 موضعًا)، نص وصورة وفيديو كمدخلات، أوزان Apache 2.0. نُشر على بطاقة Qwe‌n الخاصة بدرجة 90.3 على LiveCodeBench v6، و89.2 على GPQA Diamond، و84.3 على OSWorld-Verified و79.0 على QwenSWEBench — مُبلَّغ عنه من البائع، ولم يُستنسَخ بشكل مستقل. القياس المستقل يضعه عند مؤشر الذكاء من Artificial Analysis بدرجة 33.7 و68.1 على مؤشر AA Coding.

• Qwen3.8-Flash — صدر في 26 أغسطس 2026. النافذة نفسها البالغة مليون رمز، والمدخلات متعددة الوسائط نفسها، بسعر 0.15 دولار لكل مليون رمز إدخال و0.47 دولار للإخراج. الفئة الأرخص في العائلة، وهي التي تجعل حركة الوكلاء عالية الحجم ميسورة التكلفة.

يوجد أيضًا مدخل غير موسوم Qwen3.8: النموذج الرائد البالغ 2.4 تريليون معلمة، الذي قالت علي بابا إن أوزانه قادمة، ولا يمكن استدعاؤه في أي مكان حتى الآن. إذا كنت تبحث عن "Qwe​n 3.8" وتتوقع نموذجًا واحدًا، فهذا سبب أن الإجابة عائلة من أربعة، وليس نموذجًا واحدًا.

A screenshot of the OrcaRouter model page for Qwen3.8-27B, showing the Featured badge, a 256K-token context window, text, image and video input with text output, badges for Vision, Tools, JSON and Reasoning, the provider line 'by Qwen - 2026-08-13', a pricing row of $0.33 input and $2.40 output per million tokens with measured latency and 120.2M tokens of traffic, and the beginning of the model description covering the 27B dense multimodal model's Apache-2.0 licence and 256K context.

في مقابل كل ذلك، لا تتجاوز مواصفة AREX-2 سطرًا واحدًا: مستودع، وطابع زمني، واسم يوحي بجيل ثانٍ من شيء سبق أن بنته BAAI مرة واحدة.

التفصيل الذي يُعيد تأطير المقارنة بأكملها

AREX ليس منافسًا لـ Qwen؛ بل هو مستهلك له. كلا النموذجين الأولين من AREX مدرَّبان تدريبًا لاحقًا على بنى Qwen3.5 الأساسية، ثم يُلفّان في إطار يجعلهما وكلاء لا نماذج محادثة: حلقة داخلية تبحث وتتصفح وتدمج الأدلة في إجابة مرشَّحة تحمل قيمة ثقة، وحلقة خارجية تفحص تلك الإجابة مقابل القيود الأصلية، فإما تقبلها أو تنقّحها أو تتخلى عن المسار وتبدأ من جديد. الهندسة المثيرة للاهتمام في AREX ليست الشبكة، بل الحلقة، وآلية تحديث السياق التي تُبقي النتائج المتحقَّقة والمرشَّحات المفتوحة والقيود غير المحلولة مستقيمة على مدى أفق طويل، وواجهة الأدوات التي تُظهر البحث والتصفح للنموذج كإجراءات من الدرجة الأولى.

لهذا السبب، فإن الأرقام التي نشرتها عائلة النماذج بنفسها — 82.5 على BrowseComp، و85.4 على GAIA، و71.0 على xbench-2510، و89.9 على DeepSearch QA و82.0 على WideSearch-en لـ 122B Base، مع 70.7 / 81.6 / 57.0 / 78.5 / 68.5 لـ 4B Turbo — لا يمكن مقارنتها بدرجات البرمجة والوكيلية الخاصة بـ Qwen3.8-27B، حتى وإن كان الاثنان يتشاركان في سلالة معمارية. إنها تقيس أشياء مختلفة. يسأل QwenSWEBench ما إذا كان بإمكان نموذج حل مشكلة في مستودع. يسأل BrowseComp ما إذا كان بإمكان وكيل العثور على حقيقة يصعب العثور عليها عن قصد، عبر عمليات بحث كثيرة، دون أن يفقد السؤال. نقطة تفتيش خام لـ Qwen3.5 تسجل بشكل سيئ في الثاني وبشكل جيد في الأول، وهو بالضبط الفجوة التي يهدف التدريب اللاحق والمنصة الخاصة بـ BAAI إلى سدها.

A generated pricing card headed 'The Qwen3.8 family is priced. AREX-2 is not callable.' It lists Qwen3.8-Max at $2.00 in / $6.00 out with a 1M context released 3 Aug 2026, Qwen3.8-27B at $0.33 in / $2.40 out with 256K context and open weights released 13 Aug 2026, Qwen3.8-Flash at $0.15 in / $0.47 out with a 1M context released 26 Aug 2026, Qwen3.5-122B-A10B at $0.115 in / $0.917 out as the backbone AREX-Base post-trains up to 128K, and a highlighted AREX-2 row reading 'no rate card' because there are no weights, card or licence tag. A footer reads 'Qwen3.8-27B scores 33.7 on the AA Intelligence Index; AREX-2 does not exist to score.' The OrcaRouter logo is composited in the bottom-right corner.

ما الذي يُرجَّح أن يكون عليه الجيل الثاني

إذا واصل AREX-2 النمط نفسه، فإن القراءة الأرجح — استنتاج لا حقيقة — هي وكيل بحثي من الجيل الثاني دُرِّب لاحقًا على عمود فقري Qwen أحدث من الجيل 3.5 الذي تستخدمه نماذج AREX الحالية. Qwen3.8-27B كثيف، ومتعدد الوسائط، ومتاح بموجب Apache 2.0، ما يجعله مرشحًا طبيعيًا لوكيل من فئة الجودة؛ أما Qwen3.8-Flash فرخيص لكل رمز، وهذا مهم للغاية عندما يجري وكيلك العشرات من الاستدعاءات لكل استعلام ويعيد قراءة سياق متنامٍ في كل خطوة.

لا شيء من ذلك مؤكَّد. لا يحمل الاسم حجمًا ولا بنية أساسية ولا تاريخًا، ووجود «2» في خط منتجات هو عرف تسمية وليس مواصفة. أما المؤكَّد فهو أضيق نطاقًا بكثير، وينبغي أن يُذكر على هذا النحو: أنشأ BAAI المستودع في 29 سبتمبر 2026، ولم يضع فيه شيئًا، ولم يُعلن شيئًا. لا أوزان، ولا بطاقة نموذج، ولا عدد معاملات، ولا وسم ترخيص، ولا مقاييس أداء مرجعية، ولا مزوّد يقدّمه. إذا رأيت أرقام AREX-2 منقولة في أي مكان هذا الأسبوع، فهي ليست قياسات.

ما يمكنك شراؤه فعلاً بعد ظهر اليوم

عدم التماثل العملي بين هذين ليس في الجودة، بل في أن أحد الطرفين لديه قائمة أسعار والآخر لديه مُدخل في دليل.

إذا كان عملك قائمًا على الوكلاء وكنت تريد الركيزة التي بُنيت عليها عائلة AREX، فإن العمود الفقري الدقيق قابل للاستدعاء: Qwen3.5-122B-A10B موجود في كتالوج OrcaRouter بسعر 0.115 دولار لكل مليون رمز إدخال و0.917 دولار لكل مليون رمز إخراج حتى 128 ألف رمز، ويرتفع إلى 0.287 / 2.294 دولار بعد ذلك، مع تمكين الرؤية واستخدام الأدوات والاستدلال. هذا هو النموذج الذي يقوم AREX-Base بتدريبه لاحقًا، ومتاح دون انتظار أي شيء.

إذا كنت تريد الجيل الحالي، فإن كلا الفئتين المفتوحتين من Qwen3.8 على الكتالوج: Qwen3.8-27B بسعر $0.33 لكل مليون رمز إدخال و$2.40 لكل مليون رمز إخراج، ويعمل على بنيتنا التحتية الخاصة لأن الأوزان مفتوحة ولا توجد تكلفة لكل رمز من المورّد لتمريرها، وQwen3.8-Flash بسعر $0.15 / $0.47 لفئة الحجم. واجهة API واحدة تغطي كليهما، ويُمرَّر سعر قائمة المزوّد كما هو دون إضافة أي شيء لكل رمز، لذا عندما تغيّر علي بابا سعرًا يتغير الرقم هنا في اليوم نفسه.

وعندما يُطرح AREX-2 فعلاً، فإن سبب انتمائه خلف تلك الطبقة نفسها بنيوي وليس ترويجياً. حلقة وكيل تُجري عشرين استدعاءً لكل استعلام تضاعف معدل فشل كل مزوّد عشرين مرة؛ قاعدة توجيه مع تجاوز فشل تلقائي تقرر وقت التشغيلهي الفرق بين أن تكون المهلة إعادة محاولة وأن تكون المهلة إجابة خاطئة بثقة. تنطبق هذه الحجة على أي وكيل بحث، وستنطبق على AREX-2 متى وُجد AREX-2 ليوجَّه.

من ينبغي أن يتصرف، وعلى ماذا؟

إذا كنت بحاجة إلى وكيل بحث اليوم، فإن AREX-Base هو نموذج AREX الموجود، وقد صدر في يوليو تحت رخصة Apache 2.0، واختبارات أداء الوكيل الخاصة به هي اختبارات البائع نفسه، ولكن على الأقل هي مرتبطة بنموذج قابل للتنزيل. وإذا كنت بحاجة إلى استدلال متعدد الوسائط متطور أو حركة وكلاء عالية الحجم اليوم، فإن مستويات Qwen3.8 متاحة ومسعّرة ومقيّمة بشكل مستقل جزئيًا، ولا شيء في وجود AREX-2 يغيّر ذلك القرار.

السيناريو الوحيد الذي يكون فيه AREX-2 مهمًا لقرار تتخذه هذا الأسبوع هو السيناريو الذي تختار فيه عمودًا فقريًا لعملية ضبط دقيق. وفي هذا السيناريو تكون الإجابة ظاهرة بالفعل في الكتالوج: الأعمدة الفقرية من إصدار 3.5 المستخدمة في AREX لا تزال رخيصة ومتاحة، وجيل 3.8 أفضل ومتاح أيضًا، وAREX من الجيل الثاني — متى ظهر — سيكون على الأرجح دليلًا على أي قاعدة Qwe​n يعتقد BAAI أنها تستحق البناء عليها، وليس بديلًا عنها.

ثلاثة أمور من شأنها أن تحسم ما تبقّى: ملفات في الشجرة، وبطاقة تضم عدد المعاملات وحقل النموذج الأساسي، ووسم ترخيص. أول هذه الأمور هو المهم، لأنه حتى يتحقق، فإن هذه المقارنة هي بين عائلة مُسعّرة وعنصر نائب.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا