بطاقة عنوان رئيسية لـ 'Qwen3.8-Max مقابل Qwen3.7-Max' مع العنوان الفرعي 'فئتان من فئة Max، و16 نقطة مؤشر، وعرض ترويجي يقلب السعر'، وتذييل يذكر أن أرقام Qwen3.8-Max تأتي من إفصاح Alibaba بتاريخ 22 سبتمبر 2026 وArtificial Analysis، بينما تأتي أرقام Qwen3.7-Max من Artificial Analysis.
Guides & Insights

Qwen3.8-Max مقابل Qwen3.7-Max: مستويان من فئة Max، و16 نقطة مؤشر، وعرض ترويجي يقلب الأسعار

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

قبل أربعة أيام، أخبرنا المورّد أن Qwen3.8-Max ليس النموذج الذي شحنته في أغسطس. في بيان صحفي بتاريخ 22 سبتمبر 2026، من مؤتمر أبسارا في هانغتشو، أفصحت الشركة أن نموذجها الرائد أكمل 33 دورة تكرارية من أعمال التدريب والتدريب اللاحق المؤتمتة بالكامل على مدى أكثر من شهر، وأن الإصدار الناتج رفع مؤشر Artificial Analysis Intelligence Index من 40 إلى 45. لم يتغير معرّف النموذج قط. أما الرقم الذي خلفه فقد تغيّر.

وهذا يهم أكثر في موضع واحد بعينه: المقارنة بين Qwen3.8-Max وQwen3.7-Max، فئة Max التي استبدلها الطراز الأحدث. أصبح Qwen3.8-Max متاحًا للعموم في 3 أغسطس 2026؛ وصدر Qwen3.7-Max في مايو. على الورق، يبدو هذا قرارًا جيليًا سهلًا — طراز رائد أحدث، ودرجة أعلى، فلنمضِ. لكن الأرقام تقول شيئًا أكثر إحراجًا. الفئة الأقدم أسرع بثلاث إلى أربع مرات، وأرخص بنحو خمس مرات لكل مهمة مكتملة، ومطابقة للفئة الأحدث في اختبارات المعرفة الصرفة. الفئة الأحدث متعددة الوسائط، وأفضل بفارق كبير في المهام الوكيلية، وأرخص على بطاقة الأسعار الدولية. أيّهما ينبغي أن تستدعي يعتمد على سؤال تغفله معظم المقارنات: هل تشتري المعرفة أم تشتري استدعاءات الأدوات.

ما يدّعيه إفصاح Apsara فعليًا

هذا الإفصاح هو بيان مورّد، نشرته Alibaba على موقعها الصحفي الخاص، وينبغي قراءته على هذا الأساس. وما يقوله محدد: على مدى أكثر من شهر من التشغيل المؤتمت بالكامل الذي شمل تصميم خطوط المعالجة، والتحقق من البيانات، والتجريب التكراري، وتشخيص الأخطاء، أكمل Qwen3.8-Max 33 دورة، وأنتج التحسين الذاتي للتدريب، إضافة إلى تقنيات ما بعد التدريب، حركة النتيجة. كما وصفت Alibaba تجربة ثانية في تصميم الشرائح، حيث أجرى النموذج أكثر من 60 ساعة من التحسين الذاتي عبر دورة حياة التصميم، وقام بأكثر من 10,000 استدعاء لأدوات EDA، وأنتج وحدات ناقل شرائح بمستوى الإنتاج مع تقليص مساحة الشريحة بنسبة 42% دون تنازل معلن عن الأداء. كل ذلك هو رواية Alibaba عن نموذجها الخاص، ولم يعِد إنتاجه أحد من خارج الشركة.

لكن حركة النتيجة نفسها ليست ادعاءً من مورّد. فالمؤشر مؤشر Artificial Analysis، والرقم 45 موجود على صفحة Qwen3.8 Max (0902) الخاصة بذلك الطرف الثالث. أما الرقم 40 الذي انتقلت منه فيوجد على صفحة المنظمة نفسها الخاصة بإصدار 3 أغسطس، وهو الآن موسوم بأنه مهمل ويشير إلى الإصدار الحالي. إذن، الفارق سبب يبلّغ عنه المورّد ومرتبط بأثر قُيّم بشكل مستقل، وهذا موقف أقوى من أي من الشقين منفردًا. وهو أيضًا، حتى كتابة هذه السطور، أكثر الأدلة العامة الملموسة التي يمتلكها أي أحد على أن مختبرًا في طليعة المجال حرّك القدرة المقيسة لمنتجه الرائد دون طرح رقم إصدار جديد.

هناك أمران آخران بشأن الإصدار يسهل تفويتهما، وكلاهما محوري. أولًا، أكدت علي بابا أن Qwen 4 قيد التدريب، مع توقعات بأن تتوسع سلسلتا Qwen 4.5 وQwen 5 لتصل إلى 5–10 تريليونات معلمة. ثانيًا، هناك لقطة مؤرخة للنموذج المُحدَّث. وقد ثبّتت علي بابا البناء الخاضع للتدريب اللاحق باسم qwen3.8-max-0902 في 2 سبتمبر، وهو قابل للتوجيه بشكل منفصل. هذا التثبيت هو الإجابة العملية على كل ما يقتضيه الكشف عن RSI، وسنعود إليه.

لوحة النتائج

ستة أبعاد، لكلا الجانبين، مع الإبقاء على انضباط توثيق المصادر صريحًا لأن العمودين ليسا موثّقين بالقدر نفسه.

• نافذة السياق — Qwen3.8-Max 1,000,000 توكن مقابل Qwen3.7-Max 1,000,000 توكن (متطابقة)

• الحد الأقصى للإخراج — 131,072 توكن مقابل 131,072 توكن وفقًا لصفحات النماذج الخاصة بـ Alibaba نفسها (متطابقة؛ لاحظ أن صفحة الكتالوج لدينا الخاصة بـ Qwen3.7-Max تذكر 64,000، وهو تباين نشير إليه بدلًا من التستر عليه)

• طريقة الإدخال — النص والصورة والفيديو مقابل النص فقط

• سعر القائمة الدولي لكل مليون توكن — 2.00 دولار للإدخال / 6.00 دولار للإخراج مقابل 2.50 دولار للإدخال / 7.50 دولار للإخراج؛ وبطاقة الأسعار نفسها تفرض بالفعل على كلا الطرازين 1.65 دولار / 4.951 دولار في بكين وفرانكفورت وفيرجينيا

• مؤشر Artificial Analysis Intelligence Index — 45 مقابل 29

• سرعة الإخراج المستقلة — 39.7 توكن/ثانية مقابل 211.3 توكن/ثانية، مقيسة مقابل نفس فئة المقارنة المكوّنة من 211 نموذجًا، حيث تصنّف Artificial Analysis الفئة الأحدث بأنها بطيئة بشكل ملحوظ والفئة الأقدم بأنها سريعة بشكل ملحوظ

الصفان الأخيران هما المقال بأكمله. ضمن عائلة المؤشر نفسها، الطبقة الأحدث متقدمة بـ16 نقطة. أما من حيث السرعة، فهي متخلفة بأكثر من خمسة أضعاف.

A two-column comparison scoreboard: left column 'Qwen3.8-Max' lists Context window 1,000,000 tokens, Max output 131,072 tokens, Input text / image / video, International price per 1M $2.00 / $6.00, AA Intelligence Index 45 and Output speed 39.7 tok/s; right column 'Qwen3.7-Max' lists Context window 1,000,000 tokens, Max output 131,072 tokens, Input text only, International price per 1M $2.50 / $7.50, AA Intelligence Index 29 and Output speed 211.3 tok/s; a footer credits Alibaba's 22 Sep 2026 disclosure and Artificial Analysis.

من أين تأتي النقاط الـ16 — ومن أين لا تأتي

قسّم Index إلى أجزائه، وسيتضح شكل الترقية، وهو ليس الشكل الذي يوحي به التسويق.

في ما يتعلق بالمعرفة والاستدلال، النموذجان متعادلان فعليًا. GPQA Diamond: 92.8 مقابل 92.3. Humanity's Last Exam: 43.1 مقابل 40.5. استرجاع السياق الطويل: 80.33 مقابل 79. SciCode: 52.1 مقابل 49.5. إذا كان عبء العمل لديك هو الإجابة عن الأسئلة عبر مجموعة نصوص كبيرة، فإن القفزة بين الأجيال هي خطأ تقريب. وسيكون من الصعب تبرير دفع مضاعف مقابل ذلك.

في الأعمال الوكيلية والبرمجية، تتّسع الفجوة بقوة. Terminal-Bench 2.1: 88.76 مقابل 74.53. مؤشر البرمجة لدى Artificial Analysis: 76.2 مقابل 66. وأوسع تباين في المجموعة هو مهمة استخدام أدوات الخدمات المصرفية، حيث يسجّل Qwen3.8-Max 47.84 مقابل Qwen3.7-Max11.75 — فجوة بأربعة أضعاف في القدرة نفسها التي يقول وصف RSI إن الدورات الآلية كانت تُحسّنها: تصميم خطوط الأنابيب، والتحقق من البيانات، والتجريب التكراري، وتشخيص الأخطاء. النموذج الذي يقضي شهرًا في تحسين حلقة تدريبه هو نموذج أصبح أفضل في الحلقات.

تحفّظ صادق واحد على تلك الصفوف الفردية. تقع صفحتا الطرازين ضمن عائلة المراجعات نفسها لمؤشر Intelligence Index (‏v4.3 وv4.3.2)، وهو ما يجعل مقارنة العنوان الرئيسي بين 45 و29 مقارنةً عادلة. أما الصفوف الخاصة بكل اختبار معياري فليست من الفوج نفسه: تعود أرقام Qwen3.7-Max على مستوى المهمة إلى نافذة تقييم مايو، بينما تأتي أرقام Qwen3.8-Max من سلسلة سبتمبر. اقرأ اتجاه المسار، لا الخانة المعنوية الثالثة.

سؤال السعر هو سؤالان

على قائمة الأسعار الدولية لـ Alibaba، فإن Max الأحدث أرخص من الإصدار الذي حلّ محلّه: $2.00 / $6.00 لـ Qwen3.8-Max مقابل $2.50 / $7.50 لـ Qwen3.7-Max، لكل مليون توكن. خفض بنسبة 20% في كلا الاتجاهين مع تقدّم الأجيال أمر غير معتاد ويستحق الإشارة بحد ذاته. كما تصبّ اقتصاديات الذاكرة المؤقتة في مصلحة الفئة الأحدث أيضًا — ذاكرة مؤقتة ضمنية عند $0.25 مقابل $0.50، وقراءة ذاكرة مؤقتة صريحة عند $0.17 مقابل $0.25.

هذا هو السؤال الأول، وله إجابة إقليمية تعمل معظم التغطيات على تسطيحها. تتقاضى علي بابا من كلا الطرازين 1.65 دولار للإدخال / 4.951 دولار للإخراج في بكين وفرانكفورت وفيرجينيا. لا توجد فجوة الـ20% إلا على بطاقة سنغافورة الدولية. إذا وصلت حركة المرور لديك إلى المناطق الثلاث الأخرى، فإن رموز الإدخال والإخراج تكلف الشيء نفسه لكلا مستويي Max اليوم، ويتقلص القرار إلى القدرة الصرفة — وعندها يفوز الطراز الأحدث في كل شيء عدا معدل الإنتاجية، ولم يبقَ أي حساب للقيام به.

السؤال الثاني هو الفخ. لا يكلف Qwen3.7-Max حاليًا $2.50 / $7.50. بل يُقدَّم بسعر $1.25 / $3.75 — نصف السعر المعلن، وهو سعر ترويجي. وهذا يجعل فئة الجيل السابق الخيار الأرخص اليوم، وبفارق كبير. ويعني أيضًا أن السعر الذي يمكنك قياسه هذا الأسبوع ليس السعر الذي ستلتزم به. تذكر صفحة النموذج الخاصة بـ Alibaba بوضوح أن الجدول المنشور يعرض التسعير الأصلي "باستثناء أي عروض ترويجية محدودة المدة" وتوجهك إلى وحدة التحكم للحصول على العروض الحالية. العرض الترويجي، بحكم طبيعته، سعر يمكن أن ينتهي. وإذا انتهى، فلا يصبح Qwen3.7-Max أكثر تكلفة مما هو عليه اليوم فحسب؛ بل يصبح أغلى بنسبة 25% من النموذج الذي يتفوق عليه.

نمرّر سعر المزوّد بهامش ربح 0%، لذا فإن سعر القائمة والعرض الترويجي كليهما سارٍ من جانبنا في اليوم نفسه الذي يتغيّران فيه — وهو أمر مناسب للمقارنة وغير مفيد إذا كنت تحاول إعداد ميزانية. ابنِ النموذج على أساس بطاقة القائمة، وتعامل مع السعر الترويجي على أنه مكسب إضافي.

A screenshot of Alibaba Cloud Model Studio's 'Recommended models' documentation overview page, showing the console navigation on the left, the line 'Alibaba Cloud Model Studio offers Qwen and third-party models for text, image, audio, and video.', an 'Updated at: 2026-09-24 20:17:58' stamp, and category cards covering Text generation (listing qwen3.8-max and qwen3.7), Image & video, World models, and Audio & speech.

الرقم الذي يقلب حجة التكلفة

سعر التوكن ليس هو ما تكلفه المهمة. تنشر Artificial Analysis رقمًا لتكلفة المهمة يشمل اقتصاديات الذاكرة المؤقتة وحجم الاستدلال وطول الإجابة، وبناءً على هذا المقياس ينقلب الترتيب تمامًا: $5.41 لكل مهمة Intelligence Index لـ Qwen3.8-Max مقابل $1.15 لـ Qwen3.7-Max. علاوة 4.7×، مقابل سعر توكن إما أرخص بنسبة 20% أو مماثل حسب منطقتك.

يعود الفارق في معظمه إلى الإسهاب. في التقييم نفسه، أنتج النموذج الأحدث 190 مليون رمز إخراج مقابل ما بلغه النموذج الأقدم، أي 120 مليون، ويستدل باستفاضة للوصول إلى إجاباته. إذا كنت تدفع مقابل كل رمز إخراج لعبء عمل كبير الحجم ومتوسط الصعوبة، فإن Max الأحدث ليس النموذج الأرخص عند أي سعر للرمز في أي من قائمتي الأسعار. إنه النموذج الأكثر تكلفة، وسعر الرمز المعلن في القائمة هو الأداة الخاطئة لاتخاذ القرار بشأنه.

السرعة، وما تُظهره بيانات حركة المرور الخاصة بنا

فجوة الإنتاجية كبيرة بما يكفي لتغيير المعماريات. يضع Artificial Analysis نموذج Qwen3.8-Max عند 39.7 رمزًا في الثانية — ويصف ملخصه النموذج بأنه بطيء بشكل ملحوظ — مقابل 211.3 لـ Qwen3.7-Max، الذي يصفه بأنه سريع بشكل ملحوظ. هذا هو الفرق بين نموذج تضعه خلف واجهة تفاعلية وآخر تضعه خلف قائمة انتظار — وعلى Qwen3.8-Max، فهو أول ما تعرضه عليك لوحة الإحصاءات الخاصة بنا.

تخبرنا بيانات القياس عن بعد الخاصة بملعبنا التجريبي على مدار سبعة أيام حتى 25 سبتمبر بقصة أكثر دقة بعض الشيء حول زمن الاستجابة، وهي تأتي مع تحذير: هذه قياساتنا على التوجيه الخاص بنا، وليست معيارًا مُتحكَّمًا فيه. أظهر Qwen3.8-Max وسيطًا قدره 2,611 مللي ثانية للاستجابة الأولى عند 54.7 رمزًا في الثانية بمعدل خطأ 2.45%؛ وأظهر الإصدار المثبّت 0902 وسيطًا قدره 3,360 مللي ثانية عند 46.2 رمزًا في الثانية بمعدل خطأ أنظف بشكل ملحوظ بلغ 0.66%. استقر Qwen3.7-Max عند وسيط 4,509 مللي ثانية ولكن عند 169.8 رمزًا في الثانية بمعدل خطأ 3.80%. إذن، تجيب الفئة الأقدم بشكل أبطأ في البداية ثم تتدفق بسرعة أكبر بثلاث مرات، مع فشلها بشكل أكثر تكرارًا. إذا كان عبء العمل الخاص بك متفجرًا، فإن فرق معدل الخطأ هذا يستحق اهتمامًا أكبر من الوسيط.

كلا المستويين مُفعّلان عبر مفتاح OrcaRouter واحد إلى جانب اللقطة المثبّتة، مع تجاوز فشل تلقائي بين المزوّدين. في مقارنة كهذه، هذه هي النقطة العملية: قياس مطالباتك الخاصة مقابل كلا جيلي Max هو تغيير في الإعداد، وليس عقدًا ثانيًا.

A screenshot of OrcaRouter's own model page for Qwen3.7-Max (models/qwen/qwen3.7-max) in the dark theme, showing the Qwen3.7-Max heading, its model description, and the stat and price panel for the tier.

أصبحت قابلية التكرار الآن العامل الحاسم

هذا هو الجزء من إفصاح Apsara الذي لم يحسب له أحد حسابًا. إن معرّف نموذج نشط انتقلت قدرته المقيسة من 40 إلى 45 خلال شهر، من دون تغيير في الإصدار ومن دون إعلان آنذاك، يمثّل خطرًا على قابلية إعادة الإنتاج. وإذا كان سلوك منتجك دالةً لمعرّف متغيّر، فلديك نموذج يمكن أن يتحسّن — أو ينزاح — تحت حزمة تقييم مجمّدة، أو مكتبة مطالبات مخزّنة مؤقتًا، أو مجموعة انحدار معتمدة.

كلا الجيلين يقدّم لقطات مؤرّخة، وهذا هو التخفيف. توثّق علي بابا أن Qwen3.7-Max مكافئ وظيفيًا لـ qwen3.7-max-2026-05-20، مع نسخ مؤرّخة إضافية عند 2026-05-17 و2026-06-08. ولدى Qwen3.8-Max qwen3.8-max-0902، نسخة سبتمبر المُدرَّبة لاحقًا، وهي المقصودة بالرقم 45. إذا كنت تُطلق أي شيء يحتاج إلى قابلية إعادة الإنتاج، فثبّت المعرّف المؤرّخ وتعامل مع المعرّف العائم كهدف تجريبي. دورات RSI سمة من سمات المعرّف العائم؛ والتثبيت هو سبيلك إلى إلغاء الاشتراك فيها.

تفصيل تسمية يجدر معرفته كي لا تسيء قراءة الكتالوج. تُدرج Alibaba صيغة ثالثة مؤرخة، qwen3.8-max-2026-09-02، إلى جانب الاسم المستعار 0902؛ فهما يشيران إلى البناء نفسه. لم يعد إصدار 3 أغسطس الأصلي قابلاً للتوجيه من جانبنا — نحن نقدّم Qwen3.8-Max، وتثبيت 0902، وQwen3.7-Max.

من الذي يجب أن يختار ماذا

لا يقوم القرار على أيّ الطرازين أفضل، بل يقوم على ما تشتريه بالفعل.

ابقَ على Qwen3.7-Max إذا كان عبء عملك نصيًا فقط، ومعتمدًا على المعرفة أكثر من الاعتماد على الأدوات، وحساسًا للإنتاجية — تصنيف بحجم كبير، واستخلاص، واسترجاع بسياق طويل، وتلخيص دفعي. في GPQA Diamond والاسترجاع طويل السياق يكون ضمن نقطة واحدة من الطراز الأحدث، ويبث أسرع بثلاث إلى أربع مرات، ويكلف 1.15 دولارًا للمهمة مقابل 5.41 دولارًا. وهو أيضًا الجواب الصحيح لأي شخص يريد رأيًا ثانيًا رخيصًا في تهيئة دمج أو توجيه، لأنه بسعره الترويجي يقع في فئة سعرية مختلفة تمامًا. تحذيران: العرض الترويجي هو عرض ترويجي، وقد أشارت Artificial Analysis بالفعل إلى أن الطراز مهجور، واستُبدل بـ Qwen3.8-Max. لا تبدأ التزامًا متعدد السنوات بناءً عليه.

انتقل إلى Qwen3.8-Max إذا صحّ أي مما يلي: تحتاج إلى إدخال الصور أو الفيديو، وهو ما لا يقبله Qwen3-Max إطلاقًا؛ أو كان عبء عملك قائمًا على الوكلاء، بسلاسل طويلة من استدعاءات الأدوات أو حلقات برمجة متعددة الخطوات، حيث يشكّل 88.76 مقابل 74.53 على Terminal-Bench 2.1 وفجوة استخدام الأدوات بأربعة أضعاف الفرق بين الإطلاق وعدمه؛ أو كنت تُسعّر وفق بطاقة الأسعار الدولية السنغافورية، فالموديل الأحدث أرخص بنسبة 20% ببساطة ولا توجد مقايضة تستحق الموازنة. ثبّت qwen3.8-max-0902 إذا كنت تحتاج إلى أن يبقى السلوك ثابتًا.

إذا كنت في بكين أو فرانكفورت أو فيرجينيا، فإن الخيار أوضح مما توحي به أي مقارنة: كلا فئتي Max تكلفان $1.65 / $4.951 لكل مليون رمز. متطابقة. وبهذه الأسعار، فإن عدم دفع أي مبلغ إضافي مقابل الإدخال متعدد الوسائط، ومؤشر أعلى بـ16 نقطة، ودرجة استخدام أدوات أفضل بأربعة أضعاف ليس قرارًا، بل هو مجاني — ويصبح السبب الوحيد للبقاء على Qwen3.7-Max هو الإنتاجية الخام.

سؤالان يستحقان الإجابة عليهما مباشرة

هل يعني تشغيل تدريبي من 33 دورة أن النموذج تغيّر في ظل حركة مرور API القائمة؟ هذا ما يوحي به الإفصاح، ولهذا السبب يوجد التثبيت المؤرّخ. تصف علي بابا النموذج المحسّن بأنه «Qwen3.8-Max المحدّث»، وهو المعرّف العائم، لا معرّف جديد. إذا كانت لديك أعباء عمل على المعرّف العائم حتى سبتمبر، فقد كانت تُخدَم بواسطة نموذج تغيّرت قدرته المقيسة خلال تلك النافذة. ولم تنشر علي بابا سجل تغييرات للبنيات الوسيطة، لذا فإن الطريقة الموثوقة الوحيدة لمعرفة السلوك الذي لديك هي التثبيت.

هل ادّعاء RSI مُتحقَّق منه بشكل مستقل؟ النتيجة التي أنتجها كذلك — فالمؤشر مؤشر Artificial Analysis، و45 موجود على صفحتهم. أما الآلية التي تقف خلفه فهي وصف علي بابا الخاص لعملية تدريبها، دون تكرار خارجي، ولا بروتوكول تقييم منشور، ولا طرف ثالث يراقب الدورات الـ33. اعتبر "33 دورة تكرارية" ادّعاءً من المورّد و"45 بعد 40" زوجًا مقيسًا. وهما ليسا من جنس القول نفسه، وهذا الفرق هو سبب كون العنوان الرئيسي يستحق القراءة بعناية بدل تكراره.

الشيء التالي الذي يجب مراقبته ليس Qwen 4. بل ما إذا كان عرض Qwen3.7-Max بنصف السعر سيصمد بعد وصول الطراز الذي يُفترض أن يحل محله. وإذا لم يصمد، فسيكتشف عدد كبير جدًا من الفرق أنهم كانوا يقارنون سعرًا معلنًا بخصم، وأن الأقدم بين الشقيقين كان الأغلى طوال الوقت.