
تستهدف Qwen 4.5 وQwen 5 ما بين 5 و10 تريليونات من المعاملات: ما قالته Alibaba وما لم تقله
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
في مؤتمر Apsara في هانغتشو بتاريخ 22 سبتمبر 2026، وضعت الشركة حجمًا للجيل الذي يلي الجيل القادم.Qwen 4.5 وQwen 5 سلسلتان "من المتوقع أن تتوسعا لتصل إلى 5 إلى 10 تريليونات معامل"، وفقًا للصياغة الواردة في البيان الصحفي الإنجليزي للشركة — وهو بند في خارطة طريق، وليس مواصفة. لا يملك أي من الطرازين تاريخ إصدار، أو بطاقة طراز، أو معرّف API، أو سعرًا، أو نتيجة قياس مرجعي منشورة، مما يعني أنه لا يمكن استدعاء أي منهما اليوم. الطراز الرائد الذي يمكنك شراؤه فعليًا هو Qwen3.8-Max، المتاح عمومًا منذ 3 أغسطس 2026، بـ 2.4 تريليون معامل. في الأيام التي تلت المؤتمر، اختُزلت جملة خارطة الطريق تلك في الكثير من التغطيات إلى ادعاء بأن طرازًا بـ 10 تريليونات معامل قادم — وهو ادعاء أقوى وأبسط من الادعاء الذي قدمته الشركة. المسافة بين هاتين الجملتين تبلغ نحو عام من التخطيط.
الادعاء، والنسخة التي انتشرت منه
قيل شيئان على المسرح، ويستحقان الفصل لأنهما يحملان كميات مختلفة جدًا من المعلومات. الأول تحديث للحالة: Qwen 4 قيد التدريب، على بنية معمارية جديدة. والثاني خارطة طريق: من المتوقع أن تصل سلسلتا Qwen 4.5 وQwen 5 إلى نطاق معلمات يتراوح بين 5 و10 تريليونات.
ينسب البيان الصحفي الإنجليزي الصادر عن Alibaba كليهما إلى الشركة بدلًا من مسؤول تنفيذي مسمّى. أما تغطية المؤتمر التي تذهب أبعد من ذلك، فتنسب خارطة الطريق إلى ليو دا ييهنغ، الذي يدير مشروع Qwen للنماذج اللغوية الكبيرة في Alibaba Token Hub، وتنقل تصوّره القائل إن التوسّع مسار أساسي نحو الذكاء الاصطناعي الفائق. وهذا التصوّر هو السياق الذي قُدّم فيه رقم المعاملات، وهو ما يفسّر لماذا جاء الرقم كنطاق لا كهدف.
ما انتشر حينها كان الطرف الأعلى من النطاق. وتتضمّن العناوين الإنجليزية التي تلته عنوانًا واحدًا على الأقل يصف نموذجًا تم التشويق له بـ10 تريليونات معلمة، وعدة عناوين تصف خطة لنموذج يتراوح بين 5 و10 تريليونات معلمة. وكلاهما قراءتان قابلتان للدفاع عنهما لشريحة عرض. ولا أيٌّ منهما مواصفة، والفرق مهم لأي شخص يتعيّن عليه أن يخطط بناءً عليه.
5 تريليونات هي هدف جيل، و10 تريليونات هدف جيل آخر.
أهم ما ينبغي إدراكه إدراكًا صحيحًا بشأن هذا الإعلان هو أن 5 إلى 10 تريليونات تشكّل نطاقًا يمتد عبر جيلين، لا طرازًا واحدًا بهامش تفاوت واسع. وجملة علي بابا نفسها تربط هذا النطاق بـ«سلسلتي طرازي Qwen 4.5 وQwen 5 القادمتين» — أي السلسلتين، بصيغة الجمع، مجتمعتين.
التقارير الصادرة باللغة الصينية من المؤتمر نفسه دقيقة في اتجاه مختلف مرة أخرى، بعناوين تصف نماذج بعد Qwen 4.5 تتوسع إلى نطاق يتراوح بين 5 و10 تريليونات. وتضع هذه القراءة الطرف البالغ 10 تريليونات خارج Qwen 4.5 أيضاً. والبيان الوحيد الذي تتفق عليه كل المصادر هو أن النطاق يغطي المسافة من Qwen 4.5 إلى Qwen 5. وإن إسناد 10 تريليونات إلى Qwen 5 تحديداً هو استنتاج صار عنواناً، وليس اقتباساً.
وعلى سبيل المقارنة، هذه هي الأرقام الوحيدة في هذه القصة المنشورة وليست المُتوقَّعة:
• من 5 إلى 10 تريليونات — نطاق المعاملات الذي يربطه البيان الصحفي لشركة Alibaba بسلسلتي Qwen 4.5 و Qwen 5
• 2.4 تريليون — إجمالي المعاملات في Qwen3.8-Max، النموذج الرائد المطروح، وفقًا لبطاقة النموذج الرسمية الخاصة به
• 95 مليار — المعاملات النشطة في Qwen3.8-Max لكل رمز، الرقم الذي يحدد تكلفة خدمة الرمز الواحد
• 10 تريليونات — أعلى النطاق، والجزء الوحيد منه الذي وصل إلى معظم العناوين الإنجليزية
• 0 — عدد المواصفات المنشورة، وتواريخ الإصدار، والأسعار، ونوافذ السياق، ونتائج المعايير القياسية لـ Qwen 4.5 أو Qwen 5

رقم المعامل الذي يهم هو ذاك الذي لم ينشره أحد.
إجمالي المعاملات هو الرقم الذي يختار المختبر ذكره. أما المعاملات النشطة فهي الرقم الذي يحتاجه المشتري، وخارطة الطريق لا تتضمن أياً منها.
Qwen3.8-Max هو نموذج مزيج خبراء بإجمالي 2.4 تريليون معامل، و95 مليار معامل نشط لكل رمز. وهذا يعني نسبة تنشيط تبلغ نحو 4 بالمئة: يحتفظ النموذج بقدر كبير من المعرفة في أوزان لا يقرأها عند أي رمز بعينه، ويدفع تكلفة حسابية مقابل شريحة صغيرة منها. تخبرك المعاملات الإجمالية بمقدار الذاكرة التي يشغلها هذا الشيء وبحجم الصندوق الذي تحتاجه. أما المعاملات النشطة فتخبرك بما تدفعه في كل مرة يجيب فيها.
إذا مضيت بهذه النسبة إلى الأمام، يصبح شكل المشكلة مرئيًا. نموذج بـ10 تريليون معامل، بُني عند نفس نسبة التنشيط البالغة 4 بالمئة، سيُنشّط نحو 400 مليار معامل لكل توكن — أكثر من أربعة أضعاف ما ينشّطه Qwen3.8-Max الآن. هذه حسابات مبنية على افتراض معلن، وليست ادعاءً بشأن Qwen 5: ارفع التناثر فيهبط عدد المعاملات النشطة، واخفضه فيصعد. لكن هذه الحسابات هي التي تحدد ما إذا كان نموذج بـ10 تريليون معامل منتجًا يُقدَّم فعليًا أم أثرًا بحثيًا، وهي الحساب الذي يستدعيه عنوان 5 إلى 10 تريليون ثم يتركه غير مكتمل.
هنا أيضًا يتوقف اقتصاد التوجيه عن كونه مجردًا. على OrcaRouter، يُمرَّر سعر قائمة المزوّد مع هامش ربح 0%، لذا فإن خفض سعر البائع على أحد مستويات Qwen يصبح ساريًا على مفتاحك في اليوم نفسه بدلًا من موعد التجديد. إن جيلًا تكون تكلفة تقديم خدمته غير مؤكدة فعلًا هو بالضبط الحالة التي تكون فيها قيمة هذا التمرير المباشر أكبر من خصم يُتفاوض عليه مسبقًا مقابل رقم لم ينشره أحد.
إعلان الشريحة هو الجدول الزمني الفعلي
أعلنت Alibaba في البيان الصحفي نفسه عن خارطة طريق النموذج ومسرّع جديد، والاثنان أكثر ارتباطًا مما يذكره البيان.
معالج Zhenwu V900 من T-Head هو معالج للتدريب والاستدلال بذاكرة سعة 216 غيغابايت وعرض نطاق بين الشرائح يبلغ 1,200 غيغابايت/ثانية، ودعم أصلي لـ FP8 وFP4، وأداء يُزعم أنه ثلاثة أضعاف أداء سابقه Zhenwu M890 الذي أُطلق في مايو. ومن المقرر أن يبدأ الإنتاج الضخم والإطلاق التجاري في الربع الأول من عام 2027. ويدعم خادم عقدة فائقة مرافق عناقيد تصل إلى 500,000 بطاقة، وتقول T-Head إن سلسلة Zhenwu خدمت أكثر من 650 عميلاً.
اقرأ الإعلانين معًا، فيصبح التسلسل واضحًا. إن تدريب نموذج مزيج الخبراء على نطاق 10 تريليونات وتقديمه يمثل مشكلة ترابط قبل أن يكون مشكلة حوسبة، لأن التوازي حسب الخبراء يعني نقل التنشيطات بين الشرائح باستمرار، و1,200 جيجابايت/ثانية من عرض النطاق بين الشرائح هو الرقم الذي يحدد ما إذا كان ذلك قابلًا للتنفيذ. إن السيليكون وفق ذلك الجدول الزمني يضع أقرب نافذة معقولة لتشغيل بهذا النطاق الطليعي في وقت متأخر من عام 2027 — وحتى حينها، فإن شحن شريحة لا يقول شيئًا عن اكتمال عملية تدريب. لقد ربطت علي بابا الموضوعين بوضعهما في إصدار واحد؛ أما الربط نفسه فهو قراءتنا، وهو مُصنَّف على أنه كذلك.
يتسق الأفق الزمني للشركة نفسها مع ذلك. وقد وضع الرئيس التنفيذي إيدي وو هدفًا يتمثل في أكثر من 20 غيغاواط من سعة مراكز بيانات Alibaba Cloud العالمية بحلول عام 2032 — وهو هدف للسعة، وليس سعة مُشغَّلة فعليًا، وأفق زمني يتجاوز خمس سنوات وليس أفق الربع المقبل.
ادعاءات التحسين الذاتي التي تدعم خارطة الطريق
السبب الذي يجعل خطة بقيمة 5 إلى 10 تريليونات قابلة للجدال أصلاً، بدلاً من أن تكون مجرد مكلفة، هو التحسين الذاتي التكراري: إذا حسّن خط أنابيب التدريب نفسه، فإن القدرة الحاسوبية المطلوبة لكل جيل تنخفض، وتقترب الحدود المتقدمة من أن تصبح ميسورة التكلفة. هذا هو الادعاء الذي تقوم عليه خارطة الطريق، وهو أيضاً أقل ما قالته Alibaba قابلية للتحقق.
ما أبلغت عنه الشركة: أكمل Qwen3.8-Max 33 دورة تكرارية على مدى شهر تقريبًا من العمل المؤتمت بالكامل شمل تصميم خطوط الأنابيب، والتحقق من البيانات وتشخيص الأخطاء، ورفع درجته في Artificial Analysis من 40 إلى 45. وفي تجربة لتصميم الرقائق، أمضى النموذج أكثر من 60 ساعة من التحسين الذاتي خلال دورة حياة تصميم، وأجرى أكثر من 10,000 استدعاء لأدوات أتمتة التصميم الإلكتروني، وقلّل مساحة الشريحة بنسبة 42 بالمئة دون خسارة في الأداء. كما يتضمن تقرير من المؤتمر تحسينًا بنسبة 96 بالمئة في إنتاجية الاستدلال من خلال الضبط الذاتي لوحدة معالجة رسوميات T-Head جديدة.
هذه مُبلَّغ عنها من قِبَل المورّد ولم تُكرَّر بشكل مستقل. وهذه ليست نقطة شكلية — فحلقة ذاتية التشغيل تُقيّم تجاربها بنفسها إنما تقيس نفسها مقابل أداة التقييم الخاصة بها، وليس للعالم الخارجي أي سبيل للتحقق من معايير التقييم. وقد قالت تغطية المؤتمر هذا عمومًا، وينبغي للقرّاء أن يفترضوا ذلك.
هناك فخ ثانٍ في الادعاء نفسه، وهو يتعلق بالتسميات لا بالأمانة. لم تقل Alibaba أي مراجعة من Artificial Analysis Intelligence Index تُقاس مقابلها حركتها من 40 إلى 45، وقد أُعيد بناء ذلك المؤشر منذ إطلاق هذا النموذج. تعرض صفحة Artificial Analysis الحالية لـ Qwen3.8 Max (0902) الرقم 45 — وهو رقم مستقل، وفق المراجعة النافذة اليوم. أما القراءة المسجلة للنموذج نفسه في منتصف أغسطس، وفق المراجعة النافذة آنذاك، فكانت 56. والرقم 45 والرقم 56 ليسا القياس نفسه بالوحدات نفسها، وطرح أحدهما من الآخر ينتج رقمًا لا معنى له. وما لا تحمله الصفحة هو الرقم 40 الذي تقول Alibaba إنها تحسّنت منه: نقطة البداية في هذا الفارق خاصة بالشركة، ونقطة النهاية وحدها تصادف أنها تقع حيث تقع القراءة المستقلة الآن. اقرأ الحركة كاتجاه، لا كقياس.

ما الذي أطلقته Alibaba فعلاً في المؤتمر نفسه؟
إذا استبعدنا خارطة الطريق، فقد ظل المؤتمر يحتوي على إصدارات حقيقية، جميعها متعددة الوسائط:
• Qwen3.8-LiveTranslate — الترجمة الفورية الشفهية، مع خفض زمن الاستجابة (LAAL) بنحو 20 بالمئة، من 2.8 ثانية إلى 2.3 ثانية
• Qwen-Audio-3.1-ASR، وQwen-Audio-3.1-TTS وQwen-Audio-3.1-Realtime — مجموعة صوتية مُحدّثة
• Qwen-Audio-3.1-TTS-Next — مشاهد صوتية سينمائية تمزج بين الحوار والأجواء من نص مكتوب، موجهة إلى الكتب الصوتية، والأفلام والتلفزيون، والبودكاست والألعاب
• Qwen-Image 3.1 — توليد الصور المُصمَّم خصيصًا للتصميم الإبداعي والتسويق التجاري الإلكتروني، ومن المقرر إطلاقه في وقت لاحق من هذا العام، مع قدرة أصلية على توليد خلفيات شفافة
• Qwen Intelligence — منصة وكيليّة متكاملة موجّهة إلى مُصنّعي الهواتف الذكية
كل بند في تلك القائمة هو منتج له نافذة تسليم. أما الادعاء على نطاق الطليعة فهو البند الوحيد في جدول الأعمال الذي لا يرتبط به تاريخ، وهذا التباين ليس مصادفة: فطرح الطبقة متعددة الوسائط هو ما يموّل سنة من خارطة الطريق، وخارطة الطريق هي ما يجعل جولة التمويل التالية أو عقد السحابة التالي حكاية بدلاً من جدول بيانات. كلا الأمرين حقيقي. لكن واحدًا فقط منهما هو شيء يمكنك استدعاؤه.
ما الذي يمكن استدعاؤه اليوم، وما الذي يجب أن يتغير لكي يتغير ذلك؟
لا يزال جيل Qwen 3.8 يشكل كامل الخط القابل للشراء. Qwen3.8-Max متاح عمومًا منذ 3 أغسطس 2026 بسعر 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، ثابت على كامل سياق الـ 1,000,000 رمز دون أي رسوم إضافية على المطالبات الطويلة. نُشرت أوزانه في 12 أغسطس 2026 باسم Qwen3.8-2.4T-A95B بصيغتي BF16 وFP8 بموجب ترخيص Qwen مخصص. جدول القياسات المرجعية الخاص بمورده قوي وغير مُدقَّق — Terminal-Bench 2.1 عند 86.6، وGPQA Diamond عند 92.6، وOSWorld-Verified عند 86.1، وكلها أرقام Alibaba نفسها — الصورة المستقلة أقل إطراءً من صورة المورد: يضع Artificial Analysis نموذج Qwen3.8 Max (0902) عند مؤشر ذكاء 45، أي المرتبة 24 من 212 نموذجًا، بتكلفة مقاسة قدرها 5.41 دولارات لكل مهمة من مهام مؤشر الذكاء و39.2 رمز إخراج في الثانية — المرتبة 159 من 212، قريبًا من الطرف البطيء للمجال. تسرد الصفحة نفسها نافذة السياق على أنها 984k مقابل 1,000,000 في صفحة النموذج الخاصة بنا، وهي فجوة يجدر معرفتها قبل تحديد حجم مهمة ذات سياق طويل. نتيجة من فئة الحدود، وسرعة من منتصف الحزمة: هذا هو الملخص الصادق للرائد المطروح، وهو خط الأساس الذي يجب أن يتفوق عليه أي Qwen 4.5 على كلا المحورين في وقت واحد.

يوفّر OrcaRouter عائلة Qwen 3.8 — qwen/qwen3.8-max، وqwen3.8-flash وqwen3.8-27b — عبر نقطة نهاية واحدة متوافقة مع OpenAI إلى جانب أكثر من 200 نموذج آخر، ما يعني أن إدراج فئة Qwen 4.5 سيكون تغييرًا في معرّف النموذج على مفتاح موجود، بدلًا من عقد مورد جديد وفاتورة جديدة وSDK جديد. وعند صدور أحدها، فسيظهر في ذلك الكتالوج. واليوم، لا Qwen 4.5 ولا Qwen 5 موجودان فيه، لأن كليهما لم يُطرح بعد — ولا تغيّر كثرة بيانات خارطة الطريق الصحفية من ذلك شيئًا.
الاستخدام العملي لخريطة طريق كهذه هو عكس خطة الهجرة تمامًا. إذا بدا في نهاية المطاف أن فئة Qwen 4.5 معقولة لعبء عملك، فإن الطريقة الأقل تكلفة لمعرفة ذلك هي توجيه شريحة من حركة المرور الحقيقية إليه خلف احتياطي تلقائي، بحيث لا يكلفك نموذج يتبين أنه بطيء أو مكلف أو أسوأ من النموذج القائم سوى نسبة مئوية من عبء عمل واحد بدلًا من ربع. وهذا هو الغرض من التبديل عند الفشل، والنموذج الطليعي غير المُثبت الذي لا يزيد عمره عن أيام هو أوضح حالة لاستخدامه.
ما يجب متابعته، وما لا ينبغي تصديقه بعد
يتحوّل بند في خارطة الطريق إلى إصدار عندما تظهر مجموعة صغيرة من الأمور الملموسة. بطاقة نموذج تحمل إجمالي عدد المعاملات، وعدد المعاملات النشطة، ونافذة السياق. معرّف API يمكنك تمريره في طلب. الأوزان على منصة نماذج. إدخال في لوحة صدارة مستقلة مصحوب بتاريخ. سعر. أي واحد من هذه إشارة؛ ومعظمها معًا إطلاق.
أشياء ليست إصدارًا، مهما بدت تقنية: ذكر في مؤتمر؛ طلب دمج من إطار عمل للتقديم يضيف فرعًا معماريًا لبناء Qwen تجريبي، وهو عمل على المحرك في مكدس استدلال شخص ما لا نموذج يمكنك استدعاؤه؛ معرّف لقطة مؤرّخ لجيل سبق أن صدر؛ ومنشور اجتماعي يعيد صياغة تعليق قيل على المسرح. الإشارة التي أنتجت هذا المقال كانت الأخيرة من هذه، وسبب استحقاقه للكتابة عنه هو أن الادعاء الأساسي قابل للتحقق مقابل البيان الصحفي الخاص بـ Alibaba نفسه — وهو مصدر نطاق الـ5 إلى 10 تريليونات، ووضع Qwen 4، وأرقام RSI جميعها. الإشارة أشارت إلى القصة؛ لكنها ليست القصة.
السؤال على المدى القريب أضيق مما توحي به العناوين. قال Alibaba إن Qwen 4 قيد التدريب، وهو ما يضع Qwen 4 قبل كل من 4.5 و5 في التسلسل — لذا فالشيء التالي الجدير بالمراقبة ليس نموذجًا بعشرة تريليونات معامل، بل ما إذا كان Qwen 4 سيصدر مصحوبًا ببطاقة نموذج وسعر ونقطة نهاية، ومتى. وإلى أن يتحقق شيء في تلك السلسلة، فإن الموقف الصادق بشأن نطاق الـ5 إلى الـ10 تريليونات هو أنه اتجاه سير، جرى الإفصاح عنه في السجل، بلا مواصفات مرفقة به وبلا تاريخ. خطط لـ Qwen3.8-Max، وراقب نطاق 4.5 و5 كأطروحة توسّع لا كمنتج، وتعامل مع كل عدد معاملات تراه لنموذج بلا بطاقة نموذج على أنه توقع.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
