
Qwen3.8-Flash-Next: Alibaba تستعرض بنية Qwen4 قبل وجود Qwen4
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianجديدQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenجديدQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekجديدDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokجديدSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
- openaiOpenAI: GPT-5.6 Terra2026-07-0957الذكاء77البرمجة
- openaiOpenAI: GPT-5.6 Sol2026-07-0961الذكاء77البرمجة
توشك شركة Alibaba على نشر بنية Qwen4 قبل نشرها لنموذج Qwen4. من المقرر أن يُطرح Qwen3.8-Flash-Next — وهو نموذج مفتوح الأوزان، متعدد الوسائط، قائم على خليط من الخبراء (MoE)، مبني على البنية من الجيل التالي التي ستدعم عائلة Qwen4 — للعموم على ModelScope في الساعة 23:00 بتوقيت بكين يوم 26 أغسطس 2026. تصوغ Alibaba هذا الإصدار كمعاينة تقنية: يحصل المطورون على البنية مبكرًا، بينما تأتي عائلة Qwen4 الكاملة لاحقًا. حتى لحظة كتابة هذا المقال، لم يتم تأكيد عدد المعاملات والترخيص والسعر، لذا فهذا تقرير بما نعرفه حتى الآن — وكل تفصيل أدناه مُصنَّف حسب مدى ثباته.
إذا لم تكن تتابع إيقاع أعمال Alibaba هذا الشهر، فالمحور هو Qwen3.8-Max — النموذج الرئيسي الذي يضم 2.4 تريليون معامل، والذي صدر في 3 أغسطس/آب وتمت مفتوحته باسم Qwen3.8-2.4T-A95B بعد أقل من أسبوعين. ثم يصل Qwen3.8-Flash-Next بعد أقل من شهر من ذلك. نفس المختبر الذي أطلق نموذجًا مفتوح الأوزان بمعاملات تبلغ 2.4 تريليون، يقدّم الآن البنية المعمارية للجيل التالي، قبل حتى تسمية النموذج الرئيسي لذلك الجيل.
ما الذي تم الإعلان عنه؟
وصلت الإشارة إلى الساحة عبر القنوات المعتادة. أصبحت صفحة تشويقية من ModelScope لـ Qwen3.8-Flash-Next متاحة في 25 أغسطس، وتحمل شارة "إصدار مفتوح قادم"، والشعار "إلى الجيل التالي — بسرعة البرق"، ومؤقت إصدار مضبوط على 2026-08-26 23:00 (UTC+08:00). نشر فريق Qwen من Alibaba على منصة X في اليوم نفسه: "موجة Qwen القادمة آتية." المنشور الذي أوصلنا هذا الخبر، من حساب @kimmonismus على X، وصف الأمر نفسه بكلمات مختلفة قليلاً: نموذج MoE متعدد الوسائط مفتوح الأوزان على بنية الجيل التالي، مع وصول مبكر حتى يتمكن المجتمع من الاستعداد لعائلة Qwen4.

الجزء الذي يستحق إعادة القراءة هو تأطير علي بابا نفسه. يُوصف النموذج بأنه مبني على البنية الجيلية التالية "التي ستُشغّل عائلة Qwen4 القادمة" — وليس صراحةً على أنه Qwen4 نفسه. السبب المعلن من علي بابا هو أن التغييرات المعمارية يجب أن تكون في أيدي المجتمع قبل وصول العائلة، بحيث تكون بيئات التشغيل وأدوات التكميم والتطبيقات جاهزة عند إصدار المنتج الفعلي. هذا موقف تسويقي، لكنه أيضاً التزام تقني: اعرض الجزء الصعب أولاً، وخذ المجتمع معك في الرحلة.
ما هو مؤكد اليوم، وما هو غير مؤكد:
• مؤكد، وفقًا للتشويق وبيان Qwen: Qwen3.8-Flash-Next هو نموذج مفتوح الأوزان، متعدد الوسائط، ومن طراز MoE مبني على بنية Qwen4.
• مؤكد، وفقًا لبيان Qwen: يقدّم تغييرين معماريين بارزين — بنية GDN الهجينة وQwen Sparse Attention (QSA).
• تم التأكيد، وفقًا للإعلان التشويقي: موعد الإصدار، 2026-08-26 23:00 (UTC+08:00)، على ModelScope.
• غير مؤكد: المعاملات الإجمالية أو النشطة، شروط الترخيص، طول السياق، توفر واجهة برمجة التطبيقات أو التسعير، وكل نتيجة من نتائج المعايير. لا يوجد تقييم مستقل بعد لأن الأوزان لم تُنشر بعد.

ما هي بنية Qwen4 في الواقع؟
تحمل القصة آليتان. الأولى، GDN — Gated Delta Network — هي طبقة الانتباه الخطي من Alibaba. بينما يحتفظ المحوّل القياسي بذاكرة تخزين مؤقتة للمفاتيح والقيم تنمو مع طول التسلسل، تحافظ طبقة GDN على حالة متكررة ثابتة الحجم وتحدّثها بقاعدة بوّابة مُتعلَّمة؛ وتمتد السلالة عبر DeltaNet وMamba-2. الثمرة هي ما كان يشغّل خط Qwen بهدوء منذ Qwen3-Next: تبقى السياقات الطويلة منخفضة التكلفة لأن الحالة لا تنمو، بينما تبقى أقلية من طبقات الانتباه الكامل في المزيج لتؤدي الاسترجاع الدقيق الذي لا يجيده الانتباه الخطي. في الجيل الحالي، يعمل هذا المزيج بنحو ثلاث طبقات GDN مقابل كل طبقة انتباه كامل — إذ يُحصي التحليل المجتمعي لنقطة التحقق Qwen3.8-2.4T-A95B وجود 69 طبقة GDN مقابل 23 طبقة انتباه. ويوصف Qwen3.8-Flash-Next بأنه "بنية GDN الهجينة" على هذا النسب تمامًا.
الثاني، QSA — Qwen Sparse Attention — هو العنصر الجديد فعلًا، ولا يوجد وصف تقني عام له بعد: فقط الاسم، وتقديمه بوصفه أحد التغييرين البارزين في المعاينة. هذا الغياب للتفاصيل بحد ذاته جزء من النمط. معاينة Qwen3-Next في أواخر 2025 قدّمت Gated DeltaNet مع الندرة ذاتها في التوثيق، ولم تُحدَّد البنية بالكامل إلا بعد أن تبنّتها سلسلة Qwen3.5. الخلاصة العملية للقارئ هي نفسها في المرتين: الكناري المعماري يظهر أولًا، ويأتي التوثيق ونماذج الإنتاج بعده.
خطة اللعب التي نجحت بالفعل مرة واحدة
لقد نفذت Alibaba هذه الخطة نفسها من قبل، وقد نجحت. في أواخر عام 2025، كشفت Qwen3-Next عن Gated DeltaNet ومزيج من الانتباه الخطي والكامل. عندما صدرت سلسلة Qwen3.5، اعتمدت هذا المخطط على نطاق واسع — وقد استمر هذا المزيج عبر جيل Qwen3.8 منذ ذلك الحين، بما في ذلك الرائد 2.4T. السبب في أهمية هذه السابقة هنا هو التوقيت الذي تنطوي عليه. ينبغي توقع عائلة Qwen4 الكاملة في الجانب البعيد من هذه المعاينة، وليس داخلها؛ إذا كانت الفجوة في Qwen3-Next أي دليل، فإن المسافة بين "هنا البنية" و"هنا العائلة" تقاس بالأشهر. لا شيء في الإعلان التشويقي يؤكد ذلك — إنه استنتاج من نمط نفذته Alibaba الآن مرتين.
ما زلنا لا نعرفه
المجهولات هي جوهر المعاينة، وهي حقيقية:
• المعلمات. لا يكشف التشويق عن أيٍّ منها. تشير تكهنات المجتمع على X وReddit — بدون أي دعم رسمي — إلى تهيئة بإجمالي يبلغ نحو 125 مليار معلم، منها 6 مليارات نشطة، مع جدول بحث ضخم لتضمينات n-gram. تعامل مع ذلك كإشاعة.
• طبقة "Flash". في جيل Qwen3.5، كان Qwen3.5-Flash المتاح سحابيًا فقط نسخة محسّنة من النموذج مفتوح الأوزان Qwen3.5-35B-A3B. من غير المعروف ما إذا كان Qwen3.8-Flash-Next هو النظير مفتوح الأوزان لنموذج Qwen3.8 بحجم مماثل؛ فقد يكون نموذجًا من فئة 125B-A6B بدلاً من ذلك. كلا القراءتين مجرد تخمين.
• الترخيص. إصدارات Alibaba الأخيرة من Qwen تتراوح بين ترخيص Apache-2.0 (Qwen3.8-27B) وترخيص Qwen3.8-Max المقيد بالإيرادات. ويحدد موقع Flash-Next في هذا الطيف ما إذا كان يمكن استخدامه تجاريًا، وفي أي نطاق.
• المعايير. يسلط بيان Qwen الضوء على البرمجة الوكيلة، والمهام طويلة الأمد، والذكاء متعدد الوسائط، ولكن لا توجد أرقام مرفقة ولا يوجد تقييم مستقل حتى يتم إصدار الأوزان.
عائلة تعمل بدورة زمنية مدتها أسبوعان
الإيقاع الزمني المحيط هو قصة بحد ذاتها. صدر نموذج Qwen3.8-Max، الطراز الرائد الذي يضم 2.4 تريليون معامل، في 3 أغسطس؛ تلاه الإصدار مفتوح الأوزان Qwen3.8-2.4T-A95B في الفترة من 12 إلى 13 أغسطس؛ ثم وصل الإصدار المجاني Qwen3.8-27B بترخيص Apache-2.0 بعد أيام قليلة؛ والآن، قبل نهاية الشهر، يتم استعراض بنية الجيل القادم. لا يوجد مختبر آخر يكرر هذه الوتيرة حاليًا. بالنسبة للقارئ الذي يختار النماذج، فإن النتيجة العملية هي أن "أفضل Qwen" هدف متحرك — والفجوة بين الأجيال تصل أسرع مما يتكيف معه النظام البيئي المحيط عادةً. شراء قرار بدلاً من نموذج أصبح الخيار الأكثر جدوى من الناحية الدفاعية.
ماذا يجب على المطوّر فعله الآن
خطط للبنية، وليس فقط للنموذج. ستكون Qwen3.8-Flash-Next نسخة معاينة غير مثبتة في اليوم الأول: لا معايير مستقلة، والنظام البيئي لوقت التشغيل ما زال يلحق بالركب، ولا توجد سوى ادعاءات البائع بشأن القدرات الوكيلية وطويلة الأفق التي تهم أعباء العمل التي ستستخدمها. الطريقة الآمنة لتقييمها ليست ربطها بمسار إنتاج — بل توجيه نسخة منخفضة المخاطر من أحد أعباء العمل إليها، ومقارنة المخرجات بالنموذج الحالي، والسماح للتبديل الاحتياطي التلقائي باستيعاب اللحظات التي يسيء فيها المزود الذي يقدم نموذجًا مفتوح الأوزان جديدًا التصرف. على OrcaRouter، تكون هذه هي نفس نقطة النهاية ونفس المفتاح الذي تستخدمه بالفعل: يقع Qwen3.8-Flash-Next ونموذجك الحالي خلف واجهة برمجة تطبيقات واحدة، ويمكن للغة توجيه DSL إجراء اختبار أ/ب بين المعاينة والنموذج الحالي باستخدام نفس الطلب قبل الالتزام بأي شيء.
التسعير، عندما يكون موجودًا، يجب أن يُقرأ بنفس الطريقة. لم تعلن Alibaba عن سعر API لـ Flash-Next، والأوزان غير المطروحة غير قابلة للتوجيه في أي مكان. عندما يكشف مزودٌ عنه، يمرر OrcaRouter سعر قائمة المزود مباشرةً بهامش ربح 0% — لذا فإن أي رقم ستظهر به Alibaba سيظهر دون تغيير في اليوم نفسه. أقرب خط أساس يمكنك استدعاؤه فعليًا اليوم هو Qwen3.8-Max (qwen/qwen3.8-max)، وهو الرائد الذي ستستقر هذه البنية تحته في النهاية: نافذة سياق تبلغ 1,000,000 رمز، بسعر $2.00 لكل مليون رمز إدخال و$6.00 لكل مليون رمز إخراج، وتُمرَّر هذه الأسعار بسعر القائمة. احتفظ بهذا الرقم في ذهنك عندما ينخفض سعر Flash-Next؛ فهو التكلفة التي يجب على الجيل القادم أن يقلّ عنها.

ماذا تشاهد عند الإطلاق
أربعة أمور تهم في اللحظة التي ينفد فيها مؤقت الإصدار:
• عدد المعاملات ومستوى المعاملات النشطة — سواء كان هذا هو النموذج من فئة 125B-A6B الذي تصفه الشائعات أو إصدارًا أصغر.
• الترخيص — متساهل مثل Qwen3.8-27B، أو مقيد مثل ترخيص Max.
• ما إذا كانت التقييمات المستقلة الأولى تُعيد إنتاج ادعاءات البائع بشأن الترميز الوكيلي والمهام طويلة المدى — الأرقام هي ما يُوثَق به، لا السطور التسويقية.
• مدة انتظار Alibaba قبل أن تتبع عائلة Qwen4 الكاملة المعاينة.
لا شيء من ذلك يمكن معرفته من هنا. ما يمكن معرفته اليوم هو شكل القرار الذي اتخذته علي بابا: إنها تراهن على أن الجيل القادم من بنيتها يستحق أن يُمنح مجانًا قبل الإصدار الرئيسي. هذا الرهان هو القصة — والأوزان تُطرح غدًا.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
