بطاقة عنوان رئيسية للمواجهة بين Qwen3.8-27B وQwen 3.8، تعرض بطاقتي شرائح بحواف دائرية — النموذج الكثيف 27B بسياق 262K وترخيص Apache 2.0 في مواجهة نواة MoE بحجم 2.4T / 95B نشط بترخيص مخصص — مع شعار OrcaRouter في الزاوية السفلية اليمنى.
Guides & Insights

Qwen3.8-27B مقابل Qwen 3.8: الجيل ذاته، وحدة معالجة رسومات في مواجهة رفّ

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

هذا الأسبوع، وضعت Aliba​ba نموذج Qwen3.8-27B على مسار الاستدلال السريع لدى Cerebras — وهي المرة الأولى التي يحصل فيها النموذج الكثيف 27B على خيار مستضاف سريع حقًا — وأخيرًا فهرست Artificial Analysis كلا جانبي هذه المواجهة. يسجّل Qwen3.8-27B نتيجة 34 على AA Intelligence Index. أما Qwen 3.8، أي النواة المفتوحة التي يقصدها معظم الناس عندما يكتبون الاسم دون لاحقة، فيسجّل 40. هذان الرقمان يعيدان ضبط مقارنة كان على تغطية الإطلاق في أغسطس أن تعتمد بالكامل على كلام المورّد.

النموذج وراء "Qwen 3.8" كاسم مستقل هو Qwen3.8-2.4T-A95B: أوزان مزيج الخبراء البالغة 2.4 تريليون معامل التي نشرتها علي بابا بموجب ترخيص مخصص. أما Qwen3.8-27B فهو العضو الكثيف من الجيل نفسه — نحو 27 مليار معامل، Apache 2.0، بحجم مناسب لوحدة معالجة رسوميات واحدة. يتشاركان اسم العائلة، وطول السياق الأصلي البالغ 262 ألفًا، ونافذة الإطلاق. كل ما عدا ذلك عنهما دراسة في الأضداد: أحدهما يمكنك امتلاكه، والآخر لا يمكنك إلا استئجاره. إليك ما الغرض من كل منهما فعليًا الآن وقد أصبح لكل منهما أرقامه المستقلة.

الجيل نفسه، أشكال متعاكسة

Qwen3.8-27B هو نموذج كثيف — 27 مليار معامل (28 مليارًا عند احتساب مشفّر الرؤية)، و64 طبقة، ومكدّس انتباه هجين مؤلف من 48 طبقة انتباه خطي Gated DeltaNet مقابل 16 طبقة انتباه كامل. هذا الهجين هو السبب في أن نموذجًا بحجم 27 مليار يمكنه حمل 262,144 رمزًا من السياق الأصلي. Qwen3.8-2.4T-A95B هو البنية الرائدة: 2.4 تريليون معامل إجمالي، ونحو 95 مليار معامل نشط لكل رمز، و92 طبقة مع 512 خبيرًا لكل طبقة، و69 من هذه الـ92 طبقة تعمل بالانتباه الخطي. الحيلة ذاتها، ببصمة أكبر تسعين مرة.

• البنية — Qwen3.8-27B: كثيف بحجم 27B، كل رمز يفعّل كامل النموذج. Qwen3.8-2.4T-A95B: إجمالي 2.4T / ~95B نشط MoE.

• السياق — كلاهما 262K أصلي؛ امتداد 1M الخاص بـ27B متاح عبر الاستضافة فقط، بينما يصل 2.4T إلى نحو 984K وفق القياس.

• المُدخلات — Qwen3.8-27B: نص وصورة وفيديو. Qwen3.8-2.4T-A95B: نص فقط، مع تثبيت التفكير في وضع التشغيل.

• الترخيص — Qwen3.8-27B: Apache 2.0. Qwen3.8-2.4T-A95B: ترخيص Qwen3.8-Max المخصص.

• الأوزان — Qwen3.8-27B: 55.6GB بصيغة BF16، تُكمَّم إلى إصدار Q4 بحجم ‎~16GB. Qwen3.8-2.4T-A95B: ‎~2.4TB بصيغة BF16، أي رفّ وحدات معالجة رسومية، وليس حاسوبًا مكتبيًا.

• أين تجدهما — Qwen3.8-27B: استضافة ذاتية أو استئجار رخيص. Qwen3.8-2.4T-A95B: استئجار، لأن لا أحد عاقلًا يمتلك رفّ الخوادم.

أرقام مستقلة، أخيرًا

حمل كل مقال مقارنة صدر في أغسطس عن Qwen3.8-27B نفس التحفّظ: «لا توجد درجات مستقلة بعد». لم يعد ذلك صحيحًا. فقد أصبحت Artificial Analysis تمتلك قياسات لكلا النموذجين اعتبارًا من هذا الأسبوع، وشكل البيانات مثير للاهتمام حقًا.

في مؤشر الذكاء، يسجّل Qwen3.8-2.4T-A95B 40 نقطة، ويحتل المرتبة الرابعة من أصل 113 في فئته. ويسجّل Qwen3.8-27B 34 نقطة — ما يجعله الأول بين 140 نموذجًا في فئة الحجم 4–40B ذات الأوزان المفتوحة، وهو أداء قوي بحق لنموذج كثيف بحجم 27B. كِلاهما بطيئان وفق قياس مستقل: 39.0 رمز إخراج في الثانية للطراز 27B و38.1 للطراز 2.4T، مقابل وسيط فئة يبلغ نحو 90. كِلاهما يتسمان بالإسهاب، إذ يولّد الطراز 27B نحو 200M رمز إخراج خلال جولات المؤشر، مقابل وسيط فئة يبلغ 68M. لا يُعد أي منهما نموذجًا حدوديًا بارزًا؛ كِلاهما نموذجان كادحان، ويقول المؤشر إن الطراز 2.4T هو النموذج الكادح الأقوى بفارق واضح.

A three-lane infographic titled 'Qwen3.8-27B — three ways to rent it': self-hosted lane on OrcaRouter at $0.33/$2.40 per 1M tokens with 262K context, vendor lane on Qwen Cloud at $0.50/$3.00 with 1M context and a 90% cache discount, and the fast lane on Cerebras PayGo at $0.99/$1.49 with rapid inference, plus the OrcaRouter logo in the bottom-right corner.

الأسعار على الجانب المستقل تحكي القصة نفسها بالدولار. تسعّر Artificial Analysis نموذج 27B عند 0.50 دولار لكل مليون إدخال و3.00 دولارات لكل مليون إخراج على النسخة المستضافة من Qwen Cloud (خصم ذاكرة مؤقتة بنسبة 90%)، ونموذج 2.4T عند 2.00 / 6.00 دولارات (خصم ذاكرة مؤقتة بنسبة 88%). التكلفة لكل مهمة في Intelligence Index: 0.82 دولار لنموذج 27B مقابل 2.16 دولار لنموذج 2.4T. النموذج الأصغر أرخص تشغيلًا لكل وحدة ذكاء — وكلاهما مكلفان بالنسبة إلى فئة سرعتهما لأن كليهما نموذجان استدلاليان يستهلكان بكثافة رموز الإخراج.

كل ما عدا ذلك — SWE-bench Pro 61.7، وDeepSWE 1.1 42.2، وLiveCodeBench v6 90.3 لطراز 27B؛ و86.6 Terminal-Bench 2.1 و67.7 SWE-bench Pro الخاصة بالطراز 2.4T — يظل مُبلَّغًا عنه من المورّد، وغير مُعاد إنتاجه، ومُوسومًا بذلك في جميع أنحاء هذا المقال. تُعدّ مؤشرات AA أعلاه الأرضية المستقلة التي يقع تحتها كل ذلك.

ما الذي يغيّره إدراج Cerebras

في 12 سبتمبر 2026، أعلن حساب Qwen أن Qwen3.8-27B يعمل الآن على Cerebras، مع إدراجه المباشر في الكتالوج تحت لافتة "Qwen 3.8 27B is now available on Cerebras PayGo". وتُدرجه Cerebras بسعر 0.99 دولار لكل مليون رمز إدخال و1.49 دولار لكل مليون رمز إخراج على أجهزة من فئة WSE التي جعلت الشركة مشهورة بالسرعة. وهذا يمنح النموذج 27B شيئًا لم يمتلكه النواة 2.4T قط: مسارًا سريعًا.

A comparison scoreboard titled 'Qwen3.8-27B vs Qwen 3.8 — the matchup': the 27B shows 27B dense architecture, 262K native context, text/image/video input, Apache 2.0, AA Intelligence 34, and $0.33/$2.40 per 1M tokens; the 2.4T core shows 2.4T / 95B-active MoE, 984K measured context, text-only input, the Qwen3.8-Max custom license, AA Intelligence 40, and $2.00/$6.00 per 1M tokens, with a footer labeling the 27B price as the OrcaRouter self-hosted rate, the 2.4T price as the Qwen3.8-Max API rate, and the AA figures as of September 2026, plus the OrcaRouter logo in the bottom-right corner.

هذا مهم لأن البطء والإسهاب كانا المأخذ الحقيقي الوحيد على 27B منذ اليوم الأول. على منصة الاختبار المستقلة يسجّل 39 t/s؛ وعلى بيانات القياس التشغيلية الخاصة بخدمتنا كان يقدّم ~154 رمز إخراج في الثانية مع زمن وصول أول رمز عند الوسيط p50 قدره 4.48s — والآن هناك مزوّد ثانٍ ينافس على المحور نفسه. أما 2.4T، في المقابل، فليس لديه مسار سريع على الإطلاق: عند 38 t/s فأنت تدفع أسعار الطليعة مقابل سرعة ضمن الوسط، والسبيل الوحيد للالتفاف على ذلك هو استئجار عنقود GPU وتشغيل الأوزان المفتوحة بنفسك.

ثلاثة مسارات لـ 27B، ومسار واحد لـ 2.4T

اعتبارًا من اليوم، يمكن استئجار dense 27B بثلاث طرق، ويستحق تفاوت الأسعار القراءة قبل أن تختار:

• مسار الاستضافة الذاتية — Qwen3.8-27B متاح الآن على OrcaRouter بسعر $0.33 / $2.40 لكل مليون رمز، ويعمل على بنيتنا التحتية الخاصة. أرخص سعر إدخال في السوق له، بمخرجات تبلغ ~154 tok/s وسياق 262K.

• مسار المورّد — الإصدار المستضاف من Qwen Cloud، بسعر 0.50 دولار / 3.00 دولار لكل مليون، مع سياق يبلغ مليون توكن وخصم بنسبة 90% على التخزين المؤقت.

• المسار السريع — Cerebras PayGo، 0.99 / 1.49 دولار لكل مليون، مع التركيز على السرعة بدلًا من السعر.

A screenshot of the OrcaRouter model page for Qwen3.8 27B (captured September 12, 2026) showing the input price of $0.33 per 1M tokens, output price of $2.40 per 1M tokens, a 262K token context window, text/image/video input support, and a p50 first-token latency of 4.48 seconds.

لا يوجد للنواة المفتوحة 2.4T فارق سعري مكافئ. واجهة API الرائدة التي تخدم البنية نفسها — Qwen3.8-Max — سعرها $2.00 / $6.00 لكل مليون، وهذا هو الرقم الذي يبقى ثابتًا سواء أسميته Max أو النواة المفتوحة. وإذا شغّلت الأوزان بدلًا من ذلك، تنقلب المعادلة الاقتصادية إلى العتاد: يحتاج 2.4T إلى نحو 2.4TB من أوزان BF16 وإلى عقدة متعددة وحدات GPU، وهو قرار رأسمالي لا يتخذه أحد باستخفاف. وتشغّل وحدة GPU بسعة 24GB نسخة Q4 للنموذج 27B بتكلفة حدية تُقرّب إلى الصفر.

المثال العملي الذي يحسم الأمر لدى معظم الفرق: 100M من توكنات الإدخال و20M من توكنات الإخراج يوميًا. بمعدل $2/$6 الخاص بـ 2.4T، يبلغ ذلك نحو $320 يوميًا، أي ~$117,000 سنويًا. أما على 27B بمعدلنا البالغ $0.33/$2.40، فيبلغ نحو $81 يوميًا — وعلى النسخة المستضافة ذاتيًا فهو ثمن الكهرباء. يمنحك 2.4T ميزة جودة حقيقية، AA 40 مقابل 34. وما إذا كانت هذه الميزة تستحق فاتورة شهرية بخمسة أرقام هو السؤال بأكمله الذي يطرحه هذا الاقتران.

حيث يتباينون بحق

بعد الفهرس، تحدد ثلاثة فروق عملية أيّ واحد يناسب عبء عمل معيّن.

الإدخال متعدد الوسائط هو المرشّح الأنقى. يقرأ Qwen3.8-27B النصوص والصور والفيديو — لقطات الشاشة، والمخططات، والمستندات التي تحتوي على أشكال، وإطارات الفيديو، وكلها تدخل في نافذة 262K نفسها. أما Qwen3.8-2.4T-A95B فهو نصّي فقط بشكل صارم. إذا تضمّن إدخالك أي شيء بصري، فإن 2.4T يُستبعد بغض النظر عن مؤشره الأعلى.

التحكم في التفكير يأتي ثانياً. يمكن إيقاف وضع الاستدلال لدى نموذج 27B لكل طلب، وهذا مهم للاستخراج الحساس لزمن الاستجابة حيث تكون سلسلة التفكير مجرد عبء إضافي؛ كما أنه يكشف عن reasoning_effort. لا تستطيع نواة 2.4T إيقاف التفكير — فكل استجابة تبدأ بكتلة think>، وتدفع ثمن تلك الرموز سواء أردتها أم لا. تعالج واجهة API الرائدة هذه المشكلة، لكن النواة المفتوحة لا تفعل.

الترخيص هو الثالث، وله أهمية تظهر بهدوء عند التوسع. إن Apache 2.0 على نموذج 27B هو المعيار المتساهل: التعديل، وإعادة التوزيع، والاستخدام التجاري، مع تضمين منح براءات الاختراع. أما 2.4T فيُطرح بموجب ترخيص Qwen3.8-Max مخصص — متساهل من حيث الروح، لكنه شروط Alibaba، وليس معيارًا مجتمعيًا، ويستحق قراءة الملف قبل بناء منتج عليه.

توجيه القرار

يمكن الوصول إلى طرفي هذه المواجهة عبر مفتاح OrcaRouter واحد، وهذا ما يجعل سؤال "أيّهما أختار" رخيصًا للإجابة عنه تجريبيًا. Qwen3.8-27B متاح الآن باسم qwen/qwen3.8-27b بسعر قائمة المزوّد دون أي هامش ربح، وواجهة API الرائدة المبنية على النواة نفسها بسعة 2.4T متاحة الآن باسم qwen/qwen3.8-max بسعر $2.00 / $6.00 لكل مليون — سعر Alibaba نفسه، يُمرَّر مباشرةً، لذا أي تغيير في سعر البائع يكون مباشرًا هنا في اليوم نفسه.

تلك البنية نفسها بسعة 2.4T كأوزان قابلة للتنزيل ليست شيئًا نقدّمه — إذا أردت النواة المفتوحة عبر واجهة برمجة تطبيقات اليوم، فإن المسار الرائد هو الطريقة العملية للوصول إليها، وqwen/qwen3.8 مُهيأ مسبقًا للتفعيل في اللحظة التي يقدّم فيها مزوّد ما الأوزان المفتوحة. قاعدة توجيه ترسل حركة المرور البصرية والحساسة لزمن الاستجابة إلى qwen/qwen3.8-27b والذيل الصعب في الاستدلال إلى qwen/qwen3.8-max لا تكلّف شيئًا لإعدادها وتنتقل تلقائيًا إلى مزوّد بديل عند التعطل. مفتاح واحد، بلا عقد ثانٍ، والانقسام تغيير في الإعدادات وليس إعادة هندسة معمارية — أرخص طريقة لاختبار ما إذا كانت النقاط الست الإضافية في مؤشر 2.4T تستحق 5.67 دولار لكل مليون رمز إخراج بالنسبة لك.

من الذي يجب أن يختار ماذا

• اختر Qwen3.8-27B إذا كان مُدخلك يتضمن صورًا أو فيديو، أو إذا كنت تريد خاصية التفكير مع إمكانية إيقاف تشغيلها، أو إذا كنت تملك وحدة معالجة رسومات بسعة 24GB أو تخطط لامتلاك واحدة، أو إذا كان إنفاقك لكل رمز (token) ضخمًا بما يكفي بحيث يصبح الفرق بين $0.33/$2.40 و$2.00/$6.00 هو الحجة الكاملة.

• اختر Qwen 3.8 (النواة 2.4T) إذا كنت تتعامل مع النصوص فقط، وتريد أقوى رقم استدلال مستقل في العائلة (AA 40)، وكان معدل $2/$6 — أو تكلفة تشغيل عقدة GPU — ضمن ميزانيتك بأريحية.

• اختر كليهما إذا كانت حركة الاستخدام لديك تشمل الملفين: مرّر المسار عبر البوابة، ودع الموجّه يقسّمه حسب الوسائط والصعوبة، وغيّر رأيك عندما تصدر نقطة التحقق التالية لأي من النموذجين أو يصل سعر أي منهما.

الحكم

كان اسم Qwen 3.8 دائمًا منتجين يتظاهران بأنهما عائلة واحدة، والآن أصبح لكل منهما أرقام مستقلة للجدال حولها. Qwen3.8-2.4T-A95B هو العقل الأقوى، نصي فقط، مكلف، ومربح بلا جدال عند $2/$6. أما Qwen3.8-27B فهو القابل للنشر — متعدد الوسائط، Apache 2.0، قابل للاستضافة الذاتية، واعتبارًا من هذا الأسبوع أصبح لديه أخيرًا مسار سريع أيضًا. فجوة المؤشر حقيقية: 40 مقابل 34. وكذلك فجوة السعر: نحو خمسة أضعاف تكلفة التوكن الواحد عندما تشغّل 2.4T كواجهة API. بالنسبة لمعظم الفرق، لا يتعلق القرار بنقاط المؤشر الست. بل يتعلق بما إذا كنت تشتري توكنات أم تشتري عتادًا — و27B هو الوحيد من بين الاثنين الذي يتيح لك شراء العتاد.