تم إنشاء بطاقة عنوان لـ Step 5 Preview مقابل Qwen 3.8 Max Prime تقرأ «نقطة مؤشر واحدة، أربعة دولارات وثمانية وثلاثون سنتًا»، مع ثلاث بطاقات إحصائية: مؤشر الذكاء Artificial Analysis 44 مقابل 45، وتكلفة كل مهمة مؤشر 1.03 دولار مقابل 5.41 دولار، وسعر الإخراج 2.70 دولار مقابل 9.902 دولار لكل مليون رمز. يقع شعار OrcaRouter في شريط أبيض أسفل اليمين.
Guides & Insights

معاينة الخطوة 5 مقابل Qwen 3.8 Max Prime: نقطة مؤشر واحدة، وأربعة دولارات وثمانية وثلاثون سنتًا

الكاتب

Rowan Sterling

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

ابدأ بالأمر الذي لن يخبرك به مربع البحث. Qwen 3.8 Max Prime ليس نموذجًا. إنه مسار تقديم — نفس Qwen3.8-Max، الأوزان التي أخذتها الشركة إلى التوافر العام في 3 أغسطس 2026، وتُباع تحت معرّف نموذج ثانٍ بضعف بطاقة الأسعار الدولية بالضبط. Step 5 Preview، الرائد المغلق لدى StepFun، فتح واجهة API الخاصة به في 20 سبتمبر 2026 وهو نموذج بالمعنى العادي: نقطة نهاية واحدة، سعر واحد، مجموعة أوزان واحدة لا يمكنك حيازتها. لذا فإن النسخة الصادقة من هذه المواجهة تضع نموذجًا مُقاسًا مقابل طبقة غير مُقاسة، والحساب الذي ينتج عن ذلك أكثر مباشرة مما قد يضعه أي من المورّدين على شريحة عرض. على مؤشر Artificial Analysis Intelligence Index المستقل يفصلهما نقطة واحدة، 44 مقابل 45، وفيما يتعلق بما تكلفه مهمة مكتملة يفصلهما 1.03 دولار مقابل 5.41 دولار. نقطة واحدة، وأربعة دولارات وثمانية وثلاثين سنتًا، لكل مهمة — وذلك قبل أن تشتري أيًا من السرعة التي يتقاضى Prime مقابلها فعليًا.

ما يلي هو تفكيك لذلك الرقم: من أين يأتي، ولماذا يكون Qwen ID القياسي بالفعل هو النصف الأغلى في المقارنة قبل أن يضاعف Prime أي شيء، وما الذي تشتريه الأربعة دولارات الإضافية لكل مهمة وما لا تشتريه.

الاسم يؤدي عملًا لا يؤديه المنتج

أعلنت Alibaba عن Prime — 优速模式، الوضع السريع — في مؤتمر Yunqi Conference في 22 سبتمبر 2026، ونشرته كصفّ في قائمة أسعار Model Studio. وتوضّح وثائق Alibaba نفسها بلا لبس ما الذي يتغيّر: ترتفع سرعة الإخراج إلى 1.5 إلى 2 مرة مقارنةً بواجهة API القياسية، وكما تقول الشركة المورّدة، فإن القدرات وقيود الاستخدام مطابقة للنموذج الأصلي. لا عدد معلمات جديد، ولا عقد نقطة نهاية جديد، ولا قدرة يفتقر إليها المعرّف القياسي. ما عليك سوى تغيير اسم النموذج في جسم الطلب لتكون في المسار السريع.

Generated two-column comparison scoreboard for Step 5 Preview and Qwen 3.8 Max Prime across six shared rows: what the name refers to, 'a model' against 'a serving lane for Qwen3.8-Max'; Artificial Analysis Intelligence Index 44 against 45, measured on the standard Qwen ID with no Prime row; cost per index task $1.03 against $5.41; output price $2.70 against $9.902 per million tokens; output speed 87 against 35.4 tokens per second, again measured on the standard ID; and weights, 'proprietary, BF16 checkpoint promised 15 October' against 'proprietary, none'. A footer reads that index, speed and cost-per-task figures are per Artificial Analysis and were measured on the standard Qwen3.8-Max ID rather than on Prime, and that rate cards are Alibaba's international list price and StepFun's own. The OrcaRouter logo sits in a white strip at the bottom right.

هذا يجعل مصطلح البحث فخًا. من يبحث عن نموذج Qwen رائد أحدث من Qwen3.8-Max يجد "Prime" ويقرؤه كرقم إصدار. لكنه سعر. وكل ما يوحي به الاسم حول القدرات يوفره Qwen3.8-Max نفسه: نموذج خليط خبراء متناثر بمعاملات تبلغ 2.4 تريليون، مع نحو 95 مليار معامل نشط لكل رمز، و512 خبيرًا في كل طبقة، وسياق من 983,616 رمزًا في التهيئة التي اختبرها المجلس المستقل.

لا يعاني Step 5 Preview من الغموض المماثل، بل يواجه المشكلة المعاكسة. تُدرج StepFun مواصفاته عند نحو 600 مليار معامل إجمالي مع 27 مليارًا نشطة، وإدخال نصي وصوري وفيديو، ونافذة سياق تبلغ مليون توكن، وسقف إخراج موثّق يبلغ 64,000 توكن، مع إمكانية اختيار جهد الاستدلال بين منخفض أو متوسط أو مرتفع. وهو نموذج مملوك. وقد وُعِد بنقطة تحقق BF16 في 15 أكتوبر 2026 ولم تُطرح بعد؛ وقد تداولت نسخ مرآة مجتمعية لبناء BF16 على Hugging Face منذ اليوم الذي أُتيح فيه الـ API، لكن عمليات إعادة الرفع ليست إصدارًا، ولم تنشر StepFun أي إعلان عن أوزان مفتوحة.

إذن، الثنائي غير متكافئ حقًا قبل أن يصدر أي اختبار أداء واحد: نموذجٌ معروض تجريبيًا قد يصبح متاحًا للتنزيل، في مقابل طبقة خدمة أُعيد تسعيرها لنموذجٍ لن يصبح كذلك.

ما تكلفة نقطة مؤشر واحدة

تم تشغيل كلا النموذجين بواسطة المُقيِّم المستقل نفسه، وهنا تصبح المقارنة غير مريحة بالنسبة لفكرة انخفاض التكلفة لكل رمز. تابع القراءة في 10 أكتوبر 2026:

• المؤشر — Step 5 Preview 44، أعلى بكثير من وسيط النماذج المماثلة البالغ 26. Qwen3.8-Max على إصدار 0902، 45. نقطة واحدة.

• تكلفة كل مهمة فهرسة مكتملة — 1.03 دولار مقابل 5.41 دولار. أفضل بأكثر من خمسة أضعاف.

• سعر الإخراج — 2.70 دولار مقابل 6.00 دولارات لكل مليون توكن على المعرّف القياسي، والذي يصبح 9.902 دولار بمجرد الانتقال إلى Prime. إن Step 5 Preview أرخص بمقدار 2.2 مرة من المعيار و3.7 مرة من Prime.

• سعر الإدخال — $1.00 مقابل $2.00 القياسي و$3.301 على Prime. الصورة المعكوسة لعمود الإخراج، وهي التي تهم أكثر بمجرد أن تقرأ تفصيل التكلفة أدناه.

• إصابة الذاكرة المؤقتة — 0.10 دولار لكل مليون رمز على Step 5 Preview، بخصم 90 بالمئة؛ و0.25 دولار على Qwen3.8-Max، بخصم 87.5 بالمئة تقرّبه صفحة المورّد نفسها إلى 88 بالمئة.

• رموز الإخراج لكل — 87 مقابل 35.4. هنا Qwen هو البطيء، وبمعامل يقارب اثنين ونصف.

تتعارض أعمدة التكلفة لكل توكن مع عمود التكلفة لكل مهمة، وعمود التكلفة لكل مهمة هو الجدير بالثقة، لسبب لا يظهر إلا عند فتح تفصيل التكلفة. في تشغيل الفهرس الخاص بـ Step 5 Preview، يقع 0.85 دولار من أصل 1.03 دولار على جانب الإدخال، و0.17 دولار على جانب الإخراج. وفي تشغيل Qwen3.8-Max، يقع 4.76 دولار من أصل 5.41 دولار على جانب الإدخال، و0.65 دولار على جانب الإخراج. الأسعار المعلنة تختلف بنحو الضعف؛ أما فواتير المهام فتختلف بنحو خمسة أضعاف، لأن تشغيل Qwen دفع نحو 9.9 مليار توكن إدخال عبر إطار التشغيل مقابل 5.5 مليار لدى Step 5 Preview، ولأن معظم هذا الحجم عبارة عن حركة مرور ذاكرة التخزين المؤقت يُعاد قراءتها بأي خصم يمنحه المزوّد بدلًا من السعر الرئيسي المعلن.

يوصف Step 5 Preview من قبل اللوحة بأنه مطوّل جدًا، بنحو 160 مليون رمز إخراج عبر المجموعة مقابل وسيط قدره 82 مليون — ويوصف Qwen3.8-Max بالكلمات نفسها تمامًا، بنحو 190 مليون مقابل الوسيط نفسه. لا يُعد أي منهما نموذجًا يجيب بإيجاز. إذا كان طول الإخراج هو ما كنت تأمل في تحسينه، فلا يساعدك أي من العمودين.

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 ranked 32 of 227 with a comparable-model median of 26, speed ranked 190 of 227, cost ranked 105 of 227 and verbosity ranked 103 of 227, pricing of $2.00 per million input tokens and $6.00 per million output tokens with an 88 percent cache discount, a measured cost of $5.41 per index task, 190 million output tokens generated across the run against an 82 million median, about 35 output tokens per second, and a 984k-token context.

تحتوي المقارنة على ثغرة، وهي على شكل Prime

تم قياس كل رقم في القسم السابق على Qwen3.8-Max ID القياسي. لم يُقَس أيٌّ منها على Prime.

هذا ليس تفصيلاً تقنياً. إن عرض Prime بأكمله يقوم على أن الرموز تصل أسرع، ورقم السرعة الوحيد في لوحة الصدارة لهذه العائلة هو 35.4 رمز إخراج في الثانية الخاص بـ ID القياسي — الأبطأ بين الـ IDs الثلاثة التي نوقشت هنا بفارق كبير، وهو الصف الوحيد الذي لا يكون فيه Qwen3.8-Max مكلفاً فحسب بل ضعيف الأداء بشكل واضح. إذا حقق Prime الحد الأعلى من النطاق المعلن لـ Alibaba، يصبح ذلك الـ 35.4 شيئاً مثل 70، ولا يزال أقل من 87 الخاص بـ Step 5 Preview بينما تبلغ تكلفته 3.7 أضعاف لكل رمز إخراج. وإذا حقق الحد الأدنى من النطاق، يصبح نحو 53.

تلك تقديرات مبنية على مضاعف صرّحت به الجهة البائعة، وليست قياسات، وينبغي وصفها على هذا الأساس. ولا نعرف أحدًا نشر اختبارًا مستقلًا لمعدل الإنتاجية في وضع Prime. أما رقم 1.5 إلى 2× فهو رقم Alibaba نفسها، وهو الادعاء الوحيد الذي يستند إليه المستوى بأكمله.

التفصيل البنيوي الوحيد الذي يأتي في صالح Prime هو قاعدة التقييد، ومن السهل أن يمر عليه المرء مرورًا سريعًا أثناء القراءة. توثّق علي بابا أنه في ظل Prime، عندما يبلغ حجم الاستدعاءات حد المعدل، إذا كانت المنصة لا تزال تملك موارد احتياطية، فلا يتم تقييد الطلب — وبذلك لا تنخفض الإنتاجية المتاحة لك عن الحد المعلن. هذا سقف ناعم مع أرضية صلبة: تحت الازدحام تحصل على الحد، وفي ظل السعة الخاملة يمكنك الحصول على أكثر. وبالنسبة لحلقة وكيل تطلق عشرات الاستدعاءات المتتالية، فإن هذا يهم أكثر من الوسيط، لأن أبطأ استدعاء هو ما يحدد متى تنتهي الحلقة. وهو أيضًا أوضح تفسير لسبب وجود Prime كمنتج من الأساس. تبيع علي بابا موقعًا في الطابور من سعة بنتها بالفعل، وتتقاضى ضعف السعر مقابل الحق في أن تُخدَم أولًا منها.

ماذا تقول بطاقتا الأسعار عندما تضعهما جنبًا إلى جنب

تنشر Alibaba صفوف Qwen الخاصة بها متجاورة، ما يجعل حسابات الفئة نظيفة على نحو غير معتاد. في الصفحة الدولية، يعرض صف Prime 3.301 دولار للإدخال و9.902 دولار للإخراج لكل مليون توكن، مقابل 1.65 دولار و4.951 دولار للمعرّف القياسي وللنسخة المثبّتة 0902 الخاصة به. وهذا يساوي 2.0 بالضبط في كلا العمودين — ليس تقريبًا مقرّبًا بل النسبة الحرفية للأرقام المنشورة. تسرد صفحة التسعير الإنجليزية الخاصة بـ StepFun سعر Step 5 Preview عند 1.00 دولار للإدخال، و0.10 دولار عند إصابة الذاكرة المؤقتة، و2.70 دولار للإخراج، مع تضمين الإدخال عند إخفاق الذاكرة المؤقتة تكلفة كتابة محتوى جديد في الذاكرة المؤقتة. الرقم المنشور من المورّد لإصابة الذاكرة المؤقتة هو خصم بنسبة 90 بالمئة؛ وتسجّل اللوحة المستقلة 95 بالمئة استنادًا إلى المواد نفسها، ومن المفيد أن تعرف أي الرقمين تبني عليه نموذجك.

ضع البطاقات الثلاث في عمود واحد وسيتضح الشكل. ناتج Prime، 9.902 دولار. ناتج Standard Qwen، 6.00 دولار في سجل لوحة الصدارة و4.951 دولار على صفحة Alibaba الدولية الخاصة بها. ناتج Step 5 Preview، 2.70 دولار. وعلى المسار الرخيص الذي لا يعلن عنه أحد، تبلغ قراءة الذاكرة المؤقتة في Step 5 Preview 0.10 دولار مقابل 0.25 دولار في Qwen — وهو ما يهم أكثر من عمود الناتج لأي حمل عمل يكرر بادئته.

تحذير واحد بشأن الأرقام القديمة، لأن هذه العائلة أُعيد تسعيرها أكثر من مرة خلال سبعة أسابيع. السعران المتداولان على نطاق واسع، 2 دولار للمدخلات و6 دولارات للمخرجات لـ Qwen3.8-Max، هما سعر الإطلاق المعلن في أغسطس، وما زال هذا ما يعرضه تبويب سنغافورة لدى Alibaba. أما الصفوف الدولية والعالمية فتُظهر الآن 1.65 دولار و4.951 دولار. إذا كنت تحسب الإنفاق، فاستخدم بطاقة الأسعار الخاصة بمنطقتك وأعد قراءتها في اليوم الذي تلتزم فيه.

طريقتان لقراءة 2×

لأن Prime هو النموذج نفسه بسعر يعادل ضعف سعر المعرّف القياسي، فإن العلاوة السعرية سهلة التسعير وصعبة التبرير. في الطرف الأعلى من نطاق Alibaba، تدفع ضعف السعر مقابل ضعف السرعة، وهو أمر محايد التكلفة لكل ثانية تُزال من زمن الاستجابة. وفي الطرف الأدنى، تدفع ضعف السعر مقابل 1.5×، أي علاوة بنسبة 33 بالمئة لكل ثانية تُوفَّر. لا أحد الطرفين غير معقول للعمل التفاعلي؛ ولا أيٌّ منهما قابل للدفاع عنه في دفعة ليلية. ولهذا فإن النصيحة القياسية بشأن هذه الفئة — الاستدعاءات الحساسة لزمن الاستجابة على Prime، وكل ما عدا ذلك على المعرّف القياسي — هي أيضًا النصيحة الصحيحة.

المقارنة مع Step 5 Preview هي النقطة التي يتغير عندها شكل الاستدلال، وهذا هو الجزء الذي يجعل إطار «vs» مرئيًا. لا ينافس Prime ‏Step 5 Preview على السعر إطلاقًا. فالمعرّف القياسي أكثر تكلفة بالفعل لكل توكن إخراج مما عليه Step 5 Preview، وأكثر تكلفة بخمس مرات لكل مهمة مكتملة، كما أنه يسجّل نتيجة أعلى بنقطة واحدة. يضاعف Prime جانب التكلفة في معادلة كانت خاسرة أصلًا، ويشتري في المقابل سرعة يمتلك Step 5 Preview منها قدرًا أكبر مجانًا. إذا كانت السرعة هي ما تحتاجه من هذه العائلة، فالبيان الصادق هو أن النموذج على الجانب الآخر من هذه الصفحة يمنحك 87 توكنًا في الثانية مقابل 2.70 دولار لكل مليون توكن إخراج، أما المسار السريع فيمنحك نطاقًا يبلغ ذروته، وفق أرقام Alibaba نفسها، نحو 70 مقابل 9.902 دولار.

هذا ليس حجةً على أن Step 5 Preview يفوز. إنه حجة على أن قيمة Prime داخلية بالكامل في خط منتجات Alibaba نفسه، وعلى أن الحجة لصالحه تقوم على أحمال عمل يؤدي فيها تقدم Qwen3.8-Max بمقدار نقطة واحدة في المؤشر، أو سياقه البالغ 983,616 رمزًا، أو ملف مهامه المختلف، عملًا لا يؤديه سياق Step 5 Preview البالغ مليون رمز. وهي المقارنة التي لا يستطيع أحد إجراؤها بعد، لأن صف Prime غير موجود على أي لوحة مستقلة.

Generated rate-card infographic comparing three published price lists in one column: Qwen 3.8 Max Prime at $3.301 input and $9.902 output per million tokens, the standard qwen3.8-max and qwen3.8-max-0902 IDs at $1.65 and $4.951 on Alibaba's international page against the $2 and $6 still shown on its Singapore tab, and Step 5 Preview at $1.00 input, $0.10 cached input and $2.70 output from StepFun's English pricing page. A footer reads that the Prime row is exactly 2.0 times the standard row on both columns and that all figures are vendor list prices read on 10 October 2026.

ما يعنيه هذا بالنسبة للمشتري

لا يوجد أيٌّ من هذين على OrcaRouter. يمكن الوصول إلى Step 5 Preview عبر واجهة StepFun البرمجية الخاصة بها وعددٍ قليل من المنصات الخارجية؛ أما Prime فهو مستوى من Alibaba Cloud Model Studio يُقدَّم عبر نقطة نهاية مقيَّدة بنطاق مساحة العمل؛ ويمكنك التحقق من كلا الادّعاءين مقابل فهرسنا في الدقيقة نفسها التي تقرأ فيها هذا الكلام، وهو اختبار أفضل من أن تأخذ بكلامنا على عواهنه.

ما نوجّهه هو منتج مختلف في العائلة نفسها، ويصادف أنه المنتج الذي تظل حسابات هذا المقال تشير إليه. يقع Qwen3.8-Max القياسي ونسخته المثبّتة المؤرخة Qwen3.8-Max-0902 في الكتالوج على المفتاح نفسه الذي توجد عليه نظيراتهما Qwen3.8-Max-Preview وQwen3.8-Flash وQwen3.8-27B، إلى جانب أكثر من 200 نموذج آخر، مع سعر قائمة المزوّد الممرّر دون هامش ربح بنسبة 0 بالمئة. يترتب على ذلك أمران، وكلاهما يؤثر على القرار أعلاه. الأول أن تغيير بطاقة الأسعار لدى Alibaba يظهر من جانبنا في اليوم نفسه الذي تنشره فيه Alibaba — وهي بالضبط الخاصية التي تريدها من مورّد أعاد بالفعل تسعير هذه العائلة مرتين خلال سبعة أسابيع. والثاني أن خط الأساس لديك يتوقف عن كونه رهانًا على مورّد واحد: فالمعرّف القياسي هو الطبقة التي من المرجح أن تُبقيها على مسارك الافتراضي، وإبقاؤه خلف طبقة توجيه بدلًا من تكامل مباشر هو ما يجعل قرار Prime قابلًا للعكس لكل نقطة نهاية بدلًا من لكل عقد.

إذا كنت تختار بين الاسمين الواردين في عنوان هذا المقال، فالفرق واضح ومباشر. اتجه إلى Step 5 Preview عندما تريد الدرجة، وإدخال الفيديو والصورة، وخصم الذاكرة المؤقتة بنسبة 90 بالمئة، وتقبّل أنك تستأجر معاينة تكون نقطة تحققها وعدًا بحلول 15 أكتوبر وليست ترخيصًا. لا تتجه إلى Qwen 3.8 Max Prime إلا إذا كنت ملتزمًا بالفعل بـ Qwen3.8-Max، وقد قِست، على مطالباتك الخاصة، أن 35 رمزًا في الثانية لدى standard ID هي ما يكلّفك المال — وسعّر ذلك القرار مقابل 2× وليس مقابل 1.5×، لأن سقف نطاق المورّد ليس الرقم الذي ستراه في الإنتاج.

القياس الذي من شأنه أن يحسم هذا الأمر غير موجود، ويستحقّ أن يُقال هذا بوضوح بدلًا من تجميله. يحتاج أحدهم إلى تشغيل Prime عبر منصة اختبار تشغّل أيضًا Step 5 Preview، وأن ينشر توزيعًا للإنتاجية بدلًا من مضاعف، وأن يضع رقم تكلفة لكل مهمة إلى جانب نقطة المؤشر التي يشتريها. وحتى ذلك الحين، فإن الأرقام الوحيدة التي يتشاركها الطرفان هي بطاقتا الأسعار، وهما تقولان الشيء نفسه من اتجاهين متعاكسين: المسار السريع هو أغلى طريقة لشراء رمز Qwen3.8-Max، وأبطأ طريقة لشراء ثانية من الزمن الفعلي مقابل ما تتقاضاه البديلة عن الثانية نفسها.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا