بطاقة عنوان رئيسية مُولّدة تحمل النص 'Solar Mini 4 مقابل Qwen3.8-Max' مع العنوان الفرعي 'ما التكلفة الفعلية لآخر عشرين نقطة مؤشر' وشارتين تحملان '24.1 مقابل 45.4 على المؤشر' و'$0.36 مقابل $5.41 لكل مهمة'.
Guides & Insights

Solar Mini 4 مقابل Qwen3.8-Max: ما التكلفة الفعلية لآخر عشرين نقطة مؤشر

الكاتب

Magnus Corvin

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج →
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

تبلغ تكلفة Solar Mini 4 مبلغ 0.10 دولار لكل مليون توكن إدخال و0.40 دولار لكل مليون توكن إخراج. أما Qwen3.8-Max، وهو النموذج الذي يقصده معظم الناس عندما يكتبون «Qwen 3.8» ويطلبون الـ API، فتبلغ تكلفته 2.00 و6.00 دولار. وعلى قائمة الأسعار، يبدو ذلك كفرق يعادل عشرين ضعفًا في سعر الإدخال. وفي التقييم المستقل الذي خضع له النموذجان الآن، فإن الرقم الصادق هو أن Qwen3.8-Max يسجّل 45.4 في Artificial Analysis Intelligence Index مقابل 24.1 لـ Solar Mini 4 — أي نحو ضعف القدرة المقيسة — بينما يكلّف نحو خمسة عشر ضعفًا لكل مهمة مكتملة. كل ما يستحق معرفته عن هذا الاقتران يكمن في الفجوة بين هاتين النسبتين، وفي أن نموذج Upstage يعمل بمعدل 204 توكن في الثانية بينما يعمل الطراز الرائد من Alibaba بمعدل 39 توكنًا في الثانية.

ملاحظة تسمية واحدة قبل الأرقام، لأنها تغيّر ما تشتريه. Qwen 3.8 هو جيل، وليس نموذجًا: النموذج الرائد المستضاف هو Qwen3.8-Max، وقد أُعيد إصداره كنسخة مؤرخة 0902، أما العضو القابل للتنزيل من الجيل نفسه فهو Qwen3.8-2.4T-A95B، أوزان الـ2.4 تريليون معامل التي نشرتها علي بابا في 12 أغسطس 2026. وSolar Mini 4، الصادر في 22 سبتمبر 2026، هو نموذج Upstage من نوع خليط الخبراء المتناثر بـ35 مليار معامل، مع نحو 3 مليارات معامل نشطة لكل رمز، ولا تتوفر له أوزان مفتوحة بأي ثمن.

العمودان، بشأن الأبعاد التي تحدد قرار الشراء.

• Intelligence Index — 45.4 لـ Qwen3.8-Max (0902) مقابل 24.1 لـ Solar Mini 4، وكلاهما على Intelligence Index v4.3.2.

• التكلفة لكل مهمة مكتملة — 5.41 دولارًا لـ Qwen3.8-Max مقابل 0.36 دولارًا لـ Solar Mini 4. بنسبة تقارب خمسة عشر إلى واحد، وهي النسبة التي لا يذكرها أحد.

• بطاقة الأسعار — $2.00 / $6.00 لكل مليون رمز، والإدخال المخزّن مؤقتًا $0.25، لـ Qwen3.8-Max مقابل $0.10 / $0.40، والإدخال المخزّن مؤقتًا $0.01، لـ Solar Mini 4.

• السياق — 1,000,000 توكن في كليهما، وهو البُعد الوحيد الذي لا يخسر فيه النموذج الرخيص أي شيء. تُدرج Artificial Analysis العدد 983,616 لـ Qwen3.8-Max و1,048,576 لـ Solar Mini 4؛ بينما تقول وثائق Upstage الخاصة إنه 512K، لذا فإن سقف النموذج الصغير هو الأقل يقينًا بين الاثنين.

• الأوزان — Qwen3.8-Max احتكاري ومستضاف؛ نظيره المفتوح Qwen3.8-2.4T-A95B قابل للتنزيل بموجب ترخيص مخصص ويسجل 39.9 على المؤشر نفسه بسياق يبلغ 262,000 رمز. Solar Mini 4 احتكاري وليس له نظير مفتوح.

• الإنتاجية — 204 رمزًا إخراجيًا في الثانية لـ Solar Mini 4 مقابل 39.5 لـ Qwen3.8-Max، وفقًا لما قاسه المختبر نفسه. النموذج الذي تبلغ تكلفته لكل مهمة واحدًا على خمسة عشر من تكلفة الآخر أسرع بخمس مرات في إنجازها.

ما الذي تشتريه واحد وعشرون نقطة مؤشر

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

إنهم يشترون الطرف الصعب من التوزيع. في اختبار Humanity's Last Exam، يجيب Qwen3.8-Max إجابات صحيحة عن 43.1% من البنود، مقابل 25.8% لـ Solar Mini 4. وفي البرمجة العلمية، تبلغ النسبة 52.1% مقابل 47.6%. أما في العمل المعرفي الوكيلي، فإن الفجوة تتسع لتدخل فئة مختلفة: يبلغ Qwen3.8-Max ‏1663 نقطة Elo على GDPval-AA، بينما لا يصل Solar Mini 4 سوى إلى 1072 — أي ما يقارب ستمئة نقطة Elo، وهذا ليس فرقًا ناتجًا عن التقريب، بل تغيّرًا في ما يمكن الوثوق بأن يفعله النموذج دون إشراف.

التقييم الوحيد الذي لا يكتفي فيه النموذج الصغير بالصمود فحسب، بل يفوز، هو الاستدلال بالسياق الطويل. يحقق Solar Mini 4 نسبة 83.3% في AA-LCR v1.1، بينما يحقق Qwen3.8-Max نسبة 80.3%. وهذه هي أقوى حجة لصالح Solar Mini 4 في هذه المقارنة بأكملها: في المعيار المصمم لاختبار "قراءة مستند طويل جدًا والاستدلال عبره"، فإن دفع خمسة عشر ضعف السعر لكل مهمة يشتري نتيجة أسوأ بثلاث نقاط.

المجال الذي لا يكون فيه أيٌّ من النموذجين هو الأداة المناسبة هو العمل المستقل على الطرفية. يسجّل Solar Mini 4 نسبة 1% في Terminal-Bench 4.0؛ ويسجّل Qwen3.8-Max نسبة 38.9%. النموذج الذي ينجح في ثمانٍ من عشرين مهمة طرفية صعبة قابل للاستخدام فعليًا هناك، أما الآخر فليس كذلك، وهذا أوضح مثال في هذه المقارنة على فجوة في النوع لا في الدرجة.

لماذا تكون فاتورة المهمة الواحدة للنموذج الرائد أسوأ بكثير مما يوحي به سعر التوكن الخاص به؟

يُصدر Qwen3.8-Max مخرجات أكثر لكل مهمة مقارنةً بـ Solar Mini 4 — 107,700 رمز مقابل 88,300 — ويُصدرها بتكلفة 6.00 دولار لكل مليون بدلاً من 0.40 دولار. هذا هو معظم الفارق هناك، قبل النظر في سلوك التخزين المؤقت. تقدم Alibaba سعرًا قدره 0.25 دولار للمدخلات المخزنة مؤقتًا، وهو خصم حقيقي مقابل سعر المدخلات البالغ 2.00 دولار، والشقيق المفتوح للعائلة، Qwen3.8-2.4T-A95B، هو نموذج متناثر بـ 2.4 تريليون معامل مع حوالي 95 مليار معامل نشط، لذا فإن كل رمز ينتجه يتم إنتاجه بواسطة آلة أكبر بكثير. لا شيء من ذلك يُعد انتقادًا. إنه السبب وراء وجود مضاعف خمسة عشر ضعفًا لكل مهمة، والسبب في أن مقارنة السعر لكل رمز بين هذين النموذجين مضللة في كلا الاتجاهين.

النتيجة العملية: Solar Mini 4 ليس «Qwen 3.8 الاقتصادي». إنه متخصص يصادف أنه رخيص وسريع وقوي في محور واحد بالضبط — المستندات الطويلة — وضعيف في المحور الذي تكون تكلفة الخطأ فيه الأعلى، ألا وهو الموثوقية الوكيلية. أما Qwen3.8-Max فهو العامّ الذي تظهر ميزته تحديدًا حيث تكون الإجابة الخاطئة مكلفة.

تشغيل الزوج بدلاً من الاختيار بينهما

هذه هي الحالة غير المعتادة في سلسلة Solar Mini 4 حيث يكون كلا طرفي المقارنة مسارين يمكننا فعلاً بيعك إياهما. Qwen3.8-Max ولقطته المؤرخة 0902 موجودان على OrcaRouter بسعر البائع المعلن 2.00 / 6.00 دولار، إلى جانبQwen3.8-Flash بسعر 0.15 / 0.47 دولار وQwen3.8-27B بسعر 0.33 / 2.40 دولار — ثلاث درجات من الجيل نفسه، مفتاح واحد، دون عقد ثانٍ ودون تغيير في الشيفرة يتجاوز سلسلة اسم الطراز. اعتبارًا من 1 أكتوبر 2026، يُظهر قياس ساحة التجربة الخاصة بنا أن Qwen3.8-Max يبلغ 2.5 ثانية لـ p50 مع 87.7 رمز إخراج في الثانية خلال الأيام السبعة الماضية؛ وهذه النافذة متجددة، لذا اقرأ بطاقة الطراز المباشرة بدلاً من هذه الجملة. طرازات Upstage غير متاحة عبرنا، ويجب الوصول إلى Solar Mini 4 من خلال واجهة برمجة التطبيقات الخاصة بـ Upstage.

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

ما يجعل ذلك ممكنًا هو الانقسام الذي تجادل هذه المقارنة لصالحه: إرسال حركة المستندات الطويلة واللغة الكورية والاستخراج المهيكل إلى مكان رخيص، وتوجيه الطلبات الثقيلة بالاستدلال والتي تستخدم الأدوات إلى النموذج الرائد، وترك تجاوز الفشل يغطي المزوّد الذي يمرّ بفترة سيئة. وهو أيضًا الموضع الذي تكتسب فيه لغة التوجيه DSL مكانتها — فتركيب النماذج في استدعاء واحد يعني أن تمريرة أولى رخيصة وتمريرة تحقق مكلفة يمكن أن تكونا طلبًا واحدًا إلى نقطة نهاية واحدة بدلًا من تكاملين يجب إبقاؤهما متزامنين.

النسخة المختصرة

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

إذا كان عبء العمل لديك يتسم بسياق طويل، وشكل إخراج ثابت، وميزانية زمن استجابة مقبولة، فإن Solar Mini 4 يمنحك 83% من نتيجة السياق الطويل مقابل 1/15 من المهمة وخمسة أمثال الإنتاجية، ولن تظهر النقاط الـ21 المفقودة في المؤشر أبداً على لوحة المعلومات الخاصة بك. وإذا كان عبء العمل لديك يتضمن أدوات، أو وكلاء متعددي الخطوات، أو أسئلة تكون فيها إجابة خاطئة واثقة أسوأ من عدم الإجابة، فإن النقاط المفقودة هي المنتج بأكمله، ويستحق Qwen3.8-Max خمسة عشر ضعف السعر. وكل رقم منسوب إلى Artificial Analysis أعلاه هو قياس مستقل لتلك المنظمة؛ وتسمية Qwen3.8 وتواريخ إصداره تخص Alibaba، وأرقام تقديم الخدمة الخاصة بـ OrcaRouter هي قياسنا الخاص في ساحة التجارب على نافذة متدحرجة مدتها سبعة أيام.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا