
Solar Mini 4 مقابل Qwen3.8-Max: ما التكلفة الفعلية لآخر عشرين نقطة مؤشر
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 لكل مليون رمز
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 لكل مليون رمز · 159 tok/s
- typesafeجديدTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 220 tok/s
- OpenAIجديدOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
تبلغ تكلفة Solar Mini 4 مبلغ 0.10 دولار لكل مليون توكن إدخال و0.40 دولار لكل مليون توكن إخراج. أما Qwen3.8-Max، وهو النموذج الذي يقصده معظم الناس عندما يكتبون «Qwen 3.8» ويطلبون الـ API، فتبلغ تكلفته 2.00 و6.00 دولار. وعلى قائمة الأسعار، يبدو ذلك كفرق يعادل عشرين ضعفًا في سعر الإدخال. وفي التقييم المستقل الذي خضع له النموذجان الآن، فإن الرقم الصادق هو أن Qwen3.8-Max يسجّل 45.4 في Artificial Analysis Intelligence Index مقابل 24.1 لـ Solar Mini 4 — أي نحو ضعف القدرة المقيسة — بينما يكلّف نحو خمسة عشر ضعفًا لكل مهمة مكتملة. كل ما يستحق معرفته عن هذا الاقتران يكمن في الفجوة بين هاتين النسبتين، وفي أن نموذج Upstage يعمل بمعدل 204 توكن في الثانية بينما يعمل الطراز الرائد من Alibaba بمعدل 39 توكنًا في الثانية.
ملاحظة تسمية واحدة قبل الأرقام، لأنها تغيّر ما تشتريه. Qwen 3.8 هو جيل، وليس نموذجًا: النموذج الرائد المستضاف هو Qwen3.8-Max، وقد أُعيد إصداره كنسخة مؤرخة 0902، أما العضو القابل للتنزيل من الجيل نفسه فهو Qwen3.8-2.4T-A95B، أوزان الـ2.4 تريليون معامل التي نشرتها علي بابا في 12 أغسطس 2026. وSolar Mini 4، الصادر في 22 سبتمبر 2026، هو نموذج Upstage من نوع خليط الخبراء المتناثر بـ35 مليار معامل، مع نحو 3 مليارات معامل نشطة لكل رمز، ولا تتوفر له أوزان مفتوحة بأي ثمن.
العمودان، بشأن الأبعاد التي تحدد قرار الشراء.
• Intelligence Index — 45.4 لـ Qwen3.8-Max (0902) مقابل 24.1 لـ Solar Mini 4، وكلاهما على Intelligence Index v4.3.2.
• التكلفة لكل مهمة مكتملة — 5.41 دولارًا لـ Qwen3.8-Max مقابل 0.36 دولارًا لـ Solar Mini 4. بنسبة تقارب خمسة عشر إلى واحد، وهي النسبة التي لا يذكرها أحد.
• بطاقة الأسعار — $2.00 / $6.00 لكل مليون رمز، والإدخال المخزّن مؤقتًا $0.25، لـ Qwen3.8-Max مقابل $0.10 / $0.40، والإدخال المخزّن مؤقتًا $0.01، لـ Solar Mini 4.
• السياق — 1,000,000 توكن في كليهما، وهو البُعد الوحيد الذي لا يخسر فيه النموذج الرخيص أي شيء. تُدرج Artificial Analysis العدد 983,616 لـ Qwen3.8-Max و1,048,576 لـ Solar Mini 4؛ بينما تقول وثائق Upstage الخاصة إنه 512K، لذا فإن سقف النموذج الصغير هو الأقل يقينًا بين الاثنين.
• الأوزان — Qwen3.8-Max احتكاري ومستضاف؛ نظيره المفتوح Qwen3.8-2.4T-A95B قابل للتنزيل بموجب ترخيص مخصص ويسجل 39.9 على المؤشر نفسه بسياق يبلغ 262,000 رمز. Solar Mini 4 احتكاري وليس له نظير مفتوح.
• الإنتاجية — 204 رمزًا إخراجيًا في الثانية لـ Solar Mini 4 مقابل 39.5 لـ Qwen3.8-Max، وفقًا لما قاسه المختبر نفسه. النموذج الذي تبلغ تكلفته لكل مهمة واحدًا على خمسة عشر من تكلفة الآخر أسرع بخمس مرات في إنجازها.
ما الذي تشتريه واحد وعشرون نقطة مؤشر

إنهم يشترون الطرف الصعب من التوزيع. في اختبار Humanity's Last Exam، يجيب Qwen3.8-Max إجابات صحيحة عن 43.1% من البنود، مقابل 25.8% لـ Solar Mini 4. وفي البرمجة العلمية، تبلغ النسبة 52.1% مقابل 47.6%. أما في العمل المعرفي الوكيلي، فإن الفجوة تتسع لتدخل فئة مختلفة: يبلغ Qwen3.8-Max 1663 نقطة Elo على GDPval-AA، بينما لا يصل Solar Mini 4 سوى إلى 1072 — أي ما يقارب ستمئة نقطة Elo، وهذا ليس فرقًا ناتجًا عن التقريب، بل تغيّرًا في ما يمكن الوثوق بأن يفعله النموذج دون إشراف.
التقييم الوحيد الذي لا يكتفي فيه النموذج الصغير بالصمود فحسب، بل يفوز، هو الاستدلال بالسياق الطويل. يحقق Solar Mini 4 نسبة 83.3% في AA-LCR v1.1، بينما يحقق Qwen3.8-Max نسبة 80.3%. وهذه هي أقوى حجة لصالح Solar Mini 4 في هذه المقارنة بأكملها: في المعيار المصمم لاختبار "قراءة مستند طويل جدًا والاستدلال عبره"، فإن دفع خمسة عشر ضعف السعر لكل مهمة يشتري نتيجة أسوأ بثلاث نقاط.
المجال الذي لا يكون فيه أيٌّ من النموذجين هو الأداة المناسبة هو العمل المستقل على الطرفية. يسجّل Solar Mini 4 نسبة 1% في Terminal-Bench 4.0؛ ويسجّل Qwen3.8-Max نسبة 38.9%. النموذج الذي ينجح في ثمانٍ من عشرين مهمة طرفية صعبة قابل للاستخدام فعليًا هناك، أما الآخر فليس كذلك، وهذا أوضح مثال في هذه المقارنة على فجوة في النوع لا في الدرجة.
لماذا تكون فاتورة المهمة الواحدة للنموذج الرائد أسوأ بكثير مما يوحي به سعر التوكن الخاص به؟
يُصدر Qwen3.8-Max مخرجات أكثر لكل مهمة مقارنةً بـ Solar Mini 4 — 107,700 رمز مقابل 88,300 — ويُصدرها بتكلفة 6.00 دولار لكل مليون بدلاً من 0.40 دولار. هذا هو معظم الفارق هناك، قبل النظر في سلوك التخزين المؤقت. تقدم Alibaba سعرًا قدره 0.25 دولار للمدخلات المخزنة مؤقتًا، وهو خصم حقيقي مقابل سعر المدخلات البالغ 2.00 دولار، والشقيق المفتوح للعائلة، Qwen3.8-2.4T-A95B، هو نموذج متناثر بـ 2.4 تريليون معامل مع حوالي 95 مليار معامل نشط، لذا فإن كل رمز ينتجه يتم إنتاجه بواسطة آلة أكبر بكثير. لا شيء من ذلك يُعد انتقادًا. إنه السبب وراء وجود مضاعف خمسة عشر ضعفًا لكل مهمة، والسبب في أن مقارنة السعر لكل رمز بين هذين النموذجين مضللة في كلا الاتجاهين.
النتيجة العملية: Solar Mini 4 ليس «Qwen 3.8 الاقتصادي». إنه متخصص يصادف أنه رخيص وسريع وقوي في محور واحد بالضبط — المستندات الطويلة — وضعيف في المحور الذي تكون تكلفة الخطأ فيه الأعلى، ألا وهو الموثوقية الوكيلية. أما Qwen3.8-Max فهو العامّ الذي تظهر ميزته تحديدًا حيث تكون الإجابة الخاطئة مكلفة.
تشغيل الزوج بدلاً من الاختيار بينهما
هذه هي الحالة غير المعتادة في سلسلة Solar Mini 4 حيث يكون كلا طرفي المقارنة مسارين يمكننا فعلاً بيعك إياهما. Qwen3.8-Max ولقطته المؤرخة 0902 موجودان على OrcaRouter بسعر البائع المعلن 2.00 / 6.00 دولار، إلى جانبQwen3.8-Flash بسعر 0.15 / 0.47 دولار وQwen3.8-27B بسعر 0.33 / 2.40 دولار — ثلاث درجات من الجيل نفسه، مفتاح واحد، دون عقد ثانٍ ودون تغيير في الشيفرة يتجاوز سلسلة اسم الطراز. اعتبارًا من 1 أكتوبر 2026، يُظهر قياس ساحة التجربة الخاصة بنا أن Qwen3.8-Max يبلغ 2.5 ثانية لـ p50 مع 87.7 رمز إخراج في الثانية خلال الأيام السبعة الماضية؛ وهذه النافذة متجددة، لذا اقرأ بطاقة الطراز المباشرة بدلاً من هذه الجملة. طرازات Upstage غير متاحة عبرنا، ويجب الوصول إلى Solar Mini 4 من خلال واجهة برمجة التطبيقات الخاصة بـ Upstage.

ما يجعل ذلك ممكنًا هو الانقسام الذي تجادل هذه المقارنة لصالحه: إرسال حركة المستندات الطويلة واللغة الكورية والاستخراج المهيكل إلى مكان رخيص، وتوجيه الطلبات الثقيلة بالاستدلال والتي تستخدم الأدوات إلى النموذج الرائد، وترك تجاوز الفشل يغطي المزوّد الذي يمرّ بفترة سيئة. وهو أيضًا الموضع الذي تكتسب فيه لغة التوجيه DSL مكانتها — فتركيب النماذج في استدعاء واحد يعني أن تمريرة أولى رخيصة وتمريرة تحقق مكلفة يمكن أن تكونا طلبًا واحدًا إلى نقطة نهاية واحدة بدلًا من تكاملين يجب إبقاؤهما متزامنين.
النسخة المختصرة

إذا كان عبء العمل لديك يتسم بسياق طويل، وشكل إخراج ثابت، وميزانية زمن استجابة مقبولة، فإن Solar Mini 4 يمنحك 83% من نتيجة السياق الطويل مقابل 1/15 من المهمة وخمسة أمثال الإنتاجية، ولن تظهر النقاط الـ21 المفقودة في المؤشر أبداً على لوحة المعلومات الخاصة بك. وإذا كان عبء العمل لديك يتضمن أدوات، أو وكلاء متعددي الخطوات، أو أسئلة تكون فيها إجابة خاطئة واثقة أسوأ من عدم الإجابة، فإن النقاط المفقودة هي المنتج بأكمله، ويستحق Qwen3.8-Max خمسة عشر ضعف السعر. وكل رقم منسوب إلى Artificial Analysis أعلاه هو قياس مستقل لتلك المنظمة؛ وتسمية Qwen3.8 وتواريخ إصداره تخص Alibaba، وأرقام تقديم الخدمة الخاصة بـ OrcaRouter هي قياسنا الخاص في ساحة التجارب على نافذة متدحرجة مدتها سبعة أيام.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
