بطاقة عنوان مُنشأة بعنوان "Union Alpha مقابل Qwen3.8 Flash" مع عنوان فرعي "يفصل بينهما نقطة واحدة في الاختبار الوحيد الذي شغّلهما معًا"، فوق ثلاث بطاقات مستديرة تقرأ "Official A: 136/157 مقابل 137/157"، و"السياق: 262,144 مقابل 1,000,000 رمز"، و"الزمن حتى أول رمز: 10.00 ث مقابل 6.62 ث". يقرأ التذييل: Official A وفقًا لـ SMF Clearinghouse مع زمن الاستجابة وفقًا لـ OrcaRouter خلال آخر 7 أيام.
Guides & Insights

Union Alpha مقابل Qwen3.8 Flash: نقطة واحدة تروي القصة كاملة

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

يفصل بين Union Alpha وQwen3.8 Flash نقطة واحدة في الاختبار الوحيد الذي قاس كليهما. في مجموعة SMF Clearinghouse Official A — 157 اختبارًا، مع إيقاف الاستدلال — سجّل Union Alpha نتيجة 136، وسجّل تشغيل محلي لـ Qwen3.8-Flash-Next نتيجة 137. وهذه أقرب نتيجة مواجهة مباشرة سجّلها أي من النموذجين، وهي أيضًا الرقم الأكثر تضليلًا في هذه المقارنة، لأن المدخلين لم يُشغَّلا في الظروف نفسها، وواحد فقط منهما نموذج يمكنك استئجاره فعليًا الآن.

ما الذي يخبرك به فارق النقطة الواحدة وما لا يخبرك به

ابدأ بما يثبته. إن Union Alpha ليس خدعة بالمعنى التافه — فمجموعة اختبارات واسعة تضم 157 اختبارًا خالية من الأخطاء، واستدلال مثالي (30/30)، واستخدام أدوات مثالي (2/2)، ليست شيئًا تنتجه نقطة نهاية جوفاء. ونتيجته في البرمجة 26/30 وفي الرياضيات 24/30 تضعانه في نطاق موثوق، بينما درجة الكتابة 2/5 تضعانه بعيدًا كل البعد عن أعمال النثر ذات الأغراض العامة.

والآن، المحاذير، التي يُعتمد عليها.

كان مُدخل Qwen3.8 Flash تشغيلًا محليًا لـ Qwen3.8-Flash-Next — نقطة التحقق مفتوحة الأوزان — وليس واجهة Qwen3.8 Flash API المستضافة. يعني التشغيل المحلي التكميم الخاص بك، ومكدس الاستدلال الخاص بك، ومحلّل استدعاء الأدوات الخاص بك. لا شيء من ذلك مضمون أن يطابق ما تُرجعه نقطة النهاية المستضافة، وقد أشار القائمون على الاختبار إلى أن المقارنة غير قاطعة لهذا السبب تحديدًا.

مجموعة اختبارات واحدة ليست ملفًا تعريفيًا. إن Official A واسع النطاق لكنه ضحل لكل فئة: فئة الأدوات لا تضم سوى اختبارين. وفئة أدوات من اختبارين فقط تحقق 2/2 هي مؤشر جيد، وليست دليلًا على الموثوقية الوكيلية، كما أن Union Alpha مُقدَّم صراحةً بوصفه نموذجًا وكيليًا وبرمجيًا. إن الأداة تقيس شيئًا مجاورًا للادعاء.

والنقطة الواحدة نفسها تقع داخل ضوضاء مجموعة اختبار مكوّنة من 157 اختبارًا. تعامل مع 136 و137 على أنهما «في النطاق نفسه»، لا كترتيب.

جنبًا إلى جنب

• نافذة السياق — Union Alpha ‏262,144 توكنًا مقابل Qwen3.8 Flash ‏1,000,000 توكن مُتاح (262,144 أصليًا، موسَّعة عبر YaRN).

• الحد الأقصى للمخرجات — Union Alpha ‏131,072 رمزًا مقابل Qwen3.8 Flash ‏131,000 رمز. متكافئان فعليًا.

• المدخلات — نص وصورة على Union Alpha مقابل نص وصورة وفيديو على Qwen3.8 Flash.

• التسعير — $0 أثناء المعاينة التجريبية لـ Union Alpha مقابل Qwen3.8 Flash عند $0.150/M للإدخال، و$0.470/M للإخراج، و$0.018/M لقراءة الذاكرة المؤقتة، و$0.230/M لكتابة الذاكرة المؤقتة.

• عناصر التحكم في الاستدلال — لا شيء منها في Union Alpha مقابل وضع تفكير في Qwen3.8 Flash مفعّل افتراضيًا ويمكن تعطيله.

• زمن الوصول إلى أول رمز — Union Alpha ‏10.00 ثانية p50 مقابل Qwen3.8 Flash ‏6.62 ثانية p50، وكلاهما مقيسان على نقطة النهاية لدينا خلال النافذة نفسها البالغة سبعة أيام. سرعة فك التشفير الخام أقرب مما توحي به السمعة: 170 رمزًا في الثانية مقابل 103.

• المصدر — مشغّل مجهول الهوية، بلا أوزان مقابل Alibaba/Qwen، مع فتح أوزان Qwen3.8-Flash-Next على Hugging Face وModelScope.

Generated two-column comparison scoreboard for Union Alpha and Qwen3.8 Flash. Union Alpha column: context window 262,144 tokens, max output 131,072 tokens, text and image input, $0 preview price, no published weights, 10.00 s p50 time to first token. Qwen3.8 Flash column: context window 1,000,000 tokens served, max output 131,000 tokens, text, image and video input, $0.150 input and $0.470 output per 1M tokens, Qwen3.8-Flash-Next weights open-sourced, 6.62 s p50 time to first token. Footer reads Official A per SMF Clearinghouse with latency and errors per OrcaRouter over the last 7 days.

Qwen3.8 Flash: رهان بـ6 مليارات معامل نشط على الكفاءة

أُطلقت Qwen3.8 Flash في 26 أغسطس 2026 بوصفها النسخة الإنتاجية المُدارة من نقطة التحقق مفتوحة الأوزان Qwen3.8-Flash-Next، التي أصدرتها علي بابا في الوقت نفسه. وهي نموذج خليط خبراء يضم 125 مليار معامل، ويُنشّط نحو 6 مليارات معامل لكل رمز، إضافة إلى 51 مليار معامل تضمين N-gram، مبنية على انتباه هجين يجمع بين Gated DeltaNet ومفهرس انتباه متناثر.

يتعلق تأطير المورّد باقتصاديات التدريب: تُفيد علي بابا بأن تكلفة التشغيل تبلغ نحو 1/9 من تكلفة Qwen3.7-Plus، مع ادّعاء أن التعبئة المسبقة أسرع بما يصل إلى 7.6× وفك الترميز أسرع بما يصل إلى 4.9× على أحمال عمل بحجم 1M رمز مع معدلات إصابة عالية في ذاكرة التخزين المؤقت. هذه أرقام المورّد ولم يتم إعادة إنتاجها بشكل مستقل.

جدول القياسات المرجعية الخاص به أيضًا مُبلَّغ عنه من الجهة الموردة وغير مُعاد إنتاجه: SWE-bench Pro ‏62.5، وDeepSWE v1.1 ‏58.7، وSWE-bench Multilingual ‏81.0، وNL2Repo ‏48.1، وCoWorkBench ‏73.9، وJobBench ‏55.7، وRealWorldQA ‏88.5، وLVBench ‏76.6، وAndroidWorld ‏84.5. الرقم الجدير بأن يُقتبس في وجه التسويق هو Humanity's Last Exam عند 35.9، وهو يقع دون 40.0 لدى Claude Opus 4.6 في المقارنة نفسها.

في صفحة النموذج الخاصة بنا، لا يزال قسم المعايير العامة يقرأ "قيد الانتظار" — لم يقيّمه أي طرف ثالث بعد. لكن ما لدينا هو حركة الاستخدام الخاصة بنا: وسيط زمن الوصول إلى أول رمز يبلغ 6.62 ثانية، ومعدل إخراج يبلغ 103 رموز في الثانية، ومعدل خطأ 4.5%. معدل الخطأ هذا مرتفع بما يكفي ليستحق المتابعة، وهو نوع من الأرقام لا يظهر إلا عند قياس نقطة نهاية حية بدلًا من منشور إطلاق.

The OrcaRouter model page for Qwen3.8 Flash, showing a 1M-token context window, 131K max output, text plus image and video input, $0.15 per million input tokens and $0.47 per million output tokens, a p50 time to first token of 6.62 s, and 2,322.0M tokens of traffic over seven days.

Union Alpha: النموذج بلا مالك

ظهر Union Alpha في كتالوجات طرف ثالث في 16 سبتمبر 2026، ويُقدَّم عبر الطبقة المجانية لدى OrcaRouter. لا يملك مختبرًا مسمّى، ولا أوزانًا، ولا رخصة، ولا عددًا للمعاملات، ولا ملاحظة معمارية. يقرأ حقل مزوّده "Stealth".

نقطة النهاية الخاصة به، على الأقل، واضحة: سياق من 262,144 رمزًا، وأقصى إخراج 131,072 رمزًا، وإدخال نصي وصوري مع إخراج نصي فقط، واستدعاء الأدوات، وإخراج JSON، ودرجة الحرارة وtop_p وmax_tokens، ولا توجد أي عناصر تحكم في الاستدلال على الإطلاق. لا يدعم خيار الأداة فعليًا سوى "auto". وُصفت نافذته المجانية بأنها نحو أسبوع، مع تقييد للمعدل، ولم يُعلن عن أي تسعير بعد المعاينة.

الادعاء المذكور — «أداء بمستوى الطليعة عبر مجموعة واسعة من المهام العامة» — هو ادعاء مُبلَّغ عنه من قِبل المشغّل وغير مُدقَّق. ونتيجة 136/157 في Official A هي القياس المستقل الوحيد الموجود.

The OrcaRouter model page for Union Alpha (Free), listed under the stealth vendor, showing a FREE badge, a 262K-token context window, 131K max output, text and image input with text output, and pricing shown as Free and rate-limited with model usage at $0.

السرعة هي حيث يتوقفون عن أن يبدوا متشابهين.

أرقام الإنتاجية الرئيسية لا تفصل بينهما بالطريقة التي تتوقعها، والسبب يستحق الفهم.

استنادًا إلى بيانات التتبع الخاصة بتوجيهنا على مدى الأيام السبعة الماضية، يبثّ Qwen3.8 Flash بمعدل 103 رموز إخراج في الثانية، مع زمن وسيط للوصول إلى أول رمز (p50) يبلغ 6.62 ثانية ومعدل خطأ 4.5%. أما Union Alpha، الذي قيس بالطريقة نفسها، فيبثّ بمعدل 170 رمزًا في الثانية. ومن حيث سرعة فك الترميز الخام، فإن النموذج المجهول هو الأسرع بين الاثنين.

ما لا يفعله هو أن يبدأ. قيمتا p50 وp95 لزمن الوصول إلى أول رمز لدى Union Alpha مثبتتان عند 10.00 ثوانٍ، ما يعني أن نصف الطلبات على الأقل تنتظر عشر ثوانٍ أو أكثر قبل ظهور أول رمز، ومعدل الأخطاء لديها في النافذة نفسها هو 7.7% — أي نحو 1.7 ضعف معدل Qwen. استغرق تشغيل Official A المكوّن من 157 اختبارًا، الذي تستند إليه الأقسام السابقة، 4.6 ساعات من الزمن الفعلي، بوسيط زمن استجابة قدره 91.9 ثانية ومتوسط قدره 104.8 ثانية لكل اختبار، وبلغت أربعة اختبارات المهلة الزمنية البالغة 300 ثانية الخاصة بمنصة الاختبار. أبلغ مختبرون مستقلون شغّلوه يوم الإطلاق عن إنتاجية أقل بكثير مما تُظهره نقطة النهاية لدينا، وهو ما قد تتوقعه من خدمة لا تزال تستوعب حملًا هائلًا في أول يوم.

إذن، الفرق العملي ليس في سرعة فك الترميز، بل في زمن الوصول إلى أول رمز والموثوقية. لا يصلح Union Alpha لأي شيء تفاعلي — لا إكمال تلقائي، ولا مساعدة مضمّنة، ولا حلقة وكيل محكمة — لأن صمتًا لمدة عشر ثوانٍ لا يمكن تمييزه عن التعليق. إنه يناسب العمل غير المتزامن: مهام دفعية ليلية، ومعالجة مستندات طويلة، وعمليات تقييم دون اتصال حيث لا شيء ينتظر أول رمز، ويُستوعَب معدل فشل نسبته 7.7% عبر إعادة المحاولة.

Qwen3.8 Flash بمعدل 103 رموز في الثانية، مع وسيط زمن الوصول إلى أول رمز قدره 6.62 ثانية، ليس سريعًا أيضًا. التوصيف الصادق هو أن كليهما بطيء، وأن واحدًا منهما فقط يفشل في نحو طلب واحد من كل ثلاثة عشر طلبًا.

حجة الكفاءة، ومن يحق له طرحها

تطرح Alibaba حجة تتعلق بتكلفة التدريب: تكلفة تدريبه تُساوي تُسع تكلفة Qwen3.7-Plus، أي ستة مليارات معامل نشط لكل رمز، ما يجعله رخيصًا في الخدمة. وهذا ادعاء يخص نموذجًا موجودة أوزانه وموثّق نسبه.

حكاية الكفاءة لدى Union Alpha مُضمَرة لا معلنة — نموذج مجهول بسعة 256K يمكن استدعاؤه مجانًا. المجانية ليست هي الرخص. هناك من يدفع ثمن وحدات معالجة الرسوميات تلك، وللمعاينة نهاية معلنة، واعتراف المشغّل نفسه بأنه كان يضبط الأداء من أجل السرعة يوحي بأن اقتصاديات التقديم لم تستقر بعد. نموذج مجاني لمدة أسبوع ثم يتعذر تسعيره بعد ذلك تكون حجته حول الكفاءة قد انتهت صلاحيتها بانتهاء النافذة.

تجربة المجهول دون المراهنة عليه

السبب الذي يجعل هذه المواجهة تحديدًا جديرة بأن تُبقيها في ذهنك هو أنها أرخص اختبار ممكن لنموذج غير مُثبت. Qwen3.8 Flash هو المعروف: مورّد مسمّى، وأوزان مفتوحة، ومعايير منشورة (وإن كانت منحازة لصالح المورّد)، وسعر حقيقي لكل توكن يبلغ 0.150/0.470 دولار. Union Alpha هو المجهول، بسعر صفر، وتقوم مطالبته التنافسية بأكملها على نتيجة اختبار واحدة من 157 اختبارًا.

بدلًا من الاختيار، ضع المجهول خلف قاعدة تجاوز الفشل. يمرّر OrcaRouter سعر القائمة الخاص بالمزوّد بهامش ربح 0% ويدعم تجاوز الفشل التلقائي عبر المزوّدين، لذا فإن نقطة نهاية Union Alpha المقيّدة بمعدل أو المختفية تنتقل إلى نموذج لا يزال يستجيب بدلًا من أن تظهر كمهمة فاشلة في الثالثة صباحًا. كلا النموذجين يعملان بالمفتاح نفسه، لذا تكلّف التجربة تغييرًا في الإعدادات بدلًا من تكامل ثانٍ — ولا يلزم أن يكون أي منهما قرارًا تدافع عنه، لأنك تستطيع تبديل التوجيه عندما تُغلق النافذة المجانية.

حكم

Qwen3.8 Flash هو النموذج الذي يمكن البناء عليه. ستة مليارات معامل نشط، وأوزان شقيقة مفتوحة المصدر، ونافذة سياق تبلغ مليون رمز، وإدخال فيديو، وسرعة فعلية تبلغ 103 رموز في الثانية، وسعر منشور يمكنك التنبؤ به. معاييره مُبلَّغ عنها من المورّد، ومعدل خطئه يستحق المراقبة، لكنه ينتمي إلى جهة ما، وتلك الجهة تطرحه فعليًا.

Union Alpha هو النموذج الذي ينبغي قياسه. الفجوة البالغة نقطة واحدة على Official A مثيرة للاهتمام حقًا — فهي تشير إلى أن هذا الشيء، أياً كان، ليس لعبة — وعند $0 مع سقف إخراج 131K وإدخال بصري، فإنه يستحق أسبوعًا من انتباهك. لكن فجوة نقطة واحدة على مجموعة اختبار واحدة، أنتجها مشغّل مجهول بمعدل خطأ 7.7%، هي سببٌ للتحقيق لا سببٌ للتبديل.

الشيء الجدير بالمراقبة هو الأمر نفسه الذي طالما حسم هذا: اسم. كُشف عن Ox Alpha، الإصدار السابق في هذه السلسلة، بعد ستة أيام من ظهوره باسم Zhipu's GLM-5.3-Flash. وإذا حصل Union Alpha على اسم، تتوقف المقارنة عن كونها حول نقطة وتبدأ تكون حول سعر.

الكمية المعروفة مُسعَّرة وموثَّقة: صفحة نموذج Qwen3.8 Flash تُظهر معدلات 0.150 دولار/0.470 دولار، وسياق الخدمة البالغ مليون رمز، وسقف المخرجات البالغ 131 ألفًا، مع بقاء معايير الأداء العامة معلّقة حتى الآن.