
Boreal مقابل Qwen3.8 Max: الصف الذي يأمل كل مورّد أن تتخطاه
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0240الذكاء72البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0340الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2134الذكاء69البرمجة
كل إطلاق نموذج ينشر بطاقة أرقام، وفي كل بطاقة صفٌّ يفضّل المورّد ألّا تتوقف عنده طويلًا. أما Qwen3.8 Max، الذي صدر في 3 أغسطس 2026، فصفوفه المُطرية سهلة العثور عليها: فقد احتلّ المركز الأول في لوحة CodeArena لتصنيف الواجهات الأمامية برصيد 1,691 نقطة، وبلغ مؤشر Artificial Analysis Agentic Index قيمة 58 ليعادل Claude Opus 5 عند الجهد العالي — وهو أقرب ما وصل إليه مختبر صيني إلى قمة تلك اللوحة — وحقّق نتيجة 1,739 إيلو في GDPval-AA، متقدمًا على GPT-5.6 Sol. أما الصف الواقع تحتها فقراءته أصعب. وفي المجموعة نفسها لدى المُقيِّم ذاته، ارتفع معدل الهلوسة المُقاس من 23% في الجيل السابق إلى 40%، وانخفضت درجة استرجاع السياق الطويل لدى النموذج بمقدار نقطتين. Boreal، نموذج الفيديو الإعلاني من Creatify، الذي أُطلق في 15 سبتمبر 2026 بتكلفة سنت واحد في الثانية، يحمل على بطاقته الخاصة صفًّا من النوع نفسه — وهو أكثر تحديدًا، لأن المورّد نشره.
لا يُعدّ أيٌّ من الصفّين مُقصيًا. كلاهما أكثر إفادة من الدرجات الرئيسية، ولهذا يجدر وضعهما جنبًا إلى جنب بدلًا من مقارنة اللافتات.
ما يتفوّق فيه Qwen3.8 Max حقًا
الانتصارات حقيقية وليست صغيرة.
Qwen3.8 Max هو نموذج خليط خبراء بنحو 2.4 تريليون معامل، مع ما يقرب من 95 مليار معامل نشطة لكل رمز، وهو أول Qwen من فئة Max تقول Alibaba إنه سيُصدر بأوزان مفتوحة — أُعلن عنه لأسبوع 10 أغسطس 2026 دون ترخيص أو تاريخ مؤكد، وهي تفصيلة جديرة بالملاحظة لأن الإعلان ليس إصدارًا. وهو يحمل نافذة سياق بسعة مليون رمز مع سقف إخراج يبلغ 131,072 رمزًا، ويقبل النص والصور والفيديو كمدخلات. تستحق تلك النقطة الأخيرة التشديد في هذه المقارنة تحديدًا: فمن بين النماذج النصية الرائدة الأربعة التي تضعها هذه السلسلة في مواجهة Boreal، يُعد Qwen3.8 Max واحدًا من اثنين فقط يمكن تسليمهما مقطع فيديو منتهيًا وطرح سؤال عنه.
التسعير عدواني على نحو أعاد تشكيل هذه الفئة. فعند 2.00 دولار لكل مليون توكن من الإدخال و6.00 دولارات لكل مليون توكن من الإخراج، مع قراءات الذاكرة المؤقتة بـ0.25 دولار، فإنه يأتي أقل من الجيل السابق بنحو 20% مع مضاعفة الحد الأقصى لطول الإخراج. على لوحتنا، يستقر ذلك عند 2.00 و6.00 دولار، وسياق من مليون توكن، وزمن وسيط (p50) للوصول إلى أول توكن قدره 10.00 ثوانٍ — وهو السقف الذي تسجّله أدوات القياس لدينا، لذا اقرأه على أنه «بطيء» لا دقيق — و183.0 مليون توكن من الحركة خلال الأيام السبعة الماضية.
والصف الذي تحته
إليك الجزء الذي لا يصل إلى عنوان منشور الإطلاق.
سجّل التقييم المستقل من Artificial Analysis حالتي تراجع بين Qwen3.7-Max وQwen3.8 Max. انخفض مقياس استرجاع السياق الطويل لديه بمقدار نقطتين. وانخفض مقياس الإحاطة المعرفية لديه بمقدار عشر نقاط، كما ارتفع معدل الهلوسة الذي يقيسه المُقيِّم من 23% إلى 40%. وفي الوقت نفسه، ارتفعت تكلفة النموذج لكل مهمة على مؤشر الذكاء من 0.53 دولار إلى 1.14 دولار — إذ استغرق نحو 64 دورًا لكل مهمة، بينما استغرق سلفه 14 دورًا.
اقرأ تلك معًا وستظهر صورة متماسكة. Qwen3.8 Max هو نموذج تحسّن في الأشياء التي يمكن لمعايير الأداء ذات الإجابة الصحيحة الواحدة قياسها — البرمجة، وإكمال المهام الوكيلية، وحل المشكلات المنظمة — وساء في الشيء الأصعب في التقييم: معرفة متى لا يعرف. النموذج الذي يتأمل أكثر ويهلوس أكثر لا يناقض نفسه. تخلق مسارات الاستدلال الأطول مزيدًا من الفرص للالتزام بإجابة خاطئة واثقة، ومعيار الأداء الذي يكافئ إكمال المهمة لا يعاقب على ذلك حتى تحتوي المهمة على ثابت مخفي يمكن انتهاكه.
بالنسبة للمشتري، النتيجة العملية ضيقة ومحددة. إذا كان استخدامك للنموذج يتمثل في توليد الشيفرة أو سير عمل وكيلي حيث تفشل الإجابة الخاطئة بشكل صارخ — يفشل اختبار، أو ينكسر البناء — فإن الانتكاسات تكاد تكون غير مرئية، والمكاسب هي القصة بأكملها. أما إذا كان استخدامك هو الاسترجاع أو التلخيص أو أي شيء تصل فيه إجابة خاطئة بليغة إلى إنسان دون تدقيق، فإن الانتقال من 23 إلى 40 هو الرقم الذي ينبغي أن يحدد تقييمك، لا تصنيف CodeArena.
أسوأ صف لـ Boreal نفسه، منشور من قبل المورّد
التناقض الذي يجعل هذا الاقتران مفيدًا هو أن Creatify فعلت شيئًا لا يفعله معظم المورّدين: فقد وضعت أضعف نتيجة لها في المنشور نفسه الذي وضعت فيه أقوى نتيجة.
خضع Boreal لاختبار أعمى مقابل نموذجه الأساسي غير المعدل، مع تثبيت الأمر النصي والدقة وعدد الإطارات والبذرة، عبر 40 حالة إنتاجية. وتُفيد Creatify عن تفضيل بنسبة 81% لصالح Boreal — 25 مقابل 6 مع 9 تعادلات، اختبار الإشارة p<0.001 — ثم تُفصّل هذا المتوسط. إعلانات المنتجات: 83%. مشاهد المبدعين وUGC: 85%. مقاطع حديث شخص واحد: 60%.
ذلك الرقم الأخير هو الصف. تُعدّ مقاطع الرؤوس المتحدثة من أكثر الصيغ شيوعًا في الإعلانات ذات الاستجابة المباشرة، وهي الصيغة التي تكون فيها ميزة النموذج على نموذجه الأساسي الخاص أضعف ما يمكن — بالكاد أفضل من رمي عملة معدنية في مواجهة نموذج لم يكن أحد سيطلقه. يُصرَّح بأن التصيير يعمل بنسبة 1:1 مع الزمن الحقيقي في فئة 720p، وتحسّن الاحتفاظ بالتفاصيل الدقيقة بنسبة 11.3% عند p=0.004، لذا فإن الحصيلة الإجمالية إيجابية حقًا. كل ما يفعله التفصيل هو إخبارك بأي نصف من الفئة ضُبط هذا النموذج من أجله، وهو ليس النصف الذي يظهر فيه شخص يتحدث إلى الكاميرا.
لاحظ أيضًا نوع الأدلة الذي يمثله كل صف من هذه الصفوف. اكتشف مُقيِّم مستقل يشغّل أدواته الخاصة تراجع Qwen3.8 Max. أفصح المورّد عن صف Boreal الضعيف، في اختبار صمّمه المورّد وشغّله. الثاني أكثر موثوقية كبيان واقعي وأقل إفادة كمقارنة، لأنه لا يوجد رقم مستقل في أي مكان في ملف Boreal.

تباين المواصفات
• الإخراج — Boreal: فيديو مُصيَّر، بفئة 720p، من نص إلى فيديو ومن صورة إلى فيديو. Qwen3.8 Max: نص فقط، حتى 131,072 رمزًا.
• المدخل — Boreal: مطالبة نصية أو صورة ثابتة. Qwen3.8 Max: نص وصور وفيديو.
• السعر — Boreal: 0.01 دولار لكل ثانية من الفيديو النهائي. Qwen3.8 Max: 2.00 دولار لكل مليون إدخال / 6.00 دولار لكل مليون إخراج، قراءات ذاكرة التخزين المؤقت بسعر 0.25 دولار.
• السياق — Boreal: غير منشور. Qwen3.8 Max: 1M رمز إدخالًا، 131K رمز إخراجًا.
• زمن الاستجابة — Boreal: مُعلَن بنسبة 1:1 مع الزمن الحقيقي. Qwen3.8 Max: p50 زمن الوصول إلى أول رمز هو 10.00 ثوانٍ على لوحتنا.
• الأوزان — Boreal: خاصة، تملكها وتقدّمها Creatify. Qwen3.8 Max: خاصة عند الإطلاق؛ أعلنت Alibaba عن إصدار مفتوح الأوزان لأول نموذج Qwen من فئة Max، دون تأكيد الترخيص أو الموعد.
• الدليل — Boreal: اختبار أعمى من 40 حالة أجراه المورّد، دون تقييم مستقل. Qwen3.8 Max: تغطية مستقلة للمعايير المرجعية تشمل انحدارين مُقاسين، إلى جانب صفوف المورّد البالغة 86.1 على OSWorld-Verified و86.6 على Terminal-Bench 2.1.
ما قيمة الانحدار بالنسبة لشخص يشتري
عادةً ما تُعتبر التراجعات على لوحات الصدارة من التوافه. لكنها أقرب إلى أكثر ما ينشره معيار أداء من صلةٍ باتخاذ القرار، لأنها الصفوف الوحيدة التي تخبرك بما تخلى عنه المورّد.
الخطوة المفيدة ليست قراءة أيٍّ من البطاقتين، بل تشغيل كلا النموذجين على حركة المرور الخاصة بك — والعقبة العملية هي أن هذا يعني عادةً عقدين، ومجموعتي أدوات تطوير برمجيات (SDK)، وعلاقتي فوترة، وهو قدر من الاحتكاك يكفي لأن تتخطى معظم الفرق الاختبار وتشتري بناءً على النتيجة الرئيسية بدلاً من ذلك.
هذا الاحتكاك هو الجزء الذي تزيله طبقة التوجيه. Qwen3.8 Max موجود في كتالوجنا إلى جانب الجيل السابق، لذا فإن مقارنتهما على مجموعة التقييم الخاصة بك هي تغيير من سطر واحد في سلسلة النموذج بدلًا من دورة شراء، كما أن المفتاح نفسه يصل إلى بقية الكتالوج عندما تقول المقارنة إنك تريد نموذجًا مختلفًا لمرحلة مختلفة من خط المعالجة. وهو يأتي بسعر قائمة مزوّد الخدمة مع هامش ربح 0%، وهذا يهم هنا لسبب محدد: فقد وصل Qwen3.8 Max أرخص بنحو 20% من الجيل الذي حلّ محله، وإعادة تسعير من البائع بهذا النوع هي شيء ينبغي أن يظهر على فاتورتك عند حدوثه بدلًا من التجديد التالي.
Boreal ليس في كتالوجنا. لا يقدّم OrcaRouter نماذج توليد الفيديو، ولا ينبغي قراءة أي شيء هنا على أنه يدّعي خلاف ذلك. ما نقدّمه هو الطبقة التي تعلوه — النصّ، والنسخ المتغايرة، وتمرير الامتثال، وتحليل ما حقّق أداءً — ويمكن تسليم المقطع النهائي إلى اثنين من النماذج في هذه السلسلة، ومن بينهما Qwen3.8 Max، لمراجعته.

كيفية قراءة أي من البطاقتين
يُعد Qwen3.8 Max خيار الشراء الأقوى إذا كان عملك يتمثل في البرمجة أو الوكلاء أو الاستدلال المنظّم، وبسعر يقل عن سعر سابقه، والانحداران المستقلان هما السبب في اختباره على حركة الاسترجاع والتلخيص لديك قبل توجيه الإنتاج إليه. إن نسبة الهلوسة البالغة 40% ليست سببًا لتجنّب النموذج؛ بل هي سبب لمعرفة أي من أحمال العمل لديك يمكنها تحمّلها.
Boreal هو الوحيد من بين الاثنين الذي ينتج المُخرَج الذي تدور حوله هذه المقارنة اسميًا، وهو أرخص خيار موثوق وفق الأسعار المعلنة لفيديو إعلاني قصير. قيده مرتبط بالتنسيق تحديدًا وقد ذكره المورّد نفسه: تفضيل بنسبة 60% لمقاطع شخص واحد يتحدث. اختبر ذلك التنسيق قبل إعلانات المنتجات، لأن الهامش المتاح فيه هو الأصغر.
هناك أمران من شأنهما أن يغيّرا هذا. إذا أطلقت Alibaba الأوزان المفتوحة التي أعلنت عنها لـ Qwen3.8 Max، فسيتغيّر كل من تسعير النموذج واستمراريته، وستكون الرخصة التي يأتي بموجبها أكثر أهمية من التاريخ. وبالنسبة إلى Boreal، فإن أول تقييم مستقل — من أي نوع، ومن أي جهة — سيحل محل اختبار بائع من 40 حالة يحمل حاليًا عبء الإثبات كله لنموذج يُباع ضمن صيغة تكون فيها العلامات التجارية حساسة بشكل غير معتاد لكيفية ظهور منتجها.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
