
AesCode 32B مقابل Qwen3.8 27B: مايكروسوفت بنته على Qwen، وواحد منهما قابل للاستدعاء
- OrcaجديدOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 لكل مليون رمز · 87 tok/s
- openaiجديدOpenAI: GPT-6.1 Sol2026-09-2952الذكاء
- anthropicجديدAnthropic: Claude Sonnet 5.52026-09-2856الذكاء
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 لكل مليون رمز · 115 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238الذكاء
- OpenAIOpenAI: GPT-6 Sol2026-09-2248الذكاء
- AnthropicAnthropic: Claude Opus 5.52026-09-2258الذكاء
- xAIGrok 4.72026-09-2146الذكاء
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 لكل مليون رمز · 47 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 777 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- OpenAIOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- AnthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 لكل مليون رمز · 61 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 452 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
التفصيل الذي يُعيد تنظيم هذه المقارنة بأكملها موجود في السطر الثاني من الطراز:AesCode 32Bيبدأ من Qwen3-VL-32B-Instruct. نموذج الأكواد المخصص للتصميم من Microsoft هو نسخة Qwen3-VL مضبوطة بدقة، برخصة Apache 2.0، وموجود على مستودع Hugging Face أُنشئ في 29 سبتمبر 2026، مع إيداع بعنوان "Release AesCode-32B" بتاريخ 7 أكتوبر 2026، ومن دون أي إعلان من Microsoft في أي مكان.Qwen3.8 27Bهو الطرف الآخر من هذا النسب: الطراز الكثيف متعدد الوسائط بحجم 27B مفتوح الأوزان الخاص بالمورّد نفسه، الذي صدر في 14 أغسطس 2026 بموجب Apache 2.0، البنية اللاحقة لنقطة التفتيش VL التي ضبطتها Microsoft بدقة. إذن فليست هذه مواجهة بين الجهود الرائدة لمورّدين اثنين. بل هي مواجهة بين طراز عام الأغراض مفتوح الأوزان من مختبر واحد، ونسخة مضبوطة بحثيًا من العائلة نفسها من منافس، ويتبين أن الفرق العملي بينهما يدور بالكامل تقريبًا حول ما يُسمح لك بفعله بالملف بعد حصولك عليه.
نفس الترخيص، نفس العائلة، كمية مختلفة من الطراز
كلاهما بترخيص Apache 2.0، وكلاهما يستقبل الصور والنصوص، وكلاهما يعيد نصًا. أما كل ما يأتي بعد ذلك فيختلف، ويختلف صف النشر أكثر من أي شيء آخر.
• المعلمات — AesCode 32B: نموذج كثيف بحجم 33B على قاعدة Qwen3-VL-32B-Instruct. Qwen3.8 27B: كثيف بحجم 27B، و28B عند احتساب مُشفّر الرؤية، و64 طبقة بحجم مخفي 5120.
• الذاكرة اللازمة لتشغيله — AesCode 32B: توصي البطاقة بتخطيط نحو 65 GB من ذاكرة المسرّع لمعاملات bf16 وحدها، ويستخدم مثال الخدمة الخاص بها توازي التنسور رباعي الاتجاه. Qwen3.8 27B: حوالي 55.6 GB بصيغة bf16.
• السياق — AesCode 32B: 24,576 رمزًا في التكوين المُبلَّغ عنه، مع تحديد المطالبات والاستجابات أثناء التدريب بحد أقصى 8,192. Qwen3.8 27B: 262,144 رمزًا أصليًا، قابل للتوسيع إلى 1,000,000 باستخدام تحجيم YaRN.
• الانتباه — AesCode 32B: موروث من العمود الفقري Qwen3-VL. Qwen3.8 27B: هجين، 48 طبقة انتباه خطي Gated DeltaNet مقابل 16 طبقة انتباه كامل بنسبة 3:1، وهو ما يجعل نافذة 262K ميسورة التكلفة للتشغيل.
• ما الغرض منه — AesCode 32B: إنشاء عناصر بصرية غنية بالمعلومات على هيئة HTML وCSS قابلين للتحرير، إضافةً إلى أبحاث حول توليد الشيفرة متعدد الوسائط. Qwen3.8 27B: عمل عام قائم على الوكلاء ومتعدد الوسائط — البرمجة، واستخدام الحاسوب، وفهم المستندات والفيديو، واستدعاء الأدوات.
• من أين تحصل عليه — AesCode 32B: تنزيل من Hugging Face؛ لا يوجد مزوّد استدلال ينشره. Qwen3.8 27B: الأوزان، أو نقطة نهاية مستضافة.
ضعف السياق، وبصمة أصغر قليلًا، وبنية أساسية أحدث بجيل واحد، وترخيص مطابق تمامًا. الصف الوحيد الذي يفوز فيه AesCode 32B فوزًا قاطعًا هو الصف الأول، وهو يفوز فيه عبر ضبط دقيق خاص بمهمة.
ما الذي تم قياس كل منها عليه فعليًا
نظاما التقييم لا يتلامسان، والتظاهر بخلاف ذلك هو الخطأ المعتاد في صفحات كهذه.
بطاقة Qwen3.8 27B واسعة ومحددة في آن واحد. البرمجة: Terminal-Bench 2.1 عند 73.0، SWE-bench Pro عند 61.7، QwenSWEBench عند 79.0، LiveCodeBench v6 عند 90.3. الاستدلال: GPQA Diamond 89.2، Humanity's Last Exam 30.8. استخدام الحاسوب: OSWorld-Verified 84.3، WebArena-Verified 64.8، AndroidWorld 81.9. الرؤية: MathVision 94.6 مع تحسين الاستدلال وقت التنفيذ من البائع و90.0 بدونه، OmniDocBench 1.5 عند 91.1. كلها أرقام البائع الخاصة على منصة الاختبار الخاصة به — مع حاشية تستحق القراءة، وهي أن تشغيلات SWE-bench Pro و QwenSWEBench استخدمت منصة Claude Code، لذا فهي غير قابلة للمقارنة مباشرة مع النماذج التي تم تقييمها على منصة مختلفة.
لدى AesCode 32B معيار واحد، وهو معيار أحادي الغرض: 300 عيّنة إنفوجرافيك، وثلاث عمليات توليد لكل موجّه دون انتقاء، تُصيَّر وتُقيَّم عبر سبع قنوات. والنتيجة الرئيسية هي Overall بمقدار 85.89 مع توفير الصورة المرجعية، مقابل 81.28 لـ GPT-5.5 و80.39 لـ Claude Opus 4.8 ضمن إطار التقييم نفسه — إضافةً إلى الادعاء بأن AesCode 32B يتفوق على نموذجه الأساسي Qwen3-VL-32B بفارق 22.4 نقطة في بُعد Visual و24.8 في Overall.
ضع هذين بجانب بعضهما البعض، فلن يتطابق أي شيء. يقيس Terminal-Bench ما إذا كانت مهمة shell تكتمل؛ ويقيس تقييم AesCode ما إذا كان نص الإنفوجرافيك مقروءًا، وما إذا كان تخطيطه لا يتجاوز حدود اللوحة، وما إذا كان جدوله جدول HTML حقيقيًا. لا توجد مقاييس مشتركة، ولا أداة تقييم مشتركة، ولا مهمة مشتركة. العبارة الصادقة الوحيدة هي أن AesCode 32B أفضل بكثير في المخرجات التصميمية من نموذجه الأساسي، وأن Qwen3.8 27B نموذج عام قوي — ولا يخبرك أي من الادعاءين بأي شيء عن الآخر.

فجوة الأدلة حقيقية هذه المرة، في اتجاه واحد
تُعدّ معايير الأداء التي تضعها الجهات المورّدة هي القاعدة في هذه الصناعة، لذا من المهم أن هذين الاثنين يختلفان في مدى تحقّق طرف آخر من مزاعم مورّديهما.
طرح Qwen3.8 27B مع جدول المورّد الخاص به، ثم راكم نتائج خارجية خلال أسابيع. يتضمن سجل النموذج المستقل دراسة عن وكيل قانوني أجرتها شركة الذكاء الاصطناعي القانوني Harvey مع شركة الذاكرة الناشئة Engram، تصدّر فيها Qwen3.8 27B المُكيّف كل نموذج اختبرته الدراسة، بما في ذلك Claude Opus 4.8، في 250 مهمة قانونية — مع التحفظ المهم أن النموذج المُكيّف كان قد درس أولاً مجموعة بيانات الشركة المختبَرة البالغة 100M توكن، لذا فهي نتيجة عن التكييف بقدر ما هي عن النموذج. ويتضمن ظهورًا في لوحة WebDev من Code Arena والمركز الأول بين الأوزان المفتوحة في لوحة Image-to-WebDev من Arena.ai، وكلاهما ادعاءان ترتيبيان نقلهما المورّد وليسا منهجية منشورة. ويتضمن كذلك لوحة طرف ثالث بدرجة منشورة: تسجّل Artificial Analysis نموذج Qwen3.8 27B عند 33.70 على مؤشر Intelligence Index الخاص بها، بتكلفة لكل مهمة منجزة تبلغ نحو 1.01 دولار، وتنشر تفصيل الرموز الكامن وراء ذلك.
AesCode 32B لا يملك أيًا من ذلك. لا ترتيب في ساحة التقييم، ولا إدراج في لوحة الصدارة، ولا إعادة إنتاج من طرف ثالث، ولا اختبار إنتاجية مستقل — وليس لأن أحدًا بحث فيه ووجده قاصرًا، بل لأن نقطة تفتيش لا يقدمها أي مزود لا يمكن لإطار اختبار خارجي أن يقيّمها من الأساس. أرقامه هي أرقام المورّد، محسوبة بواسطة منظومة التحقق نفسها التي درّبت النموذج، على عينات اختارها المورّد، مقابل خطوط أساس شغّلها المورّد. الإصدار شفاف على نحو غير معتاد بشأن المنهجية — أسماء قنوات المكافأة، وأعداد عمليات التشغيل، ومعاملات فك التشفير، ومعدلات الفشل، كلها منشورة — لكن الشفافية حول كيفية إنتاج رقم ما لا تعادل أن ينتجه شخص آخر.
الذي يتطلب بطاقة محفوظة على الملف
هنا يتوقف النسب عن كونه معلومة ثانوية ويبدأ في كونه القرار.
AesCode 32B يطلب منك 65 غيغابايت من ذاكرة المسرّع، ومسار تقديم متعدد الوسائط، والاستعداد لتشغيل نموذج غير معلن عنه كمتبنٍّ مبكر. مثال التقديم الخاص به يمتد إلى التوازي الموترّي الرباعي، والنموذج موثّق لسياق من 24,576 رمزًا مع عدم وجود خيار مستضاف يمكن الرجوع إليه. إذا كنت تمتلك الأجهزة بالفعل وكان خط أنابيبك يحتاج حقًا إلى ضبط دقيق خاص بالتصميم، فهذه مقايضة معقولة. بالنسبة لمعظم الفرق، إنه مشروع يستغرق أسبوعين قبل أول إخراج مفيد.
Qwen3.8 27B مستضاف ذاتيًا على البنية التحتية الخاصة بـ OrcaRouter وقابل للاستدعاء اليوم مقابل 0.33 دولار لكل مليون رمز إدخال و2.40 دولار لكل مليون رمز إخراج، مع سياق يبلغ 262,144 رمزًا ومدخلات نصية وصورية وفيديو. هذه هي أسعار القائمة الممرَّرة دون أي هامش مضاف من جانبنا، وهو يعمل على المفتاح نفسه الذي تعمل عليه أكثر من 200 نموذج آخر، لذا فإن المقارنة مع أي بديل في الكتالوج هي مجرد معامل طلب لا عقد ثانٍ. هذه هي القضية العملية بأكملها، وهي قضية كبيرة: النموذج الذي يتخلف بجيل واحد عن العمود الفقري لـ AesCode 32B من حيث العائلة هو النموذج الذي يمكنك تقييمه ظهر هذا اليوم، على مطالباتك الخاصة، مقابل بضعة سنتات.
هناك نقطة ثانوية هنا يجعلها منظور التوجيه ملموسة. ولأن AesCode 32B هو ضبط دقيق لنقطة تحقق Qwen3-VL، فإن العائلة تمنحك طريقة رخيصة لاختبار ما إذا كان الجانب المستضاف من البنية يعمل على الإطلاق قبل أن تلتزم بالاستضافة الذاتية لأي شيء. يتوفر Qwen3-VL 235B A22B Instruct مقابل 0.40 دولار لكل مليون إدخال و1.60 دولار إخراج، ويتوفر Qwen3-VL 8B Instruct مقابل 0.18 و0.70. لا هذا ولا ذاك هو AesCode 32B، ولم يُدرَّب أي منهما على جودة التصميم — لكن يمكن الإجابة على سؤال «هل يستطيع نموذج لغوي بصري قراءة لقطات شاشتنا وكتابة الترميز الذي نحتاجه؟» بهما مقابل سنتات، كما أن التحويل التلقائي عند الفشل تحت نفس نقطة النهاية يعني أن يومًا سيئًا لمزوّد لا يُسقط خط المعالجة.

من الذي يجب أن يختار ماذا
خُذ AesCode 32B إذا كان المُخرَج هو المُسلَّم. إذا كنت تنتج شرائح عرض أو لوحات معلومات أو ملصقات أو تقارير بكميات كبيرة، وتحتاج إلى مخرجات منظَّمة تبقى قابلة للتحرير وإظهار الفروق — إذ يُصدر النموذج مستند HTML كاملاً، ويستخدم بنى جداول HTML حقيقية ومواصفات ECharts بحيث يبقى كلاهما قابلاً للفحص — ولديك العتاد أو الميزانية اللازمة لاستئجاره. أقدِم على ذلك وأنت متقبِّل لثلاثة أمور: عدم وجود تحقق مستقل من أي رقم، ونحو 65 GB للأوزان، وسياق بحجم 24K سيُقيّد المستندات الطويلة. إن معدل الفشل الشديد عند حدود لوحة الرسم البالغ 4.3% الذي تذكره البطاقة، مقابل 34.7% لدى GPT-5.5، هو أكثر رقم منفرد إثارةً للتفاؤل في الإصدار، وهو أيضًا رقم Microsoft.
اختر Qwen3.8 27B إذا كنت بحاجة إلى نموذج متعدد الوسائط مفتوح الأوزان يمكنك فعلاً تشغيله وخدمته فعلياً. سياق من 262 ألف رمز، قابل للتوسيع إلى مليون؛ وبصمة نشر تتلاءم حيث لا يتلاءم AesCode 32B؛ ووضع ترخيصي لا يختلف؛ وبعض القياسات المستقلة لجودته وكلفته لكل مهمة منجزة؛ وخيار مستضاف يعني أنك تستطيع البدء اليوم والاستضافة الذاتية لاحقاً دون إعادة كتابة التكامل. تصميمه المرحلي للانتباه على مستوى الطبقات هو السبب في أن السياق الطويل ميسور الكلفة، والسياق الطويل هو ما تميل خطوط أنابيب التصميم والمستندات إلى الحاجة إليه أكثر من غيره.
وإذا كنت بحاجة إلى كليهما — مولّد نماذج التصميم وعامل عام متعدد الاستخدامات — فإن التقسيم المعقول ليس تشغيل نموذجين لغويين بصريين من فئة 30B على عدّتك الخاصة. وجّه حركة المرور العامة إلى الجانب المُستضاف، واحتفظ بالمتخصص مستضافًا ذاتيًا، خلف مفتاح واحد، حيث يكون انقطاع مزوّد على أي من المسارين حدث تجاوز للفشل بدلًا من أن يكون حادثًا.

الأمر الجدير بالمتابعة
يتغير موقف AesCode 32B كليًا إذا أصبح قابلًا للاستدعاء. في الوقت الحالي، ضعف النموذج الحقيقي الوحيد هو الوصول، وهذا وضع مؤقت — فمزوّد استدلال يتبنّى نقطة التحقق، أو مايكروسوفت تنشر نقطة نهاية، يحوّل عملية شراء بحجم 65 غيغابايت إلى اختيار نموذج. وحتى ذلك الحين، فإن الملخص الصادق لهذه المواجهة هو أن النموذج المضبوط بدقة أفضل في مهمة واحدة، والنموذج العام أفضل في كونه قابلًا للاستخدام، ويصادف أن النموذج العام هو السلف: اختارت مايكروسوفت نقطة تحقق Qwen3-VL لتبني عليها لأنها كانت أقوى قاعدة متعددة الوسائط مفتوحة متاحة، وهذا بحد ذاته أكثر ما يفيد قوله في هذه المقارنة عن Qwen3.8 27B.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
