بطاقة رئيسية مُولّدة بعنوان 'Qwen 4 Max vs Kimi K3' مع عنوان فرعي 'وعد الأوزان المفتوحة يلتقي بتسليم الأوزان المفتوحة' وثلاث شارات حبّيبة الشكل نصّها 'أوزان موعودة، لكنها لم تُشحن'، و'أوزان K3 تصدر في 27 يوليو 2026'، و'رخصة MIT معدّلة'. ويقرأ سطر التذييل 'مؤتمر Alibaba Yunqi، هانغتشو'. تصميم تحريري فيكتوري مسطّح على خلفية بيضاء مع غسلة متدرّجة من الأزرق إلى السماوي، وشعار OrcaRouter مركَّب في أسفل اليمين.
Engineering & Research

Qwen 4 Max مقابل Kimi K3: وعد الأوزان المفتوحة يلتقي بوفاء الأوزان المفتوحة

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

أطلقت Moonshot AI نموذج Kimi K3 في 16 يوليو 2026، ثم فعلت الشيء الذي تتحدث عنه معظم المختبرات فقط: نشرت الأوزان. نزلت نقطة التحقق البالغة 2.8 تريليون معامل في 27 يوليو 2026 بموجب رخصة Modified MIT، بعد أحد عشر يومًا من الإطلاق. وفي الوقت نفسه، استُخدم مؤتمر Yunqi في 22 سبتمبر 2026 للإعلان عن Qwen 4 Max كالطراز الرائد لعائلة Qwen 4 المكوّنة من أربع فئات، والتي تتضمن Qwen 4 27B مفتوح الأوزان — فئة موعودة لا مُسلَّمة. هاتان الحقيقتان هما المقارنة. كل ما عدا ذلك عن Qwen 4 Max غير معروف حاليًا، والفجوة بين فئة مفتوحة موعودة وأخرى مُسلَّمة هي حيث يكون لهذه المواجهة ما تقوله فعلًا.

ما الذي طرحته Kimi K3 على الطاولة في يوليو

Kimi K3 هو خليط من الخبراء بمعاملات تبلغ 2.8 تريليون، ينشط 16 من 896 خبيرًا لكل رمز، مما يضع حوالي 104 مليار معامل في العمل عند أي خطوة معينة. يحمل نافذة سياق تبلغ 1,048,576 رمزًا على جانبي الإدخال والإخراج، ويقبل إدخال النص والصورة والفيديو مع إخراج نصي. تُسعّر واجهة برمجة التطبيقات الخاصة به من الطرف الأول بـ 3.00 دولارات لكل مليون رمز إدخال، و15.00 دولارًا لكل مليون رمز إخراج، و0.30 دولار لكل مليون رمز إدخال مخزن مؤقتًا، وأسعار الأطراف الثالثة أقل من ذلك.

البنية المعمارية هي الجزء الذي تردده معاينة Alibaba الخاصة. بُني Kimi K3 على Kimi Delta Attention وAttention Residuals، وهما — كما تزعم Moonshot — يحققان كفاءة توسّع أفضل بنحو 2.5 مرة من Kimi K2، وفك ترميز أسرع بما يصل إلى 6.3 مرة في سياقات بمليون رمز. هذه هي المشكلة نفسها التي يستهدفها QSA لدى Qwen — جعل الانتباه ميسور الكلفة عند الأطوال القصوى — ما يعني أن العائلتين لا تتنافسان على الحجم بقدر ما تتنافسان على أيّ تصميم للانتباه المتناثر يبقى صالحًا لفترة أطول.

النتائج التي نشرتها Moonshot عند الإطلاق، والمُبلَّغ عنها من المورّد ولم تُكرَّر آنذاك:

• مؤشر Artificial Analysis Intelligence Index — ‏57، وكان ثالثًا آنذاك خلف Claude Fable 5 وGPT-5.6 Sol. سُجِّل هذا الرقم في ظل مراجعة أقدم للمؤشر؛ وقد أُعيد بناء المؤشر مرّتين منذ ذلك الحين، لذا فهو قراءة تاريخية وليست قراءة حالية.

• Frontend Code Arena — المركز الأول بـ 1,679 إيلو، متقدمًا على كلا النموذجين اللذين تفوّقا عليه في المؤشر العام

• Terminal-Bench 2.1 — 88.3

• SWE-Marathon — 42، متقدّمًا على Opus 4.8 وGPT-5.6 Sol

• DeepSearchQA — 0.95، المركز الأول، وMATH-Vision 0.98، أيضًا في المركز الأول

• GPQA-Diamond — 0.94

تعترف مواد الإطلاق الخاصة بـ Moonshot نفسها بأن K3 لا يزال متأخرًا عن Claude Fable 5 وGPT-5.6 Sol في القدرة الإجمالية، وهي جملة أكثر فائدة من أيٍّ من ادعاءات المركز الأول الواردة أعلاه. والملامح المثيرة للاهتمام في الأرقام هي أن نموذجًا يحتل المركز الثالث في المؤشر العام قد حلّ أولًا في كود الواجهة الأمامية وأولًا في البحث بعيد المدى — وهو ملف يشير إلى أن المؤشر الإجمالي يخفي أداة متخصصة بدلًا من أن يصف أداة عامة.

A generated scoreboard titled 'Qwen 4 Max vs Kimi K3 - the scoreboard'. Left column 'Qwen 4 Max' reads announced not released, Qwen 4 27B promised, not published, not published, not published, not published. Right column 'Kimi K3' reads GA since July 16 2026, published July 27 2026, Modified MIT, $3.00 per 1M tokens, $15.00 per 1M tokens, 1,048,576 tokens. Footer reads 'Kimi K3 figures from Moonshot's launch material; Qwen 4 Max status per Alibaba's September 22 2026 Yunqi conference.'

ما وعدت به علي بابا، وما قيمة الوعد

أعلن إطلاق Qwen 4 عن أربع فئات. Qwen 4 Max كفئة رائدة، Qwen 4 Flash للإنتاجية العالية، Qwen 4 Plus كخيار متوازن في الوسط، وQwen 4 27B كفئة محلية مفتوحة الأوزان. وصف قائد Qwen LLM ليو دا ييهنغ العائلة بأنها تتدرب على بنية من الجيل الجديد وقال إنها ستصل قريباً. لا يوجد تاريخ، ولا بطاقة نموذج، ولا معرف API، ولا إدراج سحابي، ولا سعر، ولا نتيجة منشورة لأي من الأربعة.

هناك أمران محددان بشأن ذلك الإعلان يُنقلان بشكل خاطئ، وكلاهما يهم أي شخص يحاول التخطيط بناءً عليه:

إن رقم الـ 5 تريليونات إلى 10 تريليونات معامل المرتبط بتغطية Qwen 4 ليس مواصفة من مواصفات Qwen 4. بل ينتمي إلى خارطة طريق Qwen 4.5 وQwen 5. ولم يُنشر أي عدد للمعاملات من أي نوع بخصوص Qwen 4 Max

• استمرار أسماء الفئات لا يعني نقل المواصفات. نافذة سياق Qwen 4 Max، والسعر والترخيص غير معروفة؛ أرقام Qwen3.8-Max المتاحة — 1,000,000 رمز بسعر $2.00 و$6.00 لكل مليون — تصف نموذجًا مختلفًا.

سببُ كون فئة 27B هي الفئة المثيرة للاهتمام لا علاقة له بمعايير الأداء القياسية. فهي الفئة الوحيدة في سلسلة Qwen 4 التي جرت العادة تاريخيًا على أن تصدر بأوزان مفتوحة، وقد أظهر جيل Qwen 3.8 ما الذي يتيحه ذلك: فخلال أيام من صدور أوزان 27B، كان المجتمع قد أنتج تحويلات MLX وتكميمات NVFP4 وضبوطًا دقيقة من كل صنف. إن الإعلان عن 27B هو التزام بمنظومة بيئية لاحقة، وهو أكثر ما يمكن التنبؤ به على خارطة الطريق.

لكن القابلية للتوقع لا تتحقق. أوزان Kimi K3 هي ملف يمكنك تنزيله اليوم. أما أوزان Qwen 4 27B فهي مجرد سطر في محاضرة بمؤتمر.

الأوزان المفتوحة والأوزان القابلة للتشغيل ادعاءان مختلفان

ثمة فخ في التعامل مع Kimi K3 بوصفه جواب الأوزان المفتوحة، ويجدر قوله صراحةً لأنه أكثر ادعاء مبالَغ فيه شيوعًا في التغطية للنماذج الصينية المتقدمة. فنموذج مزيج الخبراء ذو 2.8 تريليون معامل هو نتاج بمقياس مراكز البيانات. والأوزان المنشورة تعني أنه مسموح لك بتشغيله، ويمكنك تفحصه، وضبطه الدقيق، وتكميمه. لكنها لا تعني أنك تستطيع تشغيله على محطة عمل. فالخدمة الفعّالة لنقطة تفتيش بهذا الحجم تتطلب عشرات من المسرّعات، وعمل التكميم الذي يعقب إصدارًا مفتوحًا — المتغيرات على نمط NVFP4 وREAP التي تنتشر خلال أسابيع — يتعلق بجعل النموذج قابلًا للخدمة بقدر ما يتعلق بجعله أصغر.

إذن، القراءة الصادقة لرخصة Kimi K3 هي قراءة أضيق نطاقًا لكنها تظل مهمة: فهو نموذج طليعي قابل للتدقيق والتعديل والاستضافة الذاتية، بموجب رخصة MIT المعدلة، للمؤسسات التي تملك العتاد اللازم لتشغيله وتقديمه. ذلك أصل استراتيجي حقيقي، وهو خيار غير مناسب لأي شخص قرأ "الأوزان المفتوحة" على أنها "تعمل على حاسوبي المحمول".

سينطبق التحذير نفسه على Qwen 4 27B إذا ما طُرح ومتى طُرح — وينطبق بحدّة أقل، لأن فئة بأوزان مفتوحة بحجم 27B هي ذات نطاق محلي حقيقي، في حين أن نموذجًا رائدًا بحجم 2.8T ليس كذلك. ولهذا تحديدًا تستحق فئة Qwen 4 27B اهتمامًا أكبر من فئة Max في هذه المقارنة، حتى وإن كانت فئة Max هي ما استُهلّ به الإعلان.

A screenshot of the OrcaRouter model page for Kimi K3 (kimi/kimi-k3), captured September 22 2026, showing the model name, the 1M token context, text and image input with text output, vision, tool and reasoning badges, and a p50 time-to-first-token figure.

السؤال التجاري الكامن وراء مسألة الترخيص

يمثل سعر Kimi K3 لدى الطرف الأول، البالغ 3.00 دولارات للمدخلات و15.00 دولارًا للمخرجات لكل مليون توكن، موقعًا تسعيريًا متميزًا، وقد كانت Moonshot صريحة في أن هذا السعر يقع عمدًا فوق الطرف الرخيص من السوق الصيني. وبالمقارنة مع Qwen3.8-Max عند 2.00 و6.00 دولارات، فإن ذلك يبلغ مرة ونصف معدل المدخلات ومرتين ونصف معدل المخرجات — وهي فجوة كبيرة بما يكفي بحيث يتعين على أي عبء عمل أن يهتم بنقاط قوة Kimi K3 المحددة، ومنها كود الواجهات الأمامية والبحث طويل الأفق، كي تستحق هذه العلاوة دفعها.

يوجّه OrcaRouter نموذج kimi/kimi-k3 إلى جانب عائلة Qwen 3.8 عبر نقطة نهاية واحدة متوافقة مع OpenAI وبهامش ربح 0%، ما يعني أنك تُحاسَب بسعر القائمة المعلن من المزوّد لا بسعر مكافئ مضاف إليه هامش ربح. في مقارنة يكون فيها فارق السعر معامل 2.5 على المخرجات، فإن غياب هامش المنصة ليس تفصيلًا هامشيًا — فطبقة بنسبة عشرة في المئة على سعر مخرجات قدره 15.00 دولارًا تعني 1.50 دولارًا لكل مليون رمز، وهو أكثر من كامل تكلفة الإدخال للنموذج الأرخص في هذه المقارنة. وتوفّر نقطة النهاية نفسها التجاوز التلقائي عند الفشل ولغة DSL للتوجيه للتعبير عن السياسة صراحةً، وهي الطريقة التي تجرّب بها نموذجًا بملف Kimi K3 على شريحة من حركة الإنتاج دون المخاطرة بمسار كامل على مزوّد لم تجرّبه من قبل.

ما لا يوفّره OrcaRouter هو Qwen 4 Max أو أي فئة من Qwen 4، لأن أياً منها لا يوجد كمنتج حتى الآن.

A screenshot of the OrcaRouter models catalogue, captured September 22 2026, showing the filter sidebar (input modalities, context length, input price, status, series), the model card grid and a code sample posting to the OpenAI-compatible endpoint at api.orcarouter.ai.

ما الذي يجب متابعته، وما الذي يجب تجاهله

ثمة ثلاث إشارات من شأنها أن تغيّر هذه المقارنة، وهي محددة بما يكفي لمراقبتها:

• أوزان Qwen 4 27B. ليس جدول المعايير الخاص بفئة Max — بل نقطة التفتيش 27B، وترخيصها وحجمها. ذلك هو الإصدار الذي سيخبرك ما إذا كان التزام علي بابا بالأوزان المفتوحة في هذا الجيل حقيقيًا بقدر ما كان في الجيل السابق.

• ترخيص Qwen 4 Max، إن وُجد. إذا نشرت علي بابا الأوزان لنموذجها الرائد بالطريقة التي فعلتها مع Qwen3.8-Max، فإن حجة الأوزان المفتوحة في هذه المواجهة تكفّ عن كونها ميزة لـKimi وتصبح تعادلًا.

• قراءة مستقلة جديدة حول Kimi K3. كانت درجات الإطلاق التي أعلنتها Moonshot مُبلَّغًا عنها ذاتيًا، وقد أُعيد بناء مؤشر Artificial Analysis مرتين منذ ذلك الحين، لذا يحتاج كل من 57 وFrontend Code Arena Elo إلى إعادة تأسيس قبل مقارنتهما بأي شيء حالي

ما يجب تجاهله هو أي جدول مواصفات لـ Qwen 4 Max يظهر قبل أن تنشر Alibaba بطاقة نموذج، وأي ادعاء بأن الأوزان المفتوحة لـ Kimi K3 تجعلها قابلة للتشغيل محليًا. كلا الخطأين منتشران بالفعل. في غضون ذلك، المقارنة التي يمكنك العمل وفقها هي بين نموذجين موجودين: Kimi K3 بسعر مرتفع مع أوزان مُسلَّمة وملف برمجي متمايز حقًا، وQwen3.8-Max بأقل من نصف سعر الإخراج مع نافذة ثابتة بمليون رمز وأوزان خاصة به. هذا خيار حقيقي، مسعّر على الجانبين، ولا يتطلب انتظار شريحة مؤتمر كي تصبح منتجًا.

مقارنات في هذه المقالة3

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا