
Qwen 3.8 مقابل Kimi K3: عملاقان صينيان، والآن أحدهما أرخص
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 177 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1323 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
هذان هما النموذجان الصينيان الأكثر تأثيرًا من نماذج الحدود لعام 2026، وهما قريبان جدًا: كلاهما نظامان ضخمان متناثران من نوع خليط الخبراء، وكلاهما بسياق يبلغ 1M-token، وكلاهما متعدد الوسائط، وكلاهما يعد بأوزان مفتوحة. Kimi K3 من Moonshot هو في الواقع الأكبر من الاثنين بمعاملات إجمالية تبلغ 2.8T مقابل 2.4T لدى Qwen — تذكير مفيد بأن عدد المعاملات ليس ترتيبًا.
حتى 3 أغسطس 2026، كانت هذه المقارنة منحازة بطريقة معينة: حصلت Kimi K3 على مؤشر Artificial Analysis Intelligence Index مُدقَّق بقيمة 57.1، وترتيب LMArena الأول في كود الواجهة الأمامية، وأسعارًا منشورة، وأوزانًا مطروحة، بينما Qwen3.8-Max كان لديه رقم بارز هو 2.4 تريليون فقط ولا شيء آخر. التوفر العام غيّر المعادلة الاقتصادية بشكل حاسم. تنشر Qwen الآن 2 دولار / 6 دولارات لكل مليون توكن مقابل 3 دولارات / 15 دولارًا من Kimi — الأمر الذي يجعل النموذج الأكبر والأكثر إثباتًا هو الأغلى بفارق كبير.
ملاحظة للمطورين — أسرع طريقة لحسم هذا الأمر هي تشغيل كليهما على مطالباتك الخاصة. يوفر OrcaRouter أكثر من 200 نموذج خلف نقطة نهاية واحدة متوافقة مع OpenAI، بحيث يمكنك مقارنة Qwen 3.8 Max بـ Kimi K3 في المهمة نفسها دون ربط اثنين من SDKs.
الخلاصة: الحكم. لا تزال Kimi K3 تتفوق على صعيد الإثبات: بتدقيق مستقل لمؤشر AA Intelligence Index بدرجة 57.1 (#3)، المركز الأول في LMArena frontend-code برصيد 1679، وأوزان مفتوحة جاهزة فعلاً. لا تزال Qwen3.8-Max بلا تقييم من أي مُقيِّم مستقل. لكن GA منحت Qwen ميزتين حقيقيتين. ففي السعر أصبحت الآن أرخص بكثير — $2 / $6 مقابل $3 / $15، أي بتكلفة أقل بمقدار 2.5 مرة على المخرجات. وفي الاختبار المستقل المباشر الوحيد المتاح، خسرت Qwen النتيجة الرئيسية 80 مقابل 83 بينما كانت الوكيل الأفضل سلوكًا بشكل واضح: 354 إشارة إلى المستودعات مقابل 274، و22 طلب بوابة مقابل 53، وصفر استدعاءات أدوات فاشلة مقابل اثنين. Kimi للجودة المُدقَّقة؛ وQwen للتنفيذ الوكيلي الأرخص والأكثر نظافة.
النقاط الرئيسية
• Kimi K3 هو النموذج الأكبر — بمعمارية MoE بسعة 2.8T مقابل 2.4T لدى Qwen، أي بزيادة 400B تقريبًا — وهي حجة قوية ضد اعتبار عدد المعلمات مقياسًا للقدرة.
• أصبح Qwen3.8-Max متاحًا بشكل عام منذ 3 أغسطس 2026 بسعر $2 / $6 لكل مليون رمز بمعدل ثابت، مقارنةً بـ Kimi K3 $3 / $15 (متوسط AA حوالي 2.31 دولار). أصبح Qwen الآن أرخص بمقدار 2.5× في المخرجات.
• تحمل Kimi K3 المرتبة المدققة: AA Intelligence Index 57.1 (#3)، ولا تتقدم عليها إلا Fable 5 وGPT-5.6 Sol، بالإضافة إلى LMArena frontend-code #1 (1679). أما Qwen3.8-Max فهو غير مُقيَّم بعد.
• في الاختبار المباشر الوحيد (Trilogy AI)، تفوقت Kimi على Qwen بنتيجة 83 مقابل 80 بشكل عام — لكن Qwen حققت المزيد من استشهادات المستودعات (354 مقابل 274)، طلبات بوابة أقل (22 مقابل 53)، ولم يكن لديها أي استدعاءات أدوات فاشلة (مقابل اثنين)، مع تقييم استخدام أدوات 9/10 مقابل 8/10 لـ Kimi.
• تُبلِّغ Qwen الآن عن أرقام الوكلاء والبرمجة: Terminal-Bench 2.1 86.6، OSWorld-Verified 86.1، FrontierSWE 73.5 (من 40.7 للنسخة السابقة) — جميعها مُبلَّغة من Alibaba.
• لا يزال توقيت الانفتاح في صالح كيمي: أوزانه جاهزة بشكل أساسي؛ أما أوزان Qwen فمن الموعود توفيرها خلال الأسبوع، دون ترخيص أو مستودع بعد.
ملاحظة حول الدقة: جميع أرقام جودة Qwen3.8-Max مُعلنة من Alibaba ولم يتم التحقق منها من قبل أطراف ثالثة. أرقام Kimi K3 مأخوذة من Artificial Analysis وLMArena. المقارنة المباشرة هي اختبار واحد من Trilogy AI ويجب النظر إليها كنقطة بيانات واحدة، وليس ترتيبًا عامًا. تسعير Qwen هو بطاقة أسعار GA ويلغي خصم المعاينة الخاص بشهر يوليو.
المواصفات والسعر، جنبًا إلى جنب
هذه هي البيانات الدقيقة، كل رقم منسوب إلى مصدره.
• المطوّر / الحالة — Qwen3.8-Max: Alibaba؛ GA (3 أغسطس 2026)؛ Kimi K3: Moonshot؛ إصدار مفتوح الأوزان
• البنية — Qwen3.8-Max: ~2.4T إجمالي، MoE متناثر (المعلمات النشطة لم تُكشف بعد)؛ Kimi K3: 2.8T MoE، رؤية أصلية (Artificial Analysis)
• نافذة السياق — Qwen3.8-Max: 1M توكن (983,616 مع التفكير؛ الحد الأقصى للإخراج 131,072)؛ Kimi K3: 1M توكن (Artificial Analysis)
• AA Intelligence Index — Qwen3.8-Max: لم يُقيَّم بعد؛ Kimi K3: 57.1 — #3 (Artificial Analysis)
• الساحة / لوحة الصدارة — Qwen3.8-Max: لم يتم تقييمه علنًا؛ Kimi K3: Frontend-code #1، 1679 (LMArena)
• نتائج مُبلَّغ عنها من المُورِّد — Qwen3.8-Max: Terminal-Bench 2.1 86.6, GPQA Diamond 92.6, OSWorld-Verified 86.1 (مُبلَّغ عنها من Alibaba)؛ Kimi K3: النتيجة مُقاسة من طرف ثالث
• التسعير (الإدخال / الإخراج) — Qwen3.8-Max: $2.00 / $6.00 لكل 1 مليون، بسعر ثابت؛ الإدخال المخزّن مؤقتًا $0.25؛ Kimi K3: $3 / $15 لكل 1 مليون (AA المجمّع ~$2.31)، مرات الوصول إلى ذاكرة التخزين المؤقت $0.30
• أوزان مفتوحة — Qwen3.8-Max: موعود خلال الأسبوع (لا ترخيص بعد)؛ Kimi K3: أوزان مفتوحة؛ الأوزان جاهزة
• السرعة — Qwen3.8-Max: p50 TTFT 1.64s (بيانات OrcaRouter لآخر 7 أيام)؛ Kimi K3: مطوّل وبطيء (~34s TTFT، وفقًا لـ AA)
أمران يؤطران هذه المقارنة، وقد انعكس أحدهما تماماً في الثالث من أغسطس.
أولًا، انقلبت العلاقة السعرية.خلال شهر يوليو، كان Kimi K3 هو النموذج ذو السعر الحقيقي، بينما كان Qwen هو النموذج الذي يحمل قسيمة خصم. الآن ينشر كلاهما أسعاره، والنموذج الأكبر والأكثر إثباتًا هو الأغلى سعرًا: $3 / $15 مقابل $2 / $6. بالنسبة للمخرجات — حيث يُنفق المال على الاستدلال وتوليد الكود — تبلغ تكلفة Kimi 2.5× أكثر. كما يفرض Qwen سعرًا ثابتًا على سياقه الكامل البالغ 1M توكن، وسعره للمدخلات المخزنة مؤقتًا عند $0.25 يقل قليلًا عن سعر إصابة الكاش لدى Kimi البالغ $0.30. بالنسبة لأي عبء عمل عالي الحجم، أصبحت اقتصاديات Qwen أفضل بوضوح الآن.
ثانيًا، فجوة الإثبات لم تتغير، وهي السبب في أن كيمي لا يزال يفوز. تحتل كيمي K3 المركز الثالث إجمالاً بمؤشر ذكاء يبلغ 57.1، خلف Fable 5 وGPT-5.6 Sol فقط — وهذا هو حكم مُقيّم محايد. إن احتلالها المركز الأول (#1) في LMArena frontend-code برصيد 1679 هو نتيجة جماعية مستمدة من مقارنات عمياء عديدة. أما نتائج Qwen في Terminal-Bench 86.6 وGPQA Diamond 92.6 فهي أرقام حقيقية لكنها من إنتاج Alibaba نفسها، وعلى إطار اختبار لم يشغّله أي شخص آخر. مرجع مفيد: النسخة السابقة Qwen3.7-Max سجّلت 46 على مؤشر AA مقابل 57.1 لكيمي، لذا تحتاج Qwen إلى قفزة جيلية كبيرة لمجرد الوصول إلى التعادل.
هناك أيضًا تفصيل متعلق بزمن الاستجابة يستحق الذكر، لأنه يتعارض مع السردية المعتادة. تقيس Artificial Analysis أن Kimi K3 يبلغ زمن الوصول إلى أول رمز حوالي 34 ثانية — وهو بطيء فعلًا. بينما تُظهر بيانات OrcaRouter التشغيلية أن Qwen3.8-Max يسجّل زمن وصول إلى أول رمز بنسبة p50 يبلغ 1.64 ثانية. تلك القياسات مأخوذة من مصادر مختلفة وليست مقارنة مضبوطة، لكنها تعقّد الافتراض السائد في مرحلة ما قبل الإطلاق بأن Qwen هي الأبطأ بين الاثنين.

الاختبار المباشر الوحيد، اقرأ بعناية
هذه هي المواجهة الوحيدة في السلسلة التي أجرى فيها طرف ثالث اختبارًا للنموذجين ضد بعضهما البعض على نفس المهمة، مما يجعلها جديرة بالقراءة المتأنية بدلًا من تلخيصها إلى فائز.
قامت Trilogy AI بمهمة فهم البنية المعمارية — لفهم مستودع حقيقي والتوصل إلى استنتاج معماري صحيح — وقامت بتقييم النتائج:
• النتيجة الإجمالية — Qwen3.8-Max: 80 / 100؛ Kimi K3: 83 / 100
• استشهادات المستودع — Qwen3.8-Max: 354؛ Kimi K3: 274
• طلبات البوابة — Qwen3.8-Max: 22; Kimi K3: 53
• استدعاءات الأدوات الفاشلة — Qwen3.8-Max: 0؛ Kimi K3: 2
• تقييم استخدام الأدوات — Qwen3.8-Max: 9 / 10؛ Kimi K3: 8 / 10
• معدل إصابة التخزين المؤقت — Qwen3.8-Max: >90%؛ Kimi K3: >90%
تقدم كيمي في العناوين بثلاث نقاط. لكن انظر إلى أعمدة العمليات، فهي بالنسبة لهندسة الوكلاء أهم من النتيجة. توصل Qwen إلى نفس الاستنتاج المعماري الأساسي باستخدام أقل من نصف طلبات البوابة بينما أنتج استشهادات تأسيسية أكثر بنسبة 29% و — وهو التفصيل الذي ينبغي أن يثير اهتمام أي شخص يبني وكلاء — صفر استدعاءات أدوات فاشلة مقابل اثنين لكيمي.
فشل استدعاءات الأدوات هو ما يكسر فعليًا أنظمة الإنتاج. فهي تتسلسل: فاستدعاء غير صحيح ينتج خطأً يجب على النموذج تفسيره، مما يستهلك دورات، مما يزيد خطر الأخطاء. النموذج الذي ينفذ 22 طلبًا سليمًا بينما ينفذ آخر 53 طلبًا مع فشلين يكون أقل تكلفة وأكثر قابلية للتنبؤ في التشغيل، حتى لو سجل ثلاث نقاط أقل في الإجابة. وبالاقتران مع معدل إخراج Qwen الأرخص بمقدار 2.5 مرة، فإن الاقتصاديات التشغيلية لتلك الجولة ترجح كفة Qwen بشكل كبير.
التحذير هو أن هذه مهمة واحدة، ومقيّم واحد، وتشغيل واحد. إنها ليست مجموعة معايير قياسية ولا يمكن تعميمها. إن مؤشر Kimi البالغ 57.1 وترتيبه الأول في الواجهة الأمامية يعتمدان على أدلة أكثر بكثير مما يقدمه هذا الاختبار الواحد. الاستنتاج الصحيح ضيق: في مهمة واحدة واقعية على الأقل من المهام الوكيلية، كان Qwen مستخدم الأدوات الأكثر انضباطًا بينما خسر قليلًا في جودة المخرجات.

التكلفة عمليًا: تشغيل النُظم الوكيلة بكميات كبيرة.
خذ وكيل تحليل مستودع: 250,000 توكن من سياق الكود لكل تشغيل، و12,000 توكن من المخرجات.
• Qwen3.8-Max: 0.25M × $2 = $0.50، زائد 0.012M × $6 = $0.072. ≈ $0.57 لكل تشغيل.
• Kimi K3: 0.25M × $3 = $0.75، زائد 0.012M × $15 = $0.18. ≈ $0.93 لكل تشغيلة.
• عند 1,500 تشغيل/يوم: Qwen ≈ $858/يوم؛ Kimi ≈ $1,395/يوم — بفارق يقارب $16,000 شهريًا.
• مع التخزين المؤقت على مستودع مستقر: مدخلات Qwen المخزنة بسعر $0.25/1M تجعل التكلفة تصل إلى ≈ $0.14؛ معدل إصابة التخزين المؤقت لدى Kimi البالغ $0.30 يجعلها تصل إلى ≈ $0.26.
الفجوة حقيقية في كلا الطرفين، ونتيجة Trilogy تزيدها تفاقمًا: إذا كانت Qwen تستخدم فعليًا أقل من نصف طلبات البوابة لإنجاز عمل مماثل، فإن الفرق الفعلي في التكلفة على المهام الوكيلة أوسع مما يوحي به جدول الأسعار وحده.
كلا النموذجين يعاملان رموز التفكير كناتج، لذا فإن التكوينات التي تعتمد على التفكير بكثافة تكلف أكثر من التقدير الساذج على أي من الجانبين — لكن سعر Qwen البالغ 6 دولارات يجعل هذه العقوبة أصغر بمقدار 2.5 مرة.
الانفتاح: شبه التكافؤ، توقيت مختلف
هذا هو المحور الذي يتشابه فيه الاثنان أكثر، والفرق يتعلق بالجاهزية فقط. أوزان Kimi K3 مفتوحة وجاهزة بشكل أساسي. أما أوزان Qwen3.8-Max فموعود بها خلال الأسبوع، دون نص ترخيص أو بطاقة نموذج أو مستودع حتى الآن — والترخيص هو ما يحدد ما إذا كان يمكنك استخدام النموذج تجاريًا من الأساس.
عمليًا، لا يمكن لأي فريق عادي استضافة أيٍّ من النموذجين الرائدين ذاتيًا. نموذج Qwen بحجم 2.4T يبلغ تقريبًا 1.2TB بدقة 4-bit مقارنة بحوالي 141GB لكل H200؛ أما Kimi بحجم 2.8T فهو أكبر من ذلك. كلاهما يحتاج إلى ثمانية أو أكثر من المسرعات عالية المستوى، وعدم إفصاح Alibaba عن عدد المعاملات النشطة يعني أنك لا تستطيع حتى نمذجة إنتاجية Qwen.
ولهذا السبب فإن النموذج المُعلَن عنه بالتزامنQwen3.8-27B مهم هنا. كما أن كونه مفتوح الأوزان ويُقال إنه يعمل بحوالي17GB من VRAM، يمنح عائلة Qwen قصة نشر محلي حقيقية لا توفرها النماذج الرائدة 2.4T ولا 2.8T. إذا كانت الأوزان المفتوحة هي سببك الفعلي للاختيار بين هذين النموذجين، فإن 27B يغير المعادلة أكثر مما يفعله أي من العملاقين.
الأسئلة الشائعة
هل Qwen 3.8 أفضل من Kimi K3؟
ليس على أدلة مدققة. تحمل Kimi K3 مؤشر AA للذكاء المستقل البالغ 57.1 (#3) والمركز الأول في كود الواجهة الأمامية على LMArena، بينما يبقى Qwen3.8-Max دون تقييم من أي جهة تقييم خارجية. في الاختبار المباشر الوحيد المتاح، فاز Kimi بنتيجة 83 مقابل 80. مزايا Qwen هي السعر (إخراج أرخص بـ2.5 مرة) وفي الاختبار نفسه، استخدام أنظف للأدوات.
أي نموذج أكبر؟
كيمي كي3، بإجمالي معاملات يبلغ 2.8 تريليون مقابل 2.4 تريليون لـ Qwen3.8-Max — أي ما يزيد بنحو 400 مليار. غير أن هذا الرقم ليس ذا دلالة كافية، إذ لم تنشر Alibaba قط عدد المعاملات النشطة لنموذج Qwen، وهو الرقم الذي يحدد فعليًا تكلفة التشغيل في نموذج خليط الخبراء (Mixture-of-Experts).
أيهما أرخص؟
Qwen3.8-Max، بوضوح، منذ الإتاحة العامة. يقدّم تسعيرة 2 دولار / 6 دولار لكل مليون رمز مقارنةً بتسعيرة Kimi K3 البالغة 3 دولار / 15 دولارًا — أي أقل بنسبة 33% على الإدخال وأقل بمقدار 2.5 مرة على الإخراج. معدّل Qwen ثابت عبر كامل سياق المليون رمز، كما أن إدخاله المخزّن بسعر 0.25 دولار يقلّل قليلًا عن معدّل اصطدام الكاش الخاص بـ Kimi البالغ 0.30 دولار.
ماذا أظهر اختبار المواجهة في الواقع؟
مهمة فهم البنية المعمارية من Trilogy AI منحت Kimi 83 و Qwen 80. لكن Qwen أنتج 354 اقتباسًا من المستودعات مقابل 274 لـ Kimi، واستخدم 22 طلب بوابة مقابل 53، وسجّل صفرًا من استدعاءات الأدوات الفاشلة مقابل اثنين، وحصل على 9/10 في استخدام الأدوات مقابل 8/10 لـ Kimi. قدّم Kimi إجابة أفضل؛ بينما كان Qwen العميل الأكثر انضباطًا. إنها مهمة واحدة، لذا تعامل معها كنقطة بيانات وليس كتصنيف.
هل خرج Qwen 3.8 Max من مرحلة المعاينة؟
نعم، في 3 أغسطس 2026، مع بطاقة أسعار منشورة ونقطة نهاية متوافقة مع OpenAI وDashScope. لم تعد حملة أرصدة Qoder لشهر يوليو تصف كيفية بيعها.
أيهما أسرع؟
ربما كيوين الآن، وهو ما يقلب الافتراض السائد في عصر المعاينة. يقيس تحليل الاصطناعي (Artificial Analysis) كيمي كي3 بحوالي 34 ثانية للوقت حتى أول رمز؛ بينما تُظهر بيانات القياس عن بعد لأوركاروتر على مدى 7 أيام من الإصدار العام أن كيوين3.8-ماكس يحقق متوسط p50 للوقت حتى أول رمز قدره 1.64 ثانية. المصادر مختلفة وليست مقارنة مضبوطة، لكن كلا النموذجين يتمتع بسمعة الإسهاب، والوقت المقاس حتى أول رمز لكيمي بطيء بحق.
هل يمكنني استضافة أي منهما بنفسي؟
ليس واقعيًا على نطاق النماذج الرائدة — تتطلب نماذج 2.4T و2.8T ثماني وحدات معالجة رسومية أو أكثر من فئة H200. أوزان Kimi جاهزة اليوم، بينما أوزان Qwen موعودة خلال الأسبوع دون ترخيص حتى الآن. أما بالنسبة لخيار محلي فعلي (on-premise)، فإن Qwen3.8-27B المُعلن عنها بالتزامن (بحوالي 17GB من VRAM) هي الخيار العملي في عائلة Qwen.
الخلاصة
Qwen 3.8 مقابل Kimi K3 هي أقرب مواجهة في هذه السلسلة، وقد فصل التوفّر العام بينهما بجلاء على محورين. تحتفظ Kimi K3 بتاج الجودة بفضل ما قاسه حَكَم: 57.1 على Intelligence Index، والمرتبة الثالثة إجمالًا، وأعلى مرتبة في كود الواجهة الأمامية لدى LMArena. هذه ليست ادعاءات — بل نتائج، وليس لدى Qwen أي ما يعادلها.
ما كسبته Qwen في 3 أغسطس هو الجانب الاقتصادي، وفازت به بشكل حاسم: 2$ / 6$ مقابل 3$ / 15$، بشكل ثابت عبر مليون رمز، مع تخزين مؤقت أرخص قليلاً. أضف إلى ذلك اكتشاف Trilogy أن Qwen أنجزت مهمة وكيلية مماثلة بنصف طلبات البوابة وصفر من استدعاءات الأدوات الفاشلة، وستبدو Qwen النموذج الأكثر كفاءة تشغيليًا حتى حيث تكون الأقل دقة. راقب حدثين: أول درجة مستقلة من مؤشر الذكاء لـ Qwen3.8-Max، ووصول الأوزان مع ترخيص. إذا سجلت Qwen أي درجة قريبة من 57.1 لنموذج Kimi، فإن فجوة السعر تجعل من الصعب جدًا تبرير استخدام Kimi للأعمال ذات الحجم الكبير. وإلى ذلك الحين، Kimi هو النموذج الذي تثق به وQwen هو النموذج الذي يمكنك تحمل تكلفة تشغيله — والطريقة الصادقة للاختيار هي على مستودعاتك الخاصة.

مقارنات في هذه المقالة3
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
