
Nex-N2.5 Pro ضد Kimi K3: المواجهة التي تحكُم فيها بطاقة معايير الوافد الجديد
- openaiجديدOpenAI: GPT-6 Astra2026-09-0455الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0247الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0247الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0157الذكاء82البرمجة
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2646الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1849الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1541الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1251الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0547الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0347الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2140الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128الذكاء49البرمجة
تأمّل الأرقام المشتركة بين Nex-N2.5 Pro وKimi K3 وستعرف من الذي زوّدهما بها. Nex-AGI أعلنت عن Nex-N2.5 Pro في 8 سبتمبر 2026 — وهو وكيل متعدد الوسائط يضم 397 مليار معلمة، يُفعَّل منها نحو 17 مليارًا — وما تزال أوزانه مُعلَّمة بأنها «قريبًا». وقد نشرت الشركة جدول معايير يُدرج مباشرةً نموذج Kimi K3 من Moonshot AI في الأعمدة نفسها. أما Kimi K3 فهو النموذج الرئيسي مفتوح الأوزان الذي يضم 2.8 تريليون معلمة، طرحته Moonshot في 16 يوليو 2026 بنافذة سياق تبلغ مليون توكن، وأصدرت أوزانه الكاملة بعد أحد عشر يومًا بموجب ترخيص MIT معدَّل، وحصل على 57 على مؤشر Artificial Analysis Intelligence Index، ما يجعله النموذج مفتوح الأوزان الأعلى ترتيبًا على اللوحة. وفي صفٍّ تلو الآخر من ذلك الجدول، يتأخر Nex-N2.5 Pro عن Kimi K3: إذ يسجّل في Terminal-Bench 2.1 درجة 82.7 مقابل 88.3 لـK3، وفي BrowseComp 89.7 مقابل 91.2، وفي SWE-Bench Pro 61.2 مقابل 63.3، وفي AutomationBench 44.2 مقابل 46.7. وعندما تنشر إحدى الشركات أرقام نموذجها الخاص بجوار المتصدّر الحالي بين النماذج مفتوحة الأوزان، ويخسر نموذجها معظم الصفوف، فإن أكثر ما يثير الاهتمام في هذه المقارنة هو أن الجدول على الأرجح يقول الحقيقة.
هذا هو الشكل غير المألوف لهذه المقارنة. عادةً ما تكون بطاقة النموذج الجديد هي الموضع الذي يُتوقَّع فيه العثور على التلميع الدعائي. أما هنا، فالبطاقة هي أقربُ ما لدى أيٍّ من النموذجَين إلى حَكَمٍ نزيه، فلم يكن لدى Nex-AGI أيُّ سببٍ لنشر جدولٍ ينتقص من فئة Pro الخاصة بها — والصفوف التي يتفوّق فيها Pro على K3 هي بالضبط الصفوف التي يُفترض أن يتفوّق فيها نموذجٌ صغيرٌ مصمَّمٌ خصيصًا لمهام استخدام الحاسوب على نموذجٍ عامٍّ أكبرَ بكثير. لذا فإن السؤال الحقيقي الذي تجيب عنه هذه الصفحة أضيقُ نطاقًا وأكثرُ فائدةً من «أيهما أفضل؟»: هل تصمد المكانةُ التي تدّعيها Nex-N2.5 Pro — وهي أداءٌ وكيليٌّ يقارب K3 بنحو سُدس المعلمات النشطة فقط — أمام حقيقة أن Kimi K3 موجودٌ فعلًا، وأوزانُه مطروحةٌ فعلًا، وهو بالفعل النموذجُ الذي يجب التغلّبُ عليه؟
الخصم، بالكامل
كيمي K3 ليس نموذجًا متخصصًا، وهذا بالضبط ما يجعله المعيار الصحيح. إنه النموذج الرئيسي لـ Moonshot: معاملات إجمالية تبلغ 2.8T مع 104B نشطة في تصميم Stable LatentMoE، وسياق يبلغ مليون رمز مع ميزانية إخراج تضاهيه، وفهم فطري للنصوص والصور والفيديو، واستدلال دائم التشغيل، وأوزان مفتوحة يمكن لأي شخص يملك ما يكفي من الأجهزة تشغيلها فعليًا. مكانته المستقلة قوية — مؤشر الذكاء البالغ 57 (من Artificial Analysis) يتصدر جميع نماذج الأوزان المفتوحة الأخرى، وسجل 1,679 إيلو في Frontend Code Arena متقدمًا على Claude Fable 5 وGPT-5.6 Sol — بينما يقع سعره، البالغ 3.00 دولارات لكل مليون رمز إدخال و15.00 دولارًا لكل مليون رمز إخراج مع 0.30 دولارًا للإدخال المخزّن مؤقتًا، في الطرف المتميز من طبقة الأوزان المفتوحة. كيمي K3 هو ما يبدو عليه "الحدودي والمفتوح" عندما لا يتنازل المورّد عن الحجم: فهو يكلف أكثر لكل رمز من المنافسين المغلقين مثل GPT-5.6 Sol على الإخراج، ومن المكلف تشغيله، ومن الصعب جدًا مجادلته في لوحات الصدارة.
حسابُ المُتحدّي
إن Nex-N2.5 Pro لا يحاول التفوق على Kimi K3 في الحجم، بل يحاول التفوق عليه في الخدمة. قامت Nex-AGI بتدريب طبقة Pro لاحقًا انطلاقًا من قاعدة من سلالة Qwen3.5 لتصبح وكيلًا بصريًا أصليًا لتشغيل أجهزة الكمبيوتر والمتصفحات، وفكرتها الأساسية هي الكفاءة: إجمالي 397B / حوالي 17B نشط، وسياق يبلغ 262K، ووصفة نشر على عقدة واحدة بـ 8×H100، مقابل 2.8T / 104B نشط لدى K3 ونوع أسطول الخدمة الذي يتطلبه نموذج بهذا الحجم. الحجة الضمنية هي أن متخصصًا نشطًا بـ 17B، مدربًا خصيصًا على حلقة الوكيل ذات التغذية البصرية الراجعة، يمكنه تقديم معظم الأداء الوكيلي لنموذج عام نشط بـ 104B بتكلفة خدمة أقل بكثير. وعلى بطاقة Nex-AGI الخاصة، الادعاء معقول لكنه جزئي: Pro يتفوق على K3 أو يعادله في OSWorld-G (87.4 مقابل 79.6) وOmniDoc (92.2 مقابل 91.1)، ويخسر بقية الصفوف المشتركة بفارق رقم واحد فقط — نموذج 397B يخسر أمام نموذج 2.8T بفارق 3 إلى 6 نقاط في البرمجة والتصفح هو، إذا كان صحيحًا، بالضبط قصة الكفاءة التي تريد Nex أن ترويها.
إذا صحّ هذا، فكل رقم من تلك الأرقام هو من إنتاج Nex-AGI نفسها؛ فقد أُنتج جزئيًا على الأقل عبر منصة اختبارها الداخلية NexCUA. ولا يمكن التحقق من Nex-N2.5 Pro بشكل مستقل اليوم لأن أوزانه غير قابلة للتنزيل — فمستودع Hugging Face لا يضم سوى ملف README ومجلدًا للرسومات البيانية ولافتة كُتب عليها «الأوزان قادمة قريبًا»، لا شيء أكثر. وينطبق التحفّظ نفسه على أرقام جانب K3 التي توردها البطاقة، وقد جمعت Nex معظمها من تقارير Moonshot المنشورة لا من قياساتها الخاصة. وما يثبته جدول Nex-AGI ليس من يفوز، بل أن مهندسي Nex-AGI أنفسهم — وهم من اختاروا المعايير ومنصة الاختبار — لم يتمكنوا من جعل فئة Pro لديهم تتفوق على Kimi K3 في معظم المعايير المشتركة. وهذه معلومة أنفع من أي نتيجة منفردة، لأنها تضع حدًّا أعلى لمدى المبالغة التي يمكن أن يبلغها التسويق.

الصفوف المهمة، جنبًا إلى جنب
• Scale — Nex-N2.5 Pro: 397B total / ~17B active, Qwen3.5-lineage multimodal. Kimi K3: 2.8T total / 104B active, Stable LatentMoE, multimodal.
• الأوزان — Nex-N2.5 Pro: وُعِد به ولم يُشحن ("قريبًا" على البطاقة). Kimi K3: نُشر في 27 يوليو بموجب رخصة MIT المعدّلة — يمكن تنزيله اليوم.
• السياق — Nex-N2.5 Pro: 262K. Kimi K3: 1M توكن، بسعر ثابت.
• السعر — Nex-N2.5 Pro: لا توجد بطاقة أسعار بعد؛ الاستضافة التجريبية مجانية. Kimi K3: $3.00 / $15.00 لكل مليون، الإدخال المخزّن مؤقتًا $0.30.
• الترتيب المستقل — Nex-N2.5 Pro: لا يوجد بعد. Kimi K3: AA Intelligence Index 57، أفضل نموذج مفتوح الأوزان على اللوحة.
• البرمجة (بطاقات المورّدين) — Nex-N2.5 Pro: Terminal-Bench 2.1 82.7, SWE-Bench Pro 61.2. Kimi K3: 88.3 و63.3 على نفس الصفوف.
• واجهة المستخدم الرسومية / استخدام الكمبيوتر — Nex-N2.5 Pro: OSWorld-G 87.4 (يتفوّق على K3 على بطاقته الخاصة)، OSWorld-2 56.4. Kimi K3: OSWorld-G 79.6، OSWorld-2 58.3 (تجميع Nex).
• بصمة الاستضافة الذاتيةNex-N2.5 Pro: وصفة تشغيل على عقدة واحدة بثمانية معالجات H100 بمجرد توفّر الأوزان. أمّا Kimi K3: 2.8T فهو أسطول خدمة، وليس عقدة واحدة.
ماذا يعني "open" بشكل مختلف في كل عمود؟
كلمة “open” تؤدي عملًا مختلفًا جدًا على الجانبين، وهي التي تحسم هذه المواجهة أكثر من أي معيار آخر. Kimi K3 مفتوح بالمعنى الذي يهم تشغيليًا: الأوزان متاحة على المنصة بموجب ترخيص MIT معدَّل شبه متساهل، ومسارات الاستدلال مكشوفة في واجهة البث البرمجية (streaming API)، كما يمكن لشركة لديها قيود على حوكمة البيانات تشغيله على أجهزة تتحكم فيها وتدقيق ما كان النموذج يفكر فيه. إنه مفتوح على نحو يُكلّفك — نموذج بحجم 2.8T يتطلب بنية تحتية ضخمة — لكن الخيار متاح اليوم. أما Nex-N2.5 Pro فمفتوح بمعنى النية: Nex-AGI تقول إن أوزان العائلة ستُطرح كمصدر مفتوح، والنموذج الأصغر الشقيق Nex-N2.5 Mini صدر فعلًا بأوزان Apache-2.0 يوم الإطلاق. أوزان Pro لم تصدر بعد، وترخيصه مُعلن في بطاقة النموذج لكنه غير ملزِم لأي شيء قابل للتنزيل، وما دام لا يوجد checkpoint بعد، فإن “open” عنصر في خارطة طريق لا خاصية في النموذج. بالنسبة لفريق يختار بين الاثنين، هذه ليست حاشية — بل الفرق بين نموذج يمكنك امتلاكه هذا الشهر ونموذج وُعدت بامتلاكه.
التقييم دون انتظار زر التنزيل
لا تحتاج إلى تجميد هذا القرار حتى تُطرح أوزان Nex-N2.5 Pro، وطبقة التوجيه هي المكان الذي تُجري فيه التجربة بتكلفة زهيدة. Kimi K3 متاح على OrcaRouter بسعر Moonshot الرسمي — $3.00 / $15.00، بلا أي هامش ربح، ويُمرَّر السعر مباشرة ويُحدَّث يوم تغيّره Moonshot — لذا فإنّ النموذج الرائد مفتوح الأوزان على بُعد مفتاح واحد فقط بجانب أكثر من 200 نموذج آخر في الكتالوج. لا يتوفر Nex-N2.5 Pro عبرنا، لذا فإن تجربته اليوم تعني استخدام المعاينة المستضافة لدى Nex-AGI، ومن ثم لاحقًا تشغيله على حزمة H100 الثمانية الخاصة بك. النمط المناسب: ضع الأعمال التي تحتاج سياقًا طويلًا وتدقيقًا مكثفًا على Kimi K3 عبر نقطة النهاية الواحدة التي تستخدمها أصلًا، ووجّه فرعًا اختباريًا إلى معاينة Nex-N2.5 Pro، ودع آلية التحويل التلقائي عند الفشل تعيد التوجيه بعيدًا عن أيٍّ منهما يتراجع أداؤه — وهذه هي بالضبط طريقة مقارنة نموذج حدودي مُصدَّر بمنافس أوزانه معلّقة، دون المراهنة على أيٍّ منهما في مسارك الإنتاجي. وعندما تُطرح أوزان Pro فعلًا، يكون التحقق بسيطًا: شغّل الصفوف المشتركة التي يمكن لمختبر مستقل إعادة إنتاجها، وانظر إذا كانت قصة الكفاءة القائمة على 17 مليار معلم نشط تصمد خارج بيئة الاختبار الخاصة بـ Nex-AGI.


أين تستقر المواجهة
Against the largest open-weights model ever shipped, Nex-N2.5 Pro does not need to win the generalist war to be worth watching — it needs to win the serving-cost argument, and its own card suggests that argument is real but unproven. Kimi K3 is the safe and genuinely strong choice today: open weights, top of the open-weights index, a million-token context, and a price you can budget against, at the cost of infrastructure that only gets harder as the model grows. Nex-N2.5 Pro is the efficiency bet: near-K3 agentic rows at a sixth of the active parameters on a single node, per a vendor's table about a model that has not shipped. Take Kimi K3 when you want the frontier model you can actually own and audit right now. Watch Nex-N2.5 Pro for the day its weights land and someone independent runs the shared rows — because if a 17B-active agent really does stay within a few points of a 104B-active flagship on computer use, that is the result that changes the serving math for every open agent after it.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
