بطاقة hero لمقارنة Nex-N2.5 Pro بـ Claude Opus 5 — بطاقة عنوان مولّدة تعرض «Nex-N2.5 Pro ضد Claude Opus 5» مع سطر فرعي: «معاينة استخدام الحاسوب المفتوحة والمجانية مقابل رائدة المعايير التي يمكنك توجيه الطلبات إليها اليوم»، وعنوان علوي: «Anthropic ضد Nex-AGI — سبتمبر 2026».
Guides & Insights

Nex-N2.5 Pro مقابل Claude Opus 5: Nex-AGI اختار المعيار، وفاز المعيار

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

اختارت Nex-AGI المقياس، فكان المقياس هو المنتصر. عندما أطلق تحالف النماذج المفتوحة ومقرّه شنغهاي نموذج Nex-N2.5 Pro في 8 سبتمبر 2026، وضع جدول استخدام الحاسوب في بطاقة النموذج Claude Opus 5 في عمود المقارنة وNex-N2.5 Pro في خانة المنافس: 68.3 لـClaude Opus 5 مقابل 56.4 لـNex-N2.5 Pro على OSWorld-2، وكلاهما مطابق تمامًا للأرقام التي طبعتها Nex-AGI على بطاقتها الخاصة. ومنذ ذلك الحين، اتسعت الفجوة في لوحات الصدارة المستقلة بدلًا من أن تضيق — فنسخة BenchLM من OSWorld 2.0 الصادرة في 29 أغسطس تُصنّف Claude Opus 5 في المرتبة الأولى بين النماذج الخمسة عشر التي تُدرجها، بنتيجة 70.6. إن التنازل عن اثنتي عشرة نقطة لصالح متصدّر المجال على المقياس الذي اخترت نشره ليس من الإخراج المعتاد لإطلاق النماذج، ولهذا فإن الجزء المثير في مقارنة Nex-N2.5 Pro مع Claude Opus 5 ليس النتيجة. بل هو ما يمثله طرفا هذه النتيجة فعلًا: نموذج مفتوح لاستخدام الحاسوب يضم 397 مليار معامل، لم يتمكن أحد خارج التحالف من تشغيله أو التحقق منه بعد، ونموذج Anthropic المغلق الرائد الذي يتصدّر المقياس ويحمل حركة الإنتاج منذ أواخر يوليو.

الملخص الصريح مقدمًا: هذه ليست منافسة بين كميتين مقاستين، لأن أحد جانبيها فقط هو ما قاسه شخص آخر غير صانعه. نموذج Nex-N2.5 Pro هو نموذج خليط خبراء متناثر، بنحو 17 مليار معامل نشط ضمن إجمالي يبلغ 397 مليارًا، وخضع لتدريب لاحق انطلاقًا من سلالة Qwen3.5، وهو موجَّه مباشرةً إلى تشغيل الحاسوب والمتصفح عبر آفاق زمنية طويلة مع حلقة تغذية راجعة بصرية. وهو يُقدَّم اليوم عبر نقاط نهاية مستضافة مجانًا، هي روابط Nex-AGI من بطاقة تعريف النموذج، في حين تظل أوزان Apache-2.0 التي تقوم عليها العائلة موسومة بعبارة «قريبًا» دون أي تاريخ. أما Claude Opus 5 فهو النموذج الرائد الإنتاجي لدى Anthropic للاستدلال الصعب والبرمجة والعمل الوكيلي؛ نموذج مغلق بسياق يبلغ مليون رمز، ومقبض ضبط للتفكير التكيفي، وسعر موثق، وأسابيع من الإدخالات على لوحات الصدارة العامة وحركة الإنتاج خلفه. وكل أفضلية في هذه المواجهة تعود إلى واحدة من هاتين الحقيقتين: أحد النموذجين قابل للتشغيل والتحقق، والآخر ليس كذلك.

المعيار الذي يتفق عليه الطرفان

معايير استخدام الحاسوب تكافئ نفس السلوك الذي صُمِّمت هذه النماذج لبيعه: وكيل ينظر إلى الشاشة، ويقرر إجراءً، وينفذه، ثم يقرأ الشاشة المتغيرة للتحقق مما إذا كان الإجراء قد نجح. إنّ Nex-N2.5 Pro معماري حول تلك الحلقة تمامًا — فالرؤية ليست نمط إدخالٍ مُلحقًا به، بل هي قناة التغذية الراجعة التي يتحقق الوكيل بناءً عليها. يتعامل Claude Opus 5 مع نفس الحلقة كواحدة من أعباء العمل العديدة، لكنه، كما يحدث، بارع جدًا فيها، ولهذا استخدمته Nex-AGI كنقطة مرجعية في المقام الأول.

الرقمان ليسا، بالمعنى الدقيق، من منصة تقييم واحدة. فقد أنتجت Nex-AGI أرقامها على OSWorld-2 عبر منصة التقييم الخاصة بها NexCUA، والتي تقول إنها ستفتح مصدرها لكنها لم تطرحها بعد؛ ونتيجة 56.4 لـ Nex-N2.5 Pro هي ناتج بائع لم يتم استنساخه من جهة خارجية. أما نتيجة Claude Opus 5 البالغة 70.6 على BenchLM فهي لقطة من طرف ثالث لـ OSWorld 2.0، بتاريخ 29 أغسطس 2026، وهي متسقة مع 68.3 التي تستشهد بها Nex-AGI نفسها من مصادر لوحات الصدارة. واختلاف المنصات والتباين الطفيف بين إصدارات المعايير يعني أن الفجوة الدقيقة — اثنا عشر نقطة في بطاقة Nex-AGI الخاصة، وأقرب إلى أربع عشرة نقطة على BenchLM — ينبغي قراءتها كمؤشر اتجاه. لكن لا خلاف على أن Nex-N2.5 Pro، استنادًا إلى أفضل الأرقام المتاحة من الجانبين، يقع دون الوكيل الطليعي الحالي لاستخدام الحاسوب.

A two-column scoreboard titled 'Nex-N2.5 Pro vs Claude Opus 5 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; Params 397B total / ~17B active; Focus computer use; OSWorld 2.0 56.4 vendor-reported; Weights Apache-2.0 pending; Price free hosted / no list price. Right column Claude Opus 5: Released Jul 24 2026; Params undisclosed; Focus general plus computer use; OSWorld 2.0 70.6 per BenchLM; Weights closed; Price $5.00 / $25.00 per 1M. Footer: 'Nex figures vendor-reported via NexCUA harness; Opus OSWorld per BenchLM Aug 29.'

إجابتان على "هل يمكنني تشغيله اليوم"

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

هذا هو الفرع الذي يحسم فعليًا نتيجة المواجهة بالنسبة لفريق يعمل، ولا يحابي الوافد الجديد. ما تزال بطاقة Hugging Face الخاصة بـ Nex-N2.5 Pro ترفع لافتة أن الأوزان ستُطرح قريبًا بموجب ترخيص Apache-2.0، دون أي تاريخ إصدار مرفق. أما النسخ الحية الوحيدة فهي نقاط النهاية المجانية المستضافة التي تشير إليها روابط Nex-AGI من البطاقة — قابلة للاستدعاء، لكنها مملوكة لجهة أخرى، دون سعر معلن أو شروط خدمة يمكن لفريق التخطيط على أساسها، ودون أي وسيلة لإعادة إنتاج رقم معياري واحد على عتادك الخاص. وعندما تُطرح الأوزان فعليًا، تكون وصفة تقديم النموذج الموثقة هي عقدة واحدة تضم ثماني وحدات H100 على صورة SGLang مخصصة — بصمة حقيقية لكنها اعتيادية لنموذج MoE بحجم 397B، وهذا هو تحديدًا ما يجعل التصميم القائم على 17 مليار معامل نشطة (17B-active) مثيرًا للاهتمام. وإلى أن يحدث ذلك، يظل Nex-N2.5 Pro معاينة يمكنك الاستعلام عنها، لا نموذجًا يمكنك البناء عليه.

كلود أوبوس 5 هو العكس تمامًا في كل تلك الصفوف. فقد تم تقديمه عبر واجهة برمجة تطبيقات Anthropic وعلى منصات التوجيه منذ 24 يوليو، وسعره عام وثابت، وأوزانه مغلقة وستبقى مغلقة، ويمكن التحقق من أيٍّ من أرقامه اليوم عن طريق تشغيله. والنظام البيئي المحيط به — Claude Code، وأدوات MCP، وسرب الوكلاء الإنتاجيين الذين اختبروه بقوة لستة أسابيع — هو بالضبط السجل المتراكم الذي لا يمكن لنموذج عمره يوم واحد أن يدّعيه. وبالنسبة لفريقٍ شرطُه "أن يعمل النموذج في الربع القادم"، فإن هذا السجل هو اللعبة كلها.

ورقة المواصفات، على ما هي عليه

ضع المظروفين جنبًا إلى جنب:

أُطلق — Nex-N2.5 Pro: 8 سبتمبر 2026 (نقاط النهاية المستضافة أصبحت مباشرة، والأوزان قيد الانتظار). Claude Opus 5: 24 يوليو 2026، متاح بشكل عام.

الحجمNex-N2.5 Pro: 397B إجمالي / ~17B نشط MoE. Claude Opus 5: عدد المعلمات غير معلن.

النمط — Nex-N2.5 Pro: مدخلات نص وصور ومخرجات نص، والرؤية البصرية محورية في حلقة استخدامه للحاسوب. Claude Opus 5: مدخلات نص وصور ومخرجات نص، مع تحليل بصري قوي.

السياق / المخرجات — Nex-N2.5 Pro: سياق 262,144 رمزًا، طول خدمة موثّق. Claude Opus 5: سياق 1M رمزًا، وسقف مخرجات 128K رمزًا.

التحكم بالاستدلال — Nex-N2.5 Pro: مفتاح reasoning_effort بخيارات none / medium (تكيّفي، افتراضي) / high. Claude Opus 5: تفكير تكيّفي افتراضيًا مع قرص جهد صريح من منخفض إلى أقصى.

الأوزان — Nex-N2.5 Pro: Apache-2.0، قريبًا، بدون تاريخ. Claude Opus 5: مغلق.

السعر لكل 1M توكن — Nex-N2.5 Pro: طبقة مجانية مستضافة، لا يوجد سعر قائمة منشور. Claude Opus 5: $5.00 للإدخال / $25.00 للإخراج، $0.50 للقراءات من الكاش، $6.25 لعمليات الكتابة إلى الكاش.

الفوارق بين النطاقات التشغيلية كافية لتجعل ورقة المواصفات ذات قيمة حقيقية: يوفّر Opus 5 نافذةً بمليون رمز (Token) وسقف إخراج يبلغ 128K للجلسات الطويلة للوكلاء، بينما يناسب سياق 262K والطبقة المجانية في Nex-N2.5 Pro أتمتةً أصغر نطاقًا تعتمد على الشاشة. ولا تجعل أيٌّ من المواصفتين الأخرى زائدةً عن الحاجة؛ إذ يختلف النموذجان حول ما ينفقه الوكيل من سياقه.

قراءة لوحة نتائج Nex-AGI الخاصة بها بصدق.

بقية البطاقة جديرة بالقراءة بالفلتر نفسه. صفوف استخدام الكمبيوتر الأخرى في Nex-N2.5 Pro — OSWorld-G 87.4، OSWorld-Verified 82.2، WebArena-Verified 67.6، WebTest 52.8، Vision2Web 68.2 — وصفوف البرمجة — Terminal-Bench 2.1 عند 82.7، SWE-Bench Pro عند 61.2، BrowseComp عند 89.7 — كلها قياسات من المورّد عبر منصة التحالف الخاصة، لم تُستنسخ خلال أول 48 ساعة. الاستنتاج الوحيد الذي يمكن أن يستخلصه القارئ المحايد من البطاقة هو أن Nex-AGI ترى أن Nex-N2.5 Pro نموذج قوي متوسط المستوى في استخدام الكمبيوتر، يتخلف عن وكيل الطليعة في الصف الأكثر أهمية. هذا تموضع متسق، بل ومتحفّظ، لنموذج مفتوح بـ397B. كما أنه ادعاء بانتظار مختبرٍ ثانٍ.

المال، عندما لا يكون لأحد الجانبين ثمن

لا توجد مقارنة أسعار نزيهة يمكن إجراؤها هنا، لأن طرفًا واحدًا فقط له سعر. الطبقة المجانية المُستضافة من Nex-N2.5 Pro لا تخبرك بشيء عن قيمة النموذج — فنقاط النهاية المجانية للتجربة هي كيف يجمع البائعون حركة المرور والتغذية الراجعة، ولم تنشر Nex-AGI أي معدل مدفوع لكل رمز (token) لهذه العائلة. تكلّف Claude Opus 5 5.00 دولارات لكل مليون رمز إدخال و25.00 دولارًا لكل مليون رمز إخراج بسعر Anthropic الرسمي، مع قراءات الكاش بسعر 0.50 دولار، وهذا هو الرقم الذي يجب أن تتحمّله الميزانية. إذا كنت تدفع هذه الفاتورة اليوم مقابل وكلاء استخدام الحاسوب (computer-use agents) وتريد أن تعرف ما إذا كان نموذج مفتوح نشط بحجم 17B قادرًا على أداء المهمة نفسها بتكلفة أقل، فالإجابة هي: ربما، لكنك لن تعرف ذلك حتى يتم إصدار الأوزان (weights) ويقوم شخص مستقل بتشغيله. مقارنة الأسعار مؤجلة، وليست محسومة، والتعامل مع نقطة نهاية مجانية كدليل على الرخص سيكون خطأً تصنيفيًا.

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5) showing the header stats $5.00 input and $25.00 output per million tokens and the byline 'by Anthropic - 2026-07-24'.

ما يمكنك فعله اليوم هو إعداد اختبار A/B لليوم الذي يصبح فيه ذلك ممكنًا. Claude Opus 5 متاح على OrcaRouter بالسعر المعلن من Anthropic — أي بنفس $5.00 / $25.00، ويُمرَّر دون أي زيادة، لذا تكون الفاتورة هنا مطابقة لفاتورة Anthropic وتتغير في اليوم الذي تغيّر فيه Anthropic أسعارها. ومع مفتاح API واحد فقط، يصبح النموذج خلف نقطة الوصول نفسها التي تضم أكثر من 200 نموذج آخر، مع تجاوز تلقائي للفشل إذا تعثر مزود ما، ولغة توجيه مخصصة (DSL) إذا أردت استخدام Opus في المهام الصعبة ونموذجًا أرخص في المهام الروتينية. أما Nex-N2.5 Pro فليس متاحًا على OrcaRouter — لقد راجعنا دليل النماذج قبل كتابة هذه المقالة، ولا يوجد أي نموذج من nex-agi مدرج هناك بعد. وبمجرد أن يوفره أي مزود بالسعر المعلن، سيظهر هنا في اليوم نفسه، وستتحول المقارنة العادلة التي لا يمكن لهذه المقالة إجراؤها بعد إلى قاعدة توجيه بدلًا من ترحيل.

من يجب أن يتصرف، ومن يجب أن ينتظر؟

إذا كان فريقك يدير اليوم أعباء عمل إنتاجية في استخدام الحاسوب أو في البرمجة الوكيلة، ويحتاج إلى نموذج بسعر معروف، وملفّ إخفاق معروف، وسجلّ مستقل، فإن Claude Opus 5 هو الخيار العقلاني في هذه المواجهة، ولا شيء في أول 48 ساعة من عمر Nex-N2.5 Pro يغيّر ذلك. وإذا كان فريقك يقيّم نماذج استخدام الحاسوب مفتوحة المصدر لبناءٍ قادم، فإن Nex-N2.5 Pro يستحق مكانًا على قائمة المراقبة؛ فكونه نموذج MoE متعدد الوسائط بحجم 397 مليار معلمة، ببصمة استضافة ذاتية رشيدة، وسردية معايير معقولة في الفئة المتوسطة، هو تحديدًا النوع من النماذج مفتوحة المصدر الذي يعيد تشكيل منحنى التكلفة — شريطة أن تصل الأوزان فعلًا، وأن تصمد أرقام بطاقة النموذج أمام اختبارٍ مستقل. أمّا الموقف العقلاني فهو الجمع بين الاثنين: إبقاء القائد المُثبَت على المسار الحرج، وترك يوم وصول الأوزان يقرّر ما إذا كان الوافد الجديد يستحق التجربة. فهذه هي المقارنة الوحيدة في هذه المواجهة التي لم تحدث بعد — وهي التي ستكون ذات أثرٍ حقيقي.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا