
Nex-N2.5 Pro مقابل GPT-5.6 Sol: رقم المورّد للوافد الجديد يتخلف عن الرقم المستقل للطرف الحالي
- openaiجديدOpenAI: GPT-6 Astra2026-09-0455الذكاء77البرمجة
- googleجديدGoogle: Gemini 3.8 Flash2026-09-0247الذكاء76البرمجة
- qwenجديدQwen: Qwen3.8 Max (0902)2026-09-0247الذكاء72البرمجة
- anthropicجديدAnthropic: Claude Fable 5.12026-09-0157الذكاء82البرمجة
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2646الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1849الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1541الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1251الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0547الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0347الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2140الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128الذكاء49البرمجة
ضع المعيار الوحيد الذي يمتلك فيه كلاهما رقمًا جنبًا إلى جنب، وترتيب العمليات فيه خاطئ بالنسبة لإطلاق منتج. بطاقة Nex-AGI تمنح نموذج Nex-N2.5 Pro درجة 56.4 على OSWorld-2، مُقاسةً على منصة NexCUA التابعة للتحالف نفسه، والتي لم يرها الجمهور. لوحة متصدرات OSWorld 2.0 من BenchLM، المحدَّثة في 29 أغسطس، تضع GPT-5.6 Sol عند 62.6 — وهو رقم مستقل يتفوق صراحةً على رقم البائع newcomer. وعلى أرض ذلك النموذج الذي لم يمر عليه سوى يوم واحد — استخدام الكمبيوتر بقراءة الشاشة، وهو الشيء الوحيد الذي صُمم من أجله — فإن النموذج العام الناضج الذي يُقارن به لا يحتاج حتى إلى علامة نجمية ليخرج متقدمًا. إن مقارنة Nex-N2.5 Pro مع GPT-5.6 Sol ليست منافسة قريبة على أي بُعد تم قياسه من قبل شخص آخر غير صانع الجديد. إنها دراسة حالة في قيمة السجل الإنتاجي، وتستحق القراءة لهذا السبب وحده.
النموذجان ليسا منافِسَيْن فعليين في الغرض. نموذج Nex-N2.5 Pro، الذي أُعلن عنه في 8 سبتمبر 2026، هو نموذج خليط خبراء متناثر يضم 397 مليار معامل، مع نحو 17 مليار معامل نشط، متعدد الوسائط (نص وصورة كمدخلات، ونص كمخرجات)، وخضع لتدريب لاحق انطلاقًا من سلالة Qwen3.5، وهو مصمم لتشغيل أجهزة الكمبيوتر والمتصفحات عبر حلقة تغذية راجعة بصرية. أوزانه بموجب رخصة Apache-2.0 ما تزال معلَّمة بعبارة «قريبًا» على Hugging Face، ونسخه الحية الوحيدة هي نقاط نهاية مستضافة مجانًا تُوصَل من الروابط الموجودة في بطاقته. أما GPT-5.6 Sol فهو النموذج الرائد من OpenAI لما يُسمّى «العمل الأصعب» — الاستدلال العميق متعدد الخطوات، وهندسة البرمجيات واسعة النطاق، وسير عمل الوكلاء طويلة الأفق — وهو متاح عبر API منذ 9 يوليو، بأوزان مغلقة، ويتحمل الآن وطأة كونه النقطة المرجعية الأكثر تقدمًا حتى أطلقت OpenAI نموذج GPT-6 Astra في 3 سبتمبر. وبينما يُعد Nex-N2.5 Pro متخصصًا لم يُصدر أوزانه الخاصة، فإن GPT-5.6 Sol نموذج عام مثبت أُصدر منذ شهرين ويعمل على أكثر حركة إنتاج تطلبًا في الصناعة.
GPT-5.6 Sol هو النموذج الذي يحمل ملفًا.
لنبدأ بما تمتلكه Sol ولا تمتلكه Nex-N2.5 Pro: سجلّ. منذ 9 يوليو، خضع GPT-5.6 Sol لاختبارات عبر منصات تقييم مستقلة، وتعرّض لمحاولات اختراق من باحثي الأمن، وأُدمج في أطر الوكلاء وسير عمل Codex. إن قياساته المستقلة عميقة وعلنية: 61 على مؤشر Artificial Analysis Intelligence Index عند أقصى مستوى للاستدلال، و88.0 على Terminal-Bench 2.1 و73.0 على DeepSWE بواسطة نفس المنصة المستقلة، وسرعة إخراج مقاسة تبلغ حوالي 71 رمزًا في الثانية بتكلفة تناهز 0.95 دولار لكل مهمة من مهام مؤشر Intelligence Index. لا شيء من هذا يجعله لا يُقهَر — فقد وضعت OpenAI منذ ذلك الحين GPT-6 Astra في مرتبة أعلى منه — لكن كل واحد من تلك الأرقام هو قياس أنتجته جهة أخرى غير OpenAI. لا يملك Nex-N2.5 Pro أي نتيجة مستقلة في أي مكان، لسبب بنيوي: لا يستطيع أي طرف خارج التحالف تشغيله.
المعيار الوحيد الذي يمتلك فيه كلاهما رقمًا
تُعدّ مقارنة OSWorld أوضح قراءة متاحة، لذا فهي تستحق أن تُذكر تحفظاتها قبل استخدامها. نتيجة Nex-N2.5 Pro البالغة 56.4 هي قياس Nex-AGI الخاص على OSWorld-2 عبر منصة NexCUA التابعة لها. أما نتيجة GPT-5.6 Sol البالغة 62.6 فمصدرها لوحة صدارة OSWorld 2.0 من BenchLM، وهي لقطة من طرف ثالث بتاريخ 29 أغسطس 2026، تضم خمسة عشر نموذجًا، وتضع Claude Opus 5 في المرتبة الأولى بدرجة 70.6، وGPT-5.6 Sol ثانيًا بدرجة 62.6، وGPT-5.6 Terra ثالثًا بدرجة 50.2. إنّ "OSWorld-2" و"OSWorld 2.0" متقاربان جدًا لكن لم يُثبت تطابقهما، لذا ينبغي قراءة الفارق الدقيق الواقع بين أربع وست نقاط على أنه مؤشر إلى الاتجاه لا قيمة مطلقة. ما يصمد أمام التحفظات هو الترتيب: بأفضل رقم يمكن لكل طرف تقديمه، تتفوق نتيجة Sol المستقلة على رقم Nex الصادر من البائع على المعيار الذي اختار Nex نشره. الوافد الجديد الذي يكون رقمه أدنى من الرقم المستقل للطرف القائم لم يقدّم سببًا مقنعًا للتحول إليه.

أظرف المواصفات
بقية ورقة المواصفات تسير في الاتجاه نفسه:
• تم الإصدار — Nex-N2.5 Pro: 8 سبتمبر 2026 (النقاط الطرفية المستضافة نشطة، الأوزان لم تُنشر بعد). GPT-5.6 Sol: 9 يوليو 2026، متاح بشكل عام.
• الحجم — Nex-N2.5 Pro: 397B إجمالاً / ~17B نشط MoE. GPT-5.6 Sol: عدد المعاملات غير معلن.
• النمط — Nex-N2.5 Pro: إدخال نص وصورة، وإخراج نص، وحلقة رؤية لاستخدام الحاسوب. GPT-5.6 Sol: إدخال نص وصورة وملف، وإخراج نص، مع استدعاء الأدوات ووضع JSON.
• السياق / المخرجات — Nex-N2.5 Pro: سياق 262,144 رمزًا. GPT-5.6 Sol: سياق ~1.05M رمزًا، وسقف مخرجات 128K.
• التحكم في الاستدلال — Nex-N2.5 Pro: لا شيء / متوسط (تكيفي، افتراضي) / عالٍ. GPT-5.6 Sol: جهد الاستدلال يصل إلى الحد الأقصى، مع مستوى معالجة سريع منفصل.
• الأوزان — Nex-N2.5 Pro: Apache-2.0، قريبًا. GPT-5.6 Sol: مغلق.
• السعر لكل مليون توكن — Nex-N2.5 Pro: فئة استضافة مجانية بدون سعر قائمة. GPT-5.6 Sol: سعر قائمة ترويجي منذ 21 أغسطس بقيمة 4.00 دولار / 20.00 دولار، و0.40 دولار للإدخال المخبأ، ثم إعادة التسعير إلى 8.00 دولار / 30.00 دولار عند تجاوز 272 ألف توكن إدخال.
سياق Sol الذي يبلغ نحو 1.05 مليون توكن وسقف الإخراج البالغ 128 ألفًا يتفوّقان بشكل كبير على نافذة 262 ألفًا في Nex-N2.5 Pro للأعمال الطويلة الأمد، وسعر Sol، وإن لم يكن رخيصًا، فهو رقم محدد يمكن للميزانية أن تضعه في حساباتها. أما الطبقة المجانية من Nex-N2.5 Pro فهي الرقم الوحيد في صالحها، وهي ليست سعرًا.
ما قيمة نتيجة عمرها يوم واحد

كل ادعاء حول نتائج المعايير مرتبط بـ Nex-N2.5 Pro — OSWorld-2 عند 56.4، وTerminal-Bench 2.1 عند 82.7، وSWE-Bench Pro عند 61.2، وBrowseComp عند 89.7 — يشترك في خاصية واحدة: أن Nex-AGI أنتجته، عبر منظومة اختبار يقول التحالف إنه سيجعلها مفتوحة المصدر لكنه لم يفعل بعد. لا يمكن إعادة إنتاج أيٍّ من تلك الأرقام بشكل مستقل، لأن ذلك مستحيل: الأوزان غير قابلة للتنزيل، ولا يوجد تاريخ مرتبط بلافتة «قريبًا». هذا الأمر أكثر أهميةً في هذه المواجهة منه في معظم المواجهات، لأن النموذج الذي تتم مقارنة Nex-N2.5 Pro به يمتلك أطول سجلّ مستقل في الصناعة. عندما تكون قاعدة أدلة المتحدي كلها مبنية على الإبلاغ الذاتي بينما قاعدة أدلة المنافس الراسخ ليست كذلك، يقع عبء الإثبات بالكامل على المتحدي، ونقطة وصول مجانية لا تُسقط ذلك العبء. لحظة وصول الشظايا وتشغيل مختبر مستقل لـ Nex-N2.5 Pro، تصبح أرقام هذا المقال قابلة للتحقق وتصبح المقارنة حقيقية. وحتى ذلك الحين، تكون عبارة «نتيجة عمرها يوم» هي التعبير الدقيق — نتيجة لا يمكن فحصها على نموذج لا يمكن تشغيله.
السعر، والمسار، وشكل القرار
التكلفة هي أكثر الجوانب التي يصعب فيها المقارنة بين الطرفين، لأن طرفًا واحدًا فقط هو من يتحمّلها. سعر GPT-5.6 Sol البالغ 4.00 دولارات / 20.00 دولارًا هو سعر القائمة الترويجي من OpenAI، الساري منذ 21 أغسطس والمُعلَن أنه سيستمر حتى 21 نوفمبر على الأقل، بعد أن انخفض من 5.00 دولارات / 30.00 دولارًا — وهو خفض جعل النموذج الرائد أكثر توفيرًا بشكل ملحوظ للعمل الوكيلي عالي الحجم، وهو خفض يعكسه موجّه التمرير المباشر في اليوم نفسه الذي تعتمده فيه OpenAI. يتوفر Sol على OrcaRouter بسعر القائمة هذا دون أي رسوم إضافية، مع توفّر الطبقة المجمّعة والطبقة السريعة عبر مفتاح API نفسه المستخدم مع أكثر من 200 نموذج آخر، لذا يمكن للفريق توجيه الطلبات التي تستلزم عمق OpenAI إلى Sol، وتوجيه النماذج الأرخص إلى كل شيء آخر. أما Nex-N2.5 Pro فليس له سعر قائمة، بل نقاط نهاية مجانية مستضافة فقط — وهي وسيلة جيدة لتقييم نموذج، لكنها أساس ضعيف لميزانية إنتاج. لا يمكنك التخطيط للإنفاق حول رقم غير موجود، ولا يمكنك التخطيط لبنية تقنية حول أوزان لم تُطرح بعد.

القرار الذي يفرضه هذا التصادم فعليًا يتعلق بالمخاطرة، لا بالقدرة. إذا كنت تحتاج إلى نموذج سيظل موجودًا في الربع القادم، بسعر معروف، وملف فشل معروف، وأشهر من الاختبارات العدائية خلفه، فإن GPT-5.6 Sol هو الخيار العقلاني — وإطلاق OpenAI لنموذج GPT-6 Astra فوقه لا يزيد الأمر إلا قوة، لأن Sol أصبح الآن الحصان المجرَّب الذي يأتي مع خفض سعري موجَّه مباشرةً نحو حجم الإنتاج الضخم. أما إذا كنت تبني وكلاء استخدام الحاسوب على أوزان مفتوحة، ويُمكنك أن تنتظر شيئًا قابلًا للتحقق، فإن Nex-N2.5 Pro يستحق المتابعة — إذ إن النموذج متعدد الوسائط المتخصص الذي يفعّل 17B هو بالضبط الشكل الذي استطاع مرارًا أن يخفض التكلفة دون نماذج الحدود المغلقة. لكن كلمة "متابعة" هي الكلمة الفاصلة. ففي كل بُعد يقيسه أي طرف غير صانعه، يتخلف Nex-N2.5 Pro عن النموذج الذي بحوزته الملفّ، وحتى تُطرح الأوزان، عندها ينتهي وجه المقارنة.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
