
CrowdStrike SafeMind ضد Claude Mythos 5: متخصص دفاعي في مواجهة حدود أنثروبيك مزدوجة الاستخدام
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2658الذكاء72البرمجة
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
CrowdStrike SafeMind وClaude Mythos 5 هما الإعلانان الأبرز في مجال نماذج الأمن لعام 2026، ويجيبان عن المشكلة نفسها من طرفين متقابلين. SafeMind عائلة متخصصة في الدفاع، بنتها CrowdStrike بالتعاون مع NVIDIA على قاعدة NVIDIA Nemotron المفتوحة، وتضم نموذجًا هجوميًا ونموذجًا دفاعيًا في حلقة تطور مشترك، دُرِّبا على بيانات استشعار Falcon وعلى خمس عشرة سنة من بيانات الاستجابة للحوادث. أما Claude Mythos 5 فهو نموذج Anthropic الحدودي المصنّف ضمن مستوى ASL-3، نموذج عام متكامل يصادف أنه استثنائي في اكتشاف الثغرات، ويُحفظ داخل بيئة وصول موثوقة ولا يُسلَّط على قواعد الأكواد الفعلية إلا عبر ماسح Claude Security الخاص بـ Anthropic. هذه المقارنة تدور حول أي الفلسفتين تناسب أي فريق، وحول حقيقة أن كلا النموذجين لا يمكن استدعاؤه عبر واجهة برمجة تطبيقات لطرف ثالث.
إجابتان مختلفتان على عبارة "المدافعون ليس لديهم ذكاء اصطناعي متطور".
عبارة كيرتز في مؤتمر Fal.Con — «كان المهاجمون يمتلكون الذكاء الاصطناعي الحدودي، ولم يملكه المدافعون» — هي التشخيص المشترك. غير أن الوصفات العلاجية المقترحة تتباين. فقد كان ردّ Anthropic عبر Claude Mythos 5 يتمثّل في بناء نموذج واحد فائق القدرة، وتصنيفه ضمن مستوى ASL-3 (الفئة المخصّصة للقدرات التي «ترفع بشكل ملموس من القدرة على الهجوم السيبراني»)، وتقنين الوصول إليه من خلال برنامج مُدقَّق إلى جانب ماسحٍ مُقيَّد. ويُعَد سجل اختبارات فريقها الأحمر (Red Team) المبرِّرَ لهذا التقنين: ثغرة في OpenBSD عمرها 27 عامًا ظلّت غير مكتشفة، وثغرة في FFmpeg عمرها 16 عامًا صمدت أمام خمسة ملايين عملية مسح آلية، واستغلالٌ في المتصفح يجمع أربع ثغرات للهروب من كلٍّ من بيئة عزل محرك العرض (Renderer) وبيئة عزل نظام التشغيل، وتصعيدُ صلاحياتٍ في نواة Linux من مستخدمٍ عادي إلى صلاحيات الجذر (root).
إجابة CrowdStrike هيكلية لا أحادية الكتلة. يجمع SafeMind بين Red Tempest، وهو نموذج هجومي يحاكي خصومًا تعمل بالذكاء الاصطناعي، وبين Blue Solano، وهو نموذج دفاعي ينشر إجراءات حماية مُختبَرة ميدانيًا، ويُديرهما في حلقة تطور مشترك مستمرة: الهجوم يجد مسار اختراق، والدفاع يُغلقه، وتقنية Falcon تسجّل النتيجة عبر القياس عن بُعد، ثم يتحسّن النموذجان معًا. وفي الطبقة السفلية توجد مهام تنظيم من NVIDIA — حيث يشغّل Nemotron 3 Ultra الإطار الدفاعي، بينما يعمل نموذج Nemotron 3 Super المضبوط بدقة على تشغيل الوكيل الفرعي لتوليد القواعد. الرهان هو أن الدفاع يصبح أفضل عبر التدريب ضد نموذج هجومي حقيقي على بيانات نقاط نهاية حقيقية، لا عبر جعل نموذج عام واحد أكثر ارتيابًا قليلًا.

لوحة النتائج، مع التسميات ظاهرة.
• الكشف — تدعي SafeMind معدل كشف أعلى بنسبة 29% من النماذج الحدودية الرائدة وخطوط الأساس مفتوحة المصدر؛ بينما لا يمتلك Claude Mythos 5 رقم كشف رئيسي مماثل، بل فقط درجات معيارية من Anthropic ونتيجة واحدة من مزود الخدمة.
• معايير مستقلة — لا يظهر أيٌّ من النموذجين على لوحة صدارة عامة. نتيجة Mythos 5 في CyberGym L1 البالغة 83.8% ونتيجة ExploitBench البالغة 78% مُعلَنة من قِبل البائع؛ بينما أرقام SafeMind البالغة 29% / 6x / 99% مُبلَّغة من قِبل CrowdStrike ولم تتم إعادة إنتاجها.
• البنية — Claude Mythos 5 هو نموذج حدودي متجانس بسياق يبلغ مليون رمز؛ بينما SafeMind هو نظام وكيل مكوّن من نموذجَين يعمل على Nemotron، ويتميّز بحلقة التشغيل لا بعدد المعاملات (الذي لم تكشف عنه CrowdStrike).
• السعر — لا يمتلك أيٌّ منهما سعرًا عامًا لكل رمز (token). لا تتوفر لـ Mythos 5 أي واجهة برمجة تطبيقات (API) خارجية إطلاقًا؛ بينما تُدمَج تكلفة SafeMind في منصة Falcon، دون الكشف عن سعرٍ مستقل.
• الفرز وتوليد الكشف — هذا هو البُعد الوحيد الذي توجد فيه مقارنة مباشرة. يولّد Blue Solano من SafeMind مرشحات كشف من تيليمتري Falcon، ويُرقّي المرشحات المُتحقق منها إلى كشفات قابلة للتنفيذ. أما Mythos 5، المدمج داخل Claude Security، فيُنتج نتائج تتضمن فئة CWE، ودرجة الخطورة، ومستوى الثقة، والأثر، وخطوات إعادة الإنتاج، وإصلاحات مقترحة. كلا النظامين مقيدان صراحةً بالمخرجات الدفاعية — دون أي توجيه حرّ للنموذج.
الوصول إلى الواقع — لا يمكن استدعاء أيٍّ منهما
أهم حقيقة في هذه المواجهة هي أيضًا الأقل متعة: لا يمكنك استدعاء أيٍّ من النموذجين. يبقى Claude Mythos 5 داخل نطاق الوصول الموثوق لدى Anthropic، ولا يمكن الوصول إليه إلا عبر Project Glasswing وماسح Claude Security لعملاء Enterprise، ولا يمكن لأي موجّه تغيير ذلك. يعمل CrowdStrike SafeMind بشكل مدمج في منصة Falcon، مع نماذج وأدوات مستقلة محجوبة خلف Project QuiltWorks. لا توجد نقطة وصول عامة، ولا تسعير لكل رمز مميز، ولا — في المستقبل المنظور — أي تكامل مع طرف ثالث يُترقَّب.
ما يمكن استدعاؤه اليوم هو المستوى الأدنى التالي: النماذج الحدودية التي تحمل أعباءً أمنية وتُباع عبر واجهة برمجة تطبيقات عادية. النموذج الخاص بـ Anthropic، Claude Fable 5 — وهو النموذج الشقيق المُجهّز بمصنّف الأمان ضمن العائلة نفسها — متاح على OrcaRouter بسعر قائمة Anthropic، 10.00 دولار لكل مليون رمز إدخال و50.00 دولار لكل مليون رمز إخراج، مع تمرير السعر دون أي زيادة. Claude Opus 5 يأتي بسعر 5.00 دولار / 25.00 دولار، ومفتاح API واحد يصل إلى كليهما إضافة إلى أكثر من 200 نموذج آخر، مع تبديل احتياطي تلقائي بين المزودين. أما بالنسبة لفريق يريد تحليل كود من فئة Mythos دون عقد Enterprise، فإن سير عمل routing-DSL — Claude Fable 5 مع تبديل احتياطي إلى Claude Opus 5 — هو البديل العملي إلى أن توسّع Anthropic الوصول الموثوق.

أي واحد إذن؟
الجواب الصادق هو أن القرار بالنسبة لمعظم المؤسسات ليس SafeMind مقابل Claude Mythos 5 — بل هو اختيار أيّ حيّزٍ مسيَّجٍ يخصُّ مورّدًا تعيش بداخله أصلًا. إذا كنت عميلًا لدى CrowdStrike، فإن SafeMind يصلك داخل المنصة التي تشغّلها أصلًا، مضبوطًا على التليمترية التي تولّدها أصلًا، مع حلقة التطور المشترك التي تشتغل بينما أنت نائم. وإذا كنت عميلًا لدى Anthropic Enterprise، فإن Claude Security على Mythos 5 يفحص مستودعاتك ضمن الخطة التي تدفعها أصلًا، وبمعدلات التوكن القياسية. الاختيار بينهما يعني اختيار مستوى البيانات الذي تأتمنه على هذه القدرة — وهذا قرارُ بنيةٍ تحتية، لا قرارُ مقاييس أداء.
سؤال المعيار — هل يمكن لكاشفات بلو سولانو أن تتفوق فعليًا على نتائج ميثوس 5 على نفس قاعدة البيانات البرمجية — سؤال حقيقي وغير قابل للإجابة حاليًا، لأن الاثنين لم يلتقيا قط على تقييم مشترك ومتاح للعموم. هذه هي الفجوة التي يجب مراقبتها. وفي هذه الأثناء، النماذج التي يمكنك توجيه مهام الأمان إليها فعليًا هي النماذج الشقيقة ذات الحدود المفتوحة، وشفافية التسعير في الموجّه بدون هامش ربح هي ما يجعل تجربتها تعديلًا من سطرين بدلًا من مشروع توريد.

مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
