
CrowdStrike SafeMind مقابل MAI-Cyber-1-Flash: نموذجان للدفاع فقط، نظام واحد مغلق الحلقة
- AlibabaجديدQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiجديدZ.ai: GLM 5.3 Flash2026-08-2658الذكاء72البرمجة
- DeepSeekجديدDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1860الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1552الذكاء68البرمجة
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1261الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0557الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0358الذكاء72البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463الذكاء78البرمجة
- googleGoogle: Gemini 3.6 Flash2026-07-2152الذكاء69البرمجة
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaMeta: Muse Spark 1.12026-07-1653الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1560الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0952الذكاء71البرمجة
ينتمي CrowdStrike SafeMind ونموذج MAI-Cyber-1-Flash من Microsoft إلى النادي الشاب نفسه: نماذج سيبرانية صُمّمت دفاعيًا أولًا، حيث لا يُعدّ توليد استغلال عمليّ قدرةً مفقودةً، بل خيارًا تصميميًا متعمدًا. كُشف عن MAI-Cyber-1-Flash في 27 يوليو 2026، وهو أول نموذج أمني من Microsoft — نموذج مختلط من الخبراء يضم 137 مليار معامل، مع 5 مليارات معامل نشطة لكل استدلال، تمت معايرته بدقة من عائلة MAI-Thinking-1 ودمجه داخل إطار الوكيل MDASH. أما CrowdStrike SafeMind، الذي أُطلق في Fal.Con 2026، فهو عائلة الأمان الوكيلية التي بنتها CrowdStrike مع NVIDIA على الأساس المفتوح NVIDIA Nemotron، حيث يجمع بين أداة الهجوم Red Tempest والدفاع Blue Solano في حلقة مستمرة داخل منصة Falcon. كلاهما يرفض بناء استغلالات؛ والسؤال المثير للاهتمام هو ما إذا كانت النتيجة أو الحلقة هي الدليل الأفضل على الدفاع.
مدافعان، مبنيان بشكل مختلف
تتمحور بنية مايكروسوفت حول التوجيه بين النماذج. MAI-Cyber-1-Flash هو متخصص مضغوط ومحسَّن للكود البرمجي يتولى الجزء الأكبر من أعمال الثغرات الروتينية داخل MDASH، ويُحيل أصعب الحالات إلى نموذج حدودي — GPT-5.4 من OpenAI — الذي يتعامل مع ما يقارب أعلى 10% من المهام. وقد حلّ هذا التقسيم بين نموذجين محل 80% من مزيج نماذج MDASH السابق، وتقول مايكروسوفت إنه خفّض التكلفة بنحو 50% مع رفع درجة النظام في CyberGym من 88.4% إلى 95.95%. صُمم هذا النموذج بمفرده ليكون أداة دفاعية فقط: فهو يحدد الثغرات ويُصلحها، ويحرز عمدًا صفرًا في جميع فئات ExploitGym — لا استغلالات عملية، بحكم التصميم.
بنية CrowdStrike هي قصة الحلقة: يحاكي Red Tempest من SafeMind خصومًا قائمين على الذكاء الاصطناعي، وينشر Blue Solano تدابير دفاعية مُختبَرة في المعارك، وتُشغّلهما المنصات باستمرار بالاستناد إلى بيانات Falcon، ثم تُعيد النتائج إلى النظام فيتحسّن كلاهما — وهذه هي حلقة التطور المشترك. ويتولى Nemotron 3 Ultra من NVIDIA تنسيق المنصة الدفاعية، بينما يعزز Nemotron 3 Super المضبوط بدقة توليد القواعد. وفي حين تُوزّع Microsoft المهام بين نموذجين لتوفير التكلفة، تُدرّب CrowdStrike نموذجين ضد بعضهما البعض لتحسين الاكتشاف.

الادعاء مقابل النتيجة
MAI-Cyber-1-Flash لديه أدلة أكثر تحديدًا، ويحتاج إلى تحفّظ أكبر. إن نتيجة 95.95% هي درجة CyberGym Level 1 لنظام MDASH — أي الإعداد المدمج للنموذج مع الأداة المساعدة (harness) مع GPT-5.4، وليس النموذج المستقل. يختبر CyberGym L1 إعادة إنتاج الثغرات المعروفة: توليد كود إثبات مفهوم عملي من وصف ومن شفرة مصدرية غير مصحَّحة، وليس اكتشافًا أعمى أو التحقق من صحة التصحيح. عند إطلاق النموذج، لم تكن النتيجة على اللوحة العامة لـ CyberGym، التي ما زالت تعرض تقديم Microsoft السابق لنظام MDASH بنسبة 88.4%. كما تبلغ Microsoft أيضًا عن CVEBench 0.314 وCyberSecEval4 0.553 وCRSBench 0.651 — وكلها منشورة من قِبل البائع.
أدلة SafeMind أقل تحديدًا وأقل قابلية للتحقق. تذكر CrowdStrike أنها تحقق معدل كشف أعلى بنسبة 29%، ومعالجة أسرع 6 أضعاف من النهاية إلى النهاية، وتوفيرًا بنسبة 99% في تكاليف الكشف والمعالجة مقارنة بالنماذج الحدودية الرائدة والمعايير مفتوحة المصدر؛ وتذكر NVIDIA أن نموذج Blue Solano حقق دقة أعلى من النماذج الحدودية الرائدة بتكلفة أقل بنسبة 99% في التقييمات الداخلية. لا توجد نتيجة علنية يمكن وضعها بجوار 95.95% — لا إدخال في CyberGym، ولا قائمة نتائج منشورة، ولا ظهور في لوحة الصدارة. أحد النظامين ينشر رقمًا، والآخر ينشر آلية؛ ولم يتم التحقق من أي منهما بشكل مستقل.
• الكشف والفرز — Blue Solano من SafeMind يولّد مرشحات للكشف من تليمترية Falcon، ويرقّي المؤكَّد منها إلى اكتشافات قابلة للتنفيذ؛ بينما MAI-Cyber-1-Flash مُحسَّن لتحليل الثغرات المكثَّف برمجيًا وفرز التصحيحات في MDASH.
• قدرة استغلال الثغرات — كلاهما صفر بحكم التصميم. MAI-Cyber-1-Flash يسجّل 0 في جميع فئات ExploitGym كخيار أمانٍ صريح؛ ويقيّد SafeMind نماذجه على المخرجات الدفاعية دون توليد استغلالات حرّة الشكل.
• المواصفات — MAI-Cyber-1-Flash: 137B إجمالاً / 5B نشطًا (MoE)، وسياق 256K. SafeMind: عدد المعاملات غير معلن، والسياق غير معلن.
• السعر — لا توجد لـ MAI-Cyber-1-Flash قيمة رمزية عامة ولا واجهة برمجة تطبيقات مستقلة؛ تكلفة SafeMind ضمن منصة Falcon.
الوصول — معاينتان خاصتان، سؤال مفتوح واحد
لا يمكن توجيه أيٍّ من النموذجين. MAI-Cyber-1-Flash موجود كمكوّن مضمّن في MDASH، ويُقدَّم عبر المعاينة الخاصة Azure AI Foundry لعملاء MDASH المعتمدين فقط — لا توجد واجهة برمجة تطبيقات عامة. يعمل SafeMind بشكل أصلي في منصة Falcon، مع وصول مستقل محجوب خلف Project QuiltWorks. وبالنسبة لفريق أمان خارج هاتين المعاينتين، يكون النموذجان طموحيين فعليًا: الآليات علنية، لكن الوصول ليس كذلك.
ما يمكن استدعاؤه اليوم هو المستوى الطليعي العام الذي يتحاشاه المزوّدان. عبر OrcaRouter، Claude Opus 5 يعمل بالسعر المدرج لدى Anthropic: $5.00 لكل مليون توكن إدخال و$25.00 لكل مليون توكن إخراج، مع تمرير الأسعار دون أي زيادة — وهو نموذج بسياق 1M تُعد أعباء فحص الأمان فيه من الأكثر استخدامًا في بيئات الإنتاج. GPT-5.6 Sol يجاوره بسعر $4.00 لكل مليون توكن إدخال و$20.00 لكل مليون توكن إخراج. مفتاح API واحد يصل إلى كليهما وإلى أكثر من 200 نموذج آخر، مع تجاوز تلقائي للفشل بين المزوّدين — وهو البديل العملي لنمط التوجيه بأسلوب MDASH الذي تصفه Microsoft، دون المعاينة الخاصة. إذا كان الدرس المستفاد من MAI-Cyber-1-Flash هو أن متخصّصًا رخيصًا إلى جانب نموذج طليعي مؤجَّل يمثل الشكل الصحيح لتكلفة أعمال الأمان، فإن هذا الشكل متاح اليوم لأي شخص عبر موجّه يمرر أسعار المزوّدين كما هي.


مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
