ما هو Gemini 3.5 Flash Cyber؟ نموذج صيد الثغرات المقيد من Google، موضح
Guides & Insights

ما هو Gemini 3.5 Flash Cyber؟ نموذج صيد الثغرات المقيد من Google، موضح

الكاتب

jinhao song

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

في 21 يوليو 2026، أعلنت Google DeepMind Gemini 3.5 Flash Cyber — النموذج الثالث والأكثر غرابة من بين ثلاثة نماذج أطلقتها في ذلك اليوم، إلى جانب النموذج العام Gemini 3.6 Flash و Gemini 3.5 Flash-Lite. إنه ليس نموذجًا عامًا يمكنك التحدث معه أو الاتصال به عبر واجهة برمجة تطبيقات (API). إنه متخصص في أمان الشيفرات البرمجية: نموذج تم ضبطه بدقة من Gemini 3.5 Flash لاكتشاف نقاط الضعف في البرمجيات والتحقق منها وإصلاحها، ويعمل داخل وكيل CodeMender التابع لـ Google. والأهم من ذلك، أنه محظور — متاح فقط للحكومات و"الشركاء الموثوقين" في برنامج تجريبي محدود الوصول، دون توفر عام، أو اشتراك ذاتي، أو سعر منشور.

ذلك يجعله مختلفًا جوهريًا عن نظرائه، المتاحين عمومًا بأسعار لكل رمز كأي نموذج آخر في قائمة الأسعار. فلاش سايبر ليس له قائمة أسعار، لأنه لا يملك منتجًا عامًا يُلحق به واحدة — فهو يعيش بالكامل داخل برنامج تجريبي مغلق. هذا الشرح يتعمق أكثر من العنوان: ما هو فلاش سايبر فعليًا، أي من أرقام أدائه مستقلة حقًا مقارنة باختبارات جوجل الداخلية، كيف تعمل آلية الوصول والتسعير فعليًا، ولمن — واقعيًا — هذا النموذج مخصص.

خلاصة الحكم.Gemini 3.5 Flash Cyber هو نموذج حقيقي لأمان الشيفرات البرمجية مقيد الوصول، يعمل داخل CodeMender لاكتشاف وإصلاح الثغرات الأمنية في البرمجيات. لم يتم طرحه بشكل عام (GA)، ولا يحتوي على واجهة برمجة تطبيقات (API) عامة أو تسعير، ويقتصر استخدامه على الحكومات والشركاء الموثوقين. في الاختبار المرجعي الوحيد من طرف ثالث المذكور (CyberGym)، تم الإبلاغ عن نسبة نجاح تبلغ حوالي 83.2%، وهي متقاربة بشكل كبير مع نماذج GPT-5.5-Cyber من OpenAI (85.6%) وMythos 5 من Anthropic (83.8%) — حيث تُقدم ميزة Google على أنها كفاءة في التكلفة وليس تفوقًا في القدرات. معظم ادعاءات الاختبارات المرجعية الأخرى، بما في ذلك أعداد المشكلات في V8، هي تقييمات داخلية لـ Google.

النقاط الرئيسية

إنه متخصص في أمان الكود، مُصمم لاكتشاف نقاط الضعف في البرامج والتحقق منها وإصلاحها — ليس أداة SOC/استخبارات التهديدات أو فرز البرامج الضارة، وليس روبوت محادثة عامًا.

•  إنها مقيدة، وليست GA.الوصول مقتصر على الحكومات والشركاء الموثوقين عبر منصة CodeMender؛ لا توجد واجهة برمجة تطبيقات عامة ولا سعر منشور لكل توكن.

مضبوط بدقة من Gemini 3.5 Flash،ونشر كاستدعاءات متعددة لوكلاء فرعيين متوازيين لكل تقرير ثغرة (تذكر Google ما يصل إلى ~5)، مدمجة في نتيجة واحدة. لم يتم الكشف عن نافذة السياق.

معيار واحد من طرف ثالث. CyberGym ~83.2% (حسب التقارير الصحفية)، مقابل GPT-5.5-Cyber 85.6% وMythos 5 83.8%. النتائج الأخرى (Big Sleep، Chrome، V8) هي تقييمات داخلية لـGoogle.

•  استخدام مزدوج، عن قصد. نموذج بهذه الجودة في العثور على ثغرات قابلة للاستغلال خطير إذا أُسيء استخدامه، لذا فإن الإجراء الوقائي الرئيسي من جوجل هو التحكم في الوصول، بالإضافة إلى الموافقة البشرية قبل أي تصحيح والتحقق المعزول من النتائج.

•  إنه نموذج مختلف عن Sec-Gemini. نموذج الاستخبارات التهديدية المنفصل السابق من Google يعالج تحليل الحوادث والأسباب الجذرية؛ بينما يركز Flash Cyber بشكل ضيق على تصحيح ثغرات الشيفرة.

•  إنها مصممة للمدافعين، وليس للمطورين. المستخدمون المقصودون هم فرق الأمن في الخطوط الأمامية، والحكومات، وشركاء المؤسسات الموثوقين الذين يقومون بأبحاث الثغرات على نطاق واسع — وليس المستهلكين أو مطوري التطبيقات العامة بشكل صريح.

معظم أرقام الأداء هنا هي تقييمات داخلية من جوجل نفسها؛ فقط CyberGym هو معيار طرف ثالث حقيقي، وحتى الرقم المحدد 83.2% يُعزى بشكل أفضل إلى تحليلات الصحافة بدلاً من نص جوجل الحرفي — استشهد به على أنه "مُبلغ عنه". لا تصف Flash Cyber بأنها متاحة بشكل عام ولا تقتبس سعرًا لكل رمز؛ فهي مقيدة وبدون تسعير. لا تخلط بينها وبين Sec-Gemini، نموذج استخبارات التهديدات المنفصل من جوجل لعام 2025.

ما هو Gemini 3.5 Flash Cyber

"السايبر" هنا يعني أمن الكود والبرمجيات — تحديدًا إيجاد الثغرات الأمنية في الكود المصدري وتأكيدها وإصلاحها. إنه ليس محللًا لعمليات الأمن، أو مساعد استخبارات تهديدات، أو مصنف برامج ضارة، ولا يجيب عن الأسئلة العامة كما يفعل نموذج الدردشة. إنه يعمل داخل CodeMender، وكيل الذكاء الاصطناعي من Google DeepMind لتصحيح أمن الكود آليًا (الذي عُرض لأول مرة في أكتوبر 2025)، بدلًا من بيعه كمنتج دردشة أو واجهة برمجية مستقل. هذا التوجّه مهم: Flash Cyber ليس نموذجًا توجّهه أنت بنفسك إلى قاعدة كود، بل هو مكون داخل خط أنابيب أكبر ومُتحكم به بإحكام تديره Google نيابة عن شركائها التجريبيين.

في الممارسة العملية، تعمل عدة عوامل فرعية لـ Flash Cyber بالتوازي على قاعدة بيانات — تذكر Google ما يصل إلى خمسة تقريبًا لكل تقرير ثغرة — ويتم دمج نتائجها الفردية في تقرير موحد واحد. هذه بنية وكيلية متعددة الاستدعاءات بدلاً من تبادل محادثة لمرة واحدة، وهذا جزء كبير من سبب تقديم Google لها كمنافسة لنماذج أكبر بكثير: الميزة تأتي من طريقة تنسيقها، وليس بالضرورة من حجم النموذج الخام. قبل شحن أي إصلاح، يوافق إنسان عليه، ويتم التحقق من الثغرة الأساسية في بيئة معزولة — يقترح النموذج ويجد، لكن البشر والبنية التحتية يتحكمون في ما يتم نشره فعليًا.

تم ضبطه بدقة من Gemini 3.5 Flash. لم تكشف Google عن حجم نافذة السياق أو القدرات متعددة الوسائط الخاصة بـ Flash Cyber، وهو في حد ذاته نقطة بيانات: على عكس نماذج Flash المتاحة عمومًا، لا توجد ورقة مواصفات لفحصها. المستخدمون المستهدفون هم المدافعون في الخطوط الأمامية، والحكومات، وشركاء المؤسسات الموثوقين الذين يقومون بأبحاث الثغرات وفرز التصحيحات على نطاق واسع — وليس المستهلكين أو المطورين العامين على الإطلاق، وليس منتجًا يمكنك إضافته إلى مجموعتك الخاصة بالتسجيل.

تحليل معمق للمعايير: ماذا تعني الأرقام؟

يوجد معيار واحد تابع لجهة خارجية في السجل، ومن الجدير فهم ما يختبره فعليًا. CyberGym هو معيار أكاديمي – بنته مجموعة تضم Dawn Song من جامعة كاليفورنيا بيركلي – يقوم بتقييم الوكلاء ضد أكثر من 1,500 ثغرة موثقة عبر 188 مشروعًا مفتوح المصدر حقيقيًا. هذه بيئة اختبار واقعية بشكل مفيد: كود حقيقي، أخطاء تاريخية حقيقية، وليس ألغازًا اصطناعية. تضع التغطية الصحفية Flash Cyber عند حوالي 83.2% على CyberGym، مقابل OpenAI's GPT-5.5-Cyber عند 85.6% وAnthropic's Mythos 5 عند 83.8%. هذه مجموعة ثلاثية متقاربة، وليست تقدمًا ساحقًا لأي طرف – وهذا هو السبب تحديدًا وراء اعتماد رسائل Google نفسها على كفاءة التكلفة بدلاً من النتيجة الخام. من الجدير بالذكر أن مدونة Google تقدم فقط الادعاء النوعي بـ "أداء تنافسي ضد نماذج أكبر بكثير"؛ الرقم الدقيق 83.2% يأتي من التحليل الصحفي للإعلان، وليس من النص الحرفي لـ Google أو إدخال لوحة متصدرة عامة يمكنك التحقق منه بنفسك.

نتيجة V8 هي نوع مختلف من الأرقام، وهي مقياس خاص بجوجل بالكامل. في اختبار ضد محرك V8 لجافا سكريبت، تذكر جوجل أن Flash Cyber وجدت 55 مشكلة مؤكدة فريدة، مقارنة بـ 47 لنموذج Gemini 3.5 Flash القياسي، و36 لنموذج Claude Opus 4.6 — بما في ذلك 10 مشكلات لم يكتشفها أي نموذج آخر. تبدو هذه المقارنة لافتة لأنها تذكر نموذجًا منافسًا محددًا وعددًا محددًا، لكنها اختبار داخلي لجوجل يُجرى على بنيتها التحتية الخاصة ضد الهدف الذي اختارته جوجل بنفسها. لم يقم أي طرف خارجي بإجراء هذا التقييم، أو نشر منهجيته للتكرار، أو التحقق من الأعداد بشكل مستقل. إنها نتيجة حقيقية تقول جوجل إنها لاحظتها — لكنها ادعاء من البائع، وليست مدققة، وهذا الفرق مهم هنا أكثر من معظم تقارير المعايير.

تتبع تقييم "Big Sleep" نفس النمط بدقة أقل. عند الاختبار على قواعد كود معقدة وواقعية مثل Chrome وSafari، يقول Google إن Flash Cyber "تفوق بشكل كبير" على الإصدارين الرئيسيين Gemini 3.5 Flash و3.6 Flash — لكن هذا ادعاء نوعي دون أرقام دقيقة، ناهيك عن طرف ثالث يتحقق من المقارنة. عند وضع النتائج الثلاثة جنبًا إلى جنب، يظهر نمط: الرقم الوحيد الذي له مصدر خارجي (CyberGym) يُظهر مجموعة ضيقة غير لافتة؛ أما الفوزان الأكثر بريقًا (V8، Big Sleep) فهما من Google تُقيّم نموذجها الخاص وفق معاييرها الأساسية التي اختارتها بنفسها.

لا يقتصر هذا النمط على Google، لكن تصحيحه هنا أصعب من المعتاد، لأن Flash Cyber مقيد بالوصول. مع نموذج مفتوح أو حتى قابل للوصول عبر واجهة برمجة التطبيقات (API)، يمكن للباحثين المستقلين في النهاية إعادة تشغيل اختبار معياري وتأكيد أو دحض رقم البائع — وهكذا تُكتشف عادةً الادعاءات المبالغ فيها. مع Flash Cyber، لا يمكن إجراء هذا التحقق إلى حد كبير: فالباحثون الخارجيون ببساطة لا يملكون إمكانية الوصول لتشغيل اختبار CyberGym الخاص بهم، أو اختبار V8 الخاص بهم، أو أي اختبار آخر ضد النموذج الفعلي. حتى إن انتماء CyberGym لجهة خارجية لا يغطي سوى تصميم الاختبار المعياري، وليس إعادة تشغيل مستقلة لـ Flash Cyber ضده — فالنقاط نفسها ما تزال تعود إلى إفصاح Google. وإلى أن يتسع نطاق الوصول إلى ما هو أبعد من الإصدار التجريبي الحالي، فإن كل ادعاء حول أداء هذا النموذج المحدد — سواء بدا مستقلاً أم لا — يعتمد في النهاية على الثقة في حساب Google الخاص.

لا تخلط بينه وبين Sec-Gemini

لدى Google أكثر من نموذج "أمني"، ومن السهل الخلط بينها. Sec-Gemini (الذي أُعلن عنه حوالي أبريل 2025) هو نموذج تجريبي سابق منفصل يستهدف سير عمل استخبارات التهديدات — تحليل السبب الجذري والحوادث، متكامل مع Google Threat Intelligence وقاعدة بيانات OSV. إذا كان اهتمامك ينصب على حالات استخدام SOC/استخبارات التهديدات، فإن Sec-Gemini — وليس Flash Cyber — هو الخط ذو الصلة. Flash Cyber يقتصر بشكل ضيق على إيجاد وإصلاح الثغرات البرمجية، وهو موجود داخل CodeMender.

الوصول، التسعير، وكيفية الحصول فعليًا على قدرة نموذج الأمان

قصة الوصول بسيطة، وإن كانت غير مفيدة لمعظم القراء: لا يوجد وصول. لا يتم بيع Flash Cyber، ولا يُدرج بسعر، ولا يمكن الوصول إليه عبر أي مفتاح API يمكنك طلبه. الطريقة الوحيدة للدخول هي أن تكون وكالة حكومية أو "شريكًا موثوقًا" خاضعًا للتحقق مقبولاً في برنامج CodeMender التجريبي — لا يوجد تسجيل ذاتي، ولا قائمة انتظار تضمن الدخول، ولا قائمة أسعار منشورة، لأنه لا يوجد منتج عام لتسعيره. ذكرت Google أن الوصول سيتوسع بمرور الوقت، لكنها لم تُرفق جدولًا زمنيًا أو تاريخ إصدار عام بهذا البيان، لذا فإن "في النهاية" هي الإجابة الأكثر تحديدًا المسجلة حاليًا.

هذا يتناقض بشدة مع النماذج الشقيقة لـ Flash Cyber. فكل من Gemini 3.6 Flash و Gemini 3.5 Flash-Lite، اللذين أُعلن عنهما في نفس اليوم، متاحان للعامة ومسعّران لكل رمز مثل أي نموذج تجاري آخر. أما Flash Cyber فهو في فئة مختلفة تمامًا — أقرب إلى قدرة داخلية من Google تم الكشف عنها للعامة منها إلى خط إنتاج. الميزانية ليست العائق هنا؛ حتى المؤسسة الممولة جيدًا والتي لا تربطها علاقة بحثية أمنية بـ Google ليس لديها سبيل للحصول على مفتاح API لـ Flash Cyber اليوم.

إذن، ما الذي يفعله الفرق فعليًا إذا أرادوا مساعدة من الذكاء الاصطناعي في العثور على الثغرات وإصلاحها في كودهم الخاص الآن؟ بالنسبة للغالبية العظمى الذين ليسوا داخل البرنامج التجريبي، فإن المسار العملي هو تشغيل نماذج الحدود العامة — النوع الذي هو متاح بشكل عام ومسعّر — ضد نفس النوع من العمل: مراجعة الكود، فرز الثغرات، صياغة التصحيحات، مع مراجعتك البشرية الخاصة ووضعها في بيئة رملية حولها. هذه أداة مختلفة جوهريًا عن أخصائي مصمم خصيصًا لهذه المهمة، لكنها الخيار المتاح. المجمّعات مثل OrcaRouter، الذي يقف خلف أكثر من 200 نموذج على نقطة نهاية واحدة متوافقة مع OpenAI، هي الطريقة التي تجمع بها معظم الفرق هذا النوع من سير عمل الأمان للنماذج العامة اليوم بدلاً من انتظار برنامج تجريبي مقيد قد لا يتم قبولهم فيه أبدًا.

لمن هذا

المدافعون المعتمدون داخل النموذج التجريبي. إذا كنت وكالة حكومية أو مؤسسة اعترفت بها Google بالفعل كشريك موثوق، فإن Flash Cyber هي أداة مصممة خصيصًا لغرض محدد: فهي تعمل ضمن سير عمل CodeMender للاكتشاف والتحقق والموافقة والتصحيح، وبنيتها الموازية الفرعية مصممة لمسح قواعد البيانات البرمجية الحقيقية على نطاق واسع، وتشير اختبارات Google الخاصة إلى أنها تنافسية - أو تتقدم على بعض المقاييس الداخلية - على النماذج العامة الأكبر في هذه المهمة المحددة. بالنسبة لهذه الفئة الضيقة من المستخدمين، فإن القيمة المقترحة حقيقية حتى لو كانت بعض الأرقام الداعمة مبلغًا ذاتيًا.

الجميع الآخرون — أي تقريبًا الجميع. إذا كنت فريق هندسة نموذجيًا، أو شركة استشارات أمنية بدون شراكة مع Google، أو باحثًا فرديًا، فإن Flash Cyber ببساطة ليست خيارًا متاحًا بغض النظر عن مدى ملاءمة حالة استخدامك. لا توجد عملية تقديم مضمونة النجاح، ولا يوجد سعر يمكنك دفعه لفتح الوصول إليها. طريقك الواقعي اليوم نحو العمل المدعوم بالذكاء الاصطناعي في مجال الثغرات هو نموذج حدودي متاح للعموم — يُوجَّه عبر شيء مثل OrcaRouter إذا كنت تريد المرونة بين مقدمي الخدمات — بالإضافة إلى انضباط المراجعة الذاتي، لأن أيًا من تلك النماذج العامة لا تأتي مع حواجز الحماية المدمجة للموافقة البشرية والتحقق من الصندوق الرملي الخاصة بـ CodeMender.

الفرق تقرر ما إذا كانت ستنتظر. إذا كانت مؤسستك تستكشف مسار شراكة مع جوجل تحديدًا للحصول على الوصول، فمن المفيد التخطيط على أساس عدم وجود تاريخ للإصدار العام — تعامل مع أي سير عمل أمني حالي على أنه يحتاج إلى العمل على نماذج متاحة بشكل عام في هذه الأثناء، وأعد النظر فيه إذا وعندما يتوسع مشروع جوجل التجريبي. الرهان على خارطة طريق تعتمد على وصول مقيد دون جدول زمني معلن هو مخاطرة لا ينبغي لمعظم الفرق تحملها.

الأسئلة الشائعة

هل يمكنني استخدام Gemini 3.5 Flash Cyber؟

ليس إلا إذا كنت جهة حكومية معتمدة أو شريكًا موثوقًا. إنه مشروع تجريبي ذو وصول محدود داخل CodeMender، بدون واجهة برمجة تطبيقات عامة، ولا وصول ذاتي، ولا تسعير منشور. تقول Google أن الوصول سيتوسع بمرور الوقت ولكن لم تحدد موعدًا للإتاحة العامة.

ما الذي يفعله فعليًا؟

تقوم بالعثور على الثغرات البرمجية في الشيفرة المصدرية والتحقق منها وتصحيحها، وتعمل كعوامل فرعية متوازية يتم دمج نتائجها في تقرير. يوافق إنسان على أي تصحيح، ويتم التحقق من الثغرات في بيئة اختبار معزولة قبل الإبلاغ عنها.

كيف يمكن مقارنتها بنماذج الأمن السيبراني من OpenAI وAnthropic؟

في معيار مرجعي مشترك تابع لجهة ثالثة (CyberGym)، تتجمع النماذج الثلاثة بشكل متقارب: Flash Cyber ~83.2%، وAnthropic Mythos 5 بنسبة 83.8%، وOpenAI GPT-5.5-Cyber بنسبة 85.6%. تضع Google ميزتها في كفاءة التكلفة بدلاً من تحقيق أعلى الدرجات الخام. جميع النماذج الثلاثة مقصورة على المؤسسات المعتمدة.

ما هي مواصفاته؟

تم ضبطه بدقة من Gemini 3.5 Flash. لم تنشر Google نافذة السياق أو التعددية الوسائطية أو عدد المعلمات لـ Flash Cyber بشكل خاص.

هل هو خطير / ذو استخدام مزدوج؟

تعترف Google بخطر الاستخدام المزدوج — فالنموذج الجيد في العثور على الثغرات القابلة للاستغلال قد يُساء استخدامه بشكل هجومي — وتذكر تقييد الوصول كإجراء تخفيفي رئيسي، إلى جانب موافقة بشرية على التصحيحات والتحقق المُعزول من النتائج.

هل يتم التحقق من نتيجة CyberGym بشكل مستقل؟

CyberGym بحد ذاته معيار أكاديمي حقيقي من طرف ثالث. لكن النسبة المحددة البالغة 83.2% المنسوبة إلى Flash Cyber تأتي من تقارير صحافية حول إعلان جوجل، وليس من النص الحرفي لجوجل نفسه أو من إدخال مباشر في لوحة المتصدرين العامة، وبما أن النموذج مغلق، فلا يمكن لأي طرف خارجي إعادة تشغيله حاليًا. تعامل مع الرقم كما هو مذكور، وليس كمؤكد بشكل مستقل.

متى سيتوفر Flash Cyber بشكل عام؟

لم تعلن جوجل عن ذلك. لقد ذكرت أن الوصول سيتوسع بمرور الوقت ليشمل أكثر من التجربة الحالية للحكومات والشركاء الموثوقين، ولكن لم يتم نشر أي تاريخ أو جدول زمني للإتاحة العامة، لذلك لا يوجد شيء ملموس للتخطيط حوله بعد.

خلاصة القول

نموذج Gemini 3.5 Flash Cyber هو أداة ضيقة وجادة: نموذج أمان للكود يقوم بالبحث عن الثغرات وإصلاحها داخل CodeMender، وموجه للحكومات والشركاء الموثوقين. إنه قادر حقًا على المعيار المستقل الوحيد المتاح، لكنه يجلس في مجموعة ضيقة مع نماذج السيبر من OpenAI وAnthropic بدلاً من التفوق عليها، وتقريبًا كل أرقامه البارزة هي تقييمات داخلية من Google. إذا لم تكن شريكًا معتمدًا، فلا يمكنك استخدامه — وبالنسبة للأعمال العامة المتعلقة بالأمان على كودك الخاص، تظل النماذج الحدودية المتاحة هي الطريق العملي. المقارنات أدناه تضعه مقابل منافسيه الحقيقيين.


© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

تواصل معنا

انضم إلى مجتمعنا

DiscordEmailXGitHubYouTube