Что такое Gemini 3.5 Flash Cyber? Объяснение модели Google Gated Vulnerability-Hunting
Guides & Insights

Что такое Gemini 3.5 Flash Cyber? Объяснение модели Google Gated Vulnerability-Hunting

Автор

jinhao song

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

21 июля 2026 года Google DeepMind объявила Gemini 3.5 Flash Cyber — третью и самую необычную из трех моделей, выпущенных в тот день, наряду с универсальными Gemini 3.6 Flash и Gemini 3.5 Flash-Lite. Это не универсальная модель, с которой можно общаться или вызывать через API. Это специалист по безопасности кода: модель, дообученная на основе Gemini 3.5 Flash для поиска, проверки и исправления уязвимостей в программном обеспечении, работающая внутри агента CodeMender от Google. И, что крайне важно, доступ к ней ограничен — она предоставляется только правительствам и «доверенным партнерам» в рамках пилотного проекта с ограниченным доступом, без публичной доступности, самостоятельной регистрации и опубликованной цены.

Это принципиально отличает его от собратьев, которые общедоступны и оцениваются за токен, как и любая другая модель из прайс-листа. У Flash Cyber нет прайс-листа, потому что у него нет публичного продукта, к которому его можно было бы прикрепить — он существует исключительно в рамках закрытой пилотной программы. Это объяснение углубляется дальше заголовка: что такое Flash Cyber на самом деле, какие из его показателей производительности действительно независимы, а какие являются внутренним тестированием Google, как на самом деле работает доступ и ценообразование, и для кого — реалистично — эта модель вообще предназначена.

Краткий вердикт. Gemini 3.5 Flash Cyber — это реальная, ограниченная модель безопасности кода, работающая внутри CodeMender для поиска и исправления уязвимостей ПО. Она не является общедоступной, не имеет публичного API или ценообразования и доступна только правительствам и доверенным партнёрам. На одном стороннем бенчмарке (CyberGym) она показывает ~83,2%, что близко к показателям OpenAI GPT-5.5-Cyber (85,6%) и Anthropic Mythos 5 (83,8%) — преимущество Google подаётся как экономическая эффективность, а не превосходство в возможностях. Большинство других заявлений о бенчмарках, включая показатели количества проблем V8, являются внутренними оценками Google.

Основные выводы

•  Это специалист по безопасности кода, настроенный на поиск, проверку и исправление уязвимостей программного обеспечения — а не инструмент SOC/разведки угроз или анализа вредоносных программ и не общий чат-бот.

•  Он ограничен, не GA. Доступ ограничен правительствами и доверенными партнерами через платформу CodeMender; нет публичного API и опубликованной цены за токен.

•  Дообучено на основе Gemini 3.5 Flash, и развернуто в виде нескольких параллельных вызовов под-агентов на каждый отчет об уязвимости (Google упоминает до ~5), объединенных в один результат. Размер контекстного окна не раскрывается.

•  Один сторонний бенчмарк. CyberGym ~83.2% (по сообщениям прессы), против GPT-5.5-Cyber 85.6% и Mythos 5 83.8%. Остальные результаты (Big Sleep, Chrome, V8) являются собственными внутренними оценками Google.

•  Двойного назначения, намеренно. Модель, настолько хорошо находящая эксплуатируемые ошибки, опасна при неправильном использовании, поэтому основная мера защиты Google — контроль доступа, а также одобрение человеком перед любым исправлением и изолированная проверка результатов.

Это другая модель, отличная от Sec-Gemini. Более ранняя отдельная модель угроз Google занимается анализом инцидентов и первопричин; Flash Cyber занимается исключительно исправлением уязвимостей кода.

Он создан для защитников, а не для разработчиков. Предполагаемые пользователи — это передовые команды безопасности, правительства и проверенные корпоративные партнеры, занимающиеся исследованием уязвимостей в больших масштабах — явно не потребители или обычные разработчики приложений.

Большинство показателей производительности здесь — это собственные внутренние оценки Google; только CyberGym является настоящим сторонним бенчмарком, и даже конкретный показатель 83,2% лучше ссылаться на анализ прессы, чем на дословный текст Google — ссылайтесь на него как на «сообщенный». Не описывайте Flash Cyber как общедоступный и не цитируйте цену за токен; он ограничен и не имеет цены. Не путайте его с Sec-Gemini, отдельной моделью Google 2025 года для разведки угроз.

Что такое Gemini 3.5 Flash Cyber

«Cyber» в данном контексте означает безопасность кода и программного обеспечения — а именно поиск, подтверждение и исправление уязвимостей в исходном коде. Это не аналитик по безопасности операций, не ассистент по разведке угроз и не классификатор вредоносного ПО, и оно не отвечает на общие вопросы, как чат-модель. Оно работает внутри CodeMender, AI-агента Google DeepMind для автоматического исправления уязвимостей в коде (впервые представленного в октябре 2025 года), а не продаётся как отдельный чат или API-продукт. Это различие важно: Flash Cyber — это не модель, которую вы сами нацеливаете на кодовую базу, а компонент внутри более крупного, строго контролируемого конвейера, который Google эксплуатирует от имени своих пилотных партнёров.

На практике несколько суб-агентов Flash Cyber работают параллельно над одной кодовой базой — Google упоминает до пяти на один отчет об уязвимости — и их индивидуальные результаты объединяются в единый консолидированный отчет. Это агентская, многозапросная архитектура, а не одноразовый чат-обмен, что во многом объясняет, почему Google представляет её как конкурентоспособную по сравнению с гораздо более крупными моделями: преимущество достигается за счёт оркестрации, а не обязательно за счёт сырого размера модели. Прежде чем любое исправление будет выпущено, его утверждает человек, а сама уязвимость проверяется в песочнице — модель предлагает и находит, но люди и инфраструктура контролируют, что в итоге попадает в развёртывание.

Она доработана на основе Gemini 3.5 Flash. Google не раскрыл размер контекстного окна или мультимодальные возможности, специфичные для Flash Cyber, что само по себе является показательным моментом: в отличие от общедоступных моделей Flash, здесь нет спецификации, которую можно было бы проверить. Ее целевые пользователи — защитники передовой линии, правительства и проверенные корпоративные партнеры, занимающиеся исследованием уязвимостей и сортировкой исправлений в больших масштабах — явно не потребители или обычные разработчики, и явно не продукт, который можно добавить в свой стек, просто зарегистрировавшись.

Глубокое погружение в бенчмарки: что означают цифры

В рекорде есть ровно один сторонний бенчмарк, и стоит понять, что он на самом деле проверяет. CyberGym — академический бенчмарк, созданный группой, в которую входит Dawn Song из UC Berkeley. Он оценивает агентов на более чем 1 500 задокументированных уязвимостях в 188 реальных проектах с открытым исходным кодом. Это по-настоящему реалистичный тестовый полигон: настоящий код, реальные исторические ошибки, а не синтетические головоломки. Согласно прессе, Flash Cyber набирает около 83,2% на CyberGym, против 85,6% у OpenAI GPT-5.5-Cyber и 83,8% у Anthropic Mythos 5. Это тесная тройка лидеров, а не отрыв кого-то одного — именно поэтому собственные сообщения Google делают упор на экономическую эффективность, а не на сырой балл. Примечательно, что блог Google делает лишь качественное заявление о «конкурентоспособной производительности по сравнению с моделями значительно большего размера»; точная цифра 83,2% взята из пресс-анализа анонса, а не из собственного текста Google или из доступной для проверки записи в публичном рейтинге.

{{1}}Результат V8 – это число иного рода, и это исключительно собственная метрика Google.{{/1}} {{2}}В ходе тестирования с использованием движка JavaScript V8 компания Google сообщает, что Flash Cyber обнаружил 55 уникальных подтверждённых проблем по сравнению с 47 для стандартной Gemini 3.5 Flash и 36 для Claude Opus 4.6 — включая 10 проблем, не замеченных ни одной другой моделью.{{/2}} {{3}}Это звучит впечатляюще, поскольку называется конкретная конкурирующая модель и конкретное количество, но это внутренний тест Google, проведённый на собственной инфраструктуре Google против собственной выбранной цели.{{/3}} {{4}}Ни одна сторонняя организация не проводила эту оценку, не публиковала её методологию для воспроизведения и не проверяла результаты независимо.{{/4}} {{5}}Это реальный результат, который, как утверждает Google, был получен — но это заявление продавца, а не проверенный аудитом результат, и это различие имеет здесь большее значение, чем в большинстве отчётов о тестировании.{{/5}}

Оценка “Big Sleep” следует той же схеме, но с ещё более низким разрешением. Тестируя на сложных реальных кодовых базах, таких как Chrome и Safari, Google утверждает, что Flash Cyber “значительно превзошёл” основные версии Gemini 3.5 Flash и 3.6 Flash — но это качественное утверждение без точных цифр, не говоря уже о проверке сравнения третьей стороной. Сложите все три результата рядом, и выявится закономерность: единственное число с внешним происхождением (CyberGym) показывает плотную, ничем не примечательную группу; две более громкие победы (V8, Big Sleep) — это обе оценки Google своей собственной модели на основе выбранных Google же базовых линий.

Эта закономерность не уникальна для Google, но здесь её сложнее исправить, чем обычно, потому что Flash Cyber является закрытым. В случае открытой модели или модели с API независимые исследователи могут в конечном итоге повторно запустить эталонный тест и подтвердить или опровергнуть цифры вендора — именно так обычно обнаруживаются завышенные утверждения. С Flash Cyber такая проверка в значительной степени невозможна: внешние исследователи просто не имеют доступа, чтобы самостоятельно пройти CyberGym, свой собственный V8 sweep или любой другой тест с использованием реальной модели. Даже сторонняя репутация CyberGym охватывает только дизайн бенчмарка, а не независимый повторный прогон Flash Cyber на нём — сам показатель всё равно восходит к раскрытию информации Google. Пока доступ не расширится за пределы нынешнего пилота, любое заявление о производительности этой конкретной модели — независимо звучащее или нет — в конечном счёте основывается на доверии к собственному отчёту Google.

Не путайте это с Sec-Gemini

У Google есть более одной модели "безопасности", и их легко перепутать. Sec-Gemini (анонсирована около апреля 2025 года) — это отдельная, более ранняя экспериментальная модель, предназначенная для рабочих процессов угроз-интеллекта — анализа первопричин и инцидентов, интегрированная с Google Threat Intelligence и базой данных OSV. Если вас интересуют случаи использования SOC/threat-intel, то Sec-Gemini, а не Flash Cyber — это релевантная линия. Flash Cyber узко ориентирована на поиск и исправление уязвимостей кода и находится внутри CodeMender.

Доступ, цены и как на самом деле получить возможность работы с моделью безопасности

История доступа проста, хотя и бесполезна для большинства читателей: её нет. Flash Cyber не продаётся, не имеет цены и недоступен через какой-либо ключ API, который вы можете запросить. Единственный способ попасть — быть государственным учреждением или проверенным "доверенным партнёром", допущенным к пилотному проекту CodeMender — нет самостоятельной регистрации, нет формы листа ожидания, гарантирующей доступ, и нет опубликованного прайс-листа, потому что нет публичного продукта для оценки. Google заявил, что доступ со временем расширится, но не привязал к этому заявлению сроков или даты GA, поэтому "когда-нибудь" — самый конкретный ответ на данный момент.

Это резкий контраст с собственными «родственниками» Flash Cyber. Gemini 3.6 Flash и Gemini 3.5 Flash-Lite, анонсированные в тот же день, общедоступны и оцениваются за токен, как и любая другая коммерческая модель. Flash Cyber находится в совершенно другой категории — ближе к внутренней возможности Google, которая случайно была публично раскрыта, чем к продуктовой линейке. Бюджет здесь не является ограничением; даже хорошо финансируемое предприятие без исследовательских отношений в области безопасности с Google не имеет доступа к ключу API Flash Cyber на сегодняшний день.

Итак, что на самом деле делают команды, если они хотят получить помощь ИИ в поиске и устранении уязвимостей в собственном коде прямо сейчас? Для подавляющего большинства, кто не участвует в пилотной программе, практический путь — использование универсальных frontier-моделей — тех, что имеют статус GA и платные — для той же работы: ревью кода, триаж уязвимостей, написание патчей, с собственным человеческим ревью и песочницами вокруг них. Это принципиально иной инструмент, чем целенаправленный специалист, обученный именно для этой задачи, но это доступный вариант. Агрегаторы вроде OrcaRouter, который стоит за 200+ моделями на одной OpenAI-совместимой конечной точке, — вот как большинство команд сегодня собирают такой рабочий процесс с общими моделями безопасности, вместо того чтобы ждать закрытого пилота, в который их могут никогда не допустить.

Для кого это

Проверенные защитники внутри пилотного проекта. Если вы являетесь государственным учреждением или организацией, которую Google уже признал доверенным партнером, Flash Cyber — это действительно специально созданный инструмент: он работает в рамках рабочего процесса CodeMender «обнаружение-проверка-одобрение-исправление», его параллельная суб-агентная архитектура предназначена для сканирования реальных кодовых баз в масштабе, а собственное тестирование Google показывает, что он конкурентоспособен — или по некоторым внутренним метрикам опережает — более крупные общие модели на этой конкретной задаче. Для этой узкой аудитории ценностное предложение реально, даже если некоторые подтверждающие цифры являются самоотчетными.

Все остальные — а это практически все. Если вы обычная инженерная команда, консалтинговая компания по безопасности без партнерства с Google или индивидуальный исследователь, Flash Cyber для вас просто не вариант, независимо от того, насколько подходящим кажется ваш сценарий использования. Нет ни гарантированно работающей процедуры подачи заявки, ни цены, которую можно было бы заплатить за доступ. Ваш реальный путь к уязвимостям с помощью ИИ сегодня — это общедоступная frontier-модель, направляемая через что-то вроде OrcaRouter (если вам нужна гибкость между провайдерами) в сочетании с собственной дисциплиной проверки, поскольку ни одна из этих общих моделей не имеет встроенных механизмов ручного утверждения и проверки в песочнице, как у CodeMender.

Команды решают, стоит ли ждать. Если ваша организация рассматривает партнерство с Google исключительно ради доступа, стоит планировать с учетом того, что даты GA пока нет — пока что любой текущий процесс безопасности должен работать на общедоступных моделях, а затем вернуться к вопросу, когда и если пилот Google расширится. Ставить дорожную карту на ограниченный доступ без объявленных сроков — риск, на который большинству команд не стоит идти.

Часто задаваемые вопросы

Можно ли использовать Gemini 3.5 Flash Cyber?

Нет, если только вы не проверенное правительственное учреждение или доверенный партнер. Это пилотный проект с ограниченным доступом внутри CodeMender, без публичного API, без самостоятельного доступа и без опубликованных цен. Google говорит, что доступ со временем расширится, но не объявил дату GA.

Что это на самом деле делает?

Он находит, проверяет и исправляет уязвимости программного обеспечения в исходном коде, работая как параллельные под-агенты, результаты которых объединяются в отчет. Человек утверждает любые исправления, а уязвимости проверяются в изолированной среде перед тем, как о них сообщается.

Как это сравнивается с кибермоделями OpenAI и Anthropic?

На одном общем стороннем тесте (CyberGym) три модели показывают близкие результаты: Flash Cyber ~83,2%, Anthropic Mythos 5 83,8%, OpenAI GPT-5.5-Cyber 85,6%. Google позиционирует свое преимущество как экономическую эффективность, а не максимальный сырой результат. Все три доступны только проверенным организациям.

Какие у него характеристики?

Он доработан на основе Gemini 3.5 Flash. Google не опубликовал информацию о его контекстном окне, мультимодальности или количестве параметров для Flash Cyber в частности.

Это опасно / двойного назначения?

Google признает риск двойного назначения — модель, хорошо находящая эксплуатируемые ошибки, может быть использована в атакующих целях — и называет ограничение доступа своей основной мерой смягчения, наряду с одобрением исправлений человеком и изолированной проверкой результатов.

Является ли оценка CyberGym независимо проверенной?

Сам по себе CyberGym является подлинным сторонним академическим бенчмарком. Однако конкретный показатель 83,2%, приписываемый Flash Cyber, исходит из сообщений прессы об объявлении Google, а не из дословного текста Google или действующей записи в публичной таблице лидеров. Поскольку модель имеет ограниченный доступ, ни одна сторонняя организация в настоящее время не может самостоятельно перезапустить её. Относитесь к этому числу как к сообщённому, а не независимо подтверждённому.

Когда Flash Cyber станет общедоступным?

Google не сообщил об этом. Было заявлено, что доступ будет расширяться со временем за пределы текущего пилотного проекта с участием правительств и доверенных партнеров, но дата общего доступа (GA) или сроки не были опубликованы, так что пока нет ничего конкретного, на что можно было бы ориентироваться.

Суть

Gemini 3.5 Flash Cyber — это узконаправленный серьёзный инструмент: модель для кибербезопасности, которая ищет и устраняет уязвимости внутри CodeMender, доступная правительствам и проверенным партнёрам. Она действительно способна на единственном независимом бенчмарке, но находится в тесной группе с моделями кибербезопасности от OpenAI и Anthropic, не вырываясь вперёд, и почти все её выдающиеся показатели — это внутренние оценки Google. Если вы не верифицированный партнёр, вы не можете её использовать, а для общей работы, связанной с безопасностью вашего собственного кода, доступные frontier-модели остаются практичным путём. Приведённые ниже сравнения ставят её в один ряд с двумя реальными конкурентами.


© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

Свяжитесь с нами

Присоединяйтесь к сообществу

DiscordEmailXGitHubYouTube