
CrowdStrike SafeMind против Claude Mythos 5: специалист по защите на фронтире двойного назначения Anthropic
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
CrowdStrike SafeMind и Claude Mythos 5 — два самых значимых анонса моделей безопасности 2026 года, и они решают одну и ту же проблему с противоположных сторон. SafeMind — это семейство специализированных защитных моделей, которое CrowdStrike создала вместе с NVIDIA на открытой базе NVIDIA Nemotron: атакующая и защитная модели находятся в цикле совместной эволюции и обучаются на телеметрии сенсоров Falcon и данных пятнадцати лет реагирования на инциденты. Claude Mythos 5 — это фронтирная модель Anthropic с классификацией ASL-3, монолитный универсал, исключительно сильный в поиске уязвимостей; она содержится в контуре доверенного доступа и направляется на реальные кодовые базы только через собственный сканер Anthropic Claude Security. Это сравнение о том, какая философия подходит какой команде, а также о том, что ни одну из моделей нельзя вызвать через сторонний API.
Два разных ответа на «у защитников нет передового ИИ»
Фраза Курца на Fal.Con — «у атакующих был передовой ИИ, а у защитников — нет» — это общий диагноз. А вот рекомендации расходятся. Ответ Anthropic с Claude Mythos 5 заключался в создании одной чрезвычайно мощной модели, классификации её как ASL-3 (уровня, зарезервированного для возможностей, которые «значительно усиливают кибернаступление»), и ограничении доступа через проверенную программу и сканер с ограничениями. Обоснованием таких ограничений служат результаты red-team: ошибка OpenBSD, остававшаяся необнаруженной 27 лет; уязвимость FFmpeg 16-летней давности, пережившая пять миллионов автоматических проверок сканером; браузерный эксплойт, объединяющий четыре уязвимости и позволяющий выйти из песочниц как рендерера, так и ОС; а также повышение привилегий в ядре Linux с уровня пользователя до root.
Ответ CrowdStrike — {{1}}структурный, а не монолитный{{/1}}. SafeMind объединяет Red Tempest — {{2}}атакующую модель, имитирующую противников, действующих на основе ИИ{{/2}} — с Blue Solano, {{3}}оборонительной моделью, применяющей проверенные в бою меры защиты{{/3}}, и запускает их в непрерывном цикле совместной эволюции: {{4}}атакующая сторона находит вектор атаки, защита закрывает его, телеметрия Falcon фиксирует результат, и обе модели совершенствуются{{/4}}. В основе лежит оркестрация NVIDIA — {{5}}Nemotron 3 Ultra управляет защитной обвязкой, а тонко настроенный Nemotron 3 Super обеспечивает работу субагента генерации правил{{/5}}. Ставка в том, что защита становится лучше благодаря тренировке против реальной модели атак на реальных данных конечных точек, а не за счет того, чтобы сделать одного универсала чуть более параноидальным.

Табло с включенными надписями
• Обнаружение — SafeMind заявляет о частоте обнаружения на 29% выше, чем у ведущих frontier-моделей и open-source бейзлайнов; у Claude Mythos 5 нет сопоставимого ключевого показателя обнаружения, только результаты бенчмарков от Anthropic и один результат, полученный провайдером.
• Независимые бенчмарки — ни одна из моделей не представлена в публичном рейтинге. Результаты Mythos 5: CyberGym L1 — 83,8% и ExploitBench — 78% — заявлены вендором; цифры SafeMind: 29% / 6x / 99% — заявлены CrowdStrike и не воспроизведены.
• Архитектура — Claude Mythos 5 — это монолитная фронтирная модель с контекстом в 1 млн токенов; SafeMind — это двухмодельная агентная система на Nemotron, отличительной особенностью которой является цикл, а не количество параметров (которое CrowdStrike не раскрыло).
• Цена — ни у одного нет публичной цены за токен. У Mythos 5 вообще нет стороннего API; стоимость SafeMind включена в платформу Falcon, а отдельная цена не раскрывается.
• Триаж и генерация правил обнаружения — это единственное измерение, в котором проводится прямое сравнение. Blue Solano от SafeMind формирует кандидатов в правила обнаружения на основе телеметрии Falcon и переводит подтверждённых кандидатов в рабочие правила обнаружения. Mythos 5 в составе Claude Security выдаёт результаты с указанием категории CWE, уровня серьёзности, уверенности, влияния, шагов воспроизведения и рекомендуемых исправлений. Обе системы строго ограничены созданием защитных артефактов — свободная отправка запросов модели не предусмотрена.
Доступ к реальности — ни то, ни другое не является вызываемым.
Самый важный факт об этом противостоянии — одновременно и самый скучный: вы не можете вызвать ни одну из моделей. Claude Mythos 5 остаётся внутри защищённого контура доступа Anthropic, доступен только через Project Glasswing и сканер Claude Security для корпоративных клиентов, и никакой маршрутизатор этого не изменит. CrowdStrike SafeMind работает нативно в платформе Falcon, а автономные модели и обвязки закрыты за Project QuiltWorks. Нет ни публичного эндпоинта, ни цен за токены и — в обозримом будущем — ни сторонней интеграции, за которой можно было бы наблюдать.
То, что сегодня доступно для вызова, — это следующая ступень вниз: передовые модели, которые выполняют задачи безопасности и продаются через обычный API. Собственная модель Anthropic Claude Fable 5 — родственная модель из той же линейки, оснащённая классификатором безопасности, — работает на OrcaRouter по прейскуранту Anthropic: $10.00 за миллион входных токенов и $50.00 за миллион выходных токенов, с нулевой наценкой. Claude Opus 5 стоит $5.00 / $25.00, и один API-ключ открывает доступ к обеим моделям и ещё 200+ другим, с автоматическим переключением между провайдерами. Для команды, которой нужен анализ кода класса Mythos без Enterprise-контракта, рабочий процесс на основе routing-DSL — Claude Fable 5 с автоматическим переходом на Claude Opus 5 — является практичной заменой, пока Anthropic не расширит доверенный доступ.

Так какой же?
Честный ответ таков: для большинства организаций выбор стоит не между SafeMind и Claude Mythos 5, а в том, в чьём закрытом контуре вы уже живёте. Если вы клиент CrowdStrike, SafeMind появляется внутри платформы, которой вы уже пользуетесь, настроенный на телеметрию, которую вы уже генерируете, а цикл коэволюции работает, пока вы спите. Если вы клиент Anthropic Enterprise, Claude Security на Mythos 5 сканирует ваши репозитории в рамках плана, за который вы уже платите, по стандартным тарифам за токены. Выбор между ними означает, какой плоскости данных вы доверите эту возможность, а это инфраструктурное решение, а не вопрос бенчмарков.
Эталонный вопрос — могут ли кандидаты Blue Solano в детектировании на самом деле превзойти результаты Mythos 5 на той же кодовой базе — реален и пока не имеет ответа, поскольку эти две системы никогда не встречались на общей публичной оценке. Именно этот разрыв стоит отслеживать. А пока модели, которые действительно можно задействовать для задач безопасности, — это открытые собратья с переднего края, а прозрачность цен на маршрутизатор с нулевой наценкой делает их опробование вопросом изменения двух строк, а не целого проекта по закупкам.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
