
CrowdStrike SafeMind vs Gemini 3.5 Flash Cyber:ループ型防御 vs Googleの脆弱性ハンター
- AlibabaNEWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.3 Flash2026-08-2658知能72コーディング
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianQwen3.8 27B2026-08-1552知能68コーディング
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング

CrowdStrike SafeMind と Google の Gemini 3.5 Flash Cyber は約2か月違いで登場し、この2つの登場は、セキュリティモデルが「安全上の注意書きが付されただけの汎用モデル」から脱却した転換点を示している。Gemini 3.5 Flash Cyber は、Google が Gemini 3.5 Flash をベースにファインチューニングしたセキュリティ専用モデルであり、政府機関と信頼できるパートナー向けのアクセス限定パイロットの中で、CodeMender エージェントに限定して実装されている。SafeMind は CrowdStrike のエージェント型モデルファミリーで、オープンな NVIDIA Nemotron ベースの上に NVIDIA と共同で構築され、Falcon プラットフォームにネイティブ搭載されている。両者とも防御ファーストであり、両者ともゲート(アクセス制限)付きであり、そして両者とも、特化がスケールに勝ると賭けている。しかし、そこに至る道筋は大きく異なる。
それぞれが基づくもの
Gemini 3.5 Flash Cyber は、出荷済みの汎用モデルを1つの仕事向けに再トレーニングしたものだ。Google によると、このモデルは Gemini 3.5 Flash を基盤に構築されており——Gemini 3.5 Flash 自体は2026年5月のモデルで、1Mトークンのコンテキストウィンドウと、公開版では100万トークンあたり1.50ドル/9.00ドルの価格設定を持つ——ソフトウェアの脆弱性を発見・検証・修正するように微調整されている。そのコストプロファイルこそが要点だ。1トークンあたりのコストが十分に安く、大規模なコードベース全体で何度も呼び出せる。これはまさに CodeMender エージェントの使い方であり、モデルを並列に呼び出して、発見事項を1つのレポートに統合する。
SafeMindは逆のアプローチを取る。CrowdStrikeはNVIDIAのオープンなNemotronモデルから始めた — Nemotron 3 Ultraが防御ハーネスを統括し、ファインチューニングされたNemotron 3 Superがルール生成サブエージェントを駆動する — そして独自の強みを重ねた:Falconセンサーテレメトリからのトレーニングデータ、Falcon Complete MDRのアノテーション、15年にわたるインシデントレスポンスの現場経験である。Gemini 3.5 Flash Cyberがコードの静的解析に最適化されているのに対し、SafeMindはエンドポイントプラットフォーム内での検出と対応のライブループに最適化されている。

現時点での検出記録
Gemini 3.5 Flash Cyber は、公開された論文や記録が存在する数少ないゲート付きサイバーモデルの一つです。Google によれば、このモデルは V8 JavaScript エンジンで55件の確認済み脆弱性を発見しました。これは Gemini 3.5 Flash の47件、Claude Opus 4.6 の36件を上回る数で、その中には他のどのモデルも見つけられなかった10件の問題が含まれています。Chrome や Safari のような複雑なコードベースを対象とした Google の Big Sleep 評価では、メインラインの Gemini 3.5 Flash と Gemini 3.6 Flash の両方を大幅に上回りました。文書化されたあるケースでは、ASLR と W^X の緩和策を回避する、信頼性100%のリモートコード実行エクスプロイトを生成しました。これは、まさにこのモデルが公開されていない理由を説明する類の成果です。Google の Cloud Vulnerability Research チームは、このモデルを使って、約2時間以内に公開 API のリモートコード実行の脆弱性と、本番サービスにおけるメモリ破損の欠陥を発見しました。
SafeMindのエビデンス基盤はより薄く、完全にベンダー由来である。CrowdStrikeは、主要なフロンティアモデルやオープンソースのベースラインと比較して、検出率が29%高い、エンドツーエンドの修復が6倍速い、検出および修復のコストが99%削減されると報告している。NVIDIAは別途、内部評価においてBlue Solanoモデルが主要なフロンティアモデルよりも高い精度を99%低いコストで達成したと報告している。どちらの数値も独立して再現されておらず、SafeMindの所見は、GoogleがV8リストを公開したような具体的で検証可能な形では一切発表されていない。エビデンスのスタイルの違いは注目に値する。Googleはモデルのキャッチログを公開し、CrowdStrikeは主張を公開したのである。
アクセス — 異なる鍵のかかったドア
どちらのモデルも公開APIからは利用できず、第三者によるルーティングもできません。Gemini 3.5 Flash CyberはCodeMender内でのみ動作し、政府および信頼できるパートナーに開放された限定アクセスのパイロットとして提供されます。そこには、防御機能を有効化して他のサイバー活動を無効化するガードレールが備わっています。Googleは、時間をかけてアクセスを拡大し、レッドチーミング機能とエンドツーエンドのエンタープライズ防御を追加する計画だと述べています。SafeMindは、CrowdStrikeの顧客向けにFalconプラットフォーム内でネイティブに動作し、スタンドアロンアクセスはProject QuiltWorksのゲートを通じてのみ許可されます。実際的な違いは、一方が政府経由のパイロットであり、もう一方が既存のエンタープライズセキュリティプラットフォーム内の製品であることです。
今日、実際に電話できる相手
ここから先、この比較はもはや机上の空論ではなくなります。ファインチューニング済みのGemini 3.5 Flash Cyberはアクセスが制限されていますが、そのベースモデルは商用製品として出荷されています。Gemini 3.5 Flashは、OrcaRouter上でGoogleの定価——入力トークン100万あたり$1.50、出力トークン100万あたり$9.00——をマークアップなしでそのまま通す形で、コンテキスト1Mトークン・出力64Kトークンとして利用可能です。これはサイバー専門モデルではなく、本記事のどこにも、そうであると主張しているとは読めません。そうではなく、これこそが、現在、通常のAPIを通じて脆弱性トリアージのワークロードに向けられる最も高性能な汎用モデルであり、大規模なコードベースを繰り返しスキャンするには手頃な価格です。プロバイダー価格をそのまま通すルーターなら、Googleの値下げはその日のうちに請求書に反映され、プロバイダー間の自動フェイルオーバーによって、ベンダーに障害が起きてもトリアージパイプラインは稼働し続けます。
どちらのゲート付きプログラムにも入れないセキュリティチーム(その大半がそうだ)にとって、現実的な選択肢は、標準APIで利用できる一般的なフロンティアモデルと、新しい契約を結ばずにモデルを切り替えられるルーターだ。SafeMindとGemini 3.5 Flash Cyberは、特殊防御の次の章を定義するだろう。ゲートが開くまでは、実際に仕事をするモデルは、実際に呼び出せるモデルなのだ。


