「CrowdStrike SafeMind vs Gemini 3.5 Flash Cyber」比較のヒーロータイトルカード。大きな見出しには「クローズドループ、ロックダウンされたハンター——どちらもゲート付き」。左パネル「CrowdStrike SafeMind」: 「Nemotron 3 Super/Ultra」「Red Tempest + Blue Solano」「Falcon テレメトリ」。右パネル「Gemini 3.5 Flash Cyber」: 「Gemini 3.5 Flash でファインチューニング済み」「CodeMender 内でのみ実行」「V8 の脆弱性55件を発見」。フッターには「Google の55件は公開済み。SafeMind の数値はベンダー提供のみ」とある。OrcaRouter のロゴは右下隅に合成されている。
Guides & Insights

CrowdStrike SafeMind vs Gemini 3.5 Flash Cyber:ループ型防御 vs Googleの脆弱性ハンター

著者

Elias Hawthorne

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る
Hero title card for the comparison 'CrowdStrike SafeMind vs Gemini 3.5 Flash Cyber'. A large headline reads 'One closed loop, one locked-down hunter — both gated'. Left panel 'CrowdStrike SafeMind': 'Nemotron 3 Super/Ultra', 'Red Tempest + Blue Solano', 'Falcon telemetry'. Right panel 'Gemini 3.5 Flash Cyber': 'Fine-tuned on Gemini 3.5 Flash', 'Runs only in CodeMender', '55 V8 vulns found'. A footer reads 'Google's 55 is published; SafeMind's numbers are vendor-only.' The OrcaRouter logo is composited in the bottom-right corner.

CrowdStrike SafeMind と Google の Gemini 3.5 Flash Cyber は約2か月違いで登場し、この2つの登場は、セキュリティモデルが「安全上の注意書きが付されただけの汎用モデル」から脱却した転換点を示している。Gemini 3.5 Flash Cyber は、Google が Gemini 3.5 Flash をベースにファインチューニングしたセキュリティ専用モデルであり、政府機関と信頼できるパートナー向けのアクセス限定パイロットの中で、CodeMender エージェントに限定して実装されている。SafeMind は CrowdStrike のエージェント型モデルファミリーで、オープンな NVIDIA Nemotron ベースの上に NVIDIA と共同で構築され、Falcon プラットフォームにネイティブ搭載されている。両者とも防御ファーストであり、両者ともゲート(アクセス制限)付きであり、そして両者とも、特化がスケールに勝ると賭けている。しかし、そこに至る道筋は大きく異なる。

それぞれが基づくもの

Gemini 3.5 Flash Cyber は、出荷済みの汎用モデルを1つの仕事向けに再トレーニングしたものだ。Google によると、このモデルは Gemini 3.5 Flash を基盤に構築されており——Gemini 3.5 Flash 自体は2026年5月のモデルで、1Mトークンのコンテキストウィンドウと、公開版では100万トークンあたり1.50ドル/9.00ドルの価格設定を持つ——ソフトウェアの脆弱性を発見・検証・修正するように微調整されている。そのコストプロファイルこそが要点だ。1トークンあたりのコストが十分に安く、大規模なコードベース全体で何度も呼び出せる。これはまさに CodeMender エージェントの使い方であり、モデルを並列に呼び出して、発見事項を1つのレポートに統合する。

SafeMindは逆のアプローチを取る。CrowdStrikeはNVIDIAのオープンなNemotronモデルから始めた — Nemotron 3 Ultraが防御ハーネスを統括し、ファインチューニングされたNemotron 3 Superがルール生成サブエージェントを駆動する — そして独自の強みを重ねた:Falconセンサーテレメトリからのトレーニングデータ、Falcon Complete MDRのアノテーション、15年にわたるインシデントレスポンスの現場経験である。Gemini 3.5 Flash Cyberがコードの静的解析に最適化されているのに対し、SafeMindはエンドポイントプラットフォーム内での検出と対応のライブループに最適化されている。

A two-column scoreboard titled 'CrowdStrike SafeMind vs Gemini 3.5 Flash Cyber — the scoreboard'. Left column 'CrowdStrike SafeMind': 'Base: NVIDIA Nemotron 3 Super/Ultra', 'Job: detection loop in Falcon', 'Detection: 29% higher (vendor)', 'Remediation: 6x faster (vendor)', 'Cost: 99% savings claim (vendor)', 'Independent score: none yet'. Right column 'Gemini 3.5 Flash Cyber': 'Base: fine-tuned Gemini 3.5 Flash', 'Job: vuln discovery in CodeMender', 'V8: 55 unique confirmed vulns', 'Big Sleep: beats 3.5/3.6 Flash', 'Cost: no public price (gated)', 'Access: governments + trusted partners'. Footer reads 'Google's V8 count is published and specific; all SafeMind figures are vendor-reported and unreproduced.' The OrcaRouter logo is composited in the bottom-right corner.

現時点での検出記録

Gemini 3.5 Flash Cyber は、公開された論文や記録が存在する数少ないゲート付きサイバーモデルの一つです。Google によれば、このモデルは V8 JavaScript エンジンで55件の確認済み脆弱性を発見しました。これは Gemini 3.5 Flash の47件、Claude Opus 4.6 の36件を上回る数で、その中には他のどのモデルも見つけられなかった10件の問題が含まれています。Chrome や Safari のような複雑なコードベースを対象とした Google の Big Sleep 評価では、メインラインの Gemini 3.5 Flash と Gemini 3.6 Flash の両方を大幅に上回りました。文書化されたあるケースでは、ASLR と W^X の緩和策を回避する、信頼性100%のリモートコード実行エクスプロイトを生成しました。これは、まさにこのモデルが公開されていない理由を説明する類の成果です。Google の Cloud Vulnerability Research チームは、このモデルを使って、約2時間以内に公開 API のリモートコード実行の脆弱性と、本番サービスにおけるメモリ破損の欠陥を発見しました。

SafeMindのエビデンス基盤はより薄く、完全にベンダー由来である。CrowdStrikeは、主要なフロンティアモデルやオープンソースのベースラインと比較して、検出率が29%高い、エンドツーエンドの修復が6倍速い、検出および修復のコストが99%削減されると報告している。NVIDIAは別途、内部評価においてBlue Solanoモデルが主要なフロンティアモデルよりも高い精度を99%低いコストで達成したと報告している。どちらの数値も独立して再現されておらず、SafeMindの所見は、GoogleがV8リストを公開したような具体的で検証可能な形では一切発表されていない。エビデンスのスタイルの違いは注目に値する。Googleはモデルのキャッチログを公開し、CrowdStrikeは主張を公開したのである。

アクセス — 異なる鍵のかかったドア

どちらのモデルも公開APIからは利用できず、第三者によるルーティングもできません。Gemini 3.5 Flash CyberはCodeMender内でのみ動作し、政府および信頼できるパートナーに開放された限定アクセスのパイロットとして提供されます。そこには、防御機能を有効化して他のサイバー活動を無効化するガードレールが備わっています。Googleは、時間をかけてアクセスを拡大し、レッドチーミング機能とエンドツーエンドのエンタープライズ防御を追加する計画だと述べています。SafeMindは、CrowdStrikeの顧客向けにFalconプラットフォーム内でネイティブに動作し、スタンドアロンアクセスはProject QuiltWorksのゲートを通じてのみ許可されます。実際的な違いは、一方が政府経由のパイロットであり、もう一方が既存のエンタープライズセキュリティプラットフォーム内の製品であることです。

今日、実際に電話できる相手

ここから先、この比較はもはや机上の空論ではなくなります。ファインチューニング済みのGemini 3.5 Flash Cyberはアクセスが制限されていますが、そのベースモデルは商用製品として出荷されています。Gemini 3.5 Flashは、OrcaRouter上でGoogleの定価——入力トークン100万あたり$1.50、出力トークン100万あたり$9.00——をマークアップなしでそのまま通す形で、コンテキスト1Mトークン・出力64Kトークンとして利用可能です。これはサイバー専門モデルではなく、本記事のどこにも、そうであると主張しているとは読めません。そうではなく、これこそが、現在、通常のAPIを通じて脆弱性トリアージのワークロードに向けられる最も高性能な汎用モデルであり、大規模なコードベースを繰り返しスキャンするには手頃な価格です。プロバイダー価格をそのまま通すルーターなら、Googleの値下げはその日のうちに請求書に反映され、プロバイダー間の自動フェイルオーバーによって、ベンダーに障害が起きてもトリアージパイプラインは稼働し続けます。

どちらのゲート付きプログラムにも入れないセキュリティチーム(その大半がそうだ)にとって、現実的な選択肢は、標準APIで利用できる一般的なフロンティアモデルと、新しい契約を結ばずにモデルを切り替えられるルーターだ。SafeMindとGemini 3.5 Flash Cyberは、特殊防御の次の章を定義するだろう。ゲートが開くまでは、実際に仕事をするモデルは、実際に呼び出せるモデルなのだ。

A screenshot of the CrowdStrike press release page titled 'CrowdStrike Launches Frontier Models for Cybersecurity, Created with NVIDIA', captured September 2, 2026, showing the announcement headline and the SafeMind description.A screenshot of the OrcaRouter model page for Gemini 3.5 Flash (google/gemini-3.5-flash) showing the Vision, Tools, JSON and Reasoning capability chips, a 1M-token context window, a 65K max output, text, image, video, file and audio inputs with text output, $1.50 per 1M input tokens and $9.00 per 1M output tokens, released May 25 2026, and the endpoints /v1/chat/completions and /v1beta/models/{model}:generateContent.
© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube