
O que é o Gemini 3.5 Flash Cyber? O Modelo de Caça a Vulnerabilidades Fechado do Google, Explicado
- googleNOVOGoogle: Gemini 3.6 Flash2026-07-2150Inteligência69Código
- googleNOVOGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaNOVOMeta: Muse Spark 1.12026-07-1651Inteligência71Código
- kimiNOVOMoonshotAI: Kimi K32026-07-1557Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Inteligência77Código
- grokxAI: Grok 4.52026-07-0854Inteligência72Código
- tencentTencent: Hy32026-07-0641Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3053Inteligência72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligência52Código57Matemática
- z-aiZ.ai: GLM 5.22026-06-1651Inteligência69Código60Matemática
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Inteligência61Código61Matemática
- anthropicAnthropic: Claude Fable 52026-06-0960Inteligência77Código
- qwenQwen: Qwen3.7 Plus2026-06-0139Inteligência56Código59Matemática
- minimaxMiniMax: MiniMax M32026-05-3144Inteligência59Código59Matemática
- AnthropicAnthropic: Claude Opus 4.82026-05-2856Inteligência74Código68Matemática
- GoogleGemini 3.5 Flash2026-05-2350Inteligência70Código51Matemática
Em 21 de julho de 2026, Google DeepMind anunciou Gemini 3.5 Flash Cyber — o terceiro e o mais incomum dos três modelos que lançou naquele dia, juntamente com o modelo de uso geral Gemini 3.6 Flash e o Gemini 3.5 Flash-Lite. Não é um modelo geral com o qual você possa conversar ou chamar por uma API. É um especialista em segurança de código: um modelo ajustado a partir do Gemini 3.5 Flash para encontrar, validar e corrigir vulnerabilidades de software, executando dentro do agente CodeMender do Google. E crucialmente, ele é restrito — disponível apenas para governos e “parceiros confiáveis” em um piloto de acesso limitado, sem disponibilidade pública, sem cadastro de autoatendimento e sem preço publicado.
Isso a torna fundamentalmente diferente de suas versões irmãs, que estão geralmente disponíveis e são precificadas por token como qualquer outro modelo em uma tabela de preços. Flash Cyber não tem tabela de preços, porque não tem um produto público ao qual vincular uma — ele vive inteiramente dentro de um programa piloto fechado. Este explicador vai além do título: o que Flash Cyber realmente é, quais de seus números de desempenho são genuinamente independentes versus os testes internos da própria Google, como funciona de fato o acesso e a precificação, e para quem — realisticamente — este modelo se destina.
Veredito TL;DR.O Gemini 3.5 Flash Cyber é um modelo real de segurança de código fechado que roda dentro do CodeMender para encontrar e corrigir vulnerabilidades de software. Ele não está em GA, não possui API pública ou preço definido, e é restrito a governos e parceiros de confiança. No único benchmark de terceiros citado (CyberGym), é relatado com ~83,2%, bem próximo do OpenAI GPT-5.5-Cyber (85,6%) e do Anthropic Mythos 5 (83,8%) — a vantagem do Google é apresentada como eficiência de custos, não como um grande salto de capacidade. A maioria das outras afirmações de benchmark, incluindo os números de contagem de problemas do V8, são avaliações internas do próprio Google.
Principais conclusões
• É um especialista em segurança de código, ajustado para encontrar, validar e corrigir vulnerabilidades de software — não uma ferramenta de SOC/inteligência de ameaças ou triagem de malware, e não um chatbot geral.
• É restrito, não GA. O acesso é limitado a governos e parceiros confiáveis por meio da plataforma CodeMender; não há API pública e nenhum preço por token publicado.
• Ajustado a partir do Gemini 3.5 Flash, e implantado como múltiplas chamadas de subagente paralelas por relatório de vulnerabilidade (o Google menciona até ~5), mescladas em um único resultado. A janela de contexto não é divulgada.
• Um benchmark de terceiros. CyberGym ~83,2% (relatado pela imprensa), versus GPT-5.5-Cyber 85,6% e Mythos 5 83,8%. Outros resultados (Big Sleep, Chrome, V8) são avaliações internas da própria Google.
• Duplo uso, deliberadamente. Um modelo tão bom em encontrar bugs exploráveis é perigoso se mal utilizado, portanto a principal mitigação do Google é o controle de acesso, além da aprovação humana antes de qualquer patch e validação em sandbox dos resultados.
• É um modelo diferente do Sec-Gemini. O modelo anterior e separado de inteligência de ameaças do Google lida com análise de incidentes e causas raiz; Flash Cyber é estritamente sobre corrigir vulnerabilidades de código.
• É feito para defensores, não para desenvolvedores. Os usuários pretendidos são equipes de segurança da linha de frente, governos e parceiros empresariais verificados que realizam pesquisa de vulnerabilidade em escala — explicitamente não consumidores ou desenvolvedores de aplicativos em geral.
A maioria das métricas de desempenho aqui são avaliações internas da própria Google; apenas o CyberGym é um benchmark genuíno de terceiros, e mesmo o valor específico de 83,2% é melhor atribuído à análise da imprensa do que ao texto literal da Google — cite-o como “reportado”. Não descreva o Flash Cyber como geralmente disponível nem cite um preço por token; ele é controlado e sem preço. Não o confunda com o Sec-Gemini, o modelo separado de inteligência de ameaças de 2025 da Google.
O que é o Gemini 3.5 Flash Cyber
“Cyber” aqui significa segurança de código e software — especificamente encontrar, confirmar e corrigir vulnerabilidades em código-fonte. Não é um analista de operações de segurança, um assistente de inteligência de ameaças ou um classificador de malware, e não responde perguntas gerais como um modelo de chat. Ele é executado dentro do CodeMender, o agente de IA do Google DeepMind para correção automatizada de segurança de código (mostrado pela primeira vez em outubro de 2025), em vez de ser vendido como um produto de chat ou API independente. Esse enquadramento é importante: o Flash Cyber não é um modelo que você aponta para um código-fonte por conta própria, é um componente dentro de um pipeline maior e rigorosamente controlado que o Google opera em nome de seus parceiros piloto.
Na prática, vários subagentes do Flash Cyber são executados em paralelo em uma base de código — o Google menciona até cerca de cinco por relatório de vulnerabilidade — e suas descobertas individuais são mescladas em um único relatório consolidado. Trata-se de uma arquitetura agêntica e de múltiplas chamadas, em vez de uma troca única de chatbot, o que é uma grande razão pela qual o Google a posiciona como competitiva em relação a modelos muito maiores: a vantagem vem de como ela é orquestrada, não necessariamente do tamanho bruto do modelo. Antes de qualquer correção ser lançada, um humano a aprova, e a vulnerabilidade subjacente é validada em um sandbox — o modelo propõe e encontra, mas pessoas e infraestrutura controlam o que realmente é implantado.
É ajustado a partir do Gemini 3.5 Flash. O Google não divulgou um tamanho de janela de contexto ou capacidades multimodais específicas para o Flash Cyber, o que por si só é um dado: ao contrário dos modelos Flash geralmente disponíveis, não há uma ficha técnica para consultar. Seus usuários-alvo são defensores da linha de frente, governos e parceiros empresariais verificados que realizam pesquisa de vulnerabilidades e triagem de patches em escala — explicitamente não consumidores ou desenvolvedores em geral, e explicitamente não um produto que você pode adicionar à sua própria pilha se inscrevendo.

Análise aprofundada de benchmark: o que os números significam
Existe exatamente um benchmark de terceiros no registro, e vale a pena entender o que ele realmente testa. O CyberGym é um benchmark acadêmico — criado por um grupo que inclui Dawn Song, da UC Berkeley — que avalia agentes contra mais de 1.500 vulnerabilidades documentadas em 188 projetos reais de código aberto. Isso é um ambiente de teste significativamente realista: código real, bugs históricos reais, não quebra-cabeças sintéticos. A cobertura da imprensa coloca o Flash Cyber em cerca de 83,2% no CyberGym, contra 85,6% do OpenAI GPT-5.5-Cyber e 83,8% do Anthropic Mythos 5. Trata-se de um grupo apertado de três, não uma liderança isolada para ninguém — e é exatamente por isso que a comunicação do Google se apoia na relação custo-eficácia, e não na pontuação bruta. Notavelmente, o blog do Google apenas faz a afirmação qualitativa de "desempenho competitivo contra modelos significativamente maiores"; o número preciso de 83,2% vem da análise da imprensa sobre o anúncio, não do texto literal do Google ou de uma entrada pública de leaderboard que você possa verificar por conta própria.
O resultado V8 é um tipo diferente de número, e é inteiramente uma métrica própria do Google. Em um teste contra o mecanismo JavaScript V8, o Google relata que o Flash Cyber encontrou 55 problemas confirmados únicos, em comparação com 47 para o Gemini 3.5 Flash padrão e 36 para o Claude Opus 4.6 — incluindo 10 problemas que nenhum outro modelo detectou. Essa é uma comparação impressionante porque nomeia um modelo rival específico e uma contagem específica, mas é um teste interno do Google realizado na própria infraestrutura do Google contra um alvo escolhido pelo próprio Google. Nenhuma parte externa realizou essa avaliação, publicou sua metodologia para replicação ou verificou as contagens de forma independente. É um resultado real que o Google afirma ter observado — mas é uma afirmação de fornecedor, não uma afirmação auditada, e a distinção é mais importante aqui do que na maioria dos relatórios de benchmark.
A avaliação "Big Sleep" segue o mesmo padrão, em uma resolução ainda menor. Testando contra bases de código complexas e reais, como Chrome e Safari, o Google afirma que o Flash Cyber "superou significativamente" os principais modelos Gemini 3.5 Flash e 3.6 Flash — mas essa é uma afirmação qualitativa, sem números exatos, e muito menos uma verificação por terceiros da comparação. Coloque os três resultados lado a lado e um padrão emerge: o único número com procedência externa (CyberGym) mostra um grupo restrito e sem destaque; as duas vitórias que parecem mais chamativas (V8, Big Sleep) são ambas o Google avaliando seu próprio modelo em relação às próprias linhas de base escolhidas pelo Google.
Esse padrão não é exclusivo do Google, mas é mais difícil de corrigir aqui do que o normal, porque o Flash Cyber é restrito. Com um modelo aberto ou mesmo acessível por API, pesquisadores independentes podem eventualmente reexecutar um benchmark e confirmar ou contestar o número de um fornecedor — é assim que alegações infladas geralmente são descobertas. Com o Flash Cyber, essa verificação em grande parte não pode acontecer: pesquisadores externos simplesmente não têm acesso para executar sua própria passagem do CyberGym, sua própria varredura V8, ou qualquer outro teste contra o modelo real. Até mesmo o pedigree de terceiros do CyberGym cobre apenas o design do benchmark, não uma reexecução independente do Flash Cyber contra ele — a própria pontuação ainda remete à divulgação do Google. Até que o acesso se amplie além do piloto atual, toda afirmação de desempenho sobre esse modelo específico — com aparência independente ou não — depende, em última instância, de confiar na própria versão do Google.

Não confunda com Sec-Gemini
O Google tem mais de um modelo de "segurança", e é fácil confundi-los. O Sec-Gemini (anunciado por volta de abril de 2025) é um modelo experimental anterior e separado, voltado para fluxos de trabalho de inteligência de ameaças — análise de causa raiz e incidentes, integrado ao Google Threat Intelligence e ao banco de dados OSV. Se o seu interesse são casos de uso de SOC/inteligência de ameaças, o Sec-Gemini — e não o Flash Cyber — é a linha relevante. O Flash Cyber foca estritamente em encontrar e corrigir vulnerabilidades de código, e reside dentro do CodeMender.
Acesso, preços e como realmente obter a capacidade do modelo de segurança
A história do acesso é simples, embora pouco útil para a maioria dos leitores: não há acesso. O Flash Cyber não é vendido, não tem preço listado e não pode ser acessado por nenhuma chave de API que você possa solicitar. A única forma de entrar é sendo uma agência governamental ou um "parceiro de confiança" verificado admitido no piloto do CodeMender — não há inscrição por autoatendimento, nenhum formulário de lista de espera que garanta entrada e nenhuma tabela de preços publicada, porque não existe um produto público para precificar. O Google disse que o acesso será expandido ao longo do tempo, mas não anexou um cronograma ou uma data de disponibilidade geral a essa declaração, então "eventualmente" é a resposta mais específica atualmente registrada.
Isso é um contraste nítido com os próprios irmãos do Flash Cyber. Gemini 3.6 Flash e Gemini 3.5 Flash-Lite, anunciados no mesmo dia, estão ambos geralmente disponíveis e precificados por token como qualquer outro modelo comercial. Flash Cyber se enquadra em uma categoria totalmente diferente — mais próximo de uma capacidade interna do Google que por acaso foi divulgada publicamente do que de uma linha de produtos. Orçamento não é a restrição aqui; mesmo uma empresa bem financiada sem relacionamento de pesquisa de segurança com o Google não tem caminho para uma chave de API do Flash Cyber hoje.
Então, o que as equipes realmente fazem se quiserem ajuda de IA para encontrar e corrigir vulnerabilidades em seu próprio código agora? Para a esmagadora maioria que não está dentro do piloto, a rota prática é executar modelos de fronteira de propósito geral — aqueles que estão em GA e têm preço — contra o mesmo tipo de trabalho: revisão de código, triagem de vulnerabilidades, elaboração de patches, com sua própria revisão humana e sandbox ao redor. Essa é uma ferramenta materialmente diferente de um especialista construído especificamente para essa tarefa, mas é a opção acessível. Agregadores como o OrcaRouter, que fica atrás de mais de 200 modelos em um único endpoint compatível com OpenAI, são como a maioria das equipes monta esse tipo de fluxo de trabalho de modelo geral de segurança hoje, em vez de esperar por um piloto restrito ao qual talvez nunca sejam admitidos.
Para quem é
Defensores verificados dentro do piloto. Se você é uma agência governamental ou uma organização que o Google já admitiu como parceiro de confiança, o Flash Cyber é uma ferramenta genuinamente projetada para a finalidade: ele opera dentro do fluxo de trabalho discover-validate-approve-patch do CodeMender, sua arquitetura paralela de subagentes foi projetada para escanear bases de código reais em escala, e os próprios testes do Google sugerem que ele é competitivo — ou, em algumas métricas internas, superior — a modelos gerais maiores nessa tarefa específica. Para esse público restrito, a proposta de valor é real, mesmo que alguns dos números de suporte sejam auto-relatados.
Todos os outros — que são praticamente todos. Se você é uma equipe de engenharia típica, uma consultoria de segurança sem parceria com o Google, ou um pesquisador individual, o Flash Cyber simplesmente não é uma opção, independentemente de quão adequado seu caso de uso pareça. Não existe um processo de inscrição que funcione garantidamente, nem um preço que você possa pagar para desbloqueá-lo. Seu caminho realista para o trabalho de vulnerabilidades assistido por IA hoje é um modelo de fronteira geralmente disponível — roteado por algo como o OrcaRouter, se você quiser flexibilidade entre provedores — combinado com sua própria disciplina de revisão, já que nenhum desses modelos gerais vem com as salvaguardas integradas de aprovação humana e validação em sandbox do CodeMender.
Equipes decidindo se devem esperar. Se sua organização está explorando um caminho de parceria com o Google especificamente para obter acesso, vale a pena planejar em torno do fato de que não existe uma data de GA — trate qualquer fluxo de trabalho de segurança atual como precisando ser executado em modelos geralmente disponíveis nesse meio tempo, e reavalie se e quando o piloto do Google se expandir. Apostar um roteiro em acesso restrito sem cronograma anunciado é um risco que a maioria das equipes não deveria assumir.
Perguntas Frequentes
Posso usar o Gemini 3.5 Flash Cyber?
Não, a menos que você seja um governo verificado ou parceiro confiável. É um piloto de acesso limitado dentro do CodeMender, sem API pública, sem acesso self-service e sem preços publicados. O Google diz que o acesso será expandido ao longo do tempo, mas não forneceu uma data de disponibilidade geral (GA).
O que realmente faz?
Ele encontra, valida e corrige vulnerabilidades de software no código-fonte, executando como subagentes paralelos cujas descobertas são mescladas em um relatório. Um humano aprova qualquer correção, e as vulnerabilidades são validadas em um sandbox antes de serem relatadas.
Como ele se compara aos modelos cibernéticos da OpenAI e da Anthropic?
No único benchmark compartilhado de terceiros (CyberGym), os três estão muito próximos: Flash Cyber ~83,2%, Anthropic Mythos 5 83,8%, OpenAI GPT-5.5-Cyber 85,6%. O Google posiciona sua vantagem como custo-eficiência, em vez de pontuação bruta máxima. Todos os três são restritos a organizações verificadas.
Quais são suas especificações?
É ajustado a partir do Gemini 3.5 Flash. O Google não publicou sua janela de contexto, multimodalidade ou contagem de parâmetros especificamente para o Flash Cyber.
É perigoso / de uso duplo?
O Google reconhece o risco de duplo uso — um modelo bom em encontrar bugs exploráveis poderia ser mal utilizado de forma ofensiva — e cita o controle de acesso como sua principal mitigação, juntamente com a aprovação humana de patches e a validação em sandbox dos achados.
A pontuação do CyberGym é verificada de forma independente?
O CyberGym em si é um benchmark acadêmico legítimo de terceiros. Mas o número específico de 83,2% atribuído ao Flash Cyber vem de relatos da imprensa sobre o anúncio do Google, e não do texto literal do Google ou de uma entrada ao vivo em um ranking público, e como o modelo é restrito, nenhuma parte externa pode atualmente executá-lo novamente por conta própria. Trate o número como relatado, não como confirmado de forma independente.
Quando o Flash Cyber se tornará geralmente disponível?
O Google não disse. Afirmou que o acesso se expandirá com o tempo além do piloto atual de governos e parceiros confiáveis, mas nenhuma data de GA ou cronograma foi publicada, então não há nada concreto para planejar ainda.
Conclusão
Gemini 3.5 Flash Cyber é uma ferramenta estreita e séria: um modelo de segurança de código que caça e corrige vulnerabilidades dentro do CodeMender, restrito a governos e parceiros de confiança. É genuinamente capaz no único benchmark independente disponível, mas fica em um grupo apertado com os modelos cibernéticos da OpenAI e da Anthropic, sem se destacar, e quase todos os seus números excepcionais são avaliações internas do Google. Se você não é um parceiro verificado, não pode usá-lo — e para trabalhos gerais relacionados à segurança no seu próprio código, os modelos de fronteira acessíveis continuam sendo a rota prática. As comparações abaixo o alinham com seus dois reais concorrentes.

