
Gemini 4 vs Gemini 4 Argon: Um destes dois modelos não existe
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 221 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 110 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
O Google anunciou um modelo de fronteira em 30 de setembro de 2026. Não é o que a maioria das pessoas está imaginando. Gemini 4 Argon é um nome real ligado a um anúncio real, uma tabela de preços real e um conjunto de benchmarks publicado. Gemini 4 é o prefixo da família sob o qual esse nome se enquadra — e, com base nos registros disponíveis hoje, não é um produto. Não há ID de modelo para ele, nem endpoint, nem model card e nem preço por milhão de tokens. Portanto, isto não é uma comparação entre dois sistemas. É uma comparação entre um modelo anunciado e um nome que muitas pessoas, incluindo este blog, vêm tratando como um modelo há meses.
Essa distinção envolve dinheiro. O Gemini 4 Argon tem uma tarifa introdutória de $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, passando para $4 e $20 após um período introdutório que o Google não definiu. Esses são valores declarados pelo fornecedor na própria publicação de anúncio do Google. Se você está orçando uma migração para o nível pro em 2026, $2/$10 é o número com o qual você pode planejar, e “o que quer que o Gemini 4 custe” não é um número de forma alguma — nada foi publicado sobre ele, porque ainda não há nada a publicar.
O que "Gemini 4" realmente é, oficialmente
Pesquise por uma página de produto do Gemini 4 e você encontrará um único documento: a própria publicação do Google intitulada Gemini 4 Argon: nossa próxima era de inteligência de fronteira, publicada em 30 de setembro de 2026, às 20:00 UTC e creditada a Koray Kavukcuoglu. Leia com atenção e "Gemini 4" nunca aparece como um modelo independente. Todas as alegações de capacidade, todos os preços e todos os benchmarks na publicação estão atrelados ao nome completo. A forma isolada aparece apenas onde o nome é usado como prefixo — "as capacidades do Gemini 4 Argon" — que é o mesmo espaço gramatical que o Gemini 3 ocupava antes que Gemini 3 Pro, Gemini 3.1 Pro e quatro variantes Flash se tornassem cada qual uma entidade própria.
O histórico geracional apoia essa leitura. O balanço da Alphabet em 23 de julho colocou o enquadramento nos registros: Sundar Pichai disse que a próxima geração de modelos de fronteira "exige modelos base muito maiores", e nomeou a codificação e a codificação agêntica como as áreas que precisam de melhorias. Em 23 de setembro, em um evento organizado pela The Information, Kavukcuoglu disse que o pré-treinamento havia terminado e que o modelo estava nos estágios iniciais do pós-treinamento, que a equipe havia visto os resultados, e que ele esperava lançar uma versão inicial de pós-treinamento bem antes do final do ano. A Business Insider descreveu o anúncio de 30 de setembro como o primeiro modelo da série 4 — uma série, o que é revelador. Todas essas três são declarações do fornecedor sobre o próprio trabalho do fornecedor, repassadas por terceiros.
O que isso significa na prática: "Gemini 4" é a geração, e a geração tem um membro nomeado. A estrutura de níveis que o Google vem lançando há dois anos — um Pro no topo, um Flash abaixo dele, uma variante Cyber restrita ao mesmo programa — ainda não foi preenchida para a geração 4. Um "Gemini 4 Pro" ou um "Gemini 4 Ultra" é uma inferência do próprio padrão de nomenclatura do Google, não é um vazamento nem um item de roadmap. Trate qualquer texto que compare o Gemini 4 Argon a "Gemini 4" como uma comparação de um modelo com seu próprio sobrenome.
O que o Gemini 4 Argon realmente é
O Gemini 4 Argon foi anunciado em 30 de setembro de 2026 no blog do Google, e Demis Hassabis anunciou o mesmo modelo, com suas próprias palavras, no X naquela noite. A implementação é faseada, e apenas a primeira fase tem data: o Argon vai primeiro para defensores cibernéticos verificados por meio do Fairwind Program, o nível exclusivo para candidaturas que o Google criou para governos e autoridades nacionais de cibersegurança, operadores de infraestrutura crítica e plataformas tecnológicas centrais. A própria publicação de Hassabis dizia que a empresa o estava lançando "começando hoje com governo e defensores cibernéticos de confiança por meio do nosso Fairwind Program". Depois disso, a formulação do Google coloca em seguida os clientes pagantes da API e os assinantes do Google AI Ultra, depois desenvolvedores, empresas e consumidores. Nenhuma dessas fases posteriores tem data.
O que não está nessa lista é a parte que importa para quem está planejando trabalho: uma data de disponibilidade geral, um ID de modelo, uma janela de contexto, uma contagem de parâmetros, um cartão de modelo ou um cartão de sistema. O Google publicou um limite de saída, não uma janela de contexto. São 1 milhão de tokens, acima do teto de 64K que a família Gemini anterior usava, e o Google o chama de líder do setor. Um aumento de uma ordem de magnitude na quantidade que uma única chamada pode retornar é uma mudança real para longas trajetórias de agentes e renderização em disparo único, e é o único número técnico no anúncio sem ambiguidade.

O conjunto de benchmarks é amplo e não conta com nenhuma reprodução. O Google relata 77,9% no DeepSWE v1.1, primeiro lugar no AutomationBench, com 51,3%, 91,7% no LVBench, um empate em primeiro lugar no CWE-bench v1, com 68%, resultados líderes no Vals Index, em seu Vals Finance Agent v2, no Legal Agent Benchmark da Harvey e o desempenho mais forte no benchmark Indirect Prompt Injection da Gray Swan. Cada um desses números é do próprio fornecedor, publicado por ele, e nenhum foi reproduzido de forma independente. Um conjunto separado de números que circulou em setembro, apresentado como benchmarks previstos do Gemini 4, com uma pontuação de 48,7% no AutomationBench, revelou-se reciclado de um lançamento não relacionado e não é uma publicação do Google. O número real relatado pelo Google para o AutomationBench é 51,3%, que é um número diferente, de uma fonte diferente.
O placar que os dois nomes produzem
Coloque os dois lado a lado nas seis dimensões em que este pareamento realmente se baseia, e a forma do problema fica óbvia:
• Existe como produto nomeado — Gemini 4: não. Gemini 4 Argon: sim, anunciado em 30/09/2026.
• Disponível hoje — Gemini 4: não existe ID de modelo nem endpoint. Gemini 4 Argon: também não existe ID de modelo nem endpoint; o acesso é controlado pelo Fairwind e somente por candidatura.
• Preço — Gemini 4: nenhum publicado. Gemini 4 Argon: US$ 2 / US$ 10 por milhão de tokens em caráter introdutório, depois US$ 4 / US$ 20. Informado pelo fornecedor.
• Saída máxima — Gemini 4: nenhuma publicada. Gemini 4 Argon: 1 milhão de tokens, contra 64K da geração anterior. Segundo o fornecedor.
• Índice de inteligência — Gemini 4: não avaliado. Gemini 4 Argon: 53 no Intelligence Index da Artificial Analysis com alto esforço de raciocínio, com um custo de US$ 1,99 por tarefa de índice. Segundo a Artificial Analysis.
• Classificação independente no ranking — Gemini 4: sem classificação. Gemini 4 Argon: primeiro no Vals Index com 68,90%, com custo de US$ 15,68 por teste, em 13,40B de tokens de entrada e 142,01M de tokens de saída. Segundo a Vals.

Leia as duas últimas linhas em conjunto e você obtém a única discordância genuinamente interessante nesta comparação. A Artificial Analysis coloca o Gemini 4 Argon em 53, o que está empatado com o Claude Fable 5.1 e o GPT-6 Astra, e cinco pontos atrás do Claude Opus 5.5, em 58. A Vals coloca-o em primeiro lugar absoluto. Ambas são independentes, ambas medem algo real, e medem coisas diferentes — o índice da AA pondera um conjunto fixo de dez avaliações em programação, raciocínio e trabalho de conhecimento, enquanto o Vals Index pondera quatro setores pela sua participação no valor acrescentado económico dos EUA. Um modelo pode liderar um e não o outro sem que nenhum dos rankings esteja errado.
Há uma segunda coisa a se notar na linha do Vals, e é aquela com que um comprador corporativo deveria se importar. O Vals registra a tabela de preços do Argon como $4/$20 — o preço pós-introdutório — enquanto o próprio anúncio do Google diz $2/$10. Se o custo por teste de $15,68 foi calculado a $4/$20, então um comprador que aceitar o preço introdutório veria um número substancialmente menor para o mesmo trabalho, e um comprador que perder a janela introdutória não veria. O Google não disse por quanto tempo essa janela dura. Essa única variável indefinida altera o número mais relevante para a decisão em todo o lançamento.
O que você pode chamar hoje
Nada sob o nome Gemini 4, e isso inclui nós. Verificamos o catálogo: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro e google/gemini-3.8-flash-cyber retornam todos "model not found", e o mesmo vale para qualquer outra plataforma de roteamento, porque nenhuma delas tem um ID de modelo para rotear. A própria lista de modelos da API Gemini — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — não traz nenhuma entrada Gemini 4 de qualquer tipo. Enquanto o Argon não passar pela fila do Fairwind e receber um identificador, não há preço cobrado nem endpoint em lugar nenhum.
A camada Pro ativa do Google é outra história. O Gemini 3.1 Pro Preview está no nosso catálogo desde 19 de fevereiro de 2026, a US$ 2,00 por milhão de tokens de entrada e US$ 12,00 por milhão de tokens de saída, com uma janela de contexto de 1.048.576 tokens, uma saída máxima de 65.536 tokens e entrada multimodal em texto, imagem, áudio, vídeo e arquivo. Oito meses depois, ele ainda está rotulado como Preview na própria lista de modelos da Gemini API, o que é, por si só, o argumento de que o Argon existe. Se ultrapassar 200.000 tokens de entrada, a tarifa dobra para US$ 4 e US$ 18.

Esse é o único ponto em que esta comparação tem uma resposta operacional. O Gemini 3.1 Pro Preview está ativo por trás do mesmo endpoint compatível com OpenAI que os outros mais de 200 modelos que roteamos, ao preço de tabela do provedor, sem markup — então, quando o Google eventualmente publicar um identificador e uma tarifa cobrada para o Gemini 4 Argon, e depois um equivalente de nível Pro se o padrão de nomenclatura se mantiver, o repasse significa que essas tarifas aparecem do nosso lado no mesmo dia em que aparecem do lado do Google. Enquanto isso, se você quiser medir o nível Pro em vez de ler sobre ele, esse é o modelo a medir. Se você quiser experimentar um modelo cujo comportamento ainda está sendo caracterizado, failover automático entre provedores é como você faz isso sem apostar um caminho de produção em uma prévia que o próprio Google descreve como estando em fase de introdução.
Uma ressalva que deve ser mencionada no mesmo fôlego que o preço
A Bloomberg noticiou em 30 de setembro que alguns funcionários do Google com acesso direto ao Argon dizem que ele se sai pior em trabalho real do que as pontuações de benchmark sugerem, com o design de front-end citado especificamente e dois funcionários usando o termo "benchmaxxing". O Google contesta a caracterização. Vale a pena colocar isso ao lado da lista de benchmarks justamente porque a lista de benchmarks é toda a base pública de evidências desse modelo. Quando há os números de um único fornecedor e nenhuma forma de reproduzi-los, um relatório de que os números não contam a história toda não é uma nota de rodapé. É metade das evidências.
Quem deve escolher qual?
Se você está escolhendo entre esses dois nomes, na verdade ainda não está escolhendo nada, e o conselho honesto é planejar em torno disso, em vez de em torno de uma comparação.
• Se você precisa de um modelo do nível pro do Google em produção neste trimestre, a resposta é o Gemini 3.1 Pro Preview. Ele pode ser chamado, tem preço definido e é o nível que o Argon está sendo posicionado para substituir. Esperar pelo Argon é esperar em uma fila na qual você não pode entrar.
• Se você faz parte do público para o qual o Argon tem acesso restrito — uma autoridade cibernética governamental, um operador de infraestrutura crítica, um mantenedor de software —, o Programa Fairwind é a única via, e a especificidade dessa restrição é um fato sobre as capacidades do modelo, não marketing. O Google o treinou para descoberta e correção de vulnerabilidades e não o disponibilizou amplamente.
• Se você estiver orçando uma migração para 2026, use $2/$10 para a janela introdutória e $4/$20 para tudo o que vier depois dela. Não use um único valor misto e não use o custo por teste de $15.68 da Vals sem verificar em qual tabela de tarifas ele foi calculado.
• Se você está esperando pelo "Gemini 4", espere por um ID de modelo. O nome vai ganhar um — o padrão de nomenclatura do Google ao longo de três gerações indica que os níveis Pro e Flash recebem seus próprios identificadores — mas o padrão não é um anúncio, nada foi publicado sobre o que um 4 puro seria, quanto custaria ou o que faria.
O ponto mais amplo é um que este blog já teve de defender antes e provavelmente terá de defender de novo: um nome de geração não é um modelo. Gemini 4 Argon é a única coisa que o Google respaldou com um nome, um preço, um conjunto de benchmarks e um plano de acesso. O resto da família é um padrão, e um padrão é algo que se pode prever, mas não algo que se pode nomear.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
