Cartão de título encabeçado por "COMPARAÇÃO DE MODELOS", com o texto "Gemini 4 vs Gemini 4 Argon", e o subtítulo "Um deles foi anunciado em 30 de setembro. O outro é um prefixo de família." e quatro chips com o texto "Gemini 4 · sem ID de modelo", "Gemini 4 Argon · anunciado em 2026-09-30", "$2 / $10 introdutório" e "AA Index 53 · Vals #1", sobre uma linha de rodapé com o texto "Números do Google relatados pelo fornecedor e não reproduzidos; números do índice conforme a Artificial Analysis; classificação conforme a Vals." O logotipo da OrcaRouter está composto no canto inferior direito.
Guides & Insights

Gemini 4 vs Gemini 4 Argon: Um destes dois modelos não existe

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O Google anunciou um modelo de fronteira em 30 de setembro de 2026. Não é o que a maioria das pessoas está imaginando. Gemini 4 Argon é um nome real ligado a um anúncio real, uma tabela de preços real e um conjunto de benchmarks publicado. Gemini 4 é o prefixo da família sob o qual esse nome se enquadra — e, com base nos registros disponíveis hoje, não é um produto. Não há ID de modelo para ele, nem endpoint, nem model card e nem preço por milhão de tokens. Portanto, isto não é uma comparação entre dois sistemas. É uma comparação entre um modelo anunciado e um nome que muitas pessoas, incluindo este blog, vêm tratando como um modelo há meses.

Essa distinção envolve dinheiro. O Gemini 4 Argon tem uma tarifa introdutória de $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, passando para $4 e $20 após um período introdutório que o Google não definiu. Esses são valores declarados pelo fornecedor na própria publicação de anúncio do Google. Se você está orçando uma migração para o nível pro em 2026, $2/$10 é o número com o qual você pode planejar, e “o que quer que o Gemini 4 custe” não é um número de forma alguma — nada foi publicado sobre ele, porque ainda não há nada a publicar.

O que "Gemini 4" realmente é, oficialmente

Pesquise por uma página de produto do Gemini 4 e você encontrará um único documento: a própria publicação do Google intitulada Gemini 4 Argon: nossa próxima era de inteligência de fronteira, publicada em 30 de setembro de 2026, às 20:00 UTC e creditada a Koray Kavukcuoglu. Leia com atenção e "Gemini 4" nunca aparece como um modelo independente. Todas as alegações de capacidade, todos os preços e todos os benchmarks na publicação estão atrelados ao nome completo. A forma isolada aparece apenas onde o nome é usado como prefixo — "as capacidades do Gemini 4 Argon" — que é o mesmo espaço gramatical que o Gemini 3 ocupava antes que Gemini 3 Pro, Gemini 3.1 Pro e quatro variantes Flash se tornassem cada qual uma entidade própria.

O histórico geracional apoia essa leitura. O balanço da Alphabet em 23 de julho colocou o enquadramento nos registros: Sundar Pichai disse que a próxima geração de modelos de fronteira "exige modelos base muito maiores", e nomeou a codificação e a codificação agêntica como as áreas que precisam de melhorias. Em 23 de setembro, em um evento organizado pela The Information, Kavukcuoglu disse que o pré-treinamento havia terminado e que o modelo estava nos estágios iniciais do pós-treinamento, que a equipe havia visto os resultados, e que ele esperava lançar uma versão inicial de pós-treinamento bem antes do final do ano. A Business Insider descreveu o anúncio de 30 de setembro como o primeiro modelo da série 4 — uma série, o que é revelador. Todas essas três são declarações do fornecedor sobre o próprio trabalho do fornecedor, repassadas por terceiros.

O que isso significa na prática: "Gemini 4" é a geração, e a geração tem um membro nomeado. A estrutura de níveis que o Google vem lançando há dois anos — um Pro no topo, um Flash abaixo dele, uma variante Cyber restrita ao mesmo programa — ainda não foi preenchida para a geração 4. Um "Gemini 4 Pro" ou um "Gemini 4 Ultra" é uma inferência do próprio padrão de nomenclatura do Google, não é um vazamento nem um item de roadmap. Trate qualquer texto que compare o Gemini 4 Argon a "Gemini 4" como uma comparação de um modelo com seu próprio sobrenome.

O que o Gemini 4 Argon realmente é

O Gemini 4 Argon foi anunciado em 30 de setembro de 2026 no blog do Google, e Demis Hassabis anunciou o mesmo modelo, com suas próprias palavras, no X naquela noite. A implementação é faseada, e apenas a primeira fase tem data: o Argon vai primeiro para defensores cibernéticos verificados por meio do Fairwind Program, o nível exclusivo para candidaturas que o Google criou para governos e autoridades nacionais de cibersegurança, operadores de infraestrutura crítica e plataformas tecnológicas centrais. A própria publicação de Hassabis dizia que a empresa o estava lançando "começando hoje com governo e defensores cibernéticos de confiança por meio do nosso Fairwind Program". Depois disso, a formulação do Google coloca em seguida os clientes pagantes da API e os assinantes do Google AI Ultra, depois desenvolvedores, empresas e consumidores. Nenhuma dessas fases posteriores tem data.

O que não está nessa lista é a parte que importa para quem está planejando trabalho: uma data de disponibilidade geral, um ID de modelo, uma janela de contexto, uma contagem de parâmetros, um cartão de modelo ou um cartão de sistema. O Google publicou um limite de saída, não uma janela de contexto. São 1 milhão de tokens, acima do teto de 64K que a família Gemini anterior usava, e o Google o chama de líder do setor. Um aumento de uma ordem de magnitude na quantidade que uma única chamada pode retornar é uma mudança real para longas trajetórias de agentes e renderização em disparo único, e é o único número técnico no anúncio sem ambiguidade.

A capture of Google's own blog post announcing Gemini 4 Argon, carrying a Published Time of 2026-09-30T20:00:00+00:00 and the headline "Gemini 4 Argon: our next era of frontier intelligence" credited to Koray Kavukcuoglu, followed by the Fairwind Program rollout and the vendor-reported benchmark set: DeepSWE v1.1 77.9%, AutomationBench 51.3%, LVBench 91.7%, CWE-bench v1 68%, an output limit of 1 million tokens up from 64K, and pricing of $2 / $10 stepping to $4 / $20.

O conjunto de benchmarks é amplo e não conta com nenhuma reprodução. O Google relata 77,9% no DeepSWE v1.1, primeiro lugar no AutomationBench, com 51,3%, 91,7% no LVBench, um empate em primeiro lugar no CWE-bench v1, com 68%, resultados líderes no Vals Index, em seu Vals Finance Agent v2, no Legal Agent Benchmark da Harvey e o desempenho mais forte no benchmark Indirect Prompt Injection da Gray Swan. Cada um desses números é do próprio fornecedor, publicado por ele, e nenhum foi reproduzido de forma independente. Um conjunto separado de números que circulou em setembro, apresentado como benchmarks previstos do Gemini 4, com uma pontuação de 48,7% no AutomationBench, revelou-se reciclado de um lançamento não relacionado e não é uma publicação do Google. O número real relatado pelo Google para o AutomationBench é 51,3%, que é um número diferente, de uma fonte diferente.

O placar que os dois nomes produzem

Coloque os dois lado a lado nas seis dimensões em que este pareamento realmente se baseia, e a forma do problema fica óbvia:

• Existe como produto nomeado — Gemini 4: não. Gemini 4 Argon: sim, anunciado em 30/09/2026.

• Disponível hoje — Gemini 4: não existe ID de modelo nem endpoint. Gemini 4 Argon: também não existe ID de modelo nem endpoint; o acesso é controlado pelo Fairwind e somente por candidatura.

• Preço — Gemini 4: nenhum publicado. Gemini 4 Argon: US$ 2 / US$ 10 por milhão de tokens em caráter introdutório, depois US$ 4 / US$ 20. Informado pelo fornecedor.

• Saída máxima — Gemini 4: nenhuma publicada. Gemini 4 Argon: 1 milhão de tokens, contra 64K da geração anterior. Segundo o fornecedor.

• Índice de inteligência — Gemini 4: não avaliado. Gemini 4 Argon: 53 no Intelligence Index da Artificial Analysis com alto esforço de raciocínio, com um custo de US$ 1,99 por tarefa de índice. Segundo a Artificial Analysis.

• Classificação independente no ranking — Gemini 4: sem classificação. Gemini 4 Argon: primeiro no Vals Index com 68,90%, com custo de US$ 15,68 por teste, em 13,40B de tokens de entrada e 142,01M de tokens de saída. Segundo a Vals.

A two-column scoreboard card headed "Gemini 4 vs Gemini 4 Argon — the scoreboard", with the subtitle "One announced model against a name with nothing behind it". The left column, headed Gemini 4, reads: exists as a named product, no; callable today, no model ID or endpoint; published price, none; maximum output, none published; intelligence index, not evaluated; independent rank, not ranked. The right column, headed Gemini 4 Argon, reads: exists as a named product, yes, announced 2026-09-30; callable today, no, Fairwind-gated; published price, $2 / $10, then $4 / $20; maximum output, 1M tokens, up from 64K; intelligence index, 53, $1.99 per task; independent rank, 1st, Vals 68.90%. A footer reads that the Argon price and output limit are per Google's own announcement, the index and per-task cost per Artificial Analysis, the rank and score per Vals, and that no figure on the left has a published source because Gemini 4 has no product page. The OrcaRouter logo is composited in the bottom-right corner.

Leia as duas últimas linhas em conjunto e você obtém a única discordância genuinamente interessante nesta comparação. A Artificial Analysis coloca o Gemini 4 Argon em 53, o que está empatado com o Claude Fable 5.1 e o GPT-6 Astra, e cinco pontos atrás do Claude Opus 5.5, em 58. A Vals coloca-o em primeiro lugar absoluto. Ambas são independentes, ambas medem algo real, e medem coisas diferentes — o índice da AA pondera um conjunto fixo de dez avaliações em programação, raciocínio e trabalho de conhecimento, enquanto o Vals Index pondera quatro setores pela sua participação no valor acrescentado económico dos EUA. Um modelo pode liderar um e não o outro sem que nenhum dos rankings esteja errado.

Há uma segunda coisa a se notar na linha do Vals, e é aquela com que um comprador corporativo deveria se importar. O Vals registra a tabela de preços do Argon como $4/$20 — o preço pós-introdutório — enquanto o próprio anúncio do Google diz $2/$10. Se o custo por teste de $15,68 foi calculado a $4/$20, então um comprador que aceitar o preço introdutório veria um número substancialmente menor para o mesmo trabalho, e um comprador que perder a janela introdutória não veria. O Google não disse por quanto tempo essa janela dura. Essa única variável indefinida altera o número mais relevante para a decisão em todo o lançamento.

O que você pode chamar hoje

Nada sob o nome Gemini 4, e isso inclui nós. Verificamos o catálogo: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro e google/gemini-3.8-flash-cyber retornam todos "model not found", e o mesmo vale para qualquer outra plataforma de roteamento, porque nenhuma delas tem um ID de modelo para rotear. A própria lista de modelos da API Gemini — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — não traz nenhuma entrada Gemini 4 de qualquer tipo. Enquanto o Argon não passar pela fila do Fairwind e receber um identificador, não há preço cobrado nem endpoint em lugar nenhum.

A camada Pro ativa do Google é outra história. O Gemini 3.1 Pro Preview está no nosso catálogo desde 19 de fevereiro de 2026, a US$ 2,00 por milhão de tokens de entrada e US$ 12,00 por milhão de tokens de saída, com uma janela de contexto de 1.048.576 tokens, uma saída máxima de 65.536 tokens e entrada multimodal em texto, imagem, áudio, vídeo e arquivo. Oito meses depois, ele ainda está rotulado como Preview na própria lista de modelos da Gemini API, o que é, por si só, o argumento de que o Argon existe. Se ultrapassar 200.000 tokens de entrada, a tarifa dobra para US$ 4 e US$ 18.

A capture of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the Google provider, a release date of 2026-02-19, a 1,048,576-token context window, a 65,536-token maximum output, pricing of $2.00 input and $12.00 output per million tokens with $4.00 and $18.00 over the 200,000-token threshold, multimodal input icons for text, image, video, audio and file, and capability chips for reasoning, tool calling, structured outputs, prompt caching, assistant prefill, computer use and web search.

Esse é o único ponto em que esta comparação tem uma resposta operacional. O Gemini 3.1 Pro Preview está ativo por trás do mesmo endpoint compatível com OpenAI que os outros mais de 200 modelos que roteamos, ao preço de tabela do provedor, sem markup — então, quando o Google eventualmente publicar um identificador e uma tarifa cobrada para o Gemini 4 Argon, e depois um equivalente de nível Pro se o padrão de nomenclatura se mantiver, o repasse significa que essas tarifas aparecem do nosso lado no mesmo dia em que aparecem do lado do Google. Enquanto isso, se você quiser medir o nível Pro em vez de ler sobre ele, esse é o modelo a medir. Se você quiser experimentar um modelo cujo comportamento ainda está sendo caracterizado, failover automático entre provedores é como você faz isso sem apostar um caminho de produção em uma prévia que o próprio Google descreve como estando em fase de introdução.

Uma ressalva que deve ser mencionada no mesmo fôlego que o preço

A Bloomberg noticiou em 30 de setembro que alguns funcionários do Google com acesso direto ao Argon dizem que ele se sai pior em trabalho real do que as pontuações de benchmark sugerem, com o design de front-end citado especificamente e dois funcionários usando o termo "benchmaxxing". O Google contesta a caracterização. Vale a pena colocar isso ao lado da lista de benchmarks justamente porque a lista de benchmarks é toda a base pública de evidências desse modelo. Quando há os números de um único fornecedor e nenhuma forma de reproduzi-los, um relatório de que os números não contam a história toda não é uma nota de rodapé. É metade das evidências.

Quem deve escolher qual?

Se você está escolhendo entre esses dois nomes, na verdade ainda não está escolhendo nada, e o conselho honesto é planejar em torno disso, em vez de em torno de uma comparação.

• Se você precisa de um modelo do nível pro do Google em produção neste trimestre, a resposta é o Gemini 3.1 Pro Preview. Ele pode ser chamado, tem preço definido e é o nível que o Argon está sendo posicionado para substituir. Esperar pelo Argon é esperar em uma fila na qual você não pode entrar.

• Se você faz parte do público para o qual o Argon tem acesso restrito — uma autoridade cibernética governamental, um operador de infraestrutura crítica, um mantenedor de software —, o Programa Fairwind é a única via, e a especificidade dessa restrição é um fato sobre as capacidades do modelo, não marketing. O Google o treinou para descoberta e correção de vulnerabilidades e não o disponibilizou amplamente.

• Se você estiver orçando uma migração para 2026, use $2/$10 para a janela introdutória e $4/$20 para tudo o que vier depois dela. Não use um único valor misto e não use o custo por teste de $15.68 da Vals sem verificar em qual tabela de tarifas ele foi calculado.

• Se você está esperando pelo "Gemini 4", espere por um ID de modelo. O nome vai ganhar um — o padrão de nomenclatura do Google ao longo de três gerações indica que os níveis Pro e Flash recebem seus próprios identificadores — mas o padrão não é um anúncio, nada foi publicado sobre o que um 4 puro seria, quanto custaria ou o que faria.

O ponto mais amplo é um que este blog já teve de defender antes e provavelmente terá de defender de novo: um nome de geração não é um modelo. Gemini 4 Argon é a única coisa que o Google respaldou com um nome, um preço, um conjunto de benchmarks e um plano de acesso. O resto da família é um padrão, e um padrão é algo que se pode prever, mas não algo que se pode nomear.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente