Cartão de título principal para o artigo 'Gemini 4 Carbon — RELATÓRIO DE VAZAMENTO', com um selo 'NÃO VERIFICADO', o subtítulo 'Um checkpoint interno do Google que o público não pode acessar — o que diz o relatório', três chips com os textos 'Fonte: Business Insider via TestingCatalog', '9–10 de outubro de 2026' e 'Testado no Jetski, a plataforma interna do Google', um cartão à esquerda com o texto 'A alegação: o feedback interno inicial coloca o Carbon como comparável ao Claude Opus 5.5 em programação', e um cartão à direita com o texto 'O contexto: o Barium-B é o checkpoint escolhido para o lançamento público do Gemini 4 Argon'. O logotipo do OrcaRouter está composto no canto inferior direito.
Guides & Insights

Vazamento do Gemini 4 Carbon: o checkpoint interno do Google que, segundo funcionários, codifica como o Claude Opus 5.5

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Existe uma versão desta história que é notícia e uma versão que é ruído, e a diferença está inteiramente naquilo a que os nomes estão ligados. Em 9 e 10 de outubro de 2026, a Business Insider noticiou — e o veículo de monitoramento de vazamentos TestingCatalog repercutiu — que funcionários da gigante das buscas estão testando internamente um checkpoint adicional do Gemini 4 chamado Carbon, que o feedback interno inicial descreve Carbon como comparável ao Claude Opus 5.5 para programação, que Barium-B é o checkpoint selecionado para o lançamento público do Gemini 4 Argon, e que Carbon, testado por meio da plataforma interna Jetski da empresa, é uma iteração separada e possivelmente mais forte. O que faz isso valer a pena ler em vez de apenas passar os olhos é a última oração: se Carbon será lançado como uma atualização do Gemini 4 Argon ou como um lançamento próprio é, nas próprias palavras do relatório, não confirmado. E esse é todo o estado das evidências — nenhum anúncio, nenhum identificador de modelo, nenhum endpoint, nenhum preço, nenhum model card e nenhum comentário do fornecedor. Tudo o que é concreto nesta página é um vazamento, uma inferência tirada de um vazamento, ou um fato sobre um modelo diferente e já pronto para lançamento com o qual o vazamento é medido.

O que o relatório realmente afirma

O sinal é tênue, e é específico o suficiente para ser falsificável, que é a única razão pela qual ele pertence a uma página como esta. Despidas de enquadramento, as alegações são estas:

• Funcionários do Google estão testando internamente um checkpoint do Gemini 4 chamado Carbon. Não é um modelo público e não pode ser chamado por nenhuma API.

• Segundo relatos, o feedback interno inicial coloca o Carbon como tendo uma sensação comparável à do Claude Opus 5.5 para programação — uma impressão de testes de funcionários, não um resultado de benchmark, e não um número que qualquer pessoa fora do Google possa reproduzir.

• O checkpoint por trás do modelo de que o público realmente ouviu falar — Gemini 4 Argon — chama-se Barium-B, e Carbon é descrito como uma iteração separada e potencialmente mais capaz, em vez da mesma versão sob dois rótulos.

• Segundo relatos, o Carbon estaria sendo exercitado por meio do Jetski, que a mesma reportagem descreve como o nome interno do Google associado ao Antigravity, seu ambiente de codificação agêntico.

• Não se sabe se o Carbon se tornará uma futura atualização do Gemini 4 Argon ou um lançamento distinto do Gemini 4. O Google não comentou nada sobre isso.

Esse é o vazamento. Ele contém uma comparação, uma relação de codinome e uma questão genuinamente em aberto, e nenhuma parte dele é um release.

A two-column infographic titled 'Gemini 4 Carbon — what the report says / what it does not'. Left column 'What the report says': '9–10 Oct 2026 — Business Insider, relayed by TestingCatalog', 'Google staff testing a Gemini 4 checkpoint named Carbon', 'Early internal feedback: feels comparable to Claude Opus 5.5 for coding', 'Barium-B is the checkpoint chosen for the public Gemini 4 Argon release', 'Tested via Jetski, tied to Antigravity'. Right column 'What it does not say': 'Whether Carbon ships as an Argon update or a separate Gemini 4 release', 'No model ID, endpoint or price of any kind', 'No model card, context window or parameter count', 'No benchmark number behind the Opus 5.5 comparison', 'No date, and no comment from Google'. Footer: 'All leak claims unverified; Google has not commented.'

A escada dos codinomes, e qual degrau importa

A razão pela qual este relatório precisa de um anel decodificador é que o hábito do Google com a tabela periódica coloca três nomes em um parágrafo que parecem paralelos e não são. Ordenados pelo que um leitor pode realmente fazer com cada um:

• Gemini 4 Argon — anunciado. Um nome de modelo real com um post de anúncio oficial e uma página da família, um preço introdutório publicado de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, um limite publicado de 1 milhão de tokens de saída, e uma implantação com acesso controlado que começou com defensores cibernéticos avaliados e foi descrita como ampliação para clientes pagos da API em seguida. Ele ainda não tem um identificador de modelo que você possa colocar em uma requisição, que é a linha que separa um modelo anunciado de um modelo que pode ser chamado.

• Barium-B — um nome de checkpoint, não um produto. Segundo a mesma reportagem, é a build selecionada para o lançamento público do Argon. É isso que há de útil no rótulo: ele mostra que o nome Argon é uma decisão de lançamento em torno de uma build interna, e não uma build em si.

• Carbon — um checkpoint interno com impressões da equipe anexadas e nada mais. Sem ID, sem preço, sem janela, sem data. É um rumor com um codinome, e codinomes são baratos.

Lida dessa forma, a história não é "um novo Gemini vazou". É que o Google parece estar rodando mais de um checkpoint de fronteira em paralelo, que aquele sobre o qual ele colocou seu nome público não é aquele com o qual seus engenheiros estão mais entusiasmados, e que ninguém fora da empresa sabe qual desses dois fatos acabará importando.

Por que "parece o Claude Opus 5.5" é a frase que sustenta tudo

De tudo no relatório, a comparação é o item que mais faz o trabalho pesado e o menos verificável, então vale a pena ser preciso sobre aquilo com que ela está sendo comparada. O Claude Opus 5.5 é o carro-chefe da Anthropic e, com base em medições independentes, o modelo de codificação mais forte e amplamente acessível por chamadas da geração atual — o ponto de referência a que um engenheiro do Google recorre quando quer dizer "este é o bom" sem citar um benchmark. Em seu preço de tabela publicado, ele custa US$ 4,00 por milhão de tokens de entrada e US$ 20,00 por milhão de tokens de saída, com leituras de cache a US$ 0,20 por milhão, além de ter uma janela de entrada de 1M de tokens e uma saída máxima de 128K tokens.

Comparado a isso, a comparação diz duas coisas ao mesmo tempo, e a segunda é a que as pessoas ignoram. A primeira é competitiva: um checkpoint interno do Google é descrito no mesmo fôlego que o carro-chefe do principal rival, o que é um elogio que o Google não colocaria em um post de blog. A segunda é de posicionamento: a comparação é a impressão de um funcionário sobre a sensação ao programar, que é exatamente o tipo de afirmação que sobrevive ao contato com uma janela de chat e morre ao contato com um ranking. Ninguém publicou um benchmark para o Carbon. Não há entrada no Artificial Analysis, nem tabela de benchmark de fornecedor, nem PDF de metodologia de avaliação — isso existe para o Gemini 4 Argon e não existe para este. Uma sensação não é uma pontuação, e esta página não vai fazer uma passar por outra.

Há também uma consequência de precificação que vale a pena mencionar, sem fingir que sabemos a resposta. Se um checkpoint que "parece o Claude Opus 5.5 para programação" está dentro do Google e o modelo que o Google realmente anunciou fica cinco pontos abaixo dele no índice independente, então a pergunta interessante não é se o Carbon é bom — é quanto o Google cobraria por ele, e se ele algum dia seria vendido aos preços de cavalo de batalha pelos quais o restante da linha Gemini foi lançado.

O que está faltando, e por que a lista é mais longa que as notícias

O inventário honesto do que não existe é o artigo inteiro, então aqui está:

• Um identificador de modelo — o Carbon não tem nenhum, e o Gemini 4 Argon também não. Nenhum dos dois nomes aparece em nenhum lugar ao qual uma requisição possa ser endereçada.

• Um preço — nada publicado para o Carbon em nenhum nível, nem mesmo uma tarifa introdutória.

• Um cartão de modelo ou cartão de sistema — nenhum, e nenhuma metodologia de avaliação publicada que o sustente.

• Uma janela de contexto, um limite de saída ou uma contagem de parâmetros — nenhum deles divulgado, e o Google não divulgou nenhuma contagem de parâmetros para nenhum Gemini.

• Um resultado de benchmark — a comparação com o Opus 5.5 é uma impressão da equipe, o que significa nenhum número, nenhum teste e nenhuma reprodutibilidade.

• Uma data — nenhum anúncio, nenhum lançamento faseado, nenhuma janela e nenhum comentário do Google sobre se um lançamento do Carbon está sequer planejado.

• Uma relação — se o Carbon é a próxima atualização do Argon ou um modelo Gemini 4 separado. Esta é a incógnita de maior consequência no relatório e é explicitamente não confirmada no próprio relatório.

Tudo o que não está nessa lista é inferência, incluindo a maior parte do que será escrito sobre isso nas próximas duas semanas.

O que um desenvolvedor pode fazer com isto hoje

A resposta útil é que quase nada muda, e vale a pena dizer exatamente por quê. Nem o Gemini 4 Argon nem o Carbon estão no OrcaRouter — consultar nosso próprio catálogo por qualquer um dos dois não retorna nada, e continuará não retornando nada até que o Google torne um deles chamável. O nome Gemini 4 não é algo para o qual você possa rotear; é um nome atrelado a um lançamento controlado. Qualquer conta que ofereça acesso ao "Gemini 4 Carbon" agora está vendendo um rótulo.

O que é real é o modelo em relação ao qual o vazamento é medido. Claude Opus 5.5 já está ativo no OrcaRouter pelo preço de tabela da Anthropic — US$ 4,00 de entrada e US$ 20,00 de saída por milhão de tokens, leituras de cache a US$ 0,20 por milhão, repassados sem nenhuma margem — então o modelo específico com o qual o Carbon está sendo descrito como comparável é um que você pode chamar hoje, na mesma chave de API que todo o resto. Isso é um fato mais útil do que o vazamento, porque é a metade da comparação que pode ser testada.

A postura que sobrevive a um rumor é a que não precisa que o rumor seja verdade. Coloque o Claude Opus 5.5 por trás das suas cargas de trabalho de programação mais difíceis e mantenha uma regra de failover para uma camada mais barata para o tráfego que não precisa dele; no dia em que um identificador real do Gemini 4 aparecer no catálogo de um provedor, nossos preços de lista são atualizados no mesmo dia em que o Google os define, porque não há etapa de renegociação entre um fornecedor publicar um preço e nós o repassarmos. Uma API para mais de 200 modelos transforma "devemos migrar?" em uma edição de DSL de roteamento e um teste A/B em tráfego real, em vez de uma reescrita. Roteie por resultados que você consegue medir, não por nomes sobre os quais você lê.

A screenshot of Google's own Gemini API models documentation page, listing the Gemini 3.8 family and earlier models with their model codes and pricing, and containing no entry for Gemini 4 Argon or Gemini 4 Carbon.A screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, showing the model id, its capability chips, a 1M-token context window, a 128K maximum output, and pricing of .00 per 1M input tokens and 0.00 per 1M output tokens with cache reads at /bin/bash.20 per 1M.

O que estamos assistindo

• Se o Google disser alguma coisa. Um comentário, uma mudança na página da família ou uma linha em um post de lançamento tiraria tudo isso da coluna de vazamentos de uma só vez. O silêncio mantém tudo onde está.

• A segunda etapa do lançamento do Argon. O anúncio descreveu clientes pagos da API e assinantes Ultra como a próxima coorte depois dos defensores verificados, e a chegada de um identificador Gemini 4 é o evento que transforma "anunciado" em "invocável". Se um endpoint executável surgir, a questão de saber se seu checkpoint é o Barium-B ou algo mais recente torna-se concreta.

• Qualquer medição independente do Carbon. No momento em que um checkpoint como este aparece num leaderboard neutro, em vez de numa impressão de funcionário, a frase do Opus 5.5 deixa de ser uma vibe e passa a ser um ponto de dados — ou deixa de ser verdade.

• A tabela de preços. Onde o Google precifica um checkpoint de fronteira que seus próprios engenheiros preferem é o indicador de se o Carbon é uma atualização do Argon ou uma categoria à parte.

• Se a relação entre os codinomes sobrevive ao contato com um lançamento. Barium-B atrás do Argon e o Carbon ao lado dele é uma história limpa hoje; posts de lançamento têm o hábito de colapsar histórias limpas em um único modelo com um único ID.

O resumo que não superestima isso é curto. Segundo relatos, funcionários do Google estão testando um checkpoint interno do Gemini 4 chamado Carbon; a impressão inicial deles é de que ele escreve código como o Claude Opus 5.5; o checkpoint por trás do lançamento público do Gemini 4 Argon é outro, chamado Barium-B; e se o Carbon algum dia se tornará um produto — uma atualização, um modelo separado ou nada — não está confirmado. A metade dessa frase sobre a qual você pode agir é a metade que nomeia o Claude Opus 5.5, porque é o único modelo no parágrafo com um identificador de modelo, um preço e um endpoint. Continue chamando o que você pode chamar, e mantenha uma regra de failover pronta para o dia em que o outro nome se tornar um.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente