Cartão de título de destaque intitulado 'Modelos Claude no Gemini Agent', com o subtítulo 'Um vazamento de 2026-10-08 nomeia quatro modelos — e três dos nomes estão errados' e três chips com os dizeres 'Gemini 4 Argon: sem ID de modelo', 'Gemini 3.8 Flash: ativo desde 2 de setembro' e 'Claude já está no Antigravity'. O logotipo da OrcaRouter está composto no canto inferior direito.
Guides & Insights

Modelos Claude no Gemini Agent: O que o vazamento revela e o que o Google já registrou por escrito

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Um vazamento publicado em 2026-10-08 afirma que G​emini Argon 4, G​emini Flash 3.8, Claude Opus 5 e Claude Sonnet 5.5 estarão todos disponíveis dentro do agente G​emini que a G​oogle anunciou no mesmo dia para o G​emini Business. Três desses quatro nomes estão errados, e a correção é mais interessante do que o vazamento. O modelo que a postagem chama de "G​emini Argon 4" é G​emini 4 Argon — o próprio modelo de fronteira da G​oogle, anunciado em 2026-09-30 por Koray Kavukcuoglu e ainda sem um ID de modelo chamável. Aquele que o vazamento chama de "G​emini Flash 3.8" é Gemini 3.8 Flash, que está na API G​emini desde 2026-09-02. E os dois modelos da A​nthropic não são a geração atual: o vazamento nomeia Claude Opus 5 (lançado em 2026-07-24) e Claude Sonnet 5.5 (lançado em 2026-09-28), enquanto a própria documentação do agente da G​oogle já direciona para Claude Opus 5.5 e Claude Sonnet 5.5. O que sobrevive à verificação não é a lista de modelos. É a frase que a própria G​oogle publicou.

Porque é isto que um vazamento pode obscurecer: o anúncio do G​oogle para o agente G​emini já diz que a A​nthropic está incluída. Ele diz isso sem número de versão, sem ID de modelo e sem uma única palavra sobre o G​emini Business. Tudo abaixo separa o que o G​oogle declarou oficialmente daquilo que uma conta no X inferiu a partir disso, porque os dois não são o mesmo documento e não dizem a mesma coisa.

O que o vazamento realmente diz, e de onde ele vem

O sinal é uma publicação no X da conta @testingcatalog, datada de 2026-10-08, cujo texto completo diz: "Gemini Argon 4, Gemini Flash 3.8, Claude Opus 5 e Claude Sonnet 5.5 estarão disponíveis no recém-anunciado Gemini Agent para o Gemini Business. É a primeira vez que modelos Claude apareceriam no Gemini, junto com os modelos do Google." Ela não traz captura de tela, nem fonte interna do Google, nem documento, e nenhuma data para a disponibilidade alegada.

Essa é uma afirmação baseada em uma única fonte sobre uma superfície de produto que, até o momento, ainda não foi lançada. Vale a pena acompanhar justamente porque o último lançamento Claude versus Google também se parecia com isso e acabou se revelando real — mas a descrição verídica da situação é que um observador terceiro leu o próprio anúncio do Google e deduziu a existência de uma linha de produtos a partir dele. A verificação de um vazamento não é se quem vazou é confiável. É se o documento subjacente diz aquilo.

O que o Google já confirmou em 08/10/2026, nas próprias palavras do Google

O G​oogle Cloud publicou "Bem-vindo ao G​emini at Work 2026: Apresentando o G​emini agent" em 8 de outubro de 2026, adaptado do discurso principal de Thomas Kurian no evento G​emini at Work 2026, e isso resolve de forma definitiva a questão da A​nthropic. A seção do post sobre orquestração de modelos diz, literalmente:

"Ele executa cada tarefa no modelo mais adequado — orquestrando entre nossa família de modelos G​emini e modelos Claude da A​nthropic hoje, e outros modelos privados e abertos líderes no futuro — para oferecer qualidade ideal e reduzir seus custos."

Portanto, a alegação de que o Claude está chegando ao agente do Google não é um vazamento. É uma declaração publicada em primeira mão, e o enquadramento do vazamento como notícia chega um dia atrasado. O que o Google não faz é nomear uma versão. Não há número de Claude Opus, número de Claude Sonnet, ID de modelo, tabela de preços, cota nem data de disponibilidade associada a essa frase em nenhum lugar do post. O Google nomeia a Anthropic e nomeia suas próprias linhas — Argon para raciocínio de fronteira, Flash para velocidade e volume, Omni para mídia generativa, Gemma para cargas de trabalho de borda leves com pesos abertos — e para por aí.

O raciocínio que o Google apresenta para a arquitetura é a parte que vale a pena manter, porque é um argumento de roteamento, e é o mesmo argumento que este blog defende sobre não fixar um único modelo no código:

"O melhor modelo para a tarefa nem sempre é o maior."

• "O modelo líder muda a cada poucos meses, então manter essa escolha em aberto significa que seu contexto, suas habilidades e seus dados permanecem no lugar quando isso acontecer."

O mecanismo declarado do Google para isso é um conjunto de recursos que ele descreve como orquestração multimodelo, Smart Routing e limites de gastos em tempo real aplicáveis no console do Cloud Billing — agentes que pausam quando um limite é atingido e são retomados com um clique, rastreados por projeto para chargeback. Se você já precificou um mês de tráfego de agentes depois do ocorrido, essa é a parte do anúncio que muda o que você pode decidir.

Headless-browser capture of Google Cloud's blog post 'Welcome to Gemini at Work 2026: Introducing the Gemini agent', dated October 8, 2026, showing the model-orchestration paragraph stating the agent runs each job on the model that fits best, 'orchestrating across our Gemini family of models and Claude models from Anthropic today', plus the Model Context Protocol and Model Armor rows.

A linha G​emini Business é a parte mais fraca do vazamento.

De tudo o que há no post, "for Gemini Business" é a parte com menos fundamento, e merece ser dita com clareza em vez de ser repassada adiante.

O post de Kurian nunca usa o nome G​emini Business. Os níveis que ele nomeia são G​emini Enterprise — implantado por "quase 90% da Fortune 100", na própria formulação do G​oogle — além de G​emini for Education, e o setor desenvolve G​emini for Financial Services e G​emini for Legal, com Government, Healthcare e Retail marcados como em breve. O G​emini no G​oogle Workspace é descrito separadamente, de forma integrada no Gmail, Drive, Docs, Slides, Sheets, Chat e Calendar. A palavra "Business" não aparece como um nível de produto em nenhum lugar do anúncio.

Há uma superfície real em business.gemini.google, e é o tipo de coisa que produz exatamente essa confusão: a URL redireciona para um endpoint de login do Google Workforce Identity Federation, ou seja, um portal de SSO para uma implantação do Gemini hospedada no Google Workspace, e não um SKU nomeado com página e preço. Isso é uma configuração de hospedagem, não um anúncio. Se o vazamento estiver certo de que o Gemini Business é onde o Claude chega primeiro, a evidência não está no post do Google — e, se estiver errado, o erro é o comum de ler um domínio de login como nome de produto.

Onde os modelos da A​nthropic já estão presentes nos produtos da G​oogle

A parte do vazamento sobre a "primeira vez que modelos Claude apareceriam no Gemini" também precisa de correção, porque o Claude já pode ser selecionado dentro de um produto do Google, e já faz uma semana.

A documentação do Antigravity do Google lista modelos de raciocínio de terceiros ao lado dos próprios do Google e, a partir desta semana, as linhas mostram:

• Claude Sonnet 5.5 (pensamento) — Google AI Pro (apenas assinaturas que não sejam de teste) e Google AI Ultra

• Claude Opus 5.5 (thinking) — G​oogle AI Pro (apenas subscrições não experimentais) e G​oogle AI Ultra

• Claude Sonnet 4.6 (thinking) e Claude Opus 4.6 (thinking) — Grátis, G​oogle AI Plus e G​oogle AI Pro, com remoção prevista para 2026-11-02

• GPT-OSS-120b — Grátis, Google AI Plus, Google AI Pro e Ultra, com remoção prevista para 2026-11-02

• Gemini 3.8 Flash, G​emini 3.7 Flash, G​emini 3.6 Flash e G​emini 3.1 Pro — todos os níveis, sem alterações

Observe o que está ausente dessa lista: Claude Opus 5 e Claude Sonnet 5, os dois modelos que o vazamento nomeia. A superfície Claude já existente do Google roda a geração 5.5, nos planos pagos, com as linhas mais antigas 4.6 em uma data de desativação documentada. Um vazamento que nomeia a geração Opus anterior para uma nova superfície do Google ou está descrevendo um nível de otimização de custos ou está simplesmente desatualizado — e não há documento em nenhum dos sentidos. Trate a lista de modelos no post do X como a linha menos confiável dele.

Você pode ligar para algum destes quatro modelos hoje?

Esta é a questão que o vazamento não pode responder e a documentação do Google pode, pelo menos para o lado do Gemini.

• G​emini 4 Argon — não. O G​oogle o anunciou em 2026-09-30 com preços introdutórios de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, um lançamento em fases com apenas a primeira fase datada (defensores cibernéticos por meio do Fairwind Program), e nenhum ID de modelo. Em 2026-10-09, a lista de modelos da API do G​emini não contém nenhuma entrada Argon nem identificador gemini-4; as entradas mais recentes são da família 3.8. A Artificial Analysis mediu o Argon com um Intelligence Index de 52,56 em sua revisão v4.3.2, em um modelo que um leitor ainda não consegue colocar em uma requisição.

• Gemini 3.8 Flash — sim, e ele pode ser chamado desde 2026-09-02, então já está disponível na API Gemini, no AI Studio e em nossas rotas como google/gemini-3.8-flash. A própria página de preços do Google o lista a US$ 0,75 por milhão de entrada e US$ 3,75 por milhão de saída até 2026-12-31, subindo para US$ 1,50 / US$ 7,50 a partir de 2027-01-01. Na mesma revisão do índice, ele pontua 40,9 — cerca de doze pontos abaixo do Argon, e essa diferença é justamente o motivo pelo qual o Google quer as duas linhas em um só agente.

• Claude Opus 5 — sim. A Anthropic lançou-o em 24 de julho de 2026, a US$ 5 / US$ 25 por milhão de tokens, com uma janela de contexto de 1M de tokens, e a Artificial Analysis atribui-lhe uma pontuação de 51 no Intelligence Index v4.3, sétimo entre cerca de 200 modelos medidos.

• Claude Sonnet 5.5 — sim. A​nthropic lançou-o em 28/09/2026 a US$ 2 / US$ 10 por milhão de tokens, e ele pontua 56 na mesma revisão, dois pontos abaixo do carro-chefe Claude Opus 5.5, com 58.

Quatro modelos, então, e apenas um deles é exclusivo de um agente G​emini. Argon é aquele de que o vazamento realmente trata, porque é o único nome que um leitor ainda não consegue alcançar.

Headless-browser capture of Google's Antigravity documentation 'Model Selection' page, showing the model-per-plan table: Gemini 3.8 Flash, 3.7 Flash, 3.6 Flash and 3.1 Pro on all tiers; Claude Sonnet 5.5 (thinking) and Claude Opus 5.5 (thinking) on Google AI Pro (non-trial subscriptions only) and Google AI Ultra; Claude Sonnet 4.6 (thinking), Claude Opus 4.6 (thinking) and GPT-OSS-120b on Free, Google AI Plus and Google AI Pro, with the footnote 'Will be removed on November 2, 2026.'

Por que o Google precisa que isso funcione, em um número

A aritmética por trás de um agente multivendor é um spread de preços, e o spread é grande. Na revisão v4.3.2 da Artificial Analysis, a mesma faixa de seis pontos vai de Claude Opus 5.5 a 58, passando por Claude Sonnet 5.5 a 56, Claude Fable 5.1 e GPT-6 Astra a 53, e Claude Opus 5 a 51 — enquanto Gemini 3.8 Flash fica em 40,9 a $0,75 / $3,75. O argumento de venda da Google é que o agente escolhe por tarefa: raciocínio de fronteira no Argon para os 5% difíceis de um fluxo de trabalho, Flash para o volume. Se Claude Opus 5.5 e Claude Sonnet 5.5 também estiverem no seletor, a mesma lógica de escolher o modelo certo se estende entre fornecedores, e a Google vende o roteamento em vez do modelo.

Esse é um bom argumento, e é algo que você pode colocar em prática sem esperar pela versão do Google dele. O erro que as empresas cometem com uma nova camada de orquestração é presumir que o roteamento é gratuito porque vem incluído. Não é: cada superfície tem seu próprio pool de cotas, seu próprio console de administração, sua própria semântica de limite de gastos e sua própria ideia do que acontece quando um provedor degrada. A própria documentação do Antigravity do Google é um exemplo ao vivo — as cotas do Claude e do GPT ficam em um pool separado dos modelos Gemini, com seus próprios limites de cinco horas e semanais, e o BYOK não é compatível com os planos que os atendem.

Tudo o que você constrói em cima do agente de um fornecedor também é construído em cima da lista de modelos dele, que é exatamente a lista que este vazamento errou. Uma API para 200+ modelos com 0% de markup sobre o preço de lista do provedor é a maneira de baixo compromisso de testar a mesma ideia de roteamento: execute uma tarefa no Gemini 3.8 Flash e no Claude Sonnet 5.5 a partir do mesmo endpoint, compare o custo por tarefa no seu próprio tráfego em vez de numa tabela do fornecedor, e deixe o failover automático entre provedores cobrir o caso em que o modelo que você escolheu é o que está tendo uma hora ruim. As mudanças de preço do fornecedor são repassadas no mesmo dia, o que importa quando o Google já disse que o Gemini 3.8 Flash dobra em 2027-01-01.

O que faria isto passar de uma fuga de informação a uma notícia?

Três documentos resolveriam isso, e nenhum deles existe hoje.

A primeira é uma página de seleção de modelos de agente do Gemini que nomeia versões — o equivalente à tabela de modelos do Antigravity, que lista Claude Sonnet 5.5 e Claude Opus 5.5 por nome e por plano. O anúncio do agente do Google não tem uma tabela dessas, e a frase sobre a Anthropic é um compromisso em prosa, e não uma especificação. Enquanto não existir uma tabela, todo número de versão em circulação é inferência de alguém.

O segundo é uma página de produto G​emini Business. No momento, a única evidência do nome é um redirecionamento SSO e uma postagem no X. Se o G​oogle estiver criando um nível entre o aplicativo G​emini para consumidores e o G​emini Enterprise, ele aparecerá no blog do Cloud ou do Workspace com um preço e uma restrição de plano, e nomeará os modelos da mesma forma que a documentação do Antigravity os nomeia.

O terceiro é um ID de modelo Argon. O Argon é todo o ponto comercial do arranjo — é a linha de fronteira do Google, com preço introdutório de US$ 2 / US$ 10, e ainda não pode ser chamado. Quando o gemini-4 ou um identificador Argon aparecer na lista de modelos da API Gemini, o agente multi-modelo terá para onde rotear algo que ainda não está no mercado. Até então, o resumo honesto de "Gemini Argon 4" é que se trata de um modelo anunciado, com uma pontuação de índice medida, um preço e nenhum endpoint — o que é uma posição real em torno da qual um leitor pode se planejar, e uma base ruim sobre a qual construir.

Generated scoreboard titled 'Claude in Gemini Agent - the scoreboard', with six rows reading 'Gemini 4 Argon: announced 2026-09-30, still no model ID', 'Gemini 3.8 Flash: callable since 2026-09-02, $0.75 / $3.75', 'Claude Opus 5: callable since 2026-07-24, $5 / $25', 'Claude Sonnet 5.5: callable since 2026-09-28, $2 / $10', "Google's own words: Claude models from Anthropic today" and 'Gemini Business: an SSO redirect, no product page', above the footer line "Google's wording is first-party and unnamed; the X post is single-source and unverified. Argon index per Artificial Analysis." The OrcaRouter logo is composited in the bottom-right corner.

O que fazer com isso se você estiver escolhendo modelos esta semana

Nada no vazamento muda o que você deve rodar hoje. Gemini 3.8 Flash, Claude Opus 5, Claude Opus 5.5, Claude Sonnet 5.5 e o restante do mercado estão todos chamáveis agora, pelos preços publicados, e o trabalho de seleção de modelo é o mesmo, independentemente de o Google lançar um agente ou não.

A única decisão sobre a qual o anúncio de fato informa é arquitetural: se você está padronizando em uma camada de orquestração de um único fornecedor, também está aceitando a lista de modelos desse fornecedor, os pools de cota desse fornecedor e o ritmo de mudança desse fornecedor. Se você está padronizando em uma API que intermedeia vários, você mantém a escolha — que é, palavra por palavra, o argumento que o G​oogle apresentou em favor do próprio produto quando escreveu que o modelo líder muda a cada poucos meses e que manter a escolha aberta significa que seu contexto, suas habilidades e seus dados permanecem no lugar quando isso acontece. A diferença é apenas quem controla o roteamento.

O que observar é restrito e datado: um ID de modelo Argon na lista de modelos da API Gemini, e uma tabela de modelos de agente Gemini que nomeia versões da Anthropic. Qualquer um deles transforma isto de um vazamento numa especificação. Até que ambos se concretizem, a descrição precisa da posição da Google é a que a Google publicou — Claude está no agente, a versão não é declarada, e o Gemini Business continua a ser uma página de login e um rumor.

Comparados neste artigo4

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente