
Modelos Claude no Gemini Agent: O que o vazamento revela e o que o Google já registrou por escrito
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
Um vazamento publicado em 2026-10-08 afirma que Gemini Argon 4, Gemini Flash 3.8, Claude Opus 5 e Claude Sonnet 5.5 estarão todos disponíveis dentro do agente Gemini que a Google anunciou no mesmo dia para o Gemini Business. Três desses quatro nomes estão errados, e a correção é mais interessante do que o vazamento. O modelo que a postagem chama de "Gemini Argon 4" é Gemini 4 Argon — o próprio modelo de fronteira da Google, anunciado em 2026-09-30 por Koray Kavukcuoglu e ainda sem um ID de modelo chamável. Aquele que o vazamento chama de "Gemini Flash 3.8" é Gemini 3.8 Flash, que está na API Gemini desde 2026-09-02. E os dois modelos da Anthropic não são a geração atual: o vazamento nomeia Claude Opus 5 (lançado em 2026-07-24) e Claude Sonnet 5.5 (lançado em 2026-09-28), enquanto a própria documentação do agente da Google já direciona para Claude Opus 5.5 e Claude Sonnet 5.5. O que sobrevive à verificação não é a lista de modelos. É a frase que a própria Google publicou.
Porque é isto que um vazamento pode obscurecer: o anúncio do Google para o agente Gemini já diz que a Anthropic está incluída. Ele diz isso sem número de versão, sem ID de modelo e sem uma única palavra sobre o Gemini Business. Tudo abaixo separa o que o Google declarou oficialmente daquilo que uma conta no X inferiu a partir disso, porque os dois não são o mesmo documento e não dizem a mesma coisa.
O que o vazamento realmente diz, e de onde ele vem
O sinal é uma publicação no X da conta @testingcatalog, datada de 2026-10-08, cujo texto completo diz: "Gemini Argon 4, Gemini Flash 3.8, Claude Opus 5 e Claude Sonnet 5.5 estarão disponíveis no recém-anunciado Gemini Agent para o Gemini Business. É a primeira vez que modelos Claude apareceriam no Gemini, junto com os modelos do Google." Ela não traz captura de tela, nem fonte interna do Google, nem documento, e nenhuma data para a disponibilidade alegada.
Essa é uma afirmação baseada em uma única fonte sobre uma superfície de produto que, até o momento, ainda não foi lançada. Vale a pena acompanhar justamente porque o último lançamento Claude versus Google também se parecia com isso e acabou se revelando real — mas a descrição verídica da situação é que um observador terceiro leu o próprio anúncio do Google e deduziu a existência de uma linha de produtos a partir dele. A verificação de um vazamento não é se quem vazou é confiável. É se o documento subjacente diz aquilo.
O que o Google já confirmou em 08/10/2026, nas próprias palavras do Google
O Google Cloud publicou "Bem-vindo ao Gemini at Work 2026: Apresentando o Gemini agent" em 8 de outubro de 2026, adaptado do discurso principal de Thomas Kurian no evento Gemini at Work 2026, e isso resolve de forma definitiva a questão da Anthropic. A seção do post sobre orquestração de modelos diz, literalmente:
"Ele executa cada tarefa no modelo mais adequado — orquestrando entre nossa família de modelos Gemini e modelos Claude da Anthropic hoje, e outros modelos privados e abertos líderes no futuro — para oferecer qualidade ideal e reduzir seus custos."
Portanto, a alegação de que o Claude está chegando ao agente do Google não é um vazamento. É uma declaração publicada em primeira mão, e o enquadramento do vazamento como notícia chega um dia atrasado. O que o Google não faz é nomear uma versão. Não há número de Claude Opus, número de Claude Sonnet, ID de modelo, tabela de preços, cota nem data de disponibilidade associada a essa frase em nenhum lugar do post. O Google nomeia a Anthropic e nomeia suas próprias linhas — Argon para raciocínio de fronteira, Flash para velocidade e volume, Omni para mídia generativa, Gemma para cargas de trabalho de borda leves com pesos abertos — e para por aí.
O raciocínio que o Google apresenta para a arquitetura é a parte que vale a pena manter, porque é um argumento de roteamento, e é o mesmo argumento que este blog defende sobre não fixar um único modelo no código:
"O melhor modelo para a tarefa nem sempre é o maior."
• "O modelo líder muda a cada poucos meses, então manter essa escolha em aberto significa que seu contexto, suas habilidades e seus dados permanecem no lugar quando isso acontecer."
O mecanismo declarado do Google para isso é um conjunto de recursos que ele descreve como orquestração multimodelo, Smart Routing e limites de gastos em tempo real aplicáveis no console do Cloud Billing — agentes que pausam quando um limite é atingido e são retomados com um clique, rastreados por projeto para chargeback. Se você já precificou um mês de tráfego de agentes depois do ocorrido, essa é a parte do anúncio que muda o que você pode decidir.

A linha Gemini Business é a parte mais fraca do vazamento.
De tudo o que há no post, "for Gemini Business" é a parte com menos fundamento, e merece ser dita com clareza em vez de ser repassada adiante.
O post de Kurian nunca usa o nome Gemini Business. Os níveis que ele nomeia são Gemini Enterprise — implantado por "quase 90% da Fortune 100", na própria formulação do Google — além de Gemini for Education, e o setor desenvolve Gemini for Financial Services e Gemini for Legal, com Government, Healthcare e Retail marcados como em breve. O Gemini no Google Workspace é descrito separadamente, de forma integrada no Gmail, Drive, Docs, Slides, Sheets, Chat e Calendar. A palavra "Business" não aparece como um nível de produto em nenhum lugar do anúncio.
Há uma superfície real em business.gemini.google, e é o tipo de coisa que produz exatamente essa confusão: a URL redireciona para um endpoint de login do Google Workforce Identity Federation, ou seja, um portal de SSO para uma implantação do Gemini hospedada no Google Workspace, e não um SKU nomeado com página e preço. Isso é uma configuração de hospedagem, não um anúncio. Se o vazamento estiver certo de que o Gemini Business é onde o Claude chega primeiro, a evidência não está no post do Google — e, se estiver errado, o erro é o comum de ler um domínio de login como nome de produto.
Onde os modelos da Anthropic já estão presentes nos produtos da Google
A parte do vazamento sobre a "primeira vez que modelos Claude apareceriam no Gemini" também precisa de correção, porque o Claude já pode ser selecionado dentro de um produto do Google, e já faz uma semana.
A documentação do Antigravity do Google lista modelos de raciocínio de terceiros ao lado dos próprios do Google e, a partir desta semana, as linhas mostram:
• Claude Sonnet 5.5 (pensamento) — Google AI Pro (apenas assinaturas que não sejam de teste) e Google AI Ultra
• Claude Opus 5.5 (thinking) — Google AI Pro (apenas subscrições não experimentais) e Google AI Ultra
• Claude Sonnet 4.6 (thinking) e Claude Opus 4.6 (thinking) — Grátis, Google AI Plus e Google AI Pro, com remoção prevista para 2026-11-02
• GPT-OSS-120b — Grátis, Google AI Plus, Google AI Pro e Ultra, com remoção prevista para 2026-11-02
• Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash e Gemini 3.1 Pro — todos os níveis, sem alterações
Observe o que está ausente dessa lista: Claude Opus 5 e Claude Sonnet 5, os dois modelos que o vazamento nomeia. A superfície Claude já existente do Google roda a geração 5.5, nos planos pagos, com as linhas mais antigas 4.6 em uma data de desativação documentada. Um vazamento que nomeia a geração Opus anterior para uma nova superfície do Google ou está descrevendo um nível de otimização de custos ou está simplesmente desatualizado — e não há documento em nenhum dos sentidos. Trate a lista de modelos no post do X como a linha menos confiável dele.
Você pode ligar para algum destes quatro modelos hoje?
Esta é a questão que o vazamento não pode responder e a documentação do Google pode, pelo menos para o lado do Gemini.
• Gemini 4 Argon — não. O Google o anunciou em 2026-09-30 com preços introdutórios de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, um lançamento em fases com apenas a primeira fase datada (defensores cibernéticos por meio do Fairwind Program), e nenhum ID de modelo. Em 2026-10-09, a lista de modelos da API do Gemini não contém nenhuma entrada Argon nem identificador gemini-4; as entradas mais recentes são da família 3.8. A Artificial Analysis mediu o Argon com um Intelligence Index de 52,56 em sua revisão v4.3.2, em um modelo que um leitor ainda não consegue colocar em uma requisição.
• Gemini 3.8 Flash — sim, e ele pode ser chamado desde 2026-09-02, então já está disponível na API Gemini, no AI Studio e em nossas rotas como google/gemini-3.8-flash. A própria página de preços do Google o lista a US$ 0,75 por milhão de entrada e US$ 3,75 por milhão de saída até 2026-12-31, subindo para US$ 1,50 / US$ 7,50 a partir de 2027-01-01. Na mesma revisão do índice, ele pontua 40,9 — cerca de doze pontos abaixo do Argon, e essa diferença é justamente o motivo pelo qual o Google quer as duas linhas em um só agente.
• Claude Opus 5 — sim. A Anthropic lançou-o em 24 de julho de 2026, a US$ 5 / US$ 25 por milhão de tokens, com uma janela de contexto de 1M de tokens, e a Artificial Analysis atribui-lhe uma pontuação de 51 no Intelligence Index v4.3, sétimo entre cerca de 200 modelos medidos.
• Claude Sonnet 5.5 — sim. Anthropic lançou-o em 28/09/2026 a US$ 2 / US$ 10 por milhão de tokens, e ele pontua 56 na mesma revisão, dois pontos abaixo do carro-chefe Claude Opus 5.5, com 58.
Quatro modelos, então, e apenas um deles é exclusivo de um agente Gemini. Argon é aquele de que o vazamento realmente trata, porque é o único nome que um leitor ainda não consegue alcançar.

Por que o Google precisa que isso funcione, em um número
A aritmética por trás de um agente multivendor é um spread de preços, e o spread é grande. Na revisão v4.3.2 da Artificial Analysis, a mesma faixa de seis pontos vai de Claude Opus 5.5 a 58, passando por Claude Sonnet 5.5 a 56, Claude Fable 5.1 e GPT-6 Astra a 53, e Claude Opus 5 a 51 — enquanto Gemini 3.8 Flash fica em 40,9 a $0,75 / $3,75. O argumento de venda da Google é que o agente escolhe por tarefa: raciocínio de fronteira no Argon para os 5% difíceis de um fluxo de trabalho, Flash para o volume. Se Claude Opus 5.5 e Claude Sonnet 5.5 também estiverem no seletor, a mesma lógica de escolher o modelo certo se estende entre fornecedores, e a Google vende o roteamento em vez do modelo.
Esse é um bom argumento, e é algo que você pode colocar em prática sem esperar pela versão do Google dele. O erro que as empresas cometem com uma nova camada de orquestração é presumir que o roteamento é gratuito porque vem incluído. Não é: cada superfície tem seu próprio pool de cotas, seu próprio console de administração, sua própria semântica de limite de gastos e sua própria ideia do que acontece quando um provedor degrada. A própria documentação do Antigravity do Google é um exemplo ao vivo — as cotas do Claude e do GPT ficam em um pool separado dos modelos Gemini, com seus próprios limites de cinco horas e semanais, e o BYOK não é compatível com os planos que os atendem.
Tudo o que você constrói em cima do agente de um fornecedor também é construído em cima da lista de modelos dele, que é exatamente a lista que este vazamento errou. Uma API para 200+ modelos com 0% de markup sobre o preço de lista do provedor é a maneira de baixo compromisso de testar a mesma ideia de roteamento: execute uma tarefa no Gemini 3.8 Flash e no Claude Sonnet 5.5 a partir do mesmo endpoint, compare o custo por tarefa no seu próprio tráfego em vez de numa tabela do fornecedor, e deixe o failover automático entre provedores cobrir o caso em que o modelo que você escolheu é o que está tendo uma hora ruim. As mudanças de preço do fornecedor são repassadas no mesmo dia, o que importa quando o Google já disse que o Gemini 3.8 Flash dobra em 2027-01-01.
O que faria isto passar de uma fuga de informação a uma notícia?
Três documentos resolveriam isso, e nenhum deles existe hoje.
A primeira é uma página de seleção de modelos de agente do Gemini que nomeia versões — o equivalente à tabela de modelos do Antigravity, que lista Claude Sonnet 5.5 e Claude Opus 5.5 por nome e por plano. O anúncio do agente do Google não tem uma tabela dessas, e a frase sobre a Anthropic é um compromisso em prosa, e não uma especificação. Enquanto não existir uma tabela, todo número de versão em circulação é inferência de alguém.
O segundo é uma página de produto Gemini Business. No momento, a única evidência do nome é um redirecionamento SSO e uma postagem no X. Se o Google estiver criando um nível entre o aplicativo Gemini para consumidores e o Gemini Enterprise, ele aparecerá no blog do Cloud ou do Workspace com um preço e uma restrição de plano, e nomeará os modelos da mesma forma que a documentação do Antigravity os nomeia.
O terceiro é um ID de modelo Argon. O Argon é todo o ponto comercial do arranjo — é a linha de fronteira do Google, com preço introdutório de US$ 2 / US$ 10, e ainda não pode ser chamado. Quando o gemini-4 ou um identificador Argon aparecer na lista de modelos da API Gemini, o agente multi-modelo terá para onde rotear algo que ainda não está no mercado. Até então, o resumo honesto de "Gemini Argon 4" é que se trata de um modelo anunciado, com uma pontuação de índice medida, um preço e nenhum endpoint — o que é uma posição real em torno da qual um leitor pode se planejar, e uma base ruim sobre a qual construir.

O que fazer com isso se você estiver escolhendo modelos esta semana
Nada no vazamento muda o que você deve rodar hoje. Gemini 3.8 Flash, Claude Opus 5, Claude Opus 5.5, Claude Sonnet 5.5 e o restante do mercado estão todos chamáveis agora, pelos preços publicados, e o trabalho de seleção de modelo é o mesmo, independentemente de o Google lançar um agente ou não.
A única decisão sobre a qual o anúncio de fato informa é arquitetural: se você está padronizando em uma camada de orquestração de um único fornecedor, também está aceitando a lista de modelos desse fornecedor, os pools de cota desse fornecedor e o ritmo de mudança desse fornecedor. Se você está padronizando em uma API que intermedeia vários, você mantém a escolha — que é, palavra por palavra, o argumento que o Google apresentou em favor do próprio produto quando escreveu que o modelo líder muda a cada poucos meses e que manter a escolha aberta significa que seu contexto, suas habilidades e seus dados permanecem no lugar quando isso acontece. A diferença é apenas quem controla o roteamento.
O que observar é restrito e datado: um ID de modelo Argon na lista de modelos da API Gemini, e uma tabela de modelos de agente Gemini que nomeia versões da Anthropic. Qualquer um deles transforma isto de um vazamento numa especificação. Até que ambos se concretizem, a descrição precisa da posição da Google é a que a Google publicou — Claude está no agente, a versão não é declarada, e o Gemini Business continua a ser uma página de login e um rumor.
Comparados neste artigo4
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
