Um cartão de título para a comparação entre Gemini 3.7 Flash e Claude Opus 5, mostrando um cartão de velocista rápido rotulado como Gemini 3.7 Flash com uma etiqueta de $0.75 / $3.75, um cartão de torre alta rotulado como Claude Opus 5 com uma etiqueta de $5 / $25 e um pequeno ícone de fração 1/6 entre eles.
Guides & Insights

Gemini 3.7 Flash vs Claude Opus 5: O que um cavalo de batalha oferece por um sexto do preço

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Aqui está o número que torna esta comparação relevante: o Claude Opus 5, carro-chefe da Anthrop​ic, marca 61 no Artificial Analysis Intelligence Index, enquanto o Gemini 3.7 Flash, cavalo de batalha do Go​ogle lançado em 13 de agosto de 2026, marca 56. Cinco pontos. E, no preço promocional que o Go​ogle está oferecendo até o fim do ano, o Gemini 3.7 Flash custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída — cerca de um sexto dos US$ 5,00 / US$ 25,00 do Claude Opus 5. A diferença que costumava separar o "cavalo de batalha" do "carro-chefe" se estreitou a ponto de a pergunta honesta não ser se o modelo barato é bom, mas o que o caro ainda faz que o barato não consegue.

O enquadramento importa, porque esta não é uma comparação de igual para igual e fingir o contrário seria enganoso. O Claude Opus 5, lançado em 24 de julho de 2026, é o modelo de disponibilidade geral mais capaz da Anthrop​ic: um modelo de raciocínio com contexto de 1M de tokens e teto de saída de 128K, projetado para as tarefas mais difíceis de engenharia, pesquisa e uso de computador. O Gemini 3.7 Flash é o cavalo de batalha de alto volume do Go​ogle: contexto de 1M, saída de 64K, entrada de texto/imagem/áudio/vídeo e uma diretriz de design que é o oposto da do Opus — gerar o máximo de tokens possível, ao menor custo possível, para os 95% do tráfego que é rotineiro. Compará-los por um único número é o caminho para uma resposta errada; compará-los pelo formato do trabalho que você realmente executa é o caminho para uma resposta útil.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Cinco pontos, explicados

O Intelligence Index não é uma escala linear, e a diferença entre 56 e 61 vale mais em algumas tarefas do que em outras. Os 61 do Opus 5 vêm de liderar nos membros mais difíceis do composto — seus 30,2 no ARC-AGI-3, 43,3 no FrontierBench e 79,2 no SWE-bench Pro são todos {{1}}relatados pelo fornecedor{{/1}}, mas são o tipo de resultados de raciocínio de fronteira que nenhum modelo da classe Flash alcança. Os 56 do Gemini 3.7 Flash são conquistados de outra forma: os números divulgados pelo {{2}}Go​ogle{{/2}} para ele (65,3 no DeepSWE v1.1, 1588 Elo no WebDev Arena, 30,4 no AutomationBench) mostram um modelo excelente em engenharia de escopo delimitado e de alto volume e em agentes, não em raciocínio aberto e inovador. Cinco pontos no índice, portanto, descrevem um precipício real de capacidade, mesmo que a distância anunciada pareça pequena.

• Intelligence Index — 56 para Gemini 3.7 Flash versus 61 para Claude Opus 5 (esforço máximo), segundo a Artificial Analysis.

• Velocidade de saída — ~340 tokens/s para o Gemini 3.7 Flash contra ~53 tokens/s para o Claude Opus 5, ambos segundo a Artificial Analysis. Uma diferença de 6,4x.

• Janela de contexto — 1M tokens para ambos, mas o teto de saída do Claude Opus 5 é 128K contra 64K do Gemini 3.7 Flash.

• Preço de entrada — $0,75 (promocional, até 2026) versus $5,00 — uma diferença de 6,7x.

• Preço de saída — $3,75 (promocional) versus $25,00 — uma diferença de 6,7x.

• Entrada multimodal — O Gemini 3.7 Flash aceita texto, imagem, áudio e vídeo; o Claude Opus 5 aceita apenas texto e imagem.

A comparison scoreboard for Gemini 3.7 Flash and Claude Opus 5: Claude Opus 5 leads 61 to 56 on the AA Index and 128K to 64K on max output, but Gemini 3.7 Flash leads ~340 to ~53 tokens per second, $0.75 to $5.00 input and $3.75 to $25.00 output, with both at 1M context.

Onde o Claude Opus 5 ainda justifica seu preço

O caso do carro-chefe não é nostalgia; é a cauda da distribuição de tarefas. Engenharia autônoma de longo horizonte — um modelo deixado sozinho com uma base de código por uma hora para planejar, editar, testar e iterar — é onde a liderança relatada do Opus 5 é mais ampla, e seus resultados de uso de computador (71 no OSWorld, relatados pelo fornecedor) o colocam em uma classe na qual o Gemini 3.7 Flash não entra. Equipes que estão migrando do Claude Opus 4.8 também devem saber que o Opus 5 vem com pensamento adaptativo ativado por padrão, com níveis de esforço recalibrados, e que desativar o pensamento só é permitido no esforço alto — mudanças comportamentais que podem quebrar pipelines existentes. Nada disso faz dele a escolha errada para trabalho difícil; isso o torna a escolha certa para uma fatia de trabalho mais estreita do que seu preço sugere.

A outra coisa que o Opus 5 vende é a economia de plataforma da Anthrop​ic. Seu cache de prompt pode reduzir o custo efetivo de entrada em até 90% em acertos de cache, e sua camada de lote reduz o preço pela metade no tráfego assíncrono — então uma carga de trabalho com alto cache e alto lote no Opus 5 cobra muito mais próximo da sombra de seu preço de tabela do que os $5 / $25 do título sugerem. O preço real do carro-chefe depende da carga de trabalho; o do cavalo de batalha, não.

Onde Gemini 3.7 Flash é a compra mais inteligente

Para qualquer coisa que faça streaming, processe em lote ou se alimente de contexto longo, o cavalo de batalha não é apenas mais barato — está estruturalmente mais bem posicionado. Uma vantagem de 6,4x na velocidade de saída muda o que você pode construir: completamento interativo de código, sumarização ao vivo de um repositório completo, loops de agente que precisam de muitas chamadas por minuto — todos batem na parede de throughput em um modelo de 53 tokens/s muito antes de baterem na parede de qualidade. O Gemini 3.7 Flash também aceita entrada de áudio e vídeo, o que abre casos de uso (transcrição de reuniões, compreensão de quadros de vídeo) que nenhum modelo Claude faz nesse eixo de entrada. E seu nível de pensamento ajustável permite executá-lo com baixo esforço para trabalho rotineiro barato e com alto esforço para o subconjunto mais difícil, pagando apenas pelo raciocínio que você usa.

O manual de pareamento

Os profissionais na prática deixaram em grande parte de tratar isso como um ou/ou, e o padrão que continua aparecendo é um loop de dividir para conquistar: Claude Opus 5 faz o planejamento e o design, Gemini 3.7 Flash faz a implementação de alto volume, e Opus 5 revisa. Cada modelo é usado onde sua relação qualidade-custo é melhor, e o pipeline combinado é mais barato e mais rápido do que executar qualquer um deles sozinho. Uma camada de roteamento torna esse padrão prático em vez de arquitetural: Claude Opus 5 está ativo no OrcaRouter pelo preço de tabela da Anthrop​ic com margem de 0%, e o DSL de roteamento permite compor uma única chamada que envia o planejador para o Opus 5 e o executor para os modelos da classe Flash por trás de um endpoint compatível com OpenAI — com fusão de modelos como próximo passo, onde ambos os modelos respondem à mesma pergunta e um juiz reconcilia os dois veredictos.

The OrcaRouter model page for Claude Opus 5, showing Anthropic's $5.00 per million input and $25.00 per million output list pricing and a 1M-token context window.

A conta, lado a lado

Coloque números reais nisso. Um dia de 10 milhões de tokens de entrada e 1 milhão de tokens de saída — um pipeline agêntico pesado, mas comum — custa $75 + $375 = $450 na tarifa padrão do Claude Opus 5. O mesmo tráfego na tarifa promocional do Gemini 3.7 Flash custa $7.50 + $37.50 = $45, exatamente um décimo. Mesmo considerando os descontos de cache do Opus no lado da entrada, a diferença é de uma ordem de magnitude, e é por isso que "flash para o volume, opus para a cauda difícil" se tornou a configuração padrão de produção, em vez de algo exótico. Quando a promoção terminar, a tarifa de entrada do Gemini 3.7 Flash dobra para $1.50 — ainda um terço da do Opus, e ainda barata o suficiente para manter a aritmética do emparelhamento intacta.

A leitura honesta

A diferença de cinco pontos é real e está exatamente onde você esperaria: no trabalho mais difícil e de horizonte mais longo. Se sua carga de trabalho é dominada por essa cauda — pesquisa de fronteira, engenharia autônoma de várias horas, uso de computador — o Claude Opus 5 justifica seu preço e você não deve pensar demais nisso. Se sua carga de trabalho é dominada por volume, latência ou contexto longo, o Gemini 3.7 Flash ao preço promocional é a melhor compra por uma ordem de magnitude, e a distância para o modelo topo de linha é um nível de benchmark, não um abismo. Os modelos estão convergindo, e a resposta prática para a maioria das equipes não é mais "qual deles", mas "quais partes do trabalho vão para cada um".

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente