
Claude Haiku 5.5 vs Gemini 3.8 Flash: Dois pontos de índice, seis vezes o custo por tarefa
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
Claude Haiku 5.5 e Gemini 3.8 Flashestão mais próximos em capacidade medida do que qualquer outro par nesta faixa de preço — 43,40 contra 40,93 no Artificial Analysis Intelligence Index v4.3.2, e ambos figuram entre os cinquenta primeiros de um ranking de 225 modelos. O que os separa é quanto custa um desses pontos do índice. Na mesma medição independente, uma tarefa concluída do Intelligence Index custa US$ 0,21 no Claude Haiku 5.5 e US$ 1,24 no Gemini 3.8 Flash.
Isso representa uma diferença de seis vezes para uma diferença de dois pontos e meio na pontuação, e é esse número que deveria decidir esta comparação. Todo o resto — as tarifas de tabela, a lista de modalidades, os prazos atrelados ao preço do Google — é uma discussão sobre as margens.
Ambos os modelos, nos números que importam
Por milhão de tokens em dólares americanos, segundo a documentação de preços da própria Anthropic e do Google, com as medições independentes atribuídas à Artificial Analysis. Armazenado em cache em 2026-10-08.

• Entrada — Claude Haiku 5.5 $0,10 até 100.000 tokens e $0,50 acima; Gemini 3.8 Flash $0,75 fixo, subindo para $1,50 em 1º de janeiro de 2027.
• Saída — Claude Haiku 5.5 US$ 0,50 por até 100.000 tokens e US$ 2,50 acima disso; Gemini 3.8 Flash US$ 3,75 fixo, subindo para US$ 7,50 na mesma data.
• Entrada em cache — Claude Haiku 5.5 $0.01 e $0.05; Gemini 3.8 Flash $0.075, além de uma cobrança de armazenamento de $0.50 por milhão de tokens por hora.
• Contexto — 1M de tokens para ambos. Saída máxima — 128.000 tokens para o Claude Haiku 5.5 contra 65.536 para o Gemini 3.8 Flash.
• Modalidade de entrada — texto e imagens para Claude Haiku 5.5; texto, imagens, fala e vídeo para Gemini 3.8 Flash. Esta é a única linha em que a lista do Google é estritamente mais longa.
• Pontuação independente — 43,40 para Claude Haiku 5.5 (Max) contra 40,93 para Gemini 3.8 Flash (High), no Intelligence Index v4.3.2.
• Custo independente por tarefa — $0,21 contra $1,24 no mesmo quadro.
• Velocidade — 241,9 tokens de saída por segundo contra 125,2, ambos medidos pela Artificial Analysis.
De onde vem o número seis vezes maior
A diferença de custo por tarefa é maior do que a diferença de preço de etiqueta, e é aí que está o interessante, porque significa que a tabela de preços por si só não a explica.
A aritmética da etiqueta de preço é simples o bastante: $0,10 contra $0,75 na entrada é sete vezes e meia mais barato, e $0,50 contra $3,75 na saída tem a mesma proporção. Se ambos os modelos gerassem os mesmos tokens para o mesmo trabalho, essa proporção se refletiria diretamente na fatura.
Isso não se transfere, e ambos os efeitos favorecem a Google. O Claude Haiku 5.5 é verboso de uma forma que o próprio fornecedor reconhece: a Artificial Analysis registou 440 milhões de tokens de saída ao executar o Index, contra uma mediana de 100 milhões, e considera o modelo muito verboso. O Gemini 3.8 Flash gerou 170 milhões contra uma mediana de 81 milhões — também assinalado como verboso, mas com um terço da contagem de tokens. A documentação da própria Anthropic acrescenta o segundo efeito: o Claude Haiku 5.5 usa o tokenizador mais recente, partilhado com o Claude 4.7 e posteriores, pelo que o mesmo texto conta como cerca de 30% mais tokens do que no modelo que substitui.
Juntando tudo, a versão honesta da alegação de preço é esta: uma vantagem de dez para um na tarifa de entrada e uma vantagem de sete e meio para um na tarifa de saída, parcialmente consumida por um modelo que escreve mais tokens por resposta, chegando a uma vantagem de seis para um na medida que cobra pelo trabalho inteiro. Ainda é uma lavada, e menor do que a tabela de preços sugere.
O preço do Google tem uma data.
A coisa mais útil na página de preços do Google é uma frase que a maioria das tabelas comparativas omite.
O Gemini 3.8 Flash está listado a US$ 0,75 para entrada e US$ 3,75 para saída, "até 31 de dezembro de 2026", e a US$ 1,50 e US$ 7,50, "a partir de 1º de janeiro de 2027". A entrada em cache passa de US$ 0,075 para US$ 0,15 na mesma data. Essa é uma tarifa introdutória com uma data de expiração impressa ao lado, cerca de onze semanas a contar do momento em que isto foi escrito.
Nada na ficha da Anthropic diz isso. As tarifas do Claude Haiku 5.5 são declaradas como tarifas, com uma estrutura de dois níveis atrelada ao comprimento do prompt, e não a um calendário, e um compromisso de descontinuação não antes de 7 de outubro de 2027. Se você está modelando um pipeline que se estende até o próximo ano, o passo de janeiro do Google é uma duplicação e pertence ao modelo; o da Anthropic não tem um evento equivalente para planejar.
Isso vale nos dois sentidos, e a leitura justa não é “um fornecedor é honesto e o outro não”. Um preço promocional é um preço real enquanto durar, e a Google tem o direito de definir o preço de um lançamento dessa forma. É simplesmente um fato da comparação que o lado aparentemente mais barato nos números de janeiro é o que tem prazo.

Quanto valem dois pontos do índice?
Uma diferença de 2,47 pontos num índice que vai até os sessenta não é erro de arredondamento, nem é um abismo. Os dois modelos ficam na mesma faixa de funcionamento, e a questão prática é se essa diferença aparece nas tarefas que você realmente executa.
Segundo os próprios números dos fornecedores, os dois não são medidos na mesma bancada de testes, então não podem ser comparados diretamente — a Anthropic publica resultados de GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 e FrontierCode para o Claude Haiku 5.5, e o Google publica seu próprio conjunto para o Gemini 3.8 Flash, e nenhum dos fornecedores executou a suíte do outro. A única comparação em pé de igualdade disponível é o ranking independente, e lá a resposta é que a Anthropic está à frente por uma margem mensurável, mas pequena.
A diferença de capacidade que importará mais para algumas equipes está na linha de modalidade. O Gemini 3.8 Flash aceita entrada de fala e vídeo; o Claude Haiku 5.5 aceita texto e imagens. Um pipeline que ingere gravações de chamadas ou captura de tela nativamente não está escolhendo entre esses dois modelos com base no preço de forma alguma — um deles não consegue fazer o trabalho sem uma etapa de transcrição ou extração de quadros à sua frente, e essa etapa tem seu próprio custo e seus próprios modos de falha.
Operando o lado mais barato do par
O Gemini 3.8 Flash está no catálogo do OrcaRouter ao preço de tabela da Google, com 0% de margem, o que aqui importa mais do que o habitual: a tarifa do fornecedor é repassada em vez de diluída, por isso, se quiser ver o que a subida de janeiro faz realmente à fatura, o número mexe-se quando o da Google se mexer. O Claude Sonnet 5.5 e o Claude Opus 5.5 também estão no catálogo, o que transforma um teste de encaminhamento a três vias — a via Flash da Google, um nível intermédio da Anthropic e, mais tarde, um nível pequeno da Anthropic — numa configuração em vez de num projeto. Uma chave, um SDK, failover automático por baixo, e a DSL de encaminhamento, se preferir expressar a escalada na rota em vez de no código da aplicação.
Claude Haiku 5.5 em si ainda não está no catálogo, e é melhor dizer isso do que deixar ambíguo. A vertente da Anthropic desta comparação está atualmente acessível apenas na Anthropic, enquanto a vertente do Google pode ser chamada a partir de nós hoje pelo preço mostrado acima.

Qual deles, e para quem?
Se o seu trabalho é texto que entra e texto que sai, seus prompts ficam abaixo de 100.000 tokens e você está pagando por token em volume real, o Claude Haiku 5.5 é o modelo mais barato por todas as métricas deste artigo e o de maior pontuação no único ranking compartilhado — com a ressalva de que a vantagem é de seis vezes no custo por tarefa, e não de dez vezes como o preço de tabela sugere.
Se você precisa de entrada de áudio ou vídeo, ou precisa de uma resposta com mais de 65K, ou se seus prompts costumam ser longos, o cálculo muda: o Gemini 3.8 Flash aceita entradas que o nível pequeno da Anthropic não aceita, e, acima de 100.000 tokens, o próprio segundo nível da Anthropic tem um preço bem acima da tarifa fixa do Google.
A única coisa a que se agarrar são as datas. A tarifa da Google é válida até ao final do ano e duplica depois disso. A da Anthropic é apresentada como fixa, com um escalão de comprimento. Independentemente do lado em que se enquadrar, construa o calendário na folha de cálculo antes de construir o pipeline.
