
Claude Haiku 5.5: Anthropic diz que o nível mais barato está chegando, semanas depois de um vazamento afirmar que ele estava morto
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
Durante cerca de duas semanas em setembro, a suposição corrente entre as pessoas que acompanham o roadmap do fornecedor era de que o nível mais barato do Claude estava sendo descontinuado. O vazamento — uma postagem no X de uma conta conhecida por alegações sobre o roadmap do fornecedor — dizia que a geração 5.5 reestruturaria a linha: Claude Fable, Claude Opus e Claude Sonnet receberiam todos versões 5.5, Fable passaria para uma nova base de pré-treinamento, e a linha Haiku sairia. A empresa nunca confirmou nada disso. Então, em 22 de setembro de 2026, junto com o lançamento do Claude Opus 5.5, a empresa disse o oposto em uma frase: "Claude Sonnet 5.5 e Claude Haiku 5.5 virão nas próximas semanas." Claude Haiku 5.5 é, portanto, anunciado, sem data e não lançado — e existe especificamente porque o rumor sobre ele estava errado. O pequeno modelo atualmente em produção, Claude Haiku 4.5, ainda é o que você chamaria hoje.
O que segue é o que está de fato estabelecido, o que é inferência e o que ninguém sabe ainda. A distinção importa mais do que o habitual aqui, porque a maior parte do que circula sobre o Haiku 5.5 é extrapolação do nível acima dele.
O que é realmente confirmado, e por quem
O conjunto confirmado é pequeno, e vale a pena mantê-lo pequeno.

• O anúncio — o próprio post de lançamento da Anthropic para o Claude Opus 5.5 afirma: "Claude Sonnet 5.5 e Claude Haiku 5.5 virão nas próximas semanas." Essa é toda a evidência direta. É uma frase no post de lançamento de outra pessoa, não um anúncio do Haiku 5.5.
• O escopo da promessa — o mesmo post diz que os dois modelos trarão "muitas das mesmas melhorias de desempenho, eficiência e segurança" que o Claude Opus 5. Isso é uma lista de categorias, não uma especificação. Nenhum benchmark, nenhum preço, nenhuma janela de contexto, nenhum ID de modelo, nenhuma data.
• A posição na hierarquia — Haiku é o mais rápido e mais barato dos três níveis atuais da Anthropic, abaixo de Sonnet e Opus. Isso é verdade desde que a linha foi introduzida e não está em disputa.
• O cronograma — "as próximas semanas", que situa a chegada plausível mais precoce no final de setembro ou outubro de 2026 e não diz nada sobre a mais tardia.
Todo o resto em circulação é ou as alegações do vazador, que a Anthropic não endossou e que o anúncio contradiz no ponto central, ou inferência extraída do Claude Opus 5.5. Trate ambos como não verificados.

O boato, especificamente, e por que era plausível
A alegação de saída não era estúpida. Tinha uma base real, e entendê-la revela algo sobre como o tier pequeno da Anthropic tem sido tratado.
O Claude Haiku 4.5 foi lançado em 15 de outubro de 2025, a US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de tokens de saída, com uma janela de contexto de 200K tokens e um limite de saída de 64K. Era o modelo mais rápido da linha e, de longe, o mais barato, e foi posicionado como equivalente a uma geração mais antiga do Sonnet em tarefas de codificação e de agentes por cerca de um terço do custo.
Então o nível ficou quieto. Entre o Haiku 4.5, em outubro de 2025, e o lançamento do Opus 5.5, em setembro de 2026 — onze meses —, todos os outros níveis do Claude avançaram pelo menos duas vezes. O Opus passou por 4.5, 4.6, 4.7, 4.8, 5, 5.5. O Sonnet passou por 4.5, 4.6, 5. O Fable chegou como um nível superior totalmente novo. O Haiku não avançou nada. Nesse mesmo período, o compromisso de descontinuação da Anthropic para o Haiku 4.5 passou para "não antes de 15 de outubro de 2026" — uma data que, no momento em que escrevo, está a cerca de três semanas de distância.
Um intervalo de onze meses numa categoria que costumava ser renovada mais ou menos a cada seis meses, somado a um prazo de descontinuação se esgotando, é exatamente o formato que uma linha de produtos assume ao sair de cena. Foi o que o vazamento dava a entender. Era uma leitura razoável. Também estava errada, e a correção veio do fornecedor, e não de um segundo vazador.
O que o Haiku 5.5 quase certamente herdará do Claude Opus 5.5
Esta seção é inferência. Ela é rotulada como tal porque a Anthropic não confirmou nada disso e porque a analogia com o nível acima é a única fonte de sinal disponível.
A promessa da Anthropic de "muitas das mesmas melhorias" fornece uma lista inicial. O Claude Opus 5.5 chegou com quatro propriedades que um leitor pode verificar em relação ao atual modelo pequeno:
• Direção do preço — Claude Opus 5.5 custa US$ 4 de entrada / US$ 20 de saída por milhão, abaixo dos US$ 5 / US$ 25 do Claude Opus 5, com leituras de cache reduzidas de US$ 0,50 para US$ 0,20. Um corte de 20% no carro-chefe torna plausível um corte correspondente na camada menor. Não é um compromisso, e nada no anúncio diz isso.
• Pensamento adaptativo — Claude Opus 5.5 não aceita thinking: {"type": "disabled"} nem um valor fixo de budget_tokens; ambos retornam um 400. O pensamento está sempre ativado e o esforço é o controle. Claude Haiku 4.5 hoje é o oposto: ele usa o formato manual mais antigo {"type": "enabled", "budget_tokens": N} e não tem nenhum parâmetro de esforço.
• Janela de contexto — Claude Opus 5.5 mantém um contexto de 1M de tokens com saída máxima de 128K. Claude Haiku 4.5 tem 200K com 64K de saída. Um salto para 1M é o maior fator isolado que mudaria para que serve o nível pequeno, e também é o que ninguém deveria presumir.
• Salvaguardas — Claude Opus 5.5 pode retornar um recusa motivo de parada em um conjunto mais amplo de categorias, com solicitações de biologia encaminhadas para Claude Opus 5 e a maioria das solicitações de cibersegurança para Claude Opus 4.8. Não se sabe se o nível pequeno herda os mesmos classificadores, ou um conjunto mais leve.
Se você está planejando uma migração partindo do pressuposto de que o Haiku 5.5 é um Claude Opus 5.5 mais barato com uma janela de contexto menor, você está planejando com base em uma analogia. A analogia é a melhor disponível, e não é evidência.
Por que a categoria importa mais do que o flagship
Os lançamentos de ponta recebem a cobertura e os modelos pequenos recebem o tráfego, o que é um descompasso que vale a pena nomear.
Claude Haiku 4.5 é o que roda nos locais onde uma chamada de modelo acontece centenas de milhares de vezes por dia e o preço por token é toda a decisão de produto: classificação, extração, roteamento, sumarização, a primeira passagem barata em uma cascata, o subagente que lê arquivos para que o modelo caro não precise fazer isso. O próprio enquadramento da Anthropic para ele é o modelo mais rápido com inteligência quase de fronteira, e o perfil de latência confirma isso — medições independentes o colocam em cerca de 86 tokens de saída por segundo com um tempo até o primeiro token de 0,65 segundo, mais rápido em ambos os aspectos do que o modelo mediano sem raciocínio em sua faixa de preço.
Em contrapartida, o Haiku 4.5 não é um modelo de fronteira e não finge ser. Sua pontuação independente no Artificial Analysis Intelligence Index é 15, classificada em 28º lugar entre os 61 modelos desse ranking e sinalizada como estimada. Esse é o número que torna a atualização 5.5 interessante em vez de rotineira: se a categoria dos modelos menores absorver algo como o salto de capacidade que o Claude Opus 5.5 deu, ela desloca o piso de preço-desempenho para trabalhos de alto volume, e muitos pipelines de produção são construídos exatamente sobre esse piso.
A questão prática para um leitor hoje não é se deve esperar. É quanto custa a espera. Se você está construindo sobre o Haiku 4.5, o intervalo de onze meses já é a resposta para se esse nível é estável o bastante para se depender dele — o fornecedor acabou de lhe dizer que é. Se você está adiando uma migração para o Haiku 5.5, está adiando-a por um modelo sem data definida e sem especificação publicada, o que é uma posição pior do que lançar com o que já existe e migrar quando o novo for lançado.
Executando a camada pequena que você tem, ao lado das que estão acima dela.

A razão pela qual uma atualização do Haiku vale a pena acompanhar da perspetiva do roteamento, e não da perspetiva da revisão de modelo, é que a decisão interessante raramente é qual modelo usar — é qual modelo usar para cada chamada. Uma cascata que envia os 80% fáceis para um modelo pequeno e escala o restante é a jogada padrão de custos, e só funciona se ambos os níveis forem acessíveis a partir do mesmo lugar com as mesmas credenciais.
O Claude Haiku 4.5 já está no OrcaRouter pelo preço de tabela da Anthropic, e o mesmo vale para o Claude Opus 5 e o Claude Sonnet 5 — uma única chave de API para os três, com 0% de markup, ou seja, o preço de tabela do provedor é repassado sem acréscimo. Quando um fornecedor corta um preço, esse corte entra em vigor do nosso lado no mesmo dia, o que importa mais na camada que você chama um milhão de vezes do que na que você chama cem. Especificamente para a cascata, a DSL de roteamento permite compor as camadas em uma única chamada, de modo que a lógica de escalonamento fique na rota e não na sua aplicação, e o failover automático significa que uma tarde ruim de um provedor não derruba o pipeline junto com ela.
Duas ressalvas honestas. O próprio Claude Opus 5.5 não está no OrcaRouter — o nível mais recente nem sempre é a rota mais recente, e preferimos dizer isso a dar a entender o contrário. E nada relacionado ao Haiku 5.5 pode ser roteado, porque ele ainda não existe. Os modelos que podem ser chamados hoje são os listados acima.
O que observar, em ordem
Quando o Haiku 5.5 chegar, quatro fatos resolverão quase todas as questões em aberto, e eles chegarão em uma ordem previsível.
• O ID do modelo e a janela de contexto, da página de visão geral de modelos da Anthropic — um ID sem data no formato claude-haiku-5-5 corresponderia à convenção da geração 4.6 em diante, e uma janela de 1M de tokens seria o destaque.
• A tabela de preços. A razão de existir do nível é o seu preço. Um número acima de $1/$5 seria um reposicionamento; um número igual ou inferior seria uma melhoria direta.
• Se o raciocínio é apenas adaptativo. Se o Haiku 5.5 rejeitar budget_tokens da mesma forma que o Claude Opus 5.5, isso é uma mudança disruptiva para todas as integrações que atualmente o definem, e é o tipo de coisa que só aparece quando você executa.
• Pontuações independentes. Os benchmarks dos fornecedores desse nível têm sido historicamente generosos em relação ao que os órgãos independentes medem, portanto, a primeira colocação da Artificial Analysis vale mais do que a tabela de lançamento.
Até que esses existam, a afirmação precisa é a entediante: a Anthropic disse que o Claude Haiku 5.5 chegará nas próximas semanas, não disse o que ele é, e o vazamento que dizia que ele foi cancelado estava errado. Essa última parte é a notícia. Todo o resto é um cronograma.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
