Cartão de título principal para Claude Haiku 5.5 com o título 'A Anthropic diz que o nível mais barato está chegando', com três selos em formato de pílula com os textos 'anunciado, sem data', 'não lançado' e 'sem especificações publicadas', uma linha de rodapé citando o post de lançamento do Opus 5.5 da Anthropic, de 22 de setembro de 2026, e o logotipo da OrcaRouter no canto inferior direito.
Guides & Insights

Claude Haiku 5.5: Anthropic diz que o nível mais barato está chegando, semanas depois de um vazamento afirmar que ele estava morto

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Durante cerca de duas semanas em setembro, a suposição corrente entre as pessoas que acompanham o roadmap do fornecedor era de que o nível mais barato do Claude estava sendo descontinuado. O vazamento — uma postagem no X de uma conta conhecida por alegações sobre o roadmap do fornecedor — dizia que a geração 5.5 reestruturaria a linha: Claude Fable, Claude Opus e Claude Sonnet receberiam todos versões 5.5, Fable passaria para uma nova base de pré-treinamento, e a linha Haiku sairia. A empresa nunca confirmou nada disso. Então, em 22 de setembro de 2026, junto com o lançamento do Claude Opus 5.5, a empresa disse o oposto em uma frase: "Claude Sonnet 5.5 e Claude Haiku 5.5 virão nas próximas semanas." Claude Haiku 5.5 é, portanto, anunciado, sem data e não lançado — e existe especificamente porque o rumor sobre ele estava errado. O pequeno modelo atualmente em produção, Claude Haiku 4.5, ainda é o que você chamaria hoje.

O que segue é o que está de fato estabelecido, o que é inferência e o que ninguém sabe ainda. A distinção importa mais do que o habitual aqui, porque a maior parte do que circula sobre o Haiku 5.5 é extrapolação do nível acima dele.

O que é realmente confirmado, e por quem

O conjunto confirmado é pequeno, e vale a pena mantê-lo pequeno.

A single-column scoreboard for Claude Haiku 5.5 with six rows reading 'Status: announced, undated', "Release window: 'coming weeks'", 'Price: not announced', 'Context window: not announced', 'Model ID: not announced' and 'Predecessor: Claude Haiku 4.5 at $1 / $5', with a footer noting the announcement came from Anthropic on 2026-09-22 with no specifications published.

• O anúncio — o próprio post de lançamento da Anthropic para o Claude Opus 5.5 afirma: "Claude Sonnet 5.5 e Claude Haiku 5.5 virão nas próximas semanas." Essa é toda a evidência direta. É uma frase no post de lançamento de outra pessoa, não um anúncio do Haiku 5.5.

• O escopo da promessa — o mesmo post diz que os dois modelos trarão "muitas das mesmas melhorias de desempenho, eficiência e segurança" que o Claude Opus 5. Isso é uma lista de categorias, não uma especificação. Nenhum benchmark, nenhum preço, nenhuma janela de contexto, nenhum ID de modelo, nenhuma data.

• A posição na hierarquia — Haiku é o mais rápido e mais barato dos três níveis atuais da Anthropic, abaixo de Sonnet e Opus. Isso é verdade desde que a linha foi introduzida e não está em disputa.

• O cronograma — "as próximas semanas", que situa a chegada plausível mais precoce no final de setembro ou outubro de 2026 e não diz nada sobre a mais tardia.

Todo o resto em circulação é ou as alegações do vazador, que a Anthropic não endossou e que o anúncio contradiz no ponto central, ou inferência extraída do Claude Opus 5.5. Trate ambos como não verificados.

Screenshot of Anthropic's Claude Platform model overview page, showing the Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 and Claude Haiku 4.5 comparison table alongside the line 'Claude Sonnet 5.5 and Claude Haiku 5.5 will follow in the coming weeks.'

O boato, especificamente, e por que era plausível

A alegação de saída não era estúpida. Tinha uma base real, e entendê-la revela algo sobre como o tier pequeno da Anthropic tem sido tratado.

O Claude Haiku 4.5 foi lançado em 15 de outubro de 2025, a US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de tokens de saída, com uma janela de contexto de 200K tokens e um limite de saída de 64K. Era o modelo mais rápido da linha e, de longe, o mais barato, e foi posicionado como equivalente a uma geração mais antiga do Sonnet em tarefas de codificação e de agentes por cerca de um terço do custo.

Então o nível ficou quieto. Entre o Haiku 4.5, em outubro de 2025, e o lançamento do Opus 5.5, em setembro de 2026 — onze meses —, todos os outros níveis do Claude avançaram pelo menos duas vezes. O Opus passou por 4.5, 4.6, 4.7, 4.8, 5, 5.5. O Sonnet passou por 4.5, 4.6, 5. O Fable chegou como um nível superior totalmente novo. O Haiku não avançou nada. Nesse mesmo período, o compromisso de descontinuação da Anthropic para o Haiku 4.5 passou para "não antes de 15 de outubro de 2026" — uma data que, no momento em que escrevo, está a cerca de três semanas de distância.

Um intervalo de onze meses numa categoria que costumava ser renovada mais ou menos a cada seis meses, somado a um prazo de descontinuação se esgotando, é exatamente o formato que uma linha de produtos assume ao sair de cena. Foi o que o vazamento dava a entender. Era uma leitura razoável. Também estava errada, e a correção veio do fornecedor, e não de um segundo vazador.

O que o Haiku 5.5 quase certamente herdará do Claude Opus 5.5

Esta seção é inferência. Ela é rotulada como tal porque a Anthropic não confirmou nada disso e porque a analogia com o nível acima é a única fonte de sinal disponível.

A promessa da Anthropic de "muitas das mesmas melhorias" fornece uma lista inicial. O Claude Opus 5.5 chegou com quatro propriedades que um leitor pode verificar em relação ao atual modelo pequeno:

• Direção do preço — Claude Opus 5.5 custa US$ 4 de entrada / US$ 20 de saída por milhão, abaixo dos US$ 5 / US$ 25 do Claude Opus 5, com leituras de cache reduzidas de US$ 0,50 para US$ 0,20. Um corte de 20% no carro-chefe torna plausível um corte correspondente na camada menor. Não é um compromisso, e nada no anúncio diz isso.

• Pensamento adaptativo — Claude Opus 5.5 não aceita thinking: {"type": "disabled"} nem um valor fixo de budget_tokens; ambos retornam um 400. O pensamento está sempre ativado e o esforço é o controle. Claude Haiku 4.5 hoje é o oposto: ele usa o formato manual mais antigo {"type": "enabled", "budget_tokens": N} e não tem nenhum parâmetro de esforço.

• Janela de contexto — Claude Opus 5.5 mantém um contexto de 1M de tokens com saída máxima de 128K. Claude Haiku 4.5 tem 200K com 64K de saída. Um salto para 1M é o maior fator isolado que mudaria para que serve o nível pequeno, e também é o que ninguém deveria presumir.

• Salvaguardas — Claude Opus 5.5 pode retornar um recusa motivo de parada em um conjunto mais amplo de categorias, com solicitações de biologia encaminhadas para Claude Opus 5 e a maioria das solicitações de cibersegurança para Claude Opus 4.8. Não se sabe se o nível pequeno herda os mesmos classificadores, ou um conjunto mais leve.

Se você está planejando uma migração partindo do pressuposto de que o Haiku 5.5 é um Claude Opus 5.5 mais barato com uma janela de contexto menor, você está planejando com base em uma analogia. A analogia é a melhor disponível, e não é evidência.

Por que a categoria importa mais do que o flagship

Os lançamentos de ponta recebem a cobertura e os modelos pequenos recebem o tráfego, o que é um descompasso que vale a pena nomear.

Claude Haiku 4.5 é o que roda nos locais onde uma chamada de modelo acontece centenas de milhares de vezes por dia e o preço por token é toda a decisão de produto: classificação, extração, roteamento, sumarização, a primeira passagem barata em uma cascata, o subagente que lê arquivos para que o modelo caro não precise fazer isso. O próprio enquadramento da Anthropic para ele é o modelo mais rápido com inteligência quase de fronteira, e o perfil de latência confirma isso — medições independentes o colocam em cerca de 86 tokens de saída por segundo com um tempo até o primeiro token de 0,65 segundo, mais rápido em ambos os aspectos do que o modelo mediano sem raciocínio em sua faixa de preço.

Em contrapartida, o Haiku 4.5 não é um modelo de fronteira e não finge ser. Sua pontuação independente no Artificial Analysis Intelligence Index é 15, classificada em 28º lugar entre os 61 modelos desse ranking e sinalizada como estimada. Esse é o número que torna a atualização 5.5 interessante em vez de rotineira: se a categoria dos modelos menores absorver algo como o salto de capacidade que o Claude Opus 5.5 deu, ela desloca o piso de preço-desempenho para trabalhos de alto volume, e muitos pipelines de produção são construídos exatamente sobre esse piso.

A questão prática para um leitor hoje não é se deve esperar. É quanto custa a espera. Se você está construindo sobre o Haiku 4.5, o intervalo de onze meses já é a resposta para se esse nível é estável o bastante para se depender dele — o fornecedor acabou de lhe dizer que é. Se você está adiando uma migração para o Haiku 5.5, está adiando-a por um modelo sem data definida e sem especificação publicada, o que é uma posição pior do que lançar com o que já existe e migrar quando o novo for lançado.

Executando a camada pequena que você tem, ao lado das que estão acima dela.

Screenshot of the OrcaRouter model page for Claude Haiku 4.5 (anthropic/claude-haiku-4.5), showing the model header, the attribution 'by Anthropic - 2025-10-15', pricing of $1.00 per million input tokens and $5.00 per million output tokens, and a 200K context window.

A razão pela qual uma atualização do Haiku vale a pena acompanhar da perspetiva do roteamento, e não da perspetiva da revisão de modelo, é que a decisão interessante raramente é qual modelo usar — é qual modelo usar para cada chamada. Uma cascata que envia os 80% fáceis para um modelo pequeno e escala o restante é a jogada padrão de custos, e só funciona se ambos os níveis forem acessíveis a partir do mesmo lugar com as mesmas credenciais.

O Claude Haiku 4.5 já está no OrcaRouter pelo preço de tabela da Anthropic, e o mesmo vale para o Claude Opus 5 e o Claude Sonnet 5 — uma única chave de API para os três, com 0% de markup, ou seja, o preço de tabela do provedor é repassado sem acréscimo. Quando um fornecedor corta um preço, esse corte entra em vigor do nosso lado no mesmo dia, o que importa mais na camada que você chama um milhão de vezes do que na que você chama cem. Especificamente para a cascata, a DSL de roteamento permite compor as camadas em uma única chamada, de modo que a lógica de escalonamento fique na rota e não na sua aplicação, e o failover automático significa que uma tarde ruim de um provedor não derruba o pipeline junto com ela.

Duas ressalvas honestas. O próprio Claude Opus 5.5 não está no OrcaRouter — o nível mais recente nem sempre é a rota mais recente, e preferimos dizer isso a dar a entender o contrário. E nada relacionado ao Haiku 5.5 pode ser roteado, porque ele ainda não existe. Os modelos que podem ser chamados hoje são os listados acima.

O que observar, em ordem

Quando o Haiku 5.5 chegar, quatro fatos resolverão quase todas as questões em aberto, e eles chegarão em uma ordem previsível.

• O ID do modelo e a janela de contexto, da página de visão geral de modelos da Anthropic — um ID sem data no formato claude-haiku-5-5 corresponderia à convenção da geração 4.6 em diante, e uma janela de 1M de tokens seria o destaque.

• A tabela de preços. A razão de existir do nível é o seu preço. Um número acima de $1/$5 seria um reposicionamento; um número igual ou inferior seria uma melhoria direta.

• Se o raciocínio é apenas adaptativo. Se o Haiku 5.5 rejeitar budget_tokens da mesma forma que o Claude Opus 5.5, isso é uma mudança disruptiva para todas as integrações que atualmente o definem, e é o tipo de coisa que só aparece quando você executa.

• Pontuações independentes. Os benchmarks dos fornecedores desse nível têm sido historicamente generosos em relação ao que os órgãos independentes medem, portanto, a primeira colocação da Artificial Analysis vale mais do que a tabela de lançamento.

Até que esses existam, a afirmação precisa é a entediante: a Anthropic disse que o Claude Haiku 5.5 chegará nas próximas semanas, não disse o que ele é, e o vazamento que dizia que ele foi cancelado estava errado. Essa última parte é a notícia. Todo o resto é um cronograma.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente