Cartão de destaque gerado, intitulado Claude Sonnet 5.5 É Lançado, com o subtítulo cinco mudanças incompatíveis para código que já está no Claude Sonnet 5, com pílulas exibindo $2 / $10 por milhão sem alteração, Intelligence Index 56 vs 38, e Lançado em 2026-09-28, e um rodapé citando Artificial Analysis v4.3.2 para o Índice e Anthropic para preços e ciclo de vida.
Guides & Insights

Claude Sonnet 5.5 é lançado no Claude e na API — com cinco mudanças que quebram código existente

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O Claude Sonnet 5.5 está disponível. O anúncio do fornecedor é datado de 28 de setembro de 2026, a página de modelos do Claude Platform o lista como “Mais recente”, e o identificador é claude-sonnet-5-5 na Claude API, no Amazon Bedrock, nos consoles de nuvem, no Microsoft Foundry e no Claude Platform on AWS. A disponibilização no próprio Claude e na API é a parte que está acontecendo esta semana. A parte que vai lhe custar um dia está em outro ponto da mesma documentação: cinco alterações que quebram compatibilidade afetam o código que já está sendo executado no Claude Sonnet 5, e uma sexta altera o formato da resposta sem que uma única requisição falhe.

Essa é a forma deste lançamento. A tabela de preços não mudou: o Claude Sonnet 5.5 custa $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, exatamente o que custa o Claude Sonnet 5, com leituras de cache a $0.20 e gravação de cache de cinco minutos a $2.50. A capacidade avançou muito. Na revisão atual da Artificial Analysis, o novo modelo está 18 pontos acima daquele que substitui, a maior diferença entre dois modelos Sonnet consecutivos naquele ranking. O custo de migração é correspondentemente o maior. Nada disso é uma reclamação — um modelo que melhora sem ficar mais caro é o cenário bom —, mas os dois fatos chegam juntos, e as notas de lançamento são a metade que decide se a sua semana será tranquila.

O que realmente foi lançado em 28 de setembro

Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed 'The best combination of speed and intelligence', showing the model ID claude-sonnet-5-5, a 1M-token context window, 128K max output, input pricing of $2 per million tokens and output pricing of $10 per million tokens, and the five breaking changes listed in the overview.

A especificação é uma continuação direta do nível, e não uma nova forma:

• ID do modelo — claude-sonnet-5-5 na Claude API, na Claude Platform on AWS e no Microsoft Foundry; anthropic.claude-sonnet-5-5 no Amazon Bedrock

• Preço — US$ 2 / MTok de entrada, US$ 10 / MTok de saída, US$ 2,50 para gravação em cache de cinco minutos, US$ 4 para gravação em cache de uma hora, US$ 0,20 para leitura de cache

• Batch — 50% de desconto em ambas as direções, portanto $1 / $5 por MTok

• Contexto e saída — 1M tokens de entrada, 128K tokens de saída de forma síncrona, 300K de saída na API Message Batches por trás do output-300k-2026-03-24, cabeçalho beta

• Raciocínio — adaptativo, com esforço padrão alto; datas de corte de conhecimento e treinamento, ambas em junho de 2026

• Ciclo de vida — retenção zero de dados desde o lançamento, e um limite mínimo de desativação publicado não antes de 28 de setembro de 2027

Dois detalhes são fáceis de passar despercebidos e são importantes. Primeiro, não há taxa extra para contexto longo: a Anthropic cobra a janela completa de 1M tokens pela tarifa padrão, portanto uma solicitação de 900.000 tokens custa o mesmo por token que uma de 9.000 tokens. Segundo, a tarifa de US$ 2 / US$ 10 no modelo anterior era originalmente um preço introdutório, com aumento programado para US$ 3 / US$ 15 em 1º de setembro de 2026; a página de preços da Anthropic agora afirma que o aumento não ocorrerá, o que faz com que o preço atual do nível Sonnet seja um compromisso permanente, e não uma promoção. Ambos são declarações do fornecedor, não descobertas independentes.

A lista de migração, na ordem em que vai morder

A visão geral do Sonnet 5.5 da Anthropic é excepcionalmente direta quanto a isso: cinco mudanças que quebram compatibilidade afetam código que já está em execução no Claude Sonnet 5. Elas não são estilísticas. Cada uma retorna um erro ou altera o comportamento silenciosamente.

• O uso forçado de ferramentas é recusado. Um tool_choice de "any", ou de uma ferramenta nomeada, agora retorna um erro em vez de restringir o modelo. Se o seu loop de agente fixa uma ferramenta para garantir uma chamada estruturada, esse loop deixa de funcionar na primeira requisição. A alternativa é deixar o modelo escolher e validar o resultado, ou mover a garantia para as saídas estruturadas.

• thinking: {"type": "disabled"} é recusado. Desativar o raciocínio por completo não é mais uma configuração suportada. A substituição é between_tools, que desativa o raciocínio antecipado e funciona em esforço high ou inferior. É a configuração de raciocínio mais baixa do modelo, não um interruptor de desligamento.

• Os blocos de pensamento estão vinculados ao modelo e à conversa.O raciocínio que um turno anterior produziu é transportado do Claude Sonnet 5 para o Claude Sonnet 5.5, mas não para outra família, e não entre contas. Aplicações que reproduzem uma transcrição entre versões do modelo descobrirão que os blocos de pensamento são rejeitados onde antes eram aceitos.

• computer_20251124 não é aceito na Claude API nem no Google Cloud. O código que declarava a versão anterior da ferramenta de uso do computador precisa migrar para o conjunto de ferramentas atual.

• A ferramenta de aconselhamento rejeita a sua própria família. Claude Opus 4.8, Claude Opus 4.7 e Claude Sonnet 5 são recusados como aconselhadores, pelo que qualquer pipeline que utilizasse um modelo Claude mais pequeno como verificador em comparação com um maior precisa de ser reemparelhado.

Depois, há a mudança que não falha nada. O texto que o modelo emite entre chamadas de ferramentas agora chega dentro de thinking blocos em vez de como saída comum. Um aplicativo que transmite texto para um usuário fica silencioso entre chamadas de ferramentas — sem erro, sem exceção, apenas uma interface que parece travar até que você defina um display valor que retorna o texto, ou mude para between_tools. Este é o modo de falha mais provável de chegar à produção, porque nada em uma suíte de testes lança exceção.

Mais uma, para completar: definir temperature, top_p ou top_k para qualquer valor não padrão retorna um 400. Se seu gateway ou biblioteca de cliente define uma temperatura por hábito em vez de intenção, esse hábito agora é uma indisponibilidade.

A alegação de 30%, contra o número independente

Artificial Analysis model page for Claude Sonnet 5.5 (adaptive reasoning, max effort, default fallback), released September 2026, showing an Intelligence Index of 56 at rank 3 of 216 models, pricing of $2.00 per million input tokens and $10.00 per million output tokens, an average cost of $7.60 per Intelligence Index task, a measured output speed of 142 tokens per second, 410M output tokens generated during the Index evaluation against a median of 88M, and a 1M-token context window.

A frase de marketing da Anthropic para o Claude Sonnet 5.5 é que ele "custa até 30% menos por tarefa do que seu antecessor" a taxas idênticas por token, e que "gera resultados 30%+ mais rápido" do que o Claude Sonnet 5. Ambas são afirmações sobre tokens, e não sobre preços, e ambas são reportadas pelo fornecedor. O mecanismo por trás da primeira é visível na própria tabela de benchmark do fornecedor: no esforço Médio no Terminal-Bench, a Anthropic diz que o Claude Sonnet 5.5 supera a melhor pontuação do Claude Sonnet 5 por "menos de um décimo do custo por tarefa", e faz afirmações semelhantes para o CursorBench no esforço Baixo e para o AA-Briefcase no Médio.

O quadro independente concorda quanto à direção e discorda quanto à magnitude. No Índice de Inteligência v4.3.2 da Artificial Analysis — dez avaliações, executadas em uma única configuração em todos os modelos — Claude Sonnet 5.5 obtém 56 pontos, o que a página coloca na 3ª posição entre 216. O Claude Sonnet 5 obtém 38 no mesmo quadro. São 18 pontos de avanço entre dois modelos consecutivos do mesmo nível, pelo mesmo preço, e é a maior diferença que a Anthropic já abriu dentro da linha Sonnet neste ano.

A cifra de custo é onde a alegação do fornecedor se torna mais difícil de sustentar. A Artificial Analysis mede o Claude Sonnet 5.5 em US$ 7,60 por tarefa concluída do Intelligence Index. Esse número não está 30% abaixo de nada em sua classe, porque o modelo é extremamente prolixo: ele emitiu 410 milhões de tokens de saída para completar as avaliações do Index, contra uma mediana de 88 milhões entre modelos comparáveis. Eficiência por token e eficiência por tarefa são quantidades diferentes, e o Claude Sonnet 5.5 é excepcionalmente bom na primeira e apenas mediano na segunda.

Todos os próprios números de benchmark da Anthropic para este lançamento são relatados pelo fornecedor e não reproduzidos por terceiros, e dois deles trazem notas de rodapé que vale a pena repetir: os números do GDPval-AA v2.1 e do AA-Briefcase v1.1 foram executados pela Artificial Analysis em uma implantação de pré-lançamento que tinha um bug que possivelmente subestimava as pontuações, e a nota da Anthropic sobre seu número do FrontierCode 1.1 explica por que o Claude Sonnet 5.5 pontua mais baixo com esforço Max do que com Xhigh nessa avaliação. Uma tabela em que um modelo supera a si mesmo em uma configuração de esforço mais baixa é uma tabela que lhe diz que sua configuração de benchmark não está definida.

Como testá-lo sem apostar um caminho de produção nisso

Há um motivo específico para executar o Claude Sonnet 5.5 por meio de um roteador em vez de diretamente contra o endpoint do fornecedor em uma migração: você não precisa escolher entre o modelo antigo e o novo enquanto descobre. Na OrcaRouter, o Claude Sonnet 5 é roteável desde 30 de junho pelo preço da própria Anthropic de US$ 2 / US$ 10, sem acréscimo, um entre mais de 200 modelos por trás de um único endpoint compatível com OpenAI, e ainda é o modelo no qual a maior parte do tráfego da API Claude roda. O Claude Sonnet 5.5 ainda não está em nosso catálogo, então a rota para ele hoje é a própria API da Anthropic.

O padrão que funciona enquanto isso é enviar uma fatia do tráfego para o novo modelo e deixar o failover cuidar do resto — com o Claude Sonnet 5 como fallback, de modo que um 400 de uma das cinco mudanças incompatíveis degrade para uma resposta mais lenta em vez de uma requisição falha. Essa também é a forma mais barata de medir aquilo que a alegação do fornecedor não informa: seus próprios tokens por tarefa nos dois modelos na mesma configuração de esforço. O número de 30% é uma média das próprias avaliações da Anthropic; seu tráfego não é essa média.

O que vem a seguir

O anúncio da Anthropic diz que o Claude Haiku 5.5 se junta à família "nas próximas semanas", o que completaria a geração 5.5 no nível pequeno. Até lá, as duas decisões diante de uma equipe que roda o Sonnet em produção são separáveis: a migração é um trabalho de um dia que você pode agendar, e a troca de modelo é uma medição que você pode adiar. Fazer na ordem inversa — trocar primeiro e descobrir o erro de uso forçado de ferramentas em produção — é a versão deste lançamento que custa um fim de semana.

Single-column scoreboard for Claude Sonnet 5.5 with six rows: Released September 28 2026, Model ID claude-sonnet-5-5, Price $2.00 / $10.00 per 1M, Intelligence Index 56 at rank 3 of 216, Cost per Index task $7.60, and Output speed 142 tokens/sec, with a footer reading 'Index, cost per task and speed per Artificial Analysis v4.3.2; pricing and lifecycle per Anthropic.'