Um cartão de título para Claude Sonnet 5.5 no Claude Code encabeçado por 'Claude Sonnet 5.5 no Claude Code', com o subtítulo 'Mesmo modelo, dois provedores, dois padrões' e a linha de legenda 'Esforço padrão: alto na API do Claude, médio no Claude Code.', com três cartões exibindo v2.1.284, 28 de setembro de 2026, $2 / $10 por 1M de tokens, e 'o alias sonnet mudou em um provedor'.
Guides & Insights

Claude Sonnet 5.5 no Claude Code: O alias mudou em um provedor, e o padrão desceu

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O briefing de terceiros que colocou Claude Sonnet 5.5 de volta no radar esta semana dizia que ele está "disponível em todos os lugares, incluindo a Plataforma e o Claude Code". A primeira metade é a própria declaração do fornecedor de 28 de setembro, e confere: Claude Sonnet 5.5 foi lançado na Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud e Microsoft Foundry por $2 e $10 por milhão de tokens, inalterado em relação a Claude Sonnet 5. A segunda metade só é verdadeira se "Claude Code" significar um único provedor. A versão do Claude Code que chegou na mesma tarde, v2.1.284, aponta o alias sonnet para Claude Sonnet 5.5 na API da Anthropic — e o deixa apontando para Claude Sonnet 4.6 no Claude Platform on AWS e Claude Sonnet 4.5 no Amazon Bedrock e no Google Cloud. Execute /model sonnet contra uma implantação do Bedrock e você não obtém o novo modelo. Há uma segunda coisa que mudou, e quase ninguém a registrou: na Claude API, Claude Sonnet 5.5 começa no nível alto de esforço; no Claude Code, começa no nível médio. Ambos os fatos estão documentados, ambos são cruciais para qualquer pessoa que esteja decidindo se deve trocar esta semana, e ambos estão por baixo da mesma frase sobre o modelo estar disponível em todos os lugares.

O que a v2.1.284 realmente mudou

A entrada do changelog do Claude Code tem apenas uma linha, e a metade importante dela é um qualificador: "Adicionado o Claude Sonnet 5.5 (claude-sonnet-5-5), agora o modelo Sonnet padrão na API da Ant​hropic — contexto de 1M, US$ 2/US$ 10 por Mtok, com US$ 0,20/Mtok para leituras de cache." Essa build foi publicada no npm em 28 de setembro às 17:11 UTC, ou seja, é a data de lançamento com um carimbo de data e hora, e não um número de versão. A documentação de configuração de modelos traz a tabela de resolução que o changelog não traz.

• sonnet alias — Claude Sonnet 5.5 na API da Anthropic; Claude Sonnet 4.6 na Claude Platform na AWS; Claude Sonnet 4.5 no Amazon Bedrock e na Agent Platform do Google Cloud; Claude Sonnet 4.5 no Microsoft Foundry.

• opus alias — Claude Opus 5.5 na API da Ant​hropic, Claude Platform na AWS, Amazon Bedrock e Goo​gle Cloud; Claude Opus 4.6 no Microsoft Foundry.

• padrãoModelo Claude Opus 5.5 no Pro, Max, Team, Enterprise e na API da Ant​hropic, e Claude Sonnet 4.5 no Microsoft Foundry. É o Opus 5.5 desde a v2.1.280, em 22 de setembro; antes disso, era o Claude Sonnet 5 no Pro e no Team Standard.

• sonnet[1m] — sem efeito quando sonnet já é resolvido para Claude Sonnet 5.5 ou Claude Sonnet 5, porque ambos possuem uma janela nativa de 1M de tokens. O sufixo não é a forma de obter contexto longo neste modelo; o modelo já o tem.

Leia a primeira e a terceira linhas em conjunto e a consequência prática é restrita, mas incisiva. Na API Ant​hropic, atualizar o Claude Code é a migração inteira — sonnet é movido para você. No Bedrock, no Goo​gle Cloud e na Claude Platform on AWS, o modelo é servido, mas o alias não é movido, e a documentação é explícita sobre a solução alternativa: quando um alias resolve para um modelo mais antigo, os modelos mais recentes podem ser alcançados nomeando-os por extenso ou definindo ANTHROPIC_DEFAULT_SONNET_MODEL. Portanto, "Sonnet 5.5 está disponível no Claude Code" é uma frase sobre um padrão, e os padrões são definidos por provedor.

O esforço padrão é um degrau diferente em cada superfície.

Esta é a parte que altera sua fatura em vez da string do modelo, e está dividida entre duas páginas que não fazem referência cruzada entre si. A documentação de esforço da API Claude afirma que Claude Sonnet 5.5 oferece suporte a todos os cinco níveis e que high é o padrão ali. A página de configuração de modelo do Claude Code declara a ordem de resolução para uma sessão — uma escolha explícita (a variável CLAUDE_CODE_EFFORT_LEVEL, --effort, ou /effort), depois suas configurações salvas, depois o padrão do próprio modelo — e então apresenta esse padrão de modelo como: "high em todos os modelos que oferecem suporte a esforço, exceto que Opus 5.5 e Sonnet 5.5 usam medium por padrão, Opus 4.7 usa xhigh por padrão."

Dois padrões, um modelo, separados por um degrau. No índice independente, esse degrau vale cerca de seis pontos de inteligência e aproximadamente 84% mais dinheiro por tarefa concluída. A própria orientação da Anthropic para Claude Sonnet 5.5 — comece em high, a menos que a carga de trabalho seja agêntica ou sensível à latência, e comece em medium para codificação agêntica e uso de ferramentas em várias etapas — foi escrita para a superfície da API, onde high é o que você obtém sem fazer nada. O Claude Code já tomou essa decisão por você na direção oposta.

Se ele tomou a decisão certa depende genuinamente da carga de trabalho, e o argumento do fornecedor em favor de médio é defensável: os níveis de esforço do modelo são explicitamente recalibrados em relação ao Claude Sonnet 5, e a nota de migração diz para executar novamente uma varredura de esforço em vez de transferir uma configuração. Mas "recalibrado" corta para os dois lados, e é na próxima seção que isso se concretiza.

The Claude Code model-configuration documentation page, showing the per-provider resolution table: the sonnet alias resolves to Claude Sonnet 5.5 on the Anthropic API, Claude Sonnet 4.6 on Claude Platform on AWS, and Claude Sonnet 4.5 on Amazon Bedrock and Google Cloud's Agent Platform; the opus alias resolves to Claude Opus 5.5 on the first four providers and Claude Opus 4.6 on Microsoft Foundry.

O que custa a escada, medido

Artificial Analysis mediu Claude Sonnet 5.5 em cada nível no Intelligence Index v4.3.2, que é uma suíte de dez avaliações, e o custo por nível é o número que uma tabela de preços não consegue mostrar a você. Todos os números abaixo são desse avaliador, lidos dos próprios dados da página do modelo em 30 de setembro de 2026; as tarifas do fornecedor são da Anthropic.

• Baixo — índice 35,84 a US$ 0,41 por tarefa; primeiro bloco em 1,04 segundo.

• Médio, o padrão do Claude Code — 40,74 a US$ 0,59; primeiro trecho em 1,34 segundos.

• Alto, o padrão da Claude API — 46,74 a US$ 1,08; primeiro bloco em 16,6 segundos.

• Xhigh — 51,85 a $2,74; primeiro chunk em 39,7 segundos.

• Max — 55,98 a $7.60; primeiro bloco em 378,8 segundos.

Agora, coloque Claude Sonnet 5 com sua própria escada ao lado dela, pois é o modelo do qual a maioria dos leitores estaria migrando. Seus degraus marcam 24,26, 28,05, 31,66, 34,38 e 38,16, custando US$ 0,51, US$ 1,00, US$ 1,79, US$ 2,87 e US$ 5,09 por tarefa. Claude Sonnet 5.5 com a configuração padrão do Claude Code em medium obtém 40,74 — acima do melhor resultado de Claude Sonnet 5 em qualquer nível de esforço — por US$ 0,59 contra US$ 5,09. Isso é 8,7 vezes mais barato por tarefa concluída no mesmo conjunto, e é a versão independente da alegação da Anthropic de "menos de um décimo do custo", que o fornecedor faz no Terminal-Bench com esforço Medium. Mesma direção, fator um pouco menor, e é um resultado medido, e não uma tabela de fornecedor. Baixe para low em vez disso, e a ordem se inverte: 35,84 fica abaixo do teto de Claude Sonnet 5, que é o piso honesto da economia.

O degrau que não é barato em nenhum dos modelos é o mais alto. No esforço máximo, Claude Sonnet 5.5 custa US$ 7,60 por tarefa de índice, contra Claude Sonnet 5, que custa US$ 5,09 — cerca de 49% a mais, não a menos. Isso não é uma contradição do número do fornecedor. É a mesma curva lida na outra ponta, e é onde uma migração acaba se a configuração de esforço for transportada em vez de descartada.

Sua configuração de esforço salva pode não acompanhar você

Há uma terceira configuração em jogo e é a que tem mais probabilidade de estar silenciosamente errada. O Claude Code salva o esforço por modelo, em modelSettings nas suas configurações de usuário, então cada modelo mantém seu próprio nível. A forma mais antiga — uma única chave de nível superior effortLevel, que é o que /effort escrevia antes de existir o salvamento por modelo — é tratada de forma diferente para modelos recentes. A documentação diz que essa chave "continua a ser aplicada onde era aplicada antes, no Opus 5, no Fable 5.1 e em modelos anteriores, enquanto o Opus 5.5 e os modelos lançados depois dele começam em seu próprio padrão até você escolher um nível para eles."

Claude Sonnet 5.5 foi lançado depois do Claude Opus 5.5 — 28 de setembro contra 22 de setembro — então ele se enquadra nesse segundo grupo. Uma equipe que definiu um effortLevel: "high" global há um ano para manter o Claude Sonnet 5 afiado não recebe high no novo modelo. Ela recebe medium, que é o padrão do Claude Code, e nada na sessão diz isso. A mesma página observa que max se aplica apenas à sessão atual, a menos que seja definido por meio da variável de ambiente, e que chaves effortLevel de projeto, local ou gerenciado, ou uma passada com --settings, se aplicam a todos os modelos. Se você quer uma política de esforço que sobreviva a um lançamento de modelo, é nessa forma que deve escrevê-la.

Uma mudança adjacente vale a pena mencionar porque compartilha o número da versão: a alternância Ultracode no controle deslizante de esforço é uma configuração do Claude Code, e não um nível de esforço do modelo, e mantê-la ativada em níveis diferentes de xhigh, ou desativá-la com /effort ultracode off, exige a v2.1.284 — a mesma build que trouxe o novo Sonnet. O Ultracode não é um nível de esforço e não deve ser lido como um, mas se você criou scripts com base no comportamento antigo, essa é a versão em que isso mudou.

A espera é o orçamento de pensamento, não a taxa de tokens.

Os valores de latência acima são a coisa mais útil do ponto de vista operacional na página, porque invertem a intuição habitual. A velocidade de saída do Claude Sonnet 5.5 não cai à medida que o esforço aumenta; ela sobe com ele, de 85 tokens por segundo com esforço baixo para 137 no máximo. O que explode é a espera antes de o primeiro token sequer existir — 1,0 segundo no baixo, 1,3 no médio, 16,6 no alto, 39,7 no xhigh, 378,8 no máximo. O modelo não é mais lento por token no topo da escada. Ele pensa por mais tempo antes de começar e, no degrau mais alto, isso é mais de seis minutos de silêncio diante de cada tarefa.

Isso reformula para que serve a configuração. médio não é tanto um compromisso de qualidade, mas sim o único nível em que o modelo se comporta como uma ferramenta conversacional; máx é uma operação em lote disfarçada de interface interativa. Um cliente de streaming que esconde a lacuna faz alto parecer bom em uma demonstração e parecer quebrado em um terminal. A divisão prática que a maioria das equipes acabará adotando é um nível baixo para qualquer coisa que um humano esteja assistindo e um alto para trabalho que roda sem supervisão — o que chega perto do conselho do próprio fornecedor, obtido pelo lado da latência em vez do lado do custo.

A comparação que realmente pode ser roteada hoje

Se o ponto da escada é que o nível médio é onde o valor está, a pergunta interessante é o que mais fica perto dele. Claude Opus 5.5 em seu próprio padrão do Claude Code, o nível médio, marca 51,24 a US$ 1,34 por tarefa na mesma suíte. Claude Sonnet 5.5 no nível alto, marca 46,74 a US$ 1,08. Quatro e meio pontos do índice os separam por cerca de um quarto a mais por tarefa, e Claude Opus 5.5 também está à frente de forma mensurável em cada degrau acima do seu padrão.

Uma nota de disponibilidade, explicitada em vez de subentendida: Claude Sonnet 5.5 não está no catálogo do OrcaRouter. Está ausente da lista pública de modelos, e todas as grafias do slug retornam não encontrado, então nada aqui deve ser lido como uma rota para ele. O que é roteável é o modelo do qual você migraria e o modelo que está acima dele. anthropic/claude-sonnet-5 está na plataforma desde 30 de junho de 2026, aos preços da própria Anthropic de US$ 2,00 e US$ 10,00 por milhão de tokens, com leituras de cache a US$ 0,20 e gravação em cache a US$ 2,50, servido por meio de /v1/messages, /v1/chat/completions e /v1/responses. anthropic/claude-opus-5.5 está lá desde 22 de setembro, a US$ 4,00 e US$ 20,00, nos endpoints compatíveis com a Anthropic e de chat-completions.

É essa combinação que torna uma varredura de esforço barata de executar. Ambos os lados da comparação — o incumbente em sua configuração antiga e o irmão maior no degrau com o qual o padrão do novo modelo está sendo comparado — respondem com uma única credencial, sem um segundo contrato e sem alteração de código além da string do modelo, e o catálogo repassa o preço de lista do provedor sem adicionar markup. A única coisa que ele não fará é servir a você Claude Sonnet 5.5 em si, e, até que isso mude, a versão honesta do conselho deste artigo é avaliar o degrau na própria API da Ant​hropic e avaliar as alternativas onde elas já estão acessíveis.

The OrcaRouter model page for anthropic/claude-sonnet-5, showing a 1M-token context window, up to 128K output tokens, input at $2.00 and output at $10.00 per 1M tokens with a $0.20 cache read and $2.50 cache write, a listing dated Jun 30, 2026, and tiles reading AA Coding 71.5 and AA Intelligence 38.2.The Artificial Analysis model page for Claude Sonnet 5.5, labelled Adaptive Reasoning, Max Effort, Default Fallback, released September 2026. It shows an Intelligence Index of 56, class ranks of #3 of 216 on intelligence and #98 of 216 on cost, $2.00 input and $10.00 output per 1M tokens with a 90% cache discount, a $7.60 average cost per Intelligence Index task, 410M tokens generated against a median of 88M, 137 tokens per second, 1M-token context window, and text and image input.

O que fazer esta semana

Três coisas, pela ordem em que lhe vão custar dinheiro se as ignorar. Verifique contra que fornecedor a sua sessão do Claude Code é realmente executada antes de assumir que a atualização foi aplicada, porque no Bedrock, no Gooogle Cloud e no Claude Platform na AWS o sonnet ainda aponta para Claude Sonnet 4.5 ou Claude Sonnet 4.6 e o modelo tem de ser indicado por extenso. Verifique se o seu esforço guardado é uma entrada modelSettings por modelo ou a chave de nível superior mais antiga, porque só a primeira o acompanha num modelo lançado depois do Claude Opus 5.5. E quando voltar a executar a varredura que o fornecedor pede, varra tanto para cima como para baixo: no padrão do Claude Code, Claude Sonnet 5.5 supera Claude Sonnet 5no seu melhor resultado por menos de um nono do custo, o que significa que a questão interessante já não é se deve descer, mas até onde lhe é possível subir em termos de custo.

A questão em aberto é Claude Haiku 5.5, que a Anthropic diz que se juntará à família nas próximas semanas e ficará abaixo deste modelo. Se o padrão de Claude Opus 5.5 se mantiver, ele chegará primeiro à API da Anthropic e se espalhará para os outros provedores com um atraso medido em lançamentos do Claude Code, e não em dias. Esse atraso é o ponto a observar, porque tudo o que foi dito acima sobre aliases e padrões é, na verdade, uma consequência dele.

Comparados neste artigo3

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente