Um cartão de título gerado para Claude Opus 5.5 vs Claude Sonnet 5, com o subtítulo "Metade do preço, vinte pontos de índice, cinco meses de ponto cego", com três ícones de linha plana (um símbolo de banco de dados empilhado, um gráfico de barras crescente e um calendário com um relógio) e uma linha de rodapé com o texto "Índice segundo a Artificial Analysis no esforço máximo; preços segundo a Anthropic." O logotipo real da OrcaRouter é composto no canto inferior direito.
Guides & Insights

Claude Opus 5.5 vs Claude Sonnet 5: Metade do Preço, Vinte Pontos de Índice e um Ponto Cego de Cinco Meses

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Se você só quer a regra: use o Claude Sonnet 5 por padrão e escale para o Claude Opus 5.5 quando uma tarefa falhar, porque o modelo mais barato custa genuinamente metade do preço e é genuinamente de uma classe de capacidade diferente. Os dois números por trás disso são 38 e 58 — as pontuações do Sonnet 5 e do Opus 5.5 no Artificial Analysis Intelligence Index, com o mesmo avaliador, na mesma família de configuração. Uma diferença de vinte pontos nesse índice não é um critério de desempate, e é a maior separação em qualquer confronto Claude contra Claude que você pode montar atualmente: Claude Opus 5.5 está classificado em #1 entre 210 modelos e Claude Sonnet 5 está classificado em #54, e a diferença de preço entre eles é de US$ 2 por milhão de tokens de entrada.

Essa é a metade fácil. A metade difícil é que escalar seletivamente exige saber quais tarefas falham, e os dois modelos discordam sobre o mundo depois de janeiro de 2026 de um modo que nenhuma avaliação vai sinalizar como erro.

A diferença de vinte pontos, em contexto

A two-column scoreboard comparing Claude Opus 5.5 and Claude Sonnet 5 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 38, ranked #54), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), default effort (medium against high), knowledge cutoff (Jun 2026 against Jan 2026), output speed (not yet published against 79.3 tokens per second) and cache read ($0.20 per million on both). The footer reads 'Index and speed figures per Artificial Analysis at max effort; prices, effort defaults and cutoffs per Anthropic.'

Artificial Analysis executa cada modelo em uma configuração publicada, e esses dois compartilham um rótulo de família — "Adaptive Reasoning, Max Effort" — o que torna a comparação incomumente limpa:

• Índice de Inteligência — Claude Opus 5.5 58, classificado em 1º de 210 vs Claude Sonnet 5 38, classificado em 54º

• Preço — Claude Opus 5.5 $4,00 entrada / $20,00 saída por milhão vs Claude Sonnet 5 $2,00 / $10,00

• Velocidade de saída — Claude Sonnet 5 79,3 tokens/s vs Claude Opus 5.5 ainda não publicado no ranking

• Tempo até o primeiro token — Claude Sonnet 5 150,02s vs. uma mediana do ranking de 3,83s

• Esforço padrão — Claude Opus 5.5 médio vs Claude Sonnet 5 alto

• Data de corte de conhecimento — junho de 2026 para o Claude Opus 5.5 vs janeiro de 2026 para o Claude Sonnet 5

• Contexto e saída — 1M de contexto e saída máxima de 128K em ambos

A coluna de classificação é a parte que merece uma pausa. Vinte pontos de índice não são quatro posições num ranking; são quarenta e nove. Num ranking de 210 modelos, Opus 5.5 e Sonnet 5 não são vizinhos com uma diferença de preço — estão em faixas diferentes, e a diferença de US$ 2 por milhão compra um salto real de capacidade, e não um selo. Quem leu a cobertura desta semana como "a Anthropic lançou um Opus mais barato" e assumiu que o nível Sonnet o absorveu deveria olhar para esse par de posições: a própria página de preços da Anthropic ainda lista o Claude Sonnet 5 como um produto atual, e a posição dele no ranking independente não mudou.

Duas ressalvas mantêm isto honesto. Ambas as pontuações foram obtidas com esforço máximo, e a configuração padrão de lançamento de nenhum dos dois modelos é a máxima: o Sonnet 5 vem por padrão em high, enquanto o Opus 5.5 vem em medium. E as linhas de velocidade complicam a história a favor do Sonnet 5: 79,3 tokens por segundo com um primeiro token em 150 segundos é um perfil de latência real e medido, e é o único dos dois que existe no quadro. A velocidade e a latência do Opus 5.5 não foram publicadas pela Artificial Analysis, o que significa que a alegação de "mais rápido" neste confronto repousa atualmente em material do fornecedor, e não em uma medição.

A nota de rodapé que muda o preço do Sonnet 5

A coisa mais concreta que surgiu no último mês para o Claude Sonnet 5 é uma frase que a maior parte da cobertura ignorou. Quando o modelo foi lançado em 30 de junho de 2026, seu preço de US$ 2 / US$ 10 foi anunciado como preço introdutório até 31 de agosto, com um aumento programado para US$ 3 / US$ 15 em 1º de setembro. Na página de preços atual da Anthropic, a nota de rodapé diz que o preço de US$ 2 / US$ 10 "agora é o preço padrão" e que o aumento "não ocorrerá".

Isso importa por dois motivos. O óbvio é que um aumento de 50% que foi anunciado e depois cancelado é uma linha de custo com a qual você agora pode planejar — o Sonnet 5 não é uma tarifa promocional cuja expiração você precisa modelar. O menos óbvio é que isso corrige a aritmética da escalada. Com o Sonnet 5 permanente a $2/$10 e o Opus 5.5 a $4/$20, a proporção entre os dois níveis é exatamente 2x nas duas direções, e é estável. Uma regra de escalada que envia, digamos, um quinto do seu tráfego para o Opus 5.5 tem um custo que você pode calcular uma vez e parar de recalcular.

As taxas de lote e de cache se movem juntas, e é isso que torna útil a comparação da tabela inteira: o Sonnet 5 cobra lotes a $1.00 / $5.00, contra $2.00 / $10.00 do Opus 5.5, e ambos cobram as leituras de cache a $0.20 por milhão. Esse último número é um empate genuíno — o Opus 5.5 reduziu sua leitura de cache de $0.50 para $0.20, e o Sonnet 5 já estava nesse valor. Se sua carga de trabalho é dominada por reler um grande contexto em cache em vez de gerar saída nova, a vantagem de preço do modelo mais barato é muito menor do que a proporção anunciada sugere, porque a única linha em que eles concordam é justamente a linha em que você mais gasta.

O corte é a parte que falha em silêncio

A generated two-card graphic titled 'Knowledge cutoffs, five months apart', showing Claude Sonnet 5 with a knowledge cutoff of January 2026 against Claude Opus 5.5 with a cutoff of June 2026, separated by a marker reading '5 months of coverage'. The footer reads 'Cutoff dates per Anthropic's Claude model documentation, current as of September 2026.'

O Claude Opus 5.5 tem um corte de conhecimento de junho de 2026. O do Claude Sonnet 5 é janeiro de 2026. São cinco meses de diferença, e é a única dimensão nesta comparação que não se anuncia. Um modelo que não sabe de um evento não fica mais lento nem menos preciso sobre ele de uma forma que o seu tratamento de erros detecte — ele responde com confiança a partir de um mundo que já avançou, e a falha se parece com uma resposta errada plausível, e não com uma recusa.

Para algumas cargas de trabalho, isto é irrelevante: refatorar uma base de código cujas convenções são estáveis, resumir documentos que você fornece, transformar dados estruturados. Para outras, é desqualificador por si só, independentemente dos vinte pontos de índice ou do preço. Qualquer coisa que envolva software lançado no segundo semestre de 2026, qualquer coisa que responda a perguntas sobre eventos recentes, qualquer coisa que dependa de uma API ou de uma versão de biblioteca que mudou depois de janeiro — essas tarefas não podem ser escaladas para o Opus 5.5, têm de começar lá. Os cinco meses não são uma diferença de qualidade; são uma restrição de escopo, e isso pertence à regra de roteamento, não à avaliação.

Ambos os modelos compartilham o restante do envelope, o que limita o quanto o corte pode ser contornado. Ambos aceitam 1M de tokens de contexto e retornam até 128K, ambos executam pensamento adaptativo que não pode ser desativado e ambos expõem profundidade apenas por meio do parâmetro de esforço. Não existe nenhuma configuração em que o Sonnet 5 receba um documento mais longo para compensar.

Executando o split

A versão prática desta comparação é um padrão e uma exceção, e a exceção precisa ser definida por algo que não seja "tarefas difíceis". O padrão que se sustenta é por classe de tarefa, e não por dificuldade: Sonnet 5 para o trabalho de alto volume em que sua data de corte é irrelevante e seu perfil de latência é aceitável, Opus 5.5 para qualquer coisa atual, qualquer coisa de horizonte longo, ou qualquer coisa em que uma tentativa fracassada custe mais do que a diferença de tokens.

Isso é uma configuração de roteamento, e não uma reescrita, e é aí que um único endpoint justifica seu lugar. O Claude Sonnet 5 está no OrcaRouter pelo próprio preço da Anthropic de $2.00 / $10.00, e o Claude Opus 5.5 está lá por $4.00 / $20.00 — preço de tabela do provedor repassado com 0% de markup, de modo que a proporção de custo na sua regra de escalonamento é a proporção de custo que a Anthropic publica, sem nenhuma camada de markup a alterando. Ambos ficam atrás de uma única chave, o que significa que o caminho de escalonamento é uma edição de regra em vez de uma segunda integração, o failover automático impede que um primário com falha derrube a requisição junto com ele, e a comparação que decide seus limites é algo que você pode executar dentro do seu próprio tráfego em vez de reconstruir a partir de duas tabelas de fornecedores.

A screenshot of OrcaRouter's own model page for anthropic/claude-sonnet-5, headed 'Claude Sonnet 5' and credited to Anthropic, showing $2.00 input and $10.00 output per 1M tokens, a 1M-token context and a PERFORMANCE panel with 79.3 output tokens per second, a 150.02s time to first token and 55M output tokens over 7 days.

Quem deve se mover e quem deve esperar

Se já está no Claude Sonnet 5 e ele está a funcionar, o argumento para o substituir é fraco: o modelo custa metade do preço, a sua tarifa é agora permanente, e a diferença no índice só importa nas tarefas em que está a falhar. O argumento para acrescentar o Claude Opus 5.5 acima dele é forte, desde que consiga nomear o gatilho — e o gatilho é normalmente ou uma falha de cutoff ou uma tarefa que as execuções de esforço máximo do Sonnet 5 continuam a errar.

Se você está escolhendo seu primeiro modelo Claude, a resposta é menos equilibrada do que a proporção de preços faz parecer. Uma diferença de vinte pontos no índice e cinco meses extras de conhecimento pelo dobro dos tokens é uma troca que a maioria das cargas de trabalho de produção fará em uma minoria das chamadas e quase nenhuma fará em todas elas. O erro a evitar em qualquer das direções é tratar os dois como intercambiáveis e trocar apenas com base no custo, porque a falha que se segue não é uma resposta pior — é uma resposta confiante sobre um mundo que terminou em janeiro.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente