
Claude Opus 5.5 vs Claude Sonnet 5: Metade do Preço, Vinte Pontos de Índice e um Ponto Cego de Cinco Meses
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 177 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1323 tok/s
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
Se você só quer a regra: use o Claude Sonnet 5 por padrão e escale para o Claude Opus 5.5 quando uma tarefa falhar, porque o modelo mais barato custa genuinamente metade do preço e é genuinamente de uma classe de capacidade diferente. Os dois números por trás disso são 38 e 58 — as pontuações do Sonnet 5 e do Opus 5.5 no Artificial Analysis Intelligence Index, com o mesmo avaliador, na mesma família de configuração. Uma diferença de vinte pontos nesse índice não é um critério de desempate, e é a maior separação em qualquer confronto Claude contra Claude que você pode montar atualmente: Claude Opus 5.5 está classificado em #1 entre 210 modelos e Claude Sonnet 5 está classificado em #54, e a diferença de preço entre eles é de US$ 2 por milhão de tokens de entrada.
Essa é a metade fácil. A metade difícil é que escalar seletivamente exige saber quais tarefas falham, e os dois modelos discordam sobre o mundo depois de janeiro de 2026 de um modo que nenhuma avaliação vai sinalizar como erro.
A diferença de vinte pontos, em contexto

Artificial Analysis executa cada modelo em uma configuração publicada, e esses dois compartilham um rótulo de família — "Adaptive Reasoning, Max Effort" — o que torna a comparação incomumente limpa:
• Índice de Inteligência — Claude Opus 5.5 58, classificado em 1º de 210 vs Claude Sonnet 5 38, classificado em 54º
• Preço — Claude Opus 5.5 $4,00 entrada / $20,00 saída por milhão vs Claude Sonnet 5 $2,00 / $10,00
• Velocidade de saída — Claude Sonnet 5 79,3 tokens/s vs Claude Opus 5.5 ainda não publicado no ranking
• Tempo até o primeiro token — Claude Sonnet 5 150,02s vs. uma mediana do ranking de 3,83s
• Esforço padrão — Claude Opus 5.5 médio vs Claude Sonnet 5 alto
• Data de corte de conhecimento — junho de 2026 para o Claude Opus 5.5 vs janeiro de 2026 para o Claude Sonnet 5
• Contexto e saída — 1M de contexto e saída máxima de 128K em ambos
A coluna de classificação é a parte que merece uma pausa. Vinte pontos de índice não são quatro posições num ranking; são quarenta e nove. Num ranking de 210 modelos, Opus 5.5 e Sonnet 5 não são vizinhos com uma diferença de preço — estão em faixas diferentes, e a diferença de US$ 2 por milhão compra um salto real de capacidade, e não um selo. Quem leu a cobertura desta semana como "a Anthropic lançou um Opus mais barato" e assumiu que o nível Sonnet o absorveu deveria olhar para esse par de posições: a própria página de preços da Anthropic ainda lista o Claude Sonnet 5 como um produto atual, e a posição dele no ranking independente não mudou.
Duas ressalvas mantêm isto honesto. Ambas as pontuações foram obtidas com esforço máximo, e a configuração padrão de lançamento de nenhum dos dois modelos é a máxima: o Sonnet 5 vem por padrão em high, enquanto o Opus 5.5 vem em medium. E as linhas de velocidade complicam a história a favor do Sonnet 5: 79,3 tokens por segundo com um primeiro token em 150 segundos é um perfil de latência real e medido, e é o único dos dois que existe no quadro. A velocidade e a latência do Opus 5.5 não foram publicadas pela Artificial Analysis, o que significa que a alegação de "mais rápido" neste confronto repousa atualmente em material do fornecedor, e não em uma medição.
A nota de rodapé que muda o preço do Sonnet 5
A coisa mais concreta que surgiu no último mês para o Claude Sonnet 5 é uma frase que a maior parte da cobertura ignorou. Quando o modelo foi lançado em 30 de junho de 2026, seu preço de US$ 2 / US$ 10 foi anunciado como preço introdutório até 31 de agosto, com um aumento programado para US$ 3 / US$ 15 em 1º de setembro. Na página de preços atual da Anthropic, a nota de rodapé diz que o preço de US$ 2 / US$ 10 "agora é o preço padrão" e que o aumento "não ocorrerá".
Isso importa por dois motivos. O óbvio é que um aumento de 50% que foi anunciado e depois cancelado é uma linha de custo com a qual você agora pode planejar — o Sonnet 5 não é uma tarifa promocional cuja expiração você precisa modelar. O menos óbvio é que isso corrige a aritmética da escalada. Com o Sonnet 5 permanente a $2/$10 e o Opus 5.5 a $4/$20, a proporção entre os dois níveis é exatamente 2x nas duas direções, e é estável. Uma regra de escalada que envia, digamos, um quinto do seu tráfego para o Opus 5.5 tem um custo que você pode calcular uma vez e parar de recalcular.
As taxas de lote e de cache se movem juntas, e é isso que torna útil a comparação da tabela inteira: o Sonnet 5 cobra lotes a $1.00 / $5.00, contra $2.00 / $10.00 do Opus 5.5, e ambos cobram as leituras de cache a $0.20 por milhão. Esse último número é um empate genuíno — o Opus 5.5 reduziu sua leitura de cache de $0.50 para $0.20, e o Sonnet 5 já estava nesse valor. Se sua carga de trabalho é dominada por reler um grande contexto em cache em vez de gerar saída nova, a vantagem de preço do modelo mais barato é muito menor do que a proporção anunciada sugere, porque a única linha em que eles concordam é justamente a linha em que você mais gasta.
O corte é a parte que falha em silêncio

O Claude Opus 5.5 tem um corte de conhecimento de junho de 2026. O do Claude Sonnet 5 é janeiro de 2026. São cinco meses de diferença, e é a única dimensão nesta comparação que não se anuncia. Um modelo que não sabe de um evento não fica mais lento nem menos preciso sobre ele de uma forma que o seu tratamento de erros detecte — ele responde com confiança a partir de um mundo que já avançou, e a falha se parece com uma resposta errada plausível, e não com uma recusa.
Para algumas cargas de trabalho, isto é irrelevante: refatorar uma base de código cujas convenções são estáveis, resumir documentos que você fornece, transformar dados estruturados. Para outras, é desqualificador por si só, independentemente dos vinte pontos de índice ou do preço. Qualquer coisa que envolva software lançado no segundo semestre de 2026, qualquer coisa que responda a perguntas sobre eventos recentes, qualquer coisa que dependa de uma API ou de uma versão de biblioteca que mudou depois de janeiro — essas tarefas não podem ser escaladas para o Opus 5.5, têm de começar lá. Os cinco meses não são uma diferença de qualidade; são uma restrição de escopo, e isso pertence à regra de roteamento, não à avaliação.
Ambos os modelos compartilham o restante do envelope, o que limita o quanto o corte pode ser contornado. Ambos aceitam 1M de tokens de contexto e retornam até 128K, ambos executam pensamento adaptativo que não pode ser desativado e ambos expõem profundidade apenas por meio do parâmetro de esforço. Não existe nenhuma configuração em que o Sonnet 5 receba um documento mais longo para compensar.
Executando o split
A versão prática desta comparação é um padrão e uma exceção, e a exceção precisa ser definida por algo que não seja "tarefas difíceis". O padrão que se sustenta é por classe de tarefa, e não por dificuldade: Sonnet 5 para o trabalho de alto volume em que sua data de corte é irrelevante e seu perfil de latência é aceitável, Opus 5.5 para qualquer coisa atual, qualquer coisa de horizonte longo, ou qualquer coisa em que uma tentativa fracassada custe mais do que a diferença de tokens.
Isso é uma configuração de roteamento, e não uma reescrita, e é aí que um único endpoint justifica seu lugar. O Claude Sonnet 5 está no OrcaRouter pelo próprio preço da Anthropic de $2.00 / $10.00, e o Claude Opus 5.5 está lá por $4.00 / $20.00 — preço de tabela do provedor repassado com 0% de markup, de modo que a proporção de custo na sua regra de escalonamento é a proporção de custo que a Anthropic publica, sem nenhuma camada de markup a alterando. Ambos ficam atrás de uma única chave, o que significa que o caminho de escalonamento é uma edição de regra em vez de uma segunda integração, o failover automático impede que um primário com falha derrube a requisição junto com ele, e a comparação que decide seus limites é algo que você pode executar dentro do seu próprio tráfego em vez de reconstruir a partir de duas tabelas de fornecedores.

Quem deve se mover e quem deve esperar
Se já está no Claude Sonnet 5 e ele está a funcionar, o argumento para o substituir é fraco: o modelo custa metade do preço, a sua tarifa é agora permanente, e a diferença no índice só importa nas tarefas em que está a falhar. O argumento para acrescentar o Claude Opus 5.5 acima dele é forte, desde que consiga nomear o gatilho — e o gatilho é normalmente ou uma falha de cutoff ou uma tarefa que as execuções de esforço máximo do Sonnet 5 continuam a errar.
Se você está escolhendo seu primeiro modelo Claude, a resposta é menos equilibrada do que a proporção de preços faz parecer. Uma diferença de vinte pontos no índice e cinco meses extras de conhecimento pelo dobro dos tokens é uma troca que a maioria das cargas de trabalho de produção fará em uma minoria das chamadas e quase nenhuma fará em todas elas. O erro a evitar em qualquer das direções é tratar os dois como intercambiáveis e trocar apenas com base no custo, porque a falha que se segue não é uma resposta pior — é uma resposta confiante sobre um mundo que terminou em janeiro.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
