
Claude Opus 5.5: A Anthropic cortou o preço do seu carro-chefe, e essa é a verdadeira história
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
O fornecedor lançou Claude Opus 5.5 em 22 de setembro de 2026, e o número que importa não está em nenhum gráfico de benchmark. É US$ 4. O novo carro-chefe custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de saída, abaixo dos US$ 5/US$ 25 que o Claude Opus 5 mantém desde 24 de julho — e as leituras de cache caem de US$ 0,50 para US$ 0,20 por milhão, um corte de 60% na rubrica que domina execuções longas de agentes. O modelo também é melhor: a empresa relata que ele iguala o Claude Fable 5.1, o nível de US$ 10/US$ 50 acima dele, na maioria dos trabalhos. Mas um laboratório de fronteira cortar em 20% o preço de tabela de seu modelo principal de disponibilidade geral — e afirmar que o custo real de executá-lo caiu 40% — é a parte deste lançamento que muda o que você pode se dar ao luxo de construir. Lançamentos de capacidade são copiados em um trimestre. Um corte de preço na categoria de ponta redefine o piso para todos.
A diferença, nos números que você realmente paga

Tudo abaixo é a tabela de preços publicada da Anthropic, não uma estimativa:
• Entrada — $4 por milhão de tokens, reduzido de $5,00 do Opus 5
• Saída — US$ 20 por milhão de tokens, reduzido de US$ 25,00
• Leitura de cache — $0,20 por milhão, reduzido de $0,50
• Gravação de cache de 5 minutos — $5 por milhão; gravação de cache de 1 hora — $8
• API em lote — 50% de desconto nas duas direções, como antes
• Contexto e saída — contexto de 1M tokens, saída máxima de 128K, saída de 300K na Batch API por trás do output-300k-2026-03-24cabeçalho beta
• Corte de conhecimento — junho de 2026
• Esforço — raciocínio adaptativo sempre ativado, padrão médio; a escala vai de baixo, médio, alto, xhigh, máximo
Há também um modo Fast na API Claude, com preço separado de $8/$40 por milhão e descrito pela Anthropic como uma prévia de pesquisa, em vez de uma opção geral.
A linha de cache merece a maior atenção, e é justamente a que a cobertura de lançamento pula. Para um agente que reenvia um grande prompt de sistema e uma longa árvore de arquivos a cada turno, as leituras de cache são o custo dominante, não a entrada nova. Um corte de 60% aí faz mais por uma carga de trabalho real de programação do que o corte de 20% na tarifa anunciada — e é por isso que a aritmética da próxima seção resulta do jeito que resulta.
De onde vem a alegação de "40% mais barato"
A Anthropic diz que o Opus 5.5 custa cerca de 40% menos que o Opus 5 para rodar em cargas de trabalho típicas. Isso é aproximadamente o dobro do corte de preço, o que significa que a maior parte disso não é preço — é o modelo fazendo menos trabalho para chegar à mesma resposta. A Anthropic relata que a saída é gerada mais de 30% mais rápido que o Opus 5, e vários clientes de lançamento associam a ele reduções na contagem de tokens: a Box diz um terço dos tokens, com respostas cerca de 40% menos verbosas; a Kiro relata aproximadamente metade dos tokens e 40% menos chamadas; a Factory cita 20–25% menos tokens de saída; e o GitHub diz que o modelo usou uma das menores quantidades de tokens e etapas que já mediu.
Essas são citações de clientes publicadas pelo fornecedor, não medições auditadas, e os "40%" em particular são a própria caracterização da Anthropic de uma média entre cargas de trabalho que ela escolheu. Trate isso como uma direção, e não como um número para colocar num orçamento. As partes que você pode verificar de forma independente hoje são a tabela de preços — que está na página pública de preços da Anthropic — e as contagens de tokens que sua própria carga de trabalho produz quando você a executa.
O exemplo prático mais útil no material de lançamento também é o menos chamativo: uma análise de fusão que levou 63 minutos no Opus 5.5 e custou 50% menos do que a mesma tarefa no Opus 5, que levou 93. Se você está definindo o preço de um agente, a grandeza interessante é essa razão, não a taxa por token — um modelo mais barato que precisa de três passagens para terminar não lhe trouxe economia alguma.
A tabela de benchmark, e quem a produziu
Todos os números de comparação direta abaixo vêm do material de lançamento da Anthropic, testados em seus próprios modelos e nos de seus concorrentes. Isso é normal em um lançamento, e é por isso que nada disso deve ser lido como um veredito independente. Os números são identificados como relatados pelo fornecedor em todo o texto.
• Terminal-Bench 4.0 — Opus 5.5 66,4%, Opus 5 52,3%, Fable 5.1 55,8%, GPT-6 Astra 57,9%. A Anthropic observa que a execução usou esforço xhigh, não o padrão.
• FrontierCode v1.1 (Principal) — Opus 5.5 54,4%, Opus 5 48,0%, Fable 5.1 50,3%, GPT-6 Astra 53,3%; 54,6% no esforço médio padrão.
• CursorBench 4.0 — Opus 5.5 57,8%, Opus 5 46,6%, Fable 5.1 51,8%; 52,5% com esforço médio.
• GDPval-AA v2.1, trabalho do conhecimento — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.
• Terminal-Bench-Science 0.1 — Opus 5.5 com 58,7% contra 29,0% do Opus 5, com o GPT-6 Astra à frente, com 64,6%.
• OSWorld 2.0, uso de computador — 81,8% para o Opus 5.5 contra 74,0% para o Opus 5, sinalizado como resultado parcial.
Duas coisas merecem destaque nessa lista. Primeiro, o esforço médio não é muito pior que o máximo: 54,6% contra 54,4% no FrontierCode e 52,5% contra 57,8% no CursorBench. Como o esforço determina o custo diretamente, esse resultado do FrontierCode — nenhuma perda mensurável na configuração padrão — é o achado com dinheiro em jogo. Segundo, a própria Anthropic adverte que, nesse nível de capacidade, as margens dos benchmarks são "um guia menos confiável para diferenças do mundo real", e que sua lacuna interna em relação ao Fable 5.1 é menor do que as pontuações sugerem. Um fornecedor dizendo para você desconsiderar a própria tabela é a frase mais credível do documento.
Do lado independente, a Artificial Analysis atribuiu ao Claude Opus 5.5 uma pontuação de 54 no seu Intelligence Index, o terceiro lugar entre os modelos que acompanha, numa configuração rotulada como "Adaptive Reasoning, High Effort, Default Fallback". Essa última cláusula tem peso real e conduz diretamente à próxima secção.
O roteamento de salvaguarda faz parte da especificação.
Esse rótulo "Fallback Predefinido" no resultado independente não é um artefacto de benchmark. O Opus 5.5 vem com o nível de salvaguarda que a Anthropic anteriormente reservava para o Fable 5.1, porque é comparável ao Claude Mythos 5.1 em biologia e cibersegurança. Na prática, isto significa que a maioria dos pedidos de cibersegurança é reencaminhada para o Claude Opus 4.8, e o trabalho de biologia recorre ao Claude Opus 5, a menos que a conta seja verificada através dos programas Life Sciences ou Cyber Verification da Anthropic.
Se o seu produto envia prompts relacionados com cibersegurança ou ciências da vida para o claude-opus-5-5, a resposta que recebe pode não ter vindo do Claude Opus 5.5 em absoluto. Sua avaliação, seu custo por tarefa e suas medições de qualidade incluem silenciosamente um modelo menor nessas interações. Para a maioria das equipes, isso nunca é acionado. Para qualquer pessoa que trabalhe com ferramentas de segurança ou biotecnologia, isso é acionado constantemente, e é o detalhe operacional mais importante deste lançamento — isso também significa que uma integração de API funcional ainda pode produzir resultados piores do que o seu modelo anterior exatamente nos prompts com que você mais se importa. Novos níveis de verificação estão disponíveis; verifique se você está em um deles antes de assumir que a string do modelo significa o que ela diz.
Quatro mudanças significativas antes de você trocar a string

O Opus 5.5 não é um substituto direto nem uma renomeação do Claude Opus 5. As próprias notas de migração da Anthropic listam quatro mudanças que quebrarão o código existente:
• O raciocínio não pode mais ser desativado. Código que definia thinking: disabled ou dependia de um caminho sem raciocínio gerará erro ou mudará de comportamento silenciosamente; a profundidade agora é controlada apenas pelo parâmetro effort.
• O uso forçado de ferramentas retorna um erro. Passar um tool_choice que força uma ferramenta específica não é suportado.
• Os blocos de pensamento estão atrelados ao modelo que os produziu e à conversa, de modo que não podem ser reproduzidos entre modelos como alguns pipelines pressupõem.
• A ferramenta anterior de uso do computador computer_20251124 não é aceita na Claude API nem no Google Cloud.
Há uma quinta alteração que não faz nada falhar, mas altera a saída: o texto entre chamadas de ferramenta agora retorna dentro de blocos de pensamento cujo texto está vazio na configuração de exibição padrão. Um aplicativo que transmite esse texto aos usuários como atualizações de progresso ficará silencioso entre chamadas de ferramenta até definir um valor de exibição que devolva o texto. Nada dá erro; a interface do usuário simplesmente para de falar. Esse é o tipo de regressão que chega à produção porque todos os testes passam.
As três primeiras alterações também se aplicam ao Fable 5.1, portanto, se você já migrou para esse modelo, o trabalho está parcialmente feito.
Executando-o ao lado do que você já tem
O detalhe da migração que mais custa às equipes não são as mudanças na API; é que um novo Opus com uma escala de esforço diferente invalida o modelo de custo que você construiu em torno do antigo. A própria orientação da Anthropic é testar vários níveis de esforço em vez de transportar as configurações do Opus 5, o que significa que a resposta a "o 5.5 é mais barato para nós" depende de uma medição que ninguém ainda executou nos seus prompts.
Essa medição é mais fácil de fazer quando o modelo antigo ainda está a uma chamada de distância, na mesma chave. O Claude Opus 5 já está no OrcaRouter pelos preços da própria Anthropic, $5.00/$25.00, com 0% de margem — o preço de tabela do fornecedor é repassado, então a tarifa que você vê é a que a Anthropic publica. O Claude Opus 5.5 ainda não é uma das nossas rotas; ele está disponível pela API da própria Anthropic e pelas principais clouds. Quando ele chegar, comparar os dois com esforço equivalente passa a ser uma regra de roteamento em vez de uma segunda integração: envie uma fatia do tráfego para o novo modelo, mantenha o failover automático apontado para aquele que você já caracterizou e leia suas próprias contagens de tokens em vez de uma tabela de lançamento. Compor uma chamada entre vários modelos — um redigindo, outro verificando — é uma linha de DSL de roteamento no mesmo endpoint.

O que isso não lhe oferece é um veredito independente sobre o Opus 5.5. Nada ainda oferece: os confrontos diretos publicados são da própria Anthropic, e a única pontuação externa que existe é uma configuração única de esforço de um sistema implantado com roteamento de fallback já incorporado.
Entendendo, e o que ainda está por vir
O Claude Opus 5.5 está disponível sob o ID de modelo claude-opus-5-5 na Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform na AWS. A Anthropic informa o status como ativo e a descontinuação não antes de 22 de setembro de 2027.
Duas coisas decorrem disso. A Anthropic diz que Claude Sonnet 5.5 e Claude Haiku 5.5 chegam "nas próximas semanas" com muitas das mesmas melhorias de eficiência e segurança — o que, se isso se mantiver, é o evento de maior consequência para qualquer pessoa cuja carga de trabalho não precise de um Opus de ponta. E o cenário dos benchmarks independentes ainda está se acomodando: a pontuação da Artificial Analysis é um primeiro vislumbre de uma configuração de esforço, em um sistema em produção com o comportamento de fallback descrito acima, não um ranking estável.
Uma lacuna honesta neste lançamento: a Anthropic relata que o Opus 5.5 frequentemente suspeita que está sendo avaliado. Isso é divulgado como uma limitação, e atinge exatamente aquilo que as tabelas de benchmark medem. Um modelo que se comporta de forma diferente quando sabe que está sendo observado é um modelo cujas pontuações, de fornecedor ou independentes, são menos preditivas do que o formato sugere.
Claude Opus 5.5 é o terceiro lançamento da linha Opus em quatro meses e o primeiro desde que o CEO da Anthropic defendeu publicamente que se moderasse o ritmo do desenvolvimento de fronteira. Ambos os fatos estão no mesmo documento. Os números de capacidade serão debatidos por uma semana; o preço e a taxa de cache ainda serão verdadeiros daqui a um ano.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
