Um cartão de título para os preços do Claude Opus 5.5, mostrando as tarifas principais de $4,00 por milhão de tokens de entrada, $20,00 por milhão de tokens de saída e $0,20 por milhão de tokens de leitura em cache.
Guides & Insights

Claude Opus 5.5: preços, a tabela completa, a linha de cache e quanto custa realmente uma tarefa

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Claude Opus 5.5 tem preço de tabela de $4,00 por milhão de tokens de entrada e $20,00 por milhão de tokens de saída, um corte fixo de 20% em relação aos $5,00/$25,00 que o Claude Opus 5 vinha cobrando, com as leituras de cache 60% mais baratas, a $0,20 por milhão. Esses são os preços publicados da Ant​hropic, lidos na própria documentação de preços da Ant​hropic em 24 de setembro de 2026, dois dias após o lançamento do modelo. O preço de tabela é a parte fácil. A Ant​hropic também afirma que o modelo custa "cerca de 40% menos para rodar" em cargas de trabalho típicas, e esse número não está na tabela de preços — é uma caracterização do fornecedor, construída a partir do corte por token somado à suposição de que o modelo gasta menos tokens e menos turnos para concluir o mesmo trabalho. Esta página separa as duas coisas: cada tarifa que você pode verificar na tabela hoje, e a aritmética por trás da que você não pode. Claude Fable 5.1, o nível de $10/$50 acima dele, aparece em todo o texto como a comparação que a própria Ant​hropic faz.

A tabela de preços completa, cada linha exatamente como a Anthropic a publica

Tudo nesta seção foi lido da documentação de preços da Anthropic em platform.claude.com e claude.com em 24 de setembro de 2026. Nada aqui foi retirado de outro artigo.

Entrada — $4,00 por milhão de tokens (preço publicado da Anthropic).

Saída — $20,00 por milhão de tokens. Os tokens de raciocínio são cobrados como tokens de saída, e o raciocínio adaptativo do Claude Opus 5.5 está sempre ativado e não pode ser desativado.

Leitura de cache — $0,20 por milhão de tokens. A Ant​hropic documenta isto como 0,05x do preço base de entrada, sua própria exceção em nota de rodapé para este modelo.

Gravação em cache de 5 minutos — US$ 5,00 por milhão de tokens, o multiplicador padrão de 1,25x sobre a entrada base que a Anthropic aplica a todos os modelos da tabela.

Gravação de cache de 1 hora — $8,00 por milhão de tokens, o multiplicador padrão de 2x sobre a entrada base.

Batch API — 50% de desconto em ambos os sentidos: $2.00 de entrada e $10.00 de saída por milhão. A Ant​hropic publica os valores com desconto diretamente, em vez de deixar você dividi-los pela metade.

Modo rápido — US$ 8,00 de entrada e US$ 40,00 de saída por milhão, exatamente 2x o padrão. A documentação da Ant​hropic intitula a página "Fast mode (research preview)".

Inferência apenas nos EUA — um multiplicador de 1,1x sobre entrada, saída, gravações de cache e leituras de cache quando inference_geo: "us" estiver definido. O roteamento global, o padrão, usa preços padrão.

Contexto e teto de saída — 1M de tokens de contexto e 128K de saída síncrona com preço padrão, sem sobretaxa de contexto longo. A Ant​hropic afirma que uma solicitação de 900 mil tokens é cobrada à mesma taxa por token que uma de 9 mil tokens. Na Batch API, o teto de saída sobe para 300K por trás do output-300k-2026-03-24 cabeçalho beta.

Anthropic também afirma que os multiplicadores de cache "se acumulam com outros modificadores de preço, como o desconto da Batch API e a residência de dados" — então uma solicitação em lote, em cache e fixada nos EUA multiplica os três, e a aritmética se compõe em vez de substituir.

Aqui está o que os leitores dos dois modelos realmente pesam em termos de custo na mesma planilha:

Claude Opus 5 — US$ 5,00 de entrada, US$ 25,00 de saída, US$ 0,50 de leitura de cache, US$ 6,25 para gravação de cache de 5 minutos, US$ 10,00 para gravação de 1 hora, US$ 2,50/US$ 12,50 no Batch (tarifas publicadas da Ant​hropic, consultadas em 24/09/2026).

Claude Fable 5.1 — $10.00 de entrada, $50.00 de saída, $0.25 de leitura de cache, $12.50 por uma gravação de cache de 5 minutos, $20.00 por uma gravação de 1 hora, $5.00/$25.00 no Batch (taxas publicadas da Ant​hropic, consultadas em 2026-09-24).

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

A linha de cache é onde a fatura do agente é realmente decidida

A cobertura do lançamento trata a leitura de cache como nota de rodapé. É a maior alavanca isolada da planilha para qualquer carga de trabalho que reenvia um prefixo grande — o que corresponde à maioria das cargas de trabalho de codificação e de agentes.

A própria nota de rodapé da Ant​hropic é incomumente explícita sobre as proporções: acertos de cache e atualizações custam 0,1x o preço base de entrada na maioria dos modelos Claude, 0,025x no Claude Fable 5.1, e 0,05x no Claude Opus 5.5. Portanto, a proporção de cache do Claude Opus 5.5 é duas vezes pior que a padrão, e duas vezes pior que a do Claude Fable 5.1.

Em dólares, ganha de qualquer forma, e esta é a parte que vale a pena internalizar: um multiplicador melhor não vence em dólares quando a taxa base é duas vezes e meia mais alta.

• Claude Fable 5.1 — 2,5% de uma base de $10,00 é $0,25 por milhão de tokens em cache.

• Claude Opus 5.5 — 5% de uma base de US$ 4,00 é US$ 0,20 por milhão de tokens em cache.

• Claude Opus 5 — 10% de uma base de $5.00 é $0.50 por milhão de tokens em cache.

A mesma inversão se mantém nas gravações. O Claude Fable 5.1 cobra US$ 12,50 para gravar um milhão de tokens no cache de 5 minutos e US$ 20,00 para a janela de 1 hora; o Claude Opus 5.5 cobra US$ 5,00 e US$ 8,00. As leituras de cache são o único item em que o Claude Opus 5.5 supera ambos os irmãos em dólares absolutos, apesar de ter a proporção intermediária.

Duas regras decidem se vale a pena pagar pela gravação. A documentação da Ant​hropic diz que uma gravação de 5 minutos custa 1,25x a entrada base e, portanto, se paga após uma única leitura de cache, enquanto uma gravação de 1 hora custa 2x a entrada base e precisa de duas leituras para se pagar. E o cache está vinculado ao prefixo que o produziu: a Ant​hropic observa que alternar entre velocidade rápida e padrão invalida o cache, porque requisições em velocidades diferentes não compartilham prefixos em cache. Mudar o modelo, o nível de esforço ou as definições de ferramentas tem o mesmo efeito. Um modelo mais barato que força uma reescrita de prefixo a cada troca pode custar mais do que o modelo caro que ele substituiu.

O que um loop longo de agente realmente custa

Considere um agente de codificação de 40 turnos que reenvia um prefixo de 120.000 tokens — prompt de sistema, esquemas de ferramentas, árvore de arquivos — a cada turno, acrescenta 1.000 novos tokens de entrada por turno provenientes dos resultados das ferramentas e produz 800 tokens de saída por turno. A substituição é o ponto aqui: altere qualquer um desses quatro números para corresponder ao seu próprio tráfego e a aritmética abaixo continua válida.

Sobre o Claude Opus 5.5:

• Gravação em cache, uma vez — 120.000 tokens a US$ 5,00 por milhão = US$ 0,60

• Leituras de cache, 39 turnos — 4,680,000 tokens a $0.20 por milhão = $0.94

• Entrada nova, 40 turnos — 40.000 tokens a $4,00 por milhão = $0,16

• Saída, 40 turnos — 32.000 tokens a $20,00 por milhão = $0,64

Total da sessão — US$ 2,34, dos quais as leituras de cache representam cerca de 40%.

No Claude Opus 5, contagens de tokens idênticas: US$ 0,75 de gravação em cache, US$ 2,34 de leituras de cache, US$ 0,20 de entrada nova e US$ 0,80 de saída — US$ 4,09.

No Claude Fable 5.1, contagens de tokens idênticas: $1.50 de gravação em cache, $1.17 de leituras de cache, $0.40 de entrada nova e $1.60 de saída — $4.67.

Mesmos tokens, mesmos turnos, sem necessidade de alegar eficiência: o Claude Opus 5.5 fica 43% abaixo do Claude Opus 5 e 50% abaixo do Claude Fable 5.1. E US$ 1,40 dos US$ 1,75 de diferença em relação ao Claude Opus 5 — oitenta por cento da economia — vem apenas da linha de leitura de cache, não da taxa de entrada anunciada.

Agora execute o formato oposto: uma chamada única com 20.000 tokens de entrada e 8.000 de saída, sem cache. Claude Opus 5.5 custa US$ 0,08 de entrada mais US$ 0,16 de saída — US$ 0,24. Claude Opus 5 custa US$ 0,10 mais US$ 0,20 — US$ 0,30. Isso é exatamente o corte nominal de 20%, e nem um ponto a mais.

Portanto, a tabela de tarifas por si só proporciona algo entre 20% e 43%, dependendo de quanto da sua fatura corresponde a leituras de cache. Qualquer alegação acima desse intervalo vem da contagem de tokens, não dos preços.

De onde vem o "cerca de 40% mais barato de executar" da Anthropic

O material de lançamento da Ant​hropic diz que o Claude Opus 5.5 "exige menos computação para ser servido do que o Opus 5" e que seus testes mostram que ele "custará 40% menos que o Opus 5 em cargas de trabalho típicas" nas configurações padrão. A decomposição que a Ant​hropic apresenta é que o modelo "custa menos por token do que o Opus 5 e usa menos tokens por tarefa, o que resulta em uma redução de 40% nos custos."

Chame isso pelo que é: uma caracterização do fornecedor de uma média entre cargas de trabalho selecionadas pela Ant​hropic, não um resultado auditado e não uma tarifa publicada na tabela de preços. A metade verificável é a primeira metade — 20% de desconto na entrada e na saída, 60% de desconto nas leituras de cache, ambos legíveis na tabela hoje. A segunda metade depende de o modelo gastar menos tokens e menos turnos em sua carga de trabalho, o que só pode ser verificado executando-a.

As evidências que a Ant​hropic oferece para a metade do token são um conjunto de declarações de clientes no momento do lançamento. Todas as seguintes são publicadas pelo fornecedor, descrevendo cargas de trabalho que o fornecedor e seus clientes escolheram:

Box — o modelo "usou um terço dos tokens que o Opus 5 usou", com respostas "40% menos verbosas sem perder precisão".

Kiro — ele "resolveu mais do que o Opus 5, fazendo cerca de 40% menos chamadas e usando metade dos tokens".

Factory — ele "igualou o Opus 5 no modo high effort, usando de 20 a 25% menos tokens de saída."

GitHub — "usou um dos menores números de tokens e passos que medimos", e no VS Code "resolveu mais tarefas de terminal do que o Opus 5 em menos da metade dos passos".

Análise de fusão, um exemplo prático — duas empresas fictícias de software de RH, com cada modelo construindo um modelo no Excel e uma apresentação executiva. A Anthropic relata que o Claude Opus 5.5 terminou em 63 minutos, contra 93 do Claude Opus 5, e "custou 50% menos para produzir". Informação do fornecedor, n=1.

O contrapeso independente importa aqui, porque aponta na direção oposta. A Artificial Analysis mediu o Claude Opus 5.5 em esforço máximo em aproximadamente 119.000 tokens de saída por tarefa do Intelligence Index, contra aproximadamente 73.000 para o Claude Opus 5 em esforço máximo — a contagem de tokens sobe, não desce. Seu resumo dessa configuração é que o Claude Opus 5.5 está "em pé de igualdade com o Opus 5 em custo por tarefa, apesar de 1,6 vez mais tokens de saída", a um custo publicado de US$ 5,98 por tarefa do Intelligence Index. Essa é uma medição independente em esforço máximo, e não é uma contradição da afirmação da Anthropic — é a outra extremidade da escala de esforço.

O que levanta a ressalva que rege todos os números desta seção. A Anthropic afirma que, salvo indicação em contrário, todos os resultados do Claude Opus 5.5 usam pensamento adaptativo em esforço máximo. O Claude Opus 5.5 tem como padrão esforço médio; o Claude Opus 5 tinha como padrão alto, e o mesmo nível nominal não é o mesmo orçamento de pensamento entre os dois modelos. Assim, uma tabela de fornecedor executada em esforço máximo e uma tabela independente executada em esforço máximo com fallback padrão ativado não são a mesma configuração, e tampouco a configuração padrão é aquela que um leitor realmente implantaria. Uma média de 40% medida em um conjunto selecionado de cargas de trabalho, com configurações que você talvez não use, é uma hipótese inicial — não uma linha de orçamento.

O modo rápido é uma prévia de pesquisa, não um nível.

O modo rápido no Claude Opus 5.5 é $8.00 por milhão de tokens de entrada e $40.00 por milhão de tokens de saída — exatamente o dobro do preço padrão — para até 2,5x mais tokens de saída por segundo. Ele não melhora o tempo até o primeiro token; o ganho está na velocidade de saída, e é mais visível com streaming.

Diga o resto sem rodeios, porque é fácil orçar isto como um nível quando não é. A Anthropic rotula o modo rápido como uma prévia de pesquisa. O acesso é solicitado por meio de um gerente de conta ou da lista de espera. Ele exige o cabeçalho beta fast-mode-2026-02-01 e speed: "fast" na requisição. Ele está disponível apenas na Claude API — não no Amazon Bedrock, Google Cloud, Microsoft Foundry ou Claude Platform na AWS. Ele não pode ser combinado com a Batch API nem com um compromisso de Priority Tier. Ele se acumula com cache de prompt e multiplicadores de residência de dados, então uma requisição em modo rápido com cache fixada nos EUA paga 1,1x além de 2x. E alternar uma carga de trabalho entre a velocidade rápida e a padrão invalida o cache de prompt, o que, em um loop de agente longo, pode custar mais do que a velocidade economiza.

Claude Opus 5 e Claude Opus 4.8 também suportam o modo rápido, a $10.00/$50.00. O Claude Opus 4.7 rejeita o parâmetro de forma categórica.

A unidade que determina a fatura é o custo por tarefa concluída

Toda tarifa acima é um preço por token. Ninguém compra tokens. Um preço por token só se torna um custo quando multiplicado pelos tokens que uma tarefa consome e pelo número de tentativas necessárias para concluí-la.

Faça as contas do exemplo com cache leve de antes. A US$ 0,24 por passada, um modelo que conclui uma tarefa na primeira tentativa custa US$ 0,24. A mesma tarefa em um concorrente a US$ 0,30 por passada custa US$ 0,30 — então o modelo mais barato parece estar 20% à frente. Agora, suponha que o modelo mais barato precise de 1,2 passadas por tarefa concluída, o que é uma taxa de sucesso generosa para trabalho agêntico: 1,2 × US$ 0,24 dá US$ 0,288, contra US$ 0,30 da alternativa de passada única. A economia desapareceu. Com três passadas, fica em US$ 0,72, e o modelo que parecia 20% mais barato por token é 140% mais caro por tarefa concluída.

É por isso que as próprias alegações de eficiência da Ant​hropic — menos tokens, menos chamadas, menos passos — são enquadradas na unidade correta. É também por isso que nenhuma delas deve ser tomada como uma rubrica orçamentária até que você as tenha reproduzido. A verificação é mecânica: preço por passagem, vezes passagens por tarefa concluída, medidos no seu próprio tráfego. Cabe a você produzir ambos os números, e nenhum fornecedor publica o segundo para a sua carga de trabalho.

Se você quer um único ponto de referência fora do fornecedor, o Artificial Analysis coloca o Claude Opus 5.5 a US$ 5,98 por tarefa do Intelligence Index em sua configuração de esforço máximo — um número independente em um ajuste que a maior parte do tráfego de produção não usará, útil como teto, e não como previsão.

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

Linhas que a tarifa anunciada não inclui

Residência.A inferência apenas nos EUA é 1,1x em cada categoria de token, incluindo leituras e gravações de cache. Ela se acumula com o modo rápido e com o desconto de Batch.

Definições de ferramentas. A Anthropic publica uma sobrecarga no prompt de sistema para uso de ferramentas por modelo: declarar ferramentas adiciona 286 tokens a cada solicitação do Claude Opus 5.5. É pouco a US$ 4,00 por milhão, mas é cobrado por solicitação, e um loop de agente faz muitas solicitações.

Invalidação de cache. Um prefixo reescrito após uma alteração de modelo, esforço, definição de ferramenta ou velocidade é cobrado à taxa de escrita — $5,00 ou $8,00 por milhão no Claude Opus 5.5 — e não à taxa de leitura de $0,20.

O modelo abaixo dele. O Claude Sonnet 5 custa US$ 2,00 na entrada e US$ 10,00 na saída por milhão, o que a nota de rodapé de preços da Ant​hropic confirma ser agora o preço padrão, e não a tarifa introdutória com que foi anunciado. O Claude Opus 5.5 é exatamente 2x o Sonnet 5 em ambas as direções.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

Chamando Claude Opus 5.5 pelo preço de tabela da Anthropic

O Claude Opus 5.5 está no OrcaRouter em anthropic/claude-opus-5.5 por US$ 4,00 de entrada e US$ 20,00 de saída por milhão — o preço de tabela da própria Ant​hropic, repassado com 0% de markup. Vale a pena afirmar esse repasse com precisão em uma página de preços: como a tarifa do provedor é repassada em vez de ficar armazenada em cache numa tabela, uma mudança na tarifa do fornecedor passa a valer aqui no mesmo dia em que é publicada, e não depois de uma janela de sincronização. Se a Ant​hropic alterar esta tabela, o número que você consulta muda junto.

A mesma chave alcança os níveis com que esta página a compara — anthropic/claude-opus-5 a $5,00/$25,00 e anthropic/claude-fable-5.1 a $10,00/$50,00 — a par do resto da linha Claude e de mais de 200 outros modelos, pelo que testar se a tarifa mais barata por token sobrevive ao contacto com as suas próprias contagens de passes não exige um segundo contrato nem uma alteração de código. O failover automático existe para o caso de querer executar um modelo desconhecido num caminho de produção sem apostar esse caminho nele.

A resposta em duas linhas sobre o que esta página trata: a tabela de preços é US$ 4,00 de entrada, US$ 20,00 de saída e US$ 0,20 por milhão de leitura em cache, e o corte de 20% é real e verificável hoje. Os 40% são a média da Anthropic entre as cargas de trabalho que ela selecionou. Rode um dos seus próprios loops de agente por ele antes de orçar com base no segundo número.

Comparados neste artigo3

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente