Cartão de título principal para o Claude Opus 5.5 com o texto "Claude Opus 5.5 demos: the first week" e o subtítulo "Three reported bills: $3.21, $13.30, $25.66", uma linha de rodapé com o texto "Unit prices per Anthropic; demo costs as reported by their builders.", e o logotipo da OrcaRouter no canto inferior direito.
Engineering & Research

Demos do Claude Opus 5.5 custam de US$ 3 a US$ 26: como interpretar os primeiros dias de builds

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Dois números da primeira semana do Claude Opus 5.5descrevem o mesmo modelo e divergem em uma ordem de magnitude. Um desenvolvedor relata um laboratório de lentes interativo concluído — uma página na qual você arrasta um anel de foco e observa um plano de foco brilhante varrer um vale — a $25,66 em gastos de API e uma hora e 26 minutos de tempo de relógio. Uma compilação amplamente compartilhada de demos de lançamento precifica uma animação de castelo do Blender construída proceduralmente, completa com fogos de artifício e reflexo no lago, em $13,30 e 35 minutos. Uma thread que chegou à primeira página do r/ClaudeAI diz $3,21. O fornecedor lançou o Claude Opus 5.5 em 22 de setembro de 2026 a $4 por milhão de tokens de entrada e $20 por milhão de tokens de saída, e nenhum desses três números está errado. Eles estão medindo coisas diferentes, e se você está fazendo um orçamento com base neles, precisa saber qual deles.

A lacuna não é ruído. É a diferença entre o que uma execução de agente produz e o que ela consome, e os últimos quatro dias produziram uma quantidade notável deste último com muito pouca prestação de contas sobre isso. Então aqui está a aritmética que ninguém publicou junto com as demos, depois a parte do lançamento que está de fato em uma tabela de preços e pode ser conferida.

O que $25.66 realmente comprou

A extremidade cara da faixa é a extremidade mais útil, porque o construtor publicou tanto o artefato quanto a fatura.

O laboratório de lentes de Ryan Sael, intitulado "O Plano de Foco", é uma única página interativa criada a partir de um único prompt em uma única sessão. Ele coloca uma lente de câmera na tela, permite arrastar o anel de foco e mostra a você aquilo que todo fotógrafo conhece, mas quase ninguém viu: a fina lâmina no mundo onde uma foto realmente fica nítida. Gire o anel e a lâmina se move, os elementos de vidro deslizam para frente ou para trás dentro do barril para mostrar por quê, e um console informa a distância, a abertura e a zona nítida — 60 cm, f/2, 1,9 cm de profundidade, nas configurações com que a página abre. Feche a abertura de f/2 para f/16 e a zona nítida se amplia à medida que o cone de luz se estreita. Uma vista explodida separa o vidro. Não há nenhum modelo de imagem em nenhum ponto do pipeline, nem recursos baixados: cada elemento é desenhado e animado em código, e é por isso que toda a demonstração do círculo de confusão é uma simulação ao vivo, e não um diagrama.

Isso é um explicador genuinamente bom, e a afirmação que o acompanha é incomumente precisa: uma única tentativa, 1 hora e 26 minutos, US$ 25,66 de uso de API, com a página no ar em lens.lab.sael.net quando a li. O número é autodeclarado e não auditável, mas também é o único custo de demonstração em circulação que vem com uma duração de sessão pela qual dividir.

Faça as contas na tabela de preços. Aos preços publicados do Claude Opus 5.5 de US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, US$ 25,66 fica entre 1,28 milhão de tokens e 6,4 milhões de tokens, dependendo da composição — o limite superior se a execução fosse só entrada, o limite inferior se fosse só saída. Um build agêntico como este fica em algum ponto intermediário, e o motivo de ele ficar mais perto do limite inferior é o item de linha que a maioria das pessoas ignora: leituras de cache no Claude Opus 5.5 custam US$ 0,20 por milhão, um quarenta avos da tarifa de entrada, então uma sessão longa que fica relendo a mesma base de código em crescimento paga quase nada por esse tráfego. Dez milhões de tokens de entrada em cache custam US$ 2. O lado da saída é onde se acumula uma hora e meia de um modelo escrevendo código, pensando e reescrevendo-o: a US$ 20 por milhão, um milhão de tokens de saída dá US$ 20, e tokens de raciocínio são cobrados como saída. O número de Sael é consistente com uma execução que produziu algo em torno de um milhão de tokens de saída contra um lado de entrada grande, barato e em cache — que é exatamente a cara de um build não assistido de 86 minutos.

Duas coisas se seguem. Primeiro, o corte no preço de tabela que chamou a atenção no dia do lançamento, de $5/$25 para $4/$20, é uma variação de 20% por token e, por si só, não teria tornado esta execução barata; o corte na leitura de cache de $0,50 para $0,20 é a linha que tornou um loop de 90 minutos acessível. Segundo, e menos confortável: nada no relatório de $25,66 diz se a execução correu bem. Um one-shot bem executado e uma sessão que patinou por uma hora e meia e depois teve sucesso produzem a mesma fatura.

A cifra de US$ 13,30 não sobrevive à sua própria aritmética.

O meio da faixa é instrutivo por um motivo diferente. Um resumo de demos de lançamento publicado em 23 de setembro relata um confronto direto no qual foi pedido ao Claude Opus 5.5 que construísse proceduralmente uma animação de dez segundos no Blender a partir de um único prompt — castelo, reflexo no lago, fogos de artifício — contra o GPT-6 Astra, sem edição manual, e relata 35 minutos e 199.600 tokens de saída por cerca de US$ 13,30, contra 28 minutos e cerca de US$ 14,50 para o GPT-6 Astra. A contagem de tokens é a parte interessante, porque não bate com o preço.

199.600 tokens de saída, a US$ 20 por milhão, custam US$ 3,99, não US$ 13,30. Para chegar a US$ 13,30 somente com a saída, você precisaria de 665.000 tokens. O dinheiro que falta está nas outras colunas: entrada a US$ 4 por milhão, gravações de cache a US$ 5 por milhão para um ponto de interrupção de cinco minutos e US$ 8 por milhão para uma hora, e quaisquer tentativas repetidas. Isso não é uma contradição no relatório — é o relatório sendo honesto sobre uma contagem de tokens que conta uma coisa e uma fatura que conta quatro, que é a confusão mais comum em conversas sobre custos na semana de lançamento. Se você for tirar um número de uma demonstração publicada, tire o valor em dólares e trate qualquer contagem de tokens ao lado dele como uma descrição parcial da execução.

Na ponta mais barata, a contabilidade fica ainda mais tênue. O tópico do r/ClaudeAI que relata US$ 3,21 de uso da API para um build finalizado é típico do gênero: um título, um vídeo e nenhum detalhamento. É plausivelmente uma sessão mais curta, um artefato menor ou muito input em cache. Não é algo para basear um orçamento, e eu não consegui verificar um dólar sequer disso.

Por que cada um desses números é um limite inferior

O modo de falha aqui não é que os construtores dissimulem. É a seleção. As demos que circulam são as que funcionaram, publicadas pelas pessoas para quem funcionaram, e as quatro tentativas que produziram uma página quebrada custaram o mesmo que a que não produziu. A coletânea que compilou a comparação do Blender diz isso abertamente — que ninguém publica as falhas — e sua própria entrada mais detalhada é um caso exemplar: um site de uma marca de relógios que não atendeu ao briefing e usou uma fonte ilegível na primeira tentativa e precisou de uma segunda para se tornar a versão que foi mostrada.

"One shot" também está fazendo um trabalho silencioso nesse vocabulário. Ele descreve uma única sessão, não uma única tentativa, e uma sessão pode conter tanta autocorreção quanto o modelo conseguir gerar — o que, em uma execução de 86 minutos, é muita coisa. O modelo reescrever o próprio código duas vezes dentro de uma mesma janela de contexto é um one shot e duas tentativas.

Então, a leitura honesta dos primeiros quatro dias é a de três níveis de evidência, e não se deve tirar a média entre eles:

• Custo autodeclarado com duração de sessão — utilizável para ordem de grandeza, não verificável. Os US$ 25,66 de Sael em 1h26min são o item mais forte deste nível.
• Custo autodeclarado com uma contagem de tokens — internamente inconsistente na maioria das vezes, como mostra o valor de US$ 13,30.
• Um valor em dólares sem nada por trás — um sinal de que alguém construiu algo, e nada mais do que isso.

A parte do lançamento que está em uma tabela de preços

Deixe de lado as alegações da demonstração, e o quadro verificável é estreito e claro. Todos os valores abaixo são as tarifas publicadas da Anthropic, lidas na própria documentação de modelos e no anúncio da empresa em 25 de setembro de 2026:

• Entrada — $4 por milhão de tokens. Saída — $20 por milhão, com tokens de raciocínio cobrados como saída, e o raciocínio adaptativo do Claude Opus 5.5 sempre ativado e impossível de desligar.
• Leituras de cache — $0,20 por milhão, um multiplicador de 0,05x. Gravações de cache — $5 por milhão no ponto de quebra de cinco minutos, $8 por milhão em uma hora. Batch API — 50% de desconto nas duas direções, $2 e $10.
• Modo rápido — $8 de entrada e $40 de saída por milhão, até 2,5x a velocidade, e a Anthropic ainda o classifica como prévia de pesquisa.
• Envelope — contexto de 1M de tokens, 128K tokens de saída de forma síncrona e 300K na Batch API com um cabeçalho beta, corte de conhecimento confiável de junho de 2026, esforço padrão médio em vez do alto que era o padrão do Claude Opus 5.
• Disponibilidade — a Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS, com encerramento garantido não antes de 22 de setembro de 2027.

As próprias alegações de desempenho do fornecedor, rotuladas como alegações: o Claude Opus 5.5 tem desempenho no nível do Claude Fable 5.1 na maioria dos trabalhos, custa cerca de 40% menos para operar do que o Claude Opus 5 e gera resultados mais de 30% mais rápido. Os 40% são uma média de carga de trabalho escolhida pelo fornecedor, e não um número de tabela de preços, e os dois não devem ser citados como se fossem o mesmo tipo de fato.

A verificação independente é menor do que a tabela do fornecedor e aponta na mesma direção, com menos margem. O Artificial Analysis atribui ao Claude Opus 5.5 a pontuação de 57,6 no seu Intelligence Index, além de 61,4 no Humanity's Last Exam, 66,9 no SciCode e 84,7 na recuperação de contexto longo nos números que a página do modelo traz. Na medição de agente de codificação da mesma publicação, que reporta custo por tarefa em vez de custo por token, o número segue na direção oposta: no esforço máximo, o custo por tarefa sobe para cerca de US$ 13,04, contra US$ 10,79 do Claude Opus 5 no mesmo harness. Um token mais barato que o modelo consome em maior quantidade não é uma tarefa mais barata. É a mesma lição que as contas da demonstração estão ensinando, vinda de um terceiro.

O que fazer de diferente na segunda semana

Se o número de US$ 25,66 foi o que fez você querer experimentar isso, a medida útil não é orçar US$ 25,66 — é fazer sua própria execução produzir um número que você consiga explicar.

Defina o esforço explicitamente em vez de aceitar o padrão, porque é esse o ajuste que move os tokens por tarefa mais do que a escolha do modelo, e o padrão neste modelo mudou em relação ao Claude Opus 5. Coloque o prefixo estável em cache de forma deliberada: o prompt mínimo cacheável no Claude Opus 5.5 é de 512 tokens, reduzido de 1.024, então prefixos compartilhados curtos que nunca eram cacheados antes agora são. Dê a qualquer tarefa de longa duração uma folga em max_tokens, já que o raciocínio faz parte desse orçamento e não pode mais ser desativado — a própria orientação de migração da Anthropic sugere começar em 64K para trabalho nos níveis de esforço mais altos e ajustar a partir daí. E instrumente a execução no final, não no início: leia o campo model de nível superior em cada resposta, porque, em prompts que seus classificadores sinalizam, a Anthropic redireciona a solicitação dentro da mesma chamada, e a string de modelo que você enviou não descreve o que respondeu.

Esse último ponto é onde um roteador deixa de ser uma conveniência. Uma execução que roda sem supervisão por uma hora e meia através de uma fronteira de salvaguarda pode voltar tendo concluído silenciosamente alguns turnos em um modelo menor, e a única forma de descobrir é olhar. Claude Opus 5.5 está na OrcaRouter pelo preço de tabela da própria Anthropic com 0% de markup — a tarifa do provedor repassada diretamente, então uma mudança de preço do fornecedor entra no ar aqui no mesmo dia em que é publicada — o que é a coisa menos interessante que o roteamento faz aqui. O interessante é que uma única API para mais de 200 modelos coloca o experimento inteiro em uma única chave, então "rode no modelo de fronteira e faça fallback em vez de falhar" é uma linha de configuração em vez de um segundo contrato e uma reescrita. O failover automático é o que torna seguro colocar um modelo desconhecido em um caminho com o qual você se importa, e uma recusa que você pode contornar é uma recusa que não encerra sua execução no minuto 70.

O número que se moverá em seguida

A Anthropic disse que Claude Sonnet 5.5 e Claude Haiku 5.5 chegam "nas próximas semanas", e isso vai redefinir o preço de cada uma dessas demos sem alterar seu formato: uma tarifa por token mais barata diante de uma contagem de tokens que ninguém consegue prever com antecedência. A mesma incerteza que tornou os números da primeira semana inutilizáveis se aplicará aos da próxima geração, e é por isso que se deve criar o hábito agora, e não depois que o corte de preço acontecer de novo.

Por enquanto, o resumo honesto é curto. O Claude Opus 5.5 é real, está disponível em geral e custa $4 e $20, com as leituras em cache mais baratas que a linha já teve. As demos que produziu nos seus primeiros quatro dias são notáveis, e os respetivos preços são meras anedotas. Se quiser um custo para a sua própria carga de trabalho, o único instrumento que o lê é a sua própria execução, com limite definido, e com a fatura lida depois.

A three-card graphic titled 'Claude Opus 5.5 — what the demos reported', with the first card reading 'Lens lab: One shot, 1h 26m / $25.66 reported', the second reading 'Blender castle: 35 min, 199,600 output tokens / $13.30 reported / output at list price: $3.99', the third reading 'Reddit build: $3.21 reported / no breakdown published', over a footer reading 'Demo costs are builder-reported and unauditable; unit prices per Anthropic.'A single-column rate card for Claude Opus 5.5 with rows reading Input: $4.00 / M tokens; Output: $20.00 / M; Cache read: $0.20 / M; Cache write, 5 min: $5.00 / M; Batch API: 50% off both ways; Default effort: medium, over a footer reading 'Prices per Anthropic, September 25, 2026. Vendor performance claims not shown.'OrcaRouter model page for anthropic/claude-opus-5.5 showing the pricing row of $4.00 input and $20.00 output per million tokens, a p50 time-to-first-token of 6.19 seconds, a 1M-token context with 128K max output, capability chips for vision, tools, JSON and reasoning, the public benchmarks by Anthropic dated 2026-09-22, and OpenAI-compatible and Anthropic SDK code samples pointing at api.orcarouter.ai.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente