
Preços da API do Claude Opus 5: US$ 5 / US$ 25 por 1M de tokens, cache a US$ 0,50 e quanto isso realmente custa
- DeepSeekNOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.32026-08-1860Inteligência75Código
- obsidianNOVOQwen3.8 27B2026-08-1552Inteligência68Código
- qwenNOVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligência69Código
- grokNOVOSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
Claude Opus 5 custa $5,00 por milhão de tokens de entrada e $25,00 por milhão de tokens de saída na API Claude Opus 5 — a mesma taxa que o modelo apresenta no diretório OrcaRouter, verificada em 18/08/2026, com markup zero. Isso o torna metade do preço do Claude Fable 5 e exatamente o que o Claude Opus 4.8 custava, e a tabela de preços na página ativa do modelo Claude Opus 5 é a referência para orçamento. As alavancas importam mais do que o preço de destaque: a entrada reutilizada é cobrada a $0,50 por milhão via cache de prompt, o lote cai para $2,50 / $12,50, e o beta do modo rápido fica em $10 / $50. Esta página é a referência de preços do modelo — a tabela exata, o custo real de uma solicitação, como o preço se compara ao do mercado, quando não é a compra certa e como chamá-lo por meio de um endpoint compatível com OpenAI com sua própria chave.
Os preços são por milhão de tokens (entrada / saída), em vigor em 2026-08-18. Os valores em dólares são lidos das tarifas de API publicadas pela Anthropic e conferidos com a página do modelo OrcaRouter para o Claude Opus 5; as tarifas de cache, lote e modo rápido são anunciadas pela Anthropic. Os preços mudam — verifique antes de construir.
O preço exato, verificado hoje
Aqui está a tabela de preços completa para Claude Opus 5, verificada em 2026-08-18:

• Input — US$ 5,00 por 1M de tokens em cache miss.
• Saída — $25,00 por 1M de tokens.
• Escrita de cache de prompt — $6,25 por 1M com TTL de 5 minutos, $10,00 por 1M com TTL de 1 hora.
• Leitura de cache de prompt — US$ 0,50 por 1M de tokens, um desconto de 90% em qualquer entrada que você reenviar.
• Batch API — $2,50 de entrada / $12,50 de saída, com um desconto fixo de 50%, assíncrona.
• Modo rápido — $10 de entrada / $50 de saída, um prêmio de 2x para até aproximadamente 2.5x de velocidade de saída, Anthropic beta.
• Janela de contexto — 1M de tokens, até 128K de saída.
O OrcaRouter repassa a tarifa do provedor sem margem de lucro, portanto o valor no diretório é o valor que você paga. Na página do modelo ao vivo, o cartão mostra $5.00 / $25.00 por 1M, leitura de cache $0.500, gravação de cache $10.00 (a taxa de TTL de 1 hora), com os selos Vision, Tools, JSON e Reasoning.
As alavancas que alteram o preço efetivo
A taxa base é apenas o ponto de partida. Três modificadores mudam o que o Opus 5 realmente custa para você:
• Cache de prompt — o contexto reutilizado custa US$ 0,50 por milhão, em vez de US$ 5 para um novo. O prefixo mínimo cacheável caiu para cerca de 512 tokens no Opus 5, então até um prompt de sistema estável e modesto se qualifica. Para qualquer agente ou chat que reenvie um prefixo grande a cada turno, o cache é a maior alavanca na conta — e como a Anthropic chaveia o cache por chave de API, permanecer em uma única chave (um único canal) é o que mantém os acertos chegando.
• Lote — A API de lote da Anthropic executa jobs de forma assíncrona, com resultados normalmente disponíveis em até 24 horas, por exatamente metade do preço: US$ 2,50 / US$ 12,50. Ela combina com cache de prompt e atende a avaliações, classificação em massa e geração offline, onde a latência não importa.
• Fast mode — $10 / $50 para até ~2,5x de throughput de saída, útil para trabalhos de alta produção onde a latência é crítica. Não é compatível com a API em lote e é um beta de primeira parte da Anthropic; a taxa padrão de repasse de um roteador é a base de $5 / $25.
O que uma solicitação realmente custa
Os preços por token são abstratos, então aqui estão exemplos práticos às taxas de hoje:
• Chamada única de chat, 50K de entrada + 20K de saída — $0.25 + $0.50 = $0.75.
• 1M de entrada + 1M de saída — $5 + $25 = $30.
• Turno agêntico, 200K de contexto em cache + 20K de entrada nova + 30K de saída — $0.10 + $0.10 + $0.75 = $0.95. O mesmo turno com cache frio — 220K de entrada nova a $1.10 — totaliza $1.85. O uso de cache reduz quase pela metade.
• Um mês de 10M tokens com divisão de 70% entrada / 30% saída, com 80% da entrada servida pelo cache: 1.4M de entrada nova ($7.00) + 5.6M em cache ($2.80) + 3M de saída ($75) ≈ $85. Sem cache, o mesmo mês é $110.
Dois avisos elevam a taxa efetiva. O Opus 5 é um modelo de pensamento — o pensamento adaptativo está ativado por padrão, e os tokens de pensamento são cobrados como saída a US$ 25 por milhão. Um prompt difícil em uma configuração de alto esforço pode gastar uma grande parte do orçamento de saída com raciocínio, então o custo efetivo de saída em trabalhos difíceis fica bem acima de uma estimativa ingênua. E o tokenizador atual da Anthropic é mais verboso que o da geração anterior, então o mesmo texto em inglês custa mais tokens (e mais dinheiro) do que custava nos modelos Claude mais antigos. Reduza a configuração de esforço para chamadas fáceis e limite a saída sempre que puder.
Como os preços do Opus 5 se comparam aos da concorrência

Lido conforme os preços de tabela publicados em 18/08/2026:
• Claude Opus 4.8 — $5 / $25. Preço idêntico ao da geração anterior. O Opus 5 tem o mesmo custo para o modelo mais novo, o que facilita a atualização.
• Claude Fable 5 — $10 / $50. O Opus 5 custa metade do preço do nível superior da Anthropic, com o mesmo contexto de 1M de tokens.
• Claude Sonnet 5 — $3 / $15 padrão ($2 / $10 introdutório até 31 de agosto de 2026). O nível Sonnet é 40% mais barato na entrada e na saída — o padrão natural quando você não precisa de raciocínio no nível Opus.
• GPT-5.6 Sol — $5 / $30. Mesmo preço de entrada, saída mais barata no Opus 5.
• GPT-5.6 Terra — $2 / $12. O nível intermediário de volume para trabalho de alto volume não-frontier.
• Gemini 3.6 Flash — $1.50 / $7.50. Um modelo de nível Flash para tráfego multimodal barato e rápido.
• Kimi K3 — $3 / $15. Um carro-chefe de pesos abertos a aproximadamente metade das tarifas da Opus.
• DeepSeek V4 Pro — $0,44 / $0,88 fora de pico (os horários de pico dobram o valor). O carro-chefe barato de pesos abertos, um universo de preços totalmente diferente.
A abordagem honesta: Opus 5 não é um modelo barato — é um carro-chefe custando metade do topo de linha (Claude Fable 5) e exatamente o que a geração anterior custava. Ele vence no preço por contexto longo e no preço por raciocínio difícil, não na tarifa absoluta. Se o seu tráfego é de prompts curtos e tarefas simples, um Sonnet de $3 ou um modelo DeepSeek de $0,44 é a opção mais barata.
Quando o Opus 5 é a escolha errada
Quatro casos em que este preço não é o que você quer:
Prompts curtos e simples. Abaixo de cerca de 20 mil tokens, sem raciocínio profundo, o prêmio do Opus é desperdiçado. O Claude Sonnet 5 a $3 / $15 (ou $2 / $10 pela janela introdutória) atende à faixa de volume por 40% a menos, e um modelo da classe Gemini Flash ou DeepSeek custa muito menos ainda.
Volume com uso intenso de raciocínio. Como o raciocínio é cobrado como saída, um prompt difícil com alto esforço pode custar bem acima da linha nominal de saída. Se sua carga de trabalho envolver muitas chamadas difíceis, meça os tokens de saída reais antes de se comprometer — a taxa efetiva pode surpreender você.
Preço por token como único objetivo. Se uma pontuação de benchmark de fronteira ou o contexto de 1M não for um requisito obrigatório, os carros-chefe mais baratos (GPT-5.6 Terra, DeepSeek V4 Pro) ou modelos da camada Flash (Gemini 3.6 Flash) oferecem taxas por token muito mais baixas para a grande maioria do tráfego.
Orçamentos de latência rigorosos. Opus 5 é um grande modelo de raciocínio — p50 time-to-first-token em torno de 7 segundos na medição de 7 dias do OrcaRouter. Para chat em tempo real onde TTFT abaixo de um segundo importa, é o modelo errado, independentemente do preço.
Como chamá-lo no OrcaRouter

O Claude Opus 5 está hospedado no OrcaRouter como ID de modelo anthropic/claude-opus-5, servido por meio do endpoint compatível com OpenAI em api.orcarouter.ai/v1 à taxa do provedor, sem nenhum acréscimo. Se você já tem um cliente OpenAI, a migração é uma mudança de URL base e de ID do modelo — nada mais. A mesma chave e o mesmo endpoint dão acesso a mais de 200 modelos; assim, o Opus 5 fica ao lado do Claude Sonnet 5, do Claude Haiku 4.5, dos níveis GPT-5.6, da família Gemini e dos modelos de pesos abertos que você pode querer comparar com ele, e você pode rotear por dificuldade em vez de reintegrar cada um.
Dois detalhes do OrcaRouter que merecem destaque em uma página de preços. BYOK: traga sua própria chave da Anthropic e a Anthropic cobra você diretamente pelas próprias tarifas — o OrcaRouter acrescenta $0 por token e mantém os limites de taxa e créditos do seu provedor intactos. Guardrails: o PII Shield e a política de conteúdo são executados antes da cobrança, então uma solicitação bloqueada retorna um 400 limpo e nunca é cobrada, e o Agent Firewall avalia chamadas de ferramentas e MCP antes de serem executadas.
A nota de honestidade que importa para uma página de preços: nós roteamos o modelo, não definimos o preço dele. O valor de $5 / $25 é a tarifa da Anthropic repassada, e quando a Anthropic a altera, a listagem acompanha — que é exatamente o motivo pelo qual esta página é datada. Se você chamar a Anthropic diretamente, obtém a mesma tarifa; a OrcaRouter existe para a rota de chave única e sem margem, se você quiser um único endpoint em toda a linha de modelos.
Fontes e data
Todos os preços acima foram verificados em 2026-08-18. Os valores da Claude são lidos a partir dos preços de API publicados pela Anthropic e conferidos com a página do modelo OrcaRouter para Claude Opus 5 (verificada no mesmo dia). Os preços pós-corte do GPT-5.6 são as taxas publicadas pela OpenAI; os valores da Gemini, Kimi e DeepSeek são as listagens atuais do diretório OrcaRouter, com o DeepSeek V4 Pro exibido na sua tarifa fora de pico (as janelas de pico dobram o valor). Os preços da Anthropic estão estáveis desde o lançamento do Opus 5 em 24 de julho de 2026, mas eles mudam — trate qualquer página anterior de "preços do Opus 5" que você encontrar com a data de verificação. Os números aqui são atuais a partir de hoje.
Cada preço acima é a taxa em tempo real na página do modelo Claude Opus 5 — verificado em 2026-08-18 com margem zero, pronto para sua própria chave.
Comparados neste artigo4
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
