Claude Opus 5: Modelo Quase-Fronteira da Anthropic pela Metade do Preço do Fable 5
Guides & Insights

Claude Opus 5: Modelo Quase-Fronteira da Anthropic pela Metade do Preço do Fable 5

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Em 24 de julho de 2026, Anthropic lançou Claude Opus 5 — e em um dia fez algo raro para um modelo "mais barato": subiu ao topo dos rankings independentes. A Anthropic apresentou o Opus 5 como chegando perto da inteligência de fronteira de Claude Fable 5 por metade do preço e foi lançado no mesmo dia em Claude.ai, Claude API, Claude Code e Claude Cowork. Desde então, a Artificial Analysis o classificou como o modelo #1 em seu Intelligence Index. Este guia cobre o que realmente é o Opus 5, o que foi verificado de forma independente versus relatado pelo fornecedor, seu novo dial de esforço e postura de segurança, quanto ele custa na prática e quem deve migrar.

Cada figura abaixo é rotulada por fonte, porque nessa velocidade a história muda diariamente: o que dizia "nenhuma pontuação independente ainda" no dia do lançamento agora é "independentemente #1." Benchmarks e preços mudam — verifique antes de comprometer o orçamento.

TL;DR. O Claude Opus 5 custa $5 por 1M de tokens de entrada e $25 por 1M de saída — idêntico ao Opus 4.8 e exatamente metade do preço do Fable 5 ($10 / $50). No Índice Artificial Analysis Intelligence, agora lidera com 61 (esforço máximo), o melhor modelo entre 170 avaliados, superando o Fable 5 (60) e igualando sua classe com metade do custo. Os benchmarks de lançamento da Anthropic corroboram isso: Frontier-Bench v0.1 43.3% (contra 33.7% do Fable 5), além de liderança no AutomationBench da Zapier e no benchmark de uso de computador OSWorld 2.0. Duas coisas o tornam mais que um corte de preço: um dial de esforço (baixo/médio/alto/máximo) que troca custo por capacidade por requisição, e a postura de segurança mais forte de qualquer Opus até agora. Se você já constrói com Claude, atualizar é de baixo risco e não aumenta sua conta; se está escolhendo entre os modelos principais, o Opus 5 agora é o líder em valor e qualidade — valide-o com sua própria carga de trabalho.

Principais conclusões

• Agora independentemente #1. A Artificial Analysis lista o Claude Opus 5 (esforço máximo) com 61 em seu Intelligence Index — o modelo melhor classificado, à frente do Fable 5 (60).

• Metade do preço do Fable 5. $5 / $25 por 1M de tokens, o mesmo que o Opus 4.8 e metade dos $10 / $50 do Fable 5 — qualidade de ponta por um preço intermediário.

• Novo dial de esforço. Configurações baixo/médio/alto/máximo trocam tokens (custo) por capacidade; "máximo" é o que lidera o placar, configurações mais baratas ainda superam a maioria dos concorrentes.

• Construído para agentes e uso em computador. A Anthropic enfatiza a conclusão de tarefas de múltiplas etapas (AutomationBench) e a condução de uma interface de usuário real (OSWorld 2.0), não apenas respostas únicas.

• O Opus mais seguro até agora. A Anthropic o chama de "o modelo Opus mais alinhado", esperando que seus classificadores cibernéticos intervenham cerca de 85% menos vezes que o Fable 5 — menos recusas falsas em trabalhos legítimos.

• Ampla disponibilidade imediata. Modelo padrão no Claude Max, mais forte no Claude Pro, e disponível na API, no Claude Code e no Claude Cowork desde o primeiro dia.

Uma nota sobre a leitura deste resumo: tudo atribuído à Anthropic é uma alegação do fornecedor a partir de materiais de lançamento; números independentes (o Intelligence Index) são atribuídos à Artificial Analysis. Quando um número ainda não foi publicado (uma pontuação separada do SWE-bench Verified), dizemos isso em vez de adivinhar.

O que realmente é o Claude Opus 5

Opus 5 é o mais novo membro da linha Opus da Anthropic — o nível "pesado" acima de Sonnet e Haiku. Ele se posiciona acima do Opus 4.8 e, no independente Intelligence Index, agora ultrapassou o Fable 5, o carro-chefe de fronteira da Anthropic de junho de 2026. O que o torna notável não é um modesto aumento de capacidade, mas a combinação: inteligência quase no topo da tabela a um preço de cavalo de batalha. A Anthropic o descreve como um modelo "atento e proativo" voltado para codificação, fluxos de trabalho agentivos e trabalho corporativo diário.

Concretamente, o Opus 5 custa $5 por 1M de tokens de entrada e $25 por 1M de tokens de saída. Isso é o mesmo que o Opus 4.8, e metade dos $10 / $50 do Fable 5. É o padrão no Claude Max e a opção mais forte no Claude Pro, e está disponível através da API Claude, Claude Code (para programação) e Claude Cowork (para trabalho de agente colaborativo) a partir do dia do lançamento. A janela de contexto é da classe Opus-family 1M.

O que há de realmente novo

O sinal mais claro no dia do lançamento foi o Frontier-Bench v0.1 da Anthropic, um conjunto difícil de raciocínio e tarefas: Opus 5 atinge 43,3%, contra 33,7% do Fable 5 e 18,7% do Opus 4.8. Nesse benchmark, o novo modelo mais barato da Anthropic supera seu próprio carro-chefe mais caro — uma afirmação que desde então foi ecoada por avaliações independentes.

Mais dois benchmarks de fornecedores completam a história de "construído para trabalho real". No AutomationBench da Zapier, que mede se um modelo conclui uma tarefa de negócio em vez de apenas iniciá-la, a Anthropic afirma que a taxa de aprovação do Opus 5 é aproximadamente 1,5 vezes a do modelo mais próximo com custo equivalente, e que mesmo sua configuração de menor esforço supera o melhor resultado de qualquer concorrente. No OSWorld 2.0, um benchmark de uso de computador, a Anthropic relata que o Opus 5 supera os concorrentes em todos os pontos de preço e atinge a pontuação máxima do Fable 5 usando cerca de um terço do orçamento. O Opus 5 também melhora em relação ao Opus 4.8 em todas as avaliações de ciências da vida que a Anthropic acompanha, com o maior salto — mais de 10 pontos percentuais — em tarefas de química orgânica, como leitura de estruturas moleculares a partir de dados de espectroscopia.

O dial de esforço: pagando apenas pela capacidade que você precisa.

A funcionalidade principal — e aquela em que a maioria dos revisores se concentra — é a configuração de esforço. O Opus 5 permite escolher quanto esforço o modelo dedica a uma solicitação: baixo, médio, alto ou máximo. Esforço maior significa mais tokens de raciocínio interno (portanto, maior custo e latência) e maior qualidade; esforço menor conserva tokens para respostas mais rápidas e baratas. É, na prática, um regulador para a sua conta de IA.

É por isso que a Artificial Analysis lista várias entradas do Opus 5 (medium, high, xhigh, max): cada nível de esforço é um ponto diferente na curva de custo-qualidade. A configuração "max" é a que atualmente lidera o Intelligence Index com 61; as configurações mais baixas trocam um pouco de qualidade por um custo por tarefa significativamente menor, e até elas, segundo a Anthropic, superam os melhores resultados da maioria dos concorrentes. Na prática, isso significa que um único modelo pode atender tanto às suas chamadas sensíveis à latência e de alto volume (low/medium) quanto aos seus trabalhos de raciocínio mais difíceis (high/max) — você ajusta por solicitação em vez de trocar de modelo.

O mergulho profundo no benchmark: o que esses testes realmente medem

Ajuda saber o que cada número significa antes de confiar nele. O Artificial Analysis Intelligence Index é uma compilação de várias avaliações independentes (raciocínio, matemática, programação, conhecimento) realizadas por terceiros; uma pontuação de 61 colocando Opus 5 em primeiro lugar entre 170 modelos é o sinal único mais crível aqui, precisamente porque a Anthropic não o realizou. Frontier-Bench v0.1 (43,3% para Opus 5) é o conjunto difícil da própria Anthropic — um sinal relativo de que o Opus 5 resolve problemas mais difíceis que o Fable 5 (33,7%) ou Opus 4.8 (18,7%), não "43% correto" no sentido escolar.

AutomationBench e OSWorld 2.0 importam mais do que uma única pontuação de raciocínio se o seu caso de uso são agentes. AutomationBench recompensa a conclusão de tarefas — a diferença entre um agente que redige um e-mail e um que realmente registra o relatório de despesas — e o OSWorld 2.0 recompensa a condução de uma interface de computador real. A afirmação da Anthropic de que o Opus 5 corresponde ao pico do OSWorld do Fable 5 por um terço do custo é, agora que o Intelligence Index corrobora sua posição geral, um forte argumento para transferir cargas de trabalho agentivas para o Opus 5. A única lacuna: ainda não há um número separado auditado independentemente do SWE-bench Verified para o Opus 5 (Fable 5 está em 95.0%, Opus 4.8 em 88.6%), portanto, para uma citação de precisão de codificação pura, aguarde esse número.

O que custa na prática

Os preços por token são abstratos; o preço por tarefa é o que aparece na sua fatura. Considere uma etapa representativa de um agente com 20.000 tokens de entrada e 3.000 tokens de saída. Opus 5 (e Opus 4.8): entrada de 20k × $5/1M = $0,10, saída de 3k × $25/1M = $0,075, totalizando cerca de $0,175 por chamada. Fable 5 a $10 / $50: $0,20 de entrada + $0,15 de saída = cerca de $0,35 — aproximadamente o dobro. Em 100.000 chamadas desse tipo por mês, isso dá cerca de $17.500 no Opus 5 contra cerca de $35.000 no Fable 5. Como o Intelligence Index agora coloca o Opus 5 à frente do Fable 5, não se trata de "quase Fable 5 por menos" — é qualidade de classe líder por cerca de metade da fatura mensal.

O dial de esforço muda a matemática novamente. Um pipeline de suporte de alto volume pode executar a maioria das chamadas com esforço baixo ou médio — mais barato do que os números acima — e reservar o esforço máximo para o punhado de tickets realmente difíceis. O argumento da Anthropic é que mesmo as configurações baratas superam as melhores dos concorrentes, então você raramente paga por capacidade que não usa. Modele sua própria combinação de níveis de esforço, em vez de assumir que toda chamada é executada no máximo.

Como acessar e usar Claude Opus 5

O Opus 5 está disponível imediatamente em cinco lugares: Claude.ai (onde é o padrão no plano Max e a opção mais forte no Pro), a API Claude (ID do modelo na documentação da Anthropic), Claude Code (para codificação em terminal e IDE) e Claude Cowork (para trabalho agente colaborativo e de várias etapas). Os usuários da API definem o nível de esforço como um parâmetro, então a compensação custo-capacidade é programável por solicitação. Se você já chama o Opus 4.8, a mudança é uma alteração no ID do modelo pelo mesmo preço — a atualização de menor atrito que a Anthropic lançou em um tempo.

Para quem é: três cenários.

1. Pipelines agentivos e de uso de computador

Se seu produto executa agentes com múltiplas etapas ou controla um navegador ou desktop, os resultados do AutomationBench e do OSWorld 2.0 do Opus 5 são direcionados diretamente a você — agora respaldados por um Índice de Inteligência independente #1. Execute a maioria das etapas com esforço médio e aumente para alto/máximo nas difíceis; pilote com seus próprios traços de agente antes de se comprometer.

2. Equipes de codificação observando o orçamento

Opus 5 está no Claude Code desde o primeiro dia pelo preço do Opus 4.8. Com a liderança do Índice de Inteligência, é um codificador padrão forte; a única citação ausente é um número independente do SWE-bench Verified (o Fable 5 ainda detém isso com 95.0%). Para equipes que já estão no Claude, a atualização é de baixo risco e sem aumento de preço.

3. Empresas padronizando-se em um modelo

Ampla disponibilidade, contexto de classe 1M, o perfil de alinhamento Opus mais seguro e um dial de esforço que cobre tanto trabalho barato em massa quanto raciocínio difícil fazem do Opus 5 um único padrão plausível para trabalho misto de escritório e engenharia — a um custo muito mais fácil de defender do que um carro-chefe de fronteira.

Segurança e alinhamento

Anthropic posiciona o Opus 5 como seu lançamento Opus mais seguro: "o modelo Opus mais alinhado" e "o menos suscetível de ser enganado para uso indevido." Uma consequência prática é importante para implantações reais: a Anthropic espera que os classificadores cibernéticos do Opus 5 interviessem cerca de 85% menos vezes do que os do Fable 5. Em termos simples, isso deve significar menos recusas falsas em trabalhos legítimos de segurança, codificação ou pesquisa — uma frustração comum com modelos de fronteira fortemente protegidos — enquanto mantém o uso indevido genuíno bloqueado. Como sempre, valide de acordo com seu próprio conteúdo e requisitos de conformidade, em vez de aceitar a postura por fé.

A história de controle de exportação do Fable 5 agora está no prompt do sistema.

O lançamento do Fable 5 não foi nada tranquilo, e esse contexto importa para quem compara Claude Opus 5 com ele. Três dias depois de Claude Fable 5 e Claude Mythos 5 terem sido lançados em 9 de junho de 2026, a Anthropic suspendeu ambos os modelos para cumprir uma ordem de controle de exportação do Departamento de Comércio dos EUA; os controles foram suspensos em 30 de junho e o acesso foi restaurado em 1º de julho. Essa sequência é história documentada — Simon Willison viu a API da Anthropic começar a retornar erros em tempo real, e a Anthropic publicou sua própria declaração sobre a suspensão e a restauração.

A novidade é como o Opus 5 lida com perguntas sobre isso. A data de corte do treinamento do modelo é maio de 2026, portanto o desligamento e sua reversão estão fora do que ele aprendeu. O prompt de sistema de aproximadamente 200.000 caracteres do Claude Opus 5, que o red-teamer Pliny the Liberator publicou em 25 de julho — um documento que a Anthropic não confirmou corresponder à produção — registra a linha do tempo completa e instrui o modelo a responder perguntas sobre a suspensão de forma direta, em vez de negá-la, apontando os usuários para a declaração oficial da Anthropic quando não puder confirmar o status atual. É um exemplo concreto de um fornecedor escrevendo a história pós-corte no prompt para que o modelo não improvise sobre sua própria família.

Quando não usá-lo

Não recorra ao Opus 5 quando você precisa especificamente de um número de codificação verificado pelo SWE-bench auditado independentemente para citar hoje — esse número ainda não foi publicado, e o Fable 5 (95,0%) ainda o possui. Não presuma que toda configuração de esforço é a #1; a configuração máxima que lidera o ranking é 61, e configurações mais baixas trocam um pouco de qualidade por custo, então avalie o nível de esforço que você realmente usará. E para texto puro de alto volume e sensível à latência, sem necessidade de raciocínio, um modelo de nível de eficiência mais barato (por exemplo Gemini 3.6 Flash a $1.50 / $7.50) ainda será mais barato por token — Opus 5 é um modelo de raciocínio e agente, não um modelo de texto em massa.

Perguntas Frequentes

Quanto custa o Claude Opus 5?

$5 por 1M tokens de entrada e $25 por 1M tokens de saída — o mesmo que Opus 4.8, e metade do preço de Fable 5 de $10 / $50. [Anthropic]

O Opus 5 é realmente o modelo #1?

No Artificial Analysis Intelligence Index, sim no momento em que escrevo: Claude Opus 5 (max effort) lidera com 61 de 170 modelos, à frente do Fable 5 (60). Essa é uma pontuação independente, não uma afirmação do fornecedor. Outros rankings e sua própria carga de trabalho podem classificar de forma diferente, e as classificações mudam à medida que os modelos são adicionados.

O que é o dial de esforço?

Uma configuração por solicitação (baixa/média/alta/máxima) que troca tokens — e, portanto, custo e latência — por capacidade. A máxima lidera o ranking; configurações mais baratas ainda superam a maioria dos concorrentes, segundo a Anthropic. Usuários da API a definem como um parâmetro.

Opus 5 é melhor que Fable 5?

No Índice de Inteligência independente (61 vs 60) e no Frontier-Bench v0.1 da Anthropic (43,3% vs 33,7%), sim — pela metade do preço. O Fable 5 ainda lidera o SWE-bench Verified medido independentemente (95,0%), então, para citações de precisão de código puro, o Fable 5 mantém essa coroa específica.

Como o Opus 5 se compara ao Opus 4.8?

Mesmo preço de $5/$25, benchmarks de fornecedor materialmente mais altos (Frontier-Bench v0.1 43,3% vs 18,7%) e ganhos em todas as avaliações de ciências da vida rastreadas, além do novo dial de esforço e alinhamento mais seguro. Para usuários existentes da versão 4.8, é uma atualização sem aumento de preço.

Quão seguro é?

A Anthropic o chama de modelo Opus mais alinhado e o menos suscetível a uso indevido, e espera que seus classificadores cibernéticos intervenham cerca de 85% menos vezes que os do Fable 5 — tipicamente menos recusas falsas em trabalho legítimo.

Onde posso usar o Claude Opus 5?

Claude.ai (padrão no Max, mais forte no Pro), a API Claude, Claude Code e Claude Cowork — ativo desde 24 de julho de 2026.

Qual é a janela de contexto?

Classe de 1M tokens da família Opus (Opus 4.8 é 1M sem sobretaxa de contexto longo). A Anthropic não divulgou separadamente um valor para o Opus 5, portanto, trate-o como classe 1M até confirmação.

Isso suporta imagens ou vídeo?

Opus 5 é principalmente um modelo de raciocínio para texto e ferramentas. Para compreensão multimodal pesada (imagem/vídeo), um modelo como Gemini 3.1 Pro é projetado especificamente para isso; use Opus 5 para texto, código e agentes.

Conclusão

Claude Opus 5 revelou-se mais do que um movimento de preços. É precificado como um cavalo de batalha — $5/$25, metade do Fable 5 e igual ao Opus 4.8 — mas agora lidera o índice independente Artificial Analysis Intelligence Index com 61 (esforço máximo), apoiado por benchmarks fortes do fornecedor (Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0), um dial de esforço genuinamente útil e o perfil de alinhamento mais seguro de qualquer Opus. A única ressalva é um número ainda ausente do SWE-bench Verified independente, onde o Fable 5 (95.0%) mantém a citação de precisão de codificação. Para os usuários existentes do Claude, a atualização é de baixo risco e não aumenta a conta; para todos os outros, o Opus 5 é agora o modelo a ser batido em qualidade por dólar — valide-o em sua própria carga de trabalho e roteie-o junto com todos os concorrentes por meio de um endpoint compatível com OpenAI no OrcaRouter.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube