
Claude Fable 5.1 vs Claude Fable 5: O que a atualização do carro-chefe da própria Anthropic realmente traz
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligência69Código
Claude Fable 5.1 é o atual carro-chefe da Anthropic, lançado em 1º de setembro de 2026, e a comparação que mais importa para a maioria das equipes é a que a própria Anthropic criou: Claude Fable 5.1 contra Claude Fable 5, o carro-chefe de 9 de junho que ele substitui. O preço é idêntico — US$ 10,00 por milhão de tokens de entrada e US$ 50,00 por milhão de tokens de saída para ambos — e a janela de contexto de 1 milhão de tokens também. O que mudou é a natureza do trabalho agêntico de longa duração: os próprios números da Anthropic mostram que o Fable 5.1 mais que dobra o desempenho do Fable 5 em seu benchmark mais difícil de agente científico, e a reportagem desta semana sobre como as empresas estão tratando a família Fable no que diz respeito à retenção de dados confere a essa atualização um segundo diferencial, ainda mais incisivo, para quem precisa escolher entre os dois hoje.
Uma nota sobre datas e fontes, desde já: o Claude Fable 5.1 foi lançado em 1º de setembro, então o modelo em si tem duas semanas, não é uma notícia de última hora. O que é atual é a reportagem de 14 de setembro de 2026 — atribuída ao The Information — de que a Nvidia, a Palantir e a Booz Allen estão restringindo o uso da família Fable da Anthropic devido a preocupações com a retenção de dados corporativos sensíveis, e que a Anthropic introduziu, em junho, registros de uso rotativos de 30 dias para monitoramento de segurança, com a opção de o cliente armazenar esses registros por conta própria, "ainda podem ser revogados". Essa reportagem é atribuída a fontes e ainda não foi confirmada de forma independente. Tudo o que está rotulado abaixo como relatado pelo fornecedor é a própria planilha de benchmark da Anthropic e não foi reproduzido por uma parte neutra.
A ficha técnica, dimensão por dimensão
• Preço — Claude Fable 5.1: US$ 10,00 de entrada / US$ 50,00 de saída por 1M de tokens, o mesmo que o Claude Fable 5. Nenhum dos dois preços mudou na atualização.
• Entrada em cache — Claude Fable 5.1 $0,25 por 1M de tokens, queda de 75% em relação aos $1,00 do Claude Fable 5. Gravações de cache $12,50 (5 minutos) / $20 (1 hora); modo em lote $5 / $25.
• Contexto e saída — ambos trazem uma janela de entrada de 1M tokens e até 128K tokens de saída; ambos aceitam entrada de texto e imagem; ambos ficam atrás da mesma interface de raciocínio adaptativo, com um ajuste de esforço que vai de baixo a máximo.
• Pontuação independente — na versão atual do Intelligence Index da Artificial Analysis, o Claude Fable 5.1 alcança 53, primeiro entre os 201 modelos acompanhados, a 67,2 tokens de saída por segundo e US$ 7,63 por tarefa do índice. O número do índice na escala de lançamento do Claude Fable 5 (62) antecede a reformulação de setembro e não é comparável, portanto não citamos um número na escala atual para ele.
• Benchmarks de fornecedores — A Anthropic relata Claude Fable 5.1 com 52,6% no Terminal-Bench-Science 0.1 contra 24,7% para Claude Fable 5; 55,8% no Terminal-Bench 4.0 contra 42,0%; 31,4% no AutomationBench contra 17,1%; e 73,4% no CursorBench 3.2.0 contra 70,5%.
• Lançados — Claude Fable 5.1 em 1º de setembro de 2026; Claude Fable 5 em 9 de junho de 2026.
Onde a atualização é realmente uma atualização
A grande jogada do lançamento do Fable 5.1 é que nada na tabela de preços mudou e quase tudo na planilha de benchmarks mudou. Os ganhos concentram-se em trabalho agêntico de longo horizonte com uso de ferramentas — o Terminal-Bench-Science 0.1 mais que dobrou, de 24,7% para 52,6%, o Terminal-Bench 4.0 subiu de 42,0% para 55,8%, e o AutomationBench quase dobrou, de 17,1% para 31,4%. No Humanity's Last Exam, a Anthropic relata 60,9% sem ferramentas e 65,0% com elas, contra 57,8% e 63,8% do Claude Fable 5. Leia esses números como direções de tendência: são a tabela do próprio fornecedor, e as maiores alegações de números individuais descrevem o irmão de acesso restrito, Claude Mythos 5.1, que compartilha os mesmos pesos, mas com salvaguardas mais rígidas.

A segunda alavanca é o custo, e ele importa mais do que qualquer benchmark individual. A entrada em cache caiu de $1,00 para $0,25 por milhão de tokens, e execuções agênticas longas são onde a releitura domina: a saída de ferramentas, o conteúdo de arquivos e turnos anteriores são reenviados repetidamente. A Anthropic estima um custo efetivo cerca de 25% menor em cargas de trabalho típicas faturadas por token e de até 45% em cargas altamente agênticas — uma estimativa do fornecedor, mas a mudança de preço subjacente é verificável na tabela de preços. Um agente de horizonte longo que relê um contexto de 100 mil tokens cinquenta vezes ao longo de uma tarefa paga $5,00 em leituras de cache no preço do Claude Fable 5 e $1,25 no do Claude Fable 5.1. Em uma frota de agentes, essa linha deixa de ser um erro de arredondamento.
A terceira mudança é a que os usuários da geração anterior sentem primeiro: o classificador de segurança. Os desenvolvedores apelidaram o comportamento antigo de "depressão do Fable" — dinheiro de modelo de ponta por uma saída que era discretamente redirecionada para um modelo mais fraco quando o classificador sinalizava solicitações benignas. A Anthropic diz que as salvaguardas cibernéticas do Fable 5.1 agora produzem cerca de 60% menos intervenções por sessão do Claude Code, e que as salvaguardas biológicas são acionadas 85% menos vezes em solicitações benignas do que no lançamento do Fable 5. Se as suas reclamações sobre o modelo de junho eram sobre transferências no meio da tarefa, esta é a atualização que as resolve diretamente.
A história de retenção desta semana, e o que isso faz com a decisão
A reportagem de 14 de setembro é a parte que muda o cálculo para as empresas, porque a família Fable é onde está o modelo mais capaz da Anthropic — e porque a postura de retenção de dados é exatamente o tipo de coisa que um comprador regulado não pode simplesmente ignorar. Segundo as informações publicadas, a Anthropic introduziu em junho registros de uso com janela móvel de 30 dias para monitoramento de segurança; os clientes foram informados de que poderiam, em vez disso, armazenar esses registros por conta própria; e a reportagem diz que essa opção "ainda pode ser revogada". A Palantir é descrita como retendo o Fable até obter garantias irrevogáveis de retenção zero de dados, a Nvidia como limitando o Fable a trabalhos menos sensíveis, e a Booz Allen como excluindo-o de trabalhos próprios de cibersegurança. Tudo isso é informação atribuída a fontes, nada disso é confirmado pelas empresas citadas, e o efeito prático é desigual: alguns clientes vão se importar muito, e outros não vão se importar nem um pouco.
Vale a pena ser preciso sobre o que isso faz com a decisão entre o 5.1 e o 5. A questão da retenção se aplica à família Fable como um todo — não é uma diferença nova entre os dois modelos, já que Fable 5 e Fable 5.1 compartilham a mesma postura de retenção. O que isso muda é o cálculo ponderado pelo risco: se sua carga de trabalho for sensível o bastante para que uma opção revogável de armazenamento próprio seja eliminatória, então nenhum dos modelos atende ao critério hoje, e a conversa deve ser conduzida com o roadmap Enterprise Frontier Safeguards (EFS) da Anthropic, que é descrito como introduzindo a retenção zero de dados de forma gradual a partir do outono de 2026 para clientes elegíveis. Se sua carga de trabalho não for tão sensível assim, as informações sobre retenção não devem dissuadir você de fazer um upgrade real de desempenho — mas isso deve constar no registro de decisão, em vez de ser descoberto mais tarde.

Quem deve escolher qual
Escolha o Claude Fable 5.1 quando o custo de uma resposta errada ou abandonada domina o custo dos tokens: investigação agêntica de longo horizonte, uso intenso de ferramentas, tudo o que vive dentro do Claude Code e cargas de trabalho em que uma leitura de cache 75% mais barata altera a sua economia unitária. Fique no Claude Fable 5 quando o seu tráfego é curto, de disparo único e tolerante a throughput — o preço é idêntico e as pontuações do modelo antigo continuam a ser de nível de fronteira — ou quando está a meio de um contrato e a sobrecarga da migração é real. O meio-termo honesto é não escolher de todo: ambos os modelos ficam atrás da mesma superfície da API da Anthropic, e se os chamar através de um único endpoint pode fazer escala para o Claude Fable 5.1 quando uma tarefa precisar do teto de raciocínio e deixar o par de preço idêntico e mais barato partilhar o failover sem um segundo contrato.
Na OrcaRouter, Claude Fable 5 e Claude Fable 5.1 estão ambos disponíveis pelos preços de tabela de seus provedores, sem nenhum acréscimo, então os US$ 10 / US$ 50 acima são o valor que aparece na fatura, e as mudanças de preço da própria Anthropic são repassadas no mesmo dia, em vez de serem absorvidas na margem de um revendedor. Testar a atualização com seu próprio tráfego é uma edição de regra de roteamento com failover automático — os dois modelos compartilham uma única chave, então o custo de troca é quase zero, e a fusão de modelos permite que um painel responda em conjunto quando uma tarefa é importante o suficiente para querer mais de uma opinião.

A versão curta: o Claude Fable 5.1 custa o mesmo que o Claude Fable 5, é cerca de duas vezes mais forte nos benchmarks de ciência agêntica que a Anthropic destaca, é 75% mais barato nas leituras de cache que dominam sessões longas e é consideravelmente menos propenso a repassar sua solicitação para um modelo mais fraco no meio da tarefa. O relatório de retenção de 14 de setembro é real e vale a pena ponderar se você for uma empresa com requisitos rigorosos de dados — mas ele se aplica à família, não a esta atualização específica, e deve ser uma linha em uma decisão que os benchmarks e a matemática do cache já decidiram.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
