
Claude Fable 5.1: o carro-chefe Fable da Anthropic, totalmente especificado
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 262 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
O Claude Fable 5.1 é o modelo principal da classe Fable em disponibilidade geral, ativo desde 1º de setembro de 2026, e fica no meio de três nomes que os leitores costumam confundir. O Claude Fable 5 sem sufixo é o original de junho de 2026, que o Fable 5.1 substitui pelo mesmo preço por token. O Claude Fable 5.2 é um terceiro nome que nunca foi lançado e não tem página de fornecedor em lugar nenhum — incluindo a própria documentação, a tabela de preços e a sala de imprensa do fornecedor, nenhuma das quais o menciona. E o Claude Mythos 5.1 também não é um modelo separado: são os mesmos pesos do Claude Fable 5.1, vendidos por meio de um programa de acesso restrito. Esta página é a referência para o único modelo que um leitor realmente pode chamar hoje: seu envelope, sua tabela completa de preços, o que o fornecedor documenta sobre esforço e raciocínio, cada número de benchmark publicado e a configuração em que foi executado, a leitura independente e quanto custa na OrcaRouter.
A família Fable: três nomes, dois modelos, uma armadilha de sufixo
A confusão de sufixos não é cosmética — as três strings diferem num único dígito e conduzem a envelopes diferentes, a preços diferentes e, num dos casos, a absolutamente nada. Esclarecê-las primeiro é o que torna o resto desta página legível.
• Claude Fable 5 — lançado em 9 de junho de 2026 como o primeiro modelo da classe Fable da Anthropic. Ele ainda é disponibilizado e ainda tem preço idêntico ao de seu sucessor: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída, com leituras de cache a US$ 1,00 por milhão. É o modelo que a versão .1 substitui, e não é o modelo do qual esta página trata.
• Claude Fable 5.1 — este modelo. Lançado em 1º de setembro de 2026, com o mesmo valor de destaque de $10 / $50 do Claude Fable 5, mas com leituras de cache reduzidas para $0.25 e uma lista mais curta de mudanças de comportamento do que o aumento de versão sugere. A própria documentação da Anthropic o descreve como a versão a escolher "para raciocínio exigente e trabalho agêntico de horizonte longo".
• Claude Fable 5.2 — não existe como um modelo disponível para compra ou documentado. A sala de imprensa da Anthropic não lista nenhum anúncio desse tipo; sua visão geral de modelos, sua página de preços e sua página do modelo Fable 5.1 não trazem o nome; a Artificial Analysis não tem nenhum registro dele; e o catálogo da OrcaRouter retorna "modelo não encontrado". Textos que você talvez tenha visto são reportagens de pré-lançamento, que são um artigo diferente deste e estão vinculados abaixo em vez de serem rediscutidos aqui.
• Claude Mythos 5.1 — o mesmo modelo subjacente que Claude Fable 5.1, com salvaguardas ajustadas para trabalho de cibersegurança e ciências da vida, em vez de lançamento geral. Está disponível apenas por meio dos programas de acesso confiável da Anthropic (Project Glasswing e Cyber Verification Program), atualmente apenas para um conjunto de organizações dos EUA, e tem preço idêntico ao Claude Fable 5.1. Não está no catálogo do OrcaRouter, e esta página não é sobre ele.
O que foi lançado em 1º de setembro de 2026, e o que o modelo realmente é
Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1 em um único anúncio, em 1º de setembro de 2026, descrevendo-os como "os modelos mais avançados do mundo para programação e trabalho do conhecimento." Trata-se de uma alegação do fornecedor, citada como tal. A parte verificável do lançamento é mais restrita e mais útil: um modelo, dois perfis de salvaguarda e uma mudança de preço concentrada inteiramente na entrada em cache.
O envelope, segundo a própria página do modelo e a documentação da API da Anthropic: uma janela de contexto de 1.000.000 de tokens com preço padrão por token — sem acréscimo para contexto longo, então uma requisição de 900.000 tokens é cobrada à mesma tarifa que uma de 9.000 tokens — e até 128.000 tokens de saída. A entrada é texto e imagens; a saída é texto. Uso de ferramentas, visão, saídas estruturadas e trabalho multilíngue são todos suportados. As datas de corte do conhecimento confiável e dos dados de treinamento são ambas de junho de 2026.
A superfície da API: claude-fable-5-1 na API Claude oficial e na Claude Platform na AWS, Google Cloud e Microsoft Foundry; anthropic.claude-fable-5-1 no Amazon Bedrock. A Anthropic compromete-se a oferecer suporte a ele "não antes de 1º de setembro de 2027", que é o horizonte para planejar uma migração, e não uma data de descontinuação.
Há uma restrição de implantação que vale a pena conhecer antes de adotá-lo como padrão: o Claude Fable 5.1 opera com salvaguardas de produção que podem recusar uma solicitação de imediato, e a orientação de fallback da Anthropic importa na prática — uma recusa retorna um HTTP 200 normal cujo motivo de parada é refusal, não um erro. O anúncio também delineia um caminho de retenção de dados: a Anthropic afirma que seu novo sistema Enterprise Frontier Safeguards, que mantém os dados em infraestrutura de nuvem controlada pelo cliente, será implementado gradualmente para clientes empresariais a partir do final deste outono, e que, até lá, clientes elegíveis podem executar o Fable 5.1 com retenção zero de dados.

O tarifário completo, e para onde o dinheiro realmente foi.
Todos os números nesta seção são provenientes da própria documentação de preços da Anthropic, consultada em 28 de setembro de 2026. O preço base dos tokens permanece inalterado em relação ao Claude Fable 5: US$ 10,00 por milhão de tokens de entrada e US$ 50,00 por milhão de tokens de saída. A mudança está no cache.
• Entrada — $10,00 por milhão de tokens, idêntico ao Claude Fable 5.
• Saída — $50,00 por milhão de tokens, idêntico ao Claude Fable 5.
• Leitura de cache (um acerto) — US$ 0,25 por milhão de tokens, contra US$ 1,00 no Claude Fable 5. A Anthropic afirma que isso representa uma redução de 75%, e é todo o mecanismo por trás da história de custos do lançamento: um acerto de cache agora custa 2,5% do preço padrão de entrada, em vez de 10%.
• Gravação em cache — $12,50 por milhão de tokens para uma janela de cinco minutos, $20,00 por milhão para uma janela de uma hora. Estes valores não foram alterados em relação ao Claude Fable 5, portanto, o lado da escrita da operação não faz parte do desconto.
• API em lote — um desconto de 50% em ambas as direções, ou seja, US$ 5,00 por milhão de entrada e US$ 25,00 por milhão de saída para trabalho assíncrono.
• Residência de dados — solicitar inferência somente nos EUA acarreta o multiplicador padrão de 1,1x da Anthropic em todas as categorias de tokens.
A Anthropic modela o resultado em seu anúncio como um custo cerca de 25% menor em cargas de trabalho típicas e de até cerca de 45% em cargas de trabalho altamente agênticas, medido no esforço padrão ao longo de quatro semanas de uso em agosto de 2026. Essas duas porcentagens são estimativas do fornecedor com base nos próprios dados de uso da Anthropic, não são números auditados de forma independente, e valem apenas para cargas de trabalho que releem o contexto. Uma solicitação de turno único sem reutilização de cache custa exatamente o mesmo que custava no Claude Fable 5.

Esforço, raciocínio e a configuração em que cada benchmark foi executado
Esta é a parte da ficha técnica que a maioria das coberturas ignora, e é a parte que decide se duas pontuações publicadas são sequer comparáveis.
O Claude Fable 5.1 usa pensamento adaptativo, e o pensamento está sempre ativado — a página do modelo da Anthropic o lista como "Adaptativo (sempre ativado)", e não há modo que o desative. A forma de orçamento fixo mais antiga do pensamento estendido não é apenas desencorajada aqui: o parâmetro é rejeitado. Nos modelos Claude 4.7 e posteriores, uma solicitação que define thinking: {type: "enabled", budget_tokens: N} retorna um erro 400, e a documentação da Anthropic nomeia o Claude Fable 5.1 como um dos modelos afetados. A substituição é um ajuste de profundidade, e não um orçamento de tokens.
Esse controle é output_config.effort, e Claude Fable 5.1 suporta todos os cinco níveis: low, medium, high, xhigh e max. O padrão é high, que também é o que você obtém ao omitir o parâmetro completamente. A própria orientação da Anthropic é começar em high, subir para xhigh ou max para o trabalho agêntico e de codificação mais sensível à capacidade, e descer para medium ou low para trabalho rotineiro ou sensível à latência quando suas avaliações mostrarem que a qualidade se mantém. A Anthropic também afirma que com esforço Low ou Medium, o Fable 5.1 alcança resultados semelhantes ou melhores que o Claude Fable 5 a um custo muito menor — e que o modelo usa High effort por padrão no Claude Code e Medium no Claude Cowork e no Claude.ai, então o mesmo nome de modelo pode se comportar de forma diferente dependendo de qual superfície você o chama.
Agora, a pergunta que define o benchmark, respondida com precisão. A Anthropic publica cada um desses benchmarks como uma curva de precisão versus custo, traçada em todos os cinco níveis de esforço, e sua tabela comparativa principal não associa um único nível de esforço a um único número. O único valor no material da Anthropic que está atrelado a um nível de esforço é o CursorBench 3.2.0: a citação do parceiro no mesmo anúncio relata 73,4% "no esforço máximo", o que corresponde aos 73,4% na tabela. Todo o resto deve ser lido como a curva, não como o ponto — e é também por isso que uma mera comparação de pontuação com o modelo de outro laboratório, avaliado em um esforço diferente e com uma estrutura de avaliação diferente, diz muito pouco.
A planilha de benchmark, e quem a executou
Todos os números nesta seção são reportados pela Anthropic e não foram reproduzidos de forma independente. Duas ressalvas das próprias notas de rodapé da Anthropic devem acompanhá-los: o erro padrão do Terminal-Bench-Science 0.1 é de ±3,5–4,5 pontos por modelo, e as pontuações do OSWorld 2.0 referem-se à versão de tarefas de agosto de 2026 dos autores do benchmark, portanto não são comparáveis aos resultados do OSWorld 2.0 publicados anteriormente.
• Terminal-Bench-Science 0.1 — Claude Fable 5.1: 52,6% vs Claude Fable 5: 24,7%, Claude Opus 5: 29,0%, GPT-5.6 Sol: 22,4%. A formulação de "mais que o dobro" mantém-se, e a Anthropic observa que seu harness reproduz o resultado do Opus 5 no ranking público (30,0%) e o resultado do Claude Fable 5 (21,4%) dentro da margem de ruído.
• Terminal-Bench 4.0 — Claude Fable 5.1: 55,8% vs Claude Fable 5: 42,0%, Claude Opus 5: 52,3%, GPT-5.6 Sol: 37,3%. Claude Mythos 5.1 atinge 60,9%, uma diferença que a Anthropic atribui a tarefas nas quais intervieram as salvaguardas cibernéticas menos precisas do modelo com acesso restrito.
• Humanity's Last Exam — Claude Fable 5.1: 60,9% sem ferramentas e 65,0% com elas, contra Claude Fable 5 com 57,8% / 63,8% e Claude Opus 5 com 56,6% / 63,6%.
• GDPval-AA v2 — Claude Fable 5.1: 1.853 vs. Claude Fable 5: 1.723, Claude Opus 5: 1.824, GPT-5.6 Sol: 1.711.
• AutomationBench — Claude Fable 5.1: 31,4% vs. Claude Fable 5: 17,1%, Claude Opus 5: 26,9%, GPT-5.6 Sol: 19,6%.
• CursorBench 3.2.0 — Claude Fable 5.1: 73,4% com esforço máximo, vs. Claude Fable 5: 70,5%, Claude Opus 5: 70,0%, GPT-5.6 Sol: 67,2%.
• OSWorld 2.0 — Claude Fable 5.1: 77,9% parcial e 41,7% estrito, vs Claude Fable 5 com 72,9% / 36,1% e Claude Opus 5 com 75,4% / 39,6%.
• Conduzido por parceiros, reportado em primeira mão — a Browserbase mediu 82% das suas tarefas de agente de navegador mais difíceis concluídas em cerca de dez minutos cada, contra 74% do Claude Opus 5 e 57% do Claude Fable 5; a pontuação de redlining de contratos do RedlineBench da Crosby passou de 47,9 para 57,0 em relação ao Fable 5; a rubrica FrontierFinance da Samaya passou de 49,2% para 55,9%.
Leia a planilha com um fato estrutural em mente, porque a Anthropic declara isso claramente: Claude Fable 5.1 e Claude Fable 5 foram ambos avaliados com salvaguardas de produção ativadas, e em tarefas nas quais essas salvaguardas intervieram ambos os modelos pontuaram zero — no OSWorld 2.0 para cada um, e no AutomationBench para Claude Fable 5. A Anthropic diz que tarefas de cibersegurança que acionaram uma intervenção foram concluídas por Claude Opus 4.8 e tarefas de biologia por Claude Opus 5, e que isso "provavelmente reduz o desempenho" dos modelos Fable nesses benchmarks. Uma recusa, em outras palavras, é pontuada como uma falha, o que é uma leitura justa de um agente que para — e também um motivo pelo qual os números mudam quando as salvaguardas mudam.
A medição independente: o que um terceiro mediu, e com que esforço
Os números independentes aqui vêm da Artificial Analysis, cujo Intelligence Index é o agregado de terceiros mais amplamente citado e que publica a configuração exata sob a qual cada resultado foi produzido. Em 28 de setembro de 2026, sua página para Claude Fable 5.1 traz o Artificial Analysis Intelligence Index v4.3.2 em 53 sob a configuração "Adaptive Reasoning, Max Effort, Default Fallback", a um custo ponderado de $7.63 por tarefa do Intelligence Index e 69.7 tokens de saída por segundo.
A escala de esforço é a parte interessante, e é justamente o que um único número de manchete esconde. O Artificial Analysis publica uma página separada para cada nível de esforço: 47 no low (US$ 2,37 por tarefa), 49 no medium (US$ 2,98), 51 no high (US$ 3,91), 53 no xhigh (US$ 5,98) e 53 no max (US$ 7,63). Duas coisas decorrem disso. Primeiro, o botão de esforço é real e tem preço: passar de max para high abre mão de dois pontos no índice e custa 49% menos por tarefa, e descer para low abre mão de seis pontos por 69% menos. Segundo, xhigh e max chegam à mesma pontuação de manchete com custos diferentes, o que é o formato comum dessas curvas e um motivo para medir sua própria carga de trabalho em vez de comprar a configuração mais alta por padrão. A mesma revisão do índice coloca o Claude Fable 5 em 50 (US$ 8,75 por tarefa), o Claude Opus 5 em 51 (US$ 5,86) e o Claude Opus 5.5 em 58 (US$ 5,98).
Duas notas de honestidade sobre essas comparações. Todas são o harness de um único fornecedor sobre uma única revisão do índice, então são comparáveis entre si e com nada mais. E não reproduzem a ordenação da Anthropic: na planilha divulgada pela Anthropic, o Claude Fable 5.1 supera todo o seu campo de comparação, enquanto, no índice da Artificial Analysis, um modelo Anthropic mais barato lançado três semanas depois obtém cinco pontos a mais. Ambas as coisas podem ser verdade, porque o índice e a planilha do fornecedor atribuem pesos diferentes a tipos de trabalho — e porque um índice de destaque é um resumo de dez avaliações, não um veredito sobre a sua tarefa.
Declarando: a questão da versão sob uma chave
A razão prática pela qual esta página existe é que "claude fable 5.1" é uma consulta que as pessoas digitam sozinha, normalmente para responder a uma de três coisas: qual dos nomes Fable é o atual, quanto custa e como experimentá-lo sem montar um segundo contrato com fornecedor. As duas primeiras são respondidas acima, nas próprias páginas da Anthropic. A terceira é onde um roteador ganha seu lugar.

Claude Fable 5.1 está no OrcaRouter como anthropic/claude-fable-5.1 ao preço de tabela da Anthropic com 0% de margem — $10,00 por milhão de tokens de entrada, $50,00 por milhão de saída, leituras de cache a $0,25 e gravações de cache a $12,50 — ao lado do Claude Fable 5 no mesmo catálogo. Ambos são acessíveis a partir de uma chave, uma URL base e uma linha de cobrança, seja através do endpoint compatível com OpenAI /v1/chat/completions ou do próprio formato /v1/messages da Anthropic, de modo que um cliente Claude SDK existente possa apontar para o novo modelo alterando dois valores. Esse é o teste de versão mais barato possível: execute o mesmo prompt contra Claude Fable 5 e Claude Fable 5.1 em esforço high e xhigh, compare o custo por tarefa concluída em vez do custo por requisição, e deixe suas próprias avaliações decidirem se o .1 vale a pena a mudança. Como a margem é zero, uma mudança de preço do fornecedor — como o corte de leitura de cache em 1º de setembro — fica ativa do nosso lado no mesmo dia, em vez de esperar por um reajuste.
Se está a escolher entre a linha Fable e algo mais barato, note que a própria Anthropic direciona a maioria das cargas de trabalho para o Claude Opus 5 na sua própria documentação, reservando o Fable 5.1 para raciocínio exigente e trabalho agêntico de longo horizonte. E se o que realmente precisa é da capacidade restrita de biologia ou cibernética, isso é o Claude Mythos 5.1 através dos programas de acesso da Anthropic — não algo para o qual esta página, ou o nosso catálogo, o possa encaminhar.
Por que isto é uma página de referência e não uma matéria de lançamento
Claude Fable 5.1 foi lançado em 1 de setembro de 2026 — quatro semanas antes de esta página ser escrita —, portanto o lançamento não é a notícia, e este texto deliberadamente não é um segundo anúncio. O argumento a favor da página é diferente e, a nosso ver, mais duradouro: é a referência canónica para um modelo que está ativo no nosso catálogo hoje, a página a que um leitor chega depois de pesquisar pelo nome do próprio modelo, e a sua justificação é a procura de pesquisa constante que podemos ver em primeira mão, e não a novidade de um lançamento. A data de lançamento de 1 de setembro é usada aqui para datar o modelo, não como um evento a noticiar. A nossa cobertura do dia do lançamento e as notícias sobre fugas de informação antes do lançamento continuam a ser artigos separados, e esta página remete para eles em vez de repetir qualquer um dos dois.
Comparados neste artigo3
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
