Cartão de título hero gerado para Claude Sonnet 5.5 vs Claude Fable 5.1, com o subtítulo 'O modelo barato está três pontos à frente', mostrando $2.00 de entrada e $10.00 de saída por milhão de tokens à esquerda, contra $10.00 e $50.00 à direita, com os valores 56 e 53 do Artificial Analysis Intelligence Index v4.3 abaixo deles, e o logotipo da OrcaRouter composto no canto inferior direito.
Guides & Insights

Claude Sonnet 5.5 vs Claude Fable 5.1: O modelo barato está três pontos à frente

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Claude Sonnet 5.5 chegou em 28 de setembro de 2026 a US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de tokens de saída. Claude Fable 5.1, o modelo da classe Mythos que o fornecedor lançou em 1º de setembro, fica em US$ 10,00 e US$ 50,00 nas mesmas duas linhas. O resumo tentador é que Fable 5.1 é o caro e, portanto, o melhor, mas no Artificial Analysis Intelligence Index a ordem é inversa: Claude Sonnet 5.5 marca 56 e Claude Fable 5.1 marca 53. Isso não é um artefato de arredondamento, e também não é a história completa, porque o mesmo avaliador coloca os dois a menos de três centavos por tarefa um do outro na mesma suíte — US$ 7,60 contra US$ 7,63. Uma diferença de cinco vezes na tabela de preços praticamente desapareceu no momento em que uma tarefa é concluída. O que resta é um conjunto de diferenças de forma, e não de pontuação, e escolher entre esses dois é, em grande parte, uma questão de qual forma sua carga de trabalho tem.

Duas tabelas de preços, e a única linha em que a diferença não é de cinco vezes

A comparação por token é gritante e não precisa de interpretação.

• Entrada — Claude Sonnet 5.5 a US$ 2,00 por milhão de tokens contra Claude Fable 5.1 a US$ 10,00, uma diferença de cinco vezes

• Saída — $10,00 contra $50,00 por milhão, novamente exatamente cinco vezes.

• Leitura de cache — $0.20 contra $0.25 por milhão. É esta a linha que sustenta execuções longas de agentes, e o desconto despenca de 5× para 20%

• Escrita de cache — $2,50 contra $12,50 por milhão para a janela padrão de cinco minutos, a maior diferença isolada em qualquer um dos cartões

• Batch — O modo batch da Anthropic não se aplica a nenhum destes cards da forma como se aplica aos da Fable 5.1: a Fable 5.1 foi lançada com preço de batch reduzido pela metade, para US$ 5,00 de entrada e US$ 25,00 de saída. Leia a linha de batch na própria página de preços da Anthropic antes de presumir que isso vale para toda a família

• Contexto e teto — 1.000.000 de tokens de contexto e 128.000 tokens de saída máxima em ambos. Na Message Batches API, o Claude Sonnet 5.5 suporta até 300.000 tokens de saída por trás do cabeçalho beta output-300k-2026-03-24, o que é uma diferença real de teto para geração em massa e não uma questão de marketing

Há um ponto modesto a favor do Claude Sonnet 5.5 que a tabela de preços subestima. A Anthropic informa que o modelo normalmente precisa de muito menos tokens para fazer o mesmo trabalho do que seu antecessor, o que, segundo ela, equivale a até 30% menos custo por tarefa. Essa é uma alegação de fornecedor sobre uma comparação diferente — Sonnet 5.5 contra Sonnet 5 — e não é evidência sobre este confronto. É, no entanto, o mecanismo que explica o que a medição independente constatou.

Onde vai parar a disparidade de preço de cinco vezes

A Artificial Analysis executou ambos os modelos em 2026-09-29 sob um único harness e um único rótulo de configuração, "Adaptive Reasoning, Max Effort, Default Fallback", no Intelligence Index v4.3. Os dois números de destaque são 56 para Claude Sonnet 5.5 e 53 para Claude Fable 5.1 — o modelo mais barato à frente por cerca de três pontos em uma escala na qual o mesmo avaliador posiciona o modelo mediano em 26. Ambos estão rotulados como modelos com nome de fornecedor na mesma página, então este é um único instrumento e um único snapshot, não dois.

Depois, a coluna de custo, e a razão pela qual este pareamento é interessante em vez de óbvio. Na mesma execução do índice, Claude Sonnet 5.5 custa $7,602633 por tarefa e Claude Fable 5.1 custa $7,629706. Vinte e sete milésimos de dólar de diferença. A decomposição é onde fica estranho: o lado de entrada do Claude Fable 5.1, sozinho, é $3,73 por tarefa, contra o componente de entrada substancialmente menor do Sonnet 5.5, e seus tokens de raciocínio, sozinhos, custam $2,36 por tarefa. O modelo que é cinco vezes mais barato por token não é nem um pouco mais barato por tarefa concluída.

A causa é o volume, e os dois modelos falham em direções opostas.

• Tokens de saída em toda a suíte de índices — Claude Sonnet 5.5 gerou 410.577.501 contra 188.465.663 do Claude Fable 5.1, em uma suíte onde a mediana rastreada é de 88 milhões. Ambos estão bem acima da mediana; o Sonnet 5.5 é mais que o dobro do Fable 5.1 e quase cinco vezes a mediana

• Tokens de saída por tarefa — 192.838 para o Sonnet 5.5 contra 78.111 para o Fable 5.1, com a parcela de raciocínio em 142.386 contra 47.240. O Sonnet 5.5 pensa aproximadamente três vezes mais tempo por tarefa

• Tokens de entrada em toda a suíte de índices — 18,5 bilhões para Sonnet 5.5 contra 5,6 bilhões para Fable 5.1. Sonnet 5.5 leu três vezes mais, o que é o número mais discreto do par e o que consome a tarifa de entrada mais barata

• Preço combinado numa proporção de 7:2:1 entre entrada, leitura de cache e saída — US$ 1,54 para Sonnet 5.5 contra US$ 7,17 para Fable 5.1. Esta é a linha que corresponde à tabela de preços, e é a linha que descreve uma carga de trabalho com saídas curtas e bem delimitadas

Juntando tudo isso, a afirmação honesta é esta: a diferença de preço combinada é real e a diferença por tarefa não é. Qual dos dois números descreve sua fatura depende inteiramente de suas tarefas terminarem ou divagarem, e a suíte de índices foi criada para deixá-las divagar.

A escada de esforço é a decisão real

Ambos os modelos expõem um parâmetro de esforço — baixo, médio, alto, xhigh, máximo — e ambos foram medidos em cada degrau em 2026-09-29. Esta é a parte da comparação que nenhuma tabela de preços consegue expressar, porque o modelo barato em um degrau inferior supera o modelo caro em um degrau inferior por uma margem ampla, e o modelo caro só se diferencia perto do topo.

• Baixo esforço — Claude Sonnet 5.5 pontua 85,84 a US$ 0,41 por tarefa; Claude Fable 5.1 pontua 46,82 a US$ 2,37. No nível mais baixo, o modelo caro está onze pontos à frente, por quase seis vezes o preço.

• Esforço médio — 40,74 a $0,59 contra 48,92 a $2,98. Fable 5.1 mantém uma vantagem de oito pontos a cinco vezes o custo

• Alto esforço — 46,74 a $ 1,08 contra 51,15 a $ 3,91. A diferença diminui para quatro pontos e meio; a razão de custo mantém-se em cerca de 3,6×

• Esforço Xhigh — 51,85 a $2,74 contra 53,20 a $5,98. Um ponto e um terço de diferença, a 46% do preço

• Esforço máximo — 55,98 a US$ 7,60 contra 53,35 a US$ 7,63. A ordenação se inverte e o custo converge para uma margem de meio por cento.

Leia a quarta e a quinta linhas em conjunto e o formato deste confronto aparece. Claude Sonnet 5.5 no xhigh entrega 51,85 — a um ponto e meio de índice da melhor pontuação do Claude Fable 5.1 em qualquer nível de esforço — por US$ 2,74 por tarefa, contra US$ 7,63. Se o seu trabalho precisa estar perto da fronteira, e não nela, essa linha é a resposta inteira, e ela economiza 64% por tarefa concluída. Leve o Sonnet 5.5 ao máximo e você compra três pontos a mais por 2,8 vezes o dinheiro, o que deixa você com a mesma conta do máximo do Fable 5.1, com uma pontuação marginalmente melhor e um perfil de raciocínio muito diferente.

Vale a pena fixar essa última frase, porque ela é contraintuitiva o suficiente para ser verificada duas vezes. Em esforço máximo equivalente, o modelo com uma tabela de preços cinco vezes mais barata custa o mesmo por tarefa que o modelo com a tabela cara. Ele chega lá emitindo 2,5 vezes mais tokens de saída, dos quais a parcela de raciocínio é três vezes maior. A própria documentação da Anthropic explica parte do mecanismo: o tokenizador mudou, e o mesmo texto produz cerca de 30% mais tokens no Claude Sonnet 5.5 do que em modelos anteriores. Esse é um fator contribuinte entre vários, e é um lembrete útil de que contagens de tokens de saída não são comparáveis entre revisões de tokenizador sem que isso seja dito.

A latência é onde os dois deixam de se parecer.

A convergência de pontuação não se estende ao tempo. No mesmo instantâneo de 2026-09-29, a Artificial Analysis relata um tempo até o primeiro token de 254,41 segundos para o Claude Fable 5.1 e 2,80 segundos para o Claude Sonnet 5.5 no recorte de prompt longo, com velocidades medianas de saída de 67,9 e 49,4 tokens por segundo, respectivamente. Isso é uma diferença de duas ordens de magnitude no tempo que um chamador espera antes que algo chegue, e é, isoladamente, o número mais consequente em termos operacionais nesta comparação.

Ambos os números precisam ter seus qualificadores declarados claramente. O TTFT do Fable 5.1 é medido no tipo de prompt longo; o recorte de prompt médio do avaliador para o mesmo modelo no mesmo dia é de 117,60 segundos, então o valor de 254 segundos é a cauda e não uma constante. Os 2,80 segundos do Sonnet 5.5 são sua mediana geral, com a faixa de variação do próprio avaliador variando de 1,91 segundos no quinto percentil a 4,23 no nonagésimo quinto. A documentação da plataforma da Anthropic descreve a latência comparativa do Fable 5.1 como mais lenta e a do Sonnet 5.5 como rápida, o que é consistente em termos de direção sem constituir uma medição.

Nossa própria infraestrutura fornece uma terceira leitura, porque roteamos Claude Fable 5.1 e medimos o que servimos. Ao longo dos sete dias até 28 de setembro, no tráfego do próprio OrcaRouter, Claude Fable 5.1 registra um tempo mediano até o primeiro token de 6.973 milissegundos, com percentil 95 de 10,0 segundos, uma velocidade de saída de 65,8 tokens por segundo e uma taxa de erro de 0,349%. Esse p50 é mais de cem vezes mais rápido do que o valor para prompt longo do avaliador, o que não é tanto uma contradição quanto uma definição de termos: um primeiro token para desenvolvedores em um prompt curto e um primeiro token de benchmark em um prompt longo são medições de coisas diferentes. Qualquer pessoa que planeje com base no número do ranking deve saber qual dos dois está comprando.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

Honestidade no sourcing, retenção e a migração que ninguém menciona

Tabelas de benchmark de fornecedores e avaliações independentes são instrumentos diferentes e nunca devem ser subtraídos entre si. A própria tabela de lançamento da Anthropic para o Claude Sonnet 5.5 informa Terminal-Bench 4.0 em 70,6%. A Artificial Analysis, executando seu próprio conjunto de testes, informa 63,6% para o mesmo modelo em uma avaliação com o mesmo nome. Para o Claude Fable 5.1, a discrepância ocorre no sentido oposto: a Anthropic informou 55,8% no lançamento, e o conjunto de testes independente registra 52,0%. Nenhum dos pares é uma correção do outro. Avalie cada um por seus próprios critérios, e prefira o independente quando estiver decidindo para onde enviar o tráfego de produção.

A postura de retenção também difere, e é o tipo de diferença que só aparece em uma revisão de compras. A Anthropic afirma que o Claude Sonnet 5.5 está disponível com retenção zero de dados, a mesma postura adotada com o Opus 5.5 e o Sonnet 5. O material de lançamento do Claude Fable 5.1 descreve uma política incremental de uso de dados que coexiste com ele e uma implantação separada no âmbito do Projeto Glasswing, com uma janela padrão de retenção de 30 dias para monitoramento de segurança, e o regime de retenção zero descrito como o estado provisório. Se sua equipe está sujeita a uma revisão de processamento de dados, essa distinção é um item de linha de verdade, e não uma nota de rodapé, e vale a pena ler a página de política atual da Anthropic em vez de qualquer resumo dela, inclusive este.

O custo de migração é assimétrico de uma forma que raramente entra na cobertura de lançamento. Migrar para Claude Sonnet 5.5 não é uma mudança de string de modelo. O guia de migração da Anthropic afirma que valores não padrão de temperature, top_p e top_k agora retornam um erro 400, que um tool_choice de any ou de uma ferramenta nomeada é rejeitado de imediato, e que thinking: {"type": "disabled"} deve se tornar between_tools se você estava executando com o thinking antecipado desativado. O tipo between_tools é aceito em esforço low, medium e high e retorna um 400 em xhigh ou max. Na API Claude e no Google Cloud, o uso de computador é suportado apenas por meio do toolset computer_toolset_20260801; o computer_20251124 mais antigo é recusado. Nada disso se aplica a uma migração para Claude Fable 5.1, que é uma atualização da mesma família do Fable 5 com três mudanças interruptivas próprias. Se você está ponderando os dois como alvos de migração paralelos, o modelo mais barato é o mais caro de adotar.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Qual deles colocar onde

A decisão que decorre dos números é uma decisão sobre quanto do seu tráfego tem escopo bem definido.

• Trabalho delimitado, de alto volume e orientado por ferramentas — Claude Sonnet 5.5, com esforço xhigh se você precisar estar próximo da fronteira. Ele fica um ponto e meio de índice atrás do melhor do Fable 5.1, por 64% menos por tarefa concluída, retorna o primeiro token em cerca de três segundos, e sua linha de gravação de cache mais barata torna acessível um prefixo de contexto reconstruído

• Trabalho de horizonte longo e aberto, em que uma resposta errada custa caro — Claude Fable 5.1. Ele iguala a pontuação máxima do Sonnet 5.5 pelo mesmo custo por tarefa, mas chega lá com um terço dos tokens de raciocínio e um quarto da entrada, o que importa quando a tarefa é genuinamente aberta e o formato da suíte de avaliação se parece com o seu problema

• Superfícies interativas limitadas por latência — Claude Sonnet 5.5, e não é nem de perto. No próprio snapshot do avaliador, a diferença de primeiro token é de duas ordens de magnitude no tipo de prompt longo, e a medição com prompt médio só a reduz para cerca de 118 segundos. Uma superfície de chat não pode ser construída sobre o número do Fable 5.1 sem batching ou streaming para contorná-lo.

• Geração em massa com saídas longas — Claude Sonnet 5.5, por causa do teto de saída de 300.000 tokens disponível na Message Batches API por trás do cabeçalho output-300k-2026-03-24, em comparação com um teto de 128.000 tokens em todos os outros lugares. Confirme o preço do seu processamento em lote antes de se comprometer; a tarifa em lote não é idêntica entre os dois cards

• Trabalho que precise abranger contas ou passar raciocínio de um sistema para outro — leia a documentação de preserved-thinking da Anthropic antes de qualquer um dos dois. Os blocos de pensamento estão vinculados ao modelo e à conta que os produziu, e o Sonnet 5.5 é o primeiro Sonnet a ser lançado com classificadores que impedem a extração de raciocínio. Isso é, ao mesmo tempo, uma funcionalidade de conformidade e uma restrição

• Cargas de trabalho regulamentadas ou sensíveis à retenção — consulte a política atual em vez da cobertura de lançamento. O Claude Sonnet 5.5 foi lançado com retenção zero de dados disponível; o material do Fable 5.1 descreve uma política incremental com uma janela padrão de 30 dias em uma implantação e retenção zero como estado provisório

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

No OrcaRouter, o Claude Fable 5.1 e o Claude Sonnet 5 estão ambos atrás de uma única credencial ao preço de tabela do fornecedor, com 0% de margem, pelo que a linha de leitura de cache e a alteração do tokenizador são as únicas coisas que mexem na sua fatura quando alterna entre eles. O Claude Sonnet 5.5 ainda não é uma rota na nossa plataforma — o modelo tem um dia de vida —, por isso a afirmação honesta é que, hoje, chega até ele através da própria API da Anthropic. Qualquer pessoa que utilize o Fable 5.1 connosco pode calcular o preço da mudança no dia em que este chegar, sem alterar mais nada na sua integração e, entretanto, o failover automático entre fornecedores é o que torna seguro experimentar um modelo tão recente num percurso que tem de manter-se operacional.

O veredito é mais estreito do que a diferença de preço sugere. Claude Sonnet 5.5 é o melhor padrão para quase tudo que é delimitado — ele pontua três pontos a mais no índice independente, responde em segundos e, no xhigh, fica a um ponto e meio do teto do Fable 5.1 por bem menos da metade do custo por tarefa. Claude Fable 5.1 mantém um argumento real, e é o que a própria tabela de comparação da Anthropic apresenta: quando o trabalho é aberto e o custo de estar errado supera o custo de pensar por mais tempo, cinco vezes o preço de entrada compra um modelo que alcança a mesma pontuação sem gastar três vezes os tokens de raciocínio para chegar lá. Escolha pelo formato da tarefa, não pelo tamanho da tabela de preços, porque no topo da escada de esforço esses dois modelos cobram o mesmo de você.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente