
Claude Opus 5.5: O Modelo Principal da Anthropic, com Especificações Completas
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 140 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 78 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 294 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
Claude Opus 5.5 é o modelo principal atual do fornecedor, lançado em 22 de setembro de 2026, e fica no meio da linha Claude como o fornecedor agora a documenta: mais barato e mais rápido que Claude Fable 5.1 acima dele, mais caro e mais lento que Claude Sonnet 5.5 abaixo dele, e o sucessor direto de Claude Opus 5 no topo da linha Opus. O seletor de modelos do próprio fornecedor oferece o resumo útil mais curto de onde ele se encaixa: comece com Claude Opus 5.5 “para a maioria das cargas de trabalho”, e recorra a Claude Fable 5.1 “para raciocínio exigente e trabalho agêntico de horizonte longo, ou quando suas avaliações no Claude Opus 5.5 com esforço mais alto ainda ficarem aquém.” Esta página é a referência para o modelo que essa orientação aponta — o envelope, a tabela completa de preços, a configuração de esforço por trás de cada pontuação publicada, a leitura independente e onde ele realmente roda. Quando um leitor quer profundidade em um desses pontos, esta página encaminha em vez de repetir: a aritmética da tabela de preços, a ficha completa de benchmarks com suas colunas de modelos cruzados e os detalhes de migração ficam cada um em sua própria página.
O que é o Claude Opus 5.5 e onde ele se situa na linha
Anthropic descreve o Claude Opus 5.5 como criado "para codificação agêntica e trabalho de conhecimento de longa duração", e o apresenta como "o primeiro modelo de nossa nova família Claude 5.5". Ele substitui o Claude Opus 5 como carro-chefe de disponibilidade geral da empresa; o Claude Opus 5 permanece listado como modelo legado e continua sendo servido. A linha de quatro modelos, conforme a própria visão geral de modelos da Anthropic a apresenta, é curta o bastante para ser apreendida em uma única passada:
• Claude Fable 5.1$10 de entrada e $50 de saída por milhão de tokens, latência comparativa listada como mais lenta, pensamento adaptativo sempre ativado, esforço padrão alto, contexto de 1M de tokens, saída máxima de 128K, data de corte de conhecimento confiável em junho de 2026. A Anthropic o posiciona acima do carro-chefe e o precifica de acordo.
Claude Opus 5.5 — US$ 4 de entrada e US$ 20 de saída por milhão, latência adaptativa moderada, pensamento adaptativo sempre ativado, esforço padrão médio, contexto de 1M tokens, saída máxima de 128 tokens, data de corte de conhecimento em junho de 2026. É o único modelo da linha que oferece suporte ao parâmetro de esforço e não usa alto, e esse detalhe importa mais do que parece — consulte a seção sobre esforço.
• Claude Sonnet 5.5 — $2 de entrada e $10 de saída por milhão, latência comparativa rápida, pensamento adaptativo, esforço padrão alto, contexto de 1M tokens, saída máxima de 128K, corte de conhecimento confiável em junho de 2026, aposentadoria não antes de 28 de setembro de 2027.
• Claude Haiku 4.5 — US$ 1 de entrada e US$ 5 de saída por milhão, latência comparativa mais rápida, raciocínio estendido, sem parâmetro de esforço, contexto de 200 mil tokens, saída máxima de 64 mil tokens, descontinuação não antes de 15 de outubro de 2026.
Duas leituras dessa tabela erram com frequência suficiente para serem nomeadas. A primeira é a direção do movimento de preço: o Claude Opus 5.5 é mais barato que o modelo que substituiu, não mais caro — $4/$20 contra os $5/$25 do Claude Opus 5 — e é mais barato que o Claude Fable 5.1 por um fator de dois e meio na entrada. A segunda é o que significa a diferença em relação ao Claude Fable 5.1. A Anthropic relata que o Claude Opus 5.5 iguala ou supera o Fable 5.1 em várias tarefas publicadas, a um quinto a um terço do custo por tarefa, enquanto ainda encaminha trabalho de raciocínio genuinamente exigente para níveis superiores; essa é uma afirmação de custo por tarefa sobre gráficos específicos, não uma afirmação geral de que o modelo mais barato é o mais forte, e a página de benchmark mantém a distinção visível. A Anthropic também diz o que vem a seguir: "O Claude Sonnet 5.5 e o Claude Haiku 5.5 chegarão nas próximas semanas", com "muitas das mesmas melhorias em desempenho, eficiência e segurança". Essa frase desde então se resolveu em parte: o Claude Sonnet 5.5 foi lançado em 28 de setembro de 2026, enquanto o Claude Haiku 5.5 não apareceu — a visão geral de modelos da Anthropic ainda lista o Claude Haiku 4.5 como o modelo pequeno atual, verificado em 7 de outubro de 2026.
Lançado em 22 de setembro de 2026 — e por que a data não é o ponto principal aqui
A data de lançamento está documentada duas vezes nas próprias páginas da Anthropic: a página de anúncio tem data de 22 de setembro de 2026, e a página do modelo traz a linha "Mais recente. Lançado em 22 de setembro de 2026." Os números de especificação neste artigo foram lidos em 28 de setembro de 2026, na documentação da própria Anthropic, na Artificial Analysis ou na API do nosso próprio modelo, e cada um está identificado com a fonte de onde veio; as afirmações na seção de disponibilidade sobre o que é atual hoje foram reverificadas nessas mesmas páginas em 7 de outubro de 2026 e estão datadas lá.
A Anthropic se compromete a dar suporte ao Claude Opus 5.5 "não antes de 22 de setembro de 2027" nas plataformas que ela mesma opera; Amazon Bedrock e Google Cloud definem suas próprias datas de ciclo de vida. Cada ID de modelo Claude é um snapshot fixado, incluindo os IDs sem data usados a partir da geração 4.6 em diante, então claude-opus-5-5 não é um ponteiro que vai mudar sem você perceber.
Por que esta página é uma referência, e não uma segunda história de lançamento
Vale a pena dizer isto sem rodeios, porque a leitura óbvia de uma página sobre um modelo lançado em 22 de setembro de 2026 é a de que se trata de cobertura de lançamento, e não é. Esta é a página de referência canônica de um modelo que está ativo no nosso catálogo hoje — a página a que um leitor chega depois de pesquisar o nome do próprio modelo, e não depois de ler um feed de notícias. A sua justificativa é a demanda de busca constante que medimos em primeira mão, não a novidade de um lançamento, e a data de lançamento de 22 de setembro aparece aqui como um fato que serve para datar o modelo, não como um evento que este texto está noticiando.
Essa distinção é estrutural. Já existem posts de lançamento, um artigo sobre o vazamento, páginas de comparação e vários textos aplicados sobre o Claude Opus 5.5 no arquivo deste blog, e mais um anúncio seria uma duplicata de um trabalho que já existe. O que não existia até agora era a página subjacente a todas elas: a orientação de que um leitor precisa antes que qualquer uma das páginas especializadas seja útil. Assim, os textos que realmente têm um assunto próprio — preços, benchmarks e a superfície da API — são vinculados a partir daqui em vez de rederivados, e esta página se limita à sua própria função.
O envelope
Da página do modelo Anthro{{1}}pic Opus 5{{2}} e da sua visão geral de modelos, ambas lidas em 28 de setembro de 2025:
• Janela de contexto — 1.000.000 de tokens. A Anthropic não publica uma contagem de palavras para a janela, apenas uma conversão aproximada para texto em inglês: "1 token equivale a aproximadamente 4 caracteres ou 0,75 palavras", com a contagem exata variando conforme o idioma e o tipo de conteúdo. Uma ressalva sobre o tokenizador acompanha esse número: Claude 4.7 e modelos posteriores, incluindo Claude Opus 5.5, usam um tokenizador mais recente que produz aproximadamente 30% mais tokens para a mesma entrada, então um prompt dimensionado para um modelo Claude anterior não preencherá a mesma janela.
• Saída máxima — 128.000 tokens de forma síncrona na API de Mensagens. Na API de Lotes de Mensagens, sobe para 300.000 tokens por trás do output-300k-2026-03-24 cabeçalho beta.
• Modalidades — A Anthropic documenta a entrada como texto e imagens, a saída como texto, e lista capacidade de visão, uso de ferramentas e multilíngue em toda a linha atual. Nossa própria entrada de catálogo para o modelo também aceita um tipo de entrada de arquivo, que a página do fornecedor não enumera.
• Cortes de conhecimento — corte de conhecimento confiável em junho de 2026; corte dos dados de treinamento em junho de 2026 também.
• IDs de modelo — claude-opus-5-5 na API da Claude, no Google Cloud, no Microsoft Foundry e no Claude Platform na AWS; anthropic.claude-opus-5-5 no Amazon Bedrock.
• Status — Ativo (mais recente), com compromisso de descontinuação não antes de 22 de setembro de 2027 em plataformas operadas pela Anthropic.

A tabela de preços, na íntegra
Tudo o que se segue é a tabela de preços publicada pela Anthropic, consultada em 28 de setembro de 2026. Os preços são por milhão de tokens.
• Entrada — $4.00
• Saída — $20,00. Os tokens de pensamento são cobrados como tokens de saída, e o pensamento adaptativo do Claude Opus 5.5 não pode ser desativado, portanto o pensamento não é uma linha separada que você possa suprimir.
• Leitura de cache — $0,20, que a Anthropic documenta como 0,05x o preço base de entrada. Esse multiplicador é uma exceção para este modelo: a tarifa padrão na tabela é 0,1x, e apenas Claude Fable 5.1 e Claude Mythos 5.1 ficam abaixo, em 0,025x.
• Gravação em cache de 5 minutos — $5.00, o multiplicador padrão de 1,25x sobre a entrada base.
• Gravação de cache de 1 hora — $8,00, o multiplicador padrão de 2x. O comprimento mínimo de prompt cacheável é de 512 tokens.
• Batch API — 50% de desconto nos dois sentidos: $2,00 de entrada e $10,00 de saída.
• Modo rápido — US$ 8,00 de entrada e US$ 40,00 de saída, exatamente o dobro do padrão, descrito pela Anthropic como uma prévia de pesquisa. Ele roda apenas na API Claude de primeira parte, não é oferecido no Claude Platform na AWS nem nas nuvens parceiras e não está disponível com a Batch API.
• Inferência somente nos EUA — definir inference_geo como "us" aplica um multiplicador de 1,1x às entradas, saídas, gravações em cache e leituras de cache. O roteamento global, que é o padrão, usa os preços padrão.
• Sem sobretaxa de contexto longo — A Anthropic afirma que os modelos Claude 4.6 e posteriores incluem a janela completa de 1 milhão de tokens com o preço padrão, portanto uma requisição de 900.000 tokens é cobrada à mesma taxa por token que uma de 9.000 tokens.
• Prompt de sistema de uso de ferramentas — A própria tabela de contagem de tokens da Anthropic indica que o prompt de sistema de uso de ferramentas do Claude Opus 5.5 tem 286 tokens quando a escolha de ferramenta é auto ou none.
A questão de custo que um leitor de fato tem não é a tabela de preços, mas a fatura, e esse é o assunto de outra página: a página de preços analisa o custo por tarefa concluída, o que a linha de cache faz ao longo de uma longa execução de agente, e até que ponto a caracterização do fornecedor de "cerca de 40% menos para executar" pode ser verificada a partir da planilha.
Esforço, raciocínio e a configuração por trás de cada pontuação publicada
Esta é a parte da especificação que a maior parte da cobertura de lançamento ignora, e é a parte que muda o que um número de benchmark significa. O pensamento adaptativo do Claude Opus 5.5 está sempre ativado e não pode ser desativado — a Anthropic afirma que solicitações que definem thinking: {"type": "disabled"} retornam um erro 400 em todos os níveis de esforço, não apenas nos mais altos. O pensamento estendido, o modo manual budget_tokens, é o mecanismo anterior: a Anthropic o documenta como obsoleto no Claude Opus 4.6 e no Claude Sonnet 4.6, e não aceito em modelos posteriores. No Claude Opus 5.5, o controle é, portanto, output_config.effort, e nada mais.
Existem cinco níveis: low, medium, high, xhigh e max. O Claude Opus 5.5 oferece suporte aos cinco. Seu padrão é medium — o único modelo que oferece suporte ao parâmetro e que não usa high como padrão — o que significa que uma requisição migrada do Claude Opus 5 sem um valor explícito de effort é executada um nível abaixo do que costumava, e a orientação da Anthropic é fazer uma nova varredura de esforço nas suas próprias avaliações, em vez de transportar as configurações. Definir o esforço como o padrão do modelo produz exatamente o mesmo comportamento que omitir o parâmetro. O esforço orienta todos os tokens da resposta, incluindo o raciocínio, e a Anthropic é explícita ao afirmar que ele é "um sinal comportamental, não um orçamento estrito de tokens". Alterações no meio da conversa são suportadas por meio de um cabeçalho beta de esforço por mensagem, mid-conversation-output-config-2026-07-01, que mantém o cache de prompt intacto — uma alteração de nível superior entre requisições não mantém.
O motivo pelo qual o esforço pertence a uma página de referência é que os resultados publicados da Anthropic não são todos executados com uma única configuração. O anúncio traz uma nota permanente — "Salvo indicação em contrário, todos os resultados do Claude Opus 5.5 usam pensamento adaptativo com esforço máximo" — e depois indica o contrário, por benchmark. Lida dessa forma, a planilha fica assim:
• Terminal-Bench 4.0 — 66,4%, relatado com esforço xhigh. Esta é uma das exceções, e é uma exceção de dois lados: a Anthropic reporta o GPT-6 Astra com esforço high no mesmo gráfico e afirma que ambos os números "representam a pontuação mais alta de cada modelo". Uma comparação em que um modelo está em xhigh e o outro em high não é uma comparação de esforço equiparado, e é a própria nota de rodapé da Anthropic que diz isso.
• FrontierCode v1.1 (Main) — 54,6%, com esforço padrão (médio). A Anthropic observa que ele supera a pontuação máxima de 53,3% do GPT-6 Astra por cerca de um quinto do custo por tarefa.
• CursorBench 4.0 — 52,5%, no esforço padrão (médio). Contra 51,8% do Claude Fable 5.1 em esforço máximo e 46,6% do Claude Opus 5 em esforço máximo. Observe novamente a assimetria: o número do Claude Opus 5.5 é obtido um nível abaixo do melhor dos outros dois modelos.
• GDPval-AA v2.1 — 1846 Elo, no esforço máximo. Claude Fable 5.1 pontua 1735 e Claude Opus 5 pontua 1708 no mesmo gráfico.
• Todo o resto publicado — com esforço máximo, pela nota permanente. Isso abrange os números do OSWorld 2.0 e do Chartography, cujos rótulos ("parcial" e "com ferramentas") descrevem como a tarefa foi pontuada, e não qual nível de esforço a produziu; nenhum dos gráficos traz uma substituição, portanto ambos se enquadram na frase global em vez de escaparem dela.
Mais duas ressalvas devem ficar ao lado desses números, e não em uma nota de rodapé. A Anthropic publica erros-padrão — ±2,6 pontos para o Claude Opus 5.5 no Terminal-Bench 4.0, ±1,6 a 2 pontos para os outros modelos Claude, e ±3,5 a 5 pontos por modelo no Terminal-Bench-Science 0.1 — e verifica dois resultados em relação a tabelas de classificação públicas, reproduzindo os 51,8% publicados do Claude Opus 5 em 52,3% e os 30,0% publicados em 29,0%. Separadamente, seus números do AutomationBench foram produzidos sem modelos de fallback, o que é uma condição de harness diferente de uma implantação que os tem. Qualquer pessoa que leia comparando modelos precisa ter esses três fatos em mãos. A posição independente do Claude Fable 5.1 também é medida em uma revisão do índice diferente da usada para o Claude Opus 5.5, portanto os dois não são diretamente comparáveis, e é na página do benchmark que isso é discutido abertamente.

A leitura independente
Os números da Anthropic são informados pelo fornecedor, e a planilha acima é citada como tal. Existe uma medição independente do Claude Opus 5.5, e ela vem de um só lugar: Artificial Analysis, cuja página do modelo ao vivo lemos em 28 de setembro de 2026.
O Artificial Analysis atribui ao Claude Opus 5.5 uma pontuação de 58 no Artificial Analysis Intelligence Index, revisão v4.3.2, o que o coloca em #1 entre 211 modelos nessa revisão. A configuração em que é medido está indicada na própria página — "Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" — e esse rótulo é a parte importante: o valor independente é um número de esforço máximo, com fallback para a configuração padrão, pelo que não é diretamente comparável a qualquer número da ficha do fornecedor que tenha sido produzido em esforço médio. A par do índice, a mesma página reporta uma velocidade de saída de 95,5 tokens por segundo, um custo de $5,98 para executar o Intelligence Index por modelo, verbosidade de 260 milhões de tokens de saída, um desconto de cache de 95%, uma janela de contexto de 1M de tokens e um preço combinado de $2,94 por milhão de tokens numa mistura de acertos de cache/entrada/saída de 7:2:1. O Artificial Analysis não publica nenhuma variante Fable 5.1 a par dele, nem uma segunda configuração do Claude Opus 5.5, pelo que os dois modelos não foram avaliados lado a lado ali com esforço equivalente e harness equivalente. Isso é uma lacuna nas evidências, não um resultado, e é por isso que esta página não apresenta uma comparação própria entre Opus 5.5 e Fable 5.1.
Vale registrar uma discrepância, porque ela se resolverá sozinha e um leitor pode ver as duas versões. A API do nosso próprio modelo, cujo valor em cache da Artificial Analysis é datado de 22 de setembro de 2026, traz 57,6 para o mesmo índice. A página ao vivo da Artificial Analysis mostra 58 na revisão atual. A página ao vivo é o valor de referência; o 57,6 é um instantâneo tirado no dia do lançamento, na revisão então em vigor. Onde esta página informa um único número, ele é 58.
A nossa própria telemetria é um terceiro tipo de medição, diferente, e não é um benchmark. Nos sete dias que terminaram a 28 de setembro de 2026, os pedidos encaminhados para anthropic/claude-opus-5.5 através do nosso playground apresentaram um p50 de tempo até ao primeiro token de 4,69 segundos, um p95 de 10,00 segundos, 97,8 tokens de saída por segundo e uma taxa de erro de 5,59%, com 62,7 milhões de tokens encaminhados nesse período. Estes valores descrevem o nosso comportamento de serviço, não a capacidade do modelo, e são aqui citados para que ninguém os interprete como um resultado de benchmark.
Disponibilidade, e o teste de versão
A Anthropic afirma que o Claude Opus 5.5 está "agora disponível em todas as plataformas, incluindo Amazon Web Services, Google Cloud e Microsoft Azure", e a página do modelo lista Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. O Claude Opus 5.5 também está ativo no OrcaRouter como anthropic/claude-opus-5.5, pelo preço de tabela da Anthropic, sem nenhuma margem adicional — US$ 4,00 de entrada, US$ 20,00 de saída, US$ 0,20 de leitura de cache e US$ 5,00 de escrita de cache, os quatro valores lidos do nosso próprio endpoint de modelo em 28 de setembro de 2026, correspondendo linha a linha à planilha do fornecedor. Nossa página para ele traz a mesma janela de 1M tokens e saída máxima de 128K, lista texto, imagem e arquivo como tipos de entrada aceitos e texto como única saída, e marca o modelo como lançado em 2026-09-22, em destaque e não obsoleto.
Tudo o resto no mesmo catálogo é acessível a partir da mesma chave: uma única API para mais de 200 modelos, preço de tabela do fornecedor repassado com 0% de margem, failover automático quando um endpoint se degrada, e uma DSL de roteamento para os casos em que quer fixar um modelo ou combinar vários numa só resposta. Para um teste de versão, essa é a propriedade útil. Como a margem é zero, o preço com que compara é o mesmo preço que a Anthropic publica, e como tanto o endpoint de chat-completions compatível com OpenAI como o endpoint de messages da própria Anthropic são servidos, um cliente Claude existente pode ser apontado para o novo ID mudando dois valores — a string do modelo e, se quiser uma profundidade de raciocínio diferente, o nível de esforço. Execute a mesma avaliação em medium e em xhigh, compare o custo por tarefa concluída em vez do custo por requisição, e deixe que os seus próprios números decidam se o carro-chefe ou o modelo acima dele é o padrão certo para o trabalho que tem em mãos. O guia da API cobre as partes que não vão falhar ruidosamente quando trocar a string; quatro alterações disruptivas aplicam-se a código que já está em execução com o Claude Opus 5, e mais uma alteração muda a forma da resposta sem sequer levantar um erro.

O Claude Opus 5.5 continua a ser o topo da linha Claude, e a data dessa afirmação é 7 de outubro de 2026. Nada acima dele na família foi publicado: a visão geral de modelos da Anthropic lista exatamente quatro modelos atuais — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 e Claude Haiku 4.5 — sem uma quinta entrada, a página de documentação do Claude Opus 5.5 ainda traz a palavra Latest ao lado do nome, e não há identificador de sucessor no mapa do site do fornecedor, na sua tabela de depreciação, neste catálogo nem no Artificial Analysis. O mesmo se verifica no sentido inverso: a lista classificada de modelos do Artificial Analysis, consultada no mesmo dia, ainda coloca o Claude Opus 5.5 em primeiro lugar. Um leitor que chega aqui à procura do próximo modelo principal da Claude está à procura de algo que ainda não tem nome, e a resposta prática é a que esta secção já dá: o Claude Opus 5.5 é o que pode chamar hoje ao preço de $4 de entrada e $20 de saída por milhão de tokens do fornecedor, e o Claude Fable 5.1 continua a ser o nível acima para as cargas de trabalho em que a Anthropic o recomenda.
Cabe aqui mais uma coisa, porque um leitor que procura por um modelo Claude que ainda não existe encontra os números de versão antes dos nomes. Um sufixo 5.5 não significa o topo de linha; significa a geração. Claude Sonnet 5.5 é o 5.5 real que chegou ao mercado: lançado em 28 de setembro de 2026, com preço definido pelo fornecedor de US$ 2 para entrada e US$ 10 para saída por milhão de tokens, e medido pela Artificial Analysis em 56,00 na mesma revisão do Intelligence Index, v4.3.2, que classifica Claude Opus 5.5 em primeiro lugar — portanto, um número que soa mais alto em um nível inferior ainda é um nível inferior. A string "Claude Fable 5.5", em contrapartida, é um rótulo de boato, e não um número de versão. A alegação por trás dela foi feita em duas postagens em redes sociais em 2 de outubro de 2026, e a cadeia termina aí: até hoje não há ID de modelo, tabela de preços, janela de contexto, data de lançamento nem benchmark para ele na documentação do fornecedor, neste catálogo ou na Artificial Analysis. O topo lançado da linha Fable é Claude Fable 5.1, e é no artigo neste blog, sob o título Claude Fable 5.5 venceu o GPT-6.1 Astra antes de existir — e é essa a parte interessante, que a cadeia de origem desse rótulo é examinada; a distinção de que esta página precisa é mais estreita — um sufixo que marca uma geração em contraste com um nome que marca uma alegação.
A versão curta
O Claude Opus 5.5 é o modelo a escolher por predefinição na gama atual da Anthropic, e os três factos que decidem se é o modelo certo para um determinado trabalho são estes. Por predefinição, usa esforço médio, ao passo que os modelos à sua volta usam por predefinição alto, pelo que uma definição migrada altera o comportamento silenciosamente. As suas métricas de referência publicadas são produzidas com níveis de esforço diferentes, e as duas mais citadas — Terminal-Bench 4.0 e CursorBench 4.0 — não são comparáveis aos números ao seu lado sem ler as notas. E a sua pontuação independente, 58 no índice v4.3.2 da Artificial Analysis, na posição #1 de 211, é uma medição de esforço máximo, o que faz dela o teto do modelo e não aquilo que vai executar.
Abaixo desses três, o quadro prático é direto: uma janela de um milhão de tokens sem sobretaxa de contexto longo, 128K de saída síncrona, uma tabela de preços que cobra menos que o modelo que ela substituiu, raciocínio adaptativo que não pode ser desativado e um compromisso de descontinuação para daqui a dois anos. Tudo o que é específico — a aritmética de quanto custa uma carga de trabalho, a tabela completa de benchmarks com suas colunas entre modelos e a posição independente de cada modelo, e os detalhes de migração para código que já roda no Claude Opus 5 — está nas páginas de preços, de benchmarks e de API, respectivamente, e esses são os próximos três cliques a partir daqui.
Comparados neste artigo3
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
