Cartão de destaque detalhado intitulado Sonnet 5.5 vs Grok 4.5, com o subtítulo duas tarifas de entrada de US$ 2 e uma espera de um minuto, mostrando três estatísticas: a primeira, 370,8s vs 6,9s, custo por tarefa US$ 7,60 vs US$ 1,04, e Índice de Inteligência 39 vs 39, com um rodapé: Índice, custo por tarefa e latência conforme Artificial Analysis v4.3.2, preços conforme os fornecedores.
Guides & Insights

Claude Sonnet 5.5 vs Grok 4.5: duas taxas de entrada de US$ 2 e uma espera de seis minutos

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Claude Sonnet 5.5 e Grok 4.5 cobram o mesmo preço de entrada: US$ 2,00 por milhão de tokens. É aí que a concordância termina, e um número deixa isso mais claro do que qualquer tabela de especificações. Na revisão v4.3.2 do Intelligence Index da Artificial Analysis, o tempo mediano até o primeiro token de resposta do Claude Sonnet 5.5 na configuração Max Effort é de 370,8 segundos. Para o Grok 4.5, é de 6,9 segundos. Mesma tarifa de entrada. Cinquenta e três vezes a espera antes que qualquer coisa volte. O Claude Sonnet 5.5, lançado em 28 de setembro de 2026, e o Grok 4.5, lançado em 8 de julho de 2026 e desde então superado duas vezes dentro da própria família, são as duas formas mais baratas de entrar na metade da frente da fronteira no papel — e o papel está escondendo a decisão que realmente importa, que é o que você está comprando com a espera.

Esse número precisa imediatamente da sua ressalva, porque um número de latência sem uma configuração não significa nada: 370,8 segundos é o modo de raciocínio padrão da Anthropic em esforço máximo, gastando um orçamento de pensamento muito grande antes de emitir um token de resposta. Quem chama a API e quer um primeiro token rápido configura outra coisa. Mas a direção é real e não é um artefato — a Artificial Analysis mede a velocidade de saída do Claude Sonnet 5.5 em 138,7 tokens por segundo, atrás apenas de um punhado de modelos, e a do Grok 4.5 em 59,2. O modelo que espera mais tempo também escreve mais rápido. O que você está escolhendo é entre uma longa deliberação seguida de uma resposta rápida, e uma curta seguida de uma mais lenta.

O que mudou em 28 de setembro?

O Claude Sonnet 5.5 tem um dia de vida. A Anthropic o lançou em 28 de setembro de 2026 sob o identificador de API claude-sonnet-5-5, ao lado de Bedrock, Google Cloud e Microsoft Foundry, e o descreve como sendo 30% mais rápido que o Claude Sonnet 5 e custando até 30% menos por tarefa na maioria dos trabalhos. Esses são números do fornecedor e não foram reproduzidos de forma independente; o preço com o qual ele está sendo comparado é real, porque a tabela de preços permaneceu estável em US$ 2,00 por milhão de tokens de entrada, US$ 10,00 por milhão de saída, US$ 0,20 para leituras de cache e US$ 2,50 para gravações de cache. A janela é de 1.000.000 de tokens, com um teto de saída síncrona de 128.000 tokens, e 300.000 tokens na Message Batches API por trás do cabeçalho output-300k-2026-03-24. O corte de conhecimento é junho de 2026. A retenção zero de dados está disponível desde o lançamento, e a Anthropic não vai aposentar o modelo antes de 28 de setembro de 2027.

Artificial Analysis model page for Claude Sonnet 5.5 in its Adaptive Reasoning, Max Effort, Default Fallback configuration, released September 2026, showing an Intelligence Index of 56, an output speed of 138.7 tokens per second, $2.00 per million input tokens and $10.00 per million output tokens, $7.60 per Intelligence Index task, 410M output tokens generated during the Index evaluation, and a 1M-token context window.

A própria página de documentação da Anthropic também é incomumente explícita sobre o custo da atualização: cinco mudanças incompatíveis separam o Claude Sonnet 5.5 do modelo no qual a maior parte do tráfego do Claude é executado atualmente, e elas são abordadas mais abaixo.

O Grok 4.5 é a proposta mais antiga e a mais complicada. A SpaceXAI — a empresa que ainda lança sob a marca x​AI em suas fichas de modelo — lançou-o em 8 de julho de 2026 como uma mistura de especialistas de 1,5 trilhão de parâmetros, treinada ao lado do editor de código Cursor, com uma janela de 500.000 tokens, entrada de texto, imagem e arquivo, e um discurso de lançamento baseado quase inteiramente em economia de tokens, e não em pontuações máximas. Ele não é mais o carro-chefe. O Grok 4.6 e o Grok 4.7 existem, ambos têm o mesmo preço de tabela de $2.00 / $6.00, e nosso catálogo lista os três. A pergunta interessante em setembro de 2026, portanto, não é se o Grok 4.5 é bom; é se algo ainda justifica recorrer ao mais antigo dos três.

A fatura não é a tabela de preços.

Coloque os dois lado a lado no quadro independente e a forma da operação aparece.

• Índice de Inteligência, revisão v4.3.2 — Claude Sonnet 5.5 56 em Esforço Máximo vs Grok 4.5 39

• Custo por tarefa do Index — Claude Sonnet 5.5 $7,60 vs Grok 4.5 $1,04, ambos medidos, não estimados

• Taxa de saída — Claude Sonnet 5.5 $10,00 por milhão vs Grok 4.5 $6,00 por milhão

• Velocidade de saída — Claude Sonnet 5.5 138,7 tokens/seg vs Grok 4.5 59,2 tokens/seg

• Tempo até o primeiro token de resposta, Max Effort — Claude Sonnet 5.5 370,8 s vs Grok 4.5 6,9 s

• Tokens gerados em toda a avaliação do Index — Claude Sonnet 5.5 410M vs Grok 4.5 77M

• Contexto — Claude Sonnet 5.5 1.000.000 tokens vs Grok 4.5 500.000 tokens

A linha de verbosidade é o mecanismo por trás da diferença de custo por tarefa, e é o número mais útil desta página. Um modelo que emite 410 milhões de tokens ao longo de uma avaliação em que o seu rival emite 77 milhões não precisa de uma taxa de saída 67% maior para custar sete vezes mais por tarefa — mas tem uma de qualquer forma, e ambos os efeitos empurram no mesmo sentido. A própria formulação da Anthropic concorda com a interpretação em vez de a contradizer: "até 30% menos por tarefa" é uma afirmação sobre contagens de tokens, não sobre taxas, porque as taxas não mudaram entre Claude Sonnet 5 e Claude Sonnet 5.5. A Artificial Analysis chega à mesma conclusão do outro lado e descreve o modelo em linguagem simples como notavelmente rápido, mas muito verboso. Contra um modelo enxuto, essa mesma propriedade é o maior risco operacional do Claude Sonnet 5.5.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Grok 4.5, the scoreboard, with six matched rows: input price $2.00 vs $2.00, output price $10.00 vs $6.00, Intelligence Index 56 vs 39, cost per task $7.60 vs $1.04, first token 370.8 s vs 6.9 s, and context window 1,000,000 vs 500,000 tokens, with a footer reading Index, cost per task and latency per Artificial Analysis v4.3.2; prices per the vendors.

Onde a tarifa barata do Grok 4.5 deixa de ser barata

A linha de US$ 2,00 / US$ 6,00 é uma faixa, não uma tarifa. Na própria documentação para desenvolvedores da SpaceXAI, esse preço se aplica até 200.000 tokens de entrada e dobra para US$ 4,00 de entrada e US$ 12,00 de saída além disso. A janela do Grok 4.5 é de 500.000 tokens, então a segunda metade da janela que ele anuncia custa o dobro da primeira. Carregar um prompt em escala de repositório no Grok 4.5 não é uma operação de US$ 6,00 de saída; é uma operação de US$ 12,00 de saída e, nesse ponto, o modelo com a tarifa "cara" de US$ 10,00 de saída é o mais barato em qualquer requisição que também emita muitos tokens.

O Claude Sonnet 5.5 não tem um nível equivalente. A tarifa de $2,00 / $10,00 mantém-se em toda a janela de 1.000.000 de tokens, e as leituras de cache são cobradas a $0,20 — um décimo da tarifa de entrada —, o que é o que torna o caso de contexto longo viável na prática, e não apenas no papel.

O tamanho da janela é a outra metade desse argumento e aponta na mesma direção. A janela do Grok 4.5 é de 500.000 tokens e cada um deles é cobrado à taxa anunciada. O Claude Sonnet 5.5 tem 1.000.000 de tokens para trabalhar, e é o formato da carga de trabalho que torna isso relevante: um repositório sobre o qual raciocinar, uma longa transcrição de agente, uma pilha de documentos que precisa permanecer à vista. O dobro do teto, nenhuma quebra de faixa na metade dele, e leituras de cache a um décimo da taxa de entrada são o que transformam carregar tanto contexto ao longo de muitas chamadas em um item de linha em vez de um orçamento.

A divisão prática não é sutil:

• Prompts curtos com saída densa — Grok 4.5 vence na taxa e vence de novo no hábito de tokens

• Prompts acima de 200.000 tokens de entrada — a taxa do Grok 4.5 dobra, e a do Claude Sonnet 5.5 não.

• Trabalho interativo sensível à latência — Grok 4.5 responde primeiro, por uma margem ampla, nas configurações padrão

• Execuções agênticas de horizonte longo — a pontuação composta e o teto de saída de 128K do Claude Sonnet 5.5 são o motivo pelo qual você paga o custo extra por tarefa, e o teto de 300K do Batches amplia isso ainda mais

A migração não é uma string de modelo

Quem estiver migrando do Claude Sonnet 5 para o Claude Sonnet 5.5 deve ler a nota de migração da Anthropic antes de escrever código, porque cinco comportamentos mudaram e apenas um deles falha de forma ruidosa em um lugar óbvio.

• Não padrão temperature, top_p ou top_k agora retorna um 400 — um pipeline com uso intensivo de amostragem para de funcionar em vez de degradar

• thinking: {"type": "disabled"} retorna um 400 e deve se tornar between_tools, com effort restrito a low, medium ou high; xhigh e max são rejeitados

• Uso forçado de ferramentas — tool_choice de "any" ou de uma ferramenta nomeada — é rejeitado de imediato, portanto um loop que força uma chamada válida pelo esquema precisa mudar para auto com uso estrito de ferramentas ou saídas estruturadas

• A mais antiga computer_20251124 ferramenta de uso do computador é rejeitada na API do Claude e no Goo​gle Cloud

• Os blocos de Thinking estão vinculados ao modelo e à conta que os produzem, portanto o raciocínio é levado adiante a partir do Claude Sonnet 5, mas não lateralmente para uma família diferente — e a ferramenta advisor não aceita mais Claude Opus 4.8, Claude Opus 4.7 ou Claude Sonnet 5 como advisors por trás de um executor Sonnet 5.5

Há uma sexta mudança que não faz nada falhar, o que a torna a perigosa: o texto entre chamadas de ferramenta agora retorna dentro de blocos de pensamento. Um aplicativo que transmite esse texto a um usuário fica silencioso entre chamadas de ferramenta até definir um valor de exibição ou desativar totalmente o pensamento antecipado. Nada dá erro. A saída simplesmente deixa de aparecer.

O Grok 4.5 não exige nada disso. É um modelo no formato da OpenAI com a superfície de amostragem intacta, e migrar para ele a partir dos próprios predecessores do Grok 4.5 é uma mudança de string de modelo. O custo de migração recai inteiramente sobre o lado do Claude, e é um dia de trabalho em vez de uma tarde.

Ambos em uma única credencial, e o limite honesto disso

Guardar na cabeça uma comparação entre dois fornecedores é fácil; executá-la é onde o custo se esconde. A OrcaRouter coloca mais de 200 modelos atrás de um único endpoint compatível com OpenAI, com o preço de tabela dos fornecedores repassado e sem nenhuma margem adicionada, de modo que uma mudança de tarifa de qualquer um dos lados entra no ar aqui no mesmo dia, em vez de só na próxima renovação de contrato, com failover automático entre fornecedores upstream e uma DSL de roteamento para compor chamadas. Toda a linha Grok está no catálogo com as próprias tarifas da SpaceXAI, e o Grok 4.5 pode ser roteado como grok/grok-4.5 a US$ 2,00 de entrada e US$ 6,00 de saída por milhão de tokens em sua janela de 500.000 tokens.

O Claude Sonnet 5.5 não está no nosso catálogo, e esta página não vai insinuar o contrário. A via para o aceder hoje é a própria API da Anthropic, ou a Bedrock e a Google Cloud, se é aí que já está.O Claude Sonnet 5 pode ser encaminhado aqui desde 30 de junho, pelos $2.00 e $10.00 da Anthropic e continua a ser o modelo em que corre a maior parte do tráfego da API Claude, o que o torna o alvo natural de failover enquanto o Claude Sonnet 5.5 ainda tem um dia e está fora de qualquer evidência de produção.

Uma ressalva aplica-se a tudo isso, e não é pequena. A linha do Grok 4.5 acima é o discurso de venda do fornecedor tal como o nosso catálogo atualmente o reproduz; o contador de tráfego dessa entrada marca zero nos últimos sete dias e a sua métrica de throughput não está a ser medida, com o tempo até ao primeiro token a situar-se no mínimo de um segundo que um modelo quase nunca chamado tende a apresentar. Um modelo sem tráfego recente aqui não é prova de que o modelo seja mau — as chamadas da família foram para o 4.6 e o 4.7 —, mas significa que os números operacionais nessa página são escassos, e o valor de latência em que vale a pena confiar é a leitura de uma rota ativa.

OrcaRouter model page for grok/grok-4.5, dated 2026-07-08, showing a 500K-token context window, text, image and file input, the pricing row of $2.00 input and $6.00 output per million tokens, a p50 time to first token of 1.00 s, a p95 of 4.0 s, and a traffic counter reading Collecting.

Qual escolher

Grok 4.5 é o modelo certo quando o prompt é curto, a resposta é densa e a integração já fala OpenAI — e quando a requisição não ultrapassar 200.000 tokens de entrada, porque, além dessa linha, a aritmética muda de mãos. Também é a escolha certa quando o primeiro token precisa chegar em segundos, e não em minutos. O que ele não é é o atual carro-chefe da Grok; Grok 4.6 e Grok 4.7 ficam acima dele pelo mesmo preço de tabela, e o motivo para escolher o 4.5 em vez de qualquer um dos dois precisa ser específico.

Claude Sonnet 5.5 é o modelo certo quando o prompt é enorme, o trabalho é agêntico o suficiente para que dezessete pontos de Index e um teto de saída de 128K justifiquem um custo por tarefa sete vezes maior, ou quando a pontuação composta é simplesmente o que se está comprando. Sua verbosidade é uma decisão de design, não um defeito, e é o número a ser medido no seu próprio tráfego antes de se comprometer — porque US$ 7,60 por tarefa de Index versus US$ 1,04 é um proxy para um valor que só a sua carga de trabalho pode produzir.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente