Uma capa gerada para Claude Opus 5.5 vs GPT-6 Sol, com o subtítulo "Metade do preço, até o contexto ficar longo", com dois ícones de linha plana (um documento e uma nuvem) e uma linha de rodapé com "Índice por Artificial Analysis no esforço máximo; preços conforme os fornecedores". O logotipo real da OrcaRouter é sobreposto no canto inferior direito.
Guides & Insights

Claude Opus 5.5 vs GPT-6 Sol: Metade do Preço, Até o Contexto Ficar Longo

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

A Anthropic e a OpenAI lançaram flagships concorrentes na mesma tarde. Claude Opus 5.5 foi lançado em 22 de setembro de 2026 a US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, um corte de 20% em ambas as linhas em relação ao Claude Opus 5. GPT-6 Sol foi lançado no mesmo dia a US$ 2 de entrada e US$ 10 de saída, um corte direto de 50% em relação ao GPT-5.6 Sol, que a OpenAI descreveu como permanente, e não promocional. Leia apenas essas duas frases e o confronto parece resolvido antes de começar: o modelo da OpenAI custa metade do preço, e metade do preço é metade do preço. Leia o restante das duas tabelas de preços e a diferença quase se fecha — não porque algum dos fornecedores mudou alguma coisa, mas porque ambos os modelos aplicam uma sobretaxa ao mesmo tipo de solicitação, e isso custa ao Sol uma parcela muito maior de sua vantagem do que custa à Anthropic.

Duas tabelas de tarifas, ambas com um degrau nelas

Abaixo de 272.000 tokens de entrada, esta é a comparação mais simples na fronteira atual:

• Entrada — GPT-6 Sol $2,00 por milhão vs Claude Opus 5.5 $4,00

• Saída — GPT-6 Sol US$ 10,00 por milhão vs Claude Opus 5.5 US$ 20,00

• Entrada em cache — GPT-6 Sol cerca de 90% de desconto sobre a parte em cache em comparação com Claude Opus 5.5, US$ 0,20 por milhão, um multiplicador de 5% sobre a entrada base

• Contexto e saída — GPT-6 Sol 872K conforme medido pela Artificial Analysis, 1M alegado em outros lugares, saída máxima de 128K vs Claude Opus 5.5 1M e 128K

• Corte de conhecimento — Claude Opus 5.5 junho de 2026 vs GPT-6 Sol não declarado nos mesmos termos

Acima de 272.000 tokens de entrada, a aritmética muda dos dois lados, e não na mesma proporção. O GPT-6 Sol recalcula o preço da solicitação inteira — não apenas do excedente, mas da chamada inteira — a aproximadamente o dobro da tarifa de entrada e uma vez e meia a tarifa de saída, chegando perto de US$ 4,00 de entrada e US$ 15,00 de saída. A tabela de tarifas do Claude Opus 5.5 não tem faixa de contexto longo: a Anthropic cobra US$ 4,00 e US$ 20,00 ao longo de toda a janela de 1 milhão de tokens e afirma que uma solicitação de 900 mil tokens custa o mesmo por token que uma de 9 mil tokens.

Junte tudo isso e a ordem se inverte num ponto inesperado. Numa chamada de contexto longo, as tarifas de entrada convergem em cerca de US$ 4 nos dois modelos — a vantagem de metade do preço do Sol na entrada desaparece por completo —, enquanto a saída estreita de uma diferença de 2x para cerca de US$ 15 contra US$ 20, uma vantagem de 25% em vez de 50%. O Sol continua mais barato. Já não é barato o suficiente para ser o único número na decisão, e a razão é que os dois acréscimos têm formatos diferentes: o modelo da Anthropic cobra uma tarifa fixa que, por acaso, é mais alta, e o da OpenAI cobra uma penalização que recai com mais força exatamente sobre as cargas de trabalho agênticas, de leitura de repositórios e de conjuntos de documentos para as quais ambas as empresas estão a vender esses modelos.

A generated graphic titled 'Two rate cards, one step each', with a subtitle reading 'Above 272,000 input tokens the input rates converge and the output gap narrows to about a quarter.' Two panels compare per-million-token input and output rates: below 272,000 input tokens Claude Opus 5.5 is $4.00 / $20.00 against GPT-6 Sol at $2.00 / $10.00, and above 272,000 input tokens Claude Opus 5.5 stays at $4.00 / $20.00 while GPT-6 Sol moves to approximately $4.00 / $15.00 because the whole call reprices. The footer reads 'Per-million-token rates. Sol's step per OpenAI; Opus 5.5 bills its full 1M window at one rate per Anthropic.'

A pontuação independente, que é a única comparação em condições iguais

A two-column scoreboard comparing Claude Opus 5.5 and GPT-6 Sol across six shared rows: Intelligence Index (58, ranked #1 of 210, against 48, ranked #18), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), output speed (not yet published against 113.3 tokens per second), time to first token (not yet published against 142.74s), knowledge cutoff (Jun 2026 against not stated in the same terms) and long-context step (none against the whole call repriced above 272K). The footer reads 'Index, speed and latency figures per Artificial Analysis at max effort; prices and the 272K step per the vendors.'

Nenhuma das tabelas de lançamento contém o novo modelo da outra — ambas foram escritas antes de os lançamentos do mesmo dia chegarem ao mercado — portanto, o material do fornecedor não consegue classificá-los de forma alguma. A Artificial Analysis consegue, porque executa todos os modelos numa única configuração publicada:

• Índice de Inteligência — Claude Opus 5.5 58, classificado em 1º entre 210 vs GPT-6 Sol 48, classificado em 18º

• Rótulo de configuração — ambos avaliados com esforço máximo; Claude Opus 5.5 rotulado adicionalmente como "Default Fallback"

• Velocidade de saída — GPT-6 Sol 113,3 tokens/seg, classificado em 38º lugar contra Claude Opus 5.5, ainda não publicado

• Tempo até o primeiro token — GPT-6 Sol 142,74 s vs. uma mediana do ranking de 3,83 s; Claude Opus 5.5 ainda não publicado

• Preço — GPT-6 Sol $2,00 / $10,00 por milhão vs Claude Opus 5.5 $4,00 / $20,00

Dez pontos de índice e dezessete posições representam a maior separação em qualquer confronto atual entre Claude e OpenAI, e vai contra o modelo mais barato pela segunda vez neste mês — o mesmo padrão apareceu quando GPT-6 Sol enfrentou Claude Opus 5 em uma comparação anterior e perdeu por três pontos mesmo custando 60% menos. A linha de velocidade aponta no sentido oposto e importa mais do que parece: 113,3 tokens por segundo é aproximadamente o dobro do que o carro-chefe GPT-6 Astra consegue, e é o número mais rápido deste grupo. Combinado com um primeiro token em 142 segundos, o perfil é de um modelo que pensa por muito tempo e depois escreve rapidamente, o que é inadequado para qualquer coisa interativa e razoável para execuções longas sem supervisão.

Ambos os números trazem a mesma ressalva que a dos fornecedores: são medições de esforço máximo, e nenhum dos modelos é enviado com esforço máximo como padrão. O Claude Opus 5.5 tem como padrão medium numa escala de esforço que vai de low a max; o GPT-6 Sol expõe uma escala que vai de none a max. Um índice de esforço máximo é uma forma justa de comparar tetos e uma forma enganosa de prever sua conta.

O que quebra quando você alterna, nos dois sentidos

A fricção de migração aqui é assimétrica e vale a pena saber antes de qualquer um dos dois movimentos.

O Claude Opus 5.5 não é um substituto direto do Claude Opus 5. O raciocínio não pode mais ser desativado, então o código que definia um caminho sem raciocínio gerará erro ou mudará de comportamento silenciosamente. O uso forçado de ferramentas retorna um erro. Os blocos de raciocínio estão vinculados ao modelo e à conversa que os produziu, portanto não podem ser reproduzidos em outros modelos. A ferramenta de uso de computador mais antiga computer_20251124 não é aceita na API Claude nem no Google Cloud. Separadamente, o texto entre chamadas de ferramentas agora retorna dentro de blocos de raciocínio que ficam vazios na configuração de exibição padrão, então um aplicativo que transmite esse texto como progresso simplesmente ficará em silêncio entre chamadas sem lançar nada.

A escala de esforço do GPT-6 Sol é a mais flexível das duas: pode ser alterada no meio da conversa sem invalidar o cache de prompt, o que significa que uma primeira passagem barata e uma nova tentativa cara no mesmo contexto são um padrão suportado, em vez de um que invalida o cache. Isso é uma vantagem genuína de engenharia para qualquer pessoa que execute raciocínio em camadas dentro de uma única sessão, e é o argumento mais forte a favor do Sol que não aparece em nenhuma tabela de preços.

Executando os dois e decidindo com seus próprios números.

A posição honesta sobre este confronto é que as tabelas dos fornecedores não conseguem resolvê-lo e o índice independente define apenas o teto. O que resta é a questão da carga de trabalho — quanto tempo os seus contextos realmente duram e quanto custa uma tentativa falhada — e isso é mensurável no seu próprio tráfego, em vez de discutível a partir de um comunicado de imprensa.

Ambos os modelos podem ser roteados pelo OrcaRouter ao preço de tabela do provedor, com 0% de markup: o GPT-6 Sol a US$ 2,00 / US$ 10,00 da OpenAI e o Claude Opus 5.5 a US$ 4,00 / US$ 20,00 da Anthropic. Como o repasse é exato e os preços mudam no mesmo dia em que os fornecedores os alteram, a proporção que você mede em staging é a proporção que você paga em produção, sem nenhuma camada de markup para recalcular. Uma única chave cobre os dois, então a regra de roteamento que envia chamadas abaixo de 272K para o Sol e chamadas de contexto longo para o modelo que vencer nas suas avaliações é uma mudança de configuração, e não uma segunda integração — e o failover automático significa que um lançamento no mesmo dia de qualquer um dos lados é algo em que você pode colocar uma fatia do tráfego, em vez de uma aposta que você faz com um pipeline inteiro.

A screenshot of OrcaRouter's own model page for openai/gpt-6-sol, headed 'GPT-6 Sol' and credited to OpenAI, showing a 1M-token context, 128K max output, and a stat strip reading INPUT $2.00 and OUTPUT $10.00 per 1M tokens with a 2.25s p50 time to first token and 4.8M tokens of traffic over 7 days.

A versão disto que sobrevive ao contato com um projeto de lei

O GPT-6 Sol é o modelo mais barato em todas as linhas, em todas as configurações, e isso não está em discussão. O que não se sustenta é a suposição de que "metade do preço" é o número com o qual planejar: em uma chamada de contexto longo, as tarifas de entrada se encontram em cerca de US$ 4 e a diferença de saída se estreita para um quarto, o que é uma decisão diferente daquela que as páginas de lançamento descrevem. Pese isso contra uma diferença de dez pontos no índice, dezessete posições e um primeiro token medido de 142 segundos, e a divisão se define por si só para a maioria das cargas de trabalho — Sol como o padrão de alto volume em contextos curtos e médios, Claude Opus 5.5 onde o contexto se estende ou a tarefa é difícil o suficiente para que uma nova tentativa custe mais do que a diferença de tokens. O erro que vale a pena evitar é escolher um destes com base apenas na tarifa principal, porque é o segundo número em cada tabela de preços que decide o caso para o qual ambos os modelos foram criados.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente