
Claude Opus 5.5 vs GPT-6.1 Sol: A Diferença de 5x em Valor de Assinatura, Medida
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 150 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 229 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
Duzentos dólares por mês compram um assento Claude Max 20x ou um assento ChatGPT Pro 200. Na mesma carga de trabalho agêntica, um deles retorna $11.726 por mês em tokens equivalentes à API de primeira parte e o outro retorna $2.084 — uma diferença de 5,6x entre Claude Opus 5.5 e GPT-6.1 Sol. Nenhum desses modelos é o que torna isto notícia, e nenhum dos dois é novo: o Claude Opus 5.5 foi lançado em 22 de setembro de 2026 e o GPT-6.1 Sol em 29 de setembro de 2026, então os próprios modelos têm, respectivamente, duas semanas e uma semana de idade. O que é novo é que a economia de assinatura de executá-los agora tem um número medido associado, publicado pela SemiAnalysis em 5 de outubro de 2026 — um dia antes deste artigo — depois que a empresa criou um método para precificar limites que os fornecedores não publicam.
O número de manchete circula no X desde a noite de 5 de outubro, geralmente desprovido de suas ressalvas. Por isso, as ressalvas vêm logo no início, porque o número não tem valor sem elas. Cada valor no gráfico abaixo é o modelo de uma publicação de pesquisa sobre os medidores privados de terceiros, medidos segundo um formato de carga de trabalho definido e relatados como um intervalo, não como um benchmark auditado. Os preços dos planos são os preços de tabela publicados pelos próprios fornecedores. As pontuações de capacidade mencionadas adiante são da Artificial Analysis, em configurações nomeadas. E toda a comparação diz respeito a assinaturas — um modo de cobrança com regras próprias —, e não a quanto cada modelo custa por token, que é uma pergunta diferente com uma resposta diferente.
Como você precifica um plano que não consegue ver por dentro
A Anthropic e a OpenAI expõem o uso da assinatura como um medidor percentual, não como um preço. Há uma janela de cinco horas e um limite semanal, e nenhuma fatura por solicitação. Os fornecedores diferenciam os níveis por multiplicadores relativos aos seus próprios outros planos — os Max 5x e Max 20x da Claude são literalmente nomeados por sua posição em relação ao Pro, e os níveis do ChatGPT eram anunciados da mesma forma, até que a OpenAI removeu a linguagem de uso relativo de sua página de preços.
O mesmo plano tem, portanto, valor diferente conforme o modelo em que você o gasta, porque um crédito consumido por um token de entrada em cache e um crédito consumido por um token de saída não são precificados na mesma proporção que os fornecedores cobram na API. É essa toda a tese do exercício: não dá para dizer que um plano vale $X por si só. Você precisa do plano, do modelo e da carga de trabalho em conjunto.
O método da SemiAnalysis vale a pena descrever porque determina quanto peso os números podem ter. A empresa realiza chamadas repetidas projetadas para isolar um tipo de token por vez — uma porção de Guerra e Paz com uma etiqueta aleatória por chamada para entrada não cacheada, o mesmo prompt marcado para cache para gravações em cache, uma etiqueta fixa para leituras de cache, um longo ensaio técnico para forçar a saída. Cada chamada registra tokens cobrados pelo fornecedor e a posição do medidor de uso. Como uma única solicitação raramente move um medidor, eles medem em etapas: os totais de tokens entre dois movimentos do medidor fornecem o custo de uma unidade do medidor, etapas parciais em cada extremidade são descartadas, e as etapas se acumulam até que o intervalo fique dentro de ±5%. Leituras de cache que não movem o medidor após 500 milhões de tokens são tratadas como gratuitas. A mistura de carga de trabalho vem então das próprias proporções de uso de setembro da empresa, e o valor é a capacidade de tokens resultante multiplicada pelo preço de API publicado pelo fornecedor para cada tipo de token.
A descoberta mais interessante na secção de metodologia não diz respeito à generosidade de nenhum dos laboratórios. Durante a validação, a SemiAnalysis descobriu que uma de três contas que testou no mesmo plano tinha limites cerca de 20% mais baixos do que as outras duas — uma conta mais antiga. O fornecedor confirmou que se tratava de um teste A/B "extremamente pequeno" sobre limites e sublinhou que não tinha cortado os limites de forma generalizada. Ambas as partes disso são importantes: prova que os limites de subscrição podem ser alterados silenciosamente a qualquer momento e prova que o método é suficientemente sensível para detetar uma alteração de 20% quando ela acontece.
O que cada nível retorna, a $200, $100 e $20
Três níveis, ambos os laboratórios, carga de trabalho agêntica, valor equivalente de API pelas tarifas de lista de primeira parte:
• $200 por mês — Claude Opus 5.5 no Max 20x retorna $11,726 — 58,6 vezes a mensalidade em tokens equivalentes de API; GPT-6.1 Sol no ChatGPT Pro 200 retorna $2,084 — 10,4 vezes a mensalidade. Razão: 5,6x.
• US$ 100 por mês Claude Opus 5.5 no Max 5x retorna $5,725 (57,3 vezes a taxa); GPT-6.1 Sol no ChatGPT Pro 100 retorna $1,055 (10,6 vezes a taxa). Proporção: 5,4x.
• $20 por mês — Claude Opus 5.5 no Claude Pro retorna $1,178 (58.9 vezes a mensalidade); GPT-6.1 Sol no ChatGPT Plus retorna $211 (10.6 vezes a mensalidade). Proporção: 5.6x.
O facto de os três níveis ficarem entre 5,4x e 5,6x é a conclusão, e não os dólares individuais. A comparação é feita no nível intermédio do catálogo de cada laboratório — o modelo que ambos os fornecedores posicionam como o cavalo de batalha do dia a dia e não como o topo de gama — e é feita ao longo de toda a escada de preços, pelo que um leitor num plano de 20 dólares obtém a mesma resposta que um leitor num plano de 200. O próprio resumo da SemiAnalysis é direto: neste nível, a Anthropic é "um negócio esmagadoramente melhor, oferecendo ~5x o valor equivalente em API de forma transversal."
O perfil de carga de trabalho por trás das três linhas está rotulado, e vale a pena lê-lo duas vezes: agêntico, 0,4% de entrada não armazenada em cache, 96,6% de entrada em cache, 2,6% de gravações de cache, 0,3% de saída. É assim que se parece um loop de agente — uma pequena quantidade de instrução nova, uma enorme quantidade de contexto relido e uma fração mínima de texto gerado. É também, como mostra a próxima seção, a mistura que mais favorece a Anthropic.

O Opus 5.5 custa o dobro por token e ainda vence por 5,6x
Eis o que a versão do gráfico que está circulando deixa de fora. O Claude Opus 5.5 não é o modelo mais barato. É o mais caro, por um fator de dois.
Ambas as tabelas de preços são públicas. O Claude Opus 5.5 tem preço de tabela de $4,00 por milhão de tokens de entrada, $0,20 por milhão de leituras de cache, $5,00 por milhão de gravações de cache e $20,00 por milhão de tokens de saída. O GPT-6.1 Sol tem preço de tabela de $2,00, $0,10, $2,50 e $10,00 para as mesmas quatro linhas. Ponderando-as pela combinação agêntica acima, as tarifas combinadas resultam em aproximadamente $0,399 por milhão de tokens para o Claude Opus 5.5 contra $0,200 para o GPT-6.1 Sol — uma proporção de 2,00x. Essa aritmética é nossa, a partir das tabelas publicadas pelos dois fornecedores, mas não é controversa: decorre diretamente dos preços publicados e da combinação indicada.
Divida o diferencial de valor de 5,6x pelo diferencial de preço de 2,0x e obtém aproximadamente 2,8x mais tokens por dólar de plano do lado do Claude. A mesma divisão no nível de $20 dá 2,79x — a diferença está em um medidor ser muito mais generoso, quase exatamente de forma uniforme ao longo da escala, e não em um modelo ser mais barato de executar. O que significa que a manchete dos 5x é uma afirmação sobre o preço dos créditos da Anthropic, e só se aplica a cargas de trabalho que se pareçam com a que foi medida.
Mude a composição e o número muda. A composição é de 96,6% de leituras em cache, em que o Opus 5.5 cobra US$ 0,20 contra US$ 0,10 do Sol. Uma carga de trabalho com baixo uso de cache — documentos novos e longos, pouco reaproveitamento — recai sobre a linha de entrada, e o mesmo 2x aparece ali. Trabalhos com muito uso de saída, como gerações longas em vez de execuções longas de agentes, atingem a linha em que o Opus custa US$ 20,00 contra US$ 10,00. E a SemiAnalysis deixa explícito que sua própria métrica preferida tem um modo de falha: o valor equivalente de API "será, naturalmente, enganoso" se um modelo for um negócio particularmente bom ou ruim a preços de API, que é exatamente a situação aqui — o modelo mais caro por token é o que tem a melhor assinatura. A empresa também se recusa a se apoiar em gráficos de eficiência de tokens, dizendo que não acredita que tarefas típicas de benchmark agêntico sejam representativas do trabalho real e que o setor carece de dados confiáveis de eficiência. Encare o 5x como uma declaração ponderada sobre um formato de carga de trabalho de uma única publicação, não como uma propriedade permanente de qualquer um dos modelos.
O que faz a diferença ser um problema real, em vez de uma troca neutra, é que o lado da assinatura e mais barato também é o lado mais forte no ranking independente. O Artificial Analysis coloca o Claude Opus 5.5 em 58 no seu Intelligence Index, na configuração que a página do modelo intitula "max with fallback", listada no seletor de variantes como "Claude Opus 5.5 (Max, Default Fallback)" — a mais alta que já medira, por vários pontos. O GPT-6.1 Sol registra 51,8 no esforço máximo no mesmo índice, versão do índice v4.3.2, com o GPT-6 Astra em 52,7. Portanto, um comprador que pondera os dois planos de $200 está sendo solicitado a pagar 5,6x mais por dólar de capacidade utilizável pelo modelo com pontuação mais baixa. As pontuações são de terceiros e independentes; os valores são do modelo da SemiAnalysis. Ambos estão rotulados, e nenhum é um número de fornecedor.

O que a OpenAI mudou em 29 de setembro
Nada disso era estático. A razão pela qual a lacuna está sendo discutida esta semana, e não na semana passada, é que a OpenAI mexeu em seus próprios medidores oito dias antes de a medição ser divulgada.
Em 29 de setembro de 2026, a OpenAI reabriu as assinaturas Pro de US$ 200 para novos assinantes e alterou a forma como o uso é calculado junto com a reabertura. Nas suas próprias palavras naquele dia, a mudança "resultaria em metade do valor em gastos de API em comparação com o antigo plano Pro de US$ 200", e um segundo post no mesmo dia descreveu a redução pela metade do valor equivalente em API do nível. Essa é uma declaração do fornecedor sobre o seu próprio plano, datada, e é o evento que tornou uma medição do valor da assinatura digna de publicação.
Três consequências, como a SemiAnalysis as mediu:
• Os tokens por nível foram reduzidos pela metade, e o valor da classe Sol caiu ainda mais do que isso.A OpenAI cortou, ao mesmo tempo, o preço da entrada em cache do GPT-6.1 Sol — para US$ 0,10 por milhão, que a conta de desenvolvedor da OpenAI descreveu em 29 de setembro como 95% abaixo do preço padrão de entrada e 50% abaixo da tarifa em cache do GPT-6 Sol —, de modo que o valor medido equivalente em API dos modelos da classe Sol no plano caiu mais de 50%, em vez dos 50% que o corte de tokens sozinho implicaria.
• Chegou um nível de US$ 500, e ele não restaura o valor. O novo plano Pro 500 oferece 21% mais GPT-6 Astra do que o antigo plano de US$ 200; por causa do corte de preço do Sol, o valor equivalente de API da classe Sol no nível de US$ 500 na verdade caiu. O modo Ultrafast — o nível de serviço de 300 tokens por segundo — é a verdadeira adição ali, e a SemiAnalysis diz que seus limites ainda estão sendo testados.
• Os assinantes atuais mantêm as condições antigas até 29 de outubro de 2026. Um plano de US$ 200 mantido antes do corte conserva a franquia mais antiga e maior até essa data e depois passa para a menor, com preço inalterado. Para quem comprou antes de 29 de setembro, a comparação neste artigo se aplica à sua conta a partir do final do mês, e não hoje.
O reequilíbrio é a parte sutil. Antes do corte, o valor por dólar da OpenAI era desequilibrado a seu próprio favor no topo: o Pro 200 oferecia aproximadamente o dobro do valor por dólar do Pro 100 no Astra, que por sua vez oferecia aproximadamente o dobro do Plus. Depois do corte, Pro 100, Pro 200 e Pro 500 oferecem todos a mesma quantidade de tokens por dólar para cada modelo, e o Plus é comparável no Sol, embora ainda seja relativamente pior no Astra. A OpenAI tornou a sua escada internamente justa ao reduzir tudo pela metade até o degrau mais baixo. A Anthropic, por outro lado, já dava o mesmo valor por dólar em todos os níveis — e é por isso que o mesmo 5,6x aparece, seja num plano de US$ 20 ou num de US$ 200. Se você está no Plus e contava com o acesso ao Astra, o corte removeu o valor que antes fazia valer a pena buscar o nível mais alto da OpenAI.
A OpenAI ainda mantém uma vantagem estrutural real, e a SemiAnalysis reconhece isso: nenhum dos níveis Pro tem uma janela de cinco horas, o que torna mais fácil consumir uma parcela elevada do limite mensal em uma única sessão longa. A avaliação da empresa é que isso não compensa uma diferença de aproximadamente 4x a 5x em valor equivalente de API.
Duas economias, um nome de modelo
Há uma armadilha em ler qualquer parte disso como uma afirmação sobre os modelos. Se você paga por token — uma chave de API, uma stack auto-hospedada, uma plataforma de agentes que você mesmo constrói — o 5.6x não é o seu número e nunca foi. Seu número é o combinado 2.00x, e com base nisso o GPT-6.1 Sol é o modelo mais barato para o mesmo loop agêntico. A comparação de assinaturas responde "qual assento devo comprar". A comparação de API responde "qual modelo devo chamar". Elas apontam em direções opostas para esses dois modelos, e confundir as duas é o erro mais comum na análise em torno do gráfico.
A rodada de cortes de preços que alimentou a medição de assinatura já está nas tabelas de preços da API. A Anthropic cortou em 20% os preços de entrada e saída do Opus 5.5 em relação ao Opus 5 e em 60% as leituras de cache quando o modelo foi lançado, em 25 de setembro. A OpenAI cortou pela metade a entrada em cache do GPT-6.1 Sol no lançamento, em 29 de setembro. Essas são as duas tabelas de preços de lista usadas ao longo deste artigo, e se aplicam quer você compre um assento ou um token. Ambos os modelos estão no catálogo da OrcaRouter pelo preço de lista do fornecedor — Claude Opus 5.5 pelo preço de lista do provedor com 0% de markup, e GPT-6.1 Sol na mesma chave por trás de um único endpoint — então um corte do fornecedor entra em vigor no mesmo momento em que é publicado, em vez de esperar por uma atualização da tabela de roteamento.
Uma coisa sobre a qual vale a pena ser franco: a OrcaRouter não vende assinaturas, portanto esta medição não muda o que um usuário da OrcaRouter paga. Ela muda por qual modelo ele deveria estar pagando, e precifica a alternativa. O lado do plano na comparação é um muro que você não controla — dois laboratórios, ambos já demonstraram que vão mexer nos limites, em silêncio e com pouca antecedência, na mesma semana em que cortam preços. O equivalente desse risco na API é poder enviar a mesma requisição para outro lugar sem um novo contrato, que é justamente para isso que serve o failover automático entre provedores. Se você está executando um loop de agente com 96,6% de leituras em cache, o que você realmente quer é a rota mais barata que aceitará a requisição, e a capacidade de mudar de ideia quando um fornecedor mudar de ideia.
Quem deve se mover, e quem não deve
Se você paga por uma assinatura do Claude e executa codificação agêntica ou longos loops de ferramentas, o argumento para permanecer agora é medido, em vez de anedótico: 58,6x o valor da sua assinatura volta como capacidade equivalente de API no plano de US$ 200, contra 10,4x no plano comparável do ChatGPT, e isso se sustenta em todos os níveis de preço. Se você está num plano ChatGPT Pro 200 comprado antes de 29 de setembro, você tem o limite mais antigo até 29 de outubro de 2026 e o menor depois disso — verifique a data antes de decidir qualquer coisa, porque, nas próximas três semanas, você estará comparando com um plano que já não existe para novos compradores.
Se você é um desenvolvedor de API, ignore o 5,6x. Roteie com base na taxa combinada de 2,00x, defina o preço por tarefa em vez de por token e verifique novamente após cada mudança de preço de fornecedor, porque este trimestre produziu quatro delas — GPT-6 Sol, Fable 5.1, Opus 5.5 e GPT-6.1 Sol em pouco mais de um mês. A medida que importa para uma assinatura é um medidor que ninguém fora do laboratório consegue ver. A medida que importa para uma API é uma tabela de preços, e essa é pública.
O que observar a seguir: se os limites do Opus da Anthropic se mantêm ao longo do trimestre, dado que sua própria concorrente passou a última semana cortando e que ambos os laboratórios mantêm a capacidade de mexer nos medidores discretamente; se a OpenAI restaura o valor da categoria Sol no plano de US$ 500 aumentando os limites em vez de cortar preços novamente; e se o direito adquirido do plano de US$ 200 realmente termina em 29 de outubro, conforme publicado. A SemiAnalysis mantém os números subjacentes como um painel ao vivo, e não como um estudo fixo, de modo que os valores citados aqui são o estado de 5 de outubro de 2026 de um conjunto de dados projetado para mudar.

Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
