Um cartão de destaque gerado intitulado 'GPT-6 Sol vs GPT-5.6 Sol', com a manchete '1 ponto de AA Index de diferença, metade do preço', com os cartões dos dois modelos mostrando um AA Index de 48 contra 47 e preços de $2,00/$10,00 contra $4,00/$20,00, e o logotipo da OrcaRouter no canto inferior direito.
Guides & Insights

GPT-6 Sol vs GPT-5.6 Sol: um ponto no índice, metade do preço e uma regressão que ninguém anunciou

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Sim, faça o upgrade — mas leia o segundo parágrafo antes de fazer isso. GPT-6 Sol, lançado em 22 de setembro de 2026, obtém 48 no Índice de Inteligência da Artificial Analysis. GPT-5.6 Sol, lançado em 9 de julho de 2026, obtém 47. Um ponto. O modelo que o substituiu custa metade: US$ 2,00 por milhão de entrada e US$ 10,00 por milhão de saída, contra US$ 4,00 e US$ 20,00. Nos números principais, esta é a decisão de upgrade mais fácil da linha atual, e o corte de preço é real, permanente e a maior redução única que o fornecedor já fez em um carro-chefe.

A complicação é que a própria avaliação da Artificial Analysis sobre o GPT-6 Sol encontrou uma mistura de ganhos e regressões, e não um avanço inequívoco. Há regressões no GDPval-AA v2.1. Há também uma faixa de reprecificação de contexto longo acima de 272.000 tokens de entrada que praticamente dobra a tarifa de entrada e aumenta a de saída em 50% — e 272K é exatamente a faixa em que o GPT-5.6 Sol tem um ponto forte divulgado. Uma migração que parece um corte direto pela metade da sua fatura pode, no tráfego de contexto longo, acabar mais perto de um empate, com um trade-off de capacidade atrelado.

O que um ganho de um ponto no Index realmente significa

Ambos os modelos foram medidos na mesma placa, versão 4.3.2, o que faz desta a comparação mais limpa de toda a série GPT-6 Sol — sem diferenças de harness, sem discrepância entre fornecedor e independente, um laboratório medindo dois modelos de um único fornecedor.

• AA Intelligence Index — GPT-6 Sol 48, classificado em 18º de 212 vs GPT-5.6 Sol 47, classificado em 19º de 212

• Custo por tarefa do Index — GPT-6 Sol aproximadamente metade do GPT-5.6 Sol

• Velocidade de saída — GPT-6 Sol 104,4 tokens/seg vs GPT-5.6 Sol 72,6 tokens/seg

Tempo até o primeiro token — GPT-6 Sol 107,18s vs. GPT-5.6 Sol mais rápido, ambos em relação à mediana do painel de 3,87s

• Preço de entrada — GPT-6 Sol $2,00 por 1M vs GPT-5.6 Sol $4,00 por 1M

• Preço de saída — GPT-6 Sol $10.00 por 1M vs GPT-5.6 Sol $20.00 por 1M

• Entrada em cache — GPT-6 Sol cerca de 90% de desconto em relação ao GPT-5.6 Sol $0,40 por 1M

• Tarifa de lote — GPT-6 Sol não publicado vs GPT-5.6 Sol US$ 2,50 / US$ 15,00

• Nível de contexto longo — GPT-6 Sol altera o preço acima de 272K de entrada vs GPT-5.6 Sol sem etapa equivalente

• Janela de contexto — GPT-6 Sol 872K por AA, 1,05M alegado vs GPT-5.6 Sol aproximadamente 1,05M a 1,1M

• Saída máxima — 128K em ambos

• Lançado — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6 Sol: Input $2.00 per 1M, Output $10.00 per 1M, AA Index 48, Speed 104.4 tok/s, Long context 'reprices above 272K', Released 2026-09-22. Right column GPT-5.6 Sol: Input $4.00 per 1M, Output $20.00 per 1M, AA Index 47, Speed 72.6 tok/s, Long context 'no step', Released 2026-07-09. Footer: 'Both measured by Artificial Analysis, Index v4.3.2.'

Veja as duas linhas de velocidade em conjunto. O GPT-6 Sol gera saída cerca de 44% mais rápido que seu antecessor, e é dramaticamente mais lento para produzir o primeiro token — 107,18 segundos contra uma mediana do quadro de 3,87. O GPT-5.6 Sol também não é um modelo rápido pelos padrões do quadro, mas não está nessa faixa. Se você migrou para o GPT-5.6 Sol para um produto interativo, o GPT-6 Sol não é um substituto direto, e isso é uma regressão funcional independente de qualquer benchmark.

Há um detalhe discretamente favorável: a tarifa padrão do GPT-6 Sol, de US$ 2/US$ 10, fica abaixo da tarifa em lote do GPT-5.6 Sol, de US$ 2,50/US$ 15. Até o nível com desconto do modelo antigo é mais caro que o preço de tabela do novo. Essa é a evidência mais forte de que o corte é estrutural, e não promocional.

A regressão é a parte interessante.

A Artificial Analysis constatou que o GPT-6 Sol reduz aproximadamente pela metade o custo por tarefa, ao mesmo tempo que gera uma mistura de ganhos e regressões. O GDPval-AA v2.1 é a regressão citada. Separadamente, o GPT-5.6 Luna, da OpenAI, também regrediu no Coding Agent Index — o que sugere um padrão nesta geração, em vez de uma falha isolada em um único modelo.

Isto merece ser levado a sério justamente porque é a constatação independente. Os materiais de lançamento da OpenAI giram em torno do custo por tarefa e das linhas de benchmark que ela selecionou; a Artificial Analysis não tem nenhum produto para vender e relata o que o seu sistema de avaliação produziu. Um modelo que é mais barato e praticamente igual no índice composto, mas mensuravelmente pior em subtarefas específicas, não é um modelo estritamente melhor. É um ponto diferente na fronteira.

A versão prática disso: se a sua carga de trabalho for fortemente moldada pelo GDPval-AA — trabalho de conhecimento economicamente valioso, o tipo de tarefa que esse benchmark foi criado para precificar —, então o ganho de um ponto na pontuação composta não cobre o seu caso, e a regressão é o número que importa. Se a sua carga de trabalho for geral, a redução pela metade do custo por tarefa é o número que importa, e a pontuação composta diz que você não abriu mão de nada mensurável.

Onde o GPT-5.6 Sol ainda vence

O GPT-5.6 Sol tem um resultado publicado de recuperação em contexto longo que o GPT-6 Sol não iguala com nada equivalente: MRCR v2, 8-needle, 91,5% na faixa de 256K a 512K. Trata-se de um índice de precisão de recuperação justamente na banda em que o tarifário do GPT-6 Sol muda.

Coloque os dois fatos lado a lado. Acima de 272.000 tokens de entrada, toda a solicitação do GPT-6 Sol é reprecificada para aproximadamente US$ 4 de entrada e US$ 15 de saída. Isso equivale aproximadamente à tarifa antiga do GPT-5.6 Sol na entrada e a três quartos dela na saída — portanto, a economia de 50% pela qual você migrou cai para cerca de 0% na entrada e 25% na saída, exatamente na faixa de contexto em que o GPT-5.6 Sol tem uma força documentada e o GPT-6 Sol não tem equivalente publicado.

Os outros resultados publicados do GPT-5.6 Sol permanecem respeitáveis e são a razão pela qual algumas equipes não farão a mudança:

• Último Exame dos Agentes — GPT-5.6 Sol 53,6

• Terminal-Bench 2.1 — GPT-5.6 Sol 88,8 / 88,0

• SWE-Bench Pro — GPT-5.6 Sol 64,6

• OSWorld 2.0 — GPT-5.6 Sol 62,6

• BrowseComp — GPT-5.6 Sol 90,4

• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo

• HLE — GPT-5.6 Sol 49,5

• MRCR v2, 8 agulhas — GPT-5.6 Sol 91,5% de 256K a 512K

Estes são reportados pela OpenAI. Observe que o BrowseComp em 90,4 e o número do MRCR são os dois mais difíceis de substituir: agentes de pesquisa na web e a recuperação de contexto longo são cargas de trabalho nas quais um modelo de dois meses de idade com um número publicado é uma aposta mais segura do que um modelo novo sem medição correspondente.

O que o GPT-6 Sol traz que não está na tabela de preços

O preço é o destaque, mas outras três coisas mudaram.

Primeiro, o teto de contexto. O GPT-6 Sol está listado com 872.000 tokens pela Artificial Analysis, contra uma alegação de 1,05M em outra parte dos materiais da OpenAI, com entrada máxima de 922K. O GPT-5.6 Sol fica em torno de 1,05M a 1,1M, dependendo da fonte. No papel, isso é um pequeno retrocesso na janela utilizável — com a ressalva de que é o limite de faixa de 272K, não o teto, que determina o custo.

Segundo, disponibilidade. O GPT-6 Sol está na API e no ChatGPT Work e Codex nos planos Plus, Pro, Business, Enterprise e Edu — e os administradores do Enterprise precisam habilitá-lo antes que os usuários o vejam. Ele não está no ChatGPT Chat. O GPT-5.6 Sol foi um lançamento mais amplo. Se o caminho de acesso da sua equipe passa por um administrador do Enterprise, a migração não é apenas uma mudança de código.

Terceiro, o lançamento de um novo modelo principal geralmente significa que o antigo se torna a alternativa mais barata, em vez de ser descontinuado. O GPT-5.6 Sol, a US$ 4/US$ 20, ainda é um excelente modelo, com 47 no Index, e, para trabalho de recuperação de contexto longo, tem um número publicado que o GPT-6 Sol não tem.

Uma migração que custa menos do que parece

A razão pela qual esta atualização específica é fácil é que os dois modelos são do mesmo fornecedor, têm o mesmo formato de API e são adjacentes no ranking — o que significa que a migração é uma mudança de string de modelo, e não uma rearquitetura, e o caminho de fallback já está no seu código. O GPT-5.6 Sol está no OrcaRouter pelo preço de tabela da OpenAI, sob o modelo de repasse que faz uma mudança de preço da OpenAI entrar em vigor do nosso lado no mesmo dia, em vez de só depois que um revendedor renegocia.

O GPT-6 Sol não está em nosso catálogo no momento em que escrevo — ele é acessível pela própria API da OpenAI. Então, a forma honesta de uma migração é uma rota com o GPT-5.6 Sol por trás dela, na mesma chave: enviar o tráfego novo para o GPT-6 Sol, manter o modelo anterior a uma mudança de configuração de distância e deixar o failover automático cobrir a janela em que a disponibilidade de um novo carro-chefe ainda está se acomodando. Para um modelo com dois dias de vida, com um botão de habilitação Enterprise na frente dele e um nível de contexto longo que muda a economia acima de 272K tokens, ter a geração anterior ainda conectada não é cautela — é a diferença entre uma tarde ruim e uma semana ruim.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

A lista de verificação de migração

Meça a distribuição real do seu contexto antes de qualquer outra coisa. Se o percentil 95 das suas solicitações ficar abaixo de 272.000 tokens de entrada, migre — a economia é de 50% genuínos nos dois lados da fatura, o custo por tarefa cai pela metade, e o índice composto diz que você não abriu mão de nada. Se uma parcela significativa do tráfego ficar acima dessa linha, modele o nível com cuidado: a aproximadamente US$ 4/US$ 15, a vantagem sobre os US$ 4/US$ 20 do GPT-5.6 Sol é de 25% na saída e nada na entrada, e você está pagando por isso com a perda de um resultado documentado de recuperação de contexto longo.

Verifique se alguém fica esperando pelo primeiro token. 107 segundos é cerca de vinte e oito vezes a mediana do painel, e é o modo de falha que vai aparecer primeiro em produção. Qualquer coisa com um humano do outro lado deve permanecer no GPT-5.6 Sol ou ser encaminhada para outro lugar.

Em seguida, verifique o caminho de ativação. Os planos Enterprise exigem que um administrador ative o GPT-6 Sol, e ele está totalmente ausente do ChatGPT Chat. Confirme que os seus usuários conseguem realmente acessá-lo antes de anunciar uma migração internamente.

Por fim, fique de olho no GDPval-AA v2.1 nas suas próprias avaliações durante o primeiro mês. O laboratório independente encontrou uma regressão ali, e um ganho composto de um ponto não lhe diz se o seu conjunto de tarefas específico subiu ou desceu. Execute suas avaliações nos dois modelos antes de fazer a migração, não depois.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the Vision, Tools, JSON and Reasoning badges, a 1.05M-token context with 128K maximum output and text + image + file input, list pricing of $4.00 input and $20.00 output per 1M tokens, and the description of GPT-5.6 Sol as the flagship of OpenAI's GPT-5.6 series, strong at command-line and multi-file coding tasks.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente