
GPT-6 Sol vs GPT-5.6 Sol: um ponto no índice, metade do preço e uma regressão que ninguém anunciou
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 610 tok/s
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 189 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
Sim, faça o upgrade — mas leia o segundo parágrafo antes de fazer isso. GPT-6 Sol, lançado em 22 de setembro de 2026, obtém 48 no Índice de Inteligência da Artificial Analysis. GPT-5.6 Sol, lançado em 9 de julho de 2026, obtém 47. Um ponto. O modelo que o substituiu custa metade: US$ 2,00 por milhão de entrada e US$ 10,00 por milhão de saída, contra US$ 4,00 e US$ 20,00. Nos números principais, esta é a decisão de upgrade mais fácil da linha atual, e o corte de preço é real, permanente e a maior redução única que o fornecedor já fez em um carro-chefe.
A complicação é que a própria avaliação da Artificial Analysis sobre o GPT-6 Sol encontrou uma mistura de ganhos e regressões, e não um avanço inequívoco. Há regressões no GDPval-AA v2.1. Há também uma faixa de reprecificação de contexto longo acima de 272.000 tokens de entrada que praticamente dobra a tarifa de entrada e aumenta a de saída em 50% — e 272K é exatamente a faixa em que o GPT-5.6 Sol tem um ponto forte divulgado. Uma migração que parece um corte direto pela metade da sua fatura pode, no tráfego de contexto longo, acabar mais perto de um empate, com um trade-off de capacidade atrelado.
O que um ganho de um ponto no Index realmente significa
Ambos os modelos foram medidos na mesma placa, versão 4.3.2, o que faz desta a comparação mais limpa de toda a série GPT-6 Sol — sem diferenças de harness, sem discrepância entre fornecedor e independente, um laboratório medindo dois modelos de um único fornecedor.
• AA Intelligence Index — GPT-6 Sol 48, classificado em 18º de 212 vs GPT-5.6 Sol 47, classificado em 19º de 212
• Custo por tarefa do Index — GPT-6 Sol aproximadamente metade do GPT-5.6 Sol
• Velocidade de saída — GPT-6 Sol 104,4 tokens/seg vs GPT-5.6 Sol 72,6 tokens/seg
Tempo até o primeiro token — GPT-6 Sol 107,18s vs. GPT-5.6 Sol mais rápido, ambos em relação à mediana do painel de 3,87s
• Preço de entrada — GPT-6 Sol $2,00 por 1M vs GPT-5.6 Sol $4,00 por 1M
• Preço de saída — GPT-6 Sol $10.00 por 1M vs GPT-5.6 Sol $20.00 por 1M
• Entrada em cache — GPT-6 Sol cerca de 90% de desconto em relação ao GPT-5.6 Sol $0,40 por 1M
• Tarifa de lote — GPT-6 Sol não publicado vs GPT-5.6 Sol US$ 2,50 / US$ 15,00
• Nível de contexto longo — GPT-6 Sol altera o preço acima de 272K de entrada vs GPT-5.6 Sol sem etapa equivalente
• Janela de contexto — GPT-6 Sol 872K por AA, 1,05M alegado vs GPT-5.6 Sol aproximadamente 1,05M a 1,1M
• Saída máxima — 128K em ambos
• Lançado — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

Veja as duas linhas de velocidade em conjunto. O GPT-6 Sol gera saída cerca de 44% mais rápido que seu antecessor, e é dramaticamente mais lento para produzir o primeiro token — 107,18 segundos contra uma mediana do quadro de 3,87. O GPT-5.6 Sol também não é um modelo rápido pelos padrões do quadro, mas não está nessa faixa. Se você migrou para o GPT-5.6 Sol para um produto interativo, o GPT-6 Sol não é um substituto direto, e isso é uma regressão funcional independente de qualquer benchmark.
Há um detalhe discretamente favorável: a tarifa padrão do GPT-6 Sol, de US$ 2/US$ 10, fica abaixo da tarifa em lote do GPT-5.6 Sol, de US$ 2,50/US$ 15. Até o nível com desconto do modelo antigo é mais caro que o preço de tabela do novo. Essa é a evidência mais forte de que o corte é estrutural, e não promocional.
A regressão é a parte interessante.
A Artificial Analysis constatou que o GPT-6 Sol reduz aproximadamente pela metade o custo por tarefa, ao mesmo tempo que gera uma mistura de ganhos e regressões. O GDPval-AA v2.1 é a regressão citada. Separadamente, o GPT-5.6 Luna, da OpenAI, também regrediu no Coding Agent Index — o que sugere um padrão nesta geração, em vez de uma falha isolada em um único modelo.
Isto merece ser levado a sério justamente porque é a constatação independente. Os materiais de lançamento da OpenAI giram em torno do custo por tarefa e das linhas de benchmark que ela selecionou; a Artificial Analysis não tem nenhum produto para vender e relata o que o seu sistema de avaliação produziu. Um modelo que é mais barato e praticamente igual no índice composto, mas mensuravelmente pior em subtarefas específicas, não é um modelo estritamente melhor. É um ponto diferente na fronteira.
A versão prática disso: se a sua carga de trabalho for fortemente moldada pelo GDPval-AA — trabalho de conhecimento economicamente valioso, o tipo de tarefa que esse benchmark foi criado para precificar —, então o ganho de um ponto na pontuação composta não cobre o seu caso, e a regressão é o número que importa. Se a sua carga de trabalho for geral, a redução pela metade do custo por tarefa é o número que importa, e a pontuação composta diz que você não abriu mão de nada mensurável.
Onde o GPT-5.6 Sol ainda vence
O GPT-5.6 Sol tem um resultado publicado de recuperação em contexto longo que o GPT-6 Sol não iguala com nada equivalente: MRCR v2, 8-needle, 91,5% na faixa de 256K a 512K. Trata-se de um índice de precisão de recuperação justamente na banda em que o tarifário do GPT-6 Sol muda.
Coloque os dois fatos lado a lado. Acima de 272.000 tokens de entrada, toda a solicitação do GPT-6 Sol é reprecificada para aproximadamente US$ 4 de entrada e US$ 15 de saída. Isso equivale aproximadamente à tarifa antiga do GPT-5.6 Sol na entrada e a três quartos dela na saída — portanto, a economia de 50% pela qual você migrou cai para cerca de 0% na entrada e 25% na saída, exatamente na faixa de contexto em que o GPT-5.6 Sol tem uma força documentada e o GPT-6 Sol não tem equivalente publicado.
Os outros resultados publicados do GPT-5.6 Sol permanecem respeitáveis e são a razão pela qual algumas equipes não farão a mudança:
• Último Exame dos Agentes — GPT-5.6 Sol 53,6
• Terminal-Bench 2.1 — GPT-5.6 Sol 88,8 / 88,0
• SWE-Bench Pro — GPT-5.6 Sol 64,6
• OSWorld 2.0 — GPT-5.6 Sol 62,6
• BrowseComp — GPT-5.6 Sol 90,4
• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo
• HLE — GPT-5.6 Sol 49,5
• MRCR v2, 8 agulhas — GPT-5.6 Sol 91,5% de 256K a 512K
Estes são reportados pela OpenAI. Observe que o BrowseComp em 90,4 e o número do MRCR são os dois mais difíceis de substituir: agentes de pesquisa na web e a recuperação de contexto longo são cargas de trabalho nas quais um modelo de dois meses de idade com um número publicado é uma aposta mais segura do que um modelo novo sem medição correspondente.
O que o GPT-6 Sol traz que não está na tabela de preços
O preço é o destaque, mas outras três coisas mudaram.
Primeiro, o teto de contexto. O GPT-6 Sol está listado com 872.000 tokens pela Artificial Analysis, contra uma alegação de 1,05M em outra parte dos materiais da OpenAI, com entrada máxima de 922K. O GPT-5.6 Sol fica em torno de 1,05M a 1,1M, dependendo da fonte. No papel, isso é um pequeno retrocesso na janela utilizável — com a ressalva de que é o limite de faixa de 272K, não o teto, que determina o custo.
Segundo, disponibilidade. O GPT-6 Sol está na API e no ChatGPT Work e Codex nos planos Plus, Pro, Business, Enterprise e Edu — e os administradores do Enterprise precisam habilitá-lo antes que os usuários o vejam. Ele não está no ChatGPT Chat. O GPT-5.6 Sol foi um lançamento mais amplo. Se o caminho de acesso da sua equipe passa por um administrador do Enterprise, a migração não é apenas uma mudança de código.
Terceiro, o lançamento de um novo modelo principal geralmente significa que o antigo se torna a alternativa mais barata, em vez de ser descontinuado. O GPT-5.6 Sol, a US$ 4/US$ 20, ainda é um excelente modelo, com 47 no Index, e, para trabalho de recuperação de contexto longo, tem um número publicado que o GPT-6 Sol não tem.
Uma migração que custa menos do que parece
A razão pela qual esta atualização específica é fácil é que os dois modelos são do mesmo fornecedor, têm o mesmo formato de API e são adjacentes no ranking — o que significa que a migração é uma mudança de string de modelo, e não uma rearquitetura, e o caminho de fallback já está no seu código. O GPT-5.6 Sol está no OrcaRouter pelo preço de tabela da OpenAI, sob o modelo de repasse que faz uma mudança de preço da OpenAI entrar em vigor do nosso lado no mesmo dia, em vez de só depois que um revendedor renegocia.
O GPT-6 Sol não está em nosso catálogo no momento em que escrevo — ele é acessível pela própria API da OpenAI. Então, a forma honesta de uma migração é uma rota com o GPT-5.6 Sol por trás dela, na mesma chave: enviar o tráfego novo para o GPT-6 Sol, manter o modelo anterior a uma mudança de configuração de distância e deixar o failover automático cobrir a janela em que a disponibilidade de um novo carro-chefe ainda está se acomodando. Para um modelo com dois dias de vida, com um botão de habilitação Enterprise na frente dele e um nível de contexto longo que muda a economia acima de 272K tokens, ter a geração anterior ainda conectada não é cautela — é a diferença entre uma tarde ruim e uma semana ruim.

A lista de verificação de migração
Meça a distribuição real do seu contexto antes de qualquer outra coisa. Se o percentil 95 das suas solicitações ficar abaixo de 272.000 tokens de entrada, migre — a economia é de 50% genuínos nos dois lados da fatura, o custo por tarefa cai pela metade, e o índice composto diz que você não abriu mão de nada. Se uma parcela significativa do tráfego ficar acima dessa linha, modele o nível com cuidado: a aproximadamente US$ 4/US$ 15, a vantagem sobre os US$ 4/US$ 20 do GPT-5.6 Sol é de 25% na saída e nada na entrada, e você está pagando por isso com a perda de um resultado documentado de recuperação de contexto longo.
Verifique se alguém fica esperando pelo primeiro token. 107 segundos é cerca de vinte e oito vezes a mediana do painel, e é o modo de falha que vai aparecer primeiro em produção. Qualquer coisa com um humano do outro lado deve permanecer no GPT-5.6 Sol ou ser encaminhada para outro lugar.
Em seguida, verifique o caminho de ativação. Os planos Enterprise exigem que um administrador ative o GPT-6 Sol, e ele está totalmente ausente do ChatGPT Chat. Confirme que os seus usuários conseguem realmente acessá-lo antes de anunciar uma migração internamente.
Por fim, fique de olho no GDPval-AA v2.1 nas suas próprias avaliações durante o primeiro mês. O laboratório independente encontrou uma regressão ali, e um ganho composto de um ponto não lhe diz se o seu conjunto de tarefas específico subiu ou desceu. Execute suas avaliações nos dois modelos antes de fazer a migração, não depois.

Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
