
GPT-6 Sol Pro vs GPT-6 Astra: O múltiplo de preço que todos citam está errado
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
GPT-6 Sol Pro e GPT-6 Astra são o nível barato e o carro-chefe do mesmo fornecedor, e o múltiplo que a maior parte da cobertura associa a essa diferença é 2,5×. Não é 2,5×. GPT-6 Sol — o modelo do fornecedor que a configuração gpt-6-sol-pro executa, em disponibilidade geral desde 22 de setembro de 2026, a US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de tokens de saída — tem seu preço comparado ao do GPT-6 Astra, o carro-chefe que alcançou disponibilidade geral em 3 de setembro de 2026, a US$ 10,00 e US$ 50,00. Isso é cinco vezes na entrada e cinco vezes na saída. O número de 2,5× pertence a uma comparação diferente: o Astra medido em relação ao GPT-5.6 Sol, a geração anterior, que custava US$ 4,00 e US$ 20,00.
Vale a pena corrigir a confusão antes de qualquer outra coisa, porque ela muda a decisão. Um prêmio de 2,5× para o carro-chefe é um erro de arredondamento em um orçamento de projeto. Um prêmio de 5× é o maior item de linha individual na maioria dos planos de inferência, e é o número que determina se o carro-chefe é o padrão ou uma exceção.
De onde veio o múltiplo errado
Quando a Astra foi lançada, em 3 de setembro, a comparação que a OpenAI e a maioria dos veículos de imprensa fizeram foi com o GPT-5.6 Sol, que era o modelo intermediário disponível na época. A Astra custava 2,5 vezes o preço desse modelo. Dezenove dias depois, a OpenAI lançou o GPT-6 Sol e cortou pela metade o preço do modelo intermediário, de $4,00 e $20,00 para $2,00 e $10,00, e descreveu os novos valores como permanentes, e não promocionais. Todas as páginas de "vs" nos principais resultados para essa comparação foram escritas nessa janela de dezenove dias e comparam a Astra ao modelo que não ocupa mais essa posição.
Nada sobre a Astra mudou. O nível abaixo dela mudou, e o múltiplo dobrou.
As duas tabelas de tarifas, linha por linha
Ambos são números publicados pela própria OpenAI, repassados sem alteração pelas plataformas que os hospedam.
• Entrada — GPT-6 Sol $2,00 por milhão de tokens vs GPT-6 Astra $10,00 por milhão de tokens
• Saída — GPT-6 Sol US$ 10,00 por milhão de tokens vs. GPT-6 Astra US$ 50,00 por milhão de tokens
• Entrada em cache — GPT-6 Sol $0,20 por milhão de tokens vs GPT-6 Astra $1,00 por milhão de tokens; ambos a uma taxa fixa de 10% da tarifa sem cache
• Gravação em cache — GPT-6 Sol $2,50 por milhão de tokens vs. GPT-6 Astra $12,50 por milhão de tokens, ambos a 1,25× a taxa de entrada sem cache
• Processamento de contexto longo — O GPT-6 Sol redefine o preço de uma solicitação acima do seu limite de entrada, cobrando o dobro das tarifas de entrada e de cache e 1,5× a tarifa de saída, para toda a solicitação; o GPT-6 Astra faz o mesmo acima de 272.000 tokens de entrada, a US$ 20,00, US$ 2,00, US$ 25,00 e US$ 75,00
• Lote — GPT-6 Sol pela metade dos preços padrão vs GPT-6 Astra pela metade de seus preços padrão, $5,00 e $25,00, o que preserva exatamente a proporção de 5×
• Janela de contexto — 1.050.000 tokens para ambos
• Saída máxima — 128.000 tokens para ambos
• Modalidades de entrada — texto e imagem para ambos, com o GPT-6 Astra também aceitando entrada de arquivos
• Data de corte de conhecimento — GPT-6 Sol 20 de abril de 2026 vs GPT-6 Astra 30 de abril de 2026, dez dias de diferença
Os dois cartões não são apenas semelhantes em estrutura; eles são a mesma estrutura com um multiplicador de cinco vezes aplicado a cada linha, incluindo o nível de lote e o nível de contexto longo. Isso é um design de produto deliberado, e significa que a escolha entre eles é genuinamente uma decisão de capacidade, e não uma decisão de estratégia de preços. Não há desconto a ser encontrado ao alterar o formato da sua solicitação.

O botão de esforço é a assimetria sobre a qual ninguém escreve.
Ambos os modelos expõem um parâmetro de esforço de raciocínio. As duas escadas não são idênticas, e a diferença tem consequências para a migração.
O conjunto documentado do GPT-6 Sol é none, low, medium, high, xhigh e max, com medium como padrão. O do GPT-6 Astra é low, medium, high, xhigh e max — não há none. Você não pode desativar o raciocínio no modelo principal. Se o seu pipeline tiver uma etapa de classificação sensível à latência que atualmente roda com esforço none, essa etapa não é portada para o Astra sem alterações; ela precisa ser reajustada, movida para um modelo diferente ou aceita com um piso de latência mais alto.
Isso é uma coisa pequena que custa uma quantidade considerável de tempo de engenharia, e está ausente de todas as páginas de comparação deste confronto porque essas páginas foram escritas com base em tabelas de preços, e não na documentação da API.
Os números independentes, com a versão do índice anexada.
A Artificial Analysis recalculou seu Intelligence Index várias vezes em 2026, e é neste confronto que isso mais importa, porque a pontuação da Astra mais repetida foi retirada.
Astra obteve 61 na versão v4.1.1 do índice no lançamento — empatou com GPT-5.6 Sol, e é por isso que grande parte da cobertura do lançamento descreveu o modelo de ponta como um avanço modesto. Esse 61 é real e vem de um índice que não existe mais. No ranking atual, Astra no esforço máximo pontua 53 a US$ 3,26 por tarefa do índice, e no esforço alto pontua 51 a US$ 1,73. GPT-6 Sol no esforço máximo pontua 48 a US$ 1,06 por tarefa do índice, e 43 no esforço alto por US$ 0,37.
Leia essas quatro linhas em conjunto e a forma da decisão surge.
• A vantagem da Astra sobre a Sol no topo de ambos os medidores é de cinco pontos no índice, a aproximadamente três vezes o custo por tarefa concluída.
• O Astra em esforço elevado custa $1,73 por tarefa. O Sol em esforço máximo custa $1,06. O modelo de topo a funcionar na sua configuração de esforço predefinida é mais caro do que o nível mais barato a funcionar no máximo, e as pontuações do índice são 51 e 48.
• A diferença de custo por tarefa — cerca de 3× — é menor que a diferença de 5× nas tarifas, porque Sol é o que mais consome tokens entre os dois por tarefa. Esse é um ponto genuíno a favor da Astra e é a única parte da narrativa do "2.5×" que resiste ao contato com os dados.
Duas ressalvas de honestidade devem ser anexadas. Estas são páginas diferentes da mesma família de índices, e não uma única execução comparativa direta publicada, e os próprios números de latência da Astra dependem do esforço em um grau que torna um único número enganoso — o mesmo modelo relata um tempo até o primeiro token medido em dezenas de segundos em um nível de esforço e em vários minutos em outro. Não cite um valor de latência da Astra sem nomear a configuração.
O que o topo de linha compra a 5×
As diferenças de capacidade são reais e estão concentradas em trabalho agêntico e multimodal, e não no raciocínio geral.
• Índice de agentes de programação — GPT-6 Astra 62 no harness Codex contra GPT-6 Sol 57, a US$ 7,09 e US$ 2,99 por tarefa, respectivamente. O carro-chefe usa cerca de um terço dos tokens por tarefa, e é por isso que a diferença por tarefa é menor que a diferença de tarifa.
• Terminal-Bench 4.0 — 59% para a Astra contra 43% para a Sol no mesmo painel independente, uma separação de dezesseis pontos que é a maior lacuna de capacidade isolada entre as duas.
• Linhas agênticas relatadas pelo fornecedor — a própria tabela de lançamento da OpenAI mostra a Astra à frente no OSWorld 2.0, ScreenSpot-Pro, AutomationBench e Agents' Last Exam, todos executados pelo fornecedor e nenhum replicado de forma independente. Ela também mostra a Sol à frente no FrontierMath T1–3 e no BrowseComp, o que vale a pena observar para quem estiver inclinado a ler a tabela do fornecedor como uma vitória completa.
• Postura de segurança — Astra foi o primeiro modelo da OpenAI designado no nível Crítico de cibersegurança sob o Preparedness Framework da empresa, e suas capacidades ciberofensivas avançadas estão condicionadas a um programa de acesso separado. Esse controle de acesso tem uma consequência na produção além das permissões: um monitor de desalinhamento é executado em requisições que usam ferramentas e, na API, uma tarefa sinalizada é interrompida em vez de ser pausada para revisão, como acontece nos clientes de consumidor.

A versão curta é que a Astra é melhor nas coisas difíceis de substituir — longos ciclos agênticos, trabalho no terminal, uso do computador — e está mais ou menos no mesmo nível de Sol nas coisas fáceis de substituir. Cinco pontos em um índice de raciocínio geral não valem 5×. Dezesseis pontos no Terminal-Bench e uma diferença de cinco pontos em agente de programação, em um trabalho no qual uma execução fracassada custa uma hora de limpeza para uma pessoa, às vezes valem a pena.
Onde uma camada de roteamento altera a aritmética
GPT-6 Astra está no OrcaRouter a $10,00 de entrada e $50,00 de saída por milhão de tokens abaixo de um limite de entrada de 272.000 tokens, com o nível de contexto longo a $20,00 e $75,00 acima disso, uma janela de contexto de 1.050.000 tokens, um limite de saída de 128.000 tokens e um tempo p50 até o primeiro token de 7,82 segundos, conforme medido em nossa própria página do modelo. O preço de tabela do provedor é repassado com sem nenhuma margem adicional.
O GPT-6 Sol não é uma das nossas rotas, portanto nada aqui é uma afirmação sobre o seu preço através de nós.

Uma proporção de preço de 5× é o caso mais claro que existe para rotear em vez de escolher. A resposta correta para a maioria das equipes não é "o modelo principal" nem "o nível mais barato" — é ambos, com a decisão tomada por requisição em vez de por trimestre. O trabalho que precisa do Astra é identificável no ponto de chamada: é a execução agêntica, a tarefa de terminal, a etapa de uso do computador. O trabalho que não precisa é todo o resto. Colocar ambos atrás de uma única chave com failover automático transforma isso em uma regra de roteamento em vez de uma migração, e significa que o modelo caro só é invocado onde é aquilo pelo que se está pagando.
A regra de decisão
• Geração, extração, classificação e sumarização de texto em grande volume — GPT-6 Sol. Cinco vezes mais barato em cada linha, três pontos de índice atrás no raciocínio geral, e a opção padrão correta.
• Codificação agêntica, trabalho em terminal e uso do computador — GPT-6 Astra. Dezesseis pontos no Terminal-Bench e cinco no índice de agentes de codificação, em trabalhos nos quais uma execução malsucedida é medida em horas de trabalho humano.
• Pipelines que atualmente executam uma etapa com esforço de raciocínio none — nem um nem outro, sem um reajuste. A Astra não tem configuração none, e essa etapa não será portada sem alterações.
• Trabalho que exige entrada de ficheiro juntamente com imagens — GPT-6 Astra, que é o único dos dois que aceita um ficheiro.
• Quem leu que o modelo de topo representa um prémio de 2,5× — refaça as contas com 5×. É o mesmo modelo ao mesmo preço; o escalão abaixo dele mudou, e a decisão é diferente com o número corrigido.
Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
