Cartão de título principal com o texto 'GPT-6 Sol Pro vs GPT-6 Astra' e o subtítulo 'O múltiplo de preço que todos citam está errado', um par de rótulos em duas colunas 'GPT-6 Sol Pro' / 'GPT-6 Astra', e uma linha de rodapé com o texto 'Preços de tabela dos fornecedores; valores por Artificial Analysis.', com o logotipo real da OrcaRouter no canto inferior direito.
Guides & Insights

GPT-6 Sol Pro vs GPT-6 Astra: O múltiplo de preço que todos citam está errado

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

GPT-6 Sol Pro e GPT-6 Astra são o nível barato e o carro-chefe do mesmo fornecedor, e o múltiplo que a maior parte da cobertura associa a essa diferença é 2,5×. Não é 2,5×. GPT-6 Sol — o modelo do fornecedor que a configuração gpt-6-sol-pro executa, em disponibilidade geral desde 22 de setembro de 2026, a US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de tokens de saída — tem seu preço comparado ao do GPT-6 Astra, o carro-chefe que alcançou disponibilidade geral em 3 de setembro de 2026, a US$ 10,00 e US$ 50,00. Isso é cinco vezes na entrada e cinco vezes na saída. O número de 2,5× pertence a uma comparação diferente: o Astra medido em relação ao GPT-5.6 Sol, a geração anterior, que custava US$ 4,00 e US$ 20,00.

Vale a pena corrigir a confusão antes de qualquer outra coisa, porque ela muda a decisão. Um prêmio de 2,5× para o carro-chefe é um erro de arredondamento em um orçamento de projeto. Um prêmio de 5× é o maior item de linha individual na maioria dos planos de inferência, e é o número que determina se o carro-chefe é o padrão ou uma exceção.

De onde veio o múltiplo errado

Quando a Astra foi lançada, em 3 de setembro, a comparação que a OpenAI e a maioria dos veículos de imprensa fizeram foi com o GPT-5.6 Sol, que era o modelo intermediário disponível na época. A Astra custava 2,5 vezes o preço desse modelo. Dezenove dias depois, a OpenAI lançou o GPT-6 Sol e cortou pela metade o preço do modelo intermediário, de $4,00 e $20,00 para $2,00 e $10,00, e descreveu os novos valores como permanentes, e não promocionais. Todas as páginas de "vs" nos principais resultados para essa comparação foram escritas nessa janela de dezenove dias e comparam a Astra ao modelo que não ocupa mais essa posição.

Nada sobre a Astra mudou. O nível abaixo dela mudou, e o múltiplo dobrou.

As duas tabelas de tarifas, linha por linha

Ambos são números publicados pela própria OpenAI, repassados sem alteração pelas plataformas que os hospedam.

• Entrada — GPT-6 Sol $2,00 por milhão de tokens vs GPT-6 Astra $10,00 por milhão de tokens

• Saída — GPT-6 Sol US$ 10,00 por milhão de tokens vs. GPT-6 Astra US$ 50,00 por milhão de tokens

• Entrada em cache — GPT-6 Sol $0,20 por milhão de tokens vs GPT-6 Astra $1,00 por milhão de tokens; ambos a uma taxa fixa de 10% da tarifa sem cache

• Gravação em cache — GPT-6 Sol $2,50 por milhão de tokens vs. GPT-6 Astra $12,50 por milhão de tokens, ambos a 1,25× a taxa de entrada sem cache

• Processamento de contexto longo — O GPT-6 Sol redefine o preço de uma solicitação acima do seu limite de entrada, cobrando o dobro das tarifas de entrada e de cache e 1,5× a tarifa de saída, para toda a solicitação; o GPT-6 Astra faz o mesmo acima de 272.000 tokens de entrada, a US$ 20,00, US$ 2,00, US$ 25,00 e US$ 75,00

• Lote — GPT-6 Sol pela metade dos preços padrão vs GPT-6 Astra pela metade de seus preços padrão, $5,00 e $25,00, o que preserva exatamente a proporção de 5×

• Janela de contexto — 1.050.000 tokens para ambos

• Saída máxima — 128.000 tokens para ambos

• Modalidades de entrada — texto e imagem para ambos, com o GPT-6 Astra também aceitando entrada de arquivos

• Data de corte de conhecimento — GPT-6 Sol 20 de abril de 2026 vs GPT-6 Astra 30 de abril de 2026, dez dias de diferença

Os dois cartões não são apenas semelhantes em estrutura; eles são a mesma estrutura com um multiplicador de cinco vezes aplicado a cada linha, incluindo o nível de lote e o nível de contexto longo. Isso é um design de produto deliberado, e significa que a escolha entre eles é genuinamente uma decisão de capacidade, e não uma decisão de estratégia de preços. Não há desconto a ser encontrado ao alterar o formato da sua solicitação.

A two-column scoreboard card titled 'GPT-6 Sol vs GPT-6 Astra - the scoreboard'. Left column 'GPT-6 Sol': AA Index, max effort 48; AA Index, high effort 43; price in/out $2 / $10; cost per index task, max $1.06; reasoning effort ladder none to max; Terminal-Bench 4.0 43%. Right column 'GPT-6 Astra': AA Index, max effort 53; AA Index, high effort 51; price in/out $10 / $50; cost per index task, max $3.26; reasoning effort ladder low to max, no none; Terminal-Bench 4.0 59%. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

O botão de esforço é a assimetria sobre a qual ninguém escreve.

Ambos os modelos expõem um parâmetro de esforço de raciocínio. As duas escadas não são idênticas, e a diferença tem consequências para a migração.

O conjunto documentado do GPT-6 Sol é none, low, medium, high, xhigh e max, com medium como padrão. O do GPT-6 Astra é low, medium, high, xhigh e max — não há none. Você não pode desativar o raciocínio no modelo principal. Se o seu pipeline tiver uma etapa de classificação sensível à latência que atualmente roda com esforço none, essa etapa não é portada para o Astra sem alterações; ela precisa ser reajustada, movida para um modelo diferente ou aceita com um piso de latência mais alto.

Isso é uma coisa pequena que custa uma quantidade considerável de tempo de engenharia, e está ausente de todas as páginas de comparação deste confronto porque essas páginas foram escritas com base em tabelas de preços, e não na documentação da API.

Os números independentes, com a versão do índice anexada.

A Artificial Analysis recalculou seu Intelligence Index várias vezes em 2026, e é neste confronto que isso mais importa, porque a pontuação da Astra mais repetida foi retirada.

Astra obteve 61 na versão v4.1.1 do índice no lançamento — empatou com GPT-5.6 Sol, e é por isso que grande parte da cobertura do lançamento descreveu o modelo de ponta como um avanço modesto. Esse 61 é real e vem de um índice que não existe mais. No ranking atual, Astra no esforço máximo pontua 53 a US$ 3,26 por tarefa do índice, e no esforço alto pontua 51 a US$ 1,73. GPT-6 Sol no esforço máximo pontua 48 a US$ 1,06 por tarefa do índice, e 43 no esforço alto por US$ 0,37.

Leia essas quatro linhas em conjunto e a forma da decisão surge.

• A vantagem da Astra sobre a Sol no topo de ambos os medidores é de cinco pontos no índice, a aproximadamente três vezes o custo por tarefa concluída.

• O Astra em esforço elevado custa $1,73 por tarefa. O Sol em esforço máximo custa $1,06. O modelo de topo a funcionar na sua configuração de esforço predefinida é mais caro do que o nível mais barato a funcionar no máximo, e as pontuações do índice são 51 e 48.

• A diferença de custo por tarefa — cerca de 3× — é menor que a diferença de 5× nas tarifas, porque Sol é o que mais consome tokens entre os dois por tarefa. Esse é um ponto genuíno a favor da Astra e é a única parte da narrativa do "2.5×" que resiste ao contato com os dados.

Duas ressalvas de honestidade devem ser anexadas. Estas são páginas diferentes da mesma família de índices, e não uma única execução comparativa direta publicada, e os próprios números de latência da Astra dependem do esforço em um grau que torna um único número enganoso — o mesmo modelo relata um tempo até o primeiro token medido em dezenas de segundos em um nível de esforço e em vários minutos em outro. Não cite um valor de latência da Astra sem nomear a configuração.

O que o topo de linha compra a 5×

As diferenças de capacidade são reais e estão concentradas em trabalho agêntico e multimodal, e não no raciocínio geral.

• Índice de agentes de programação — GPT-6 Astra 62 no harness Codex contra GPT-6 Sol 57, a US$ 7,09 e US$ 2,99 por tarefa, respectivamente. O carro-chefe usa cerca de um terço dos tokens por tarefa, e é por isso que a diferença por tarefa é menor que a diferença de tarifa.

• Terminal-Bench 4.0 — 59% para a Astra contra 43% para a Sol no mesmo painel independente, uma separação de dezesseis pontos que é a maior lacuna de capacidade isolada entre as duas.

• Linhas agênticas relatadas pelo fornecedor — a própria tabela de lançamento da OpenAI mostra a Astra à frente no OSWorld 2.0, ScreenSpot-Pro, AutomationBench e Agents' Last Exam, todos executados pelo fornecedor e nenhum replicado de forma independente. Ela também mostra a Sol à frente no FrontierMath T1–3 e no BrowseComp, o que vale a pena observar para quem estiver inclinado a ler a tabela do fornecedor como uma vitória completa.

• Postura de segurança — Astra foi o primeiro modelo da OpenAI designado no nível Crítico de cibersegurança sob o Preparedness Framework da empresa, e suas capacidades ciberofensivas avançadas estão condicionadas a um programa de acesso separado. Esse controle de acesso tem uma consequência na produção além das permissões: um monitor de desalinhamento é executado em requisições que usam ferramentas e, na API, uma tarefa sinalizada é interrompida em vez de ser pausada para revisão, como acontece nos clientes de consumidor.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

A versão curta é que a Astra é melhor nas coisas difíceis de substituir — longos ciclos agênticos, trabalho no terminal, uso do computador — e está mais ou menos no mesmo nível de Sol nas coisas fáceis de substituir. Cinco pontos em um índice de raciocínio geral não valem 5×. Dezesseis pontos no Terminal-Bench e uma diferença de cinco pontos em agente de programação, em um trabalho no qual uma execução fracassada custa uma hora de limpeza para uma pessoa, às vezes valem a pena.

Onde uma camada de roteamento altera a aritmética

GPT-6 Astra está no OrcaRouter a $10,00 de entrada e $50,00 de saída por milhão de tokens abaixo de um limite de entrada de 272.000 tokens, com o nível de contexto longo a $20,00 e $75,00 acima disso, uma janela de contexto de 1.050.000 tokens, um limite de saída de 128.000 tokens e um tempo p50 até o primeiro token de 7,82 segundos, conforme medido em nossa própria página do modelo. O preço de tabela do provedor é repassado com sem nenhuma margem adicional.

O GPT-6 Sol não é uma das nossas rotas, portanto nada aqui é uma afirmação sobre o seu preço através de nós.

Screenshot of the OrcaRouter model page for GPT-6 Astra (openai/gpt-6-astra), captured 23 September 2026, showing an input price of $10.00 and an output price of $50.00 per million tokens, a 1,050,000-token context window, a 128,000-token maximum output, and a p50 time to first token of 7.82 seconds.

Uma proporção de preço de 5× é o caso mais claro que existe para rotear em vez de escolher. A resposta correta para a maioria das equipes não é "o modelo principal" nem "o nível mais barato" — é ambos, com a decisão tomada por requisição em vez de por trimestre. O trabalho que precisa do Astra é identificável no ponto de chamada: é a execução agêntica, a tarefa de terminal, a etapa de uso do computador. O trabalho que não precisa é todo o resto. Colocar ambos atrás de uma única chave com failover automático transforma isso em uma regra de roteamento em vez de uma migração, e significa que o modelo caro só é invocado onde é aquilo pelo que se está pagando.

A regra de decisão

• Geração, extração, classificação e sumarização de texto em grande volume — GPT-6 Sol. Cinco vezes mais barato em cada linha, três pontos de índice atrás no raciocínio geral, e a opção padrão correta.

• Codificação agêntica, trabalho em terminal e uso do computador — GPT-6 Astra. Dezesseis pontos no Terminal-Bench e cinco no índice de agentes de codificação, em trabalhos nos quais uma execução malsucedida é medida em horas de trabalho humano.

• Pipelines que atualmente executam uma etapa com esforço de raciocínio none — nem um nem outro, sem um reajuste. A Astra não tem configuração none, e essa etapa não será portada sem alterações.

• Trabalho que exige entrada de ficheiro juntamente com imagens — GPT-6 Astra, que é o único dos dois que aceita um ficheiro.

• Quem leu que o modelo de topo representa um prémio de 2,5× — refaça as contas com 5×. É o mesmo modelo ao mesmo preço; o escalão abaixo dele mudou, e a decisão é diferente com o número corrigido.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente