
GPT-6.1 Sol Já Está Disponível: Quase Astra por Um Quinto do Preço, Uma Semana Depois do Modelo que Substitui
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 507 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 194 tok/s
- OrcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1143 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 55 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
A OpenAI lançou o GPT-6.1 Sol em 29 de setembro de 2026, na sua keynote do DevDay 2026 — uma atualização do nível GPT-6 Sol que foi lançado exatamente uma semana antes, sem nenhum reajuste de preço, e mirando diretamente um modelo que custa cinco vezes mais. Os números principais permanecem inalterados em relação ao modelo que ele substitui: US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de tokens de saída. O número que de fato mudou é o que a maioria das cargas de trabalho de agentes realmente paga: a entrada em cache caiu de US$ 0,20 para US$ 0,10 por milhão de tokens, metade da tarifa do GPT-6 Sol e um décimo da do GPT-6 Astra. A própria formulação da OpenAI é que o GPT-6.1 Sol "quase iguala" a inteligência do GPT-6 Astra em codificação agêntica, uso de computador e trabalho profissional a um quinto dos preços padrão de tokens do Astra, e isso é uma alegação do fornecedor, não um resultado medido — até 30 de setembro, nenhum avaliador independente publicou uma única pontuação para o modelo. O que segue separa as duas.
O que foi lançado, e onde está o registro

O lançamento está excepcionalmente bem documentado para um anúncio de DevDay. Em questão de horas, havia uma página do modelo em developers.openai.com, um bloco de preços, um adendo ao system card em deploymentsafety.openai.com e um commit no próprio esquema público da API do fornecedor, intitulado "Add gpt-6.1-sol model to model enums", com data e hora de 17:16 UTC de 29 de setembro. O changelog para desenvolvedores da OpenAI, em contrapartida, ainda termina na entrada de 22 de setembro, que anunciou o GPT-6 Sol e o GPT-6 Luna — a entrada do 6.1 não foi escrita lá, de modo que a página do modelo e o post de lançamento são o registro principal. A resolução importa porque não há um segundo snapshot de geração para o qual apontar: a lista de snapshots da página contém um único identificador, gpt-6.1-sol, sem variante datada, então "GPT-6.1 Sol" e a implantação que você chama hoje são a mesma coisa.
A forma disso, lado a lado com o que substitui:
• Identificador — gpt-6.1-sol, um único snapshot vs gpt-6-sol, também sem variante datada
• Contexto — 1.050.000 tokens e 128.000 tokens máximos de saída para ambos; a página do 6.1 declara ambos os números explicitamente, enquanto a página do 6.0 documenta, em vez disso, um máximo de entrada de 922.000 tokens
• Data de corte de conhecimento — 30 de abril de 2026 vs 20 de abril de 2026
• Esforço de raciocínio — baixo, médio (padrão), alto, xhigh, máximo, com nenhum e mínimo sem suporte vs a mesma escala, mais nenhum
• Preços — $2,00 de entrada / $0,10 em cache / $2,50 de gravação em cache / $10,00 de saída por milhão de tokens vs $2,00 / $0,20 / $2,50 / $10,00
• Prompts longos — acima de 272K tokens de entrada, toda a solicitação tem o preço reajustado para 2× as tarifas de entrada e cache e 1,5× a de saída, idêntico nos dois modelos
• Disponibilidade — Plus, Pro, Business, Enterprise e Edu no ChatGPT Work e Codex, além da API; explicitamente não no produto Chat para consumidores
• Residência — suporte a residência de dados nos EUA e na UE, com o modo rápido indisponível sob residência na UE
• Ferramentas — pesquisa na web, pesquisa de arquivos, geração de imagens, interpretador de código, shell hospedado, aplicação de patch, habilidades, uso do computador, MCP e pesquisa de ferramentas, todos com suporte por meio da API Responses
• Ajuste fino — sem suporte em nenhum dos dois
Uma característica da API que vale a pena destacar antes de você migrar: o GPT-6.1 Sol oferece suporte a Chat Completions, mas a chamada de ferramentas exige a API Responses. No GPT-6 Sol, a restrição era a inversa adjacente — a chamada de funções no Chat Completions funcionava apenas com reasoning_effort: "none". Se a sua stack chama ferramentas por meio de /v1/chat/completions, isso é uma mudança de código, não uma troca de modelo.
O benchmark alega, rotulado como alegações
Todos os números nesta seção são da OpenAI, publicados no post de lançamento, e nenhum deles foi reproduzido por ninguém fora da OpenAI até agora. Vale a pena lê-los na íntegra porque o padrão entre eles é consistente — os ganhos sobre o GPT-6 Sol são reais, mas o enquadramento que se espalha é a comparação com a Astra, e a comparação com a Astra é sempre uma comparação de custos.
• DeepSWE v1.1, tarefas complexas de engenharia de software em bases de código reais — OpenAI relata que o GPT-6.1 Sol iguala o GPT-6 Astra a cerca de um quinto do custo, e supera a melhor pontuação do GPT-6 Sol em 6,4 pontos percentuais com esforço de raciocínio e custo menores.
• GDP.pdf, perguntas profissionais sobre documentos PDF complexos — OpenAI relata que o GPT-6.1 Sol pontua acima do Claude Opus 5.5 com fallbacks a menos da metade do custo por tarefa em todas as configurações de raciocínio testadas, e aproxima-se do resultado state-of-the-art da Astra a cerca de um quinto do custo por tarefa.
• AutomationBench 1.0.6, fluxos de trabalho empresariais com múltiplas etapas em 47 ferramentas — OpenAI relata 2,2 pontos percentuais acima do Claude Opus 5.5 com esforço de raciocínio médio a cerca de um terço do custo, e 4,8 pontos acima do GPT-6 Sol na mesma configuração.
• OSWorld 2.0 conjunto offline, uso de computador de longo horizonte — OpenAI relata uma melhoria de sete pontos sobre o GPT-6 Sol com esforço de raciocínio máximo a menos da metade do custo, e um resultado dentro de 2,1 pontos da Astra a cerca de um sétimo do custo por tarefa.
• Terminal-Bench Science 0.1, fluxos de trabalho científicos — OpenAI relata que o GPT-6.1 Sol mais que dobra a pontuação do GPT-6 Sol com esforço máximo a menos da metade do custo por tarefa, a $5,47 por tarefa em média, contra $23,21 do Claude Opus 5.5 e $23,80 da Astra. OpenAI também afirma que a Astra ainda detém a pontuação máxima entre os modelos testados, com 68,1%, e deve ser usada para o trabalho científico mais difícil — uma frase utilmente não mercadológica.
• Factuality — em conversas desidentificadas nas quais os usuários sinalizaram um erro de um modelo anterior, a OpenAI relata que a proporção de respostas contendo um erro factual caiu de 11,4% para 7,7% com esforço de raciocínio baixo, uma redução de cerca de 32%, com a taxa de erro permanecendo dentro de 1,9 pontos da Astra em todas as configurações testadas a menos de um quinto do custo por tarefa.
Dois desses merecem tradução. Primeiro, a avaliação de factualidade é executada sobre prompts escolhidos deliberadamente porque um modelo anterior errou neles; a OpenAI diz isso no post, e isso significa que os 11,4% e 7,7% descrevem uma fatia hostil do tráfego, não o seu tráfego. Segundo, o parágrafo que mais fortemente favorece o modelo é aquele sobre a transparência da ferramenta de busca no adendo de segurança: em tarefas criadas para provocar falhas com esforço máximo de raciocínio, o GPT-6.1 Sol deixa de avisar o usuário de que sua ferramenta de busca está quebrada em 2,1% dos casos, contra 4,9% do GPT-6 Sol, 1,5% do GPT-6 Astra e 28,7% do GPT-6 Luna. Esse é o tipo de número que decide se um agente é implantável, e também é, mais uma vez, um número do próprio fornecedor.
O registro independente está vazio, e essa é a outra metade da história

A Artificial Analysis — o painel de terceiros que este blog trata como a referência neutra — não tem nenhuma entrada para o GPT-6.1 Sol. As URLs de modelo do painel para o slug 6.1 Sol retornam 404, e a string não aparece no HTML do leaderboard ao vivo. O que o painel tem é uma avaliação completa do GPT-6 Sol com esforço máximo de raciocínio: um Intelligence Index de 48, um custo de US$ 1,06 por tarefa do índice, 77 milhões de tokens de saída gerados durante a execução do índice, em comparação com uma mediana do painel de 88 milhões, e um Coding Agent Index de 57 a US$ 2,99 por tarefa. Esses números são a âncora independente mais próxima para o modelo que o GPT-6.1 Sol substitui, e é em relação a eles que qualquer alegação sobre o 6.1 deveria, em última análise, ser medida.
Até que essa entrada apareça, qualquer pessoa que cite uma pontuação do 6.1 Sol contra outro modelo está citando a OpenAI contra a OpenAI. Isso não é motivo para desconfiar do post de lançamento; é motivo para executar seu próprio conjunto de avaliação antes de mover um caminho de produção. O fornecedor dá uma instrução excepcionalmente concreta sobre isso: a OpenAI diz aos desenvolvedores que já usam o GPT-6 Sol para revisar as orientações de migração antes de trocar, e as orientações de migração dizem para comparar configurações em tarefas representativas em vez de presumir que o esforço mais alto é a melhor relação custo-benefício.
O desconto no input em cache é a parte que realmente altera a fatura.
Uma tabela de preços que não se move, mas uma taxa de cache que cai pela metade é fácil de passar despercebida, e é a linha mais consequente do lançamento para quem executa agentes. A entrada em cache a $0,10 por milhão de tokens é 5% da taxa de entrada não cacheada, metade da taxa de cache do GPT-6 Sol e — em comparação com a entrada em cache de $1,00 do GPT-6 Astra — um décimo da do carro-chefe. Os loops de agentes que reenviam um prefixo estável milhares de vezes vivem quase que exclusivamente dessa linha. O mesmo mês de agente de 200 milhões de tokens que seria cobrado cerca de $40 em cache no GPT-6 Sol cobra cerca de $20 no GPT-6.1 Sol; no GPT-6 Astra, o mesmo tráfego custa $200.
A aritmética nunca fica tão limpa em produção, porque as leituras de cache só são cobradas a essa taxa quando o prefixo realmente acerta na cache, e a OpenAI observa que alterar o esforço de raciocínio ou o conjunto de ferramentas disponível já não invalida uma entrada de cache como antes — que é a correção silenciosa que torna a linha de cache minimamente utilizável num loop de agente. O outro limite a observar permanece inalterado: ultrapasse 272 000 tokens de entrada e todo o pedido é reprecificado ao dobro das taxas de entrada e de cache e 1,5× da taxa de saída. O Batch e o Flex custam 50% menos que o padrão, o modo rápido custa 2× o padrão, e o processamento regional acrescenta um prêmio de 10% onde está disponível.
O que ainda não foi lançado e o que isso significa para o roteamento

A OpenAI diz que o GPT-6.1 Sol Ultrafast chega "nos próximos dias" no Codex com geração de tokens até 8× mais rápida, sem preço associado. Isso é uma promessa, não um produto, e vale a pena dizer isso como tal: não existe hoje uma tabela de preços do Ultrafast para o nível 6.1, e a OpenAI não disse se o número de 8× é medido em relação à velocidade padrão ou ao modo rápido, que, por si só, custa 2× o padrão. Trate o anúncio como um sinal de programação e precifique-o quando um número aparecer.
Do nosso lado, honestamente: o GPT-6.1 Sol ainda não está nas rotas da OrcaRouter. O endpoint público do catálogo retorna "model not found" para openai/gpt-6.1-sol hoje, e nossa linha da OpenAI inclui GPT-6 Astra, GPT-6 Sol e GPT-6 Luna. O que é chamável na OrcaRouter agora é o GPT-6 Sol pelo preço de tabela da própria OpenAI, com zero markup — a tabela de preços de $2.00 / $0.20 / $10.00 e a regra de reprecificação de 272K, repassadas exatamente como o fornecedor as lista. Isso importa mais do que o normal esta semana por um motivo específico: o mesmo repasse significa que, se a OpenAI reduzir o preço da faixa 6.1 ou atribuir um número ao Ultrafast, a mudança estará no ar do nosso lado no mesmo dia em que estiver no ar do lado da OpenAI, sem um segundo contrato para renegociar. Quando o 6.1 Sol chegar às rotas, ele aparecerá no catálogo pelo preço do fornecedor, como todo o resto, e, até lá, a resposta honesta é que o modelo que ele substitui é o que você pode chamar.
A versão prática da decisão: se você já está no GPT-6 Sol e sua carga de trabalho é pesada em cache, agêntica ou de longo horizonte, a atualização 6.1 melhora exatamente as dimensões pelas quais você está pagando, e a migração é uma mudança na string do modelo mais uma transição de Chat-Completions para Responses, caso você use ferramentas. Se sua carga de trabalho é geração de prompts curtos com pouca reutilização, o lançamento quase não muda nada para você — mesmo preço de entrada, mesmo preço de saída, mesma janela. E se você estava esperando uma pontuação de terceiros antes de se comprometer, essa espera continua em aberto.
Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
