
GPT-6.1 Sol Pro vs GPT-6 Sol Pro: Mesma Tabela de Preços, a Uma Linha de Distância
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 397 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 195 tok/s
- OrcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Duas semanas separam os lançamentos e quase nada separa as cobranças, e é por isso que a comparação entre GPT-6.1 Sol Pro e GPT-6 Sol Pro é curta e incomumente precisa. Ambos os nomes se resolvem no mesmo tipo de coisa — um modelo base mais reasoning.mode definido como pro na API Responses. Assim, nenhum dos dois tem seu próprio identificador, sua própria tabela de preços ou sua própria sobretaxa. GPT-6.1 Sol Pro é o GPT-6.1 Sol, lançado em 29 de setembro de 2026, rodando em modo pro. GPT-6 Sol Pro é o GPT-6 Sol, lançado em 22 de setembro de 2026, rodando no mesmo modo. Ambos expõem 1.050.000 tokens de contexto e 128.000 tokens de saída máxima, ambos cobram US$ 2,00 por milhão de tokens de entrada e US$ 10,00 por milhão de tokens de saída, e ambos cobram o trabalho extra do modo nessas mesmas tarifas padrão. O que realmente difere é uma linha do medidor, um degrau da escada de esforço e quanta evidência independente existe por trás de cada configuração.
Ambos os nomes são a mesma palavra para o mesmo interruptor.
Comece pelo mecanismo, porque é a razão pela qual esta comparação tem tão poucas linhas. A OpenAI vendia o Pro como um produto na era do GPT-5 — gpt-5-pro, gpt-5.2-pro, gpt-5.4-pro, gpt-5.5-pro, o1-pro, o3-pro — cada um com seu próprio identificador e seu próprio medidor premium, chegando a $150.00 de entrada e $600.00 de saída por milhão de tokens no o1-pro. Depois, o mecanismo mudou e o vocabulário não. O Pro tornou-se um valor que você define no modelo principal, cobrado pelas próprias tarifas do modelo principal, e a página de descontinuações da OpenAI diz isso com suas próprias palavras: quando aqueles antigos medidores forem aposentados ao longo de outubro e dezembro de 2026, o substituto recomendado é gpt-5.6-sol com reasoning.mode: pro — um modelo mais um modo, não um produto sucessor.
O esquema público da API do fornecedor confirma. Procure nele por identificadores da era GPT-6 e quatro aparecem: gpt-6-astra, gpt-6-sol, gpt-6-luna e gpt-6.1-sol. Nenhuma variante pro aparece entre eles, e nenhuma variante pro aparece na lista de preços também. O que apareceu, poucas horas depois de o nível 6.1 entrar no ar, foram listagens pro de toda a família em catálogos de terceiros — 6.1 Sol Pro, 6 Sol Pro, 6 Luna Pro, 5.6 Sol Pro — cada uma citando a ficha do seu modelo base. Isso é uma linha de catálogo sendo vestida com um nome, não um fornecedor lançando um produto, e é por isso que os dois objetos desta comparação são um modo em dois modelos base diferentes, e não duas implantações.
Em que as duas configurações realmente diferem

Aqui está cada dimensão que os separa, ambos os lados em uma só linha:
• A que o nome corresponde — gpt-6.1-sol com reasoning.mode: "pro" versus gpt-6-sol com reasoning.mode: "pro"; nem o fornecedor nem o catálogo publica um identificador -pro para qualquer um deles
• Data de lançamento do modelo base — 29 de setembro de 2026 versus 22 de setembro de 2026, com sete dias de diferença
• Preço de entrada — US$ 2,00 por milhão de tokens em ambos, então o volume extra de entrada do modo pro custa o mesmo por unidade em qualquer um dos níveis
• Preço de saída — US$ 10,00 por milhão de tokens em ambos, e essa é a tarifa cobrada pelos tokens de raciocínio adicionais do modo, já que o modo pro altera o volume, e não o preço
• Entrada em cache — US$ 0,10 por milhão no 6.1 Sol contra US$ 0,20 no 6 Sol; a única linha publicada em que as duas tabelas de preços divergem
• Gravações em cache — US$ 2,50 por milhão de tokens em ambos
• Reprecificação de prompt longo — acima de 272.000 tokens de entrada, toda a solicitação é reprecificada em 2× as tarifas de entrada e cache e 1,5× a tarifa de saída em ambos, o que coloca o 6.1 Sol em US$ 4,00 de entrada, US$ 0,20 em cache, US$ 5,00 de gravação em cache e US$ 15,00 de saída por milhão, contra US$ 4,00, US$ 0,40, US$ 5,00 e US$ 15,00 no 6 Sol — o desconto de cache sobrevive intacto à reprecificação
• Contexto e teto de saída — 1.050.000 tokens de contexto e 128.000 tokens de saída no máximo em ambos
• Escada de esforço de raciocínio — low, medium (o padrão), high, xhigh e max no 6.1 Sol, com none e minimal sem suporte; a mesma escada no 6 Sol com none ainda disponível
• Corte de conhecimento documentado — 30 de abril de 2026 no nível 6.1; não verificamos o do 6 Sol nas páginas que lemos, então trate essa linha como em aberto, e não como uma diferença
• Avaliação independente — uma página de terceiros publicada para o GPT-6 Sol, nenhuma para o GPT-6.1 Sol, e nenhuma avaliação de uma configuração pro para qualquer um deles
Leia a lista e o formato da decisão fica evidente. Uma linha é uma diferença real publicada — a taxa de entrada em cache, que cai pela metade. Uma linha é uma capacidade que você perde em vez de ganhar — não poder combinar o modo com effort: none no nível mais recente, o que importa para qualquer pessoa que use essa combinação para manter a latência baixa em tarefas do tipo roteamento. Todo o resto é idêntico, incluindo a regra de reprecificação que captura qualquer requisição que ultrapasse 272.000 tokens.
A lacuna de evidências, dita claramente
É aqui que a comparação deixa de ser simétrica. O GPT-6 Sol tem uma avaliação real de terceiros: o painel neutro que este blog usa como referência externa atribui a ele 47,5 no seu Intelligence Index, classificado em 12º lugar numa amostra de 145 modelos, e as nossas próprias rotas têm um registro de desempenho medido para a configuração padrão — uma latência mediana perto de 1,24 segundo, cerca de 65 tokens por segundo e uma taxa de erro de 0,16% em cerca de 167 milhões de tokens de tráfego. O GPT-6.1 Sol não tem nada disso. A página do painel para o slug 6.1 retorna um 404 e a string não aparece no leaderboard ao vivo, então toda pontuação que você vê citada para ele hoje vem do fornecedor.
Duas ressalvas quanto a isso, e ambas pesam contra superinterpretar o que de fato temos. O valor de latência medido pertence à configuração padrão; o modo pro realiza mais trabalho de modelo antes de retornar uma única resposta final, portanto é mais lento por construção, e esse número não se transfere para uma execução pro. E nenhuma plataforma independente publica uma avaliação separada de uma configuração pro em qualquer modelo desta família — a plataforma mede a configuração que mede e não separa o modo. Assim, o estado honesto do registro é um 6 Sol medido no modo padrão contra um nível 6.1 descrito pelo fornecedor, com o modo pro, em ambos os lados, apoiando-se apenas na descrição do fornecedor.
Três casos, e o que cada um deve fazer
• Você já executa o modo pro no GPT-6 Sol e ele se paga. Continue no gpt-6-sol por enquanto e mantenha a carga de trabalho na qual você o mediu. O nível 6.1 reduz pela metade a taxa de entrada em cache, o que, em um prefixo reutilizado, é dinheiro de verdade em volume, mas o próprio modo está documentado com o identificador 6.1 em um lugar — o exemplo resolvido do guia de raciocínio — e em nenhum lugar na própria página desse modelo. Espere a documentação por modelo do fornecedor ser atualizada antes de migrar um caminho que você já validou
• Você nunca mediu o modo pro de forma alguma. Comece no nível 6.1 em modo padrão, depois execute um braço pro ao lado dele com o mesmo reasoning.effort. Você obtém a linha de cache mais barata no braço que vai manter, o snapshot mais recente e uma medição do multiplicador do modo no seu próprio tráfego, em vez de uma expectativa emprestada
• Seu tráfego é dominado por um prefixo estável — instruções, esquemas de ferramentas, um prompt de sistema longo. Este é o único caso em que o nível 6.1 vence no preço antes de qualquer medição, porque a única linha publicada que difere é a que você paga com mais frequência. Faça as contas com o volume do seu próprio prefixo: a US$ 0,10 contra US$ 0,20 por milhão de tokens em cache, a economia escala com quanto da sua entrada é repetição
Nenhum desses três casos é resolvido por um benchmark, e é exatamente esse o ponto. O modo é idêntico em ambos os lados, a taxa principal é idêntica em ambos os lados, e a decisão depende de uma taxa de cache, de uma restrição de escada de esforço e de se você precisa do número de outra pessoa antes de agir.
Executando ambas as configurações a partir de uma única chave
A razão prática para executar esta comparação em vez de raciocinar sobre ela é que os dois braços diferem por uma string de modelo e um parâmetro, então o experimento custa quase nada para ser montado. O OrcaRouter encaminha openai/gpt-6-sol pelo preço de tabela da própria OpenAI sem nada acrescentado — $2,00 de entrada, $0,20 em cache, $10,00 de saída, com o nível de 272K publicado a $4,00 e $15,00 — e repassa a regra de reajuste de preço do fornecedor conforme escrita, em vez de substituí-la por uma regra própria. Como não há margem adicional sobre a tabela do fornecedor, uma mudança de tarifa ou de preço de cache aparece na rota no dia em que a OpenAI a publica, sem um segundo contrato para renegociar. Nem o nível 6.1 nem uma listagem pro dele estão nessas rotas hoje — verificamos o catálogo público em 30 de setembro de 2026 e tanto openai/gpt-6.1-sol quanto openai/gpt-6.1-sol-pro retornam modelo não encontrado —, então o braço que você pode chamar agora é o do 6 Sol, em modo padrão ou pro, no mesmo endpoint e com a mesma chave que você usaria para o nível mais novo quando ele chegar.

Faça o teste de três braços nas suas próprias requisições difíceis e mantenha reasoning.effort constante para que uma variável se mova por vez: gpt-6-sol no modo padrão, gpt-6-sol com o modo pro ativado e — assim que for roteável — gpt-6.1-sol no mesmo esforço. Leia o total de tokens cobrados do objeto de uso, e não do corpo da resposta, já que o raciocínio extra do modo cai em um campo que o texto da resposta nunca mostra. A execução no modo pro em comparação com sua gêmea padrão fornece o multiplicador sobre o seu tráfego, que não será igual ao de mais ninguém. Manter o terceiro braço como teste de regressão depois da decisão custa a mudança de uma string, e uma regra de roteamento que envia as requisições genuinamente difíceis para a configuração pro enquanto o volume maior permanece no padrão é uma linha em uma DSL de roteamento em vez de uma rearquitetura — que é a versão desta decisão que sobrevive à próxima atualização de modelo.

Conclusão
Retire os nomes e isto é uma única configuração em dois snapshots adjacentes, separados por sete dias, compartilhando uma tabela de preços até o limiar de reprecificação. O snapshot mais recente reduz pela metade a tarifa de entrada em cache e abre mão de effort: none; o mais antigo mantém esse patamar e vem com uma avaliação de terceiros, um histórico de latência medido e um modo pro que o fornecedor documenta em uma página de modelo, e não apenas em um exemplo de guia. Se o seu tráfego reutiliza um prefixo estável em volume, o nível 6.1 é o padrão mais barato, e você deve dizer isso na linha de cache, e não na manchete. Se o seu caminho de modo pro já está medido e funcionando, não há evidência publicada que justifique mudá-lo esta semana. De qualquer forma, trate os dois nomes do catálogo como um único interruptor em dois modelos base — porque essa é a única leitura que sobrevive a uma olhada na própria lista de preços do fornecedor.
O braço que você pode chamar hoje é o do 6 Sol, standard ou pro, e está listado no catálogo público ao preço de tabela da OpenAI, sem nada acrescentado, em um único endpoint e uma única chave.
