
Preços do GPT-6.1 Sol: A Tabela de Tarifas, o Único Medidor Que Mudou e o Penhasco de 272K
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
Esta página é a tabela de preços. GPT-6.1 Sol custa 2,00 $ por milhão de tokens de entrada, 0,10 $ por milhão de tokens de entrada em cache, 2,50 $ por milhão de tokens de escrita em cache e 10,00 $ por milhão de tokens de saída no nível padrão do fornecedor, e GPT-6 Sol — o patamar que este modelo substitui, e aquele que o nosso catálogo serve — apresenta 2,00 $, 0,20 $, 2,50 $ e 10,00 $ para os mesmos quatro medidores. Só um número difere entre as duas tabelas, o limiar acima do qual ambos sofrem alteração de preço está no mesmo lugar, e os descontos abaixo do preço de tabela são multiplicadores e não uma segunda lista de preços. Tudo nesta página é retirado da própria página de preços para programadores do fornecedor e das suas duas páginas de modelos para o GPT-6.1 Sol e o GPT-6 Sol, todas consultadas em 7 de outubro de 2026, e das nossas próprias fichas de modelo sempre que um valor é identificado como sendo nosso. Não se repete aqui qualquer narrativa de lançamento; se quiser saber o que foi lançado, isso é uma página diferente.
A tabela de preços, com os quatro medidores do GPT-6 Sol logo abaixo
A OpenAI publica esses valores como preços por milhão de tokens no nível de processamento padrão, para uma solicitação com 272.000 tokens de entrada ou menos. As duas linhas que importam são adjacentes de propósito, porque todo o argumento do lançamento fica visível no par: percorra cada medidor, um após o outro, e exatamente um deles muda.
• Entrada do GPT-6.1 Sol — $2,00 por milhão de tokens, inalterado em relação ao GPT-6 Sol.
• Entrada em cache do GPT-6.1 Sol — $0,10 por milhão de tokens, reduzida pela metade em relação aos $0,20 do GPT-6 Sol.
• Gravação em cache do GPT-6.1 Sol — $2,50 por milhão de tokens, inalterado em relação ao GPT-6 Sol.
• Saída do GPT-6.1 Sol — $10,00 por milhão de tokens, inalterado em relação ao GPT-6 Sol.
• Entrada do GPT-6 Sol — $2.00 por milhão de tokens.
• Entrada em cache do GPT-6 Sol — $0.20 por milhão de tokens.
• Gravação em cache do GPT-6 Sol — $2.50 por milhão de tokens.
• Saída do GPT-6 Sol — $10.00 por milhão de tokens.
Três dessas oito linhas são o mesmo número escrito duas vezes, o que é justamente o ponto: isto não é uma reprecificação, é um medidor se movendo sobre um modelo. As gravações em cache são 1,25× a taxa de entrada sem cache nos dois cartões, então $2,50 é $2,00 × 1,25 nos dois — o prêmio de gravação é uma propriedade da família, não da versão. As leituras em cache são a única linha em que os dois modelos se separam: no GPT-6.1 Sol, uma leitura em cache é 5% da taxa de entrada; no GPT-6 Sol, é 10%; e a OpenAI declara ambos como frações da taxa de entrada, em vez de como preços independentes.
Uma observação sobre como esta página apresenta os números. A OpenAI publica a tabela de preços como um preço de tabela fixo por metro, sem nenhum qualificador de esforço de raciocínio associado a qualquer uma das oito linhas acima, portanto nenhuma delas é cotada em um nível de esforço específico. O esforço muda quantos tokens uma tarefa consome, não quanto custa um token, e é por isso que a tabela independe do esforço, enquanto sua fatura não. Nada nesta página é uma comparação direta, com esforço equiparado, contra um modelo rival, e nenhuma comparação desse tipo está implícita em qualquer lugar abaixo — quando um número depender do esforço, esta página indica o esforço com que foi produzido.

A única linha que mudou: entrada em cache, $0,20 para $0,10
Um medidor de entrada em cache precifica a parte de uma solicitação que não mudou. Quando um prefixo longo e estável — um prompt de sistema, um conjunto de esquemas de ferramentas, um corpus recuperado, a transcrição acumulada de um loop — é deliberadamente armazenado para que a próxima solicitação possa reutilizá-lo, os tokens reutilizados são cobrados à taxa de cache em vez da taxa de entrada, e os tokens que são armazenados pela primeira vez são cobrados à taxa de gravação em cache. É um desconto sobre a repetição, e existe porque a alternativa, para o provedor, é recalcular o mesmo prefixo do zero a cada chamada.
Reduzir esse medidor pela metade não é o mesmo tipo de notícia que reduzir o medidor de entrada pela metade, e vale a pena ser preciso sobre a diferença. A taxa de entrada é o que custa cada token não armazenado em cache da família, então reduzi-la pela metade seria uma nova precificação de toda a linha do catálogo. A taxa de cache é uma profundidade de desconto — o quão abaixo da taxa de entrada fica um token reutilizado —, então alterá-la é uma mudança na recompensa por um comportamento específico, e não uma mudança na linha de base. A taxa de entrada do GPT-6.1 Sol é US$ 2,00, exatamente o que o GPT-6 Sol cobra, então uma requisição sem prefixo em cache é cobrada de forma idêntica nos dois modelos. Reduzir o medidor de cache pela metade leva o desconto de 90% sobre a entrada para 95% sobre a entrada, e isso alcança exatamente as cargas de trabalho cujos prefixos são longos o bastante e reutilizados com frequência suficiente para aparecer na linha. Leia o medidor alterado como "a mesma tarefa custa menos se você usar cache" em vez de "o modelo ficou mais barato", e o cartão deixa de ser surpreendente.
A aritmética decorre das duas linhas e de nada mais. Um milhão de tokens de entrada em cache custa US$ 0,10 no GPT-6.1 Sol e US$ 0,20 no GPT-6 Sol, então o lançamento vale dez centavos por milhão em cache — um valor trivial em uma única chamada e relevante em uma execução longa, porque um prefixo em cache é lido uma vez por turno. As gravações de cache permanecem inalteradas em US$ 2,50, portanto o ponto de equilíbrio para usar cache de modo geral não é alterado pelo lançamento: o retorno sobre um prêmio de gravação vem da reutilização do prefixo, não de qual das duas tarifas de cache se aplica.
Acima de 272.000 tokens de entrada, toda a solicitação é reprecificada
Ambos os cartões têm um nível de contexto longo, e a página de preços da OpenAI declara a regra da mesma forma para ambos: prompts com mais de 272K tokens de entrada são cobrados a 2× as taxas de entrada e de cache e a 1,5× a taxa de saída para a solicitação completa. A solicitação inteira tem o preço recalculado — não apenas os tokens além da linha. Essa frase é a que se deve levar desta seção, porque é onde uma tabela de tarifas deixa de ser uma tabela de consulta: com 272.001 tokens de entrada, a solicitação inteira, incluindo o primeiro token, é cobrada nas colunas de contexto longo.
O cartão de preços reajustado para o GPT-6.1 Sol, acima de 272.000 tokens de entrada:
• Entrada — $4.00 por milhão de tokens, 2× a tarifa de contexto curto.
• Entrada em cache — $0.20 por milhão de tokens, 2× a tarifa de contexto curto.
• Gravação em cache — $5.00 por milhão de tokens, 2× a tarifa de contexto curto.
• Saída — $15.00 por milhão de tokens, 1.5× a tarifa de contexto curto.
E o mesmo nível no GPT-6 Sol, para que as duas linhas possam ser comparadas uma com a outra:
• Entrada — $4.00 por milhão de tokens.
• Entrada em cache — $0.40 por milhão de tokens.
• Gravação de cache — $5.00 por milhão de tokens.
• Saída — $15.00 por milhão de tokens.
Novamente, a requisição inteira é reprecificada, e não o excedente, de modo que um prompt de 273.000 tokens é cobrado a US$ 4,00 de entrada por todos os 273.000 tokens, em vez de US$ 2,00 pelos primeiros 272.000 e US$ 4,00 pelos últimos mil. Isso faz com que cruzar o limite seja um degrau, e não uma inclinação, e faz a mudança de entrada em cache parecer diferente acima da linha do que abaixo dela. Os US$ 0,20 que o GPT-6.1 Sol cobra por uma leitura em cache acima de 272K são exatamente a tarifa que o GPT-6 Sol cobra abaixo disso, então uma carga de trabalho em cache de contexto longo no modelo mais novo paga o valor de pré-lançamento. A economia permanece em termos relativos acima da linha — US$ 0,20 contra os US$ 0,40 do GPT-6 Sol ainda é uma redução pela metade —, mas os dez centavos anunciados não se aplicam à requisição que cruza o limite, porque essa requisição não é cobrada na tabela de contexto curto de forma alguma.

Os níveis de desconto, como multiplicadores
Tudo o que está abaixo do preço de tabela padrão é um multiplicador aplicado à tabela acima, em vez de uma lista de preços separada. Apresentá-los como multiplicadores é o que os torna portáveis: os mesmos três fatores se aplicam a todos os quatro medidores de ambos os modelos, de modo que um leitor que tenha a tabela padrão tem toda a estrutura de faixas.
• Batch — 50% do padrão. O preço de Batch da OpenAI é exatamente metade em todos os quatro medidores, em ambos os modelos: US$ 1,00 de entrada, US$ 0,05 de entrada em cache, US$ 1,25 de escrita em cache e US$ 5,00 de saída por milhão no GPT-6.1 Sol, e US$ 1,00, US$ 0,10, US$ 1,25 e US$ 5,00 no GPT-6 Sol.
• Flex — 50% do padrão e idêntico ao Batch em ambos os modelos, linha por linha, pelo que a escolha entre eles é uma questão de agendamento e não de preço.
• Fast mode — 2× o padrão em todos os quatro medidores, em ambos os cartões, sem qualquer exceção indicada em nenhuma das tabelas de preços. O Fast mode custa US$ 4,00 de entrada, US$ 0,20 de entrada em cache, US$ 5,00 de escrita em cache e US$ 20,00 de saída por milhão no GPT-6.1 Sol, contra US$ 4,00, US$ 0,40, US$ 5,00 e US$ 20,00 no GPT-6 Sol — as duas linhas diferem apenas na linha de cache, e apenas pelo mesmo fator de 2× que a própria tarifa padrão de cache de cada modelo já apresenta.
• Processamento regional — um acréscimo de 10% sobre o nível aplicável, para modelos lançados em ou após 5 de março de 2026, em qualquer residência que não a predefinida.
O Fast mode tem uma restrição de disponibilidade que o preço por si só não revela. A própria página do modelo GPT-6.1 Sol da OpenAI afirma que o Fast mode não está disponível com residência de dados na UE, e as suas orientações sobre residência de dados listam o GPT-6.1 Sol entre os modelos que suportam residência na UE com processamento Standard, Flex e Batch. Assim, dentro da UE a escada de níveis é dois degraus mais curta, não um: os níveis à metade do preço existem, e o nível com o dobro do preço não. Um leitor que compare uma implementação europeia com uma dos EUA deve compará-la com o Standard, porque esse é o nível mais rápido disponível para ela — citar um valor do Fast mode para uma carga de trabalho na UE descreve uma configuração que o fornecedor não oferece.
Nada neste cartão é promocional, e nada tem prazo de validade.
As linhas do GPT-6.1 Sol acima são a tarifa de tabela. A página de preços da OpenAI não anexa a elas nenhum qualificador promocional nem data de término, e nenhum dos quatro medidores, seja no cartão de contexto curto, seja no de contexto longo, está marcado como um valor por tempo limitado. Vale a pena declarar isso explicitamente, porque a família tem um contraexemplo na mesma página: o preço promocional do GPT-5.6 Sol traz uma nota de rodapé que o compromete pelo menos até 21 de novembro de 2026, o que significa que qualquer preço do GPT-5.6 Sol cotado hoje é um preço com um ponto de revisão conhecido atrelado. Nada no GPT-6.1 Sol tem esse formato.
A consequência prática é que esta página não precisa de uma ressalva de verificação de data sobre os próprios números — precisa de uma na página que você está lendo, porque uma tarifa de tabela pode mudar sem que uma data de expiração tenha disparado. Também significa que o cartão do GPT-6.1 Sol é a linha certa para construir um modelo de custos se você estiver escolhendo entre os dois níveis do Sol e quiser que a comparação permaneça estável: o medidor de cache de US$ 0,20 do GPT-6 Sol também é uma tarifa de tabela comum, sem promoção associada, então a diferença de dez centavos entre eles é uma diferença estrutural entre os cartões, e não um desconto temporário que um modelo esteja aplicando contra o outro.
Como interpretar a alegação de preço do GPT-6.1 Sol de qualquer outra pessoa
Duas perguntas resolvem quase todas as divergências sobre quanto custa um modelo da classe Sol, e ambas podem ser respondidas a partir do cartão, e não da prosa ao seu redor.
• Qual métrica está sendo cotada? Entrada, entrada em cache, gravação de cache e saída são quatro números diferentes na mesma solicitação, e um único preço principal é quase sempre a métrica de entrada com os outros três deixados implícitos. Uma afirmação que parece um custo total geralmente é uma tarifa de entrada multiplicada por um mix de tokens presumido, e o mix presumido é onde reside a divergência.
• Qual nível de contexto foi assumido? Os cartões de contexto curto e contexto longo diferem em 2× na entrada e no cache e em 1,5× na saída, e o nível é selecionado pela solicitação inteira, e não pelo excedente, então um número cotado sem um nível é um número que muda no momento em que a solicitação ultrapassa 272.000 tokens de entrada.
• Qual nível de processamento foi assumido? Standard, Batch, Flex e Fast diferem por fatores de 2× e 50%, e um preço cotado sem dizer qual é um preço com um fator de quatro de ambiguidade embutido antes mesmo que qualquer pergunta sobre métrica seja feita.
• Qual nível de esforço foi assumido, se uma contagem de tokens estiver envolvida? As tarifas são independentes do esforço, mas as contagens de tokens não são, então qualquer valor de custo por tarefa herda o esforço de raciocínio com que foi medido — e uma comparação entre dois modelos com configurações de esforço diferentes não é uma comparação de seus preços.
Responda a esses quatro e uma alegação de preço ou se sustenta, ou não. O que ela não deve fazer é ser comparada com os quatro medidores desta página sem que o nível e o medidor sejam nomeados primeiro, porque os dois cartões estão adjacentes justamente para que a única linha móvel fique visível e nada mais seja confundido com ela.

Onde o nível GPT-6 Sol é servido
A OrcaRouter disponibiliza o nível GPT-6 à própria tarifa de tabela da OpenAI, sem nada acrescentado. A página do modelo em https://www.orcarouter.ai/models/openai/gpt-6-sol apresenta o GPT-6 Sol a $2,00 de entrada e $10,00 de saída por milhão de tokens, correspondendo linha por linha ao cartão acima, com 0% de margem, e o catálogo tem mais de 200 modelos nos mesmos termos. Nosso cartão para essa rota traz os mesmos valores de $0,20 para entrada em cache e $2,50 para gravação de cache que a OpenAI publica, de modo que os números coincidem medição por medição; considere cada valor de cache nesta página como uma reformulação da tarifa publicada pela OpenAI, e não como uma cotação independente nossa. O GPT-6.1 Sol também está listado em nosso catálogo — o cartão ativo de openai/gpt-6.1-sol traz uma data de lançamento de 29 de setembro de 2026, com ambos os níveis de preço espelhando os da OpenAI, e uma contagem de tokens de sete dias na casa das centenas de milhões —, portanto, um leitor que queira o nível mais recente deve consultar os números da própria página, em vez de tratar esta página como a palavra final sobre eles. Os preços mudam; a página é a cotação.
Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
