{{1}}Ilustração editorial em vetor flat para o hero de um blog de tecnologia sobre preços de modelos carro-chefe:{{/1}} {{2}}um grande chip de modelo arredondado em azul profundo com um brilho ciano suave sobre um fundo claro,{{/2}} {{3}}uma etiqueta de preço de papel presa ao seu canto,{{/3}} {{4}}três fluxos de tokens saindo do chip em direção a um medidor de preço circular com pequenas marcas abstratas,{{/4}} {{5}}uma pequena pilha de blocos em cache ao lado do medidor,{{/5}} {{6}}e uma folha de calendário fina deslizando pela esquerda.{{/6}} {{7}}Fundo branco com acentos de gradiente suaves em azul e ciano e um leve destaque quente;{{/7}} {{8}}ícones de linha flat mínimos;{{/8}} {{9}}tipografia geométrica sem serifa, limpa e moderna;{{/9}} {{10}}sem texto legível.{{/10}}
Guides & Insights

Preços da API GPT-5.6 Sol: $4 / $20 por 1M de Tokens Após a Redução de Preço

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

GPT-5.6 Sol custa US$ 4,00 por milhão de tokens de entrada e US$ 20,00 por milhão de tokens de saída na API GPT-5.6 Sol atualmente — a mesma taxa de repasse que o nível principal pratica no diretório OrcaRouter, verificada em 25/08/2026 com margem zero. Em 24 de agosto de 2026, a OpenAI cortou o preço da API do Sol em 20% na entrada e cerca de 33% na saída, uma promoção temporária que vigora pelo menos até 21 de novembro de 2026. Ainda é o nível mais caro da família GPT-5.6, e é o primeiro nível cujo preço de tabela mudou desde o corte de 30 de julho, que não afetou o principal. As alavancas importam mais do que o título: a entrada reutilizada custa US$ 0,40 por milhão via cache de prompt, a API em lote cai para US$ 2,00 / US$ 10,00, e o modo rápido troca um prêmio de 2x por até 2,5x de velocidade. Esta página é a referência de preços específica do Sol — a tabela exata de tarifas, quanto uma requisição realmente custa, como o principal se compara aos demais, quando ele é a compra errada e como chamá-lo por meio de um endpoint compatível com OpenAI com sua própria chave.

Os preços são por milhão de tokens (entrada / saída), em 25/08/2026. O desconto — 20% na entrada, cerca de 33% na saída, válido pelo menos até 21 de novembro de 2026 — é um anúncio da própria OpenAI, divulgado pelo valor de face; os valores em dólar são lidos das tarifas de API publicadas pela OpenAI e verificados de forma cruzada com a página do modelo GPT-5.6 Sol no OrcaRouter. As tarifas de cache, lote, modo rápido e contexto longo são anunciadas pela OpenAI. Estas são tarifas promocionais, não uma redefinição permanente — os preços mudam e podem mudar de volta; verifique antes de criar.

O preço exato, verificado hoje

Aqui está a tabela de preços completa do GPT-5.6 Sol, verificada em 2026-08-25 com as tarifas promocionais. As mesmas tarifas se aplicam a solicitações que usam o alias gpt-5.6, e os cortes estão sendo implementados gradualmente para os planos de crédito elegíveis do ChatGPT Work e Codex; as assinaturas do ChatGPT Pro, Plus e Business permanecem inalteradas.

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

• Entrada — $4,00 por 1 milhão de tokens em cache miss (reduzido de $5,00, 20% de desconto até 21 de novembro).

• Saída — US$ 20,00 por 1M de tokens (reduzido de US$ 30,00, ~33% de desconto até 21 de novembro).

• Leitura de cache de prompt — $0,40 por 1M de tokens (antes $0,50), um desconto de 90% em qualquer entrada que você reenviar.

• Escrita de cache de prompt — $5,00 por 1M de tokens (era $6,25).

• Nível de contexto longo — entradas acima de aproximadamente 272 mil tokens são cobradas a US$ 8,00 por entrada / US$ 30,00 por saída (antes US$ 10,00 / US$ 45,00; os mesmos múltiplos de 2x para entrada e 1,5x para saída agora se aplicam sobre a base mais baixa).

• Batch API — $2,00 de entrada / $10,00 de saída, um desconto fixo de 50% (antes $2,50 / $15,00), assíncrona, normalmente pronta em cerca de 24 horas.

• Modo rápido — $8.00 de entrada / $40.00 de saída (era $10.00 / $60.00), um acréscimo de 2x para até aproximadamente 2.5x a velocidade de saída, sem mudança na inteligência.

• Janela de contexto — ~1.05M tokens, até 128K de saída.

OrcaRouter repassa a taxa do provedor sem margem, então o valor no diretório é o valor que você paga — e um corte do fornecedor aparece na listagem no mesmo dia em que entra em vigor. Na página do modelo ao vivo, o cartão mostra $4,00 / $20,00 por 1M, leitura de cache $0,400, com selos de Vision, Tools, JSON e Reasoning. Esta é a primeira vez que o preço de tabela da Sol muda desde a redução de 30 de julho, que levou a GPT-5.6 Luna para $0,20 / $1,20 e a GPT-5.6 Terra para $2 / $12 enquanto o carro-chefe se manteve; o corte de 24 de agosto é a vez do carro-chefe.

As alavancas que alteram o preço efetivo

A taxa base é apenas o ponto de partida. Quatro modificadores mudam o que Sol realmente custa para você:

• Cache de prompt — contexto reutilizado custa $0,40 por milhão em vez de $4 para contexto novo, e gravações de cache custam $5,00 por milhão. Para qualquer agente ou chat que reenvia um grande prefixo a cada turno, o cache é a maior alavanca individual na conta. A OpenAI indexa o cache por projeto e chave de API, então permanecer em uma única chave (um canal) é o que mantém os acertos chegando.

• Nível de contexto longo — uma solicitação cuja entrada ultrapassa aproximadamente 272 mil tokens passa da tarifa base para US$ 8 / US$ 30. Alguns prompts enormes podem aumentar silenciosamente seu preço médio, então agrupe ou trunque quando você não precisar de fato do contexto profundo.

• Batch — A API de batch da OpenAI executa jobs de forma assíncrona com um tempo de resposta de aproximadamente 24 horas por exatamente metade do preço: $2.00 / $10.00, com entrada em cache a $0.20 e gravações de cache a $2.50. Ela combina com prompt caching e é adequada para avaliações, classificação em massa e geração offline onde a latência não importa.

• Modo rápido — $8 / $40 para até ~2,5x de throughput de saída, útil para tarefas críticas de latência em que o usuário está aguardando, como assistência de codificação ao vivo. Ele cobra 2x a taxa padrão por token, não conta para os pacotes TPM do Scale Tier adquiridos e pode voltar ao processamento padrão se você ultrapassar o limite de taxa compartilhado.

O que uma solicitação realmente custa

Os preços por token são abstratos, então aqui estão exemplos práticos às taxas de hoje:

• Chamada única de chat, 50K de entrada + 20K de saída — $0.20 + $0.40 = $0.60 (era $0.85).

• 1M de entrada + 1M de saída — $4 + $20 = $24 (antes $35).

• Turno agêntico, 200K de contexto em cache + 20K de entrada nova + 30K de saída — $0,08 + $0,08 + $0,60 = $0,76. O mesmo turno com cache frio — 220K de entrada nova a $0,88 mais $0,60 de saída — totaliza $1,48. O cache reduz aproximadamente pela metade.

• Um mês de 10M tokens com uma divisão de 70% entrada / 30% saída, com 80% da entrada servida do cache: 1,4M de entrada fresca ($5,60) + 5,6M em cache ($2,24) + 3M de saída ($60) ≈ $68. Sem cache, o mesmo mês custa $88 — e o mesmo mês no GPT-5.6 Terra custa cerca de $50, ou cerca de $5 no GPT-5.6 Luna. Essa diferença de ~14x entre Sol e Luna é por que a correspondência de níveis importa mais do que qualquer taxa individual.

Duas ressalvas elevam a taxa efetiva. Sol é um modelo de raciocínio — tokens de raciocínio interno são cobrados como saída a US$ 20 por milhão. Um prompt difícil em uma configuração de alto esforço de raciocínio pode gastar grande parte do orçamento de saída em pensamento, então o custo efetivo de saída em trabalhos difíceis fica bem acima de uma estimativa ingênua. E o tokenizador da OpenAI é mais verboso do que o da geração anterior em algumas entradas, então o mesmo texto pode custar mais tokens do que custaria no GPT-5.5. Ajuste o esforço de raciocínio à tarefa, limite a saída quando possível e meça o uso real antes de projetar a fatura.

Como os preços da Sol se comparam aos do mercado

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Lido em relação aos preços de tabela publicados em 26/08/2025 (Sol em sua tarifa promocional). A cobertura da imprensa interpreta o corte como uma resposta à pressão de preços da Anthropic e dos laboratórios chineses — isso é interpretação de terceiros, não uma declaração da OpenAI.

• GPT-5.6 Terra — US$ 2 / US$ 12, o nível intermediário pós-corte. Sol agora custa 2x mais na entrada e ~1,7x mais na saída; Terra é o padrão quando você não precisa de raciocínio de ponta.

• GPT-5.6 Luna — US$ 0,20 / US$ 1,20, a faixa de volume pós-corte. Uma diferença de 20x no input em relação à Sol; a Luna está precificada para a maior parte do tráfego simples.

• Claude Opus 5 — $5 / $25. A Sol agora é 20% mais barata tanto na entrada quanto na saída, no papel, em comparação com a Opus 5 na entrada às tarifas antigas. A comparação já favorecia a Sol antes do corte: este blog mediu anteriormente a Sol com aproximadamente 34,5% menos tokens do que um modelo da Anthropic na mesma amostra de inglês/misto, e uma análise publicada de economia de tokens (TheBlockBeats) estimou que a conta total da Sol pode ficar cerca de 21% menor do que a Claude Opus 5 para um trabalho equivalente, mesmo quando a taxa de saída da Sol era mais alta. Meça seu próprio tokenizador, não o preço de tabela.

• Claude Fable 5 — US$ 10 / US$ 50. A Sol agora é 60% mais barata no input e 60% mais barata no output do que o nível mais alto da Anthropic (era 50% / 40% nas tarifas antigas).

• Claude Opus 4.8 — $5 / $25. O Sol agora é 20% mais barato na entrada e 20% mais barato na saída — a vantagem de preço sobre o carro-chefe da geração anterior da Anthropic se inverteu completamente.

• Grok 4.6 — $2 / $6. O número mais impressionante do quadro: ele igualou o GPT-5.6 Sol no índice Artificial Analysis (ambos 61) com entrada 2x mais barata e saída ~3.3x mais barata, em comparação com uma diferença de 2.5x / 5x nas tarifas antigas.

• DeepSeek V4 Pro — US$ 0,44 / US$ 0,88 fora de pico (janelas de pico dobram o valor). Um universo de preços totalmente diferente, para a faixa barata de pesos abertos.

O enquadramento honesto: Sol continua sendo um carro-chefe premium, mas o corte o tira da faixa de preço mais alta — o preço de saída de $20 agora fica abaixo dos $25 do Claude Opus 5 e dos $25 do Claude Opus 4.8, deixando o Claude Fable 5, com seus $50, como o único carro-chefe fechado com preço de saída acima dele. Ele vence no custo efetivo por unidade de trabalho árduo (seu tokenizador, seu raciocínio, seu contexto longo) em vez da taxa absoluta, e o corte de 24 de agosto reforça esse argumento. Se o seu tráfego consiste em prompts curtos e tarefas simples, um Terra de $2, uma Luna de $0,20 ou um Grok 4.6 de $2 / $6 ainda é a opção mais barata — e no índice, o Grok 4.6 não fica devendo nada no papel.

Quando Sol é a escolha errada

Quatro casos em que este preço não é o que você quer:

Instruções curtas e simples. Abaixo de aproximadamente 20 mil tokens, sem raciocínio profundo, o prêmio do modelo principal é desperdiçado. O GPT-5.6 Terra a US$ 2 / US$ 12 ou o GPT-5.6 Luna a US$ 0,20 / US$ 1,20 atende à camada de volume por uma fração do custo, e um modelo da classe Grok 4.6 ou DeepSeek custa ainda menos.

Volume com uso intenso de raciocínio. Como o raciocínio é cobrado como saída, um prompt difícil com alto esforço pode custar bem acima da linha nominal de saída. Se sua carga de trabalho envolver muitas chamadas difíceis, meça os tokens de saída reais antes de se comprometer — a taxa efetiva pode surpreender você.

Preço por token como o único objetivo. Grok 4.6 empatou com Sol no índice a $2 / $6, e DeepSeek V4 Pro está a $0,44 / $0,88 fora de pico. Se uma pontuação em benchmark de ponta não é o requisito rígido, esses modelos oferecem taxas por token muito mais baixas para a mesma classe de trabalho.

Orçamentos de latência estritos. Sol é um modelo de raciocínio grande, então o tempo até o primeiro token é muito superior ao de um modelo da camada Flash. Para chat em tempo real onde TTFT abaixo de um segundo importa, o modo rápido a $8/$40 compra throughput, não menor latência do primeiro token — e um modelo menor ainda é a solução mais barata.

Como chamá-lo no OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol está hospedado no OrcaRouter como ID de modelo openai/gpt-5.6-sol, servido por meio do endpoint compatível com a OpenAI em api.orcarouter.ai/v1 pelo preço do provedor, sem nenhum acréscimo. Se você já tem um cliente OpenAI, a migração é uma mudança de URL base e de ID de modelo — nada mais. A mesma chave e o mesmo endpoint oferecem 200+ modelos, então Sol fica ao lado de GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 e dos modelos de pesos abertos que você queira comparar com ele, e você pode rotear por dificuldade em vez de reintegrar cada um.

Duas especificidades do OrcaRouter que merecem destaque em uma página de preços. BYOK: traga sua própria chave da OpenAI e a OpenAI cobra você diretamente pelas próprias tarifas — o OrcaRouter adiciona $0 por token e mantém intactos os limites de taxa e os créditos do seu provedor. Guardrails: o PII Shield e a política de conteúdo são executados antes da cobrança, então uma solicitação bloqueada retorna um 400 limpo e nunca é cobrada, e o Agent Firewall avalia chamadas de ferramentas e MCP antes de serem executadas.

A nota de honestidade que importa para uma página de preços: roteamos o modelo, não definimos o preço dele. O valor de $4 / $20 é a tarifa promocional da OpenAI repassada — e quando a OpenAI a alterou em 24 de agosto, a listagem acompanhou no mesmo dia, exatamente por isso esta página tem carimbo de data. Se você chamar a OpenAI diretamente, obtém a mesma tarifa; a OrcaRouter existe para a rota de chave única e sem markup, caso você queira um endpoint para toda a linha de modelos.

Fontes e data

Todos os preços acima foram verificados em 2026-08-25. Os valores do GPT-5.6 Sol foram obtidos dos preços de API publicados pela OpenAI, com verificação cruzada da página do modelo GPT-5.6 Sol no OrcaRouter (verificada no mesmo dia) e de reportagens da imprensa sobre o corte de 24 de agosto (Indian Express, Economic Times, The Star); as tarifas de lote (batch), modo rápido, gravação de cache e contexto longo são as anunciadas pela OpenAI. Os valores de Claude, Grok e DeepSeek são as listagens atuais do diretório OrcaRouter, com o DeepSeek V4 Pro exibido em sua tarifa fora do horário de pico. O preço de tabela do Sol permaneceu inalterado desde seu lançamento em 9 de julho até o corte de 30 de julho e mudou pela primeira vez em 24 de agosto com esta promoção — exatamente por isso a data importa aqui: as tarifas de $4 / $20 são temporárias, e os preços mudam; considere qualquer página de 'Preços do GPT-5.6 Sol' que você encontrar, de antes ou de depois, conforme a data de verificação. Os valores aqui são atuais até hoje.

Cada preço acima é a cotação em tempo real do GPT-5.6 Sol on OrcaRouter — verificada em 2026-08-25 com markup zero, pronta para a sua própria chave.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente