{{1}}Ilustração editorial em vetor flat para o hero de um blog de tecnologia sobre preços de modelos carro-chefe:{{/1}} {{2}}um grande chip de modelo arredondado em azul profundo com um brilho ciano suave sobre um fundo claro,{{/2}} {{3}}uma etiqueta de preço de papel presa ao seu canto,{{/3}} {{4}}três fluxos de tokens saindo do chip em direção a um medidor de preço circular com pequenas marcas abstratas,{{/4}} {{5}}uma pequena pilha de blocos em cache ao lado do medidor,{{/5}} {{6}}e uma folha de calendário fina deslizando pela esquerda.{{/6}} {{7}}Fundo branco com acentos de gradiente suaves em azul e ciano e um leve destaque quente;{{/7}} {{8}}ícones de linha flat mínimos;{{/8}} {{9}}tipografia geométrica sem serifa, limpa e moderna;{{/9}} {{10}}sem texto legível.{{/10}}
Guides & Insights

Preços da API GPT-5.6 Sol: $5 / $30 por 1M de Tokens, Cache a $0,50, e Quanto Realmente Custa

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

GPT-5.6 Sol custa US$ 5,00 por milhão de tokens de entrada e US$ 30,00 por milhão de tokens de saídana API GPT-5.6 Sol — a mesma tarifa que o nível principal tem no diretório OrcaRouter, verificado em 2026-08-18, com margem zero. É o nível mais caro da família GPT-5.6 e o único cujo preço de tabela não mudou no corte de 30 de julho, então a tabela de preços na página ao vivo do modelo GPT-5.6 Sol é a referência para orçamento. As alavancas importam mais que o título: entrada reutilizada custa US$ 0,50 por milhão via cache de prompt, a API em lote cai para US$ 2,50 / US$ 15,00, e o modo rápido troca um prêmio de 2x por até 2,5x de velocidade. Esta página é a referência de preços especificamente para o Sol — a tabela de tarifas exata, quanto uma solicitação realmente custa, como o modelo principal se compara aos demais, quando ele é a compra errada e como chamá-lo por um endpoint compatível com OpenAI com sua própria chave.

Os preços são por milhão de tokens (entrada / saída), em 2026-08-18. Os valores em dólares são obtidos das tarifas de API publicadas pela OpenAI e conferidos com a página do modelo OrcaRouter para o GPT-5.6 Sol; as tarifas de cache, lote, modo rápido e contexto longo são anunciadas pela OpenAI. Os preços mudam — verifique antes de construir.

O preço exato, verificado hoje

Aqui está a tabela de preços completa para GPT-5.6 Sol, verificada em 2026-08-18:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

Input — US$ 5,00 por 1M de tokens em cache miss.

Saída — $30.00 por 1M de tokens.

Leitura de cache de prompt — US$ 0,50 por 1M de tokens, um desconto de 90% em qualquer entrada que você reenviar.

Escrita no cache de prompt — $6.25 por 1M de tokens.

Nível de contexto longo — entradas acima de aproximadamente 272 mil tokens são cobradas a $10.00 por entrada / $45.00 por saída (2x entrada, 1,5x saída).

Batch API — $2,50 de entrada / $15,00 de saída, com 50% de desconto fixo, assíncrono, normalmente pronto em cerca de 24 horas.

Modo rápido — entrada de $10.00 / saída de $60.00, um prêmio de 2x para até aproximadamente 2.5x de velocidade de saída, sem alteração na inteligência.

Janela de contexto — ~1.05M tokens, até 128K de saída.

O OrcaRouter repassa a tarifa do provedor sem nenhum acréscimo, portanto o valor no diretório é o valor que você paga. Na página do modelo ao vivo, o cartão mostra $5,00 / $30,00 por 1M, leitura de cache $0,500, com os selos Vision, Tools, JSON e Reasoning. O preço de $5 / $30 da Sol também é o preço antes do corte: a redução da OpenAI de 30 de julho foi aplicada ao GPT-5.6 Luna (agora $0,20 / $1,20) e ao GPT-5.6 Terra (agora $2 / $12), enquanto o carro-chefe se manteve.

As alavancas que alteram o preço efetivo

A taxa base é apenas o ponto de partida. Quatro modificadores mudam o que Sol realmente custa para você:

Cache de prompt — o contexto reutilizado é cobrado a US$ 0,50 por milhão, em vez de US$ 5 por contexto novo, e as gravações de cache custam US$ 6,25 por milhão. Para qualquer agente ou chat que reenvie um grande prefixo a cada turno, o cache é a maior alavanca na conta. A OpenAI vincula o cache por projeto e chave de API; portanto, manter uma única chave (um canal) é o que faz os acertos continuarem.

Camada de contexto longo — uma solicitação cuja entrada ultrapassa aproximadamente 272 mil tokens passa da tarifa base para $10 / $45. Alguns prompts enormes podem elevar silenciosamente o preço médio, então agrupe em lotes ou trunque quando você não precisar genuinamente do contexto profundo.

Batch — a API batch da OpenAI executa tarefas de forma assíncrona com um tempo de processamento de aproximadamente 24 horas por exatamente metade do preço: $2.50 / $15.00, com entrada em cache a $0.25 e escritas em cache a $3.13. Ele pode ser usado em conjunto com o cache de prompt e é adequado para evals, classificação em massa e geração offline, onde a latência não importa.

Modo rápido — $10 / $60 para até ~2,5x de throughput de saída, útil para trabalhos com latência crítica e usuários aguardando, como assistência de codificação ao vivo. Ele cobra por token a 2x a taxa padrão, não conta para os pacotes de TPM do Scale Tier adquiridos e pode voltar ao processamento padrão se você ultrapassar o limite de taxa compartilhado.

O que uma solicitação realmente custa

Os preços por token são abstratos, então aqui estão exemplos práticos às taxas de hoje:

Chamada única de chat, 50K de entrada + 20K de saída — $0,25 + $0,60 = $0,85.

1M de entrada + 1M de saída — $5 + $30 = $35.

Turno agêntico, 200K de contexto em cache + 20K de entrada nova + 30K de saída — $0.10 + $0.10 + $0.90 = $1.10. O mesmo turno com cache frio — 220K de entrada nova a $1.10 — totaliza $2.00. O cache reduz isso quase pela metade.

Um mês de 10M tokens com uma divisão de 70% de entrada / 30% de saída, com 80% da entrada servida do cache: 1,4M de entrada nova (US$ 7,00) + 5,6M em cache (US$ 2,80) + 3M de saída (US$ 90) ≈ $100. Sem cache, o mesmo mês custa $125 — e o mesmo mês no GPT-5.6 Terra custa cerca de US$ 50, ou cerca de US$ 5 no GPT-5.6 Luna. Essa diferença de 20x entre Sol e Luna é por que a correspondência de níveis importa mais do que qualquer tarifa individual.

Duas ressalvas elevam a taxa efetiva. Sol é um modelo de raciocínio — tokens de raciocínio internos são cobrados como saída a US$ 30 por milhão. Um prompt difícil com uma configuração de alto esforço de raciocínio pode gastar uma grande parte do orçamento de saída em pensamento, então o custo efetivo de saída em tarefas difíceis fica bem acima de uma estimativa ingênua. E o tokenizador da OpenAI é mais verboso do que o da geração anterior em algumas entradas, então o mesmo texto pode custar mais tokens do que custaria no GPT-5.5. Ajuste o esforço de raciocínio à tarefa, limite a saída quando possível e meça o uso real antes de projetar uma fatura.

Como os preços da Sol se comparam aos do mercado

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Lido conforme os preços de tabela publicados em 18/08/2026:

GPT-5.6 Terra — $2 / $12, o nível intermediário pós-corte. Sol custa 2,5x mais em entrada e saída; Terra é o padrão quando você não precisa do raciocínio de ponta.

GPT-5.6 Luna — $0,20 / $1,20, a faixa de volume pós-corte. Uma diferença de 25x na entrada em relação a Sol; a Luna está precificada para a maior parte do tráfego.

Claude Opus 5 — $5 / $25. Mesma entrada, saída 20% mais barata no papel. Na prática, a comparação se inverte para algumas cargas de trabalho: este blog mediu anteriormente a Sol com aproximadamente 34,5% menos tokens que um modelo da Anthropic na mesma amostra em inglês/misto, e uma análise publicada de economia de tokens (TheBlockBeats) estimou que a conta total da Sol pode ser cerca de 21% menor que a do Claude Opus 5 para trabalho equivalente, apesar da taxa de saída mais alta. Meça seu próprio tokenizador, não o preço de tabela.

Claude Fable 5 — $10 / $50. Sol custa metade do preço de entrada e é 40% mais barato na saída do que o nível mais alto da Anthropic.

Claude Opus 4.8 — US$ 5 / US$ 25. Mesma entrada que Sol, saída mais barata — o carro-chefe da Anthropic da geração anterior.

Grok 4.6 — US$ 2 / US$ 6. O número mais impressionante do quadro: igualou o GPT-5.6 Sol no índice Artificial Analysis (ambos com 61) com entrada 2,5x mais barata e saída 5x mais barata.

DeepSeek V4 Pro — US$ 0,44 / US$ 0,88 fora de pico (janelas de pico dobram o valor). Um universo de preços totalmente diferente, para a faixa barata de pesos abertos.

A abordagem honesta: a Sol é um carro-chefe premium com uma taxa de saída premium — a maior taxa de saída entre os carros-chefe fechados abaixo do Claude Fable 5. Ela vence no custo efetivo por unidade de trabalho pesado (seu tokenizador, seu raciocínio, seu contexto longo) em vez da taxa absoluta. Se o seu tráfego é de prompts curtos e tarefas simples, um Terra de $2, uma Luna de $0,20 ou um Grok 4.6 de $2 / $6 é a opção mais barata — e no índice, o Grok 4.6 não perde nada no papel.

Quando Sol é a escolha errada

Quatro casos em que este preço não é o que você quer:

Instruções curtas e simples. Abaixo de aproximadamente 20 mil tokens, sem raciocínio profundo, o prêmio do modelo principal é desperdiçado. O GPT-5.6 Terra a US$ 2 / US$ 12 ou o GPT-5.6 Luna a US$ 0,20 / US$ 1,20 atende à camada de volume por uma fração do custo, e um modelo da classe Grok 4.6 ou DeepSeek custa ainda menos.

Volume com uso intenso de raciocínio. Como o raciocínio é cobrado como saída, um prompt difícil com alto esforço pode custar bem acima da linha nominal de saída. Se sua carga de trabalho envolver muitas chamadas difíceis, meça os tokens de saída reais antes de se comprometer — a taxa efetiva pode surpreender você.

Preço por token como o único objetivo. Grok 4.6 empatou com Sol no índice a $2 / $6, e DeepSeek V4 Pro está a $0,44 / $0,88 fora de pico. Se uma pontuação em benchmark de ponta não é o requisito rígido, esses modelos oferecem taxas por token muito mais baixas para a mesma classe de trabalho.

Orçamentos de latência rigorosos.Sol é um modelo de raciocínio de grande porte, então o tempo até o primeiro token é bem maior do que o de um modelo da categoria Flash. Para chat em tempo real, em que um TTFT abaixo de um segundo importa, o modo rápido a $10 / $60 garante taxa de transferência, não latência menor do primeiro token — e um modelo menor ainda é a correção mais barata.

Como chamá-lo no OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol está hospedado no OrcaRouter como ID de modelo openai/gpt-5.6-sol, servido por meio do endpoint compatível com a OpenAI em api.orcarouter.ai/v1 pelo preço do provedor, sem nenhum acréscimo. Se você já tem um cliente OpenAI, a migração é uma mudança de URL base e de ID de modelo — nada mais. A mesma chave e o mesmo endpoint oferecem 200+ modelos, então Sol fica ao lado de GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 e dos modelos de pesos abertos que você queira comparar com ele, e você pode rotear por dificuldade em vez de reintegrar cada um.

Duas especificidades do OrcaRouter que merecem destaque em uma página de preços. BYOK: traga sua própria chave da OpenAI e a OpenAI cobra você diretamente pelas próprias tarifas — o OrcaRouter adiciona $0 por token e mantém intactos os limites de taxa e os créditos do seu provedor. Guardrails: o PII Shield e a política de conteúdo são executados antes da cobrança, então uma solicitação bloqueada retorna um 400 limpo e nunca é cobrada, e o Agent Firewall avalia chamadas de ferramentas e MCP antes de serem executadas.

Uma nota de honestidade que importa para uma página de preços: roteamos o modelo, não definimos o seu preço. O valor de US$ 5 / US$ 30 é a taxa da OpenAI repassada, e quando a OpenAI a altera, a listagem acompanha — que é exatamente por isso que esta página está datada. Se você chamar a OpenAI diretamente, obtém a mesma taxa; a OrcaRouter existe para a rota de chave única e zero markup, se você quiser um único endpoint para toda a linha de modelos.

Fontes e data

Todos os preços acima foram verificados em 18/08/2026. Os valores do GPT-5.6 Sol são lidos da API de preços publicada pela OpenAI e verificados em cruzamento com a página do modelo OrcaRouter para GPT-5.6 Sol (verificada no mesmo dia) e com nossas próprias páginas de preços do GPT-5.6 publicadas. As tarifas de lote, modo rápido, escrita de cache e contexto longo são anunciadas pela OpenAI. Os valores do Claude, Grok e DeepSeek são as listagens atuais do diretório OrcaRouter, com o DeepSeek V4 Pro exibido na tarifa fora do pico. A OpenAI não alterou o preço de tabela do Sol desde o lançamento em 9 de julho de 2026 — o corte de 30 de julho deixou o principal intocado — mas os preços mudam; trate qualquer página antiga de "preços do GPT-5.6 Sol" que você encontrar com a data verificada. Os números aqui são atuais até hoje.

Cada preço acima é a cotação em tempo real na GPT-5.6 Sol on OrcaRouter — verificada em 2026-08-18 com margem zero, pronta para sua própria chave.

Comparados neste artigo3

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube