
Preços do GPT-5.6 Após o Corte: Luna vs Terra vs Sol, e Qual Nível Usar
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 546 tok/s
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 182 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 114 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
Após o corte de preços da OpenAI em 30 de julho de 2026, a família GPT-5.6 — GPT-5.6 Luna, GPT-5.6 Terra e GPT-5.6 Sol — nunca foi tão barata para executar em escala. Uma semana depois, em 6 de agosto, a OpenAI levou os mesmos níveis para o próprio ChatGPT: a GPT-5.6 Luna está se tornando o modelo padrão para contas gratuitas e Go, com chats de texto ilimitados, enquanto a GPT-5.6 Sol foi atualizada para Plus e Pro. Em 19 de agosto, a OpenAI e a Replit anunciaram que o novo Modo Gratuito da Replit para assinantes Core e Pro funciona com a GPT-5.6 Luna — a maior aposta de terceiros até agora no nível de volume. E no final de agosto, a OpenAI começou a implementar um fallback para usuários consumidores pesados: uma cota “Luna Reserve” que dá a contas selecionadas do ChatGPT Plus e Pro uso limitado da GPT-5.6 Luna no Codex e no ChatGPT Work depois que seus limites regulares de uso se esgotam. Mas os três níveis têm preços muito diferentes, e escolher o certo (além de usar bem cache, batch e roteamento) é a maior alavanca na sua fatura da API. Este guia apresenta os preços completos após o corte, exemplos de cálculo de custo, como cada nível se compara aos concorrentes e como rotear entre eles por meio de um único endpoint.
Os preços são por milhão de tokens (entrada / saída), refletindo a tabela de preços pós-corte conforme divulgada e as páginas do modelo de repasse da OrcaRouter; tarifas em camadas e de cache vêm das páginas de modelo da OrcaRouter, e os valores dos concorrentes são atribuídos. Os detalhes do rollout do ChatGPT neste artigo são como a OpenAI os declarou em 6 de agosto de 2026, e os detalhes do Replit Free Mode são como a OpenAI e a Replit os declararam em 19 de agosto de 2026 — informados pelo fornecedor, não medidos de forma independente. Os detalhes do Luna Reserve são como a OpenAI os documenta em sua central de ajuda e como a equipe da OpenAI e os primeiros usuários os relataram no final de agosto de 2026 — declarados pelo fornecedor e pela comunidade, não verificados de forma independente. Os preços mudam — verifique antes de desenvolver.
TL;DR
GPT-5.6 Luna ($0.20 / $1.20) é o cavalo de batalha de alto volume; Terra ($2 / $12) é o meio-termo equilibrado; Sol ($5 / $30) é o carro-chefe para o raciocínio mais difícil e codificação agêntica. Todos os três compartilham um contexto de ~1,05M de tokens e saída máxima de 128K. O cache de prompt e a opção de lote reduzem ainda mais os custos, enquanto entradas muito longas levam você a um nível superior. Do lado do consumidor, a OpenAI anunciou em 6 de agosto que o GPT-5.6 Luna está se tornando o padrão para contas Free e Go do ChatGPT, com conversas ilimitadas somente de texto, e que uma versão atualizada do GPT-5.6 Sol está sendo lançada para Plus e Pro. Em 19 de agosto, a Replit lançou o Free Mode no GPT-5.6 Luna para assinantes Core e Pro, encaminhando tarefas mais difíceis ao GPT-5.6 Sol conforme necessário. No final de agosto, a OpenAI também começou a disponibilizar um fallback chamado “Luna Reserve”, que concede uso limitado do GPT-5.6 Luna no Codex e no ChatGPT Work a determinadas contas do ChatGPT Plus e Pro após seus limites regulares se esgotarem — documentado pela OpenAI, com a distribuição para contas selecionadas relatada por usuários. Use Luna para a maioria das tarefas fáceis, Terra quando precisar de mais, e Sol somente onde ele justifica o custo — e roteie conforme a dificuldade por meio de um único endpoint compatível com a OpenAI para minimizar os gastos.
Principais conclusões
• Luna: $0.20 / $1.20 por 1M de tokens — rápido, barato, para trabalho de alto volume e sensível à latência.
• Terra: $2 / $12 — a opção intermediária equilibrada para tarefas mais difíceis que não exigem o modelo topo de linha.
• Sol: $5 / $30 — o carro-chefe para raciocínio profundo, codificação em larga escala e agentes de longo horizonte.
• O armazenamento em cache e o processamento em lote reduzem ainda mais os custos; entradas longas levam você a um nível de contexto longo mais caro.
• ChatGPT (declarado pela OpenAI, 6 de ago): Luna torna-se o padrão gratuito/Go com chats de texto ilimitados; Sol recebe uma atualização de confiabilidade para Plus/Pro.
Replit (anunciado em 19 de agosto): o Free Mode para Core/Pro funciona com GPT-5.6 Luna — até 30x mais uso por Replit, com tarefas mais difíceis roteadas para o GPT-5.6 Sol. Declarado pela Replit, não verificado de forma independente.
• Luna Reserve (final de agosto, documentado pela OpenAI): uma cota reserva limitada que permite que contas selecionadas do ChatGPT Plus e Pro continuem usando o GPT-5.6 Luna no Codex e no ChatGPT Work após os limites regulares serem esgotados — não é ilimitada e não está disponível nos espaços de trabalho Business ou Enterprise.
• Maior alavanca de economia: roteie por dificuldade — não pague taxas da Sol por trabalho que a Luna pode fazer.
O novo preço base do GPT-5.6
Aqui estão os preços base pós-corte por milhão de tokens de entrada/saída: Luna $0.20 / $1.20 (reduzido de $1 / $6), Terra $2 / $12 (reduzido de $2.50 / $15) e Sol $5 / $30 (inalterado). Os dois níveis mais baratos foram reduzidos em 30 de julho de 2026; o principal permaneceu. Simplificando, os níveis baixos agora têm preços voltados para escala, enquanto o principal continua premium.

Preços escalonados, em cache e em lote
A taxa base é apenas o ponto de partida. A precificação do GPT-5.6 tem três modificadores que alteram materialmente o seu custo efetivo:
• Camadas de contexto longo. Os preços aumentam para entradas muito longas. Nas páginas de repasse da OrcaRouter, Luna custa $0.20 / $1.20 até uma camada de contexto grande e $0.40 / $1.80 além dela; Sol custa $5 / $30 na camada base e $10 / $45 na maior. A camada é escolhida pela contagem de tokens de entrada de cada solicitação, então alguns prompts enormes podem aumentar silenciosamente seu preço médio.
• Cache de prompt. Contexto reutilizado é cobrado com um grande desconto — a leitura de cache da Luna é de aproximadamente US$ 0,02 por milhão de tokens (versus US$ 0,20 para consulta nova), com gravações de cache em torno de US$ 0,25; a leitura de cache da Sol é de cerca de US$ 0,50 (versus US$ 5 para consulta nova). Para agentes e chat com um prompt de sistema estável, o cache costuma ser a maior economia.
• Lote. Trabalhos não urgentes são executados de forma assíncrona com desconto — ideal para classificação em massa, avaliações e geração offline onde a latência não importa.
Exemplos práticos: quanto custa de verdade
Números concretos tornam os níveis reais. Considere 10 milhões de tokens por mês com uma divisão de 70% entrada / 30% saída (uma mistura típica de chat/agente):
• Luna: cerca de $5 por mês (aproximadamente $4,37 com cache de prompt).
• Terra: cerca de $50 por mês.
• Sol: cerca de $125 por mês (aproximadamente $109 com cache).
Isso é uma diferença de 25x entre Luna e Sol para o mesmo volume — o que é exatamente por que associar cada solicitação ao nível mais barato capaz de atendê-la importa mais do que qualquer tarifa única. (Esses valores correspondem à calculadora de custos na página do OrcaRouter, que estima a partir do preço de tabela; seus números reais dependem de cache e da sua combinação de entrada/saída.)
Para que realmente serve cada nível
GPT-5.6 Luna — o cavalo de batalha do volume
Luna é a camada rápida e econômica, ajustada para cargas de trabalho de alto volume e sensíveis à latência: chat, classificação, extração, roteamento e tarefas de agente leves, com p50 de tempo até o primeiro token em torno de 1,65 segundos. Após a redução, a US$ 0,20 / US$ 1,20, ela é precificada para competir diretamente com modelos abertos baratos — a opção padrão para a grande maioria das chamadas simples. É também a camada para a qual a OpenAI está direcionando o ChatGPT para consumidores: em seu anúncio de 6 de agosto, o GPT-5.6 Luna está se tornando o modelo padrão para contas Free e Go, com chats somente de texto se tornando ilimitados e um novo botão Think para raciocínio mais profundo em perguntas mais difíceis chegando na semana seguinte (os limites de arquivos, imagens e voz permanecem). A OpenAI afirma que a Luna comete 62% menos erros factuais do que o GPT-5.5 Instant que ela substitui — um número reportado pelo fornecedor, mas um sinal claro de que a camada de volume é para onde a empresa está direcionando a maior parte do seu tráfego.
Em 19 de agosto de 2026, a Replit tornou o GPT-5.6 Luna o motor do seu novo Modo Gratuito — a experiência padrão para assinantes Core e Pro. Chat cotidiano, ideação e tarefas simples de codificação rodam na Luna sem consumir o orçamento de créditos de IA pagos do usuário; a Replit diz que usuários Core agora podem criar até 30x mais por mês, incluindo até 30 horas de chat. Quando uma tarefa exige mais raciocínio, o Agente da Replit direciona a solicitação para um modelo maior nessa parte — os modos Power/Max ou GPT-5.6 Sol — e então volta para a Luna. Esses são detalhes declarados pela Replit e pela OpenAI, não verificados de forma independente — mas a direção corresponde ao corte de preço: uma Luna 80% mais barata é o que torna viável um nível sempre ativo e incluído por padrão.
Outra complicação no lado do consumidor chegou no final de agosto de 2026: Luna Reserve. Como a OpenAI documenta em sua central de ajuda, contas selecionadas do ChatGPT Plus e Pro podem obter um pool limitado de uso do GPT-5.6 Luna no Codex e no ChatGPT Work como fallback quando sua cota de uso regular for esgotada — um aviso ou indicador de lua aparece no limite, e você pode continuar trabalhando no Luna enquanto a reserva durar. Não é uma extensão ilimitada: a reserva é separada da cota regular e também tem limite, ela apenas serve o GPT-5.6 Luna (nunca Terra ou Sol), não está disponível em workspaces Business ou Enterprise, e atingir um limite regular não garante acesso. A equipe da OpenAI confirmou a existência da reserva em 27 de agosto, e relatos iniciais de usuários descrevem a implementação gradual em contas selecionadas — declarado pelo fornecedor e pela comunidade, não verificado de forma independente. Alguns relatos iniciais da comunidade também observam que a reserva executa o lado com navegador leve do GPT-5.6 Luna, portanto tarefas de inspeção ao vivo na web podem não funcionar durante a reserva.
GPT-5.6 Terra — o meio equilibrado
A Terra fica entre o volume e o topo de linha: mais capaz que a Luna para raciocínio e codificação mais complexos, mas muito mais barata que a Sol. Por US$ 2 / US$ 12, é uma opção sensata quando a Luna não é suficiente, mas você não precisa do topo de linha — extração de média complexidade, redação e tarefas de várias etapas que ainda rodam em escala.
GPT-5.6 Sol — o carro-chefe
Sol é feito para os trabalhos mais difíceis: raciocínio profundo em múltiplas etapas, engenharia de software em larga escala e fluxos de trabalho agênticos de longo horizonte, mantendo-se coerente em um contexto de ~1,05 milhão de tokens e com até 128K de saída. Por US$ 5 / US$ 30 (base), é uma opção premium — reserve-o para tarefas que realmente precisam dele, como codificação complexa em vários arquivos ou longas execuções de agentes. Em 6 de agosto, a {{1}}OpenAI{{/1}} também atualizou o GPT-5.6 Sol no ChatGPT para usuários Plus e Pro: a empresa afirma que a versão de chat é mais confiável quanto aos fatos — 68% menos erros factuais, segundo a {{2}}OpenAI{{/2}} — e fornece respostas mais focadas, com um novo controle deslizante para ajustar quanto esforço de raciocínio ela aplica. A atualização vale apenas para o chat (o Sol por trás do Work e do Codex não mudou), e o nível da API segue em US$ 5 / US$ 30.
A ressalva do token de raciocínio.
GPT-5.6 são modelos de raciocínio, portanto o custo efetivo de saída pode exceder uma estimativa ingênua: quando o raciocínio está ativado, os tokens de raciocínio interno são cobrados como saída. Em prompts difíceis com alto esforço de raciocínio, isso pode dominar sua fatura. Ajuste o esforço de raciocínio à tarefa (baixo ou desligado para chamadas simples), limite os tokens de saída quando possível e meça o uso real. Taxas mais baratas por token ajudam; gerar menos tokens ajuda mais.
Como cada nível se compara aos rivais
O corte de preços reposicionou o GPT-5.6 em relação ao mercado. Segundo os relatórios, os $0.20 / $1.20 da Luna agora subcotam o Claude Haiku 4.5 em cerca de 5x na entrada e 4x na saída, e os $2 / $12 da Terra ficam abaixo do preço padrão do Claude Sonnet 5 (relatado em $3 / $15). Frente aos modelos de pesos abertos, a Luna fica próxima do piso estabelecido pela linha V4 da DeepSeek e pelo GLM-5.2 da Zhipu (cerca de $1.20 / $4.10), com os níveis Qwen e Gemini Flash próximos. Em suma: para trabalhos sensíveis a custo, a Luna agora é competitiva com os modelos capazes mais baratos, em vez de ser uma alternativa premium a eles — enquanto a Sol continua sendo um nível genuinamente premium para capacidade que não se consegue obter a baixo custo.
A verdadeira alavanca de economia: rotear por dificuldade
{{1}}A conta mais barata não se resume a um único nível — é associar cada solicitação ao modelo menos caro que consiga atendê-la.{{/1}} {{2}}Na prática: envie chamadas fáceis e de alto volume para Luna (ou um modelo aberto barato), suba para Terra quando as tarefas forem mais difíceis e use Sol apenas para a minoria genuinamente difícil.{{/2}} {{3}}Combinado com cache e processamento em lote, isso reduz custos rotineiramente muito mais do que qualquer mudança de preço isolada.{{/3}} O problema é operacional: você não quer reintegrar três níveis da {{KEEP}}OpenAI{{/KEEP}} mais alternativas de modelos abertos separadamente.
Acesse todos os três (e rivais mais baratos) através de um único endpoint.
É aqui que um roteador neutro em relação a fornecedores ajuda. O OrcaRouter expõe GPT-5.6 Luna, Terra e Sol — pelos mesmos preços pós-corte, com margem de 0% — por meio de um único endpoint compatível com OpenAI, juntamente com modelos abertos mais baratos, como DeepSeek V4 Pro, GLM-5.2 e Qwen. Alternar entre camadas (ou fazer testes A/B do Luna contra um modelo aberto) é uma mudança de configuração, não uma reintegração, e você pode rotear cada requisição para o que for mais barato. O Luna Reserve é a versão do lado do consumidor dessa mesma ideia — um fallback integrado que mantém usuários selecionados no GPT-5.6 Luna após o esgotamento de sua cota regular — e o equivalente no lado da API é o failover automático, que o OrcaRouter gerencia quando um provedor aplica limite de taxa ou retorna erro em uma requisição.

A tabela de preços da Luna após o corte é visível na própria página de modelo da OrcaRouter ao preço de tabela — US$ 0,20 / US$ 1,20 por milhão de tokens — porque o roteador repassa os preços dos provedores com margem de 0%, com uma calculadora de custos na página para uma fatura mensal típica. Há também um nível gratuito e uma página de Offers para economias adicionais.

Perguntas Frequentes
Quais são os preços do GPT-5.6 após o corte?
Luna $0,20 / $1,20, Terra $2 / $12 e Sol $5 / $30 por milhão de tokens de entrada/saída. Luna e Terra foram cortados em 30 de julho de 2026; Sol permanece inalterado.
Qual nível do GPT-5.6 devo usar?
Luna para trabalho de alto volume e sensível à latência; Terra para tarefas mais difíceis que não precisam do carro-chefe; Sol para o raciocínio mais difícil e codificação agêntica. Roteie por dificuldade para minimizar custo.
O GPT-5.6 Luna é gratuito no ChatGPT?
OpenAI anunciou em 6 de agosto que o GPT-5.6 Luna está se tornando o modelo padrão para contas gratuitas e contas Go do ChatGPT, com chats ilimitados somente de texto; os limites permanecem para uploads de arquivos, imagens e ferramentas de voz, e um botão Think para raciocínio mais avançado está sendo lançado separadamente. Esses são planos declarados pela OpenAI, não verificados de forma independente.
Por que o Replit está usando GPT-5.6 Luna no Modo Gratuito?
O Modo Gratuito da Replit, anunciado em 19 de agosto de 2026, executa chat cotidiano, ideação e codificação simples no GPT-5.6 Luna por padrão para assinantes Core e Pro, roteando tarefas mais difíceis para um modelo maior — seus modos Power/Max ou GPT-5.6 Sol — conforme necessário. A Replit atribui o corte de preço da API Luna em 30 de julho, de aproximadamente 80%, a tornar a economia viável. Estes são planos declarados pelo fornecedor, não verificados de forma independente.
O que é Luna Reserve?
Uma cota de fallback que a OpenAI documenta para Codex e ChatGPT Work: contas selecionadas do ChatGPT Plus e Pro recebem um pool limitado de uso do GPT-5.6 Luna quando o limite de uso regular é esgotado, para que continuem funcionando em vez de serem interrompidas. Ela serve apenas o GPT-5.6 Luna — nunca Terra ou Sol — tem seu próprio limite, é separada do uso regular e não está disponível em workspaces Business ou Enterprise. A existência é declarada pela OpenAI (a equipe confirmou em 27 de agosto); a distribuição para contas selecionadas é relatada pela comunidade, não verificada de forma independente.
Quanto custa o GPT-5.6 por mês?
A 10M tokens/mês (70% entrada): aproximadamente $5 na Luna, $50 na Terra e $125 na Sol — uma diferença de 25x, antes do cache. Seu custo real depende do cache e da sua combinação de entrada/saída.
Todas as três camadas têm a mesma janela de contexto?
Sim — aproximadamente um contexto de 1,05M tokens e até 128K tokens de saída, com suporte a visão, ferramentas, JSON e raciocínio.
Como o cache de prompt afeta o custo?
O cache reduz drasticamente o custo de contexto repetido — a leitura de cache da Luna custa cerca de US$ 0,02 por milhão de tokens, contra US$ 0,20 para acesso direto — portanto, reutilize prompts em cache sempre que possível. Entradas longas, por outro lado, podem levá-lo a um nível de contexto longo mais caro.
Como os níveis se comparam aos modelos da Anthropic ou aos modelos abertos?
De acordo com relatórios, Luna subcotiza o Claude Haiku 4.5 (~5x entrada / 4x saída) e Terra fica abaixo do Claude Sonnet 5 ($3 / $15). Luna também está próxima do piso barato de modelos abertos (DeepSeek, GLM-5.2 ~$1.20/$4.10).
Onde posso usar todos os três níveis juntos?
Através do único endpoint compatível com OpenAI da OrcaRouter com markup de 0%, juntamente com modelos abertos mais baratos para roteamento baseado em dificuldade.
Conclusão
Após o corte, a GPT-5.6 Luna ($0,20 / $1,20) e a Terra ($2 / $12) são atraentes para trabalho de alto volume e nível intermediário, enquanto a Sol ($5 / $30) continua sendo a principal flagship premium — uma diferença de custo de 25x que recompensa o roteamento inteligente. A implementação para o consumidor reforça a divisão: a OpenAI está tornando a Luna o padrão gratuito, reservando a atualização de confiabilidade da Sol para os planos pagos, e o Free Mode de 19 de agosto do Replit — construído sobre a GPT-5.6 Luna, com tarefas mais difíceis roteadas para a GPT-5.6 Sol — mostra produtos de alto tráfego adotando o mesmo nível, e o fallback Luna Reserve do final de agosto estende o padrão ao manter determinados usuários Plus e Pro na GPT-5.6 Luna mesmo depois que seus limites regulares se esgotam. Para quem desenvolve APIs, esse é mais um motivo para rotear tráfego fácil para a Luna. As maiores economias vêm do roteamento por dificuldade, do uso de cache e de processamento em lote (batch), e do controle dos tokens de raciocínio, em vez de usar um único nível por padrão. Fazer isso é mais fácil por meio de um endpoint único com markup de 0%, como o OrcaRouter, onde os três níveis (com os novos preços) ficam ao lado dos modelos abertos mais baratos com os quais você vai querer compará-los.
