Preços do GPT-5.6 Após o Corte: Luna vs Terra vs Sol, e Qual Nível Usar
Guides & Insights

Preços do GPT-5.6 Após o Corte: Luna vs Terra vs Sol, e Qual Nível Usar

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Após o corte de preços da O​penAI em 30 de julho de 2026, a família GP​T-5.​6 — GPT-5.6 Luna, GPT-5.6 Terra e GPT-5.6 Sol — nunca foi tão barata para executar em escala. Uma semana depois, em 6 de agosto, a O​penAI levou os mesmos níveis para o próprio ChatGPT: a GPT-5.6 Luna está se tornando o modelo padrão para contas gratuitas e Go, com chats de texto ilimitados, enquanto a GPT-5.6 Sol foi atualizada para Plus e Pro. Em 19 de agosto, a O​penAI e a Replit anunciaram que o novo Modo Gratuito da Replit para assinantes Core e Pro funciona com a GPT-5.6 Luna — a maior aposta de terceiros até agora no nível de volume. E no final de agosto, a O​penAI começou a implementar um fallback para usuários consumidores pesados: uma cota “Luna Reserve” que dá a contas selecionadas do ChatGPT Plus e Pro uso limitado da GPT-5.6 Luna no Codex e no ChatGPT Work depois que seus limites regulares de uso se esgotam. Mas os três níveis têm preços muito diferentes, e escolher o certo (além de usar bem cache, batch e roteamento) é a maior alavanca na sua fatura da API. Este guia apresenta os preços completos após o corte, exemplos de cálculo de custo, como cada nível se compara aos concorrentes e como rotear entre eles por meio de um único endpoint.

Os preços são por milhão de tokens (entrada / saída), refletindo a tabela de preços pós-corte conforme divulgada e as páginas do modelo de repasse da OrcaRouter; tarifas em camadas e de cache vêm das páginas de modelo da OrcaRouter, e os valores dos concorrentes são atribuídos. Os detalhes do rollout do ChatGPT neste artigo são como a O​penAI os declarou em 6 de agosto de 2026, e os detalhes do Replit Free Mode são como a O​penAI e a Replit os declararam em 19 de agosto de 2026 — informados pelo fornecedor, não medidos de forma independente. Os detalhes do Luna Reserve são como a O​penAI os documenta em sua central de ajuda e como a equipe da O​penAI e os primeiros usuários os relataram no final de agosto de 2026 — declarados pelo fornecedor e pela comunidade, não verificados de forma independente. Os preços mudam — verifique antes de desenvolver.

TL;DR

GPT-5.6 Luna ($0.20 / $1.20) é o cavalo de batalha de alto volume; Terra ($2 / $12) é o meio-termo equilibrado; Sol ($5 / $30) é o carro-chefe para o raciocínio mais difícil e codificação agêntica. Todos os três compartilham um contexto de ~1,05M de tokens e saída máxima de 128K. O cache de prompt e a opção de lote reduzem ainda mais os custos, enquanto entradas muito longas levam você a um nível superior. Do lado do consumidor, a O​penAI anunciou em 6 de agosto que o GPT-5.6 Luna está se tornando o padrão para contas Free e Go do ChatGPT, com conversas ilimitadas somente de texto, e que uma versão atualizada do GPT-5.6 Sol está sendo lançada para Plus e Pro. Em 19 de agosto, a Replit lançou o Free Mode no GPT-5.6 Luna para assinantes Core e Pro, encaminhando tarefas mais difíceis ao GPT-5.6 Sol conforme necessário. No final de agosto, a O​penAI também começou a disponibilizar um fallback chamado “Luna Reserve”, que concede uso limitado do GPT-5.6 Luna no Codex e no ChatGPT Work a determinadas contas do ChatGPT Plus e Pro após seus limites regulares se esgotarem — documentado pela O​penAI, com a distribuição para contas selecionadas relatada por usuários. Use Luna para a maioria das tarefas fáceis, Terra quando precisar de mais, e Sol somente onde ele justifica o custo — e roteie conforme a dificuldade por meio de um único endpoint compatível com a O​penAI para minimizar os gastos.

Principais conclusões

• Luna: $0.20 / $1.20 por 1M de tokens — rápido, barato, para trabalho de alto volume e sensível à latência.

• Terra: $2 / $12 — a opção intermediária equilibrada para tarefas mais difíceis que não exigem o modelo topo de linha.

• Sol: $5 / $30 — o carro-chefe para raciocínio profundo, codificação em larga escala e agentes de longo horizonte.

• O armazenamento em cache e o processamento em lote reduzem ainda mais os custos; entradas longas levam você a um nível de contexto longo mais caro.

• ChatGPT (declarado pela OpenAI, 6 de ago): Luna torna-se o padrão gratuito/Go com chats de texto ilimitados; Sol recebe uma atualização de confiabilidade para Plus/Pro.

Replit (anunciado em 19 de agosto): o Free Mode para Core/Pro funciona com GPT-5.6 Luna — até 30x mais uso por Replit, com tarefas mais difíceis roteadas para o GPT-5.6 Sol. Declarado pela Replit, não verificado de forma independente.

• Luna Reserve (final de agosto, documentado pela OpenAI): uma cota reserva limitada que permite que contas selecionadas do ChatGPT Plus e Pro continuem usando o GPT-5.6 Luna no Codex e no ChatGPT Work após os limites regulares serem esgotados — não é ilimitada e não está disponível nos espaços de trabalho Business ou Enterprise.

• Maior alavanca de economia: roteie por dificuldade — não pague taxas da Sol por trabalho que a Luna pode fazer.

O novo preço base do GP​T-5.​6

Aqui estão os preços base pós-corte por milhão de tokens de entrada/saída: Luna $0.20 / $1.20 (reduzido de $1 / $6), Terra $2 / $12 (reduzido de $2.50 / $15) e Sol $5 / $30 (inalterado). Os dois níveis mais baratos foram reduzidos em 30 de julho de 2026; o principal permaneceu. Simplificando, os níveis baixos agora têm preços voltados para escala, enquanto o principal continua premium.

Preços escalonados, em cache e em lote

A taxa base é apenas o ponto de partida. A precificação do GP​T-5.​6 tem três modificadores que alteram materialmente o seu custo efetivo:

• Camadas de contexto longo. Os preços aumentam para entradas muito longas. Nas páginas de repasse da OrcaRouter, Luna custa $0.20 / $1.20 até uma camada de contexto grande e $0.40 / $1.80 além dela; Sol custa $5 / $30 na camada base e $10 / $45 na maior. A camada é escolhida pela contagem de tokens de entrada de cada solicitação, então alguns prompts enormes podem aumentar silenciosamente seu preço médio.

• Cache de prompt. Contexto reutilizado é cobrado com um grande desconto — a leitura de cache da Luna é de aproximadamente US$ 0,02 por milhão de tokens (versus US$ 0,20 para consulta nova), com gravações de cache em torno de US$ 0,25; a leitura de cache da Sol é de cerca de US$ 0,50 (versus US$ 5 para consulta nova). Para agentes e chat com um prompt de sistema estável, o cache costuma ser a maior economia.

• Lote. Trabalhos não urgentes são executados de forma assíncrona com desconto — ideal para classificação em massa, avaliações e geração offline onde a latência não importa.

Exemplos práticos: quanto custa de verdade

Números concretos tornam os níveis reais. Considere 10 milhões de tokens por mês com uma divisão de 70% entrada / 30% saída (uma mistura típica de chat/agente):

• Luna: cerca de $5 por mês (aproximadamente $4,37 com cache de prompt).

• Terra: cerca de $50 por mês.

• Sol: cerca de $125 por mês (aproximadamente $109 com cache).

Isso é uma diferença de 25x entre Luna e Sol para o mesmo volume — o que é exatamente por que associar cada solicitação ao nível mais barato capaz de atendê-la importa mais do que qualquer tarifa única. (Esses valores correspondem à calculadora de custos na página do OrcaRouter, que estima a partir do preço de tabela; seus números reais dependem de cache e da sua combinação de entrada/saída.)

Para que realmente serve cada nível

GPT-5.6 Luna — o cavalo de batalha do volume

Luna é a camada rápida e econômica, ajustada para cargas de trabalho de alto volume e sensíveis à latência: chat, classificação, extração, roteamento e tarefas de agente leves, com p50 de tempo até o primeiro token em torno de 1,65 segundos. Após a redução, a US$ 0,20 / US$ 1,20, ela é precificada para competir diretamente com modelos abertos baratos — a opção padrão para a grande maioria das chamadas simples. É também a camada para a qual a O​penAI está direcionando o ChatGPT para consumidores: em seu anúncio de 6 de agosto, o GPT-5.6 Luna está se tornando o modelo padrão para contas Free e Go, com chats somente de texto se tornando ilimitados e um novo botão Think para raciocínio mais profundo em perguntas mais difíceis chegando na semana seguinte (os limites de arquivos, imagens e voz permanecem). A O​penAI afirma que a Luna comete 62% menos erros factuais do que o GPT-5.5 Instant que ela substitui — um número reportado pelo fornecedor, mas um sinal claro de que a camada de volume é para onde a empresa está direcionando a maior parte do seu tráfego.

Em 19 de agosto de 2026, a Replit tornou o GPT-5.6 Luna o motor do seu novo Modo Gratuito — a experiência padrão para assinantes Core e Pro. Chat cotidiano, ideação e tarefas simples de codificação rodam na Luna sem consumir o orçamento de créditos de IA pagos do usuário; a Replit diz que usuários Core agora podem criar até 30x mais por mês, incluindo até 30 horas de chat. Quando uma tarefa exige mais raciocínio, o Agente da Replit direciona a solicitação para um modelo maior nessa parte — os modos Power/Max ou GPT-5.6 Sol — e então volta para a Luna. Esses são detalhes declarados pela Replit e pela OpenAI, não verificados de forma independente — mas a direção corresponde ao corte de preço: uma Luna 80% mais barata é o que torna viável um nível sempre ativo e incluído por padrão.

Outra complicação no lado do consumidor chegou no final de agosto de 2026: Luna Reserve. Como a O​penAI documenta em sua central de ajuda, contas selecionadas do ChatGPT Plus e Pro podem obter um pool limitado de uso do GPT-5.6 Luna no Codex e no ChatGPT Work como fallback quando sua cota de uso regular for esgotada — um aviso ou indicador de lua aparece no limite, e você pode continuar trabalhando no Luna enquanto a reserva durar. Não é uma extensão ilimitada: a reserva é separada da cota regular e também tem limite, ela apenas serve o GPT-5.6 Luna (nunca Terra ou Sol), não está disponível em workspaces Business ou Enterprise, e atingir um limite regular não garante acesso. A equipe da O​penAI confirmou a existência da reserva em 27 de agosto, e relatos iniciais de usuários descrevem a implementação gradual em contas selecionadas — declarado pelo fornecedor e pela comunidade, não verificado de forma independente. Alguns relatos iniciais da comunidade também observam que a reserva executa o lado com navegador leve do GPT-5.6 Luna, portanto tarefas de inspeção ao vivo na web podem não funcionar durante a reserva.

GPT-5.6 Terra — o meio equilibrado

A Terra fica entre o volume e o topo de linha: mais capaz que a Luna para raciocínio e codificação mais complexos, mas muito mais barata que a Sol. Por US$ 2 / US$ 12, é uma opção sensata quando a Luna não é suficiente, mas você não precisa do topo de linha — extração de média complexidade, redação e tarefas de várias etapas que ainda rodam em escala.

GPT-5.6 Sol — o carro-chefe

Sol é feito para os trabalhos mais difíceis: raciocínio profundo em múltiplas etapas, engenharia de software em larga escala e fluxos de trabalho agênticos de longo horizonte, mantendo-se coerente em um contexto de ~1,05 milhão de tokens e com até 128K de saída. Por US$ 5 / US$ 30 (base), é uma opção premium — reserve-o para tarefas que realmente precisam dele, como codificação complexa em vários arquivos ou longas execuções de agentes. Em 6 de agosto, a {{1}}O​penAI{{/1}} também atualizou o GPT-5.6 Sol no ChatGPT para usuários Plus e Pro: a empresa afirma que a versão de chat é mais confiável quanto aos fatos — 68% menos erros factuais, segundo a {{2}}O​penAI{{/2}} — e fornece respostas mais focadas, com um novo controle deslizante para ajustar quanto esforço de raciocínio ela aplica. A atualização vale apenas para o chat (o Sol por trás do Work e do Codex não mudou), e o nível da API segue em US$ 5 / US$ 30.

A ressalva do token de raciocínio.

GP​T-5.​6 são modelos de raciocínio, portanto o custo efetivo de saída pode exceder uma estimativa ingênua: quando o raciocínio está ativado, os tokens de raciocínio interno são cobrados como saída. Em prompts difíceis com alto esforço de raciocínio, isso pode dominar sua fatura. Ajuste o esforço de raciocínio à tarefa (baixo ou desligado para chamadas simples), limite os tokens de saída quando possível e meça o uso real. Taxas mais baratas por token ajudam; gerar menos tokens ajuda mais.

Como cada nível se compara aos rivais

O corte de preços reposicionou o GP​T-5.​6 em relação ao mercado. Segundo os relatórios, os $0.20 / $1.20 da Luna agora subcotam o Claude Haiku 4.5 em cerca de 5x na entrada e 4x na saída, e os $2 / $12 da Terra ficam abaixo do preço padrão do Claude Sonnet 5 (relatado em $3 / $15). Frente aos modelos de pesos abertos, a Luna fica próxima do piso estabelecido pela linha V4 da Deep​Seek e pelo GLM-5.2 da Zhi​pu (cerca de $1.20 / $4.10), com os níveis Qw​en e Gem​ini Flash próximos. Em suma: para trabalhos sensíveis a custo, a Luna agora é competitiva com os modelos capazes mais baratos, em vez de ser uma alternativa premium a eles — enquanto a Sol continua sendo um nível genuinamente premium para capacidade que não se consegue obter a baixo custo.

A verdadeira alavanca de economia: rotear por dificuldade

{{1}}A conta mais barata não se resume a um único nível — é associar cada solicitação ao modelo menos caro que consiga atendê-la.{{/1}} {{2}}Na prática: envie chamadas fáceis e de alto volume para Luna (ou um modelo aberto barato), suba para Terra quando as tarefas forem mais difíceis e use Sol apenas para a minoria genuinamente difícil.{{/2}} {{3}}Combinado com cache e processamento em lote, isso reduz custos rotineiramente muito mais do que qualquer mudança de preço isolada.{{/3}} O problema é operacional: você não quer reintegrar três níveis da {{KEEP}}O​penAI{{/KEEP}} mais alternativas de modelos abertos separadamente.

Acesse todos os três (e rivais mais baratos) através de um único endpoint.

É aqui que um roteador neutro em relação a fornecedores ajuda. O OrcaRouter expõe GPT-5.6 Luna, Terra e Sol — pelos mesmos preços pós-corte, com margem de 0% — por meio de um único endpoint compatível com O​penAI, juntamente com modelos abertos mais baratos, como DeepSeek V4 Pro, GLM-5.2 e Qw​en. Alternar entre camadas (ou fazer testes A/B do Luna contra um modelo aberto) é uma mudança de configuração, não uma reintegração, e você pode rotear cada requisição para o que for mais barato. O Luna Reserve é a versão do lado do consumidor dessa mesma ideia — um fallback integrado que mantém usuários selecionados no GPT-5.6 Luna após o esgotamento de sua cota regular — e o equivalente no lado da API é o failover automático, que o OrcaRouter gerencia quando um provedor aplica limite de taxa ou retorna erro em uma requisição.

A tabela de preços da Luna após o corte é visível na própria página de modelo da OrcaRouter ao preço de tabela — US$ 0,20 / US$ 1,20 por milhão de tokens — porque o roteador repassa os preços dos provedores com margem de 0%, com uma calculadora de custos na página para uma fatura mensal típica. Há também um nível gratuito e uma página de Offers para economias adicionais.

Perguntas Frequentes

Quais são os preços do GPT-5.6 após o corte?

Luna $0,20 / $1,20, Terra $2 / $12 e Sol $5 / $30 por milhão de tokens de entrada/saída. Luna e Terra foram cortados em 30 de julho de 2026; Sol permanece inalterado.

Qual nível do GPT-5.6 devo usar?

Luna para trabalho de alto volume e sensível à latência; Terra para tarefas mais difíceis que não precisam do carro-chefe; Sol para o raciocínio mais difícil e codificação agêntica. Roteie por dificuldade para minimizar custo.

O GPT-5.6 Luna é gratuito no ChatGPT?

O​penAI anunciou em 6 de agosto que o GPT-5.6 Luna está se tornando o modelo padrão para contas gratuitas e contas Go do ChatGPT, com chats ilimitados somente de texto; os limites permanecem para uploads de arquivos, imagens e ferramentas de voz, e um botão Think para raciocínio mais avançado está sendo lançado separadamente. Esses são planos declarados pela O​penAI, não verificados de forma independente.

Por que o Replit está usando GPT-5.6 Luna no Modo Gratuito?

O Modo Gratuito da Replit, anunciado em 19 de agosto de 2026, executa chat cotidiano, ideação e codificação simples no GPT-5.6 Luna por padrão para assinantes Core e Pro, roteando tarefas mais difíceis para um modelo maior — seus modos Power/Max ou GPT-5.6 Sol — conforme necessário. A Replit atribui o corte de preço da API Luna em 30 de julho, de aproximadamente 80%, a tornar a economia viável. Estes são planos declarados pelo fornecedor, não verificados de forma independente.

O que é Luna Reserve?

Uma cota de fallback que a OpenAI documenta para Codex e ChatGPT Work: contas selecionadas do ChatGPT Plus e Pro recebem um pool limitado de uso do GPT-5.6 Luna quando o limite de uso regular é esgotado, para que continuem funcionando em vez de serem interrompidas. Ela serve apenas o GPT-5.6 Luna — nunca Terra ou Sol — tem seu próprio limite, é separada do uso regular e não está disponível em workspaces Business ou Enterprise. A existência é declarada pela OpenAI (a equipe confirmou em 27 de agosto); a distribuição para contas selecionadas é relatada pela comunidade, não verificada de forma independente.

Quanto custa o GPT-5.6 por mês?

A 10M tokens/mês (70% entrada): aproximadamente $5 na Luna, $50 na Terra e $125 na Sol — uma diferença de 25x, antes do cache. Seu custo real depende do cache e da sua combinação de entrada/saída.

Todas as três camadas têm a mesma janela de contexto?

Sim — aproximadamente um contexto de 1,05M tokens e até 128K tokens de saída, com suporte a visão, ferramentas, JSON e raciocínio.

Como o cache de prompt afeta o custo?

O cache reduz drasticamente o custo de contexto repetido — a leitura de cache da Luna custa cerca de US$ 0,02 por milhão de tokens, contra US$ 0,20 para acesso direto — portanto, reutilize prompts em cache sempre que possível. Entradas longas, por outro lado, podem levá-lo a um nível de contexto longo mais caro.

Como os níveis se comparam aos modelos da Anthropic ou aos modelos abertos?

De acordo com relatórios, Luna subcotiza o Claude Haiku 4.5 (~5x entrada / 4x saída) e Terra fica abaixo do Claude Sonnet 5 ($3 / $15). Luna também está próxima do piso barato de modelos abertos (Deep​Seek, GLM-5.2 ~$1.20/$4.10).

Onde posso usar todos os três níveis juntos?

Através do único endpoint compatível com OpenAI da OrcaRouter com markup de 0%, juntamente com modelos abertos mais baratos para roteamento baseado em dificuldade.

Conclusão

Após o corte, a GPT-5.6 Luna ($0,20 / $1,20) e a Terra ($2 / $12) são atraentes para trabalho de alto volume e nível intermediário, enquanto a Sol ($5 / $30) continua sendo a principal flagship premium — uma diferença de custo de 25x que recompensa o roteamento inteligente. A implementação para o consumidor reforça a divisão: a OpenAI está tornando a Luna o padrão gratuito, reservando a atualização de confiabilidade da Sol para os planos pagos, e o Free Mode de 19 de agosto do Replit — construído sobre a GPT-5.6 Luna, com tarefas mais difíceis roteadas para a GPT-5.6 Sol — mostra produtos de alto tráfego adotando o mesmo nível, e o fallback Luna Reserve do final de agosto estende o padrão ao manter determinados usuários Plus e Pro na GPT-5.6 Luna mesmo depois que seus limites regulares se esgotam. Para quem desenvolve APIs, esse é mais um motivo para rotear tráfego fácil para a Luna. As maiores economias vêm do roteamento por dificuldade, do uso de cache e de processamento em lote (batch), e do controle dos tokens de raciocínio, em vez de usar um único nível por padrão. Fazer isso é mais fácil por meio de um endpoint único com markup de 0%, como o OrcaRouter, onde os três níveis (com os novos preços) ficam ao lado dos modelos abertos mais baratos com os quais você vai querer compará-los.