Preços do GPT-5.6 Após o Corte: Luna vs Terra vs Sol, e Qual Nível Usar
Guides & Insights

Preços do GPT-5.6 Após o Corte: Luna vs Terra vs Sol, e Qual Nível Usar

Autor

Jim Song

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Após o corte de preços da O​penAI em 30 de julho de 2026, a família GPT-5.​6 — GPT-5.6 Luna, GPT-5.6 Terra e GPT-5.6 Sol — nunca foi tão barata para operar em escala. Uma semana depois, em 6 de agosto, a O​penAI levou os mesmos níveis para o próprio ChatGPT: o GPT-5.6 Luna está se tornando o modelo padrão para contas gratuitas e Go com chats de texto ilimitados, enquanto o GPT-5.6 Sol foi atualizado para Plus e Pro. Mas os três níveis têm preços muito diferentes, e escolher o certo (além de usar bem cache, lote e roteamento) é a maior alavanca na sua fatura da API. Este guia apresenta o preço completo após o corte, exemplos de custo calculados, como cada nível se compara aos concorrentes e como rotear entre eles por um único endpoint.

Os preços são por milhão de tokens {{1}}(entrada / saída){{/1}}, refletindo a {{2}}tabela de tarifas pós-corte, conforme divulgada, e as páginas do modelo de repasse da OrcaRouter{{/2}}; {{3}}as tarifas escalonadas e de cache vêm das páginas do modelo da OrcaRouter, e os valores dos concorrentes são atribuídos{{/3}}. Os detalhes do lançamento do ChatGPT neste artigo são de acordo com o que a OpenAI declarou em 6 de agosto de 2026 — {{5}}relatados pelo fornecedor, não medidos de forma independente{{/5}}. Os preços mudam — {{6}}verifique antes de construir{{/6}}.

TL;DR

GPT-5.6 Luna ($0.20 / $1.20) é o cavalo de batalha de alto volume; Terra ($2 / $12) é o meio equilibrado; Sol ($5 / $30) é o carro-chefe para o raciocínio mais difícil e codificação agêntica. Todos os três compartilham um contexto de ~1.05M tokens e saída máxima de 128K. O cache de prompt e a opção de lote reduzem ainda mais os custos, enquanto entradas muito longas fazem você subir para um nível superior. No lado do consumidor, a O​penAI anunciou em 6 de agosto que o GPT-5.6 Luna está se tornando o padrão para contas Free e Go do ChatGPT, com chats ilimitados somente de texto, e que um GPT-5.6 Sol atualizado está sendo lançado para Plus e Pro. Use Luna para a maioria fácil, Terra quando precisar de mais, e Sol somente onde ele justifica seu custo — e direcione por dificuldade por meio de um endpoint compatível com O​penAI para minimizar gastos.

Principais conclusões

• Luna: $0.20 / $1.20 por 1M de tokens — rápido, barato, para trabalho de alto volume e sensível à latência.

• Terra: $2 / $12 — a opção intermediária equilibrada para tarefas mais difíceis que não exigem o modelo topo de linha.

• Sol: $5 / $30 — o carro-chefe para raciocínio profundo, codificação em larga escala e agentes de longo horizonte.

• O armazenamento em cache e o processamento em lote reduzem ainda mais os custos; entradas longas levam você a um nível de contexto longo mais caro.

• ChatGPT (declarado pela OpenAI, 6 de ago): Luna torna-se o padrão gratuito/Go com chats de texto ilimitados; Sol recebe uma atualização de confiabilidade para Plus/Pro.

• Maior alavanca de economia: roteie por dificuldade — não pague taxas da Sol por trabalho que a Luna pode fazer.

O novo preço base do GPT-5.6

Aqui estão os preços base pós-corte por milhão de tokens de entrada/saída: Luna $0.20 / $1.20 (reduzido de $1 / $6), Terra $2 / $12 (reduzido de $2.50 / $15) e Sol $5 / $30 (inalterado). Os dois níveis mais baratos foram reduzidos em 30 de julho de 2026; o principal permaneceu. Simplificando, os níveis baixos agora têm preços voltados para escala, enquanto o principal continua premium.

Preços escalonados, em cache e em lote

A taxa base é apenas o ponto de partida. O preço do GPT-5.6 tem três modificadores que alteram materialmente seu custo efetivo:

• Camadas de contexto longo. Os preços aumentam para entradas muito longas. Nas páginas de repasse da OrcaRouter, Luna custa $0.20 / $1.20 até uma camada de contexto grande e $0.40 / $1.80 além dela; Sol custa $5 / $30 na camada base e $10 / $45 na maior. A camada é escolhida pela contagem de tokens de entrada de cada solicitação, então alguns prompts enormes podem aumentar silenciosamente seu preço médio.

• Cache de prompt. Contexto reutilizado é cobrado com um grande desconto — a leitura de cache da Luna é de aproximadamente US$ 0,02 por milhão de tokens (versus US$ 0,20 para consulta nova), com gravações de cache em torno de US$ 0,25; a leitura de cache da Sol é de cerca de US$ 0,50 (versus US$ 5 para consulta nova). Para agentes e chat com um prompt de sistema estável, o cache costuma ser a maior economia.

• Lote. Trabalhos não urgentes são executados de forma assíncrona com desconto — ideal para classificação em massa, avaliações e geração offline onde a latência não importa.

Exemplos práticos: quanto custa de verdade

Números concretos tornam os níveis reais. Considere 10 milhões de tokens por mês com uma divisão de 70% entrada / 30% saída (uma mistura típica de chat/agente):

• Luna: cerca de $5 por mês (aproximadamente $4,37 com cache de prompt).

• Terra: cerca de $50 por mês.

• Sol: cerca de $125 por mês (aproximadamente $109 com cache).

Isso é uma diferença de 25x entre Luna e Sol para o mesmo volume — o que é exatamente por que associar cada solicitação ao nível mais barato capaz de atendê-la importa mais do que qualquer tarifa única. (Esses valores correspondem à calculadora de custos na página do OrcaRouter, que estima a partir do preço de tabela; seus números reais dependem de cache e da sua combinação de entrada/saída.)

Para que realmente serve cada nível

GPT-5.6 Luna — o cavalo de batalha do volume

Luna é a camada rápida e econômica, ajustada para cargas de trabalho de alto volume e sensíveis à latência: chat, classificação, extração, roteamento e tarefas de agente leves, com p50 de tempo até o primeiro token em torno de 1,65 segundos. Após a redução, a US$ 0,20 / US$ 1,20, ela é precificada para competir diretamente com modelos abertos baratos — a opção padrão para a grande maioria das chamadas simples. É também a camada para a qual a O​penAI está direcionando o ChatGPT para consumidores: em seu anúncio de 6 de agosto, o GPT-5.6 Luna está se tornando o modelo padrão para contas Free e Go, com chats somente de texto se tornando ilimitados e um novo botão Think para raciocínio mais profundo em perguntas mais difíceis chegando na semana seguinte (os limites de arquivos, imagens e voz permanecem). A O​penAI afirma que a Luna comete 62% menos erros factuais do que o GPT-5.5 Instant que ela substitui — um número reportado pelo fornecedor, mas um sinal claro de que a camada de volume é para onde a empresa está direcionando a maior parte do seu tráfego.

GPT-5.6 Terra — o meio equilibrado

A Terra fica entre o volume e o topo de linha: mais capaz que a Luna para raciocínio e codificação mais complexos, mas muito mais barata que a Sol. Por US$ 2 / US$ 12, é uma opção sensata quando a Luna não é suficiente, mas você não precisa do topo de linha — extração de média complexidade, redação e tarefas de várias etapas que ainda rodam em escala.

GPT-5.6 Sol — o carro-chefe

Sol é feito para os trabalhos mais difíceis: raciocínio profundo em múltiplas etapas, engenharia de software em larga escala e fluxos de trabalho agênticos de longo horizonte, mantendo-se coerente em um contexto de ~1,05 milhão de tokens e com até 128K de saída. Por US$ 5 / US$ 30 (base), é uma opção premium — reserve-o para tarefas que realmente precisam dele, como codificação complexa em vários arquivos ou longas execuções de agentes. Em 6 de agosto, a {{1}}O​penAI{{/1}} também atualizou o GPT-5.6 Sol no ChatGPT para usuários Plus e Pro: a empresa afirma que a versão de chat é mais confiável quanto aos fatos — 68% menos erros factuais, segundo a {{2}}O​penAI{{/2}} — e fornece respostas mais focadas, com um novo controle deslizante para ajustar quanto esforço de raciocínio ela aplica. A atualização vale apenas para o chat (o Sol por trás do Work e do Codex não mudou), e o nível da API segue em US$ 5 / US$ 30.

A ressalva do token de raciocínio.

Os modelos GPT-5.​6 são modelos de raciocínio, então o custo efetivo de saída pode exceder uma estimativa ingênua: quando o raciocínio está ativado, os tokens de raciocínio internos são cobrados como saída. Em prompts difíceis com alto esforço de raciocínio, isso pode dominar sua fatura. Ajuste o esforço de raciocínio à tarefa (baixo ou desligado para chamadas simples), limite os tokens de saída quando possível e meça o uso real. Tarifas mais baratas por token ajudam; gerar menos tokens ajuda mais.

Como cada nível se compara aos rivais

{{1}}O corte reposicionou a GPT-5.6 em relação ao mercado.{{/1}} {{2}}Segundo relatos, os preços de US$ 0,20 / US$ 1,20 da Luna agora ficam abaixo dos do Claude Haiku 4.5 em cerca de 5x na entrada e 4x na saída, e os US$ 2 / US$ 12 da Terra ficam abaixo do preço padrão do Claude Sonnet 5 (relatado em US$ 3 / US$ 15).{{/2}} {{3}}Em relação aos pesos abertos, a Luna fica perto do piso estabelecido pela linha V4 da DeepSeek e pelo GLM-5.2 da Zhipu (cerca de US$ 1,20 / US$ 4,10), com as camadas Qwen e Gemini Flash próximas.{{/3}} {{4}}O resultado: para tarefas sensíveis a custo, a Luna agora é competitiva com os modelos capazes mais baratos, em vez de uma alternativa premium a eles — enquanto a Sol continua sendo um nível genuinamente premium para capacidades que você não consegue obter a baixo custo.{{/4}}

A verdadeira alavanca de economia: rotear por dificuldade

{{1}}A conta mais barata não se resume a um único nível — é associar cada solicitação ao modelo menos caro que consiga atendê-la.{{/1}} {{2}}Na prática: envie chamadas fáceis e de alto volume para Luna (ou um modelo aberto barato), suba para Terra quando as tarefas forem mais difíceis e use Sol apenas para a minoria genuinamente difícil.{{/2}} {{3}}Combinado com cache e processamento em lote, isso reduz custos rotineiramente muito mais do que qualquer mudança de preço isolada.{{/3}} O problema é operacional: você não quer reintegrar três níveis da {{KEEP}}O​penAI{{/KEEP}} mais alternativas de modelos abertos separadamente.

Acesse todos os três (e rivais mais baratos) através de um único endpoint.

É aqui que um roteador neutro em relação ao fornecedor ajuda. O OrcaRouter expõe GPT-5.6 Luna, Terra e Sol — pelos mesmos preços pós-corte, com 0% de acréscimo — por meio de um endpoint compatível com O​penAI, juntamente com modelos abertos mais baratos, como DeepSeek V4 Pro, GLM-5.2 e Qw​en. Alternar níveis (ou fazer teste A/B de Luna contra um modelo aberto) é uma mudança de configuração, não uma reintegração, e você pode rotear cada solicitação para o que for mais barato.

A tabela de preços da Luna após o corte é visível na própria página de modelo da OrcaRouter ao preço de tabela — US$ 0,20 / US$ 1,20 por milhão de tokens — porque o roteador repassa os preços dos provedores com margem de 0%, com uma calculadora de custos na página para uma fatura mensal típica. Há também um nível gratuito e uma página de Offers para economias adicionais.

Perguntas Frequentes

Quais são os preços do GPT-5.​6 após o corte?

Luna $0,20 / $1,20, Terra $2 / $12 e Sol $5 / $30 por milhão de tokens de entrada/saída. Luna e Terra foram cortados em 30 de julho de 2026; Sol permanece inalterado.

Qual nível do GPT-5.6 devo usar?

Luna para trabalho de alto volume e sensível à latência; Terra para tarefas mais difíceis que não precisam do carro-chefe; Sol para o raciocínio mais difícil e codificação agêntica. Roteie por dificuldade para minimizar custo.

O GPT-5.6 Luna é gratuito no ChatGPT?

O​penAI anunciou em 6 de agosto que o GPT-5.6 Luna está se tornando o modelo padrão para contas gratuitas e contas Go do ChatGPT, com chats ilimitados somente de texto; os limites permanecem para uploads de arquivos, imagens e ferramentas de voz, e um botão Think para raciocínio mais avançado está sendo lançado separadamente. Esses são planos declarados pela O​penAI, não verificados de forma independente.

Quanto custa o GPT-5.6 por mês?

A 10M tokens/mês (70% entrada): aproximadamente $5 na Luna, $50 na Terra e $125 na Sol — uma diferença de 25x, antes do cache. Seu custo real depende do cache e da sua combinação de entrada/saída.

Todas as três camadas têm a mesma janela de contexto?

Sim — aproximadamente um contexto de 1,05M tokens e até 128K tokens de saída, com suporte a visão, ferramentas, JSON e raciocínio.

Como o cache de prompt afeta o custo?

O cache reduz drasticamente o custo de contexto repetido — a leitura de cache da Luna custa cerca de US$ 0,02 por milhão de tokens, contra US$ 0,20 para acesso direto — portanto, reutilize prompts em cache sempre que possível. Entradas longas, por outro lado, podem levá-lo a um nível de contexto longo mais caro.

Como os níveis se comparam aos modelos da Anthropic ou aos modelos abertos?

De acordo com relatórios, Luna subcotiza o Claude Haiku 4.5 (~5x entrada / 4x saída) e Terra fica abaixo do Claude Sonnet 5 ($3 / $15). Luna também está próxima do piso barato de modelos abertos (Deep​Seek, GLM-5.2 ~$1.20/$4.10).

Onde posso usar todos os três níveis juntos?

Através do único endpoint compatível com OpenAI da OrcaRouter com markup de 0%, juntamente com modelos abertos mais baratos para roteamento baseado em dificuldade.

Conclusão

Após o corte, a GPT-5.6 Luna ($0.20 / $1.20) e a Terra ($2 / $12) são atraentes para trabalho de alto volume e de nível intermediário, enquanto a Sol ($5 / $30) continua sendo o carro-chefe premium — uma diferença de custo de 25x que recompensa o roteamento inteligente. A implementação para o consumidor reforça a divisão: a OpenAI está tornando a Luna o padrão gratuito, enquanto reserva a atualização de confiabilidade da Sol para planos pagos, o que, para desenvolvedores de API, é mais um motivo para direcionar o tráfego fácil para a Luna. As maiores economias vêm do roteamento por dificuldade, do uso de cache e de lote, e do controle dos tokens de raciocínio, em vez de usar um único nível por padrão. Fazer isso é mais fácil por meio de um único endpoint com margem de 0%, como o OrcaRouter, onde todos os três níveis (aos novos preços) ficam ao lado dos modelos abertos mais baratos com os quais você vai querer compará-los.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

Fale conosco

Junte-se à comunidade

DiscordEmailXGitHubYouTube