Um cartão de título principal para um artigo de alerta de vazamento sobre os rumores do GPT-6 Luna e do GPT-6 Sol, mostrando um selo âmbar 'NÃO VERIFICADO · ALERTA DE VAZAMENTO' no canto superior esquerdo, o antetítulo 'RELATÓRIO DE VAZAMENTO', a manchete 'GPT-6 Luna e GPT-6 Sol' sobre a linha 'dois nomes, nenhum modelo', o subtítulo 'Nenhum tem um ID de modelo, um preço, uma data ou uma declaração da OpenAI', três chips com os dizeres 'GPT-6 Astra lançado em 3 de setembro de 2026', 'Registro de merge da NVIDIA: GPT-6 Sol medium' e 'GPT-5.6 Luna no ar a $0.20 / $1.20', e na parte inferior um cartão sólido 'GPT-5.6 Luna — lançado, $0.20 / $1.20 por MTok' unido por uma seta fina a dois cartões tracejados 'GPT-6 Sol ? — não anunciado' e 'GPT-6 Luna ? — não anunciado'. O logotipo da OrcaRouter está composto no canto inferior direito.
Guides & Insights

GPT-6 Luna e GPT-6 Sol: o nível barato que a OpenAI ainda não lançou

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Há um artefato concreto e verificável nesta história, e não é nenhum dos nomes na manchete. Em 21 de setembro, desenvolvedores relataram ter visto a string GPT-6 Sol medium dentro de registros de merge de código da NVIDIA — um repositório de terceiros, não do fornecedor. Em torno desse único artefato, um rumor muito maior se formou: que a OpenAI está se preparando para lançar GPT-6 Sol como um cavalo de batalha de nível médio e GPT-6 Luna como sua camada barata, abaixo do carro-chefe GPT-6 Astra que a OpenAI realmente lançou em 3 de setembro de 2026. Nem o GPT-6 Sol nem o GPT-6 Luna têm um identificador de modelo, um preço, uma janela de contexto, um cartão de sistema ou uma linha na própria documentação da OpenAI. A camada que eles ocupariam, no entanto, já tem um ocupante ativo em GPT-5.6 Luna — o membro econômico da família GPT-5.6, à venda desde 9 de julho de 2026 a $0.20 por milhão de tokens de entrada e $1.20 por milhão de saída. Essa assimetria é a história toda, e é a razão pela qual este artigo vale a pena ser lido, em vez de apenas ser motivo de cautela.

O que está realmente documentado e o que é inferência

Comece pelo artefato, porque é a única coisa aqui que um leitor pode acessar e examinar. O registro de merge da NVIDIA é real no sentido de que as pessoas que o noticiaram estavam lendo um repositório público, e a alteração de código descrita é banal: um commit escrito com a assistência do GPT-6 Astra e depois revisado por algo rotulado como GPT-6 Sol. A matéria do 新智元 que levou a descoberta a um público mais amplo apresentou-a como um exemplo funcional de uma "matriz de trabalhadores de IA" — uma cadeia em que um modelo escreve e outro revisa. Trate esse enquadramento como comentário. O próprio registro de merge indica que alguém dentro da infraestrutura de um terceiro está se preparando para servir um modelo sob esse nome. Ele não indica que a OpenAI lançou um, e não diz absolutamente nada sobre a Luna.

O restante do argumento a favor de um lançamento do GPT-6 Sol é mais frágil do que a cobertura em torno dele sugere. A imprensa de tecnologia chinesa noticiou um preço vazado de US$ 2,50 por milhão de tokens de entrada e US$ 15 por milhão de saída — aproximadamente metade do que custa o GPT-5.6 Sol —, além de alegações de que o suporte estava sendo preparado na OpenAI API, no Codex OAuth, na entrada de imagens e no tratamento de contexto longo, e de um suposto lançamento na terça-feira, 22 de setembro. Parte dessas reportagens apontava para as 3h da manhã de terça-feira. No momento em que escrevo, não há anúncio da OpenAI, nem string de identificador, nem entrada na página de preços e nem avistamento no seletor de modelos para o GPT-6 Sol ou o GPT-6 Luna. Um veículo que cobriu a mesma cadeia de rumores observou que seus próprios números de preço não eram coerentes entre si, citando US$ 2,50/US$ 15, US$ 4/US$ 30 e outros valores em circulação — o que é a cara de um rumor depois de passar por quatro traduções, não a cara de uma tabela de preços.

O GPT-6 Luna é ainda mais fraco, e vale a pena ser franco quanto a isso. A presença de Luna na história remonta a uma única postagem de 6 de setembro, na qual a conta do X @kimmonismus escreveu que a OpenAI estava "já preparando o lançamento do GPT-6 Sol" e então raciocinou, a partir do padrão de nomenclatura do GPT-5.6, que "Sol, Terra e Luna ainda estão por vir". Isso é um argumento baseado na simetria de nomenclatura. Luna nunca foi objeto de uma alegação por si só — nenhum vazamento, nenhuma captura de tela, nenhuma string de modelo, nenhum preço. Ela aparece em compilações posteriores apenas porque apareceu no primeiro post.

Três datas, e o que cada uma provou

Vale a pena ler linhas do tempo de vazamentos como um placar, porque esta já tem um.

6 de setembro — a alegação da família. Inferência da comunidade a partir do precedente do GPT-5.6, sem artefato anexado. Não verificada então, não verificada agora.

15–16 de setembro — Sam Altman postou que a OpenAI tinha um "grande lançamento esta semana, e então para o devday lançamento x 6", depois recuou da primeira metade na noite seguinte, dizendo que a coisa que ele estava mais animado para lançar chegaria na semana seguinte e valeria a pena esperar. Ele não nomeou nenhum produto em nenhuma das postagens. Este é o único elemento declarado por um executivo em toda a história, e fala sobre timing e nada mais.

21 de setembro — o registro de merge da NVIDIA, e o primeiro artefato da cadeia. Um registro de merge no repositório de outra pessoa é um sinal real de que um modelo está sendo preparado para servir. Não é um lançamento.

Terça-feira, 22 de setembro — hoje, e a data que o próprio rumor nomeou. No momento em que escrevo, não há anúncio da OpenAI, nem identificador de modelo, nem entrada em lista de preços e nem avistamento no seletor de modelos para o GPT-6 Sol, e absolutamente nenhum para o GPT-6 Luna.

O próximo marco datado é o DevDay, na terça-feira, 29 de setembro, no Fort Mason Center — o "ship x 6" a que Altman se referiu, e a data alternativa que o noticiário chinês indicou caso o lançamento de terça-feira não acontecesse. Se um modelo de sexta geração de gama média ou econômico for real, é ali que ele tem maior probabilidade de aparecer, e uma única linha na própria lista de modelos da OpenAI resolveria tudo o que este artigo precisa ressalvar.

O nível já existe, e é barato.

Aqui está a parte da história que é inteiramente verificável, e é a razão pela qual um "GPT-6 Luna" é algo estranho de se aguardar. GPT-5.6 Luna está no ar, e é barato de uma forma que os modelos de ponta não são.

Preço — $0,20 por milhão de tokens de entrada e $1,20 por milhão de saída, de acordo com a própria documentação da API da OpenAI. Foi lançado em 9 de julho de 2026 a $1,00 / $6,00 e teve redução de cerca de 80% no final de julho.

Tarifas de cache e de contexto longo — leituras de entrada em cache têm cerca de 90% de desconto; pedidos que ultrapassam o limite de contexto longo são cobrados a cerca de $0.40 / $1.80 pela totalidade do pedido.

Contexto e saída — uma janela de contexto de 1M de tokens com saída máxima de 128K. O tempo mediano até o primeiro token é indicado como 1,83 segundos.

Função — A OpenAI substituiu o GPT-5.5 Instant pelo GPT-5.6 Luna como modelo padrão do ChatGPT Free e Go em 6–7 de agosto de 2026, adicionando um botão "Think" para raciocínio mais aprofundado na semana seguinte.

Efeito do corte — em 9 de setembro, Sarah Friar, diretora financeira da OpenAI, disse na conferência Communacopia do Goldman Sachs que a redução de preço produziu um aumento de cerca de dez vezes no uso, e argumentou que implantar o Luna é mais barato do que executar o GLM 5.3 da Z.ai em uma camada de nuvem. São ambos números de fornecedor apresentados por uma executiva em um evento para investidores: vale noticiar, não vale tratá-los como verificados de forma independente.

A two-column scoreboard titled 'GPT-6 Sol and GPT-6 Luna (reported) vs GPT-5.6 Luna (shipped) — the scoreboard'. The left column 'GPT-6 Sol and GPT-6 Luna (reported)' reads: Model ID: none found; Price per MTok: reported $2.50 in / $15 out, inconsistent; Context window: not announced; Availability: not shipped; Evidence: one NVIDIA merge record plus unnamed developer reports; Date: claimed Sep 22, unconfirmed. The right column 'GPT-5.6 Luna (shipped)' reads: Model ID: openai/gpt-5.6-luna; Price per MTok: $0.20 in / $1.20 out; Context window: 1M tokens, 128K max output; Availability: GA since Jul 9, 2026; Evidence: OpenAI API docs and price list; Role: default model for ChatGPT Free and Go. The footer reads 'GPT-6 Sol and GPT-6 Luna are unconfirmed; GPT-5.6 Luna figures per OpenAI's API documentation.' The OrcaRouter logo is composited in the bottom-right corner.

Coloque os dois preços lado a lado e a questão dos níveis se responde sozinha. O preço divulgado do GPT-6 Sol, de US$ 2,50 / US$ 15, é mais de doze vezes a tarifa de entrada do GPT-5.6 Luna. Uma Luna de sexta geração não estaria competindo com o Sol — estaria competindo com o modelo que a OpenAI já está oferecendo de graça como padrão do seu nível gratuito.

Por que um nível barato do GPT-6 é plausível de qualquer forma

Há um argumento comercial real por trás do rumor, e ele diz respeito a onde estão os tokens, e não a onde está o ranking. O GPT-6 Astra custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, com solicitações de contexto longo cobradas em um nível superior. Ele lista uma janela de contexto de 1M de tokens — a mesma classe da geração 5.6, a uma tarifa muito mais alta. No Artificial Analysis, a configuração de raciocínio máximo do Astra obtém 53 no Intelligence Index do rastreador, a cerca de US$ 3,26 por tarefa, o que é um preço defensável para trabalho de fronteira e indefensável para classificação, extração, roteamento ou loops de agentes em alto volume.

Essa lacuna é exatamente o formato que produziu Sol, Terra e Luna na geração 5.6, e é por isso que a cobertura continua apontando para um Sol de nível médio, em vez de um segundo carro-chefe. O próprio comportamento de preços da OpenAI sustenta a direção do movimento: sua resposta à pressão de custos em julho foi reduzir em 80% o preço da faixa barata, em vez de substituí-la, e seu CFO subiu ao palco em setembro para debater preços frente a modelos chineses de pesos abertos. Uma empresa que defende o segmento de entrada do mercado é uma empresa que pretende continuar lançando no segmento de entrada.

O contra-argumento é igualmente real, e é por isso que a lógica do próprio vazamento é mais fraca do que parece. Lançar um modelo econômico da série 6 significa pedir a todas as equipes que já ajustaram prompts, caching e harnesses de avaliação em torno do GPT-5.6 Luna que revalidem tudo isso em troca de um ganho marginal. Esse é um motivo genuíno pelo qual um GPT-6 Luna pode nunca ser anunciado — não porque o rumor seja falso, mas porque a decisão de produto que ele pressupõe pode não ter sido tomada.

A screenshot of the Artificial Analysis model page for GPT-6 Astra at maximum reasoning, showing an Intelligence Index score of 53, a speed of 65.3 output tokens per second, a cost of $3.26 per Intelligence Index task, and list pricing of $10.00 per million input tokens and $50.00 per million output tokens.

Como se preparar sem apostar num modelo que não existe

Você não pode chamar o GPT-6 Sol nem o GPT-6 Luna. Ninguém pode, e nenhuma plataforma os hospeda — o máximo que foi relatado é que um desenvolvedor viu uma string de modelo GPT-6 Sol ser retornada onde uma requisição do GPT-5.6 Sol era esperada, o que é uma curiosidade de roteamento, e não disponibilidade. O que você pode fazer é tornar a chegada eventual barata de adotar e cara de ser surpreendido por ela.

A versão prática é manter o nome do modelo fora do código da sua aplicação. Se a sua stack chama um modelo por uma string fixa no código, adotar um modelo de nível médio de sexta geração significa um deploy, uma nova passagem de requalificação de prompt e uma nova execução de avaliação. Se ela chama uma rota, significa alterar uma linha. O OrcaRouter expõe mais de 200 modelos por trás de uma única API com 0% de markup — o preço de lista do provedor repassado diretamente, então quando um fornecedor corta um preço, o número do nosso lado muda no mesmo dia, que foi como o corte de 80% do GPT-5.6 Luna apareceu aqui sem ninguém renegociar nada. O failover automático faz o resto: aponte uma rota para o nível mais barato que satisfaça o seu limite de avaliação, e um modelo não lançado fica fora do caminho até existir e passar.

A screenshot of the OrcaRouter model page for openai/gpt-5.6-luna, showing the model title GPT-5.6 Luna, its capability chips, a 1M-token context window with a 128K maximum output, an input price of $0.20 per million tokens and an output price of $1.20 per million tokens.

Esse é o uso honesto de um vazamento como este: não planejar uma migração para um modelo que ainda não foi anunciado, mas perceber qual slot na sua stack um novo modelo de nível intermediário preencheria, e garantir que preenchê-lo depois seja uma mudança de configuração, e não um projeto.

O que contaria como evidência

A linha entre um vazamento que vale a pena seguir e um vazamento que vale a pena ignorar está em se o artefato foi produzido pelo fornecedor ou por uma parte neutra. Aplicando aqui:

Conta — um identificador de modelo na documentação da API da OpenAI, um cartão de sistema, uma entrada na página de preços da OpenAI, uma aparição no seletor de modelos do ChatGPT, uma primeira execução independente de benchmark em um rastreador como o Artificial Analysis, ou uma listagem em um catálogo de roteamento com um endpoint real por trás.

Não conta — um registro de merge no repositório de outra pessoa por si só, uma lista de rumores sem atribuição em uma compilação, uma captura de tela vazada de um preço que três veículos noticiam de três maneiras diferentes, a observação de um desenvolvedor anônimo ou uma probabilidade de mercado de previsões. No final de julho, os mercados de previsões precificavam cerca de 77–78% para um lançamento do GPT-6 até 30 de setembro. Essa é a opinião de um mercado sobre uma data, não uma evidência sobre um modelo, e foi precificada antes de o Astra ser lançado.

Até que algo da primeira lista se concretize, a posição precisa sobre ambos os nomes é estreita e pouco glamourosa. GPT-6 Sol é uma string num registro de merge da NVIDIA e um preço com o qual ninguém concorda. GPT-6 Luna é um nome que aparece num rumor de família, numa lista que ninguém reivindicou, ocupando um tier que o GPT-5.6 Luna já preenche a $0.20 de entrada e $1.20 de saída. Não há nada para migrar, nada para comparar em benchmark e nada para precificar. A única coisa que vale a pena fazer hoje é garantir que, quando houver, seu roteamento não precise ser reescrito para chegar até lá.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente