Cartão de título principal para um artigo de monitoramento de vazamentos sobre o GPT-6 Astra Minor, exibindo a manchete 'GPT-6 Astra Minor', o subtítulo 'o terceiro nome no vazamento do Azure, e o único que ninguém previu', selos em formato de pílula com os dizeres 'não anunciado', 'sem ID de modelo' e 'apenas string de registro', e um rodapé com os dizeres 'Noticiado em um arquivo de configuração do Azure, 22 de setembro de 2026'.
Guides & Insights

GPT-6 Astra Minor: O Terceiro Nome no Vazamento do Azure da OpenAI, e o Único que Ninguém Previu

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Três strings apareceram na própria configuração do Azure da Microsoft em 22 de setembro de 2026, e apenas uma delas foi uma surpresa. gpt-6-sol e gpt-6-luna circulavam havia duas semanas — nós cobrimos ambos, e nenhum dos dois tem um ID de modelo, um preço ou uma linha na documentação do fornecedor hoje. O terceiro, gpt-6-astra-minor, nunca tinha sido mencionado por ninguém. É uma variante do GPT-6 Astra, o carro-chefe lançado em 3 de setembro de 2026, e o nome implica algo que os outros dois não implicam: não um novo nível ao lado do carro-chefe, mas uma versão menor do próprio carro-chefe. GPT-5.6 Luna, o nível barato já à venda a US$ 0,20 por milhão de tokens de entrada, é o incumbente contra o qual qualquer nome barato do GPT-6 precisa se justificar, e GPT-6 Sol é o irmão cuja data de lançamento rumorada já passou uma vez sem um produto. O que segue é o que está documentado, o que é inferência, e o único fato sobre este vazamento que ninguém reportou ainda.

O que o vazamento realmente é, e o que não é

A alegação é mais restrita do que a cobertura em torno dela sugere. Na tarde de 22 de setembro, um usuário do fórum chinês de desenvolvedores locdd.com publicou que a configuração pública do playground do Azure listava três caminhos de registro da OpenAI que não haviam sido anunciados: azureml://registries/azure-openai/models/gpt-6-sol, o mesmo para gpt-6-luna, e azureml://registries/azure-openai/models/gpt-6-astra-minor. O autor da postagem indicou como fonte um URL ativo da Microsoft, em vez de uma captura de tela. A imprensa de tecnologia chinesa repercutiu o assunto na mesma noite e, desde então, ele circula como um “vazamento do Azure” — agora com uma versão da história em captura de tela misturada, o que vale a pena notar porque as duas versões não são igualmente verificáveis.

Acessamos o URL indicado pelo autor da postagem — https://ai.azure.com/modelcache/widgets/PlaygroundConfig.json — em 23 de setembro de 2026, e ele retorna um 200 com um documento JSON de 33 KB que lista caminhos de registro de dezenas de modelos. No registro azure-openai, ele nomeia gpt-6-astra e, da geração anterior, gpt-5.6-sol, gpt-5.6-luna e gpt-5.6-terra. Ele não contém gpt-6-sol, gpt-6-luna nem gpt-6-astra-minor. Há duas leituras honestas disso, e não vamos escolher uma por você. Ou o endpoint é servido a partir de um cache que ainda não havia captado as novas entradas, ou os três nomes foram vistos em algum lugar que o endpoint público não expõe — uma build interna, uma implantação regional, uma visão autenticada —, e a citação de um URL público feita pelo autor da postagem é a parte da história que não se sustenta. De qualquer forma, os próprios nomes continuam sem atribuição à Microsoft ou à OpenAI, e nenhuma das duas empresas disse uma palavra sobre qualquer um deles.

Também vale a pena ser preciso sobre o que é um caminho de registro. Um modelo registrado no registro azure-openai do Azure é uma reserva de nome com uma estrutura de implantação por trás. Não é um preço, nem uma janela de contexto, nem uma data, nem um cartão de sistema e nem um lançamento. Historicamente, o Azure já incluiu nomes de modelos muito antes da disponibilidade geral — é exatamente por isso que essa classe de vazamento merece ser lida, e também por isso vale a pena lê-la com ceticismo. Um nome em um registro lhe diz que alguém dentro de um provedor de nuvem provisionou uma string. Não lhe diz que o modelo existe.

A two-column scoreboard titled 'GPT-6 Astra vs GPT-6 Astra Minor - the scoreboard'. The left column, GPT-6 Astra, reads: Status: shipped Sep 3, 2026; Model ID: gpt-6-astra; Price per MTok: $10 / $50; Context window: about 1.05M tokens; Vendor docs: yes; Evidence: vendor-published. The right column, GPT-6 Astra Minor, reads: Status: not announced; Model ID: none; Price per MTok: not published; Context window: not published; Vendor docs: none; Evidence: one registry string. A footer reads 'Astra figures per OpenAI and Azure. Astra Minor: unconfirmed, no vendor documentation.'

Por que astra-minor é o interessante

A gramática de nomeação está fazendo um trabalho real aqui, e é a única evidência real na história.

Na geração GPT-5.6, Sol, Terra e Luna são irmãos — três nomes distintos para três níveis de aproximadamente a mesma família, com preços de $4/$20, $2/$12 e $0.20/$1.20 por milhão de tokens, respectivamente. Um sufixo como -minor é uma construção diferente. Ele se anexa a um modelo base e diz este é aquele modelo, menor. É a gramática de GPT-4o mini, o4-mini, GPT-5-mini, GPT-5.4-mini e gpt-image-2-mini — a convenção de longa data da própria Microsoft e da OpenAI, e a que a Microsoft tem usado em toda a sua própria linha de modelos pequenos também.

Essa distinção importa para o que o modelo seria, não apenas para como ele seria chamado.

• Um nome irmão como GPT-6 Sol seria um novo nível — um ponto diferente na curva de capacidade e preço, treinado e ajustado separadamente.

• Um nome secundário como GPT-6 Astra Minor seria a mesma geração oferecida de forma mais barata — a mesma família de arquitetura, uma pegada menor, muito provavelmente um irmão destilado ou podado do carro-chefe, em vez de uma nova base.

O segundo é o de maior impacto entre os dois para quem escreve código usando essas APIs, porque é o formato que a OpenAI já usou antes para tornar uma geração carro-chefe acessível em volume. O GPT-4o mini não era uma curiosidade; tornou-se o modelo pequeno padrão em uma quantidade muito grande de tráfego de produção, enquanto o GPT-4o completo permanecia caro. Se o GPT-6 Astra Minor for real e seguir esse padrão, o número interessante não é sua pontuação de benchmark — é se ele fica próximo o suficiente do comportamento da Astra para que você possa mover uma carga de trabalho para baixo sem reescrever os prompts em torno dele.

Há um motivo para isto ser especulação e não análise: nada sobre o GPT-6 Astra Minor foi publicado. Sem preço, sem janela de contexto, sem contagem de parâmetros, sem benchmark, sem data, sem system card. A string de registro é toda a base de evidências.

O que a comunidade pensa que é, e por que isso é adivinhação

O tópico onde isto surgiu é a coisa mais útil nisto, porque as suposições estão visíveis e nenhuma delas concorda. O resumo do próprio autor foi direto: Por enquanto, não se sabe qual é o seu posicionamento — o seu posicionamento é pouco claro. O que se seguiu foi um conjunto de teorias mutuamente exclusivas, e vale a pena lê-las como uma amostra de quanto se sabe de facto, que é nada.

• Um nível entre o Sol e o Astra. É o palpite mais comum, e o que a diferença de preço torna mais plausível — o Astra a $10/$50 custa cerca de cinquenta vezes a taxa de entrada do GPT-5.6 Luna, e há muito espaço nessa faixa.

• Uma Astra quantizada. Esta seria genuinamente inédita: a quantização é normalmente uma atividade da comunidade ou de um motor de inferência sobre pesos abertos, não algo que um fornecedor distribui como um nome de registro de primeira parte. Considere-a a menos provável das quatro.

• Uma variante fortemente focada em visão. Uma resposta argumentou que Astra e seu irmão menor "leem imagens bem, mas queimam tokens e computação" — uma afirmação sobre um modelo que ninguém executou e, portanto, não é afirmação alguma.

• Um substituto barato para a geração anterior. O argumento aqui é o mais forte dos quatro à primeira vista: o Astra é caro o suficiente para que "substituir a geração anterior por uma versão mais leve seja totalmente razoável". Isso é uma afirmação sobre os incentivos da OpenAI, não sobre o modelo.

O que todas essas teorias têm em comum é que nenhuma delas vem com um número. Ninguém no tópico reivindica uma especificação, porque não há especificação a reivindicar. Se você vir o GPT-6 Astra Minor descrito em qualquer lugar com um preço, uma janela de contexto ou um benchmark atrelado, essa descrição foi inventada.

A lacuna que teria que preencher

Vale a pena fazer as contas, porque isso explica por que um terceiro nome GPT-6 é plausível, ainda que ninguém tenha evidências de que ele exista.

As tarifas publicadas pela própria OpenAI colocam o GPT-6 Astra a $10 por milhão de tokens de entrada e $50 por milhão de saída, com pedidos de contexto longo cobrados num escalão superior acima de cerca de 272.000 tokens. A $50 por milhão de saída, mil tokens de saída custam cinco centavos. Um ciclo agêntico que emite dez mil tokens de raciocínio, chamadas de ferramentas e diffs custa cerca de cinquenta centavos por execução — e essa é a parte barata do trabalho agêntico, em que o ciclo é executado dezenas de vezes por tarefa. Abaixo do Astra, as tarifas em vigor são o GPT-5.6 Sol a $4/$20 (numa tarifa promocional), o GPT-5.6 Terra a $2/$12 e o GPT-5.6 Luna a $0.20/$1.20. O abismo entre o modelo principal e tudo o que está abaixo dele é íngreme, e não há nada na geração GPT-6 do lado barato dessa linha.

Esse é o argumento comercial a favor de um modelo menor. É também o argumento contra os dois irmãos sobre os quais se especula: a OpenAI já vende o GPT-5.6 Luna a US$ 0,20 de entrada, e responder à pressão de custos cortando em 80% o preço de um nível já existente — que foi o que ela fez no fim de julho de 2026 — sai mais barato do que treinar e servir um modelo totalmente novo. Um modelo menor é uma proposta diferente, porque não compete com o GPT-5.6 Luna tanto por preço, mas por ser o GPT-6.

Para quem está planejando em torno disso, a pergunta prática não é qual nome vence, mas como você experimentaria um sem apostar um caminho de produção nele. Todos os quatro modelos da OpenAI que estão de fato ativos e roteáveis — GPT-6 Astra, GPT-5.6 Sol, GPT-5.6 Terra e GPT-5.6 Luna — estão no OrcaRouter atrás de uma única chave de API, pelo preço de tabela do provedor com 0% de markup repassado em vez de acrescentado, então uma mudança de tarifa do fornecedor entra em vigor do nosso lado no mesmo dia em que acontece. Isso importa mais em um nível que você chama um milhão de vezes do que em um que você chama cem. E se um nome barato de GPT-6 aparecer, o failover automático é a maneira mais barata de descobrir se ele aguenta: direcione uma fatia do tráfego para ele, e deixe a rota recorrer ao nível em que você já confia quando não aguentar. Para deixar explícito o que não é verdade hoje — nada chamado GPT-6 Astra Minor pode ser roteado em lugar nenhum, incluindo aqui, porque não existe como um modelo chamável. O próprio GPT-6 Astra é a rota GPT-6 mais recente que oferecemos.

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the model title GPT-6 Astra, the vendor OpenAI with a 2026-09-04 date, a 1M-token context window with a 128K maximum output, text, image and file input, an input price of $10.00 per million tokens, an output price of $50.00 per million tokens, a p50 time to first token of 7.75 seconds and 328.7M tokens of traffic over seven days.

Seis dias, e uma data que a OpenAI assinou com o próprio nome

Este vazamento tem um prazo de validade natural, e é curto. O DevDay 2026 da OpenAI é em 29 de setembro no Fort Mason, em São Francisco — anunciado em 29 de abril, a primeira conferência de desenvolvedores presencial da empresa desde 2024, com keynote transmitida ao vivo. Sam Altman enquadrou os preparativos em 15 de setembro com "um grande lançamento esta semana, e depois para o DevDay lançamento x 6", voltou atrás na primeira metade na noite seguinte para "semana que vem", e o líder do Codex, Tibo Sottiaux, tem feito suspense sobre o evento como o melhor da história da empresa. A data de lançamento rumorada do GPT-6 Sol, terça-feira, 22 de setembro, já passou sem nenhum modelo anunciado, o que é exatamente o padrão que direciona a atenção para o DevDay.

Há um outro compromisso com data nesta história e, ao contrário de tudo o mais nela, a OpenAI assinou-o: a série GPT-5.5 será descontinuada em 14 de outubro de 2026. Descontinuar uma geração anterior numa data agendada é o que uma empresa faz quando precisa de espaço nas prateleiras, e 14 de outubro é a única data em todo o ciclo de rumores do GPT-6 a que o fornecedor associou o seu próprio nome.

Então, o teste é barato e está próximo. Se o DevDay produzir uma família GPT-6, os nomes no registro vão parecer proféticos, e este artigo será uma nota de rodapé. Se 29 de setembro passar sem nada, isso é um dado real contra todos os três nomes de uma vez — e não custa nada esperar os seis dias em vez de reestruturar um roadmap por causa de uma string num arquivo de configuração.

A screenshot of Microsoft Learn's 'Foundry Models sold by Azure' page, showing the page title, the heading 'Foundry Models sold directly by Azure', and a right-hand 'In this article' table of contents whose Azure OpenAI entries include GPT-6, GPT-5.6, GPT-5.5, GPT-5.4, GPT-5.3, GPT-5.2 and GPT-5.1, plus a Deployment types entry and a note reading 'See Models sold directly by Azure for more information.' The GPT-6 model table itself sits below the visible area of this capture.

A colisão de nomes que vai custar dinheiro a alguém

Aconteça o que acontecer em 29 de setembro, uma armadilha já está ativa e não tem nada a ver com o fato de o vazamento ser real.

• GPT-5.6 Sol é um modelo à venda hoje. GPT-6 Sol é um rumor. As strings diferem em um caractere e resolvem para coisas completamente diferentes.

• GPT-5.6 Luna é um modelo à venda hoje por US$ 0,20/US$ 1,20 e é o padrão para os planos gratuito e Go do ChatGPT. GPT-6 Luna é um rumor sem nada por trás além de um argumento de simetria de nomes de 6 de setembro.

• O GPT-6 Astra é um modelo que a OpenAI lançou em 3 de setembro. O GPT-6 Astra Minor não existe e, se aparecer, será um modelo diferente e menor — não um apelido para o Astra.

O modo de falha é um arquivo de configuração que diz gpt-6-luna porque um post de blog disse que o nível estava chegando, e um job de produção que ou dá erro ou, silenciosamente, acaba caindo em outra coisa. É o tipo de erro que é invisível em staging e caro em produção. A disciplina que o evita é chata: conectar o identificador exato da própria lista de modelos do fornecedor e tratar qualquer nome que você só viu em um vazamento como um nome que você não pode chamar. Um 404 de um modelo não anunciado não prova nada sobre o amanhã — é a resposta esperada hoje.

O que resolveria isso, em ordem

Quatro coisas transformariam isto de uma string de registro em um modelo, e elas chegam em uma sequência previsível.

• O nome que aparece na própria documentação de modelos da OpenAI ou na lista de modelos vendidos pela Azure. Essa é a primeira confirmação real e geralmente chega antes de qualquer outra coisa.

• Um ID de modelo com um carimbo de data nele. É aí que o modelo deixa de ser um nome e começa a ser uma versão.

• A tabela de preços. Para um menor, o preço é o produto. Um número significativamente abaixo do $10/$50 da Astra é a tese inteira; um número próximo disso tornaria o sufixo sem sentido.

• Pontuações independentes. As tabelas de lançamento dos fornecedores para a geração GPT-6 têm sido generosas em relação ao que os painéis independentes medem, então a primeira colocação no Artificial Analysis valerá mais do que qualquer slide de lançamento.

Até que pelo menos os dois primeiros existam, a afirmação precisa é a mais entediante: três nomes de modelos da OpenAI apareceram numa configuração do Azure em 22 de setembro de 2026, dois deles andavam a ser alvo de rumores há duas semanas e o terceiro não tinha sido alvo de rumor nenhum, e nem a Microsoft nem a OpenAI confirmaram nenhum deles. O GPT-6 Astra Minor é o mais interessante dos três precisamente por ser aquele que ninguém esperava — um carro-chefe menor é um tipo diferente de alegação do que um novo nível — e é também, por enquanto, aquele que tem menos por trás. Seis dias dirão mais do que as últimas seis semanas disseram.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente