Cartão de título com o texto 'OpenAI Aeon agent: um vazamento, rotulado', com a linha de estado 'Noticiado como próximo do lançamento — sem página de produto, sem preços, sem documentação' e três cartões: O artefacto — gpt-6-astra-aeon numa flag de funcionalidade do Codex Desktop, 3 de setembro; O contexto — o GPT-6 Astra foi lançado a 3 de setembro, o DevDay é a 29 de setembro; A lacuna — comportamento, limites, preço e acesso não noticiados. Uma linha de rodapé diz 'O nome Aeon não está verificado.'
Guides & Insights

Vazamento do Aeon Agent da OpenAI: o que é, na verdade, o suposto rival do bot Grok, e o que ainda não foi verificado

Autor

Magnus Corvin

Data de publicação

Voltar para todas as publicações

Algo chamado Aeon estará, segundo relatos, prestes a ser lançado pelo fornecedor — um agente persistente, sempre ativo, posicionado contra Grok Bot, o produto de colaborador digital que a SpaceXAI lançou a 11 de agosto, e contra o Muse da Meta. A alegação circula sob uma forma que vale a pena ler com atenção: o "Grok Bot" ("Aeon") do fornecedor está prestes a ser lançado, possivelmente antes do DevDay, possivelmente esta semana. Não há página de produto, nem preços, nem documentação, nem benchmark, nem declaração pública que mencione a palavra. O que existe é mais ténue e mais interessante do que o resumo sugere: duas strings de ID de modelo detetadas dentro de uma flag de funcionalidade do Codex Desktop a 3 de setembro — "gpt-6-astra" e "gpt-6-astra-aeon" — ao lado de um lançamento de plataforma confirmado, uma data de conferência confirmada de 29 de setembro, e um modelo principal confirmado, GPT-6 Astra, que foi lançado a 3 de setembro e assumiu o topo da linha da empresa, retirando essa posição ao GPT-5.6 Sol. Aeon é a próxima coisa mais plausível no roteiro do fornecedor. É também, à data de hoje, uma string num ficheiro de configuração e um conjunto de relatos que remontam todos às mesmas poucas publicações.

Em que consiste realmente o vazamento

Vale a pena separar o artefato do relato, porque os dois não têm o mesmo peso.

O artefato é concreto e datado. Em 3 de setembro, circulou uma captura de tela mostrando dois identificadores de modelo não documentados adicionados a uma feature flag do Statsig dentro do Codex Desktop: "gpt-6-astra" e "gpt-6-astra-aeon". A imagem veio da conta @notjazii e foi amplificada por @kimmonismus — a mesma conta cuja publicação é o sinal por trás deste artigo — com a observação de que os modelos já estavam "already" no Codex e poderiam aparecer "any minute now". Foi essa mesma captura de tela que primeiro vinculou o modelo Astra, confirmado pela OpenAI, ao nome GPT-6. Essa é a totalidade da evidência primária, e ela é genuína: as feature flags são o modo como os fornecedores preparam configurações antes de um lançamento, de modo que as strings são preparação de implantação real, e não invenção.

O que eles não fazem é estabelecer que algo esteja disponível, nem o que é. Um identificador em preparação pode ficar sem uso, ser renomeado ou se referir a um experimento interno que nunca é lançado sob esse nome. Nada na captura de tela descreve comportamento, memória, limites de contexto, preço ou quem tem acesso. O próprio sufixo é ambíguo: pode ser uma configuração de agente de longa duração, um nível de produto, um perfil de segurança ou uma sinalização para uma build interna de avaliação. Tratar "gpt-6-astra-aeon" como um modelo público chamado Aeon vai além das evidências, e essa é a leitura honesta do artefato, mesmo que o artefato seja real.

É das reportagens que vêm os detalhes, e elas são uniformemente secundárias. As reportagens descrevem o Aeon como um agente 24/7 que retém memória ao longo de vários dias, faz avançar projetos de longo horizonte em segundo plano, retoma mediante gatilhos de eventos e roda na linha de modelos Astra. Fragmentos vazados da interface supostamente mostram memória, ações agendadas e conectores de aplicativos de terceiros, com fluxos de comércio — pesquisa de produtos, montagem de carrinho, acompanhamentos pós-compra — dentro de uma única thread. Alegações de chamadas de ferramentas em menos de um segundo e suporte nativo a APIs indianas de pagamento e logística aparecem em uma única reportagem, sem corroboração e sem captura de tela anexada. Uma linha separada de reportagens liga o nome ao trabalho interno de matemática da OpenAI: reportagens até setembro dizem que um modelo interno, especulado ser o Aeon, foi usado em execuções de longo horizonte que produziram progresso em problemas do Prêmio do Milênio, com um relato descrevendo cerca de 10.000 agentes coordenadores e uma execução de 88 horas em Navier–Stokes com verificação formal em Lean. A OpenAI confirmou progresso em um segundo problema do Milênio; não confirmou que o Aeon, ou qualquer modelo nomeado, estivesse por trás disso. Esses são dois fatos diferentes, e as reportagens regularmente os fundem.

Mais um trecho do resumo merece uma correção, porque ele se repete. O mesmo texto de sinal menciona GPT-6 Solcomo esperado para breve, com Claude Opus 5.5e Claude Sonnet 5.5como a resposta da Anthropic. Sol é um nome vazado com um único artefato de terceiros por trás dele — a string "GPT-6 Sol medium" em um registro de merge da NVIDIA — e não é o carro-chefe já lançado da OpenAI; GPT-6 Astra é, desde 3 de setembro, ao lado do Astra Pro. Os nomes Claude 5.5 são strings não confirmadas que aparecem em listas de qualificação de mercados de previsão. Se você está lendo um calendário de lançamentos montado a partir disso, é um calendário de rumores, não de entregas.

O que a OpenAI realmente lançou, e o que isso diz sobre a Aeon

A evidência mais forte a favor do Aeon não é o vazamento de forma alguma — são as duas semanas de lançamentos da OpenAI de um lado e do outro dele.

• 3 de setembro — GPT-6 Astra chegou à disponibilidade geral, modelo de fronteira da OpenAI, contexto de 1 milhão de tokens, listado a US$ 10,00 de entrada e US$ 50,00 de saída por milhão de tokens, com desconto de 90% em cache. (A Artificial Analysis data o lançamento em 3 de setembro; nosso próprio catálogo lista o modelo em 2026-09-04.)

• 10 de setembro — A OpenAI abriu a Agents API em beta público, expondo o harness gerenciado do Codex: a OpenAI executa a orquestração da sessão, a compactação e a recuperação de contexto, enquanto os desenvolvedores fornecem a tarefa, o modelo, as ferramentas e o ambiente de execução, com sandboxes hospedados pela OpenAI, auto-hospedados ou em infraestrutura de parceiros. A cobrança é por tokens, ferramentas e tempo de contêiner, sem taxa de plataforma separada.

• 10 de setembro — GPT-Live-1 chegou à API a US$ 0,05 por minuto de voz.

• 15–16 de setembro — Sam Altman publicou que a OpenAI tinha um "grande lançamento esta semana, e depois, para o DevDay, lançamento x 6", e então voltou atrás na primeira metade: a coisa que ele estava mais empolgado para lançar naquela semana chegaria, em vez disso, na semana seguinte.

• 29 de setembro — DevDay 2026 no Fort Mason Center, São Francisco, confirmado desde junho, keynote transmitida ao vivo.

Leia tudo isso em conjunto e Aeon deixa de parecer um boato absurdo. A OpenAI acabou de transformar o harness de agente em produto e vendê-lo aos desenvolvedores; a versão voltada ao consumidor dessa mesma capacidade, vendida por assinatura para concorrer com Grok Bot e Muse, é o próximo passo óbvio, e o "na próxima semana, em vez disso" de Altman cai exatamente na janela entre 16 de setembro e o DevDay. Nada disso confirma o nome Aeon. Mas significa que o formato da história é coerente: um produto de agente, na linha Astra, em torno do DevDay.

Screenshot of OrcaRouter's model page for GPT-6 Astra (openai/gpt-6-astra), dated 2026-09-04, showing a 1M token context window, 128K max output, input $10.00 and output $50.00 per million tokens, p50 time to first token 7.38 seconds, and 353.5M tokens of traffic in seven days, with a code sample pointing at api.orcarouter.ai/v1

Se a Aeon for lançada, com o que ela está realmente competindo?

Três corridas, não uma — e elas têm placares diferentes.

A corrida dos agentes persistentes já está perdida por tempo. O Grok Bot entrou em beta inicial em 11 de agosto, com preço de entrada de US$ 120 por assento, integrado ao plano Cursor Premium Teams da SpaceXAI, com planos individuais de US$ 200 e US$ 300 por mês. Cada bot recebe sua própria VM na nuvem, com navegador, sistema de arquivos e terminal, faz login em aplicativos que não têm API, salva fluxos de trabalho demonstrados como rotinas e continua funcionando depois que você fecha o laptop. O Muse da Meta veio na sequência, em 8 de setembro. A OpenAI seria a terceira a chegar a uma categoria para a qual definiu a pesquisa.

A corrida por capacidade está genuinamente em aberto, porque ninguém publicou um número.A SpaceXAI não divulgou nenhum benchmark independente nem dados de confiabilidade para o Grok Bot; o roteador de modelos por trás dele é automático e os usuários não podem fixar um modelo; os testadores têm se mostrado publicamente pouco impressionados; e os avaliadores observam que não há uma camada de controle empresarial — sem permissões com escopo, regras de escalonamento ou trilha de auditoria, com o isolamento de credenciais descrito como por usuário, e não por bot. Esse é um padrão baixo, e é o mesmo padrão que a Aeon cumpriria ou não, de forma invisível, porque produtos de agentes não são avaliados por benchmarks como os modelos são. Não há um índice da Artificial Analysis para "o agente concluiu a tarefa sem fazer algo catastrófico".

A corrida de preços é a que os leitores vão sentir. O preço de US$ 120 do Grok Bot é um piso, não um teto — o uso além dos limites incluídos é cobrado pelo custo dos tokens. Se o Aeon chegar dentro de um nível de assinatura existente da OpenAI, a comparação deixa de ser sobre o preço de tabela e passa a ser sobre qual assento você já paga. Se ele chegar como um nível próprio, a OpenAI terá de justificar um novo item de cobrança diante de um produto que já está sendo entregue há seis semanas.

E há uma quarta restrição que os vazamentos nunca mencionam e que a reportagem deveria mencionar. A Astra atingiu o limiar Crítico de capacidade de cibersegurança da OpenAI, e a empresa alertou que o monitoramento pode atrasar, pausar ou interromper tarefas legítimas — incluindo explicitamente jobs de longa duração. Um agente persistente é, por definição, um job de longa duração. Seja o que for o Aeon, ele é lançado em uma postura de segurança que, segundo a OpenAI, pode interromper exatamente as cargas de trabalho com base nas quais o produto é vendido.

Os testes datados que resolveriam isso

Rumores sobre um produto a uma semana do lançamento valem pouco. Estas são as coisas específicas que transformariam o Aeon de uma string em um produto, e cada uma é verificável:

• Uma página pública da OpenAI ou nota de versão que use o nome Aeon, em vez de uma captura de tela de um arquivo de configuração. Este é o sinal mais claro e isolado, e ele ainda não apareceu.

• Uma entrada no próprio catálogo de modelos ou produtos da OpenAI, ou um identificador de modelo que seja resolvido através da API. Uma flag do Statsig não é isso.

• Qualquer preço publicado, nível de assento ou regra de acesso. As reportagens atualmente dizem que Plus e Business vêm primeiro, com o acesso à API por último; isso não foi atribuído à OpenAI.

• A keynote do DevDay em 29 de setembro. Esta é a superfície natural de revelação, e se nada aparecer lá, o enquadramento "antes do DevDay" colapsa por si só.

• Um sinal de capacidade. A OpenAI pausou novas assinaturas do Pro de $200 no início de setembro para proteger a capacidade da Astra sob demanda; um novo produto de agente sempre ativo consome inferência continuamente, em vez de por sessão, então os limites de disponibilidade são uma questão real que os rumores não abordam.

Como fazer hedge de um produto que ainda não existe

Não há nenhum endpoint do Aeon para chamar, então não há para onde mudar — e este é o ponto do ciclo em que a medida útil não é "adotar", mas sim "tornar a mudança barata para mais tarde".

Duas coisas que você pode fazer hoje que não custam nada e compensam de qualquer forma que isso se resolva. Primeiro, mantenha a camada de modelo atrás de um único endpoint em vez de espalhada por SDKs de cada fornecedor: o OrcaRouter coloca a linha OpenAI — GPT-6 Astra, GPT-5.6 Sol e o resto da linha GPT-5.6 — e mais de 200 modelos de outros fornecedores atrás de uma única chave de API pelo preço de lista do provedor, com 0% de markup, de modo que um novo modelo ou uma nova superfície de agente passa a ser uma mudança de configuração em vez de um projeto de integração. Segundo, se você vai testar um produto de agente na semana em que ele for lançado, teste-o em algum lugar onde uma falha seja sobrevivível: failover automático entre provedores significa que uma rota ainda não comprovada pode ficar ao lado de um modelo que você já caracterizou em vez de substituí-lo, e a DSL de roteamento permite compor vários modelos em uma única chamada, para que um loop de agente possa usar um modelo barato nas etapas entediantes e um modelo de ponta apenas onde ele vale o preço.

Nada disso exige que você acredite no rumor da Aeon. É o que você gostaria de ter em vigor na manhã em que ele se revelar verdadeiro.

A two-column scoreboard titled 'Aeon vs Grok Bot - the scoreboard'. Left column 'Aeon (reported)': Status reported nearing release, Evidence one Codex feature-flag string, Behaviour memory and scheduled actions per reports, Price unreported, Access unreported, Benchmarks none. Right column 'Grok Bot (shipped)': Status early beta since Aug 11, Evidence vendor product page, Behaviour cloud VM with browser and terminal, Price from $120 per seat per month, Access bundled with Cursor Premium Teams, Benchmarks none. The footer reads 'Aeon column unverified reporting; Grok Bot figures per SpaceXAI.'

A afirmação por baixo da afirmação

O mais interessante na história da Aeon é aquilo que ela está sendo usada para explicar. Até setembro, reportagens ligaram o nome ao trabalho interno de longo horizonte da OpenAI em matemática do Prêmio Millennium — milhares de agentes coordenadores, uma execução de verificação formal de 88 horas, progresso em um segundo problema. A OpenAI reconheceu o progresso. Não o atribuiu à Aeon, e o modelo descrito nessa reportagem é otimizado para raciocínio de longo horizonte temporal, o que é diferente de um agente para o consumidor que gerencia seu calendário e seu carrinho.

Dois nomes estão sendo soldados porque são adjacentes em um arquivo de configuração e adjacentes em um ciclo de notícias. Esse é o mesmo mecanismo que produziu as entradas GPT-6 Sol e Claude 5.5 no sinal de onde este texto veio: um nome de modelo plausível, um evento subjacente real e um número de versão fazendo mais trabalho do que qualquer evidência por trás dele. A postura correta não é o ceticismo quanto a se a OpenAI está construindo um agente — ela claramente está, e já vendeu o harness. É ceticismo quanto ao nome, à data e à lista de recursos, nenhum dos quais tem uma fonte primária.

O que nós lhe diríamos para fazer

Não faça planos em torno do Aeon esta semana. Não há produto a avaliar, nenhum preço a comparar e nenhuma documentação a ler, e o enquadramento "antes do DevDay, talvez esta semana" já escorregou uma vez — o próprio recuo de Altman tirou um lançamento da semana de 14 de setembro. Os fatos datados e decisivos são estes: "gpt-6-astra-aeon" existe como string numa feature flag do Codex Desktop desde 3 de setembro; o GPT-6 Astra é o carro-chefe da OpenAI em produção, a US$ 10,00/US$ 50,00 por milhão de tokens com contexto de 1M; a Agents API está em beta público desde 10 de setembro; o DevDay é em 29 de setembro.

Todo o resto é afirmação. Se você está avaliando agentes para trabalho real agora, os produtos que você pode de fato comprar são Grok Bot e Muse, e a leitura honesta de ambos é que nenhum dos dois publicou dados independentes de confiabilidade — teste em fluxos de trabalho de baixo risco e mantenha credenciais de produção fora deles até que alguém publique. Se você está esperando a resposta da OpenAI, o calendário oferece uma data para marcar e nenhum motivo para agir antes dela.

Quando a Aeon finalmente for lançada, a primeira pergunta não será se ela é melhor. Será se ela está disponível, a que preço, e se o monitoramento que acompanha a Astra permite concluir um trabalho que leva três dias. Esses são os números que valem a pena acompanhar, e nenhum deles está no vazamento.

A two-column card titled 'Aeon - verified vs claimed'. Left column 'Verified': Flag string gpt-6-astra-aeon, Sept 3; GPT-6 Astra generally available Sept 3; Agents API public beta Sept 10; DevDay September 29, San Francisco; Grok Bot beta since August 11; Muse launched September 8. Right column 'Claimed': Aeon the product name; Launch before DevDay, possibly this week; Behaviour memory and scheduled actions; Connectors commerce and app integrations; Access Plus and Business seats first; Benchmarks none published. The footer reads 'Left column per OpenAI and SpaceXAI announcements; right column single-source rumour.'