
Il leak dell'Aeon Agent di OpenAI: cos'è davvero il presunto rivale del bot Grok e cosa non è ancora verificato
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qualcosa chiamato Aeon sarebbe in procinto di essere rilasciato dal fornitore — un agente persistente e sempre attivo, contrapposto a Grok Bot, il prodotto di coworking digitale che SpaceXAI ha lanciato l'11 agosto, e a Muse di Meta. La notizia circola in una forma che vale la pena leggere con attenzione: il "Grok Bot" ("Aeon") del fornitore sarebbe prossimo al rilascio, forse prima del DevDay, forse questa settimana. Non esiste una pagina di prodotto, né un prezzo, né documentazione, né benchmark, né una dichiarazione pubblica che nomini quella parola. Ciò che esiste è più esile e più interessante di quanto suggerisca il riassunto: due stringhe di ID modello individuate il 3 settembre all'interno di un feature flag di Codex Desktop — "gpt-6-astra" e "gpt-6-astra-aeon" — che stanno accanto a un lancio di piattaforma confermato, a una data di conferenza confermata, il 29 settembre, e a un modello di punta confermato, GPT-6 Astra, lanciato il 3 settembre e che ha preso il vertice della linea aziendale da GPT-5.6 Sol. Aeon è la prossima cosa più plausibile nella roadmap del fornitore. Ed è anche, a oggi, una stringa in un file di configurazione e una serie di resoconti che risalgono tutti agli stessi pochi post.
In che cosa consiste effettivamente la fuga
Vale la pena tenere separati l'artefatto e la reportistica, perché i due non hanno lo stesso peso.
Il reperto è concreto e datato. Il 3 settembre è circolato uno screenshot che mostrava due identificativi di modello non documentati aggiunti a un feature flag di Statsig all'interno di Codex Desktop: "gpt-6-astra" e "gpt-6-astra-aeon". L'immagine proveniva dall'account @notjazii ed è stata amplificata da @kimmonismus — lo stesso account il cui post è il segnale alla base di questo articolo — con l'osservazione che i modelli erano "già" in Codex e potevano apparire "da un momento all'altro". Lo stesso screenshot è ciò che per primo ha collegato il modello Astra confermato da OpenAI al nome GPT-6. Questa è l'intera prova primaria, ed è autentica: i feature flag sono il modo in cui i fornitori predispongono le configurazioni prima di un lancio, quindi le stringhe sono una reale preparazione al deployment, non un'invenzione.
Ciò che non fanno è stabilire che qualcosa sia disponibile, o cosa sia. Un identificatore in staging può restare inutilizzato, essere rinominato o riferirsi a un esperimento interno che non viene mai rilasciato con quel nome. Nulla nello screenshot descrive il comportamento, la memoria, i limiti di contesto, il prezzo o chi ottiene l'accesso. Il suffisso stesso è ambiguo: potrebbe essere una configurazione di agente a più lunga esecuzione, un livello di prodotto, un profilo di sicurezza o un flag per una build di valutazione interna. Trattare "gpt-6-astra-aeon" come un modello pubblico chiamato Aeon va oltre le prove, e questa è la lettura onesta dell'artefatto anche se l'artefatto è reale.
Il reporting è ciò da cui provengono i dettagli, ed è uniformemente secondario. I report descrivono Aeon come un agente 24/7 che conserva la memoria per giorni, porta avanti progetti a lungo termine in background, riprende su trigger di eventi e funziona sulla linea di modelli Astra. Si dice che frammenti trapelati dell'interfaccia mostrino memoria, azioni programmate e connettori per app di terze parti, con flussi commerciali — ricerca di prodotti, creazione del carrello, follow-up post-acquisto — all'interno di un unico thread. Le affermazioni su chiamate agli strumenti in meno di un secondo e sul supporto nativo per le API di pagamento e logistica indiane compaiono in un unico report, senza alcuna corroborazione e senza screenshot allegato. Un filone separato di reporting collega il nome al lavoro matematico interno di OpenAI: report fino a settembre affermano che un modello interno, ipotizzato essere Aeon, è stato usato in esecuzioni a lungo termine che hanno prodotto progressi su problemi del Premio Millennium, con un resoconto che descrive circa 10.000 agenti coordinatori e un'esecuzione di 88 ore su Navier–Stokes con verifica formale in Lean. OpenAI ha confermato progressi su un secondo problema del Premio Millennium; non ha confermato che Aeon, o qualsiasi modello citato per nome, ne fosse all'origine. Sono due fatti diversi, e il reporting li fonde regolarmente.
Un altro punto del riepilogo merita una correzione, perché ricorre. Lo stesso testo segnale menziona GPT-6 Sol come atteso da un momento all'altro, con Claude Opus 5.5 e Claude Sonnet 5.5 come risposta di Anthropic. Sol è un nome trapelato con un solo artefatto di terze parti a sostegno — la stringa "GPT-6 Sol medium" in un record di merge di NVIDIA — e non è il flagship in distribuzione di OpenAI; lo è GPT-6 Astra, dal 3 settembre, insieme ad Astra Pro. I nomi Claude 5.5 sono stringhe non confermate che compaiono negli elenchi di qualificazione dei mercati di previsione. Se state leggendo un calendario di lanci messo insieme da quelli, è un calendario di voci, non di lanci reali.
Cosa ha effettivamente rilasciato OpenAI, e cosa questo dice su Aeon
La prova più forte a favore di Aeon non è affatto la fuga di notizie — sono le due settimane di rilasci di OpenAI che si trovano ai suoi due lati.
• 3 settembre — GPT-6 Astra ha raggiunto la disponibilità generale, il modello di frontiera di OpenAI, contesto da 1 milione di token, listato a 10,00 $ di input e 50,00 $ di output per milione di token con uno sconto cache del 90%. (Artificial Analysis data il rilascio al 3 settembre; il nostro catalogo elenca il modello sotto 2026-09-04.)
• 10 settembre — OpenAI ha aperto l'Agents API in beta pubblica, rendendo disponibile l'harness Codex gestito: OpenAI esegue l'orchestrazione della sessione, la compattazione e il recupero del contesto, mentre gli sviluppatori forniscono il compito, il modello, gli strumenti e l'ambiente di esecuzione, con sandbox ospitate da OpenAI, self-hosted o su infrastruttura di partner. La fatturazione si basa su token, strumenti e tempo di container, senza una commissione di piattaforma separata.
• 10 settembre — GPT-Live-1 è arrivato nell'API a 0,05 $ per minuto vocale.
• 15–16 settembre — Sam Altman ha scritto che OpenAI aveva una "grande uscita questa settimana, e poi sei uscite per il DevDay", per poi fare marcia indietro sulla prima metà: la cosa che non vedeva l'ora di lanciare quella settimana sarebbe invece arrivata la settimana successiva.
• 29 settembre — DevDay 2026 al Fort Mason Center, San Francisco, confermato da giugno, keynote trasmesso in diretta streaming.
Mettendo insieme questi elementi, Aeon smette di sembrare una diceria senza fondamento. OpenAI ha appena trasformato in prodotto l'agent harness e l'ha venduto agli sviluppatori; la versione per il consumatore di quella stessa capacità, venduta in abbonamento in competizione con Grok Bot e Muse, è la prossima mossa ovvia, e il "next week instead" di Altman cade proprio nella finestra tra il 16 settembre e il DevDay. Niente di tutto ciò rende verificato il nome Aeon. Significa però che la forma della storia è coerente: un prodotto agente, sulla linea Astra, intorno al DevDay.

Se Aeon vedrà la luce, con cosa si troverà davvero a competere?
Tre gare, non una — e hanno classifiche diverse.
La corsa agli agenti persistenti è già persa sui tempi. Grok Bot è entrato in beta anticipata l'11 agosto con un prezzo d'ingresso di 120 $ per utente, inserito nel livello Cursor Premium Teams di SpaceXAI, con livelli individuali a 200 e 300 $ al mese. Ogni bot riceve una propria VM cloud con browser, filesystem e terminale, accede ad app prive di API, salva i flussi di lavoro dimostrati come routine e continua a lavorare dopo che hai chiuso il portatile. Il Muse di Meta è seguito l'8 settembre. OpenAI sarebbe terzo in una categoria di cui ha definito la ricerca.
La corsa alle capacità è davvero aperta, perché nessuno ha pubblicato un numero.SpaceXAI non ha pubblicato benchmark indipendenti né dati di affidabilità per Grok Bot; il router dei modelli che ne sta alla base è automatico e gli utenti non possono fissare un modello; i tester non sono rimasti pubblicamente impressionati; e i recensori notano che non esiste un livello di controllo aziendale — nessun permesso con ambito definito, regole di escalation o traccia di audit, con l'isolamento delle credenziali descritto come per utente anziché per bot. Questa è un'asticella bassa, ed è la stessa asticella che Aeon supererebbe o non supererebbe, in modo invisibile, perché i prodotti agente non vengono valutati con benchmark come i modelli. Non esiste un indice Artificial Analysis per "l'agente ha completato l'attività senza fare qualcosa di catastrofico".
La corsa ai prezzi è quella che i lettori percepiranno. I 120 $ di Grok Bot sono un minimo, non un tetto massimo: l'uso oltre i limiti inclusi viene fatturato al costo per token. Se Aeon arriva all'interno di un livello di abbonamento OpenAI esistente, il confronto smette di riguardare il prezzo di listino e diventa una questione di quale postazione già paghi. Se arriva come livello a sé stante, OpenAI deve giustificare una nuova voce di spesa rispetto a un prodotto che è sul mercato da sei settimane.
E c'è un quarto vincolo che le fughe di notizie non menzionano mai e che il resoconto giornalistico dovrebbe menzionare. Astra ha raggiunto la soglia critica di capacità di cybersecurity di OpenAI, e l'azienda ha avvertito che il monitoraggio potrebbe rallentare, mettere in pausa o interrompere attività legittime — includendo esplicitamente i job di lunga durata. Un agente persistente è, per definizione, un job di lunga durata. Qualunque cosa sia Aeon, viene rilasciato in una postura di sicurezza che, come dichiarato da OpenAI, può interrompere esattamente i carichi di lavoro su cui il prodotto viene venduto.
I test datati che risolverebbero la questione
Le voci su un prodotto a una settimana dal lancio valgono poco. Queste sono le cose specifiche che trasformerebbero Aeon da una stringa in un prodotto, e ciascuna è verificabile:
• Una pagina pubblica di OpenAI o una nota di rilascio che usi il nome Aeon, anziché uno screenshot di un file di configurazione. Questo è il singolo segnale più pulito e non è apparso.
• Una voce nel catalogo di modelli o prodotti di OpenAI stessa, oppure un identificatore di modello che si risolve tramite l'API. Un flag Statsig non lo è.
• Qualsiasi prezzo pubblicato, fascia di posti o regola di accesso. Attualmente le informazioni riportate indicano prima Plus e Business, con l'accesso API in coda; ciò non è stato attribuito a OpenAI.
• Il keynote del DevDay del 29 settembre. Questa è la superficie di rivelazione naturale, e se non emerge nulla lì, l'inquadratura "prima del DevDay" crolla da sola.
• Un segnale di capacità. OpenAI ha sospeso i nuovi abbonamenti Pro da 200 $ all'inizio di settembre per proteggere la capacità di Astra a fronte della domanda; un nuovo prodotto agente always-on consuma inferenza in modo continuo anziché per sessione, quindi i limiti di disponibilità sono una vera questione che le voci non affrontano.
Come coprire un prodotto che non esiste ancora
Non esiste un endpoint Aeon da chiamare, quindi non c'è nulla verso cui passare — e questo è il punto del ciclo in cui la mossa utile non è "adottare" ma "rendere economico il passaggio per dopo".
Due cose che puoi fare oggi che non costano nulla e danno un ritorno qualunque sia l'esito. Primo, tieni il livello del modello dietro un unico endpoint invece di sparpagliarlo tra SDK specifici per fornitore: OrcaRouter mette la gamma OpenAI — GPT-6 Astra, GPT-5.6 Sol e il resto della linea GPT-5.6 — e oltre 200 modelli di altri fornitori dietro un'unica chiave API al prezzo di listino del provider con 0% di ricarico, così un nuovo modello o una nuova superficie agent è una modifica di configurazione anziché un progetto di integrazione. Secondo, se hai intenzione di provare un prodotto agent nella settimana del suo lancio, provalo in un contesto in cui un fallimento è sopravvivibile: il failover automatico tra provider significa che una rotta non ancora collaudata può affiancarsi a un modello che hai già caratterizzato invece di sostituirlo, e il DSL di routing ti permette di comporre più modelli in un'unica chiamata, così un loop di agent può usare un modello economico per i passaggi noiosi e un modello di frontiera solo dove vale il prezzo.
Niente di tutto ciò richiede che tu creda alla voce su Aeon. È quello che vorresti avere già pronto la mattina in cui si rivelerà vera.

L'affermazione sotto l'affermazione
La cosa più interessante della storia di Aeon è ciò che essa viene usata per spiegare. Fino a settembre, i report hanno collegato il nome al lavoro interno di OpenAI a lungo orizzonte sulla matematica dei Millennium Prize — migliaia di agenti coordinati, un'esecuzione di verifica formale di 88 ore, progressi su un secondo problema. OpenAI ha riconosciuto i progressi. Non li ha attribuiti ad Aeon, e il modello descritto in quei report è ottimizzato per il ragionamento su lunghi orizzonti temporali, che è una cosa diversa da un agente per consumatori che gestisce il tuo calendario e il tuo carrello.
Due nomi vengono saldati insieme perché sono adiacenti in un file di configurazione e adiacenti in un ciclo di notizie. È lo stesso meccanismo che ha prodotto le voci GPT-6 Sol e Claude 5.5 nel segnale da cui proviene questo pezzo: un nome di modello plausibile, un evento reale sottostante e un numero di versione che fa più lavoro di qualsiasi prova a supporto. La postura corretta non è lo scetticismo sul fatto che OpenAI stia costruendo un agente — lo sta chiaramente facendo, e ha già venduto l'harness. È scetticismo sul nome, sulla data e sull'elenco delle funzionalità, nessuno dei quali ha una fonte primaria.
Quello che ti diremmo di fare
Non fare piani basati su Aeon questa settimana. Non c'è alcun prodotto da valutare, nessun prezzo da confrontare e nessuna documentazione da leggere, e la formulazione "prima del DevDay, forse questa settimana" ha già slittato una volta — il dietrofront di Altman ha spostato un lancio fuori dalla settimana del 14 settembre. I fatti datati e decisivi sono questi: "gpt-6-astra-aeon" esiste come stringa in un feature flag di Codex Desktop a partire dal 3 settembre; GPT-6 Astra è il modello di punta di OpenAI in distribuzione a $10,00/$50,00 per milione di token con contesto da 1M; l'API Agents è in beta pubblica dal 10 settembre; il DevDay è il 29 settembre.
Tutto il resto è un'asserzione. Se stai valutando agenti per lavoro reale adesso, i prodotti che puoi effettivamente acquistare sono Grok Bot e Muse, e la lettura onesta di entrambi è che nessuno dei due ha pubblicato dati indipendenti sull'affidabilità — fai test su flussi di lavoro a basso rischio e tieni le credenziali di produzione fuori da essi finché qualcuno non lo fa. Se stai aspettando la risposta di OpenAI, il calendario ti dà una sola data da cerchiare e nessun motivo per agire prima di allora.
Quando Aeon verrà rilasciato, la prima domanda non sarà se sia migliore. Sarà se è disponibile, a quale prezzo e se il monitoraggio incluso in Astra consente ad Aeon di completare un lavoro che richiede tre giorni. Sono questi i numeri da tenere d'occhio, e nessuno di essi compare nella fuga di notizie.

