
OpenAI's Aeon Agent-lek: wat de vermeende rivaal van de Grok-bot werkelijk is, en wat nog niet is geverifieerd
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Iets genaamd Aeon zal naar verluidt binnenkort door de leverancier worden uitgebracht — een permanente, altijd actieve agent die zich positioneert tegen Grok Bot, het digitale-coworkerproduct dat SpaceXAI op 11 augustus uitbracht, en tegen Muse van Meta. De bewering circuleert in een vorm die het waard is om zorgvuldig te lezen: de "Grok Bot" ("Aeon") van de leverancier staat op het punt te verschijnen, mogelijk voor DevDay, mogelijk deze week. Er is geen productpagina, geen prijs, geen documentatie, geen benchmark en geen publieke verklaring waarin het woord wordt genoemd. Wat wel bestaat, is dunner en interessanter dan de samenvatting doet vermoeden: twee model-ID-strings die op 3 september zijn gespot in een feature flag van Codex Desktop — "gpt-6-astra" en "gpt-6-astra-aeon" — naast een bevestigde platformlancering, een bevestigde conferentiedatum van 29 september en een bevestigd vlaggenschipmodel, GPT-6 Astra, dat op 3 september uitkwam en de top van de productlijn van het bedrijf overnam van GPT-5.6 Sol. Aeon is het meest plausibele volgende item op de roadmap van de leverancier. Het is vandaag de dag ook een string in een configuratiebestand en een reeks rapporten die allemaal terug te voeren zijn op dezelfde paar posts.
Waar het lek eigenlijk uit bestaat
Het is de moeite waard om het artefact te scheiden van de berichtgeving, omdat de twee niet hetzelfde gewicht hebben.
Het artefact is concreet en van een datum voorzien. Op 3 september circuleerde een screenshot waarop twee ongedocumenteerde modelidentificaties te zien waren die aan een Statsig-featureflag in Codex Desktop waren toegevoegd: "gpt-6-astra" en "gpt-6-astra-aeon". De afbeelding kwam van het account @notjazii en werd versterkt door @kimmonismus — hetzelfde account waarvan de post het signaal achter dit artikel is — met de observatie dat de modellen "al" in Codex zaten en "elk moment" konden verschijnen. Diezelfde screenshot was wat OpenAI's bevestigde Astra-model voor het eerst aan de GPT-6-naam verbond. Dat is het geheel van het primaire bewijs, en het is authentiek: featureflags zijn hoe leveranciers configuraties klaarzetten vóór een lancering, dus de strings zijn echte deploymentvoorbereiding in plaats van verzinsel.
Wat ze niet doen, is vaststellen dat er iets beschikbaar is, of wat het is. Een klaargezette identifier kan ongebruikt blijven, worden hernoemd, of verwijzen naar een intern experiment dat nooit onder die naam wordt uitgebracht. Niets in de schermafbeelding beschrijft gedrag, geheugen, contextlimieten, prijs of wie toegang krijgt. Het achtervoegsel zelf is dubbelzinnig: het kan een langer draaiende agentconfiguratie zijn, een productlaag, een veiligheidsprofiel, of een vlag voor een interne evaluatiebuild. "gpt-6-astra-aeon" behandelen als een openbaar model dat Aeon heet, loopt vooruit op het bewijs, en dat is de eerlijke lezing van het artefact, ook al is het artefact echt.
De berichtgeving is waar de details vandaan komen, en die is steevast secundair. In rapporten wordt Aeon beschreven als een 24/7-agent die herinneringen over dagen heen vasthoudt, langetermijnprojecten op de achtergrond vooruithelpt, hervat bij gebeurtenistriggers en draait op de Astra-modelreeks. Gelekte interfacefragmenten zouden geheugen, geplande acties en connectors voor apps van derden tonen, met commerceflows — productonderzoek, het opbouwen van winkelwagentjes, follow-ups na aankoop — binnen één thread. Claims over tool calls van minder dan een seconde en native ondersteuning voor Indiase betaal- en logistiek-API's komen voor in één enkel rapport, zonder bevestiging en zonder bijgevoegde screenshot. Een aparte lijn in de berichtgeving verbindt de naam met OpenAI's interne wiskundewerk: rapporten tot en met september zeggen dat een intern model, waarvan wordt gespeculeerd dat het Aeon is, werd gebruikt in langlopende runs die vooruitgang opleverden bij Millennium Prize-problemen, waarbij één verslag ongeveer 10.000 coördinerende agents en een run van 88 uur op Navier–Stokes met Lean-formele verificatie beschrijft. OpenAI heeft vooruitgang op een tweede Millenniumprobleem bevestigd; het heeft niet bevestigd dat Aeon, of welk genoemd model dan ook, daarachter zat. Dat zijn twee verschillende feiten, en in de berichtgeving worden ze regelmatig samengevoegd.
Nog één onderdeel van de samenvatting verdient een correctie, want het komt steeds terug. Dezelfde signaaltekst noemt GPT-6 Sol als binnenkort te verwachten, met Claude Opus 5.5 en Claude Sonnet 5.5 als het antwoord van Anthropic. Sol is een gelekt naam met één artefact van een derde partij erachter — de string "GPT-6 Sol medium" in een NVIDIA-merge-record — en het is niet het vlaggenschip dat OpenAI uitlevert; GPT-6 Astra is dat wel, sinds 3 september, naast Astra Pro. De namen Claude 5.5 zijn niet-bevestigde strings die opduiken in kwalificatielijsten van voorspellingsmarkten. Als je een lanceerkalender leest die uit die gegevens is samengesteld, is het een kalender van geruchten, niet van daadwerkelijk uitgebrachte producten.
Wat OpenAI daadwerkelijk heeft uitgebracht, en wat dat over Aeon zegt
Het sterkste bewijs voor Aeon is helemaal niet het lek — het zijn de twee weken aan OpenAI-releases die aan weerszijden ervan liggen.
• 3 september — GPT-6 Astra werd algemeen beschikbaar, OpenAI's grensverleggende model, context van 1 miljoen tokens, geprijsd op $10,00 input en $50,00 output per miljoen tokens met 90% korting op cache. (Artificial Analysis dateert de release op 3 september; onze eigen catalogus vermeldt het model onder 2026-09-04.)
• 10 september — OpenAI heeft de Agents API in openbare bèta geopend, waarmee de beheerde Codex-harness wordt ontsloten: OpenAI verzorgt de sessieorkestratie, contextcompressie en herstel, terwijl ontwikkelaars de taak, het model, de tools en de uitvoeringsomgeving leveren, met sandboxes die worden gehost door OpenAI, zelfgehost of op infrastructuur van partners. Facturering gebeurt op basis van tokens, tools en containertijd, zonder aparte platformvergoeding.
• 10 september — GPT-Live-1 verscheen in de API voor $0,05 per spraakminuut.
• 15–16 september — Sam Altman postte dat OpenAI "deze week een grote release had, en dan voor devday zes keer zou uitbrengen", en kwam vervolgens terug op de eerste helft: het ding waar hij het meest naar uitkeek om die week te lanceren, zou in plaats daarvan de week erna verschijnen.
• 29 september — DevDay 2026 in het Fort Mason Center, San Francisco, sinds juni bevestigd, keynote live gestreamd.
Als je die samen leest, ziet Aeon er niet langer uit als een wild gerucht. OpenAI heeft net de agent-harness als product op de markt gebracht en die aan ontwikkelaars verkocht; de consumentgerichte versie van diezelfde capaciteit, als abonnement verkocht in concurrentie met Grok Bot en Muse, is de voor de hand liggende volgende zet, en Altmans 'volgende week in plaats daarvan' valt precies in het venster tussen 16 september en DevDay. Niets daarvan maakt de naam Aeon geverifieerd. Het betekent wel dat de vorm van het verhaal coherent is: een agentproduct, in de Astra-lijn, rond DevDay.

Als Aeon uitkomt, waarmee concurreert het dan eigenlijk?
Drie races, niet één — en ze hebben verschillende scoreborden.
De race om persistente agents is qua timing al verloren. Grok Bot ging op 11 augustus in vroege bèta met een instapprijs van $120 per seat, gebundeld in de Cursor Premium Teams-tier van SpaceXAI, met individuele tiers van $200 en $300 per maand. Elke bot krijgt zijn eigen cloud-VM met een browser, bestandssysteem en terminal, logt in bij apps zonder API, slaat gedemonstreerde workflows op als routines en blijft werken nadat je de laptop dichtklapt. Meta's Muse volgde op 8 september. OpenAI zou de derde zijn in een categorie waarvoor het het onderzoek heeft gedefinieerd.
De capaciteitenrace ligt echt open, want niemand heeft een cijfer gepubliceerd. SpaceXAI heeft geen onafhankelijke benchmarks of betrouwbaarheidsgegevens voor Grok Bot vrijgegeven; de modelrouter erachter is automatisch en gebruikers kunnen geen model vastpinnen; testers zijn publiekelijk niet onder de indruk geweest; en reviewers merken op dat er geen bedrijfscontrolelaag is — geen afgebakende rechten, escalatieregels of audittrail, waarbij credential-isolatie wordt beschreven als per gebruiker in plaats van per bot. Dat is een lage lat, en het is dezelfde lat die Aeon onzichtbaar zou halen of niet, omdat agentproducten niet op dezelfde manier worden gebenchmarkt als modellen. Er is geen Artificial Analysis-index voor "heeft de agent de taak afgerond zonder iets catastrofaals te doen."
De tarievenrace is degene die lezers zullen voelen. De $120 van Grok Bot is een ondergrens, geen bovengrens — gebruik boven de inbegrepen limieten wordt gefactureerd tegen tokenkosten. Als Aeon binnen een bestaand OpenAI-abonnementstarief komt, gaat de vergelijking niet meer over de lijstprijs maar over welke seat je al betaalt. Als het als een eigen tarief komt, moet OpenAI een nieuwe regelpost rechtvaardigen tegenover een product dat al zes weken wordt geleverd.
En er is een vierde beperking die de lekken nooit noemen en die de berichtgeving wel zou moeten noemen. Astra heeft de Critical-drempel voor cyberbeveiligingscapaciteit van OpenAI bereikt, en het bedrijf heeft gewaarschuwd dat monitoring legitieme taken kan vertragen, pauzeren of stoppen — met expliciete vermelding van langlopende jobs. Een persistente agent is per definitie een langlopende job. Wat Aeon ook is, het komt op de markt in een veiligheidshouding waarvan OpenAI heeft gezegd dat die precies de workloads kan onderbreken waarop het product wordt verkocht.
De gedateerde tests die dit zouden beslechten
Geruchten over een product een week voor de lancering zijn goedkoop. Dit zijn de specifieke dingen die van Aeon een echt product in plaats van een tekenreeks zouden maken, en elk ervan is controleerbaar:
• Een openbare OpenAI-pagina of release-opmerking die de naam Aeon gebruikt, in plaats van een screenshot van een configuratiebestand. Dit is het zuiverste signaal en het is niet verschenen.
• Een vermelding in OpenAI's eigen model- of productcatalogus, of een modelidentifier die via de API wordt herleid. Een Statsig-flag is dat niet.
• Elke gepubliceerde prijs, stoelcategorie of toegangsregel. De berichtgeving zegt momenteel dat Plus en Business eerst komen, met API-toegang achteraan; dat is niet aan OpenAI als bron toe te schrijven.
• De DevDay-keynote op 29 september. Dit is het natuurlijke moment voor de onthulling, en als daar niets verschijnt, valt de "vóór DevDay"-framing vanzelf in duigen.
• Een capaciteitssignaal. OpenAI heeft begin september nieuwe $200 Pro-abonnementen gepauzeerd om de capaciteit voor Astra onder de vraagdruk te beschermen; een nieuw always-on agentproduct verbruikt continu inferentie in plaats van per sessie, dus beschikbaarheidslimieten zijn een reële kwestie waar de geruchten niets over zeggen.
Hoe een product hedgen dat nog niet bestaat
Er is geen Aeon-endpoint om aan te roepen, dus er is niets om naar over te schakelen — en dit is het punt in de cyclus waarop de nuttige zet niet "adopteren" is, maar "de overstap voor later goedkoop maken".
Twee dingen die je vandaag kunt doen, die niets kosten en die zich uitbetalen hoe dit ook uitpakt. Ten eerste: houd de modellaag achter één endpoint in plaats van verspreid over SDK's per leverancier: OrcaRouter zet het OpenAI-assortiment — GPT-6 Astra, GPT-5.6 Sol en de rest van de GPT-5.6-lijn — en meer dan 200 modellen van andere leveranciers achter één enkele API-sleutel tegen de adviesprijs van de provider met 0% opslag, zodat een nieuw model of een nieuw agent-oppervlak een configuratiewijziging is in plaats van een integratieproject. Ten tweede: als je een agentproduct wilt uitproberen in de week dat het uitkomt, probeer het dan uit op een plek waar een fout te overleven is: automatische failover tussen providers betekent dat een onbewezen route naast een model kan staan dat je al hebt gekarakteriseerd in plaats van het te vervangen, en met de routing-DSL kun je meerdere modellen samenbrengen in één aanroep, zodat een agent-loop een goedkoop model kan gebruiken voor de saaie stappen en een frontiermodel alleen waar het de prijs waard is.
Niets daarvan vereist dat je het Aeon-gerucht gelooft. Het is wat je gereed wilt hebben op de ochtend dat het waar blijkt te zijn.

De claim onder de claim
Het meest interessante aan het Aeon-verhaal is waarvoor het als verklaring dient. Tot en met september koppelden rapporten de naam aan het interne langetermijnwerk van OpenAI aan Millenniumprijs-wiskunde — duizenden coördinerende agents, een formele-verificatierun van 88 uur, vooruitgang bij een tweede probleem. OpenAI heeft erkend dat er vooruitgang is geboekt. Het heeft die niet aan Aeon toegeschreven, en het model dat in die berichtgeving wordt beschreven is geoptimaliseerd voor redeneren met een lange tijdshorizon, wat iets anders is dan een consumentenagent die je agenda en je winkelmandje beheert.
Twee namen worden aan elkaar gelast omdat ze naast elkaar staan in een configuratiebestand en naast elkaar staan in een nieuwscyclus. Dat is hetzelfde mechanisme dat de vermeldingen GPT-6 Sol en Claude 5.5 produceerde in het signaal waar dit stuk vandaan komt: een plausibele modelnaam, een echte onderliggende gebeurtenis, en een versienummer dat meer werk verricht dan enig bewijs dat erachter zit. De juiste houding is niet scepsis over de vraag of OpenAI een agent bouwt — dat doet het duidelijk, en het heeft de harness al verkocht. Het is scepsis over de naam, de datum en de functielijst, die geen van alle een primaire bron hebben.
Wat wij je zouden zeggen te doen
Plan deze week niet rond Aeon. Er is geen product om te evalueren, geen prijs om te vergelijken en geen documentatie om te lezen, en het vooruitzicht "vóór DevDay, misschien deze week" is al één keer opgeschoven — Altmans eigen terugkrabbeling haalde een lancering weg uit de week van 14 september. De datumgebonden kernfeiten zijn deze: "gpt-6-astra-aeon" bestaat sinds 3 september als een string in een feature flag van Codex Desktop; GPT-6 Astra is OpenAI's vlaggenschip dat nu wordt uitgeleverd, tegen $10,00/$50,00 per miljoen tokens met 1M context; de Agents API is sinds 10 september in openbare bèta; DevDay is op 29 september.
Al het andere is een bewering. Als je nu agenten beoordeelt voor echt werk, zijn de producten die je daadwerkelijk kunt kopen Grok Bot en Muse, en de eerlijke lezing van beide is dat geen van beide onafhankelijke betrouwbaarheidsgegevens heeft gepubliceerd — test op workflows met lage inzet en houd productie-inloggegevens erbuiten totdat iemand dat wel doet. Als je wacht op het antwoord van OpenAI, geeft de kalender je één datum om te omcirkelen en geen enkele reden om vóór die datum actie te ondernemen.
Wanneer Aeon daadwerkelijk uitkomt, zal de eerste vraag niet zijn of het beter is. Die zal zijn of het beschikbaar is, tegen welke prijs, en of de monitoring die Astra meelevert, het een taak laat afronden die drie dagen duurt. Dat zijn de cijfers die het waard zijn om in de gaten te houden, en geen ervan staat in de gelekte informatie.

Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
