Titelkarte mit der Aufschrift „OpenAI Aeon Agent: ein Leak, gekennzeichnet“, mit der Statuszeile „Gemeldet als kurz vor der Veröffentlichung stehend – keine Produktseite, keine Preisangaben, keine Dokumentation“ und drei Karten: Das Artefakt – gpt-6-astra-aeon in einem Codex Desktop Feature-Flag, 3. Sept.; Der Kontext – GPT-6 Astra wurde am 3. Sept. veröffentlicht, DevDay ist am 29. Sept.; Die Lücke – Verhalten, Limits, Preis und Zugriff nicht gemeldet. Eine Fußzeile lautet: „Der Name Aeon ist nicht verifiziert.“
Guides & Insights

OpenAIs Aeon Agent Leak: Was der angebliche Rivale des Grok-Bots tatsächlich ist und was noch unbestätigt ist

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Etwas namens Aeon wird Berichten zufolge vom Anbieter demnächst veröffentlicht – ein persistenter, immer aktiver Agent, positioniert gegen Grok Bot, das Digital-Coworker-Produkt, das SpaceXAI am 11. August ausgeliefert hat, und gegen Metas Muse. Die Behauptung kursiert in einer Form, die es wert ist, sorgfältig gelesen zu werden: Das „Grok Bot“ („Aeon“) des Anbieters steht kurz vor der Veröffentlichung, möglicherweise vor dem DevDay, möglicherweise diese Woche. Es gibt keine Produktseite, keine Preisgestaltung, keine Dokumentation, keinen Benchmark und keine öffentliche Erklärung, die das Wort nennt. Was existiert, ist dünner und interessanter, als die Zusammenfassung vermuten lässt: zwei Modell-ID-Strings, die am 3. September in einem Codex Desktop-Feature-Flag entdeckt wurden – „gpt-6-astra“ und „gpt-6-astra-aeon“ – neben einem bestätigten Plattformstart, einem bestätigten Konferenzdatum am 29. September und einem bestätigten Flaggschiffmodell, GPT-6 Astra, das am 3. September ausgeliefert wurde und die Spitze der Produktlinie des Unternehmens von GPT-5.6 Sol übernahm. Aeon ist das plausibelste nächste Ding auf der Roadmap des Anbieters. Es ist außerdem, Stand heute, ein String in einer Konfigurationsdatei und eine Reihe von Berichten, die alle auf dieselben wenigen Posts zurückgehen.

Woraus das Leck tatsächlich besteht

Es lohnt sich, das Artefakt von der Berichterstattung zu trennen, denn die beiden haben nicht dasselbe Gewicht.

Das Artefakt ist konkret und datiert. Am 3. September machte ein Screenshot die Runde, der zwei undokumentierte Modellbezeichner zeigte, die einem Statsig-Feature-Flag in Codex Desktop hinzugefügt worden waren: „gpt-6-astra" und „gpt-6-astra-aeon". Das Bild stammte vom Account @notjazii und wurde von @kimmonismus weiterverbreitet — demselben Account, dessen Post das Signal hinter diesem Artikel ist —, verbunden mit der Beobachtung, dass die Modelle „bereits" in Codex seien und „jeden Moment" erscheinen könnten. Ebenderselbe Screenshot war es, der OpenAIs bestätigtes Astra-Modell erstmals mit dem Namen GPT-6 in Verbindung brachte. Das ist der gesamte Bestand an Primärbelegen, und er ist echt: Feature-Flags sind das Mittel, mit dem Anbieter Konfigurationen vor einem Launch vorbereiten, die Strings sind also echte Deployment-Vorbereitung und keine Erfindung.

Was sie nicht tun, ist zu belegen, dass irgendetwas verfügbar ist oder was es ist. Eine vorbereitete Kennung kann ungenutzt bleiben, umbenannt werden oder sich auf ein internes Experiment beziehen, das nie unter diesem Namen veröffentlicht wird. Nichts im Screenshot beschreibt Verhalten, Speicher, Kontextgrenzen, Preis oder wer Zugriff erhält. Das Suffix selbst ist mehrdeutig: Es könnte sich um eine länger laufende Agent-Konfiguration, eine Produktstufe, ein Sicherheitsprofil oder ein Flag für einen internen Evaluierungs-Build handeln. „gpt-6-astra-aeon“ als öffentliches Modell namens Aeon zu betrachten, greift den Belegen vor, und das ist die ehrliche Lesart des Artefakts, auch wenn das Artefakt echt ist.

Die Berichterstattung ist die Quelle der Details, und sie ist durchweg zweitrangig. Berichte beschreiben Aeon als einen 24/7-Agenten, der Erinnerungen über Tage hinweg behält, langfristige Projekte im Hintergrund vorantreibt, bei Ereignisauslösern wieder aufnimmt und auf der Astra-Modellreihe läuft. Durchgesickerte Interface-Fragmente sollen Gedächtnis, geplante Aktionen und Konnektoren für Drittanbieter-Apps zeigen, mit Commerce-Abläufen – Produktrecherche, Warenkorbaufbau, Follow-ups nach dem Kauf – innerhalb eines Threads. Behauptungen über Tool-Aufrufe im Subsekundenbereich und native Unterstützung für indische Zahlungs- und Logistik-APIs tauchen in einem einzigen Bericht auf, ohne Bestätigung und ohne beigefügten Screenshot. Ein separater Strang der Berichterstattung verbindet den Namen mit OpenAIs interner Mathematikarbeit: Berichte bis September besagen, dass ein internes Modell, vermutlich Aeon, in Long-Horizon-Läufen eingesetzt wurde, die Fortschritte bei Millennium-Preis-Problemen erzielten, wobei ein Bericht etwa 10.000 koordinierende Agenten und einen 88-stündigen Lauf zu Navier–Stokes mit Lean-Formalverifikation beschreibt. OpenAI hat Fortschritte bei einem zweiten Millennium-Problem bestätigt; es hat nicht bestätigt, dass Aeon oder irgendein namentlich genanntes Modell dahinterstand. Das sind zwei verschiedene Fakten, und die Berichterstattung vermischt sie regelmäßig.

Ein weiterer Punkt der Zusammenfassung verdient eine Korrektur, weil er immer wieder auftaucht. Derselbe Signaltext erwähnt GPT-6 Sol als unmittelbar bevorstehend, mit Claude Opus 5.5 und Claude Sonnet 5.5 als Antwort von Anthropic. Sol ist ein geleakter Name, hinter dem genau ein Drittanbieter-Artefakt steht – die Zeichenfolge „GPT-6 Sol medium" in einem NVIDIA-Merge-Eintrag –, und er ist nicht OpenAIs ausgeliefertes Flaggschiff; das ist seit dem 3. September GPT-6 Astra, zusammen mit Astra Pro. Die Claude-5.5-Namen sind unbestätigte Zeichenfolgen, die in Qualifikationslisten von Prognomärkten auftauchen. Wenn Sie einen Startkalender lesen, der aus diesen zusammengestellt wurde, dann ist das ein Kalender von Gerüchten, nicht von Auslieferungen.

Was OpenAI tatsächlich veröffentlicht hat und was das über Aeon aussagt

Der stärkste Beweis für Aeon ist keineswegs der Leak – es sind die zwei Wochen an OpenAI-Veröffentlichungen zu beiden Seiten davon.

• 3. September — GPT-6 Astra erreichte die allgemeine Verfügbarkeit: OpenAIs Frontier-Modell mit 1-Million-Token-Kontext, angegeben mit 10,00 $ für Eingabe und 50,00 $ für Ausgabe pro Million Token, mit 90 % Cache-Rabatt. (Artificial Analysis datiert die Veröffentlichung auf den 3. September; unser eigener Katalog führt das Modell unter 2026-09-04.)

• 10. September — OpenAI hat die Agents API in der öffentlichen Beta geöffnet und damit das verwaltete Codex-Harness zugänglich gemacht: OpenAI übernimmt die Sitzungsorchestrierung, die Kontextkomprimierung und die Wiederherstellung, während Entwickler die Aufgabe, das Modell, die Tools und die Ausführungsumgebung bereitstellen, wobei Sandboxes von OpenAI gehostet, selbst gehostet oder auf Partnerinfrastruktur betrieben werden. Die Abrechnung erfolgt nach Tokens, Tools und Containerzeit, ohne separate Plattformgebühr.

• 10. September — GPT-Live-1 ist in der API für 0,05 $ pro Sprachminute angekommen.

• 15.–16. September — Sam Altman postete, OpenAI habe diese Woche ein „großes Ship, und dann zum devday Ship x 6“; anschließend ruderte er bei der ersten Hälfte zurück: Das, worauf er sich in dieser Woche beim Launch am meisten freute, würde stattdessen erst in der darauffolgenden Woche erscheinen.

• 29. September — DevDay 2026 im Fort Mason Center, San Francisco, seit Juni bestätigt, Keynote im Livestream.

Liest man das zusammen, wirkt Aeon nicht mehr wie ein wildes Gerücht. OpenAI hat gerade das Agenten-Harness produktisiert und es an Entwickler verkauft; die verbraucherorientierte Version derselben Fähigkeit, als Abonnement gegen Grok Bot und Muse verkauft, ist der offensichtliche nächste Schritt, und Altmans „stattdessen nächste Woche“ fällt genau in das Fenster zwischen dem 16. September und dem DevDay. Nichts davon macht den Namen Aeon verifiziert. Es bedeutet aber, dass die Form der Geschichte stimmig ist: ein Agentenprodukt, auf der Astra-Linie, rund um den DevDay.

Screenshot of OrcaRouter's model page for GPT-6 Astra (openai/gpt-6-astra), dated 2026-09-04, showing a 1M token context window, 128K max output, input $10.00 and output $50.00 per million tokens, p50 time to first token 7.38 seconds, and 353.5M tokens of traffic in seven days, with a code sample pointing at api.orcarouter.ai/v1

Wenn Aeon erscheint, womit konkurriert es dann eigentlich?

Drei Rennen, nicht eines — und sie haben unterschiedliche Anzeigetafeln.

Das Rennen um persistente Agenten ist bereits auf Zeit verloren. Grok Bot ging am 11. August in die frühe Beta – zu einem Einstiegspreis von 120 Dollar pro Nutzer, gebündelt in SpaceXAIs Tarif Cursor Premium Teams, mit Einzeltarifen für 200 und 300 Dollar im Monat. Jeder Bot bekommt seine eigene Cloud-VM mit Browser, Dateisystem und Terminal, meldet sich in Apps an, die keine API haben, speichert demonstrierte Workflows als Routinen und arbeitet weiter, nachdem man den Laptop zugeklappt hat. Metas Muse folgte am 8. September. OpenAI wäre der Dritte in einer Kategorie, deren Forschung es definiert hat.

Das Wettrennen um Fähigkeiten ist wirklich offen, denn niemand hat eine Zahl veröffentlicht.SpaceXAI hat keine unabhängigen Benchmarks oder Zuverlässigkeitsdaten für Grok Bot veröffentlicht; der dahinterstehende Model-Router ist automatisch, und Nutzer können kein Modell festlegen; Tester zeigten sich öffentlich wenig beeindruckt; und Rezensenten merken an, dass es keine Enterprise-Kontrollschicht gibt – keine abgegrenzten Berechtigungen, Eskalationsregeln oder Audit-Trails, wobei die Isolierung von Anmeldedaten als pro Nutzer statt pro Bot beschrieben wird. Das ist eine niedrige Hürde, und es ist dieselbe Hürde, an der Aeon bestehen oder scheitern würde – unsichtbar, weil Agentenprodukte nicht so gebenchmarkt werden wie Modelle. Es gibt keinen Artificial Analysis-Index für die Frage: „Hat der Agent die Aufgabe erledigt, ohne etwas Katastrophales zu tun?“

Das Preisrennen ist das, was die Leser zu spüren bekommen werden. Die 120 US-Dollar für Grok Bot sind eine Untergrenze, keine Obergrenze – die Nutzung über die enthaltenen Limits hinaus wird zu Tokenkosten abgerechnet. Wenn Aeon innerhalb einer bestehenden OpenAI-Abo-Stufe erscheint, geht es beim Vergleich nicht mehr um den Listenpreis, sondern darum, welchen Seat Sie bereits bezahlen. Wenn es als eigene Stufe erscheint, muss OpenAI einen neuen Rechnungsposten gegenüber einem Produkt rechtfertigen, das seit sechs Wochen verfügbar ist.

Und es gibt eine vierte Einschränkung, die die Leaks nie erwähnen und die die Berichterstattung erwähnen sollte. Astra hat OpenAIs kritische Cybersicherheits-Fähigkeitsschwelle erreicht, und das Unternehmen hat gewarnt, dass Überwachung legitime Aufgaben verlangsamen, pausieren oder stoppen kann – ausdrücklich einschließlich lang laufender Jobs. Ein persistenter Agent ist per Definition ein lang laufender Job. Was auch immer Aeon ist, es kommt in eine Sicherheitslage, von der OpenAI gesagt hat, dass sie genau die Workloads unterbrechen kann, für die das Produkt verkauft wird.

Die datierten Tests, die dies klären würden

Gerüchte über ein Produkt eine Woche vor dem Start sind billig. Das hier sind die konkreten Dinge, die Aeon von einem String zu einem Produkt machen würden, und jedes davon ist überprüfbar:

• Eine öffentliche OpenAI-Seite oder Release-Notiz, die den Namen Aeon verwendet, statt eines Screenshots einer Konfigurationsdatei. Dies ist das eindeutigste Signal, und es ist nicht erschienen.

• Ein Eintrag in OpenAIs eigenem Modell- oder Produktkatalog oder eine Modellkennung, die sich über die API auflösen lässt. Ein Statsig-Flag ist das nicht.

• Jeder veröffentlichte Preis, jede Seat-Stufe oder Zugriffsregel. Die Berichterstattung besagt derzeit, dass Plus und Business zuerst kommen und API-Zugriff nachgelagert ist; OpenAI wurde dafür nicht als Quelle genannt.

• Die DevDay-Keynote am 29. September. Das ist die natürliche Enthüllungsbühne, und wenn dort nichts erscheint, bricht die „Vor-DevDay“-Rahmung von selbst zusammen.

• Ein Kapazitätssignal. OpenAI setzte Anfang September neue 200-$-Pro-Abonnements aus, um die Astra-Kapazität unter der Nachfrage zu schützen; ein neues, permanent aktives Agentenprodukt verbraucht Inferenz kontinuierlich statt pro Sitzung, sodass Verfügbarkeitsgrenzen eine echte Frage sind, die die Gerüchte nicht berühren.

Wie man ein Produkt absichert, das noch nicht existiert

Es gibt keinen Aeon-Endpunkt, den man aufrufen könnte, also gibt es nichts, wohin man wechseln könnte – und das ist der Punkt im Zyklus, an dem der sinnvolle Schritt nicht „übernehmen“, sondern „den Wechsel für später günstig machen“ ist.

Zwei Dinge, die Sie heute tun können, die nichts kosten und sich auszahlen, egal wie sich das entwickelt. Erstens: Behalten Sie die Modellschicht hinter einem einzigen Endpunkt, statt sie über anbieterspezifische SDKs zu verstreuen: OrcaRouter stellt das OpenAI-Line-up — GPT-6 Astra, GPT-5.6 Sol und den Rest der GPT-5.6-Reihe — und über 200 Modelle anderer Anbieter hinter einem einzigen API-Schlüssel zum Listenpreis des Anbieters mit 0 % Aufschlag, sodass ein neues Modell oder eine neue Agent-Oberfläche eine Konfigurationsänderung ist statt eines Integrationsprojekts. Zweitens: Wenn Sie ein Agent-Produkt in der Woche seines Starts testen wollen, testen Sie es dort, wo ein Fehlschlag verkraftbar ist: automatisches Failover über Anbieter hinweg bedeutet, dass eine unerprobte Route neben einem Modell stehen kann, das Sie bereits charakterisiert haben, statt es zu ersetzen, und die Routing-DSL lässt Sie mehrere Modelle zu einem Aufruf zusammenstellen, sodass eine Agent-Schleife für die langweiligen Schritte ein günstiges Modell nutzen kann und ein Frontier-Modell nur dort, wo es den Preis wert ist.

Nichts davon verlangt von dir, dass du das Aeon-Gerücht glaubst. Es ist das, was du am Morgen, an dem es sich als wahr erweist, eingerichtet haben möchtest.

A two-column scoreboard titled 'Aeon vs Grok Bot - the scoreboard'. Left column 'Aeon (reported)': Status reported nearing release, Evidence one Codex feature-flag string, Behaviour memory and scheduled actions per reports, Price unreported, Access unreported, Benchmarks none. Right column 'Grok Bot (shipped)': Status early beta since Aug 11, Evidence vendor product page, Behaviour cloud VM with browser and terminal, Price from $120 per seat per month, Access bundled with Cursor Premium Teams, Benchmarks none. The footer reads 'Aeon column unverified reporting; Grok Bot figures per SpaceXAI.'

Die Behauptung unter der Behauptung

Das Interessanteste an der Aeon-Geschichte ist, wofür sie als Erklärung herhalten muss. Den ganzen September über verknüpften Berichte den Namen mit OpenAIs interner Arbeit an Mathematik zu den Millennium-Preisen über lange Zeithorizonte – Tausende koordinierter Agenten, ein 88-stündiger Lauf zur formalen Verifikation, Fortschritte bei einem zweiten Problem. OpenAI hat Fortschritte eingeräumt. Zugeschrieben hat das Unternehmen sie Aeon jedoch nicht, und das in diesen Berichten beschriebene Modell ist auf Schlussfolgern über lange Zeithorizonte optimiert – was etwas anderes ist als ein Consumer-Agent, der deinen Kalender und deinen Warenkorb verwaltet.

Zwei Namen werden miteinander verschweißt, weil sie in einer Konfigurationsdatei nebeneinanderstehen und in einem Nachrichtenzyklus nebeneinanderstehen. Das ist derselbe Mechanismus, der die Einträge GPT-6 Sol und Claude 5.5 in dem Signal hervorgebracht hat, aus dem dieser Beitrag stammt: ein plausibler Modellname, ein reales zugrunde liegendes Ereignis und eine Versionsnummer, die mehr Arbeit leistet als jede dahinterstehende Evidenz. Die richtige Haltung ist nicht Skepsis darüber, ob OpenAI einen Agenten baut – das tut es eindeutig, und es hat das Harness bereits verkauft. Sie ist Skepsis gegenüber dem Namen, dem Datum und der Funktionsliste, von denen keines eine Primärquelle hat.

Was wir Ihnen sagen würden, was Sie tun sollen

Richten Sie Ihre Planung diese Woche nicht an Aeon aus. Es gibt kein Produkt zu bewerten, keinen Preis zu vergleichen und keine Dokumentation zu lesen, und die Erwartung „vor dem DevDay, vielleicht diese Woche“ hat sich bereits einmal zerschlagen – Altmans eigener Rückzieher hat einen Launch aus der Woche des 14. September heraus verschoben. Die datierten, tragenden Fakten sind folgende: „gpt-6-astra-aeon“ existiert mit Stand vom 3. September als Zeichenkette in einem Codex-Desktop-Feature-Flag; GPT-6 Astra ist OpenAIs aktuell ausgeliefertes Flaggschiff zu 10,00 $/50,00 $ pro Million Token mit 1-Mio.-Token-Kontext; die Agents API ist seit dem 10. September in der öffentlichen Beta; DevDay ist am 29. September.

Alles andere ist eine Behauptung. Wenn Sie jetzt Agenten für echte Arbeit bewerten, sind die Produkte, die Sie tatsächlich kaufen können, Grok Bot und Muse, und die ehrliche Einschätzung zu beiden ist, dass keines von beiden unabhängige Zuverlässigkeitsdaten veröffentlicht hat — testen Sie sie in risikoarmen Workflows und halten Sie Produktionszugangsdaten von ihnen fern, bis jemand dies tut. Wenn Sie auf die Antwort von OpenAI warten, gibt Ihnen der Kalender ein Datum zum Einkreisen und keinen Grund, vorher zu handeln.

Wenn Aeon tatsächlich erscheint, wird die erste Frage nicht lauten, ob es besser ist. Sondern ob es verfügbar ist, zu welchem Preis, und ob das Monitoring, das Astra mitliefert, es ermöglicht, einen Job abzuschließen, der drei Tage dauert. Das sind die Zahlen, die man im Auge behalten sollte, und keine davon steht in dem Leak.

A two-column card titled 'Aeon - verified vs claimed'. Left column 'Verified': Flag string gpt-6-astra-aeon, Sept 3; GPT-6 Astra generally available Sept 3; Agents API public beta Sept 10; DevDay September 29, San Francisco; Grok Bot beta since August 11; Muse launched September 8. Right column 'Claimed': Aeon the product name; Launch before DevDay, possibly this week; Behaviour memory and scheduled actions; Connectors commerce and app integrations; Access Plus and Business seats first; Benchmarks none published. The footer reads 'Left column per OpenAI and SpaceXAI announcements; right column single-source rumour.'

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert