
OpenAIs „o“-Agent: Was das DevDay-2026-Leak tatsächlich aussagt – und was nicht
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 610 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 189 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
Der gemeldete Name ist der am wenigsten interessante Teil. Was das Leck über den Always-on-Agent des Unternehmens aussagt, ist, dass er "o" heißen wird, dass er in jedem ChatGPT Pro-Tier enthalten sein wird, und dass ein Fast Mode — auf Cerebras-Silizium laufend — daran angebracht ist. Das Detail, bei dem es sich lohnt zu verweilen, ist kleiner und seltsamer als das: Die Referenz wurde angeblich auf der Upgrade-Seite für den $100 Pro-Plan, nicht den $200-Plan, im selben Monat, in dem das Unternehmen den $200-Plan überhaupt nicht mehr verkaufte. Es gibt keine Produktseite, keinen Preis, keine Modellbezeichnung und keine Stellungnahme des Unternehmens, die den Buchstaben als Produktnamen verwendet. Der Beitrag hinter diesem Artikel ist die Zusammenfassung eines Accounts von dem, was er angeblich gesehen hat, und die Konferenz, auf die es sich bezieht, ist real: DevDay 2026 ist am 29. September im Fort Mason Center in San Francisco. Der Agent, mit dem er konkurriert, ist ebenfalls real — Grok Bot, das Digital-Coworker-Produkt, das SpaceXAI am 11. August in eine frühe Beta-Version brachte. Das Modell, auf dem der Agent vermutlich laufen würde, ist real und datiert: GPT-6 Astra, allgemein verfügbar seit dem 3. September. Fast nichts anderes in der Behauptung ist es.
Woraus das Leck tatsächlich besteht, nach Gewicht sortiert
Drei Dinge werden gemeldet, und sie verdienen es nicht, als eine einzige Behauptung gelesen zu werden.
Die in Screenshots festgehaltenen Verweise sind der stärkste Teil. Ein am 26. September veröffentlichter Bericht besagt, dass Verweise auf „O“ in ChatGPTs eigener Konfiguration auftauchen – als Anzeigename und als Mail-Suffix, geschrieben als „-o“ – und dass dieselbe Zeichenfolge kürzlich als Vorteil auf der Upgrade-Seite für den 100-Dollar-ChatGPT-Pro-Plan aufgeführt wurde. Dabei handelt es sich eher um Artefakte in Deployment-Form als um eine Erfindung: Konfigurationsoberflächen sind der Ort, an dem ein Unternehmen ein Produkt vorbereitet, bevor es es ankündigt, so wie es auch bei Feature-Flags der Fall ist. Sie sind zugleich die schwächste Art von verfügbarem Artefakt, denn eine vorbereitete Zeichenfolge kann umbenannt, zweckentfremdet oder aufgegeben werden, und sie bringt kein Verhalten mit sich. Der Bericht ist eindeutig in Bezug auf diese Lücke: Was der Agent tut, worauf er zugreifen darf, ob er irgendetwas zeitlich plant, wie lange er sich erinnert und wer ihn bekommt, wird alles nicht genannt.
Der Name ist der Anspruch zweiter Ordnung. Ein gesperrter @o-Account auf X wird als mögliche Reservierung angeführt. Ein gesperrter Handle ist ein Datenpunkt über die Absicht zu einem bestimmten Zeitpunkt, nicht darüber, was das Produkt ist, und derselbe Buchstabe ist bereits einmal durch OpenAIs Namensabteilung gegangen — mehr dazu unten.
Die dritte Ebene ist der Teil, der aus dem dieswöchigen Signal und nicht aus der Berichterstattung stammt: dass „o“ in allen Pro-Stufen auftaucht, dass Fast Mode bestätigt ist, dass es vermutlich in eine 500-Dollar-Abo-Stufe gebündelt ist und dass Cerebras-Silizium die Geschwindigkeit möglich macht. „Vermutlich“ leistet in diesem Satz sichtbare Arbeit. Der Signalbeitrag selbst ist in der Aufzeichnung, die das Radar gemacht hat, abgeschnitten – sein fünfter Punkt beginnt mit „shared m…“ und bricht ab –, also lies die Liste als unvollständig und nicht als fünf feststehende Punkte.
Das Namensproblem, das niemand überprüft hat
OpenAI hat den Buchstaben bereits verwendet. Seine Reasoning-Modelle erschienen unter o1, o3, o3-mini und o4-mini in den Jahren 2024 und 2025, und die Produktlinie wurde eher heruntergefahren als ausgebaut: o4-mini wurde im Februar 2026 aus ChatGPT entfernt, GPT-4.5 verschwand im Juni, und o3 erhielt eine 90-tägige Auslaufphase, die am 28. Mai in den Versionshinweisen zum Modell angekündigt wurde – eine Stilllegung, über die dieser Blog damals berichtete, weil Nutzer von verschwindenden Antworten vor dem Stichtag berichteten.
Ein bloßes „o“ als Name eines Consumer-Agenten würde also mit der jüngsten Geschichte des Unternehmens selbst kollidieren und wäre an genau der Stelle mehrdeutig, an der Mehrdeutigkeit teuer ist: bei einer Modellauswahl. Das ist kein Beweis dafür, dass der Leak falsch ist – Anbieter recyceln Buchstaben, und ein interner Codename stirbt oft beim Namensreview –, aber es ist ein Grund, den Namen als den entbehrlichsten Teil der Geschichte zu behandeln. Wenn „o“ unter einem anderen Label erscheint, gilt jede unten aufgeführte datierte Tatsache weiterhin.
Warum das Timing glaubwürdig ist, obwohl das Produkt es nicht ist
Der stärkste Beweis für eine DevDay-Agent-Einführung ist nicht das Leak. Es ist das, was OpenAI in den vier Wochen davor bereits aufgebaut hat.
• 3. September — GPT-6 Astra erreichte die allgemeine Verfügbarkeit als Frontier-Modell von OpenAI: Kontext von 1,05 Mio. Token, maximale Ausgabe von 128K, gelistet zu 10,00 $ pro Million Eingabe-Token und 50,00 $ pro Million Ausgabe, mit gecachtem Input zu 1,00 $ und Cache-Schreibvorgängen zu 12,50 $. Unser eigener Katalog führt dasselbe Modell unter einem Listungsdatum vom 04.09.2026; Artificial Analysis datiert die Veröffentlichung auf den 3. September.
• 10. September — OpenAI hat die Agents API in öffentlicher Beta geöffnet und verkauft Entwicklern das verwaltete Codex-Harness: OpenAI übernimmt die Orchestrierung, die Kontextkomprimierung und die Wiederherstellung, während der Entwickler die Aufgabe, das Modell, die Tools und die Umgebung liefert. Das ist die Infrastruktur eines Always-on-Agenten, verkauft als Entwicklerprodukt.
• 10. September — am selben Tag wurden neue Anmeldungen und Upgrades für den 200-Dollar-Tarif ChatGPT Pro ausgesetzt; als Grund wurde die Nachfrage nach GPT-6 Astra genannt. Der 100-Dollar-Tarif, Plus, Go, Business und Enterprise sowie die API blieben weiterhin offen.
• 22. September — GPT-6 Sol und GPT-6 Luna erschienen für 2,00 $ / 10,00 $ bzw. 0,10 $ / 0,50 $ pro Million Tokens, was OpenAI als dauerhaft und nicht als Werbeaktion bezeichnet hat, wodurch das günstige Ende der Produktlinie erweitert wird, auf das der Agent für Routinearbeit zurückgreifen würde.
• 26. September — Die Dokumentation des Ultrafast-Serving-Tiers wurde erweitert: eine unveröffentlichte Geschwindigkeitsauswahl mit Standard, Fast und Ultrafast wurde im Responses API Playground entdeckt, und Berichte deuten auf einen breiteren Rollout rund um den DevDay hin.
• 29. September — DevDay 2026, Keynote im Livestream, Eröffnung durch Sam Altman. OpenAIs Entwickler-Account postete „72 Stunden bis zum OpenAI DevDay“ am selben Wochenende, an dem der Agent-Bericht erschien.

Liest man diese sechs Zeilen zusammen, ergibt sich ein kohärentes Bild der Geschichte: OpenAI hat das Agenten-Harness zum Produkt gemacht, es an Entwickler verkauft, den Consumer-Seat rationiert, der sein bestes Modell enthält, und hält in vier Tagen eine Keynote. Eine an Endverbraucher gerichtete Version desselben Harness — als Abonnement statt als Per-Token-Endpoint verkauft — ist der offensichtliche nächste Schritt. Nichts davon verifiziert den Namen, die Stufe oder die Cerebras-Verbindung. Es macht den Zeitpunkt plausibel, was eine andere und schwächere Behauptung ist.
Schnellmodus, Ultraschnell und die Cerebras-Behauptung
Das Signal besagt, dass Fast Mode „bestätigt“ ist und dass der Cerebras-Chip „wirkt“. Beides muss voneinander getrennt werden, denn das eine ist dokumentierte Plattform-Infrastruktur und das andere eine Schlussfolgerung darüber, welcher Chip welches Produkt bedient.
Der Fast-Modus ist eine echte, kostenpflichtige Stufe in OpenAIs API für die GPT-6-Reihe: Er wird zum doppelten Standardsatz abgerechnet und liefert rund die 2,5-fache Ausgabegeschwindigkeit, und es ist dieselbe Stufe, die am 30. Juli 2026 aus „Priority processing“ umbenannt wurde – die API akzeptiert entweder service_tier: "fast" oder service_tier: "priority". Er ist bei mindestens einem Modell der Reihe nicht mit EU-Datenresidenz verfügbar. Innerhalb des ChatGPT-Abo-Pools setzt die Berichterstattung über die Abo-Guthabenstruktur den Fast-Modus mit dem 2,5-fachen Guthabensatz an statt mit dem 2-fachen der API, was die schnellste Einstellung innerhalb von ChatGPT zu einem etwas schlechteren Geschäft macht als außerhalb – ein Detail, das man kennen sollte, bevor man annimmt, ein Fast-Modus-Vorteil sei das wert, wonach er klingt.
Ultrafast ist die Cerebras-Stufe, und sie ist ein anderes Kaliber. OpenAI kündigte sie am 13. August 2026 als erstes Produkt seiner Compute-Partnerschaft mit Cerebras an – ein Geschäft, über das mit rund 10 Milliarden US-Dollar über drei Jahre berichtet wird – und sie liefert bis zu 14× Standarddurchsatz und bis zu 750 Ausgabe-Tokens pro Sekunde bei GPT-5.6 Sol, dem Modell, auf das sie derzeit beschränkt ist. Der Zugriff ist kontrolliert, es gibt keinen veröffentlichten Preis, und seit dieser Woche ist sie noch immer eine Wartelisten-Stufe statt einer allgemeinen. In der Referenz zur Responses API wird ultrafast als Wert für den service_tier-Parameter aufgeführt, mit dem Hinweis, dass es „derzeit für gpt-5.6-sol verfügbar“ ist.
Genau deshalb sollte der Cerebras-Satz in dem Leak als Vermutung mit plausibler Grundlage statt als Bestätigung behandelt werden. Ein Consumer-Agent, der kontinuierlich läuft, würde von Latenz und Kosten pro Aufgabe dominiert werden, und Geschwindigkeit der Cerebras-Klasse ist eine echte Antwort auf die erste Hälfte davon. Doch es gibt noch keinen dokumentierten Ultrafast-Pfad für irgendein GPT-6-Modell, keine Preisliste dafür und nichts von OpenAI, das einen Consumer-Agenten an diese Hardware bindet. Die Richtung der Schlussfolgerung ist vernünftig; die Gewissheit in der Formulierung ist nicht verdient.
Was „in allen Pro-Tarifen verfügbar“ Sie kosten würde
Das ist der Teil der Behauptung, den ein Leser tatsächlich bewerten kann, weil die darunterliegende Stufenstruktur veröffentlicht ist.
• Monatliche Preise — die ChatGPT-Pro-Tarife zu 100 $ und 200 $ waren beide bis einschließlich September erhältlich; neue Anmeldungen für den 200-$-Tarif sind seit dem 10. September ausgesetzt, und OpenAI hat keinen Schwellenwert für eine Wiederaufnahme veröffentlicht.
• Die verbrauchsabhängig abgerechnete Version derselben Fähigkeit — GPT-6 Pro ist im 200-Dollar-Tarif auf 200 Nachrichten pro Woche begrenzt und im 100-Dollar-Tarif auf 50 pro Woche, wobei Letztere aus einem Kontingent stammen, das mit GPT-5.6 Sol Pro geteilt wird. Business-Tarife liegen niedriger. Das sind die von OpenAI veröffentlichten Zahlen, und sie sind die eigentliche Grenze dafür, was ein „Vorteil auf der Upgrade-Seite“ wert ist.
• Token-Arithmetik beim zugrunde liegenden Modell — bei 10,00 $ / 50,00 $ pro Million entsprechen 500 $ an GPT-6 Astra API etwa 50 Mio. Input-Tokens oder 10 Mio. Output-Tokens, wobei sich die effektive Arbeit oberhalb der 272K-Input-Schwelle erneut halbiert, bei der die gesamte Anfrage mit 20,00 $ / 2,00 $ / 75,00 $ neu bepreist wird.
• Die günstigere Hälfte der Reihe — für dieselben 500 $ gibt es rund 250 Mio. Input- oder 50 Mio. Output-Tokens auf GPT-6 Sol zu 2,00 $ / 10,00 $, und das Zehnfache davon auf GPT-6 Luna zu 0,10 $ / 0,50 $.
Wenn der Agent innerhalb eines bestehenden Abonnements kommt, geht es beim Vergleich nicht mehr um den Listenpreis, sondern darum, für welchen Seat Sie bereits bezahlen. Kommt er als eigene Rechnungsposition, muss OpenAI ihn gegenüber einer Kategorie rechtfertigen, in der ein Rivale seit sechs Wochen ausliefert. So oder so verändert ein Always-on-Agent die Form der Rechnung: Ein Assistent, der weiterarbeitet, während Sie schlafen, verbraucht Tokens ohne einen Menschen in der Schleife, und genau das ist die Arbeitslast, die eine verbrauchsbasierte Tarifstufe bestraft und ein Seat absorbiert. Es ist außerdem die Arbeitslast, bei der zwischengespeicherter Input zu einem Zehntel des frischen Inputs die Gesamtsumme entscheidet – ein persistenter Agent sendet in jeder Runde einen nahezu unveränderten Kontext erneut, und genau das ist das Muster, für das ein Cache-Rabatt gebaut ist.
Das ist die Ebene, auf der OrcaRouter arbeitet, und es lohnt sich, offen zu sagen, was sie nicht abdeckt. Wir routen OpenAIs Modelle pro Token, wobei der Listenpreis des Anbieters mit 0 % Aufschlag durchgereicht wird, sodass eine Tarifänderung eines Anbieters hier noch am selben Tag wirksam ist – mit automatischem Failover über Anbieter hinweg und einer Routing-DSL zum Zusammensetzen von Aufrufen. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol und GPT-6 Luna laufen alle über einen Schlüssel. Was wir Ihnen nicht verkaufen können, ist ein ChatGPT-Abonnement oder ein Agent, den es noch nicht gibt – es gibt nichts zu routen, bis OpenAI einen auf den Markt bringt.
Die Hürde, die der Agent nehmen muss, ist niedriger, als sie aussieht.
Grok Bot ist der Vergleich, den der Leak selbst anstellt, und die ehrliche Lesart davon ist, dass SpaceXAI die Messlatte niedrig gelegt hat. Es ging am 11. August in eine frühe Beta – in einer Einstiegskonfiguration für 120 US-Dollar pro Nutzerplatz, gebündelt in Cursor Premium Teams, mit Einzeltarifen zu 200 und 300 US-Dollar pro Monat, wobei die Nutzung über die enthaltenen Limits hinaus zu Token-Kosten abgerechnet wird. Jeder Bot erhält eine eigene Cloud-VM mit Browser, Dateisystem und Terminal; er meldet sich bei Apps an, die keine API haben; er speichert vorgeführte Workflows als Routinen und läuft weiter, nachdem der Laptop zugeklappt wurde.
Was nicht veröffentlicht wurde, ist der Teil, der irgendetwas klären würde. SpaceXAI hat keine unabhängigen Benchmarks oder Zuverlässigkeitsdaten dafür veröffentlicht, der dahinterstehende Modell-Router ist automatisch, und Nutzer können kein Modell festlegen, frühe Tester zeigten sich öffentlich unbeeindruckt, und Rezensenten stellen das Fehlen einer Unternehmens-Kontrollschicht fest – keine bereichsbezogenen Berechtigungen, Eskalationsregeln oder Audit-Trail. Metas Muse folgte am 8. September in eine Kategorie, die inzwischen drei Produkte umfasst.

Diese letzte Zeile ist der springende Punkt des ganzen Vergleichs. Es gibt keinen Artificial-Analysis-Index für „Hat der Agent die Aufgabe abgeschlossen, ohne etwas Katastrophales zu tun?", daher wird ein persistenter Agent auf derselben Grundlage gekauft wie ein Chatbot im Jahr 2023: Demos und Vibes. Die eine zeitgebundene Einschränkung, die niemand in dieser Geschichte erwähnt, ist OpenAIs eigene Sicherheitshaltung. GPT-6 Astra erreichte die kritische Cybersicherheitsfähigkeits-Schwelle des Unternehmens, und OpenAI hat gewarnt, dass die Überwachung legitime Aufgaben verlangsamen, anhalten oder stoppen kann – ausdrücklich einschließlich lang laufender Jobs. Ein Always-on-Agent ist per Definition ein Langzeitjob, und zwar in der Plattform, die bereits gesagt hat, dass sie einen solchen unterbrechen kann.
Was würde das überprüfbar machen, und wann?
Gerüchte über ein Produkt, dessen Markteinführung vier Tage entfernt ist, sind billig, und die Prüfungen sind konkret.
• Eine OpenAI-Seite, ein Versionshinweis oder ein Help-Center-Eintrag, in denen der Name als Produktname verwendet wird. Bisher ist nichts aufgetaucht, und die Historie des Buchstabens innerhalb von OpenAI macht dies zum Test, bei dem am meisten schiefgehen kann.
Eine Konfigurationsoberfläche, die ein Neuladen übersteht – ein tatsächlich käuflicher Tarif, ein ausgewiesenes Kontingent, eine Einstellungsseite – statt eines Anzeigestrings, der in einem Build vorbereitet wird.
• Überhaupt jede Verhaltensspezifikation: was ihm gewährt werden kann, was es zeitlich einplant, wie lange es sich erinnert, ob es in der Produktion eine eigene Mail-Identität besitzt oder nur in einer Konfigurationsdatei.
• Ein Preis. „In allen Pro-Tarifen“ ist kein Preis, und ein 500-Dollar-Tarif wird nicht dadurch zur Tatsache, dass ein separater Bericht 500-Dollar-Abonnement-Strings an einer anderen Stelle gefunden hat.
• Dass der Cerebras-Link entweder in OpenAIs eigener Serving-Dokumentation für die Stufe auftaucht – so wie es Ultrafasts Beschränkung auf GPT-5.6 Sol tat – oder gar nicht auftaucht.

Die Entscheidung, die einem Leser danach bleibt, ist kleiner, als das Leck nahelegt, und sie dreht sich nicht um den Brief. Wenn Sie einen Always-on-Agenten für die Arbeit evaluieren, ist das Produkt, das heute existiert, Grok Bot, und der vernünftige Schritt ist ein kurzer Test gegen Ihren eigenen Workflow statt einer Seat-Verpflichtung — die 120-Dollar-Einstiegsstufe ist eine Untergrenze, keine Obergrenze, und die Nutzung über die enthaltenen Limits hinaus wird zu Token-Kosten abgerechnet. Wenn Sie entwickeln, ist die Agents API seit dem 10. September in der öffentlichen Beta und der Teil dieser Geschichte, den Sie heute tatsächlich testen können, wobei Harness, Sandbox und Abrechnung alle dokumentiert sind.
Und wenn Sie kalkulieren, was der Betrieb von all dem kosten würde, stützen Sie sich dabei auf die Modelle statt auf das Gerücht. GPT-6 Astra ist zu $10,00 / $50,00 pro Million Token auf OrcaRouter zum OpenAI-eigenen Listenpreis ohne zusätzlichen Aufschlag verfügbar, GPT-6 Sol und GPT-6 Luna sind dort für $2,00 / $10,00 bzw. $0,10 / $0,50 vertreten, und der Cache-Lesepreis – $1,00 gegenüber $10,00 bei Astra – ist der Wert, der entscheidet, was eine persistente Workload tatsächlich kostet. Ein Agent, den OpenAI nicht angekündigt hat, kann nicht gebenchmarkt, geroutet oder gekauft werden. Die darunterliegenden Token können heute gebenchmarkt, geroutet oder gekauft werden, und der Zähler, den Sie darauf aufbauen, wird weiterhin der richtige Zähler sein, wenn sich der Name auf der Verpackung als etwas anderes als ein einzelner Buchstabe erweist.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
