
ChatGPT Pro Max: Was der 500-Dollar-Bericht sagt – und was OpenAI nicht bestätigt hat
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 281 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 182 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1285 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 119 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
Am 24. September 2026 veröffentlichte der Leak-Tracking-Account @testingcatalog — betrieben von Tibor Blaho —, was nach eigenen Angaben in unveröffentlichten ChatGPT-Abonnement-Referenzen zu finden war: einen Plan namens ChatGPT Pro Max, mit einem Preis von 500 US-Dollar pro Monat. Die Zahl von 600 US-Dollar, die daneben kursiert, ist die Zahl, die im eigenen Video des Accounts gezeigt wird, die er der Mehrwertsteuer zuschreibt. Das ist die gesamte Beweislage. Es gibt keine Ankündigung, kein Startdatum, keine Modell-ID und kein veröffentlichtes Kontingent, das damit verbunden wäre. Was den Bericht trotzdem lesenswert macht, ist die Stufe, über der er angesiedelt wäre — diejenige, deren Verkauf der Anbieter im Laufe des Septembers einstellte —, und der Grund, warum er sie nicht mehr verkaufte, ist das Modell im Zentrum der Geschichte: die Nachfrage nach GPT-6 Astra, dem Flaggschiff, das am 5. September allgemein verfügbar wurde und das in den eigenen Nutzungsobergrenzen von ChatGPT als GPT-6 Pro angezeigt wird. Die günstigeren API-Stufen, GPT-6 Sol zu $2 / $10 und GPT-6 Luna zu $0.10 / $0.50 pro Million Tokens, sind das, was man kauft, wenn eine monatliche Lizenz nicht zur Arbeit passt. Pro Max wäre diese Lizenz. DevDay ist am 29. September, also in vier Tagen.
Was der Bericht enthält
TestingCatalogs Bericht ist kurz, und das Nützliche daran ist, die drei Behauptungen, die er aufstellt, von denen zu trennen, die er ausdrücklich nicht aufstellt.
Was darin steht: Der Plan erschien in einem unveröffentlichten ChatGPT-Abo, er würde 500 US-Dollar pro Monat kosten; und seine Beschreibung unterscheidet sich vom Pro-Tarif „hauptsächlich durch den Zugriff auf ‚Fastest Work and Code‘?“
Was er hinzufügt, ohne es zu bestätigen: dass damit größere Nutzungskontingente einhergehen könnten – der Artikel selbst sagt, dies sei „noch nicht bestätigt“. Unser Briefing für diesen Beitrag formuliert denselben Vorbehalt anders: Die Limits könnten noch steigen, bevor überhaupt etwas ausgeliefert wird. Beide Formulierungen deuten auf dieselbe Lücke hin. OpenAI hat für diese Stufe keine einzige Zahl veröffentlicht, sodass niemand außerhalb des Unternehmens weiß, ob man für 500 US-Dollar mehr Nachrichten, längere Agentenläufe, einen schnelleren Serving-Pfad oder lediglich eine höhere Obergrenze bekommt, die die meisten Käufer nie erreichen.
Was er nicht behauptet: keine Modell-ID, kein Veröffentlichungsdatum, keine Kapazitätsverpflichtung und keine Bestätigung von OpenAI. Jede Publikation, die die Geschichte im Laufe des letzten Tages aufgegriffen hat – und es gibt viele, von Crypto Briefing über Futubull bis Startup Fortune – stellt sie als berichtet oder geleakt dar und nicht als angekündigt. Diese Einordnung ist korrekt und es lohnt sich, sie beizubehalten, denn der Unterschied zwischen „OpenAI bereitet sich vor“ und „OpenAI ist gestartet“ ist der Unterschied zwischen einem Plan, den man kaufen kann, und einem String in jemandes Entwicklertools.
Der einzige Teil der Beschreibung, der wirklich Informationen trägt, ist „Work und Codex“. Das sind die Agenten-Buckets im ChatGPT-Produkt, und sie werden getrennt von Chat abgerechnet: Chat, ChatGPT Work und Codex haben jeweils eigene Kontingente, wobei sich Work und Codex einen einzigen Pool teilen und ein OpenAI-API-Schlüssel außerhalb aller drei steht. Ein Plan, dessen Verkaufsargument schnellerer Zugang zu Work und Codex ist, ist kein Plan für mehr Chatten. Es ist ein Plan für das Ausführen langer agentischer Jobs – die Arbeitslast, bei der die Kosten pro Stunde eines Frontier-Modells am schwersten vorherzusagen und am leichtesten zu verpulvern sind.

Die Kapazitätsstory darunter
Eine Stufe über einer Stufe, die nicht zum Verkauf steht, ist kein Widerspruch, und beide zusammen zu lesen macht den Bericht zu mehr als einem Preisschild.
Mitte September – Medienberichte über die Pause ballten sich um den 11. September – stellte OpenAI die Annahme neuer Anmeldungen und Upgrades auf den 200-Dollar-Pro-Plan ein, unter Verweis auf die Nachfrage nach GPT-6 Astra. Der Leiter des Bereichs Kernprodukt und Plattform des Unternehmens wurde mit den Worten zitiert, er habe „so etwas noch nie gesehen“, und in der Berichterstattung wurde angemerkt, dass die Pause sogar erfolgte, nachdem OpenAI die verfügbare Rechenkapazität seit 2023 um etwa das 9,5-Fache erweitert hatte. Unsere eigene Berichterstattung hielt dasselbe aus einer anderen Richtung fest: Ende September verkaufte OpenAI noch immer keine neuen 200-Dollar-Pro-Plätze, und die etwa zur selben Zeit eingeführte 100-Dollar-Pro-Stufe war stattdessen die angebotene Option.
Die Reihenfolge ist also: Die Nachfrage nach dem Flaggschiff überstieg die Kapazität, die oberste Stufe wurde für neue Käufer geschlossen, eine günstigere Stufe wurde darunter geöffnet, und nun wurde eine teurere Stufe darüber gemeldet. Jeder dieser Schritte ist eine Rationierungsentscheidung. Das Schließen einer Stufe rationiert über die Warteschlange; das Öffnen einer günstigeren rationiert über das Kontingent; das Hinzufügen einer teuren rationiert über den Preis. Wenn Pro Max real ist, ist die interessante Frage nicht, ob 500 $ viel ist – das ist es eindeutig –, sondern welchen dieser drei Hebel OpenAI an der Spitze zu ziehen wählt, und ob die 200-$-Stufe wieder geöffnet wird, bevor Pro Max erscheint, oder ob sie einfach zu der Stufe wird, die nicht mehr an der Spitze steht.
Cerebras und was „schnellste“ bedeuten müsste
Der Artikel von TestingCatalog merkt an, dass „der Kontext auch auf die Cerebras-Infrastruktur hindeutet“, und ergänzt, dass OpenAI keine direkte Verbindung zwischen Cerebras und Pro Max bestätigt hat. Unser Briefing besagt, dass der Ultra-Fast-Pfad wahrscheinlich Cerebras-gestützt ist. Betrachten Sie beides als Schlussfolgerung, denn genau das sind sie: eine plausible Lesart einer unbestätigten Beschreibungszeile, nicht ein Kapazitätsvertrag, den irgendjemand öffentlich unterzeichnet hat.
Es gibt allerdings einen echten Präzedenzfall, von dem aus man argumentieren kann. OpenAI setzt bereits auf Cerebras für einen auf Latenz ausgerichteten Inferenzpfad – die GPT-5.6 Sol Ultrafast Preview, die Sol auf Cerebras-Hardware auf bis zu 750 Ausgabe-Tokens pro Sekunde bringt, ist eine limitierte Preview für eine kleine Gruppe von Kunden und keine allgemein verfügbare Stufe. Wenn „Fastest Work and Codex“ irgendetwas Technisches bedeutet, dann wäre das die Form, die es annehmen würde: dieselben Gewichte, auf schnellerem Silizium bereitgestellt, an eine kleine Anzahl sehr hoch zahlender Accounts verkauft. Diese Lesart hat eine Konsequenz, die man im Auge behalten sollte. Eine Geschwindigkeitsstufe ist eine Bereitstellungsvariante, kein neues Modell. An den Gewichten, dem Kontextfenster oder den Benchmark-Werten von GPT-6 Astra würde sich auf einem Pro-Max-Seat nichts ändern, also sollte niemand erwarten, dass ein nur für Pro Max verfügbares Modell in der API auftaucht.
Was man für 500 $ im Monat bekommt – auf zwei Arten berechnet
Hier wird aus dem Leak eine Entscheidung statt eines Gerüchts, denn ein Leser, der 500 US-Dollar pro Monat abwägt, hat eine zweite Option, deren Preis öffentlich bekannt ist.
Ein ChatGPT-Seat wird nach Nachrichten und Agentenläufen abgerechnet, und OpenAI veröffentlicht dafür kein Token-Äquivalent. Diese Lücke ist der ehrliche Ausgangspunkt: Man kann ein Pro-Max-Kontingent nicht in Token umrechnen, weil das Kontingent nicht veröffentlicht wurde. Was man tun kann, ist, die Alternative zu bepreisen. Zu den Listenpreisen von OpenAI erhält man für 500 $, ausgegeben als verbrauchsabhängige API-Nutzung, 50 Millionen Input-Token oder 10 Millionen Output-Token von GPT-6 Astra zu $10 / $50 pro Million — und 250 Millionen Input- oder 50 Millionen Output-Token von GPT-6 Sol zu $2 / $10. Das sind die eigenen Listenpreise von OpenAI, und die $10 / $50 für GPT-6 Astra verdoppeln sich auf $20 / $75, sobald eine Anfrage die 272.000-Token-Grenze überschreitet, sodass ein Agentenlauf mit langem Kontext pro Token mehr kostet, als es der genannte Preis vermuten lässt.
Die praktische Trennung ist nicht Abo versus API; sie verläuft danach, welche Arbeitslast auf welchem Abrechnungszähler sitzt. Gespräche, einmalige Fragen und alles, wofür Sie für Bequemlichkeit bezahlen, gehören auf einen Seat. Nächtliche Agentenläufe, Batch-Jobs und alles, was sich in Tokens messen lässt, gehören auf einen Schlüssel mit nutzungsbasierter Abrechnung, bei dem die Rechnung der Arbeit folgt statt einer Obergrenze, die Sie nicht sehen können.
OrcaRouter ist die verbrauchsabgerechnete Seite dieser Aufteilung. Wir routen GPT-6 Astra zum Listenpreis von OpenAI, daneben GPT-6 Sol für 2 $ / 10 $ und GPT-6 Luna für 0,10 $ / 0,50 $, mit 0 % Aufschlag — der Listenpreis des Anbieters wird durchgereicht, sodass eine Preisänderung eines Anbieters bei uns noch am selben Tag live ist statt erst zum nächsten Abrechnungszyklus. Ein Schlüssel erreicht über 200 Modelle, und automatisches Failover bedeutet, dass ein Modell, auf das Sie sich nicht festgelegt haben, hinter einer Route liegen kann statt in Ihrem Produktionspfad: Wenn GPT-6 Astra für eine Aufgabe die falsche Wahl ist, ist der Fallback eine Routing-Änderung, kein neuer Vertrag. Um es klar zu sagen, was wir nicht verkaufen — ChatGPT Pro Max ist ein Abonnementprodukt innerhalb von ChatGPT, kein API-Modell, und wir verkaufen keine ChatGPT-Zugänge weiter und beanspruchen keinen Zugriff darauf. Wir messen Tokens bei den Modellen.


Was würde dies vor dem 29. September überprüfbar machen?
Vier Tage sind lang genug, damit sich das Leck so oder so klärt, und die Oberflächen, die es klären würden, sind spezifisch.
Der Planauswähler im ChatGPT-Webclient ist der, den man im Auge behalten muss, denn dort sollen die Referenzen ursprünglich gesehen worden sein. Eine Tarifstufe, die von einem String zu einer auswählbaren Zeile in dieser Liste wird, ist eine Tarifstufe, die existiert. Die Preisseite ist die zweite Oberfläche: Wenn OpenAI eine Zahl dafür nennt, hat diese Zahl Vorrang vor 500 $, und die Mehrwertsteuerlücke ist dann keine Fußnote mehr. Die dritte ist der Tarifvergleich des Helpcenters, wo OpenAI die Nachrichtenzahlen veröffentlicht, für die es einstehen will — eine leere Zelle dort bedeutet, dass das Kontingent weiterhin unveröffentlicht ist, egal, was die Marketingseite sagt. Und die vierte ist DevDay selbst am 29. September, wo eine neue Top-Tarifstufe am wenigsten überraschen würde und wo OpenAI außerdem sagen müsste, ob die 200-$-Tarifstufe wieder geöffnet wird.
Was nichts davon ändern würde: die API. Wenn Pro Max auf den Markt kommt, behält GPT-6 Astra seinen Listenpreis, behält sein Kontextfenster und bleibt per Schlüssel zum selben Preis wie zuvor erreichbar. Ein Abo-Tarif ist eine Verpackungsentscheidung darüber, wie OpenAI den Zugang zu einem Modell verkauft, das bereits existiert und bereits öffentlich bepreist ist.
Für einen Leser ist die Entscheidung heute also klar zweigeteilt. Wenn Ihre Arbeit aus Gesprächen und kurzen Agent-Läufen auf einem Seat besteht, gibt es noch nichts zu tun: Die Stufe ist nicht angekündigt, und es gibt keinerlei Preis, auf den Sie reagieren könnten; und der Kuchen, auf den es zu warten gilt, ist DevDay. Wenn Ihre Arbeit in Tokens gemessen wird, hat die 500-Dollar-Frage bereits eine Antwort, die überhaupt nicht von dem Leak abhängt — dasselbe Flaggschiff ist heute pro Token zum Listenpreis verfügbar, wobei die Obergrenze durch Ihr Budget gesetzt wird und nicht durch ein Kontingent, das OpenAI nicht beschrieben hat.
In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
