
GPT-6.1 Ultrafast ist Pro für nur 500 $, und dieses Detail steckte drei Beiträge tief.
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
GPT-6.1 Sol Ultrafast kam am 8. Oktober 2026 mit der seltensten Sache, die eine Geschwindigkeitsstufe mit sich bringen kann: einem veröffentlichten Preis. 12,00 $ pro Million Input-Tokens, 60,00 $ pro Million Output-Tokens, genau das Sechsfache dessen, was GPT-6.1 Sol — das Modell, das OpenAI am 29. September 2026 auf seiner DevDay-2026-Keynote veröffentlichte — im Standard-Tarif kostet. Womit der Ankündigungs-Thread nicht begann, war die Frage, wo ein ChatGPT-Abonnent es tatsächlich einschalten kann, und die Antwort, drei Beiträge weiter unten, ist der $500 Pro-Plan. Diese Reihenfolge verdient mehr Aufmerksamkeit, als sie bekommen hat, denn die API-Hälfte und die Abo-Hälfte dieses Rollouts sind auf entgegengesetzte Weise zugangsbeschränkt, und der Unterschied entscheidet, ob Ultrafast etwas ist, das man diese Woche ausprobieren kann, oder etwas, für das man einen Plan kaufen muss.
Am Modell hat sich nichts geändert. GPT-6.1 Sol Ultrafast ist derselbe Checkpoint, dasselbe Kontextfenster von 1.050.000 Token, dieselbe Ausgabeobergrenze von 128.000 Token, derselbe Wissensstichtag 30. April 2026 und dieselben Antworten wie GPT-6.1 Sol. Ultrafast ist ein Service-Tier – eine von Ihnen angeforderte Scheduling-Priorität – kein zweites Modell. Das ganze Produkt ist Latenz, zu einem Vielfachen verkauft, und die einzigen zwei Fragen, die zählen, sind, wie viel davon Sie bekommen und wer es kaufen darf.
Was die Aufzeichnung tatsächlich aussagt, in der Reihenfolge, in der sie es aussagt.
Die empörte Version dieser Geschichte besagt, dass OpenAI das Gate vergraben habe. Die zutreffende Version ist spezifischer und lässt sich Zeile für Zeile anhand von OpenAIs eigener Dokumentation überprüfen.
Das Entwickler-Changelog enthält den Eintrag vom 8. Oktober: Hinzufügen des Ultrafast-Modus für GPT-6.1 Sol in der Responses API, angefordert durch Senden von model: "gpt-6.1-sol" mit service_tier: "ultrafast", beschrieben als Verkürzung der Zeit zwischen generierten Ausgabe-Tokens und angegeben als verfügbar für alle API-Nutzer, vorbehaltlich der Rate Limits, mit globaler Verarbeitung und Datenresidenz in den USA und der EU. Für sich genommen ist das eine uneingeschränkte Einführung zu einem veröffentlichten Tarif.
Die Tier-Dokumentation besagt, dass Ultrafast die schnellste Service-Stufe in der API ist, breit verfügbar für GPT-6 Astra und GPT-6.1 Sol mit Vorschau-Zugang für GPT-5.6 Sol, und empfiehlt WebSockets dafür. Nach wie vor keine Erwähnung eines Plans.

Das Abo-Detail steht auf der ChatGPT-seitigen Speed-Seite, und es sind drei Einschränkungen, gebündelt in einem Absatz: Ultrafast ist in Codex und ChatGPT Work verfügbar, bei Pro $500 und in berechtigten Enterprise- und Edu-Tarifen. Enterprise-Administratoren bekommen es standardmäßig deaktiviert und müssen es pro Benutzer oder pro Workspace aktivieren. Und der Consumer-Chat-Oberfläche wird die Stufe überhaupt nicht angeboten — GPT-6.1 Sol selbst ist in Work und Codex beheimatet, daher war Chat nie im Umfang enthalten.
Setzt man die drei zusammen, ergibt sich ein klares Bild. Ein API-Schlüssel ist ein Ticket. Ein ChatGPT-Abonnement ist nur dann ein Ticket, wenn es das teuerste ist, das OpenAI verkauft, oder wenn ein Administrator es für Sie freigeschaltet hat. Niemand, der den ersten Beitrag der Ankündigung liest, würde darauf kommen.
Warum das Gate existiert, und es ist nicht willkürlich
Die naheliegende Lesart ist, dass OpenAI die Überholspur nutzt, um 500-Dollar-Pläne zu verkaufen. Der dahinterliegende Mechanismus ist weniger zynisch und nützlicher: Ultrafast ist ein teurer Zähler, und ein 500-Dollar-Plan ist der einzige Verbraucherplan, bei dem ein 8x-Zähler in die inkludierte Nutzung passt.
Bei einem Abonnement wird die inkludierte Nutzung zum Achtfachen der Standardrate verbraucht, wenn Sie Ultrafast verwenden, sodass ein einzelner Ultrafast-Turn dasselbe Kontingent aufbraucht wie acht Standard-Turns. Das ist eine Folge dessen, was die Stufe tut – sie erkauft sich Wall-Clock-Zeit, indem sie Serving-Kapazität verbraucht, und ein Abonnement ist ein Produkt mit fester Kapazität. Verlangt man für den achtfachen Kapazitätsverbrauch dasselbe Kontingent, bricht die Wirtschaftlichkeit des Plans bei $20 pro Monat zusammen. Verlangt man das Achtfache an Kontingent, wird die Stufe in einem kleinen Plan schlicht unattraktiv. So oder so landet die Stufe dort, wo das Kontingent groß genug ist, um sie zu absorbieren.
Die API hat keine solche Einschränkung, weil sie nach Verbrauch abgerechnet wird. Dort erhält Ultrafast ein eigenes Rate-Limit-Budget, getrennt von den Standard- und Fast-Budgets, und OpenAI beschreibt diese Limits als pro Organisation festgelegt statt auf der Tier-Seite veröffentlicht. Das ist ein zweiter Punkt, auf den man achten sollte, den die Ankündigung aber nicht in den Vordergrund gestellt hat: Die Umstellung einer Workload auf Ultrafast vervielfacht nicht nur die Rechnung, sondern verschiebt die Workload auf eine andere Obergrenze, und wenn man den Traffic über das hinaus erhöht, was der Organisation zugestanden wurde, werden die eigenen Limits des Tiers zum Ausfallmodus.
Die Arithmetik, Geschwindigkeit auf zwei verschiedene Arten zu kaufen
Hier ist die Entscheidung in Zahlen – und das ist der Teil, den du mit deinen eigenen Token-Zahlen statt mit meinen nachrechnen solltest. Nimm eine Agenten-Sitzung, die über 40 Turns hinweg pro Turn 30.000 Eingabe-Tokens sendet und 1.500 Ausgabe-Tokens empfängt.
• Gesamtzahl der Tokens pro Ausführung — 1.200.000 Eingabe-Tokens, 60.000 Ausgabe-Tokens, verteilt auf 40 Anfragen, die jeweils mit großem Abstand unter der 272.000-Token-Schwelle liegen, ab der OpenAI die gesamte Anfrage neu bepreist.
• Bei Standard GPT-6.1 Sol — 1,2 Millionen Tokens zu 2,00 $ pro Million sind 2,40 $, plus 60.000 zu 10,00 $ pro Million sind 0,60 $. Drei Dollar pro Durchlauf.
• Bei GPT-6.1 Sol Ultrafast — 1,2 Millionen bei 12,00 $ sind 14,40 $, plus 60.000 bei 60,00 $ sind 3,60 $. Achtzehn Dollar pro Durchlauf.
• Der Unterschied — 15,00 $ pro Durchlauf, um den Großteil der Generierungszeit bei einem Job zu entfernen, der sich ansonsten nicht ändert.
Diese 15,00 $ pro Durchlauf sind die Zahl, die Sie dem Abonnement gegenüberstellen sollten. Wenn der einzige Grund, aus dem Sie den Pro-Plan erwägen, Ultrafast ist, dann ist bei diesen Token-Zahlen nach rund 33 Durchläufen pro Monat der Punkt erreicht, an dem die 500 $ des Plans und die Abrechnung der API pro Token gleichauf liegen — darunter ist die Abrechnung pro Token der günstigere Weg, dieselbe Stufe zu kaufen, und darüber beginnt der Plan zu gewinnen. Ihre Token-Zahlen verschieben diesen Schnittpunkt, manchmal erheblich, also rechnen Sie mit Ihren eigenen Zahlen, bevor Sie 33 als Schwellenwert behandeln. Es ist unsere Rechnung zu einer angegebenen Arbeitslast, kein veröffentlichter Break-even-Punkt.

p>Zwei strukturelle Anmerkungen, die jede Tokenanzahl überstehen.
Die Geschwindigkeitsbehauptung ist übernommen, und sie ist das Einzige, was man sorgfältig lesen sollte.
Ultrafast wird mit „bis zu 8x schneller“ beworben, und die einzige modellspezifische Messung, die OpenAI hinter dieser Aussage veröffentlicht, gehört zu einem anderen Modell. Der Satz in der Dokumentation lautet, dass GPT-6 Astra Ultrafast Token bis zu 8x schneller generiert als GPT-6 Astra im Standardmodus in Codex. Das ist ein Astra-Wert, gemessen in Codex. Die Dokumentation für die Stufe von GPT-6.1 Sol beschreibt sie als Verkürzung der Zeit zwischen den Token und verweist auf eine Preisliste; sie nennt dafür keine Zahl, und auch keine unabhängige Stelle hat eine Token-pro-Sekunde-Messung für die Sol-Variante veröffentlicht.
Es kann durchaus zutreffen. Beide Modelle laufen auf demselben Serving-Stack, und der Stufenmechanismus ist derselbe, daher ist ein Astra-Multiplikator ein vernünftiger Prior für Sol. Aber „bis zu 8x“ ist eine Anbieter-Obergrenze, nicht reproduziert, von einem Schwestermodell übernommen – und das „bis zu“ leistet in diesem Satz echte Arbeit. Behandle den Multiplikator als Hypothese, die du an deinen eigenen Prompts testest, denn die Dokumentation der Stufe testet ihn nie für dich.
Derselbe Vorbehalt lässt sich für die älteren Stufen billiger anbringen. Ultrafast über GPT-5.6 Sol wurde am 13. August 2026 mit „bis zu 14x schneller als die Standard-Verarbeitung“ in eingeschränkter Vorschau angekündigt, und drei Monate später spricht die Dokumentation noch immer von Vorschauzugang, während die Ultrafast-Preistabelle genau zwei Zeilen enthält – GPT-6 Astra und GPT-6.1 Sol. Eine 14x-Zahl ohne veröffentlichten Preis und ohne allgemeine Verfügbarkeit ist eher eine Behauptung als ein Produkt, und sie ist eine nützliche Erinnerung daran, wie viel an dieser Stufenleiter noch Wunschdenken ist.
Wenn der 500-Dollar-Plan nicht zustande kommt
Für alle, die nicht Pro für 500 $ kaufen werden, um eine Latenzstufe zu testen, ist der sinnvolle Schritt, die beiden Dinge zu trennen, die in der Ankündigung gebündelt wurden. Die Stufe ist auf der API für alle API-Nutzer verfügbar, daher ist die Schnellspur ohne Abonnement erwerbbar — zu 12,00 $ und 60,00 $ pro Million Token, mit eigenem Rate-Limit-Budget, bei einer Arbeitslast, die klein genug ist, um sie zu messen. Teste sie dort zuerst, mit deinen eigenen Prompts, gegen die Standardspur.
Die Standard-Lane ist diejenige, die ohne all das existiert. OrcaRouter bedient GPT-6.1 Sol als openai/gpt-6.1-sol zu OpenAIs eigenen Listenpreisen — 2,00 $ pro Million Input-Tokens und 10,00 $ pro Million Output-Tokens — mit 0 % Aufschlag und dem direkt durchgereichten Anbieterpreis, sodass eine Preisänderung eines Anbieters noch am selben Tag bei uns ankommt. Ultrafast ist nichts, was wir verkaufen: Es ist ein Service-Tier-Flag, das auf Ihrem eigenen OpenAI-Konto abgerechnet wird, und wir sagen das lieber klar, als eine Modellseite etwas anderes implizieren zu lassen. Was ein Schlüssel hingegen bietet, ist die Möglichkeit, die Standard-Lane und den Rest des Katalogs zu routen — mehr als 200 Modelle hinter einem einzigen OpenAI-kompatiblen Endpoint — und über Anbieter hinweg automatisch ein Failover durchzuführen, wenn einer beeinträchtigt ist, was die günstigste Versicherung ist, wenn Sie kurz davor stehen, eine Latenz-Tier vor einen Produktionspfad zu setzen.

Und wenn Sie Plus oder Team nutzen und die Antwort, nach der Sie gesucht haben, „Kann ich das einfach einschalten?“ lautete, dann lautet sie nein – mit einer bestimmten Ausprägung. Codex und ChatGPT Work auf Pro für 500 $ oder einem berechtigten Enterprise- oder Edu-Plan, aktiviert von einem Administrator, wenn es sich um die Enterprise-Variante handelt. Alles andere erreicht Ultrafast über die API und zahlt pro Token.
Was als Nächstes ansehen
Drei Dinge würden dies von einem zugangsbeschränkten Rollout in einen gewöhnlichen verwandeln, und alle drei sind beobachtbar. Ein veröffentlichtes Ultrafast-Rate-Limit für GPT-6.1 Sol würde das Rätselraten darüber beenden, ob die eigene Obergrenze der Stufe greift, bevor die Rechnung es tut. Eine modellspezifische Geschwindigkeitsmessung – oder eine unabhängige – würde die geborgte Astra-Zahl durch etwas ersetzen, an dem sich die Sol-Stufe messen lassen kann. Und dass Ultrafast ChatGPT Plus erreicht, würde bedeuten, dass sich die Kapazitätsrechnung geändert hat, was das Signal dafür ist, dass die Zugangsbeschränkung Startknappheit war und nicht die dauerhafte Gestalt der Stufe.
Bis dahin ist die ehrliche Zusammenfassung eng und überprüfbar. GPT-6.1 Sol wurde am 29. September 2026 ausgeliefert und ist unverändert. Am 8. Oktober 2026 bekam es eine Schnellspur mit einem echten Preis, offen für API-Nutzer und in ChatGPT nur über den 500-Dollar-Plan zugänglich – ein Detail, das eher den ersten als den dritten Beitrag verdient hätte, und eines, das für die meisten Leser entscheidet, ob dies ein Einzelposten oder eine Bestellung ist.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
