
GPT-6.1 Sol Ultrafast vs. GPT-5.6 Sol Ultrafast: Eine Stufe, drei Modelle, eines davon wartet noch
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
GPT-6.1 Sol Ultrafast und GPT-5.6 Sol Ultrafast sind dieselbe Dienststufe, angewendet auf zwei verschiedene Sol-Generationen, und nach dem 8. Oktober 2026 befinden sie sich in entgegengesetzten Zuständen. GPT-6.1 Sol ist von „demnächst verfügbar“ zu einer veröffentlichten Preisliste übergegangen — 12,00 $ pro Million Input-Tokens, 60,00 $ pro Million Output-Tokens, das Sechsfache von Standard — verfügbar für jeden API-Nutzer sowie für Nutzer von Codex und ChatGPT Work im Pro-Plan für 500 $. GPT-5.6 Sol ist noch immer dort, wo Ultrafast begann: eine angekündigte Stufe, in begrenzter Vorschau, ohne überhaupt eine Zeile auf der Preisseite. Gleicher Name, gleicher Mechanismus, und nur eines davon kann man tatsächlich kaufen.
Das ist die Kurzfassung. Die längere Fassung ist wichtig, weil die prominenten Geschwindigkeitsangaben der Stufe an unterschiedliche Modelle geknüpft sind, in unterschiedlichen Oberflächen gemessen wurden und in einem Fall seit drei Monaten veraltet sind.
Was "Ultrafast" bei jedem Modell tatsächlich ist
On neither model is Ultrafast a separate checkpoint. You send the same model id and flip a service tier — model: "gpt-6.1-sol" with service_tier: "ultrafast" in the Responses API — and OpenAI schedules your request on the low-latency path. The weights, the answers and the context window are unchanged. On GPT-6.1 Sol that window is 1,050,000 tokens with a 922,000-token maximum input and 128,000 maximum output; GPT-5.6 Sol carries the identical window and output ceiling, and differs mainly in knowledge cutoff (February 16, 2026 against April 30, 2026) and in the reasoning ladder, where GPT-5.6 Sol still accepts none and GPT-6.1 Sol does not.
Bei dem Vergleich geht es also nicht darum, „welches Modell schneller denkt“, sondern darum, „welche Generation derselben Stufe dir offensteht“ – und die Antwort hat sich vor vier Tagen geändert.

Die veröffentlichten Multiples und die eine Zahl, die bei 14x blieb
OpenAI hat zwei Geschwindigkeitsaussagen über diese Stufe veröffentlicht, zu zwei Modellen, und keine von beiden ist eine allgemeine Aussage über „Ultrafast“.
• GPT-6 Astra Ultrafast — „generiert Tokens bis zu 8-mal schneller als GPT-6 Astra im Standardmodus in Codex“. Dies ist die aktuelle Schlagzeile dieser Stufe, wiederholt in der Geschwindigkeitsdokumentation auf der ChatGPT-Seite.
• GPT-5.6 Sol Ultrafast — am 13. August 2026 angekündigt als „bis zu 14-mal schneller als die Standardverarbeitung“, in begrenzter Vorschau für ausgewählte Kunden.
Beachten Sie, was fehlt. Für GPT-6.1 Sol Ultrafast gibt es keinen veröffentlichten Geschwindigkeitsmultiplikator. Die Dokumentationsseite beschreibt die Stufe, nennt ihre Ratenlimits und ihre Datenresidenz-Ausrichtung und verweist auf die Preistabelle – doch der einzige modellspezifische Multiplikator im gesamten Dokumentationsbestand gehört zu Astra. Die ehrliche Position ist, dass „bis zu 8x“ Astras Messung ist, auf demselben Serving-Stack, und es ist die Zahl, mit der der Rollout verkauft wird, ohne dass sie für Sol von irgendjemandem reproduziert wurde – innerhalb von OpenAI oder außerhalb.
Die 14x-Zahl verdient mehr Misstrauen, als ihr üblicherweise entgegengebracht wird, und zwar wegen ihres Alters. Sie wurde Mitte August für eine Tarifstufe angekündigt, die noch immer nicht allgemein verfügbar ist, und blieb etwa zwei Monate lang unverändert, während die Tarifstufe selbst um zwei andere Modelle herum neu aufgebaut wurde. In dieser Zeit geschah das Naheliegende, was man erwarten würde – dass 5.6 Sol's Ultrafast die Vorschauphase verlassen und einen Preis bekommen würde – nie. Stattdessen bekam GPT-6 Astra es am 29. September und GPT-6.1 Sol bekam es am 8. Oktober. Eine Zahl, die nur in einer Ankündigung existiert und an eine Konfiguration geknüpft ist, die niemand kaufen kann, ist Marketingtext, bis sie auf einer Preisliste steht.
Seite an Seite: Was jede einzelne kostet und wer sie erreichen kann
• Standardtarif — GPT-6.1 Sol 2,00 $ Eingabe / 0,10 $ zwischengespeichert / 2,50 $ Cache-Schreiben / 10,00 $ Ausgabe pro 1 Mio. Token vs. GPT-5.6 Sol 4,00 $ / 0,40 $ / 5,00 $ / 20,00 $
• Ultraschneller Tarif — GPT-6.1 Sol 12,00 $ / 0,60 $ / 15,00 $ / 60,00 $, veröffentlicht über die 6x-Standard-Regel und mit eigener Zeile in der Ultrafast-Preistabelle im Vergleich zu GPT-5.6 Sol, kein veröffentlichter Tarif
• Langkontext über 272K Eingabe-Tokens — GPT-6.1 Sol mit 2x Eingabe- und Cache-Raten sowie 1,5x Ausgabe für die gesamte Anfrage neu bepreist, was eine Ultrafast-Langkontext-Zeile von $24.00 / $1.20 / $30.00 / $90.00 gegenüber dem Ultrafast-Äquivalent von GPT-5.6 Sol ergibt, das niemand veröffentlicht hat
• Verfügbarkeit der Stufe — GPT-6.1 Sol: alle API-Nutzer, vorbehaltlich separater Ratenlimits, sowie Codex und ChatGPT Work bei Pro für 500 $ und berechtigten Enterprise- und Edu-Plänen vs. GPT-5.6 Sol: eingeschränkte Vorschau für ausgewählte API-Kunden
• Ratenlimits zum Start — GPT-6.1 Sol hat ein eigenes Ultrafast-Budget, getrennt von den Standard- und Fast-Limits, pro Organisation festgelegt und auf Anfrage erhöht im Vergleich zu GPT-5.6 Sol, nicht veröffentlicht
• Datenresidenz — GPT-6.1 Sol unterstützt US- und EU-Residenz sowie globale Verarbeitung unter Fast und Ultrafast im Vergleich zu GPT-5.6 Sol mit US-Residenz und globaler Verarbeitung
• Geschwindigkeitsfaktor — GPT-6.1 Sol, keine Angabe veröffentlicht vs. GPT-5.6 Sol, „bis zu 14x" in der Ankündigung vom August, nicht reproduziert
• Kontext- und Ausgabegrenze — 1.050.000 bzw. 128.000 für beide
Eine Asymmetrie in dieser Liste ist es wert, hervorgehoben zu werden. GPT-6.1 Sol ist die einzige Ultrafast-Konfiguration mit EU-Datenresidenz: Astras Ultrafast ist nur in den USA verfügbar, und 5.6 Sol ist überhaupt nicht offen. Wenn Ihre Workload an EU-Verarbeitung gebunden ist, ist der 8. Oktober das erste Datum, an dem diese Stufe in irgendeiner Form für Sie verfügbar war.
Bei einem Abonnement liegt der Unterschied in einem Plan, nicht in einem Modell.
In Codex und ChatGPT Work verhalten sich beide Generationen strukturell gleich — Ultrafast ist eine Geschwindigkeitseinstellung für ein Modell, das Sie bereits haben —, aber die Zugangsbeschränkung davor ist neu. Ultrafast ist bei Pro für 500 $ sowie bei berechtigten Enterprise- und Edu-Tarifen verfügbar und in Enterprise-Workspaces standardmäßig deaktiviert, bis ein Administrator es aktiviert. Innerhalb eines Abonnements wird die inkludierte Nutzung mit dem 8-Fachen des Standard-Tarifs verbraucht, und gekaufte Credits oder Enterprise-Pay-as-you-go werden mit dem 6-Fachen abgerechnet; in der API beträgt der Multiplikator einheitlich 6x in jeder Preiszeile.
Speziell für GPT-5.6 Sol ist nichts davon bisher erreichbar. Es gibt keinen Abo-Pfad – die Geschwindigkeitsdokumentation auf ChatGPT-Seite führt Ultrafast als Unterstützung für GPT-6 Astra und GPT-6.1 Sol auf – und der API-Pfad ist weiterhin hinter einer Preview-Kohorte verschlossen. Was auch immer die 14x-Zahl verspricht, sie verspricht es einem Satz von Konten, der sich seit zwei Monaten nicht erweitert hat.

Welche man tatsächlich verwenden sollte und wann man abwarten sollte
Wenn Sie heute anfangen, beantwortet sich die Frage größtenteils von selbst: GPT-6.1 Sol Ultrafast ist erwerbbar, bepreist und dokumentiert, GPT-5.6 Sol Ultrafast hingegen nicht. Der Grund, stattdessen zum älteren Modell zu greifen, ist überhaupt nicht die Stufe – sondern dass GPT-5.6 Sol seit dem 9. Juli 2026 im Umlauf ist, und wenn Sie Prompt-Suiten, Evaluationen und Kostenmodelle darauf aufgebaut haben, sind die Migrationskosten für den Wechsel zu einem Sol-Refresh mit einem anderen Wissensstichtag und einer strikt schmaleren Reasoning-Leiter real, selbst wenn der Preis halbiert wird. Vollziehen Sie diesen Wechsel nach seinem eigenen Zeitplan, nicht deshalb, weil endlich eine Geschwindigkeitseinstellung verfügbar geworden ist.
Die Entscheidungsregel für die Stufe selbst ist diejenige, die Astras Zahlen implizieren und Sols bestätigen: Der sechsfache Preis für eine Latenzsenkung ist ein gutes Geschäft, wenn ein Mensch oder ein Agent auf die Ausgabe wartet, und ein schlechtes, wenn ein Auftrag bis zum Morgen Zeit hat. Nichts am Rollout von GPT-6.1 Sol ändert diese Rechnung; er macht sie nur auf einem günstigeren Basismodell verfügbar, wo die absolute Rechnung für einen schnellen Turn kleiner ist.
Und wenn Sie stattdessen die Fast-Stufe möchten, können Sie sie allein anhand der Preistabelle ableiten: 2x Standard, und Fast ist die beständige mittlere Option, seit OpenAI am 30. Juli 2026 Priority processing umbenannt hat. Ultrafast ist nach wie vor die Stufe, bei der man ein ungemessenes Versprechen kauft, und auf der GPT-5.6 Sol-Seite eine, die man überhaupt nicht kaufen kann.
Einen von beiden mit einer einzigen Taste anrufen
GPT-5.6 Sol und GPT-6.1 Sol im Standard-Tarif sind beide auf OrcaRouter — openai/gpt-5.6-sol zu 4,00 $ Eingabe und 20,00 $ Ausgabe pro Million Token, openai/gpt-6.1-sol zu 2,00 $ und 10,00 $ — mit 0 % Aufschlag bereitgestellt, wobei der Listenpreis des Anbieters durchgereicht wird, sodass eine Preisänderung des Anbieters Ihre Rechnung am selben Tag erreicht, an dem sie auf der Preisliste erscheint. Das ist bei diesem Paar wichtiger als üblich, denn der Preis von 4,00 $ / 20,00 $ für GPT-5.6 Sol ist ausdrücklich ein Aktionspreis, und OpenAI gibt an, dass er mindestens bis zum 21. November 2026 verfügbar ist. Wenn dieses Zeitfenster endet, verringert sich der Abstand zwischen den beiden Generationen, und eine Plattform mit Preisweitergabe bedeutet, dass Sie es Ihren Nutzungszahlen entnehmen statt einer Verlängerungs-E-Mail.
Derselbe Schlüssel und derselbe Endpunkt tragen mehr als 200 Modelle, sodass der Vergleich der beiden Sol-Generationen mit Ihrem eigenen Traffic weder zwei Integrationen noch zwei Verträge erfordert, und automatisches Failover hält einen Produktionspfad aufrecht, wenn ein Anbieter beeinträchtigt ist. Wo eine einzelne Antwort nicht ausreicht, fügt die Routing-DSL mehrere Modelle zu einem Aufruf zusammen, und Modellfusion stellt ein Panel dahinter.
Was wir nicht anbieten, ist Ultrafast. Bei beiden Modellen ist es ein Service-Tier-Flag auf einem OpenAI-Konto und kein separat routbares Modell, daher bleibt es innerhalb Ihrer direkten OpenAI-Integration – und bei GPT-5.6 Sol ist es dort nicht einmal allgemein verfügbar. Wir sagen das so deutlich, weil die Alternative darin bestünde, eine Fähigkeit zu implizieren, die wir nicht haben. Und das ist kein Satz, den wir in diesem Blog stehen haben wollen.

In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
