
GPT-6.1 Sol Preisgestaltung: Die Preisliste, der eine Zähler, der sich bewegte, und die 272K-Klippe
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Diese Seite ist die Preisliste. GPT-6.1 Sol kostet 2,00 $ pro Million Input-Token, 0,10 $ pro Million gecachter Input-Token, 2,50 $ pro Million Cache-Schreib-Token und 10,00 $ pro Million Output-Token im Standard-Tarif des Anbieters, und GPT-6 Sol — die Stufe, die dieses Modell ersetzt und die unser Katalog bedient — steht bei 2,00 $, 0,20 $, 2,50 $ und 10,00 $ für dieselben vier Messgrößen. Eine Zahl unterscheidet sich zwischen den beiden Karten, die Schwelle, oberhalb derer beide neu bepreisen, liegt an derselben Stelle, und die Rabatte unterhalb des Listenpreises sind Multiplikatoren und keine zweite Preisliste. Alles auf dieser Seite stammt von der eigenen Entwickler-Preisseite des Anbieters und dessen beiden Modellseiten für GPT-6.1 Sol und GPT-6 Sol, alle abgerufen am 7. Oktober 2026, sowie aus unseren eigenen Modellkarten, wo ein Wert als unserer gekennzeichnet ist. Kein Launch-Narrativ wird hier wiederholt; wenn Sie wissen möchten, was ausgeliefert wurde, ist das eine andere Seite.
Die Preisliste, mit GPT-6 Sols
OpenAI veröffentlicht diese als Preise pro Million Tokens auf der Standard-Verarbeitungsstufe, für eine Anfrage mit 272.000 oder weniger Eingabe-Tokens. Die beiden Zeilen, auf die es ankommt, sind absichtlich benachbart, denn das gesamte Argument der Veröffentlichung ist in dem Paar sichtbar: Liest man jede Messgröße der Reihe nach von oben nach unten, ändert sich genau eine davon.
• GPT-6.1 Sol Eingabe — $2.00 pro Million Tokens, unverändert gegenüber GPT-6 Sol.
• GPT-6.1 Sol Cache-Eingabe — $0.10 pro Million Tokens, halbiert gegenüber den $0.20 von GPT-6 Sol.
• GPT-6.1 Sol Cache-Schreibvorgang — $2.50 pro Million Tokens, unverändert gegenüber GPT-6 Sol.
• GPT-6.1 Sol Ausgabe — $10.00 pro Million Tokens, unverändert gegenüber GPT-6 Sol.
• GPT-6 Sol-Eingabe — 2,00 $ pro Million Tokens.
• GPT-6 Sol zwischengespeicherte Eingabe — 0,20 $ pro Million Tokens.
• GPT-6 Sol Cache-Schreibvorgang — 2,50 $ pro Million Tokens.
• GPT-6 Sol-Ausgabe — 10,00 $ pro Million Tokens.
Drei dieser acht Zeilen sind dieselbe Zahl, zweimal geschrieben, und genau darum geht es: Das ist keine Neupreisgestaltung, sondern ein einziger Zähler, der sich bei einem einzigen Modell bewegt. Cache-Schreibvorgänge kosten auf beiden Karten das 1,25-Fache des Eingabe-Tarifs ohne Cache, also sind 2,50 $ auf beiden 2,00 $ × 1,25 — der Schreibaufschlag ist eine Eigenschaft der Familie, nicht der Version. Cache-Lesevorgänge sind die einzige Zeile, bei der sich die beiden Modelle unterscheiden: Bei GPT-6.1 Sol kostet ein Cache-Lesevorgang 5 % des Eingabe-Tarifs, bei GPT-6 Sol sind es 10 %, und OpenAI gibt beide als Bruchteile des Eingabe-Tarifs an, nicht als eigenständige Preise.
Eine Anmerkung dazu, wie diese Seite Zahlen angibt. OpenAI veröffentlicht die Preisliste als einheitlichen Listenpreis pro Meter, ohne dass einer der acht obigen Zeilen ein Qualifizierer für den Reasoning-Aufwand beigefügt ist, sodass keine von ihnen mit einem bestimmten Aufwandsniveau angegeben wird. Der Aufwand ändert, wie viele Tokens eine Aufgabe verbraucht, nicht, was ein Token kostet, weshalb die Preisliste aufwandsunabhängig ist, Ihre Rechnung aber nicht. Nichts auf dieser Seite ist ein direkter Vergleich bei identischem Aufwand gegen ein konkurrierendes Modell, und kein solcher Vergleich wird weiter unten an irgendeiner Stelle impliziert — wo eine Zahl vom Aufwand abhängen würde, nennt diese Seite den Aufwand, mit dem sie erstellt wurde.

Die eine Zeile, die sich geändert hat: gecachte Eingabe, von 0,20 $ auf 0,10 $
Ein Cached-Input-Zähler bepreist den Teil einer Anfrage, der sich nicht geändert hat. Wenn ein langer, stabiler Präfix – ein System-Prompt, eine Reihe von Tool-Schemata, ein abgerufener Korpus, das angesammelte Transkript einer Schleife – bewusst gespeichert wird, damit die nächste Anfrage ihn wiederverwenden kann, werden die wiederverwendeten Tokens zum Cache-Tarif statt zum Eingabe-Tarif abgerechnet, und die Tokens, die überhaupt erst gespeichert werden, werden zum Cache-Schreib-Tarif abgerechnet. Es ist ein Rabatt auf Wiederholung, und es existiert, weil die Alternative für den Anbieter darin besteht, denselben Präfix bei jedem Aufruf von Grund auf neu zu berechnen.
Diesen Tarif zu halbieren ist nicht dieselbe Art von Neuigkeit wie den Input-Tarif zu halbieren, und der Unterschied ist es wert, präzise benannt zu werden. Der Input-Satz bestimmt, was jedes ungecachte Token in der Familie kostet; ihn zu halbieren wäre eine Neufestsetzung der Preise für die gesamte Kataloglinie. Der Cache-Satz ist eine Rabatttiefe – wie weit unter dem Input-Satz ein wiederverwendetes Token liegt –, ihn zu verschieben ist also eine Änderung der Belohnung für ein bestimmtes Verhalten und nicht eine Änderung an der Grundlinie. Der Input-Satz von GPT-6.1 Sol beträgt 2,00 $, genau das, was GPT-6 Sol verlangt, daher wird eine Anfrage ohne gecachten Präfix bei den beiden Modellen identisch abgerechnet. Den Cache-Tarif zu halbieren hebt den Rabatt auf den Input-Satz von 90 % auf 95 %, und das erreicht genau die Workloads, deren Präfixe lang genug und oft genug wiederverwendet werden, um sich überhaupt auf der Linie niederzuschlagen. Lies den verschobenen Tarif als „dieselbe Aufgabe kostet weniger, wenn du cachst“ statt als „das Modell ist billiger geworden“, und die Karte ist nicht mehr überraschend.
Die Rechnung ergibt sich aus den beiden Zeilen und nichts anderem. Eine Million gecachte Eingabe-Token kostet 0,10 $ bei GPT-6.1 Sol und 0,20 $ bei GPT-6 Sol, die Veröffentlichung ist also zehn Cent pro gecachter Million wert – ein Wert, der bei einem einzelnen Aufruf trivial und bei einem langen Lauf von Bedeutung ist, weil ein gecachtes Präfix einmal pro Turn gelesen wird. Cache-Schreibvorgänge bleiben unverändert bei 2,50 $, der Break-even-Punkt für das Caching überhaupt wird durch die Veröffentlichung also nicht verändert: Die Amortisation eines Schreibaufschlags kommt aus der Wiederverwendung des Präfixes, nicht daraus, welcher der beiden gecachten Tarife gilt.
Bei über 272.000 Eingabe-Tokens wird die gesamte Anfrage neu bepreist.
Beide Karten verfügen über eine Long-Context-Stufe, und die Preisseite von OpenAI gibt die Regel für beide gleich an: Prompts mit mehr als 272K Eingabe-Tokens werden mit 2× Eingabe- und Cache-Raten und 1,5× Ausgabe bepreist für die gesamte Anfrage. Die gesamte Anfrage wird neu bepreist – nicht nur die Tokens jenseits der Grenze. Dieser Satz ist der, den man aus diesem Abschnitt mitnehmen sollte, denn hier hört eine Tarifkarte auf, eine Nachschlagetabelle zu sein: Bei 272.001 Eingabe-Tokens wird die gesamte Anfrage, einschließlich des ersten Tokens, nach den Long-Context-Spalten abgerechnet.
Die neu bepreiste Karte für GPT-6.1 Sol bei über 272.000 Eingabe-Tokens:
• Eingabe — 4,00 $ pro Million Tokens, 2× des Kurzkontext-Tarifs.
• Zwischengespeicherte Eingabe — 0,20 $ pro Million Tokens, 2× des Kurzkontext-Tarifs.
• Cache-Schreiben — 5,00 $ pro Million Tokens, 2× des Kurzkontext-Tarifs.
• Ausgabe — 15,00 $ pro Million Tokens, 1,5× des Kurzkontext-Tarifs.
Und dieselbe Stufe bei GPT-6 Sol, damit die beiden Zeilen gegeneinander gelesen werden können:
• Eingabe — 4,00 $ pro Million Tokens.
• Zwischengespeicherte Eingabe — 0,40 $ pro Million Tokens.
• Cache-Schreibvorgang — 5,00 $ pro Million Tokens.
• Ausgabe — 15,00 $ pro Million Tokens.
Erneut wird die gesamte Anfrage neu bepreist, nicht der übersteigende Teil, sodass ein Prompt mit 273.000 Tokens für alle 273.000 Tokens mit 4,00 $ Input berechnet wird statt mit 2,00 $ für die ersten 272.000 und 4,00 $ für die letzten tausend. Dadurch wird das Überschreiten der Schwelle zu einem Sprung statt zu einer Steigung, und die Änderung bei gecachtem Input sieht oberhalb der Grenze anders aus als darunter. Die 0,20 $, die GPT-6.1 Sol für einen gecachten Lesevorgang oberhalb von 272K berechnet, sind genau der Tarif, den GPT-6 Sol darunter berechnet, sodass eine gecachte Workload mit langem Kontext auf dem neueren Modell den Vorabpreis zahlt. Die Ersparnis bleibt in relativer Hinsicht oberhalb der Grenze bestehen – 0,20 $ gegenüber 0,40 $ von GPT-6 Sol sind immer noch eine Halbierung –, doch die viel zitierte Zehn-Cent-Ersparnis gilt nicht für die Anfrage, die die Schwelle überschreitet, weil diese Anfrage überhaupt nicht nach der Kurzkontext-Karte abgerechnet wird.

Die Rabattstufen, als Multiplikatoren
Alles unterhalb des Standard-Listenpreises ist ein Multiplikator, der auf die oben stehende Karte angewendet wird, statt einer separaten Preisliste. Sie als Multiplikatoren anzugeben, macht sie übertragbar: Dieselben drei Faktoren gelten für alle vier Zähler bei beiden Modellen, sodass ein Leser, der die Standardkarte hat, die gesamte Staffelstruktur hat.
• Batch — 50 % des Standards. Die Batch-Preisgestaltung von OpenAI beträgt bei beiden Modellen über alle vier Messgrößen hinweg genau die Hälfte: 1,00 $ Eingabe, 0,05 $ zwischengespeicherte Eingabe, 1,25 $ Cache-Schreibvorgang und 5,00 $ Ausgabe pro Million bei GPT-6.1 Sol sowie 1,00 $, 0,10 $, 1,25 $ und 5,00 $ bei GPT-6 Sol.
• Flex — 50 % des Standards und bei beiden Modellen Zeile für Zeile identisch mit Batch, sodass die Wahl zwischen ihnen eine Frage der Terminplanung und nicht des Preises ist.
• Fast-Modus — 2× Standard über alle vier Messgrößen hinweg bei beiden Tarifkarten, ohne dass in einer der beiden Preistabellen eine Ausnahme aufgeführt ist. Der Fast-Modus kostet 4,00 $ Eingabe, 0,20 $ zwischengespeicherte Eingabe, 5,00 $ Cache-Schreibvorgang und 20,00 $ Ausgabe pro Million bei GPT-6.1 Sol, gegenüber 4,00 $, 0,40 $, 5,00 $ und 20,00 $ bei GPT-6 Sol — die beiden Zeilen unterscheiden sich nur in der Zeile für zwischengespeicherte Eingaben und nur um denselben 2×-Faktor, den der eigene Standard-Cache-Tarif des jeweiligen Modells bereits aufweist.
• Regionale Verarbeitung — ein Aufschlag von 10 % auf die jeweils geltende Stufe, für Modelle, die am oder nach dem 5. März 2026 veröffentlicht wurden, bei jeder anderen Residenz als der Standardresidenz.
Der Fast mode hat eine Verfügbarkeitsbeschränkung, die der Preis allein nicht verrät. Auf der eigenen Modellseite von OpenAI für GPT-6.1 Sol heißt es, dass Fast mode mit EU-Datenresidenz nicht verfügbar ist, und in seinen Leitlinien zur Datenresidenz wird GPT-6.1 Sol unter den Modellen aufgeführt, die EU-Residenz mit Standard-, Flex- und Batch-Verarbeitung unterstützen. Innerhalb der EU ist die Stufenleiter also um zwei Sprossen kürzer, nicht um eine: Die Stufen zum halben Preis sind vorhanden, die Stufe zum doppelten Preis nicht. Ein Leser, der ein europäisches Deployment mit einem US-Deployment vergleicht, sollte es mit Standard vergleichen, denn das ist die schnellste Stufe, die ihm zur Verfügung steht – eine Zahl für den Fast mode bei einem EU-Workload zu nennen, beschreibt eine Konfiguration, die der Anbieter nicht anbietet.
Nichts auf dieser Karte ist werblich, und nichts hat ein Ablaufdatum.
Die obigen Zeilen zu GPT-6.1 Sol sind der Listenpreis. Die Preisseite von OpenAI versieht sie weder mit einem Aktionshinweis noch mit einem Enddatum, und keiner der vier Messwerte auf der Kurzkontext- oder der Langkontextkarte ist als zeitlich begrenzter Wert gekennzeichnet. Das sollte ausdrücklich erwähnt werden, denn die Modellfamilie hat ein Gegenbeispiel direkt auf derselben Seite: Der Aktionspreis von GPT-5.6 Sol trägt eine Fußnote, die ihn mindestens bis zum 21. November 2026 festschreibt, was bedeutet, dass jeder heute genannte GPT-5.6 Sol-Preis ein Preis ist, mit dem ein bekannter Überprüfungspunkt verbunden ist. Nichts bei GPT-6.1 Sol weist diese Form auf.
Die praktische Konsequenz ist, dass diese Seite keinen Datumsprüfungs-Vorbehalt bei den Zahlen selbst braucht – sie braucht einen auf der Seite, die Sie gerade lesen, weil sich ein Listenpreis ändern kann, ohne dass ein Ablaufdatum ausgelöst wurde. Das bedeutet außerdem, dass die GPT-6.1-Sol-Karte die richtige Zeile ist, um ein Kostenmodell darauf aufzubauen, wenn Sie zwischen den beiden Sol-Stufen wählen und möchten, dass der Vergleich stabil bleibt: Der $0.20-Cache-Tarif von GPT-6 Sol ist ebenfalls ein gewöhnlicher Listenpreis, an den keine Promotion geknüpft ist, sodass die Zehn-Cent-Lücke zwischen ihnen ein struktureller Unterschied in den Karten ist und nicht ein vorübergehender Rabatt, den ein Modell gegen das andere fährt.
Wie man die Preisaussage von jemand anderem zu GPT-6.1 Sol interpretiert
Zwei Fragen entscheiden fast jeden Streit darüber, was ein Modell der Sol-Klasse kostet, und beide lassen sich anhand der Karte beantworten statt anhand der Prosa drumherum.
• Welcher Zähler wird zitiert? Input, gecachter Input, Cache-Write und Output sind vier verschiedene Zahlen bei derselben Anfrage, und ein einzelner Schlagzeilenpreis ist fast immer der Input-Zähler, während die anderen drei implizit bleiben. Eine Angabe, die wie Gesamtkosten klingt, ist meist ein Input-Tarif multipliziert mit einem angenommenen Token-Mix, und in der angenommenen Mischung liegt der Dissens.
• Welche Kontextstufe wurde angenommen? Die Karten für kurzen und langen Kontext unterscheiden sich um Faktor 2 bei Input und Cache und um Faktor 1,5 bei Output, und die Stufe wird durch die gesamte Anfrage bestimmt, nicht durch den Überschuss, sodass eine ohne Stufe genannte Zahl eine Zahl ist, die sich in dem Moment ändert, in dem die Anfrage 272.000 Input-Tokens überschreitet.
• Welche Verarbeitungsstufe wurde angenommen? Standard, Batch, Flex und Fast unterscheiden sich um Faktoren von 2× und 50 %, und ein Preis, der ohne Angabe genannt wird, welcher gilt, ist ein Preis mit einem eingebauten Faktor vier an Mehrdeutigkeit, bevor überhaupt eine Frage zum Zähler gestellt wird.
• Welches Effort-Level wurde angenommen, wenn eine Token-Anzahl im Spiel ist? Die Tarife sind unabhängig vom Effort, die Token-Anzahlen jedoch nicht, sodass jede Kostenangabe pro Aufgabe den Reasoning-Effort erbt, bei dem sie gemessen wurde – und ein Vergleich zwischen zwei Modellen mit unterschiedlichen Effort-Einstellungen ist kein Vergleich ihrer Preise.
Beantworte jene vier, und entweder überlebt eine Preisbehauptung oder sie überlebt nicht. Was sie nicht tun sollte, ist, mit den vier Messgeräten dieser Seite verglichen zu werden, ohne dass zuerst die Stufe und das Messgerät genannt werden, denn die beiden Karten liegen genau nebeneinander, damit die einzige bewegliche Linie sichtbar ist und nichts anderes damit verwechselt wird.

Wo die GPT-6-Sol-Stufe bereitgestellt wird
OrcaRouter bedient die GPT-6-Stufe zu OpenAIs eigenem Listenpreis, ohne dass etwas aufgeschlagen wird. Die Modellseite unter https://www.orcarouter.ai/models/openai/gpt-6-sol führt GPT-6 Sol mit 2,00 $ für den Input und 10,00 $ für den Output pro Million Tokens auf und stimmt Zeile für Zeile mit der obigen Karte überein, bei 0 % Aufschlag, und der Katalog umfasst mehr als 200 Modelle zu denselben Konditionen. Unsere Karte für diese Route weist dieselben Werte für gecachten Input mit 0,20 $ und Cache-Schreiben mit 2,50 $ aus, die OpenAI veröffentlicht, sodass die Zahlen Zähler für Zähler übereinstimmen; betrachten Sie jeden gecachten Wert auf dieser Seite als Wiedergabe der von OpenAI veröffentlichten Rate und nicht als eigenständiges Angebot von uns. GPT-6.1 Sol ist ebenfalls in unserem Katalog aufgeführt – die Live-Karte für openai/gpt-6.1-sol nennt ein Veröffentlichungsdatum vom 29. September 2026, wobei beide Preisstufen die von OpenAI spiegeln, sowie eine Token-Zahl der letzten sieben Tage im dreistelligen Millionenbereich –, wer also die neuere Stufe sucht, sollte die Zahlen jener Seite selbst lesen, statt diese Seite als letztes Wort dazu zu betrachten. Preise ändern sich; maßgeblich ist die Seite.
In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
