Redaktionelle flache Vektorillustration für den Hero-Bereich eines Technologie-Blogs über die Preisgestaltung von Flaggschiff-Modellen: ein großer abgerundeter Modell-Chip in tiefem Blau mit sanftem Cyan-Schein auf hellem Hintergrund, ein Papier-Preisschild an seiner Ecke befestigt, drei Token-Ströme, die aus dem Chip in ein kreisförmiges Preismessgerät mit kleinen abstrakten Strichen fließen, ein kleiner Stapel zwischengespeicherter Blöcke neben dem Messgerät und ein schmales Kalenderblatt, das von links hereingleitet. Weißer Hintergrund mit sanften Blau-Cyan-Verlaufselementen und einem subtilen warmen Akzent; minimale flache Liniensymbole; saubere moderne geometrische serifenlose Typografie; kein lesbarer Text.
Guides & Insights

GPT-5.6 Sol API Preise: 4 $ / 20 $ pro 1 Mio. Tokens nach der Preissenkung

Autor

Gideon Frost

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

GPT-5.6 Sol kostet $4.00 pro Million Eingabe-Tokens und $20.00 pro Million Ausgabe-Tokens auf der GPT-5.6 Sol API mit Stand von heute – derselbe Pass-through-Satz, den die Flaggschiff-Stufe im OrcaRouter-Verzeichnis führt, geprüft am 25.08.2026 ohne Aufschlag. Am 24. August 2026 senkte OpenAI den API-Preis von Sol um 20 % bei den Eingabe- und etwa 33 % bei den Ausgabe-Tokens – eine zeitlich begrenzte Sonderaktion, die mindestens bis zum 21. November 2026 läuft. Es ist immer noch die teuerste Stufe in der GPT-5.6-Familie und die erste Stufe, deren Listenpreis sich seit der Senkung vom 30. Juli verändert hat, die das Flaggschiff übersprungen hat. Die Stellschrauben zählen mehr als die Schlagzeile: Wiederverwendete Eingaben werden über Prompt-Caching mit $0.40 pro Million berechnet, die Batch-API sinkt auf $2.00 / $10.00, und der Schnellmodus tauscht einen 2x-Aufschlag gegen bis zu 2.5x Geschwindigkeit. Diese Seite ist die Preisreferenz speziell für Sol – die genaue Preisliste, was eine Anfrage tatsächlich kostet, wie sich das Flaggschiff im Vergleich zum Feld schlägt, wann es der falsche Kauf ist und wie man es über einen OpenAI-kompatiblen Endpoint mit einem eigenen Schlüssel aufruft.

Preise gelten pro Million Tokens (Eingabe / Ausgabe), Stand 2026-08-25. Der Preisnachlass — 20 % auf die Eingabe, etwa 33 % auf die Ausgabe, gültig bis mindestens 21. November 2026 — stammt aus OpenAIs eigener Ankündigung und wird zum Nennwert übernommen; die Dollar-Beträge sind den veröffentlichten API-Preisen von OpenAI entnommen und mit der OrcaRouter-Modellseite für GPT-5.6 Sol abgeglichen. Cache-, Batch-, Fast-Mode- und Long-Context-Preise wurden von OpenAI angekündigt. Dabei handelt es sich um Aktionspreise, nicht um eine dauerhafte Preissenkung — Preise verändern sich und können auch wieder auf das alte Niveau zurückkehren; prüfen Sie, bevor Sie darauf aufbauen.

Der genaue Preis, heute verifiziert.

Hier ist die vollständige Tarifkarte für GPT-5.6 Sol, verifiziert am 25.08.2026 zu den Aktionspreisen. Dieselben Preise gelten für Anfragen mit dem gpt-5.6-Alias, und die Ermäßigungen werden schrittweise auf berechtigte ChatGPT-Work- und Codex-Guthabenpläne ausgeweitet; ChatGPT-Pro-, Plus- und Business-Abonnements bleiben unverändert.

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

• Eingabe — 4,00 $ pro 1 Million Token bei einem Cache-Miss (reduziert von 5,00 $, 20 % Rabatt bis zum 21. November).

Output — $20.00 pro 1 Mio. Tokens (statt $30.00, ca. 33 % Rabatt bis zum 21. November).

• Prompt-Cache-Lesen — 0,40 $ pro 1 Mio. Token (vorher 0,50 $), 90 % Rabatt auf jede erneut gesendete Eingabe.

• Prompt-Cache-Schreiben — $5,00 pro 1M Tokens (bisher $6,25).

• Long-Context-Stufe — Eingaben über etwa 272.000 Token werden mit 8,00 $ Input / 30,00 $ Output abgerechnet (zuvor 10,00 $ / 45,00 $; dieselben 2x-Input- und 1,5x-Output-Multiplikatoren gelten nun auf der niedrigeren Basis).

• Batch-API — 2,00 $ Eingabe / 10,00 $ Ausgabe, pauschal 50 % Rabatt (statt 2,50 $ / 15,00 $), asynchron, in der Regel innerhalb von etwa 24 Stunden verfügbar.

• Schnellmodus — 8,00 $ Eingabe / 40,00 $ Ausgabe (zuvor 10,00 $ / 60,00 $), ein 2x-Aufschlag für bis zu etwa 2,5-fache Ausgabegeschwindigkeit bei unveränderter Intelligenz.

• Kontextfenster — ~1,05M Tokens, bis zu 128K Ausgabe.

OrcaRouter reicht den Anbieterpreis ohne Aufschlag durch, sodass der Betrag im Verzeichnis genau der Betrag ist, den Sie zahlen – und eine Preissenkung des Anbieters erscheint noch am selben Tag in der Auflistung, an dem sie wirksam wird. Auf der Live-Modellseite zeigt die Karte: 4,00 $ / 20,00 $ pro 1M, Cache-Read 0,400 $, mit Vision-, Tools-, JSON- und Reasoning-Badges. Dies ist das erste Mal, dass sich der Listenpreis von Sol seit der Senkung vom 30. Juli geändert hat, die GPT-5.6 Luna auf 0,20 $ / 1,20 $ und GPT-5.6 Terra auf 2 $ / 12 $ brachte, während das Flaggschiff unverändert blieb; die Senkung vom 24. August gilt dem Flaggschiff.

Die Hebel, die den effektiven Preis verändern

Die Basisrate ist nur der Ausgangspunkt. Vier Modifikatoren ändern, was Sol dich tatsächlich kostet:

• Prompt-Caching – wiederverwendeter Kontext wird mit 0,40 $ pro Million abgerechnet statt mit 4 $ für frischen Kontext; Cache-Schreibvorgänge kosten 5,00 $ pro Million. Für jeden Agenten oder Chat, der bei jeder Runde ein großes Präfix erneut sendet, ist Caching der größte Hebel auf der Rechnung. OpenAI verknüpft den Cache mit Projekt und API-Schlüssel – wer also bei einem Schlüssel (einem Kanal) bleibt, sorgt dafür, dass die Cache-Treffer ankommen.

• Langkontext-Stufe — eine Anfrage, deren Eingabe etwa 272.000 Token überschreitet, wechselt vom Basispreis auf $8 / $30. Einige wenige riesige Prompts können Ihren Durchschnittspreis unmerklich erhöhen. Bündeln oder kürzen Sie daher, wenn Sie den tiefen Kontext nicht wirklich benötigen.

• Batch — Die Batch-API von OpenAI führt Jobs asynchron aus, mit einer Bearbeitungszeit von etwa 24 Stunden zu exakt dem halben Preis: $2.00 / $10.00, mit gecachtem Input für $0.20 und Cache-Schreibvorgängen für $2.50. Sie ergänzt Prompt-Caching und eignet sich für Evals, Massenklassifizierung und Offline-Generierung, bei denen Latenz keine Rolle spielt.

• Schnellmodus – 8 $ / 40 $ für bis zu ~2,5-fache Ausgabedurchsatzrate, nützlich für latenzkritische Arbeiten, bei denen Benutzer warten, wie Live-Coding-Assistenz. Er wird pro Token zum doppelten Standardsatz abgerechnet, zählt nicht zu gekauften Scale-Tier-TPM-Paketen und kann auf Standardverarbeitung zurückgreifen, wenn Sie das gemeinsame Ratelimit überschreiten.

Was eine Anfrage tatsächlich kostet

Preise pro Token sind abstrakt, daher hier einige durchgerechnete Beispiele zu den heutigen Kursen:

• Ein einzelner Chat-Aufruf, 50K Eingabe + 20K Ausgabe — 0,20 $ + 0,40 $ = 0,60 $ (war 0,85 $).

• 1M Eingabe + 1M Ausgabe — $4 + $20 = $24 (war $35).

• Agentic Turn, {{1}}200K gecachter Kontext + 20K frischer Input + 30K Output{{/1}} — $0,08 + $0,08 + $0,60 = $0,76. Derselbe Turn mit kaltem Cache — {{2}}220K frischer Input zu $0,88 plus $0,60 Output{{/2}} — ergibt insgesamt $1,48. Caching halbiert es ungefähr.

• Ein Monat mit 10 Mio. Tokens bei einer Aufteilung von 70 % Eingabe / 30 % Ausgabe, wobei 80 % der Eingabe aus dem Cache stammen: 1,4 Mio. frische Eingabe ($5.60) + 5,6 Mio. gecachte Eingabe ($2.24) + 3 Mio. Ausgabe ($60) ≈ $68. Ohne Cache kostet derselbe Monat $88 — und derselbe Monat kostet bei GPT-5.6 Terra etwa $50, bei GPT-5.6 Luna etwa $5. Diese etwa 14-fache Spanne zwischen Sol und Luna zeigt, warum die Stufenabstimmung wichtiger ist als jeder einzelne Tarif.

Zwei Einschränkungen erhöhen den effektiven Satz. Sol ist ein Reasoning-Modell – interne Reasoning-Token werden als Ausgabe mit 20 Dollar pro Million abgerechnet. Eine schwierige Eingabeaufforderung bei hoher Reasoning-Anstrengung kann einen großen Teil ihres Ausgabebudgets für das Denken aufwenden, sodass die effektiven Ausgabekosten bei schwierigen Aufgaben weit über einer naiven Schätzung liegen. Und der Tokenizer von OpenAI ist bei manchen Eingaben wortreicher als der der vorherigen Generation, sodass derselbe Text mehr Token kosten kann als bei GPT-5.5. Passen Sie die Reasoning-Anstrengung an die Aufgabe an, begrenzen Sie die Ausgabe, wo möglich, und messen Sie die tatsächliche Nutzung, bevor Sie eine Rechnung prognostizieren.

Wie Sols Preisgestaltung im Vergleich zur Konkurrenz abschneidet

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Gemessen an den veröffentlichten Listenpreisen vom 2026-08-25 (Sol zu seinem Aktionspreis). Presseberichte deuten die Senkung als Reaktion auf den Preisdruck durch Anthropic und chinesische Labore – das ist eine Interpretation Dritter, keine Stellungnahme von OpenAI.

GPT-5.6 Terra — 2 $ / 12 $, die mittlere Stufe nach dem Preisschnitt. Sol kostet jetzt 2x mehr beim Input und ~1,7x mehr beim Output; Terra ist die Standardwahl, wenn man kein Flaggschiff-Reasoning benötigt.

• GPT-5.6 Luna — 0,20 $ / 1,20 $, die Volumenstufe nach der Preissenkung. Ein 20-facher Eingabeabstand zu Sol; Luna ist preislich auf die einfache Mehrheit des Datenverkehrs ausgelegt.

• Claude Opus 5 — $5 / $25. Sol ist jetzt auf dem Papier sowohl beim Input als auch beim Output 20 % günstiger, verglichen mit den alten Preisen, bei denen es beim Input Opus 5 entsprach. Der Vergleich fiel schon vor der Senkung zugunsten von Sol aus: Dieser Blog hatte Sol zuvor anhand derselben englischen/gemischten Stichprobe mit etwa 34,5 % weniger Tokens als ein Anthropic-Modell gemessen, und eine veröffentlichte Token-Ökonomie-Analyse (TheBlockBeats) schätzte, dass Sols Gesamtrechnung für gleichwertige Arbeit etwa 21 % niedriger ausfallen kann als bei Claude Opus 5, selbst wenn Sols Ausgabepreis höher war. Messen Sie Ihren eigenen Tokenizer, nicht den Listenpreis.

• Claude Fable 5 — $10 / $50. Sol ist jetzt bei Input und Output 60 % günstiger als die Top-Stufe von Anthropic (vorher 50 % / 40 % bei den alten Tarifen).

• Claude Opus 4.8 – 5 $ / 25 $. Sol ist jetzt 20 % günstiger beim Input und 20 % günstiger beim Output – der Preisvorteil gegenüber dem Flaggschiff der vorherigen Anthropic-Generation hat sich komplett umgekehrt.

• Grok 4.6 — $2 / $6. Die auffälligste Zahl auf der Tabelle: Grok 4.6 erreichte GPT-5.6 Sol beim Artificial Analysis index (beide 61) bei 2x günstigerem Input und ~3.3x günstigerem Output, ein Rückgang von einer 2.5x / 5x Lücke bei den alten Preisen.

• DeepSeek V4 Pro — 0,44 $ / 0,88 $ außerhalb der Spitzenzeiten (Spitzenzeiten verdoppeln den Preis). Eine völlig andere Preiswelt für die günstige Open-Weights-Klasse.

Die ehrliche Einordnung: Sol ist immer noch ein Premium-Flaggschiff, aber der Preisnachlass zieht es aus der obersten Preisklasse heraus – der Ausgabepreis von 20 $ unterbietet nun Claude Opus 5 mit 25 $ und Claude Opus 4.8 mit 25 $, sodass Claude Fable 5 mit 50 $ als einziger geschlossener Flaggschiff-Ausgabepreis darüber bleibt. Es punktet mit den effektiven Kosten pro Einheit harter Arbeit (sein Tokenizer, seine Argumentationsfähigkeit, sein langer Kontext) und nicht mit dem absoluten Preis, und die Senkung vom 24. August untermauert dieses Argument. Wenn Ihr Traffic aus kurzen Prompts und einfachen Aufgaben besteht, sind ein Terra für 2 $, eine Luna für 0,20 $ oder ein Grok 4.6 für 2 $ / 6 $ immer noch die günstigere Wahl – und im Index steht Grok 4.6 auf dem Papier nichts nach.

Wenn Sol die falsche Wahl ist

Vier Fälle, in denen dieser Preis nicht der ist, den Sie wollen:

Kurze, einfache Prompts. Unterhalb von grob 20K Tokens ohne tiefes Denken ist das Premium-Flaggschiff verschwendet. GPT-5.6 Terra für $2 / $12 oder GPT-5.6 Luna für $0.20 / $1.20 bewältigt die Volumenstufe für einen Bruchteil der Kosten, und ein Grok-4.6- oder DeepSeek-Klassenmodell kostet noch weniger.

Denkintensives Volumen. Da Denken als Output abgerechnet wird, kann ein anspruchsvoller Prompt mit hohem Aufwand deutlich über der nominellen Output-Zeile kosten. Wenn Ihre Arbeitslast aus vielen schwierigen Aufrufen besteht, messen Sie die tatsächlichen Output-Tokens, bevor Sie sich festlegen — der effektive Preis kann Sie überraschen.

Preis pro Token als einziges Ziel.Grok 4.6 ist mit Sol im Index bei 2 $ / 6 $ gleichgezogen, und DeepSeek V4 Pro liegt außerhalb der Spitzenzeiten bei 0,44 $ / 0,88 $. Wenn ein Frontier-Benchmark-Ergebnis keine harte Anforderung ist, liefern diese Modelle für dieselbe Art von Arbeit deutlich niedrigere Preise pro Token.

Strikte Latenz-Budgets. Sol ist ein großes Reasoning-Modell, daher liegt die Zeit bis zum ersten Token deutlich über der eines Flash-Modells. Für Echtzeit-Chat, bei dem eine Sub-Sekunden-TTFT entscheidend ist, erkauft der schnelle Modus für 8 $ / 40 $ Durchsatz, nicht aber eine geringere Latenz beim ersten Token – und ein kleineres Modell ist weiterhin die günstigere Lösung.

Wie ruft man es in OrcaRouter auf?

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol läuft auf OrcaRouter als Modell-ID openai/gpt-5.6-sol, bereitgestellt über den OpenAI-kompatiblen Endpunkt unter api.orcarouter.ai/v1 zum Herstellerpreis ohne Aufschlag. Wenn Sie bereits einen OpenAI-Client haben, ist die Migration eine Änderung von Basis-URL und Modell-ID – sonst nichts. Über denselben Schlüssel und Endpunkt sind über 200 Modelle verfügbar, sodass Sol neben GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 und den Open-Weight-Modellen steht, mit denen Sie es vergleichen möchten, und Sie können nach Schwierigkeit routen, anstatt jedes Modell neu zu integrieren.

Zwei OrcaRouter-Besonderheiten, die auf einer Preisseite erwähnt werden sollten. BYOK: Bringen Sie Ihren eigenen OpenAI-Schlüssel mit, und OpenAI stellt Ihnen direkt zu seinen eigenen Tarifen in Rechnung — OrcaRouter schlägt $0 pro Token auf und lässt Ihre Provider-Ratenlimits und Guthaben unangetastet. Guardrails: Der PII-Shield und die Inhaltsrichtlinie werden vor der Abrechnung ausgeführt, sodass eine blockierte Anfrage einen sauberen 400 zurückgibt und nie berechnet wird, und die Agent-Firewall bewertet Tool- und MCP-Aufrufe, bevor sie ausgeführt werden.

Der Ehrlichkeitshinweis, der für eine Preisseite wichtig ist: wir leiten das Modell weiter, wir setzen seinen Preis nicht fest. Die $4/$20-Angabe ist der durchgereichte Aktionspreis von OpenAI — und als OpenAI ihn am 24. August geändert hat, folgte der Eintrag am selben Tag, was genau der Grund dafür ist, dass diese Seite ein Datum trägt. Wenn du OpenAI direkt aufrufst, erhältst du denselben Preis; OrcaRouter existiert für den Weg mit einem einzigen Schlüssel und ohne Aufschlag, wenn du einen einzigen Endpunkt für die gesamte Modellreihe möchtest.

Quellen und Datum

Alle oben genannten Preise wurden am 25.08.2026 verifiziert. Die GPT-5.6-Sol-Werte stammen aus der veröffentlichten API-Preisliste von OpenAI, wurden mit der OrcaRouter-Modellseite für GPT-5.6 Sol (am selben Tag geprüft) sowie mit Pressemeldungen zur Senkung vom 24. August (Indian Express, Economic Times, The Star) abgeglichen; Batch-, Fast-Mode-, Cache-Write- und Long-Context-Tarife wurden von OpenAI angekündigt. Die Claude-, Grok- und DeepSeek-Werte sind die aktuellen OrcaRouter-Verzeichniseinträge, wobei DeepSeek V4 Pro zum Off-Peak-Tarif angezeigt wird. Sols Listenpreis blieb vom Launch am 9. Juli bis zur Senkung am 30. Juli unverändert und bewegte sich zum ersten Mal am 24. August mit dieser Aktion – genau deshalb ist das Datum hier entscheidend: Die Tarife von 4 $ / 20 $ sind vorübergehend, und Preise ändern sich; behandeln Sie jede frühere oder spätere Seite mit „GPT-5.6-Sol-Preisen“, die Sie finden, anhand des geprüften Datums. Die Zahlen hier entsprechen dem heutigen Stand.

Jeder oben genannte Preis ist der Live-Kurs auf GPT-5.6 Sol on OrcaRouter — geprüft am 2026-08-25 ohne Aufschlag, bereit für Ihren eigenen Schlüssel.

In diesem Artikel verglichen2

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert