
GPT-5.6 Sol API-Preise: 5 $ / 30 $ pro 1M Token, Cache bei 0,50 $, und was es wirklich kostet
- DeepSeekNEUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianNEUQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenNEUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
GPT-5.6 Sol kostet $5.00 pro Million Eingabetokens und $30.00 pro Million Ausgabetokens auf der GPT-5.6 Sol API – derselbe Tarif, den die Flaggschiff-Stufe im OrcaRouter-Verzeichnis führt, geprüft am 18.08.2026, ohne Aufschlag. Es ist die teuerste Stufe der GPT-5.6-Familie und die einzige, deren Listenpreis sich bei der Senkung vom 30. Juli nicht bewegt hat. Die Preisliste auf der Live-Seite des GPT-5.6-Sol-Modells ist daher die Grundlage für die Budgetplanung. Die Stellschrauben sind wichtiger als die Schlagzeile: Wiederverwendete Eingaben kosten $0.50 pro Million über Prompt-Caching, die Batch-API sinkt auf $2.50 / $15.00, und der schnelle Modus bietet bis zu 2.5x Geschwindigkeit gegen einen 2x-Aufschlag. Diese Seite ist die Preisreferenz speziell für Sol – die genaue Preisliste, was eine Anfrage tatsächlich kostet, wie das Flaggschiff im Vergleich zum Feld abschneidet, wann es der falsche Kauf ist und wie man es über einen OpenAI-kompatiblen Endpunkt mit dem eigenen Schlüssel aufruft.
Preise gelten pro Million Tokens (Eingabe / Ausgabe), Stand 2026-08-18. Die Dollarbeträge stammen aus den veröffentlichten API-Preisen von OpenAI und wurden mit der OrcaRouter-Modellseite für GPT-5.6 Sol abgeglichen; Cache-, Batch-, Fast-Mode- und Long-Context-Preise stammen von OpenAI. Preise ändern sich — prüfen Sie vor dem Erstellen.
Der genaue Preis, heute verifiziert.
Hier ist die vollständige Preisliste für GPT-5.6 Sol, verifiziert am 2026-08-18:

• Input — $5.00 pro 1M Tokens bei einem Cache-Miss.
• Output — 30,00 $ pro 1M Tokens.
• Prompt-Cache lesen — 0,50 $ pro 1 Mio. Tokens, ein Rabatt von 90 % auf jede erneut gesendete Eingabe.
• Prompt-Cache-Schreiben — 6,25 $ pro 1 Mio. Tokens.
• Langkontext-Tarif — Eingaben über etwa 272.000 Token werden mit 10,00 $ für Eingabe und 45,00 $ für Ausgabe abgerechnet (2x Eingabe, 1,5x Ausgabe).
• Batch-API — 2,50 $ Eingabe / 15,00 $ Ausgabe, pauschal 50 % Rabatt, asynchron, in der Regel innerhalb von etwa 24 Stunden fertig.
• Schnellmodus — 10,00 $ Eingabe / 60,00 $ Ausgabe, ein 2-facher Aufpreis für bis zu etwa 2,5-fach höhere Ausgabegeschwindigkeit ohne Änderung der Intelligenz.
• Kontextfenster — ~1,05M Tokens, bis zu 128K Ausgabe.
OrcaRouter gibt den Anbieterpreis ohne Aufschlag weiter, sodass der im Verzeichnis angezeigte Betrag der Betrag ist, den Sie zahlen. Auf der Live-Modellseite zeigt die Karte $5,00 / $30,00 pro 1M, Cache-Read $0,500, mit Vision-, Tools-, JSON- und Reasoning-Badges. Auch Sols $5 / $30 ist der Preis vor der Kürzung: OpenAIs Preissenkung vom 30. Juli galt für GPT-5.6 Luna (jetzt $0,20 / $1,20) und GPT-5.6 Terra (jetzt $2 / $12), während das Flaggschiff unverändert blieb.
Die Hebel, die den effektiven Preis verändern
Die Basisrate ist nur der Ausgangspunkt. Vier Modifikatoren ändern, was Sol dich tatsächlich kostet:
• Prompt-Caching — wiederverwendeter Kontext kostet 0,50 $ pro Million statt 5 $ bei frischem Kontext, und Cache-Schreibvorgänge kosten 6,25 $ pro Million. Für jeden Agenten oder Chat, der bei jeder Runde ein großes Präfix erneut sendet, ist Caching der größte Hebel auf der Rechnung. OpenAI bindet den Cache an Projekt und API-Schlüssel. Wenn man also bei einem Schlüssel (einem Kanal) bleibt, sorgt das dafür, dass die Cache-Treffer landen.
• Langkontext-Stufe – eine Anfrage, deren Eingabe ungefähr 272.000 Token überschreitet, wechselt vom Basistarif zu 10 $ / 45 $. Ein paar sehr große Prompts können Ihren Durchschnittspreis unbemerkt erhöhen. Bündeln oder kürzen Sie daher, wenn Sie den tiefen Kontext nicht wirklich benötigen.
• Batch — Die Batch-API von OpenAI führt Aufträge asynchron mit einer Bearbeitungszeit von etwa 24 Stunden zum exakt halben Preis aus: $2.50 / $15.00, mit zwischengespeichertem Input für $0.25 und Cache-Schreibvorgängen für $3.13. Sie lässt sich mit Prompt-Caching kombinieren und eignet sich für Evals, Massenklassifizierung und Offline-Generierung, bei denen es auf Latenz nicht ankommt.
• Schnellmodus — $10 / $60 für bis zu ~2,5x Ausgabedurchsatz, nützlich für latenzkritische Aufgaben, bei denen der Benutzer wartet, wie z. B. Live-Coding-Assistenz. Er wird pro Token zum doppelten Standardsatz abgerechnet, nicht auf gekaufte Scale-Tier-TPM-Pakete angerechnet und kann auf Standardverarbeitung zurückfallen, wenn Sie das gemeinsame Ratenlimit überschreiten.
Was eine Anfrage tatsächlich kostet
Preise pro Token sind abstrakt, daher hier einige durchgerechnete Beispiele zu den heutigen Kursen:
• Einzelner Chat-Anruf, 50K Eingabe + 20K Ausgabe — $0.25 + $0.60 = $0.85.
• 1M Eingabe + 1M Ausgabe — $5 + $30 = $35.
• Agenten-Turn, 200K gecachter Kontext + 20K frische Eingabe + 30K Ausgabe — $0.10 + $0.10 + $0.90 = $1.10. Derselbe Turn mit kaltem Cache — 220K frische Eingabe zu $1.10 — ergibt insgesamt $2.00. Caching halbiert es fast.
• Ein Monat mit 10M Token bei einer Aufteilung von 70 % Input / 30 % Output, wobei 80 % des Inputs aus dem Cache bedient werden: 1,4 Mio. frischer Input (7,00 $) + 5,6 Mio. gecachter Input (2,80 $) + 3 Mio. Output (90 $) ≈ $100. Ohne Cache kostet derselbe Monat $125 — und derselbe Monat auf GPT-5.6 Terra kostet etwa 50 $, oder etwa 5 $ auf GPT-5.6 Luna. Dieser 20-fache Unterschied zwischen Sol und Luna zeigt, warum die Wahl der richtigen Stufe wichtiger ist als jeder einzelne Tarif.
Zwei Einschränkungen erhöhen den effektiven Tarif. Sol ist ein Reasoning-Modell – interne Reasoning-Tokens werden als Output mit 30 Dollar pro Million abgerechnet. Ein schwieriger Prompt bei hoher Reasoning-Effort-Einstellung kann einen großen Teil seines Output-Budgets für das Denken verbrauchen, sodass die effektiven Output-Kosten bei anspruchsvollen Aufgaben weit über einer naiven Schätzung liegen. Und OpenAIs Tokenizer ist bei manchen Eingaben ausführlicher als der der vorherigen Generation, sodass derselbe Text mehr Tokens kosten kann als auf GPT-5.5. Stimmen Sie den Reasoning-Aufwand auf die Aufgabe ab, begrenzen Sie die Ausgabe, wo möglich, und messen Sie die tatsächliche Nutzung, bevor Sie eine Rechnung hochrechnen.
Wie Sols Preisgestaltung im Vergleich zur Konkurrenz abschneidet

Abgelesen an den veröffentlichten Listenpreisen am 2026-08-18:
• GPT-5.6 Terra — $2 / $12, die mittlere Preisstufe nach der Preissenkung. Sol kostet 2,5x mehr bei Eingabe und Ausgabe; Terra ist die Standardwahl, wenn man kein Flaggschiff-Reasoning benötigt.
• GPT-5.6 Luna — $0,20 / $1,20, die Volumenstufe nach der Preissenkung. Ein 25-facher Eingabevorsprung gegenüber Sol; Luna ist preislich auf die klare Mehrheit des Traffics ausgelegt.
• Claude Opus 5 — $5 / $25. Gleiche Eingabe, auf dem Papier 20 % günstigere Ausgabe. In der Praxis kehrt sich der Vergleich bei manchen Workloads um: Dieser Blog hat zuvor gemessen, dass Sol bei derselben englischen/gemischten Stichprobe etwa 34,5 % weniger Tokens benötigt als ein Anthropic-Modell, und eine veröffentlichte Token-Ökonomie-Analyse (TheBlockBeats) schätzte, dass Sols Gesamtrechnung für gleichwertige Arbeit trotz der höheren Ausgaberate etwa 21 % niedriger ausfallen kann als bei Claude Opus 5. Messen Sie Ihren eigenen Tokenizer, nicht den Listenpreis.
• Claude Fable 5 — 10 $ / 50 $. Sol kostet beim Input nur die Hälfte und ist beim Output 40 % günstiger als Anthropics höchste Stufe.
• Claude Opus 4.8 — $5 / $25. Gleicher Input wie Sol, günstigerer Output — das Flaggschiff der vorherigen Anthropic-Generation.
• Grok 4.6 — $2 / $6. Der auffälligste Wert auf dem Brett: Es glich GPT-5.6 Sol im Artificial-Analysis-Index (beide 61) bei 2,5-mal günstigerem Input und 5-mal günstigerem Output.
• DeepSeek V4 Pro — 0,44 $ / 0,88 $ außerhalb der Spitzenzeiten (Spitzenzeiten verdoppeln den Preis). Eine völlig andere Preiswelt für die günstige Open-Weights-Klasse.
Die ehrliche Einordnung: Sol ist ein Premium-Flaggschiff mit einer Premium-Ausgaberate – der höchsten Ausgaberate der geschlossenen Flaggschiffe unterhalb von Claude Fable 5. Es punktet beim effektiven Preis pro Einheit harter Arbeit (sein Tokenizer, seine Argumentation, sein langer Kontext) und nicht bei der absoluten Rate. Wenn Ihr Traffic aus kurzen Prompts und einfachen Aufgaben besteht, sind ein $2 Terra, ein $0.20 Luna oder ein $2 / $6 Grok 4.6 die günstigere Wahl – und im Index gibt Grok 4.6 auf dem Papier nichts her.
Wenn Sol die falsche Wahl ist
Vier Fälle, in denen dieser Preis nicht der ist, den Sie wollen:
Kurze, einfache Prompts. Unterhalb von grob 20K Tokens ohne tiefes Denken ist das Premium-Flaggschiff verschwendet. GPT-5.6 Terra für $2 / $12 oder GPT-5.6 Luna für $0.20 / $1.20 bewältigt die Volumenstufe für einen Bruchteil der Kosten, und ein Grok-4.6- oder DeepSeek-Klassenmodell kostet noch weniger.
Denkintensives Volumen. Da Denken als Output abgerechnet wird, kann ein anspruchsvoller Prompt mit hohem Aufwand deutlich über der nominellen Output-Zeile kosten. Wenn Ihre Arbeitslast aus vielen schwierigen Aufrufen besteht, messen Sie die tatsächlichen Output-Tokens, bevor Sie sich festlegen — der effektive Preis kann Sie überraschen.
Preis pro Token als einziges Ziel.Grok 4.6 ist mit Sol im Index bei 2 $ / 6 $ gleichgezogen, und DeepSeek V4 Pro liegt außerhalb der Spitzenzeiten bei 0,44 $ / 0,88 $. Wenn ein Frontier-Benchmark-Ergebnis keine harte Anforderung ist, liefern diese Modelle für dieselbe Art von Arbeit deutlich niedrigere Preise pro Token.
Strikte Latenzbudgets. Sol ist ein großes Reasoning-Modell, daher liegt die Zeit bis zum ersten Token deutlich über der eines Flash-Modells. Für Echtzeit-Chat, bei dem eine TTFT unter einer Sekunde entscheidend ist, erkauft der Fast-Modus für 10 $/60 $ Durchsatz, aber keine geringere Latenz beim ersten Token — und ein kleineres Modell ist weiterhin die günstigere Lösung.
Wie ruft man es in OrcaRouter auf?

GPT-5.6 Sol läuft auf OrcaRouter als Modell-ID openai/gpt-5.6-sol, bereitgestellt über den OpenAI-kompatiblen Endpunkt unter api.orcarouter.ai/v1 zum Herstellerpreis ohne Aufschlag. Wenn Sie bereits einen OpenAI-Client haben, ist die Migration eine Änderung von Basis-URL und Modell-ID – sonst nichts. Über denselben Schlüssel und Endpunkt sind über 200 Modelle verfügbar, sodass Sol neben GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 und den Open-Weight-Modellen steht, mit denen Sie es vergleichen möchten, und Sie können nach Schwierigkeit routen, anstatt jedes Modell neu zu integrieren.
Zwei OrcaRouter-Besonderheiten, die auf einer Preisseite erwähnt werden sollten. BYOK: Bringen Sie Ihren eigenen OpenAI-Schlüssel mit, und OpenAI stellt Ihnen direkt zu seinen eigenen Tarifen in Rechnung — OrcaRouter schlägt $0 pro Token auf und lässt Ihre Provider-Ratenlimits und Guthaben unangetastet. Guardrails: Der PII-Shield und die Inhaltsrichtlinie werden vor der Abrechnung ausgeführt, sodass eine blockierte Anfrage einen sauberen 400 zurückgibt und nie berechnet wird, und die Agent-Firewall bewertet Tool- und MCP-Aufrufe, bevor sie ausgeführt werden.
Der Ehrlichkeitshinweis, der auf einer Preisseite zählt: Wir routen das Modell, wir legen seinen Preis nicht fest. Die Angabe von $5 / $30 ist OpenAIs durchgereichter Tarif, und wenn OpenAI ihn ändert, folgt die Auflistung — genau deshalb trägt diese Seite ein Datum. Wenn du OpenAI direkt aufrufst, erhältst du denselben Tarif; OrcaRouter existiert für den Weg mit nur einem Schlüssel und ohne Aufschlag, wenn du für die gesamte Modellreihe einen einzigen Endpunkt möchtest.
Quellen und Datum
Alle oben genannten Preise wurden am 18.08.2026 überprüft. Die GPT-5.6-Sol-Angaben stammen aus den veröffentlichten API-Preisen von OpenAI und wurden mit der OrcaRouter-Modellseite für GPT-5.6 Sol (am selben Tag geprüft) sowie unseren eigenen veröffentlichten GPT-5.6-Preisseiten abgeglichen. Die Batch-, Fast-Mode-, Cache-Write- und Long-Context-Tarife wurden von OpenAI angekündigt. Die Claude-, Grok- und DeepSeek-Angaben sind die aktuellen OrcaRouter-Verzeichniseinträge, wobei DeepSeek V4 Pro mit seinem Off-Peak-Preis angezeigt wird. OpenAI hat den Listenpreis von Sol seit der Einführung am 9. Juli 2026 nicht geändert – die Senkung vom 30. Juli ließ das Flaggschiff unberührt –, aber Preise ändern sich; behandeln Sie jede frühere „GPT-5.6 Sol pricing“-Seite, die Sie finden, anhand ihres Prüfdatums. Die hier genannten Zahlen sind Stand heute aktuell.
Jeder oben genannte Preis ist der Live-Kurs auf dem GPT-5.6 Sol on OrcaRouter — geprüft am 2026-08-18 ohne Aufschlag, bereit für deinen eigenen Key.
In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
