
GPT-5.6 API-Preise: Sol-, Terra- und Luna-Stufen, echte Kosten und wie man jede einzelne aufruft
- qwenNEUQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaNEUOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNEUAnthropic: Claude Opus 52026-07-2461Intelligenz78Coding
- googleNEUGoogle: Gemini 3.6 Flash2026-07-2150Intelligenz69Coding
- googleNEUGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaNEUMeta: Muse Spark 1.12026-07-1651Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1557Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Intelligenz77Coding
- grokxAI: Grok 4.52026-07-0854Intelligenz72Coding
- tencentTencent: Hy32026-07-0641Intelligenz59Coding
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligenz42Coding
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligenz39Coding
- anthropicAnthropic: Claude Sonnet 52026-06-3053Intelligenz72Coding
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligenz52Coding57Mathe
- z-aiZ.ai: GLM 5.22026-06-1651Intelligenz69Coding60Mathe
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Intelligenz61Coding61Mathe
- anthropicAnthropic: Claude Fable 52026-06-0960Intelligenz77Coding
- qwenQwen: Qwen3.7 Plus2026-06-0139Intelligenz56Coding59Mathe
GPT-5.6 ist OpenAIs Flaggschiff-Familie vom Juli 2026, und das Wichtige für Entwickler ist, dass es nicht einen Preis gibt. Es wird in drei Stufen angeboten – Sol, Terra und Luna. In der OpenAI API kostet Sol 5 $ pro Million Eingabe-Tokens und 30 $ pro Million Ausgabe-Tokens, Terra kostet 2,50 $ und 15 $, und Luna kostet 1 $ und 6 $. Jede Stufe hat einen Rabatt für zwischengespeicherte Eingaben, alle drei akzeptieren sowohl Bild- als auch Texteingaben, und das Kontextfenster umfasst etwa 1,05 Millionen Tokens mit bis zu 128K Ausgabe-Tokens.
Der Listenpreis ist nur der Anfang der tatsächlichen Kosten. Welche Stufe Sie tatsächlich benötigen, wie viel Sie cachen, wie viel Output das Modell generiert und einige Preisregeln, die die meisten Anleitungen auslassen – Prompts über 272K Tokens, Data-Residency-Aufschlag und Dienststufen – bestimmen die Rechnung weit mehr als der offizielle Satz. Dieser Leitfaden analysiert den Preis jeder Stufe, wofür sie gedacht ist, wie sie bewertet wird, wie man von GPT-5.5 migriert, wie man sie aufruft und wie sie im Vergleich zu Claude, GLM, Gemini, DeepSeek und Grok abschneidet.
Kurze Antwort: GPT-5.6 Preise auf einen Blick
- Drei Stufen (pro Million Token, Eingabe / Ausgabe): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- Zwischengespeicherte Eingabe: $0,50 (Sol), $0,25 (Terra), $0,10 (Luna) pro Million Tokens; Cache-Schreibvorgänge kosten das 1,25-fache der nicht zwischengespeicherten Eingaberate.
- Positionierung: Sol für die anspruchsvollste Denkarbeit und agentische Aufgaben, Terra als ausgewogener Standard, Luna für hochvolumige, kostenintensive Aufgaben.
- Modalität: multimodal – GPT-5.6 akzeptiert Bildeingaben neben Text. Kontext ~1,05 M Token, max. Ausgabe 128K.
- Zwei Preisregeln, die Sie beachten sollten: Prompts mit über 272.000 Eingabe-Tokens werden mit dem 2-fachen Eingabe- und dem 1,5-fachen Ausgabepreis für die gesamte Anfrage berechnet, und Data-Residency-Endpunkte erhöhen den Preis um 10 %.
- Möglichkeiten, weniger zu bezahlen: Batch ist 50 % günstiger als Standard, Caching reduziert wiederholte Eingaben auf ein Zehntel, und die Weiterleitung von Routinearbeit an eine niedrigere Stufe vermeidet Sols Ausgabe von 30 $.
- Intelligence: Artificial Analysis places GPT-5.6 Sol near the top of its Intelligence Index (score 59).
GPT-5.6 API-Preise, Stufe für Stufe

OpenAI bepreist GPT-5.6 pro Million Tokens, und die Ausgabe ist auf jeder Stufe weitaus teurer als die Eingabe. Die derzeit veröffentlichten Preise sind:
- GPT-5.6 Sol: $5.00 Eingabe, $0.50 gecachte Eingabe, $30.00 Ausgabe (Cache-Schreibvorgänge $6.25).
- GPT-5.6 Terra: 2,50 $ Eingabe, 0,25 $ zwischengespeicherte Eingabe, 15,00 $ Ausgabe.
- GPT-5.6 Luna: 1,00 $ Eingabe, 0,10 $ gecachte Eingabe, 6,00 $ Ausgabe.
Zwei Details sind wichtig, bevor Sie ein Budget planen. Erstens dominiert die Ausgaberate die meisten tatsächlichen Kosten, insbesondere bei Reasoning- und agentischen Arbeiten, bei denen das Modell lange Abläufe, Tool-Aufrufe und Überarbeitungen vor einer endgültigen Antwort generiert. Zweitens gibt es auf der Preisseite keine separate Preiszeile für "Sol Ultra"; "Sol Ultra" ist eine höhere Reasoning-Konfiguration von Sol (einem Multi-Agenten-Setup), keine unabhängige Stufe – planen Sie Ihr Budget um Sol, Terra und Luna herum.
Wofür jede Stufe eigentlich gedacht ist
Luna: hohes Volumen und kostenempfindlich
Luna ist die Economy-Stufe mit $1 Input und $6 Output. Sie ist die richtige Standardwahl für Klassifizierung, Extraktion, Routing, Zusammenfassung, Entwurf und das große Volumen an Routinearbeit, bei dem ein kleiner Qualitätsunterschied das Ergebnis nicht ändert. Mit sechs Dollar pro Million Output-Token ist es günstig genug, um im großen Maßstab und wiederholt eingesetzt zu werden.
Terra: der ausgewogene Standard
Terra liegt mit 2,50 $ und 15 $ in der Mitte. Für die meisten Anwendungen und Programmierarbeiten ist es der sinnvolle Ausgangspunkt: deutlich stärker als Luna bei schwierigeren Aufgaben, aber zum halben Ausgabepreis von Sol. Beginnen Sie hier, und verlagern Sie eine Aufgabe nur dann auf Sol, wenn Terra sie sichtbar nicht bewältigt.
Sol: die schwierigste argumentative und agentische Arbeit
Sol ist das Flaggschiff für $5 und $30, und Artificial Analysis platziert es nahe der Spitze seines Intelligence Index. Reservieren Sie es für schwierige Architekturen, komplexes Debugging, Agenten mit langem Zeithorizont und risikoreiche Analysen, bei denen ein vermiedener Fehler den Aufpreis wert ist. Die Verwendung von Sol für Routineaufgaben ist der häufigste Weg, bei GPT-5.6 zu viel auszugeben.
Kommen Sie von GPT-5.5? Welcher Tarif spart am meisten?
GPT-5.6 Sol ist preislich identisch zu GPT-5.5 mit 5 $ Input und 30 $ Output, daher ändert sich bei der direkten Übertragung eines GPT-5.5-Workloads auf Sol nur wenig an der Rechnung. Der Sparvorteil liegt in den beiden neuen günstigeren Stufen. Terra liefert bei den meisten Aufgaben etwa GPT-5.5-ähnliche Qualität zum halben Preis, sodass die einfachste Migration darin besteht, bestehenden GPT-5.5-Traffic zu Terra zu schicken und nur die Aufgaben, die schlechtere Ergebnisse liefern, wieder auf Sol hochzustufen.
Der praktische Migrationsplan umfasst drei Schritte: Leiten Sie GPT-5.5-Aufrufe an Terra um, führen Sie Ihren Evaluierungssatz durch und eskalieren Sie nur die Fehlschläge an Sol, während Sie klar routinemäßige Arbeiten an Luna weiterleiten. Die meisten GPT-5.5-Workloads werden auf diese Weise günstiger, ohne dass ein messbarer Qualitätsverlust entsteht.
Wie die Stufen tatsächlich punkten


Price only matters next to capability. On OpenAI’s own Terminal-Bench 2.1 numbers, the tiers separate about as you would expect: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, and Luna 84.7%. For context in the same table, GPT-5.5 scores 85.6%, Claude Opus 4.8 is 78.9%, Claude Fable 5 is 83.1%, and Gemini 3.1 Pro (preview) is 70.7%. Artificial Analysis separately gives Sol an Intelligence Index of 59, near the top of its ranking.
Betrachten Sie diese als vom Anbieter gemeldet und richtungsweisend. OpenAI hat eine begrenzte Reihe von Evaluierungen für GPT-5.6 veröffentlicht, jedoch zum Zeitpunkt des Schreibens keine traditionellen Coding- und Reasoning-Benchmarks wie SWE-bench Verified oder GPQA. Nutzen Sie daher diese Bewertungen, um zu entscheiden, was Sie in Ihrer eigenen Arbeitslast testen möchten, und nicht als endgültiges Urteil.

Die Lese-Rate für zwischengespeicherte Eingaben jeder Stufe beträgt ein Zehntel der Rate für frische Eingaben: 0,50 $ auf Sol, 0,25 $ auf Terra, 0,10 $ auf Luna. Das Schreiben in den Cache kostet jedoch das 1,25‑fache der Rate für ungecachte Eingaben (etwa 6,25 $ pro Million auf Sol), sodass sich Caching nur dann lohnt, wenn ein stabiles Präfix oft genug wiederverwendet wird, um die Schreib‑Prämie wieder hereinzuholen – Systemanweisungen, ein großes Dokument, Repository‑Regeln oder eine Produkttaxonomie. Platzieren Sie stabiles Material am Anfang des Prompts und die wechselnde Frage am Ende, und vermeiden Sie es, Zeitstempel oder zufällige Kennungen vor wiederverwendbarem Kontext einzufügen.
Caching reduziert wiederholte Eingabekosten; es hat keine Auswirkung auf die Ausgabe. Da die Ausgabe auf jeder Stufe die teure Seite ist, sind die beiden Hebel, die eine GPT-5.6-Rechnung am meisten bewegen, das Caching eines stabilen Präfix und die Kontrolle darüber, wie viel das Modell schreibt.
Welche Stufe solltest du wählen?

Wählen Sie keine Stufe nach dem Ruf. Wählen Sie sie durch Tests. Erstellen Sie einen kleinen Satz repräsentativer Aufgaben mit klaren Akzeptanzkriterien, führen Sie sie zuerst auf Luna aus und befördern Sie nur die Aufgaben, die fehlschlagen, zu Terra, dann zu Sol. Messen Sie die Kosten pro akzeptierter Aufgabe, nicht den durchschnittlichen Token-Preis, denn eine günstigere Stufe, die drei Versuche benötigt, kann mehr kosten als eine stärkere Stufe, die einmal erfolgreich ist.
Eine operative Gewohnheit spart bares Geld: die genaue Modellstufen-ID in jeden Aufruf einbetten, anstatt sich auf einen bloßen Alias zu verlassen, damit eine Routineanfrage nie unbemerkt auf der teuersten Stufe läuft. Eine gemischte Arbeitslast verteilt sich in der Regel auf Luna für routinemäßige Transformation und Entwurf, Terra für die tägliche Implementierung und Analyse und Sol für die anspruchsvolle Minderheit – die meisten Anfragen benötigen überhaupt nie das Flaggschiff.
GPT-5.6 im Preisvergleich mit der Konkurrenz
GPT-5.6 does not exist in isolation. Read against the current field (per million tokens, input / output, mid-2026): Claude Opus 4.8 is $5 / $25, Claude Fable 5—Anthropic’s strongest public model—is $10 / $50, GLM 5.2 is $1.40 / $4.40 on Z.AI (third-party hosts can be lower), Grok 4.5 is $2 / $6, Google’s Gemini 3.5 Flash is about $1.50 / $9, and DeepSeek V4-Pro is about $0.44 / $0.87. Confirm each on the vendor’s own page, as these move.
Die Erkenntnisse sind konkret. GPT-5.6 Sol ist beim Input gleichauf mit Opus 4.8, aber beim Output teurer (30 $ vs. 25 $), daher ist Opus bei output-intensiver agentischer Arbeit pro Token etwas günstiger, während Sol den Intelligence Index anführt. Terra unterbietet beide Flaggschiffe und ist die preisbewusste Wahl innerhalb der OpenAI-Familie. Luna konkurriert preislich mit günstigeren Modellen, wobei Grok 4.5, GLM 5.2 und vor allem DeepSeek noch darunter liegen. Kein einzelnes Preissegment oder Anbieter gewinnt alles, genau deshalb ist Routing nach Schwierigkeit besser, als sich auf ein Modell festzulegen.
Eine bearbeitete monatliche Rechnung

Setzen Sie Zahlen darauf. Für einen mittelschweren Monat mit 50 Millionen Eingabe- und 10 Millionen Ausgabe-Token, zum Listenpreis vor Caching und Toolnutzung, beläuft sich die Modellgebühr ungefähr auf:
- GPT-5.6 Luna: etwa $110
- GPT-5.6 Terra: etwa 275 $.
- GPT-5.6 Sol: etwa $550.
- Zum Vergleich: GLM 5.2 etwa $114, Grok 4.5 etwa $160, Claude Opus 4.8 etwa $500, Claude Fable 5 etwa $1.000.
Dieselben Aufgaben, intelligent geroutet – Luna und Terra für die Masse, Sol für die schwierige Minderheit – landen viel näher an der Spanne von 110–275 Dollar als an einem pauschalen Betrag von 550 Dollar für Sol für alles. Diese Lücke, über ein Jahr multipliziert, ist das gesamte Argument für ein stufenbasiertes Routing.
Einzuplanende versteckte Kosten
Mehrere Preisregeln erscheinen nicht im angegebenen Tarif und überraschen die Teams später:
- Lange Prompts: Eine Anfrage mit über 272.000 Eingabetokens wird für die gesamte Anfrage mit dem 2-fachen der Eingabe und dem 1,5-fachen der Ausgabe berechnet, sodass sich die Kosten für Aufrufe mit großen Kontexten und großen RAGs mehr als verdoppeln können.
- Ausgabevolumen: Die Ausgabe beträgt bis zu sechs Mal die Eingaberate, daher ist unbegrenzte oder hochrationale Ausgabe das Hauptrisiko für übermäßige Ausgaben.
- Service-Stufe: Priority-Verarbeitung kostet ungefähr das Doppelte des Standardsatzes (etwa $10 Eingabe / $60 Ausgabe auf Sol); Flex und Batch sind günstiger. Wählen Sie die Stufe bewusst mit der service_tier-Einstellung.
- Datenresidenz: Regionale Verarbeitungsendpunkte erhöhen die Kosten um 10 % für Modelle, die am oder nach dem 5. März 2026 veröffentlicht wurden, einschließlich GPT-5.6.
- Agentenschleifen und Wiederholungen: Anweisungen, Werkzeuge und Verlauf werden bei jeder Runde erneut gesendet, und eine fehlgeschlagene lange Anfrage verschwendet die Eingabe, für die Sie bereits bezahlt haben.
- Tier drift: alles auf Sol zu lassen, "um sicher zu sein", ist die mit Abstand teuerste Gewohnheit.
Möglichkeiten, weniger zu bezahlen
Drei Hebel senken eine GPT-5.6-Rechnung, ohne dass Sie ändern, was Sie bauen. Batch: Asynchrone Anfragen über die Batch-Stufe sind 50 % günstiger als der Standardpreis, ideal für umfangreiche Luna-Arbeiten, die nicht latenzempfindlich sind. Caching: Verwenden Sie ein stabiles Präfix oft genug wieder, um den 1,25-fachen Schreibaufschlag zu umgehen, und wiederholte Eingaben reduzieren sich auf ein Zehntel. Routing: Senden Sie Routinearbeit an Luna oder Terra und eskalieren Sie nur die schwierige Minderheit an Sol, und halten Sie Prompts möglichst unter der 272K-Schwelle.
Wie man GPT-5.6 aufruft
GPT-5.6 ist über die OpenAI API und über OpenAI-kompatible Gateways verfügbar, sodass die Integration stabil bleibt, während Sie das Modell oder die dahinterliegende Stufe ändern. Folgendes ist ein standardmäßiges OpenAI-kompatibles Muster; bestätigen Sie die aktuelle Modell-ID vor dem Produktionseinsatz und legen Sie die genaue Stufe fest, anstatt einen bloßen Alias zu verwenden.
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Überarbeiten Sie dieses Modul und erläutern Sie die Risiken."}],
)
print(response.choices[0].message.content)
Das Wechseln der Stufen ist eine Änderung in einer Zeile am Modellfeld, was das schwierigkeitsbasierte Routing praktisch macht: Sende Routineaufrufe an Luna oder Terra und eskaliere nur die schwierigen an Sol.
Testen von GPT-5.6 über OrcaRouter
Ein Gateway erleichtert die Einführung von GPT-5.6 aus zwei Gründen. Erstens kann derselbe OpenAI-kompatible Client alle drei Stufen sowie Vergleichsmodelle wie Claude Opus 4.8, GLM 5.2 und Grok 4.5 aufrufen, sodass Sie einen einzigen Evaluierungssatz über alles hinweg ausführen können, ohne Integrationscode umschreiben zu müssen, und die tatsächlichen Kosten pro angenommener Aufgabe messen können – einschließlich Tool-Gebühren, Wiederholungen und des 272K-Aufschlags. Zweitens kann ein Gateway zwischen Anbietern umschalten und ein Budgetlimit durchsetzen, sodass ein vorübergehendes Kapazitätsproblem oder ein fehlgeleiteter Sol-Aufruf den Monat nicht sprengt. Bestätigen Sie die Live-GPT-5.6-Route und die aktuellen Stufen-IDs, bevor Sie darauf ein Budget aufbauen.

Nächster Schritt: Registrieren Sie sich für OrcaRouter und führen Sie Ihren eigenen GPT-5.6-Stufenvergleich über einen einzigen API-Endpunkt durch.
FAQ
Was ist der Unterschied zwischen GPT-5.6 Sol, Terra und Luna?
Sie sind drei Stufen derselben Familie zu unterschiedlichen Preisen und Leistungsniveaus. Sol ist das Flaggschiff für die härteste Arbeit ($5/$30), Terra ist der ausgewogene Standard ($2.50/$15) und Luna ist die Economy-Stufe für Aufgaben mit hohem Volumen ($1/$6). Wählen Sie die niedrigste Stufe, die Ihre Tests besteht.
Gibt es eine Preisstufe für GPT-5.6 Sol Ultra?
Nein. „Sol Ultra“ ist eine höherdenkende Multi-Agent-Konfiguration von Sol, keine separate Zeile auf der Preisseite. Es verbraucht mehr Tokens und kostet mehr pro Aufgabe, aber Sie budgetieren es als Sol mit höherem Aufwand.
Warum überstieg meine GPT-5.6-Rechnung eine einfache Schätzung?
Normalerweise Ausgabe-Token, der 272K-Langprompt-Zuschlag (2x Eingabe, 1,5x Ausgabe), Priority-Service-Tier, Datenresidenz-Aufschlag oder Wiederholungen. Protokollieren Sie die vollständige Anforderungskette und messen Sie die Kosten pro akzeptierter Aufgabe statt pro Prompt.
Kann ich GPT-5.6 feinabstimmen, und gibt es eine kostenlose Stufe?
Nein zu beidem. GPT-5.6 unterstützt kein Fine-Tuning, und die API hat keine kostenlose Stufe – die Abrechnung beginnt mit dem ersten Token. Kostenloser Zugang besteht nur innerhalb bestimmter ChatGPT-Pläne, die ein separates Produkt von der API sind.
Welcher ChatGPT-Plan kann welche Stufe nutzen?
Es variiert je nach Produkt. In ChatGPT Work und Codex können Free und Go Terra verwenden, während Plus und höher zwischen Sol, Terra und Luna wählen können; die höchste Ultra-Einstellung ist auf Pro und Enterprise beschränkt. Behandeln Sie die API- und ChatGPT-Pläne als getrennt – ein API-Schlüssel erbt nicht den Zugriff eines Abonnements.
Das Fazit
Die Preisstruktur von GPT-5.6 ist die Staffelung. Sol für 5$/30$ führt die Intelligenz-Rankings an, Terra für 2,50$/15$ ist der Standard für das Preis-Leistungs-Verhältnis und die natürliche Heimat für den früheren GPT-5.5-Verkehr, und Luna für 1$/6$ bewältigt das Volumen. Caching reduziert wiederholte Eingaben auf ein Zehntel (nach einem 1,25-fachen Schreibaufpreis), Batch ist zum halben Preis, aber die Ausgabe ist auf jeder Stufe die teure Seite und lange Eingabeaufforderungen über 272K unterliegen einem Aufpreis.
Behandeln Sie die drei Stufen als ein Routing-Problem, nicht als einen einzelnen Kauf: Standardmäßig niedrig, bei Fehler eskalieren, stabilen Kontext cachen, Batch verwenden, wo die Latenz es erlaubt, und ein Vergleichsmodell über denselben Endpunkt erreichbar halten. Das führt zu weit geringeren Kosten pro angenommener Aufgabe, als Flaggschiff-Tarife für Routinearbeit zu zahlen.
