
GPT-6 Astra Preisgestaltung: Warum drei verschiedene Preise alle korrekt sind und was eine Aufgabe wirklich kostet
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiNEUOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenz78Coding
Das Wichtigste zuerst: GPT-6 Astra kostet $10,00 pro Million Eingabe-Token, $1,00 pro Million gecachter Eingabe und $50,00 pro Million Ausgabe-Token im Standard-Tarif von OpenAI. Das ist OpenAIs eigener Listenpreis, entnommen von OpenAIs eigener Preisseite am 16. September 2026 — und das Datum ist wichtig, denn das Modell wurde zu verschiedenen Zeitpunkten unterschiedlich bepreist, und Leser finden immer wieder diese anderen Zahlen. GPT-6 Astra selbst erschien am 3. September 2026, dreizehn Tage vor dieser Seite. Dies ist kein Launch-Artikel und kein Ankündigungsartikel; es ist die Referenzseite für ein Modell, das jetzt allgemein verfügbar und seit dieser Woche allgemein im Einsatz ist. GPT-5.6 Sol erscheint unten als die Preisbasis, über der Astra verkauft wird, nicht als das Thema.
Der Grund, warum eine Preisliste eine ganze Seite braucht, ist, dass die kursierenden Zahlen nicht übereinstimmen. Suche nach dem Preis dieses Modells, und du findest $10/$50 von OpenAI, einen Batch-Tarif von $5/$25, Azure nennt sowohl $10/$50 als auch $11/$55, und mindestens ein Endpunkt ist mit $20/$100 aufgeführt. Keine dieser Angaben ist ein Tippfehler, und keine davon ist der Listenpreis, der stillschweigend geändert wurde. Es sind unterschiedliche Service-Level und unterschiedliche Wiederverkäufer, und sie auseinanderzuhalten ist der Unterschied zwischen einem Budget und einer Vermutung.
Die Preisliste, bei der jede Position beschriftet und datiert ist
Alles in diesem Abschnitt wurde aus OpenAIs eigener Dokumentation zu API-Preisen und Modellen vom 16. September 2026 entnommen. Stammt eine Zahl von jemand anderem, sagt der Satz, der sie enthält, dies auch.
• Standard, Anfragen mit höchstens 272,000 Eingabe-Tokens — $10.00 pro 1 Mio. Eingabe-Tokens, $1.00 pro 1 Mio. zwischengespeicherte Eingabe-Tokens, $12.50 pro 1 Mio. Cache-Schreibvorgänge, $50.00 pro 1 Mio. Ausgabe-Tokens (OpenAIs eigene Preisliste, abgerufen am 2026-09-16).
• Die Cache-Schreibzeile ist real – und sie wird oft übersehen – beim ersten Mal, wenn ein Präfix gesendet wird, handelt es sich um einen Schreibvorgang zu 12,50 $ pro 1 Mio., nicht um einen Lesevorgang zu 1,00 $. Cache-Schreibvorgänge werden mit dem 1,25-Fachen des Standard-Eingabetarifs abgerechnet.
• Standard, Anfragen über 272.000 Eingabe-Token — 20,00 $ Eingabe, 2,00 $ zwischengespeicherte Eingabe, 25,00 $ Cache-Schreibvorgänge, 75,00 $ Ausgabe pro 1 Mio. Die gesamte Anfrage wird neu berechnet, nicht nur die Token jenseits der Grenze (OpeNAIs eigene Preistabelle, gelesen am 16.09.2026).
• Batch und Flex — die Hälfte des Standardpreises: 5,00 $ Input, 0,50 $ gecachter Input, 6,25 $ Cache-Schreibvorgänge, 25,00 $ Output pro 1 Mio. (OpenAIs eigene Preistabelle, gelesen am 16.09.2026). Ab über 272K Input beträgt der Batch-Tarif 10,00 $ / 1,00 $ / 12,50 $ / 37,50 $.
• Schnellmodus — doppelter Standardsatz: 20,00 $ Eingabe, 2,00 $ gecachte Eingabe, 25,00 $ Cache-Schreibvorgänge, 100,00 $ Ausgabe pro 1 Mio. (OpenAIs eigene Preisliste, gelesen am 16.09.2026).
• Modell-Spezifikationen, die den Preis bestimmen — Kontextfenster 1.050.000 Tokens, maximale Eingabe 922.000, maximale Ausgabe 128.000, Wissensstichtag 2026-04-30, Unterstützung für Reasoning-Tokens ja, Werte für den Reasoning-Aufwand low / medium / high / xhigh / max (OpenAIs eigene Modelldokumentation, gelesen am 16.09.2026).
Wenn Sie die Ein-Satz-Version möchten: Im Standard-Tarif kostet eine Anfrage, die unter 272K Eingabe-Tokens bleibt, 10 $ pro Million Eingabe und 50 $ pro Million Ausgabe, Cache-Lesevorgänge kosten ein Zehntel des Eingabe-Tarifs, und alles andere in diesem Artikel ist entweder ein Rabatt dafür, eine langsamere Verarbeitung zu akzeptieren, oder ein Zuschlag für das Überschreiten einer Schwelle.
Warum Sie eine andere Zahl sehen werden und welche welche ist
Fünf verschiedene Dinge führen zu einem Angebot, das nicht $10/$50 beträgt. Vier davon lassen sich anhand der Dokumentation belegen; eines nicht, und das werden wir sagen, statt zu raten.
$5/$25 ist die Batch-Stufe, und es ist OpenAI's eigener Preis. Dies ist kein Wiederverkäuferrabatt und kein ausgehandelter Enterprise-Tarif. Auf OpenAI's Preisseite wird die Batch-Verarbeitung zum halben Standardtarif aufgeführt, und die Astra-Batch-Zeile nennt $5.00 für den Input und $25.00 für den Output. Wenn eine Quelle Ihnen $5/$25 nennt, als wäre es ein anderes Modell, dann ist es dasselbe Modell, dieselben Gewichte, in der langsameren Warteschlange. Batch ist die richtige Antwort für nächtliche Evaluierungsläufe und die falsche Antwort für alles Interaktive.
11 $/55 $ sind genau ein Aufschlag von 10 % auf den Listenpreis, und OpenAI dokumentiert einen Aufschlag von 10 % für Residency-Endpunkte. Auf der Preisseite von OpenAI heißt es, dass für Residency-Endpunkte ein Aufschlag von 10 % für Modelle berechnet wird, die am oder nach dem 5. März 2026 veröffentlicht wurden. GPT-6 Astra wurde am 3. September 2026 veröffentlicht und erfüllt somit die Voraussetzungen. Multipliziert man den Listenpreis mit 1,1, erhält man 11,00 $ und 55,00 $ auf den Cent genau. Das ist eine starke Erklärung dafür, woher das höhere Angebot im Azure-Stil kommt – ein an Residency gebundener Endpunkt, der einen dokumentierten Aufschlag weitergibt, statt dass ein Reseller eine Marge erfindet. Wir sollten präzise sein, was die Grenze dieser Behauptung angeht: Der Aufschlag wird von OpenAI dokumentiert, und die Arithmetik stimmt exakt überein, aber das konkrete Azure-Listing, das wir gesehen haben, gibt selbst nicht an, dass es sich um einen Residency-Endpunkt handelt. Betrachten Sie es als die wahrscheinliche Erklärung, nicht als eine bestätigte.
$20/$100 ist der Fast-Mode-Tarif von OpenAI für dieses Modell. Diese Zahl sieht am ehesten wie eine unseriöse Zahl aus und ist dabei am wenigsten unseriös. Der Fast-Modus verdoppelt jede Zeile, und Astras Standard-Fast-Zeile liegt bei $20,00 für die Eingabe und $100,00 für die Ausgabe pro 1 Mio. Ein Endpunkt, der $20/$100 angibt, gibt damit eine andere Serviceebene an – Priority Processing –, nicht einen anderen Listenpreis und nicht ein anderes Modell. Wenn Sie diese Zahl neben Astras Namen sehen, lautet die Frage, welche Verarbeitungsstufe gemeint ist, nicht welcher Anbieter.
Preise unter dem Listenpreis existieren, und sie sind die Marge von jemand anderem. Drittanbieter-Gateways und Wiederverkäufer bewerben Astra unter dem Listenpreis. Ein Gateway listet öffentlich etwa 20 % unter dem Tarif von OpenAI. Das ist eine kommerzielle Entscheidung dieses Betreibers, keine Preisänderung von OpenAI — und sie bringt die Datenverarbeitungs- und Zuverlässigkeitsbedingungen mit sich, die dieser Betreiber anwendet. Wir werden sie nicht nennen und ihren Rabatt nicht als Beweis für den Preis dieses Modells werten, denn er ist ein Beweis für ihr Geschäft, nicht für OpenAIs Preisliste.
Was wir nicht verifizieren konnten. Wir sahen ein Router-Listing, das als Modell gpt-6-astra mit einer Batch-Stufe zu $5/$25 und einem beweglichen Alias der Form ~openai/gpt-astra-latest angab. Die Batch-Zahl deckt sich mit der eigenen Seite von OpenAI. Der Alias ist ein Gateway-Konstrukt: Die Modelldokumentation von OpenAI führt genau einen Eintrag unter Snapshots auf, und zwar das reine gpt-6-astra, ohne datierte Form und ohne -latest-Alias. Setzen Sie einen Gateway-Alias nicht in eine Konfiguration, als hätte der Anbieter ihn veröffentlicht. Unabhängig davon fanden wir keine OpenAI-Dokumentation für irgendeine separat bepreiste Stufe wie "Astra Pro", "Astra-Medium" oder Ähnliches. "Pro" erscheint in der Benennung von ChatGPT-Tarifen, nicht in der API-Preisliste, und ein Router-Listing ist keine Anbieterdokumentation. Wenn Sie eine Stufe bestätigt haben möchten, bestätigen Sie sie auf der eigenen Seite von OpenAI.

Astra neben dem Rest der OpenAI-Preiskarte
Ein Preis ist nur im Vergleich zu den Alternativen auf derselben Karte aussagekräftig. Dies sind alles OpenAI-eigene Standardtarife, alle abgerufen am 16. September 2026, alle pro Million Tokens, alle bei 272K Input oder darunter.
• GPT-6 Astra — 10,00 $ Eingabe / 1,00 $ zwischengespeichert / 12,50 $ Schreiben / 50,00 $ Ausgabe.
• GPT-5.6 Sol — $4.00 Eingabe / $0.40 gecacht / $5.00 Schreiben / $20.00 Ausgabe.
• GPT-5.6 Terra — 2,00 $ Eingabe / 0,20 $ Cache / 2,50 $ Schreiben / 12,00 $ Ausgabe.
• GPT-5.6 Luna — 0,20 $ Eingabe / 0,02 $ gecacht / 0,25 $ Schreiben / 1,20 $ Ausgabe.
• Die Long-Context-Versionen — Astra 20,00 $ / 2,00 $ / 25,00 $ / 75,00 $; Sol 8,00 $ / 0,80 $ / 10,00 $ / 30,00 $; Terra 4,00 $ / 0,40 $ / 5,00 $ / 18,00 $; Luna 0,40 $ / 0,04 $ / 0,50 $ / 1,80 $.
Unter dieser Tabelle läuft eine Sonderaktion, und sie bestimmt den Multiplikator, über den alle streiten. Auf der Preisseite von OpenAI heißt es, dass der Aktionspreis von GPT-5.6 Sol mindestens bis zum 21. November 2026 verfügbar ist. Verglichen mit dem Aktionspreis, der heute gilt, ist Astra auf jeder einzelnen Zeile 2,5-mal so teuer wie Sol — 2,5-mal so teuer beim Input, 2,5-mal so teuer beim gecachten Input, 2,5-mal so teuer beim Output. Verglichen mit dem Nicht-Aktionspreis von Sol von 5,00 $ für Input und 30,00 $ für Output ist Astra 2-mal so teuer beim Input und etwa 1,67-mal so teuer beim Output. Beide Multiplikatoren sind rechnerisch korrekt und sie beschreiben dieselben zwei Modelle am selben Tag. Der Unterschied liegt einzig und allein darin, welchen Sol-Preis du als Nenner verwendest, und die ehrliche Antwort auf „Ist Astra 2,5-mal so teuer wie Sol?“ lautet: ja, bis zum 21. November 2026 oder wann immer OpenAI die Aktion beendet — je nachdem, was zuerst kommt.
Wir legen diesen Punkt ausführlich dar, weil er der häufigste Fehler in der Berichterstattung über dieses Modell ist, auch auf diesem Blog. Ein Multiplikator pro Token, der stillschweigend eine Sol-Rate auswählt und sie nicht benennt, ist keine Tatsache über Astra. Er ist eine Tatsache darüber, wann der Satz geschrieben wurde.

Kosten pro Aufgabe, nicht Kosten pro Token
OpenAIs eigene Darstellung ist, dass der Vergleich von Token-Preisen für dieses Modell der falsche Vergleich ist, weil Astra darauf ausgelegt ist, langfristige Arbeit mit weniger Tokens und weniger Wiederholungsversuchen zu erledigen. Diese Behauptung ist es wert, ernst genug genommen zu werden, um die Rechnung anzustellen, anstatt sie einfach zu wiederholen. Hier ist also ein durchgerechnetes Beispiel mit vorab genannten Annahmen, damit Sie sie an Ihre eigene Arbeitslast anpassen können.
Die Arbeitslast: ein Agentenlauf mit 200 Aufrufen, die Form einer über Nacht laufenden Migration. Jeder Aufruf umfasst 10.000 Eingabe-Tokens, von denen 8.000 Cache-Lesevorgänge und 2.000 frische Tokens sind, und erzeugt 500 Ausgabe-Tokens. Über den gesamten Lauf sind das 400.000 frische Eingabe-Tokens, 1.600.000 gecachte Eingabe-Tokens und 100.000 Ausgabe-Tokens, plus einen einzelnen Cache-Schreibvorgang von 10.000 Tokens, um das Präfix vorzubelegen. Standard-Tarif, unter 272K pro Anfrage, daher fällt kein Long-Context-Aufschlag an.
• GPT-6 Astra — Neu 0,4 Mio. × 10,00 $ = 4,00 $; Cache 1,6 Mio. × 1,00 $ = 1,60 $; Schreiben 0,01 Mio. × 12,50 $ = 0,13 $; Ausgabe 0,1 Mio. × 50,00 $ = 5,00 $. Gesamt 10,73 $.
• GPT-5.6 Sol zum Aktionspreis — neu $1.60; zwischengespeichert $0.64; Schreiben $0.05; Ausgabe $2.00. Gesamt $4.29.
• GPT-5.6 Sol zum regulären Preis — frisch 2,00 $; zwischengespeichert 0,80 $; Schreiben 0,06 $; Ausgabe 3,00 $. Gesamt 5,86 $.
• GPT-5.6 Terra — neu $0.80; zwischengespeichert $0.32; Schreiben $0.03; Ausgabe $1.20. Gesamt $2.35.
• GPT-5.6 Luna — neu $0,08; gecacht $0,03; Schreiben $0,00; Ausgabe $0,12. Gesamt $0,23.
Bei identischen Token-Zahlen ist Astra dann also etwa das 46-Fache von Luna und das 4,6-Fache von Terra. Niemand kauft Luna, um eine Aufgabe in Astra-Größe zu erledigen, und genau diese Fußnote ist der ganze Grund, warum Kosten-pro-Token-Vergleiche zwischen diesen beiden Modellen reines Theater sind. Der Vergleich mit Sol ist derjenige, der etwas entscheidet, also hier ist die Zahl, auf die es ankommt.
Der Break-even-Punkt liegt bei 40 %. Da Astra bei Sols Aktionspreis in jeder Zeile genau 2,5-mal so teuer wie Sol ist, kann Astra bei derselben Aufgabe bis zu 40 % von Sols Tokens verbrauchen und landet trotzdem auf derselben Rechnung – und das gilt für jede Mischung aus frischem Input, gecachtem Input und Output, weil das Verhältnis einheitlich ist. Wenn Astra ein Drittel von Sols Tokens einsetzt, kommt Astra günstiger weg; setzt Astra die Hälfte ein, ist Astra teurer. Gegenüber Sols regulärem Preis steigt der Break-even-Punkt bei dieser cache-lastigen Mischung auf etwa 55 %, weil Astras Output-Multiplikator auf 1,67x sinkt, während sein Input-Multiplikator auf 2x fällt.
Diese eine Zahl ist die aussagekräftige, und an ihr gehen die Herstellerangabe und die unabhängige Messung auseinander. OpenAI meldet für Terminal-Bench 4.0 57,9 % für Astra gegenüber 37,3 % für GPT-5.6 Sol, bei geschätzten API-Kosten pro Aufgabe, die etwa 9 % niedriger liegen – Herstellerangabe. Artificial Analysis hat in einer am 9. September 2026 veröffentlichten unabhängigen Bewertung Astra im Coding Agent Index mit etwa einem Drittel der Tokens von Sol pro Aufgabe gemessen und für Astra dennoch 7,09 $ pro Aufgabe bei maximalem Aufwand ermittelt – etwa 15 % mehr als Sol (max) – bei einem um 7 Punkte höheren Ergebnis. Im Intelligence Index derselben Bewertung lag Astra über die Aufwandsstufen hinweg zwischen 0,82 $ und 3,26 $ pro Aufgabe, also etwa 60 % teurer als Sol bei maximalem Aufwand.
Beides kann gleichzeitig zutreffen, und die Lücke zwischen ihnen ist die ehrliche Schlagzeile. Token-Einsparungen sind real und groß — ein Drittel ist genau die Art von Zahl, die einen Break-even von 40 % überschreitet —, aber Einsparungen, die anhand von Output-Tokens gemessen werden, verkleinern nicht die Cache-Read- und Fresh-Input-Posten, die eine lange Agenten-Session dominieren. Ob Astra pro Aufgabe günstiger ist als Sol, hängt von Ihrem Mix ab, und die Richtung kippt je nach Workload. Wer Ihnen sagt, es sei einfach günstiger oder einfach 2,5-mal teurer, zitiert eine Zeile der Rechnung, als wäre sie die Gesamtsumme.
Was bestimmt bei diesem Modell eigentlich die Rechnung
Drei Dinge dominieren, und alle drei sind spezifisch dafür, wie Astra verwendet werden soll.
Reasoning-Tokens sind Ausgabe-Tokens. Sie werden mit 50,00 $ pro Million abgerechnet, genauso wie sichtbare Ausgabe. Auf der Modellseite von OpenAI werden die unterstützten Effort-Werte mit low, medium, high, xhigh und max angegeben, und es gibt keine Deaktivierungseinstellung – die Untergrenze ist höher als bei älteren Modellen. Bei der unabhängigen Messung im Intelligence Index lag die Spanne zwischen den Effort-Stufen low und max bei 0,82 $ bis 3,26 $ pro Aufgabe – ein Faktor von vier bei identischer Arbeit. Die Effort-Stufe ist der größte einzelne Kostenhebel, den Sie kontrollieren, und es lohnt sich, sie pro Aufruf statt global festzulegen.
Wiederholungen vervielfachen alles. Ein Agent, der scheitert und erneut ausgeführt wird, bezahlt den gesamten Prefix noch einmal. Das ist der Mechanismus hinter OpenAIs Behauptung, mit weniger Wiederholungen auszukommen, und es ist auch der Grund, warum Pro-Token-Rechnungen in beide Richtungen irreführen: Ein Modell, das pro Token 2,5-mal so viel kostet, aber in einem Durchlauf fertig wird, kann ein billigeres Modell schlagen, das drei Durchläufe braucht. Wenn Sie Astra mit irgendetwas vergleichen, messen Sie abgeschlossene Aufgaben pro Dollar, nicht Token pro Dollar.
Langer Kontext ist der vorgesehene Modus, und er ist mit einem Aufschlag belegt. Das Fenster umfasst 1.050.000 Token. Überschreitet eine einzelne Anfrage 272.000 Input-Token, wird die gesamte Anfrage neu bepreist – mit 20,00 $ pro Million für Eingabe und 75,00 $ pro Million für Ausgabe –, nicht nur der übersteigende Teil. Eine Anfrage mit 280.000 Token kostet ungefähr doppelt so viel wie eine Anfrage mit 270.000 Token, für etwa 4 % mehr Eingabe. Bei einem Modell, das für langfristige Arbeit gebaut wurde, ist dies die mit Abstand einfachste Möglichkeit, unbemerkt ein Budget zu sprengen, und deshalb ist es üblicherweise billiger, eine langfristige Aufgabe in Anfragen unter 272K aufzuteilen, als sie als Ganzes zu senden, obwohl das Modell in der Lage ist, sie als Ganzes zu verarbeiten.
Das Gegengewicht ist das Caching, und genau hier sparen lange Agent-Sitzungen tatsächlich Geld. Gecachte Lesevorgänge kosten 1,00 $ gegenüber 10,00 $ für frische, eine Reduzierung um 90 %, und eine lange Sitzung sendet dasselbe Präfix Dutzende Male erneut. Der Cache-Schreibvorgang von 12,50 $ wird einmal bezahlt. Im oben durchgerechneten Beispiel würde Astras Rechnung, wenn jeder Aufruf sein 8.000-Token-Präfix ungecacht erneut senden müsste, von 10,73 $ auf etwa 25,00 $ steigen — der Cache leistet mehr für das Budget als jede andere einzelne Position.
Der Datensatz zum Multiple
Mehrere Seiten in diesem Blog, darunter GPT-6 Astra vs. GPT-5.6 Sol: Lohnt sich der 2,5-fache Preis? und GPT-6 Astra: Nachfrage pausiert neue $200 ChatGPT Pro-Anmeldungen, geben an, dass Astra mit dem 2,5-Fachen des Token-Preises von GPT-5.6 Sol gelistet wird. Diese Zahl wurde anhand von Sols Aktionspreis von $4,00 pro Eingabe und $20,00 pro Ausgabe berechnet, dem Preis, den die Preisseite von OpenAI heute führt und als Aktionspreis beschreibt; er ist mindestens bis zum 21. November 2026 verfügbar.
Der Multiplikator ist also nicht falsch geworden – er hat ein Ablaufdatum erhalten, das die früheren Seiten nicht trugen. Gegenüber Sols Nicht-Aktionspreis von 5,00 $ für Input und 30,00 $ für Output liegt Astra beim Input bei 2x und beim Output bei etwa 1,67x, nicht bei 2,5x. Die Seiten, die 2,5x nennen, sollten so gelesen werden, dass sie sich auf das Aktionsfenster beziehen; die Richtung des Vergleichs ändert sich nicht, aber die Größe der Lücke schrumpft um ein Fünftel bis ein Drittel, sobald die Aktion endet. Wer über den 21. November 2026 hinaus budgetiert, sollte 5,00 $ und 30,00 $ als Sol-Nenner und 2x / 1,67x als Astra-Multiplikator verwenden. Wir wiederholen die Argumente auf diesen Seiten nicht – die dortigen Benchmark- und Zuverlässigkeitsüberlegungen stehen für sich –, sondern korrigieren nur den Nenner, gegen den sie berechnet wurden.
Die „free“-Frage, ohne Ausflüchte beantwortet
Für dieses Modell gibt es keine kostenlose Stufe und keinen kostenlosen API-Zugang. Nutzer von ChatGPT Free und ChatGPT Go erhalten GPT-6 Astra überhaupt nicht. Plus-Abonnenten erhalten es nur über ChatGPT Work und Codex, nicht im regulären Chat. Die API wird ab dem ersten Token mit 10,00 $ pro Million Input-Token abgerechnet, und der günstigste legitime Weg, diese Zahl zu senken, ist die Batch-Stufe zu 5,00 $ pro Million, was eher Latenz als Leistungsfähigkeit kostet. Wer kostenlosen API-Zugang zu GPT-6 Astra bewirbt, verkauft etwas weiter — meist einen Testguthaben-Pool auf einem Drittanbieter-Gateway mit eigenen Datenbedingungen. Das ist nicht unbedingt ein schlechtes Angebot, aber es ist nicht kostenlos, und es ist nicht OpenAI.
Wichtig zu wissen, wenn Sie Ihre Kapazitätsplanung auf ein Abonnement statt auf die API ausrichten: Am 10. September 2026 pausierte OpenAI neue Anmeldungen und Upgrades für seine 200-Dollar-Stufe ChatGPT Pro und begründete dies mit der Nachfrage nach Astra. Die 100-Dollar-Stufe, Plus, Go, die API sowie Business- und Enterprise-Konten blieben offen. Verbraucher wurden rationiert; API- und Enterprise-Zugang nicht. Wenn Ihr Plan vom Nutzungskontingent eines Verbraucher-Abonnements abhängt, ist das das Risiko, das Sie modellieren müssen.
Es routen – und was ein Router nicht behebt
Astra ist eines der Modelle, die über OrcaRouter unter openai/gpt-6-astra verfügbar sind, zu denselben 10,00 $ für Input und 50,00 $ für Output, die der Anbieter berechnet, mit der auf unserer Modellseite gezeigten Staffelung oberhalb von 272K. Wir geben den Listenpreis des Anbieters mit 0 % Aufschlag weiter, was bei diesem Modell mehr zählt als bei den meisten: Die Zahlen in diesem Artikel haben sich bereits einmal innerhalb der Lebensdauer des Modells geändert, und ein durchgereichter Preis ändert sich an dem Tag, an dem der Anbieter ihn ändert, und nicht erst, wenn sich jemand daran erinnert, eine Tabelle zu aktualisieren.

Das ehrliche Argument für Routing ist hier nicht der Preis, denn es gibt keinen Rabatt, den man dir verkaufen könnte — es ist, dass die obige Kostenrechnung von der Workload abhängt und du erst nach dem Ausführen weißt, auf welcher Seite der 40%-Gewinnschwelle du landest. Astra hinter einem einzigen Endpoint zusammen mit Sol, Terra und Luna zu betreiben bedeutet, dass du abgeschlossene Aufgaben pro Dollar mit deinem eigenen Traffic messen und Modelle wechseln kannst, ohne einen zweiten Vertrag oder eine Codeänderung. Die Routing-DSL ermöglicht es dir, einen Aufruf über mehrere Modelle hinweg zusammenzusetzen, statt einen Produktionspfad auf ein einziges festzulegen, und automatisches Failover deckt den Fall ab, den dieses Modell bereits zweimal gezeigt hat — dass die Nachfrage danach die Kapazität übersteigen kann.
Die Kompromisse sind genauso real und es lohnt sich, sie zu benennen. Ein Router ist ein Hop im Anfragepfad, und bei einem Modell, dessen Verkaufsargument langfristig autonome Arbeit ist, ist dieser Hop ein weiterer Punkt in der Fehlerdomäne; wenn Ihre Toleranz dafür null ist, wenden Sie sich direkt an den Anbieter. Mehrere Dinge in diesem Artikel existieren nur bei einer direkten Beziehung: Die Option Zero Data Retention, die OpenAI berechtigten API-Kunden auf unterstützten Endpunkten anbietet, unterliegt der Genehmigung durch OpenAI, und Enterprise-Enablement – das beim Start standardmäßig deaktiviert ist und von Administratoren gemäß ihrer geltenden Rate Card aktiviert wird – ist eine Vereinbarung zwischen Ihnen und OpenAI, nicht etwas, das ein Router gewähren kann. OpenAI dokumentiert außerdem, dass der Fast-Modus für dieses Modell mit EU-Datenresidenz nicht verfügbar ist. Wenn Sie Residenz und Geschwindigkeit zusammen benötigen, folgt diese Einschränkung dem Modell, nicht der Route. Und ein Aufschlag von 0 % bei einem Router ist kein Rabatt: Wir sind nicht günstiger als der direkte Weg, wir sind derselbe Preis mit weniger Integrationen, die gepflegt werden müssen.
Was zu sehen
Ein Datum und eine Zahl. Das Datum ist der 21. November 2026, an dem Sols Aktionspreis nicht mehr garantiert ist – wenn er wegfällt, sinkt Astras Multiplikator gegenüber Sol bei der Eingabe von 2,5x auf 2x und bei der Ausgabe auf 1,67x, und jeder im Umlauf befindliche Kosten-pro-Aufgabe-Vergleich wird um ein Fünftel bis ein Drittel vorteilhafter für Astra, ohne dass sich an Astra auch nur eine einzige Sache ändert. Die Zahl ist Ihr eigener Break-even: Führen Sie eine repräsentative Aufgabe mit langem Zeithorizont auf beiden Modellen aus, zählen Sie abgeschlossene Aufgaben und die Gesamtsumme in Dollar, und Sie erhalten eine Antwort, die nützlicher ist als alles, was veröffentlicht wurde, einschließlich dieser Seite.
Astra hinter einen einzigen Endpunkt neben Sol, Terra und Luna zu stellen bedeutet, dass Sie abgeschlossene Aufgaben pro Dollar mit Ihrem eigenen Traffic messen und Modelle wechseln können, ohne einen zweiten Vertrag oder eine Codeänderung.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
