Eine Hero-Titelkarte für einen Leak-Watch-Artikel über die Gerüchte zu GPT-6 Luna und GPT-6 Sol, mit einem bernsteinfarbenen Badge 'UNVERIFIZIERT · LEAK WATCH' oben links, der Dachzeile 'LEAK-BERICHT', der Schlagzeile 'GPT-6 Luna und GPT-6 Sol' über der Zeile 'zwei Namen, keine Modelle', dem Untertitel 'Keines hat eine Modell-ID, einen Preis, ein Datum oder eine OpenAI-Stellungnahme', drei Chips mit der Aufschrift 'GPT-6 Astra ausgeliefert am 3. September 2026', 'NVIDIA-Merge-Rekord: GPT-6 Sol medium' und 'GPT-5.6 Luna live für $0.20 / $1.20' sowie unten einer durchgezogenen Karte 'GPT-5.6 Luna — ausgeliefert, $0.20 / $1.20 pro MTok', die über einen dünnen Pfeil mit zwei gestrichelten Karten 'GPT-6 Sol ? — nicht angekündigt' und 'GPT-6 Luna ? — nicht angekündigt' verbunden ist. Das OrcaRouter-Logo ist in die untere rechte Ecke eingefügt.
Guides & Insights

GPT-6 Luna und GPT-6 Sol: Die günstige Preisklasse, die OpenAI noch nicht veröffentlicht hat

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Es gibt ein hartes, überprüfbares Artefakt in dieser Geschichte, und es ist keiner der beiden Namen in der Überschrift. Am 21. September berichteten Entwickler, sie hätten die Zeichenkette GPT-6 Sol mediumin NVIDIA-Code-Merge-Aufzeichnungen gesehen – im Repository eines Dritten, nicht des Anbieters. Um dieses eine Artefakt herum hat sich ein weit größeres Gerücht gebildet: dass OpenAI sich darauf vorbereite, GPT-6 Solals Arbeitspferd der mittleren Stufe auf den Markt zu bringen und GPT-6 Lunaals seine günstige Stufe, unterhalb des Flaggschiffs GPT-6 Astra, das OpenAI tatsächlich am 3. September 2026 ausgeliefert hat. Weder GPT-6 Sol noch GPT-6 Luna hat eine Modellkennung, einen Preis, ein Kontextfenster, eine System Card oder eine Zeile in OpenAIs eigener Dokumentation. Die Stufe, die sie besetzen würden, hat jedoch bereits einen aktiven Bewohner in GPT-5.6 Luna – dem Budget-Mitglied der GPT-5.6-Familie, das seit dem 9. Juli 2026 für 0,20 $ pro Million Input-Tokens und 1,20 $ pro Million Output-Tokens erhältlich ist. Diese Asymmetrie ist die ganze Geschichte, und sie ist der Grund, warum man diesen Artikel lesen und nicht bloß absichern sollte.

Was ist tatsächlich dokumentiert, und was ist Schlussfolgerung?

Beginne mit dem Artefakt, denn es ist das Einzige hier, das ein Leser selbst nachsehen kann. Der NVIDIA-Merge-Eintrag ist in dem Sinne real, dass die Personen, die darüber berichteten, ein öffentliches Repository lasen, und die beschriebene Codeänderung ist unspektakulär: ein Commit, der mit Unterstützung von GPT-6 Astra verfasst und anschließend von etwas geprüft wurde, das als GPT-6 Sol bezeichnet wird. Der 新智元-Artikel, der den Befund einem breiteren Publikum bekannt machte, rahmte ihn als funktionierendes Beispiel einer „AI-Arbeitskräftematrix“ – einer Kette, in der ein Modell schreibt und ein anderes prüft. Betrachte diese Rahmung als Kommentar. Der Merge-Eintrag selbst sagt dir, dass jemand innerhalb der Infrastruktur eines Drittanbieters dabei ist, ein Modell unter diesem Namen bereitzustellen. Er sagt nicht, dass OpenAI eines veröffentlicht hat, und er sagt überhaupt nichts über Luna.

Der Rest der Argumente für einen Launch von GPT-6 Sol ist dünner, als die Berichterstattung darüber vermuten lässt. Die chinesische Tech-Presse hat von einem durchgesickerten Preis von 2,50 US-Dollar pro Million Eingabe-Tokens und 15 US-Dollar pro Million Ausgabe-Tokens berichtet – etwa die Hälfte dessen, was GPT-5.6 Sol kostet –, zusammen mit Behauptungen, dass Unterstützung über die OpenAI API, Codex OAuth, Bildeingabe und Langkontext-Verarbeitung hinweg eingerichtet würde, sowie einem behaupteten Launch am Dienstag, dem 22. September. Ein Teil dieser Berichterstattung deutete auf Dienstag um 3 Uhr morgens hin. Zum Zeitpunkt des Verfassens gibt es keine OpenAI-Ankündigung, keinen Identifier-String, keinen Eintrag auf der Preisseite und keine Sichtung in der Modellauswahl für GPT-6 Sol oder GPT-6 Luna. Ein Medium, das dieselbe Gerüchtkette verfolgte, merkte an, dass seine eigenen Preisangaben nicht zueinander passten, und nannte 2,50 $/15 $, 4 $/30 $ und weitere kursierende Zahlen – was so aussieht wie ein Gerücht, nachdem es vier Übersetzungen durchlaufen hat, nicht wie eine Preisliste.

GPT-6 Luna ist noch schwächer, und es lohnt sich, das unverblümt zu sagen. Lunas Auftauchen in der Geschichte geht auf einen einzigen Beitrag vom 6. September zurück, in dem der X-Account @kimmonismus schrieb, OpenAI sei „bereits dabei, die Veröffentlichung von GPT-6 Sol vorzubereiten“, und dann aus dem Namensmuster von GPT-5.6 ableitete, dass „Sol, Terra und Luna noch kommen werden“. Das ist ein Argument aus der Namenssymmetrie. Luna war nie Gegenstand einer eigenständigen Behauptung – kein Leak, kein Screenshot, kein Model-String, kein Preis. In späteren Zusammenstellungen taucht es nur auf, weil es im ersten Beitrag auftauchte.

Drei Daten, und was jedes einzelne bewies

Leak-Zeitlinien lohnt es sich als Scorecard zu lesen, denn diese hier hat bereits eine.

6. September — die Behauptung der Familie. Schlussfolgerung der Community aus dem GPT-5.6-Präzedenzfall, kein Artefakt beigefügt. Damals unbestätigt, heute unbestätigt.

15.–16. September — Sam Altman postete, dass OpenAI diese Woche eine „große Veröffentlichung“ habe und dann zum DevDay „Veröffentlichung x 6“, nahm die erste Hälfte davon am folgenden Abend zurück und sagte, die Sache, auf deren Start er sich am meisten freue, werde stattdessen erst in der nächsten Woche erscheinen und „das Warten wert“ sein. In keinem der beiden Posts nannte er ein Produkt. Dies ist das einzige von einer Führungskraft geäußerte Element in der gesamten Geschichte, und es betrifft nur den Zeitpunkt und sonst nichts.

21. September — der NVIDIA-Merge-Eintrag und das erste Artefakt in der Kette. Ein Merge-Eintrag in einem fremden Repository ist ein echtes Signal dafür, dass ein Modell für die Bereitstellung vorbereitet wird. Es ist kein Release.

Dienstag, 22. September – heute, und das Datum, das das Gerücht selbst nannte. Zum Zeitpunkt dieses Schreibens gibt es keine OpenAI-Ankündigung, keine Modellkennung, keinen Eintrag in der Preisliste und keine Sichtung im Modellauswahlmenü für GPT-6 Sol, und überhaupt keine für GPT-6 Luna.

Der nächste datierte Checkpoint ist der DevDay am Dienstag, dem 29. September, im Fort Mason Center — das von Altman erwähnte „ship x 6“ und das Ausweichdatum, auf das die chinesische Berichterstattung verwies, falls der Start am Dienstag nicht stattfand. Wenn ein Mittelklasse- oder Budgetmodell der sechsten Generation tatsächlich existiert, würde es dort am plausibelsten auftauchen, und eine einzige Zeile in OpenAIs eigener Modellliste würde alles klären, was dieser Artikel nur vorsichtig formulieren muss.

Die Stufe existiert bereits, und sie ist günstig.

Hier ist der Teil der Geschichte, der sich vollständig überprüfen lässt, und er ist der Grund, warum es seltsam ist, auf ein „GPT-6 Luna“ zu warten. GPT-5.6 Luna ist live, und es ist auf eine Weise günstig, wie es Frontier-Modelle nicht sind.

Preis — 0,20 $ pro Million Eingabe-Token und 1,20 $ pro Million Ausgabe-Token, laut OpenAIs eigener API-Dokumentation. Es wurde am 9. Juli 2026 zu 1,00 $ / 6,00 $ eingeführt und Ende Juli um rund 80 % gesenkt.

Cache- und Langkontext-Tarife — gelesene gecachte Eingaben werden mit rund 90 % Rabatt abgerechnet; Anfragen oberhalb der Langkontext-Schwelle werden mit etwa 0,40 $ / 1,80 $ für die gesamte Anfrage berechnet.

Kontext und Ausgabe — ein Kontextfenster von 1 Mio. Tokens mit einer maximalen Ausgabe von 128K. Die mediane Zeit bis zum ersten Token wird mit 1,83 Sekunden angegeben.

Rolle — OpenAI ersetzte GPT-5.5 Instant durch GPT-5.6 Luna als Standardmodell für ChatGPT Free und Go am 6.–7. August 2026 und fügte in der darauffolgenden Woche eine „Think“-Schaltfläche für tiefergehendes Reasoning hinzu.

Auswirkung der Preissenkung — am 9. September sagte Sarah Friar, Finanzvorständin von OpenAI, auf der Communacopia-Konferenz von Goldman Sachs, die Preissenkung habe zu einer etwa zehnfachen Steigerung der Nutzung geführt, und argumentierte, der Einsatz von Luna sei günstiger als der Betrieb von Z.ai's GLM 5.3 auf einer Cloud-Ebene. Beides sind Anbieterzahlen, die eine Führungskraft bei einer Investorenveranstaltung genannt hat: berichtenswert, aber nicht als unabhängig verifiziert zu behandeln.

A two-column scoreboard titled 'GPT-6 Sol and GPT-6 Luna (reported) vs GPT-5.6 Luna (shipped) — the scoreboard'. The left column 'GPT-6 Sol and GPT-6 Luna (reported)' reads: Model ID: none found; Price per MTok: reported $2.50 in / $15 out, inconsistent; Context window: not announced; Availability: not shipped; Evidence: one NVIDIA merge record plus unnamed developer reports; Date: claimed Sep 22, unconfirmed. The right column 'GPT-5.6 Luna (shipped)' reads: Model ID: openai/gpt-5.6-luna; Price per MTok: $0.20 in / $1.20 out; Context window: 1M tokens, 128K max output; Availability: GA since Jul 9, 2026; Evidence: OpenAI API docs and price list; Role: default model for ChatGPT Free and Go. The footer reads 'GPT-6 Sol and GPT-6 Luna are unconfirmed; GPT-5.6 Luna figures per OpenAI's API documentation.' The OrcaRouter logo is composited in the bottom-right corner.

Setzt man die beiden Preispunkte nebeneinander, beantwortet sich die Frage nach der Staffelung von selbst. Der gemeldete Preis für GPT-6 Sol von 2,50 $ / 15 $ liegt mehr als zwölfmal über dem Eingabepreis von GPT-5.6 Luna. Eine Luna der sechsten Generation würde nicht mit Sol konkurrieren – sie würde mit dem Modell konkurrieren, das OpenAI bereits als Standard seiner kostenlosen Tarifstufe verschenkt.

Warum eine günstige GPT-6-Stufe trotzdem plausibel ist

Unter dem Gerücht steckt ein echtes kommerzielles Argument, und es geht darum, wo die Tokens sind, nicht darum, wo das Leaderboard steht. GPT-6 Astra kostet 10 $ pro Million Input-Tokens und 50 $ pro Million Output-Tokens, wobei Anfragen mit langem Kontext zu einem höheren Tarif abgerechnet werden. Es listet ein Kontextfenster von 1 Mio. Tokens auf – dieselbe Klasse wie die 5.6-Generation, zu einem deutlich höheren Preis. Bei Artificial Analysis erreicht die Max-Reasoning-Konfiguration von Astra 53 Punkte im Intelligence Index des Trackers bei etwa 3,26 $ pro Aufgabe, was für Frontier-Arbeit ein vertretbarer Preis ist und für Klassifikation, Extraktion, Routing oder hochvolumige Agent-Loops ein unvertretbarer.

Diese Lücke hat genau die Form, die in der 5.6-Generation Sol, Terra und Luna hervorgebracht hat, und deshalb deutet die Berichterstattung immer wieder auf einen Mittelklasse-Sol statt auf ein zweites Flaggschiff hin. Das eigene Preisverhalten von OpenAI stützt diese Stoßrichtung: Die Reaktion auf den Kostendruck im Juli bestand darin, die günstige Stufe um 80 % zu senken, statt sie zu ersetzen, und der CFO trat im September auf die Bühne, um über den Preis gegenüber chinesischen Open-Weight-Modellen zu streiten. Ein Unternehmen, das das untere Marktsegment verteidigt, ist ein Unternehmen, das weiterhin im unteren Segment liefern will.

Das Gegenargument ist ebenso real, und es ist der Grund, warum die Logik des Leaks selbst schwächer ist, als sie aussieht. Ein Budget-Modell der 6er-Serie auszuliefern bedeutet, jedes Team, das bereits Prompts, Caching und Evaluierungs-Harnesses um GPT-5.6 Luna herum abgestimmt hat, dazu zu bringen, all das für einen marginalen Gewinn erneut zu qualifizieren. Das ist ein echter Grund, warum eine GPT-6 Luna möglicherweise nie angekündigt wird – nicht weil das Gerücht falsch ist, sondern weil die Produktentscheidung, die es voraussetzt, möglicherweise nicht getroffen wurde.

A screenshot of the Artificial Analysis model page for GPT-6 Astra at maximum reasoning, showing an Intelligence Index score of 53, a speed of 65.3 output tokens per second, a cost of $3.26 per Intelligence Index task, and list pricing of $10.00 per million input tokens and $50.00 per million output tokens.

Wie man sich vorbereitet, ohne auf ein Modell zu setzen, das nicht existiert

Du kannst GPT-6 Sol oder GPT-6 Luna nicht aufrufen. Niemand kann das, und keine Plattform hostet sie – das Höchste, was berichtet wurde, ist, dass ein Entwickler dort einen GPT-6-Sol-Modellstring zurückgegeben sah, wo eine GPT-5.6-Sol-Anfrage erwartet wurde, was eher eine Routing-Kuriosität als Verfügbarkeit ist. Was du tun kannst, ist, die letztendliche Ankunft kostengünstig zu übernehmen und es teuer zu machen, von ihr überrascht zu werden.

Die praktische Variante besteht darin, den Modellnamen aus Ihrem Anwendungscode herauszuhalten. Wenn Ihr Stack ein Modell über einen fest codierten String aufruft, bedeutet die Umstellung auf eine Mittelklasse der sechsten Generation ein Deployment, eine erneute Prompt-Qualifizierung und einen neuen Evaluationslauf. Wenn er eine Route aufruft, bedeutet es die Änderung einer einzigen Zeile. OrcaRouter stellt über 200 Modelle hinter einer einzigen API mit 0 % Aufschlag bereit — der Listenpreis des Anbieters wird direkt weitergegeben, sodass sich der Wert auf unserer Seite am selben Tag ändert, wenn ein Anbieter einen Preis senkt; genau so tauchte die 80-prozentige Senkung von GPT-5.6 Luna hier auf, ohne dass irgendjemand etwas neu verhandeln musste. Das automatische Failover erledigt den Rest: Richten Sie eine Route auf die günstigste Stufe aus, die Ihren Eval-Schwellenwert erfüllt, und ein noch nicht ausgeliefertes Modell bleibt außen vor, bis es existiert und besteht.

A screenshot of the OrcaRouter model page for openai/gpt-5.6-luna, showing the model title GPT-5.6 Luna, its capability chips, a 1M-token context window with a 128K maximum output, an input price of $0.20 per million tokens and an output price of $1.20 per million tokens.

Das ist die ehrliche Nutzung eines Leaks wie diesem: nicht eine Migration zu einem Modell zu planen, das noch nicht angekündigt wurde, sondern zu erkennen, welchen Platz in deinem Stack eine neue Mittelklasse füllen würde, und sicherzustellen, dass das spätere Füllen eine Konfigurationsänderung und kein Projekt ist.

Was würde als Beweis gelten

Die Grenze zwischen einem Leak, dem man nachgehen sollte, und einem Leak, den man ignorieren sollte, ist, ob das Artefakt vom Anbieter oder von einer neutralen Partei erstellt wurde. Hier angewendet:

Zählt — eine Modellkennung in OpenAIs API-Dokumentation, eine System Card, ein Eintrag auf OpenAIs Preisseite, ein Erscheinen in der ChatGPT-Modellauswahl, ein erster unabhängiger Benchmark-Lauf auf einem Tracker wie Artificial Analysis oder eine Listung in einem Routing-Katalog mit einem echten Endpunkt dahinter.

Zählt nicht — ein Merge-Eintrag im Repository von jemand anderem für sich allein betrachtet, eine quellenlose Gerüchteliste in einem Sammelartikel, ein geleaktes Screenshot eines Preises, den drei Medien auf drei verschiedene Weisen melden, die Beobachtung eines ungenannten Entwicklers oder eine Wahrscheinlichkeit aus einem Prognosemarkt. Prognosemärkte taxierten Ende Juli eine Veröffentlichung von GPT-6 bis zum 30. September mit etwa 77–78 %. Das ist die Meinung eines Marktes über ein Datum, kein Beleg für ein Modell, und sie wurde eingepreist, bevor Astra erschien.

Bis einer der ersten Listeneinträge landet, ist die genaue Position zu beiden Namen begrenzt und unspektakulär. GPT-6 Sol ist eine Zeichenkette in einem NVIDIA-Merge-Datensatz und ein Preis, auf den sich niemand einigen kann. GPT-6 Luna ist ein Name, der in einem Familien-Gerücht auftaucht, in einer Liste, die niemand für sich beansprucht hat, und eine Stufe einnimmt, die GPT-5.6 Luna bereits bei 0,20 $ Input und 1,20 $ Output belegt. Es gibt nichts, wohin man migrieren könnte, nichts zu benchmarken und nichts zu bepreisen. Das Einzige, was heute zu tun sich lohnt, ist sicherzustellen, dass Ihr Routing nicht umgeschrieben werden muss, um es zu erreichen, sobald es etwas gibt.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert