Eine generierte Hero-Karte mit dem Titel „GPT-6 Sol vs GPT-5.6 Sol“, der Überschrift „1 Indexpunkt Unterschied, zum halben Preis“, wobei die Karten der beiden Modelle einen AA Index von 48 gegenüber 47 sowie Preise von 2,00 $/10,00 $ gegenüber 4,00 $/20,00 $ zeigen und das OrcaRouter-Logo unten rechts.
Guides & Insights

GPT-6 Sol vs. GPT-5.6 Sol: Ein Indexpunkt, halber Preis und eine Regression, die niemand angekündigt hat

Autor

Elias Hawthorne

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Ja, upgraden – aber lesen Sie vorher den zweiten Absatz. GPT-6 Sol, veröffentlicht am 22. September 2026, erreicht 48 Punkte im Intelligence Index von Artificial Analysis. GPT-5.6 Sol, veröffentlicht am 9. Juli 2026, erreicht 47 Punkte. Ein Punkt. Das Modell, das es ersetzt hat, kostet halb so viel: 2,00 $ pro Million Input-Token und 10,00 $ pro Million Output-Token gegenüber 4,00 $ und 20,00 $. Gemessen an den Eckdaten ist dies die einfachste Upgrade-Entscheidung im aktuellen Lineup, und die Preissenkung ist real, dauerhaft und die größte einzelne Preissenkung, die der Anbieter bei einem Flaggschiff vorgenommen hat.

Die Komplikation ist, dass die eigene Bewertung von GPT-6 Sol durch Artificial Analysis eine Mischung aus Verbesserungen und Rückschritten ergab statt eines sauberen Sprungs nach vorn. Bei GDPval-AA v2.1 gibt es Rückschritte. Außerdem gibt es eine Langkontext-Preisstufe oberhalb von 272.000 Eingabe-Tokens, die die Eingaberate etwa verdoppelt und die Ausgaberate um die Hälfte erhöht – und 272K ist genau der Bereich, in dem GPT-5.6 Sol eine veröffentlichte Stärke aufweist. Eine Migration, die wie eine einfache Halbierung Ihrer Rechnung aussieht, kann bei Langkontext-Traffic unterm Strich eher auf null hinauslaufen – mit einem Kompromiss bei den Fähigkeiten obendrauf.

Was ein Anstieg des Index um einen Punkt tatsächlich bedeutet

Beide Modelle wurden auf demselben Board, Version 4.3.2, gemessen, was dies zum saubersten Vergleich in der gesamten GPT-6-Sol-Serie macht – keine Unterschiede bei der Testumgebung, keine Diskrepanz zwischen Hersteller und unabhängiger Stelle, ein Labor, das zwei Modelle von ein und demselben Anbieter misst.

• AA Intelligence Index — GPT-6 Sol 48, Rang 18 von 212 vs. GPT-5.6 Sol 47, Rang 19 von 212

• Kosten pro Index-Aufgabe — GPT-6 Sol etwa die Hälfte von GPT-5.6 Sol

• Ausgabegeschwindigkeit — GPT-6 Sol 104,4 Tokens/Sek. vs. GPT-5.6 Sol 72,6 Tokens/Sek.

• Zeit bis zum ersten Token — GPT-6 Sol 107,18 s vs. GPT-5.6 Sol schneller, beide im Vergleich zu einem Board-Median von 3,87 s

• Eingabepreis — GPT-6 Sol 2,00 $ pro 1 Mio. vs. GPT-5.6 Sol 4,00 $ pro 1 Mio.

• Preis für Ausgabe — GPT-6 Sol 10,00 $ pro 1 Mio. vs. GPT-5.6 Sol 20,00 $ pro 1 Mio.

• Zwischengespeicherte Eingabe — GPT-6 Sol etwa 90 % günstiger gegenüber GPT-5.6 Sol, 0,40 $ pro 1 Mio.

• Batch-Tarif — GPT-6 Sol nicht veröffentlicht vs. GPT-5.6 Sol $2.50 / $15.00

• Long-Context-Stufe — GPT-6 Sol wird oberhalb von 272K Input neu bepreist, im Gegensatz zu GPT-5.6 Sol ohne entsprechenden Schritt

• Kontextfenster — GPT-6 Sol 872K laut AA, 1,05 Mio. angegeben gegenüber GPT-5.6 Sol ungefähr 1,05 Mio. bis 1,1 Mio.

• Maximale Ausgabe — 128K bei beiden

• Veröffentlicht — GPT-6 Sol 2026-09-22 vs. GPT-5.6 Sol 2026-07-09

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6 Sol: Input $2.00 per 1M, Output $10.00 per 1M, AA Index 48, Speed 104.4 tok/s, Long context 'reprices above 272K', Released 2026-09-22. Right column GPT-5.6 Sol: Input $4.00 per 1M, Output $20.00 per 1M, AA Index 47, Speed 72.6 tok/s, Long context 'no step', Released 2026-07-09. Footer: 'Both measured by Artificial Analysis, Index v4.3.2.'

Schauen Sie sich die beiden Geschwindigkeitslinien zusammen an. GPT-6 Sol erzeugt Ausgaben etwa 44 % schneller als sein Vorgänger und ist dramatisch langsamer darin, ein erstes Token zu erzeugen – 107,18 Sekunden gegenüber einem Board-Median von 3,87. GPT-5.6 Sol ist nach Board-Standards ebenfalls kein schnelles Modell, aber es bewegt sich nicht in diesem Bereich. Wenn Sie für ein interaktives Produkt auf GPT-5.6 Sol umgestiegen sind, ist GPT-6 Sol kein Drop-in-Ersatz, und das ist eine funktionale Regression, unabhängig von jeglichem Benchmark.

Eine Zeile fällt unauffällig günstig aus: Der Standardtarif von GPT-6 Sol mit 2 $/10 $ unterbietet den Batch-Tarif von GPT-5.6 Sol mit 2,50 $/15 $. Sogar die rabattierte Stufe des alten Modells ist teurer als der Listenpreis des neuen. Das ist der stärkste Beleg dafür, dass die Senkung strukturell und nicht aktionsbedingt ist.

Die Regression ist der interessante Teil

Artificial Analysis fand heraus, dass GPT-6 Sol die Kosten pro Aufgabe etwa halbiert, während es eine Mischung aus Verbesserungen und Verschlechterungen hervorbringt. GDPval-AA v2.1 ist die namentlich genannte Verschlechterung. Davon unabhängig verschlechterte sich auch OpenAIs GPT-5.6 Luna beim Coding Agent Index – was eher auf ein Muster in dieser Generation hindeutet als auf einen isolierten Fehlschlag bei einem einzelnen Modell.

Das ist gerade deshalb ernst zu nehmen, weil es der unabhängige Befund ist. Die Launch-Materialien von OpenAI sind um Kosten pro Aufgabe und um von OpenAI ausgewählte Benchmark-Zeilen herum aufgebaut; Artificial Analysis hat kein Produkt zu verkaufen und berichtet, was seine Testumgebung hervorgebracht hat. Ein Modell, das billiger und beim Gesamtwert ungefähr gleichauf, bei bestimmten Teilaufgaben aber messbar schlechter ist, ist kein strikt besseres Modell. Es ist ein anderer Punkt an der Frontier.

Die praktische Version davon: Wenn Ihre Arbeitslast stark GDPval-AA-förmig ist – wirtschaftlich wertvolle Wissensarbeit, die Art von Aufgabe, für deren Bepreisung dieser Benchmark entwickelt wurde –, dann deckt der Ein-Punkt-Zuwachs im Composite Sie nicht ab, und die Regression ist die Zahl, auf die es ankommt. Wenn Ihre Arbeitslast allgemein ist, ist die Halbierung der Kosten pro Aufgabe die Zahl, auf die es ankommt, und das Composite sagt, dass Sie nichts Messbares aufgegeben haben.

Wo GPT-5.6 Sol noch gewinnt

GPT-5.6 Sol hat ein veröffentlichtes Long-Context-Retrieval-Ergebnis, dem GPT-6 Sol nichts Gleichwertiges entgegensetzen kann: MRCR v2, 8-Needle, 91,5 % im Bereich von 256K bis 512K. Das ist ein Retrieval-Genauigkeitswert in dem Bereich, in dem sich die Preisstaffel von GPT-6 Sol ändert.

Betrachten Sie die beiden Fakten im direkten Vergleich. Oberhalb von 272.000 Eingabe-Tokens wird die gesamte Anfrage bei GPT-6 Sol neu bepreist – auf ungefähr 4 $ für die Eingabe und 15 $ für die Ausgabe. Das entspricht in etwa dem alten Tarif von GPT-5.6 Sol bei der Eingabe und drei Vierteln davon bei der Ausgabe – die 50 % Einsparung, für die Sie migriert sind, schrumpft also auf etwa 0 % bei der Eingabe und 25 % bei der Ausgabe, genau in dem Kontextbereich, in dem GPT-5.6 Sol eine dokumentierte Stärke hat und GPT-6 Sol kein veröffentlichtes Gegenstück.

Die anderen veröffentlichten Ergebnisse von GPT-5.6 Sol bleiben respektabel und sind der Grund, warum einige Teams nicht wechseln:

• Letzte Prüfung der Agenten — GPT-5.6 Sol 53,6

• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0

• SWE-Bench Pro — GPT-5.6 Sol 64.6

• OSWorld 2.0 — GPT-5.6 Sol 62.6

• BrowseComp — GPT-5.6 Sol 90.4

• GDPval-AA v2 — GPT-5.6 Sol 1747,8 Elo

• HLE — GPT-5.6 Sol 49,5

• MRCR v2, 8-Needle — GPT-5.6 Sol 91,5 % bei 256K bis 512K

Diese wurden von OpenAI gemeldet. Beachten Sie, dass BrowseComp mit 90,4 und der MRCR-Wert die beiden sind, die am schwersten zu ersetzen sind: Web-Recherche-Agenten und Long-Context-Retrieval sind Arbeitslasten, bei denen ein zwei Monate altes Modell mit einer veröffentlichten Zahl die sicherere Wahl ist als ein neues Modell ohne entsprechende Vergleichsmessung.

Was GPT-6 Sol mitbringt, das nicht auf der Preisliste steht

Die Preisgestaltung ist die eigentliche Neuigkeit, aber drei andere Dinge haben sich geändert.

Zunächst die Kontext-Obergrenze. GPT-6 Sol wird von Artificial Analysis mit 872.000 Tokens angegeben, gegenüber einer Angabe von 1,05 Mio. an anderer Stelle in OpenAI-Unterlagen, bei 922K maximaler Eingabe. GPT-5.6 Sol liegt je nach Quelle bei etwa 1,05 Mio. bis 1,1 Mio. Auf dem Papier ist das ein kleiner Rückschritt beim nutzbaren Fenster – mit der Einschränkung, dass nicht die Obergrenze, sondern die 272K-Stufengrenze die Kosten bestimmt.

Zweitens: die Verfügbarkeit. GPT-6 Sol ist in der API und in ChatGPT Work und Codex auf Plus, Pro, Business, Enterprise und Edu verfügbar – und Enterprise-Administratoren müssen es aktivieren, bevor Nutzer es sehen. In ChatGPT Chat ist es nicht verfügbar. GPT-5.6 Sol war ein breiterer Rollout. Wenn der Zugriffspfad Ihres Teams über einen Enterprise-Administrator läuft, ist die Migration nicht nur eine Codeänderung.

Drittens bedeutet die Einführung eines neuen Flaggschiffs im Allgemeinen, dass das alte zum günstigeren Rückfallmodell wird, anstatt eingestellt zu werden. GPT-5.6 Sol ist mit $4/$20 weiterhin ein hervorragendes Modell mit 47 im Index, und für Long-Context-Retrieval-Arbeit verfügt es über eine veröffentlichte Zahl, die GPT-6 Sol nicht vorweisen kann.

Eine Migration, die weniger kostet, als es den Anschein hat

Der Grund, warum dieses besondere Upgrade einfach ist, ist, dass die beiden Modelle vom selben Anbieter stammen, dieselbe API-Struktur haben und in der Rangliste benachbart sind – was bedeutet, dass die Migration eine Änderung der Modellzeichenfolge und keine Neuarchitektur ist, und der Fallback-Pfad bereits in Ihrem Code vorhanden ist. GPT-5.6 Sol ist auf OrcaRouter zu OpenAIs Listenpreis verfügbar, nach dem Pass-through-Modell, bei dem eine Preisänderung von OpenAI noch am selben Tag auf unserer Seite live geht, statt erst, nachdem ein Wiederverkäufer neu verhandelt.

GPT-6 Sol ist zum Zeitpunkt dieses Schreibens nicht in unserem Katalog – es ist über OpenAIs eigene API erreichbar. Die ehrliche Form einer Migration ist also eine Route mit GPT-5.6 Sol dahinter auf demselben Schlüssel: neuen Traffic an GPT-6 Sol senden, das vorherige Modell nur eine Konfigurationsänderung entfernt halten und automatisches Failover das Zeitfenster abdecken lassen, in dem sich die Verfügbarkeit eines neuen Flaggschiffs noch einpendelt. Bei einem Modell, das zwei Tage alt ist, mit einem Enterprise-Aktivierungsschalter davor und einer Long-Context-Stufe, die die Wirtschaftlichkeit oberhalb von 272K Tokens verändert, ist es keine Vorsicht, die vorherige Generation weiterhin eingebunden zu haben – es ist der Unterschied zwischen einem schlechten Nachmittag und einer schlechten Woche.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

Die Migrations-Checkliste

Messen Sie Ihre tatsächliche Kontextverteilung, bevor Sie irgendetwas anderes tun. Wenn das 95. Perzentil Ihrer Anfragen unter 272.000 Eingabe-Tokens liegt, migrieren Sie – die Ersparnis beträgt echte 50 % auf beiden Seiten der Rechnung, die Kosten pro Aufgabe halbieren sich, und der zusammengesetzte Index sagt, dass Sie nichts aufgegeben haben. Wenn ein relevanter Anteil des Verkehrs über dieser Grenze liegt, kalkulieren Sie die Stufe sorgfältig: Bei ungefähr 4 $/15 $ beträgt der Vorteil gegenüber GPT-5.6 Sols 4 $/20 $ 25 % bei der Ausgabe und nichts bei der Eingabe, und Sie bezahlen dafür mit dem Verlust eines dokumentierten Long-Context-Retrieval-Ergebnisses.

Prüfe, ob jemand auf das erste Token wartet. 107 Sekunden sind etwa das Achtundzwanzigfache des Board-Medians, und es ist der Fehlermodus, der in der Produktion zuerst auftreten wird. Alles, bei dem am anderen Ende ein Mensch ist, sollte auf GPT-5.6 Sol bleiben oder woandershin geroutet werden.

Dann prüfe den Aktivierungspfad. Enterprise-Pläne erfordern, dass ein Administrator GPT-6 Sol einschaltet, und in ChatGPT Chat fehlt es vollständig. Vergewissere dich, dass deine Nutzer es tatsächlich erreichen können, bevor du intern eine Migration ankündigst.

Zuletzt: Beobachte GDPval-AA v2.1 im ersten Monat mit deinen eigenen Evals. Das unabhängige Labor hat dort eine Regression gefunden, und ein Zuwachs von einem Punkt beim zusammengesetzten Score sagt dir nicht, ob sich dein spezifisches Aufgabenset nach oben oder unten bewegt hat. Führe deine Evals auf beiden Modellen durch, bevor du umstellst, nicht danach.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the Vision, Tools, JSON and Reasoning badges, a 1.05M-token context with 128K maximum output and text + image + file input, list pricing of $4.00 input and $20.00 output per 1M tokens, and the description of GPT-5.6 Sol as the flagship of OpenAI's GPT-5.6 series, strong at command-line and multi-file coding tasks.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert