
GPT-6 Sol vs. Qwen 4 Max: Der Eingabepreis ist ein Gleichstand und fast alles andere lässt sich nicht vergleichen
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Hier ist die Zahl, die die Paarung GPT-6 Sol und Qwen 4 Max eine eigene Seite wert macht: Beide sind mit 2,00 $ pro Million Input-Tokens gelistet. Dort beginnt der nutzbare Teil des Vergleichs und, was Qwen 4 Max betrifft, endet er dort so gut wie. Das Unternehmen kündigte die Qwen 4 Max-Stufe am 22. September 2026 auf seiner Apsara-Konferenz an – am selben Tag, an dem GPT-6 Sol veröffentlicht wurde –, und zum Zeitpunkt dieses Textes gibt es keine veröffentlichte Model Card dafür: keinen Preis, kein Kontextfenster, keine Aussage zu den Gewichten und keinen Score von irgendeinem Evaluator. Das Qwen-Flaggschiff, für das es tatsächlich Messwerte gibt und das man heute aufrufen kann, ist Qwen3.8 Max, veröffentlicht am 3. August 2026 zu 2,00 $ / 6,00 $. Die praktische Frage lautet also nicht, wie Qwen 4 Max im Vergleich zu GPT-6 Sol abschneidet. Sie lautet, was die angekündigte Stufe darüber verrät, wohin das Flaggschiff des Unternehmens steuert, und wie das Qwen, das man heute tatsächlich ansteuern kann, gegen das GPT-6-Modell abschneidet.
Diese Unterscheidung ist keine Haarspalterei. Eine Stufe, die angekündigt, aber nicht spezifiziert wurde, kann jede Annahme absorbieren, die man über sie anstellen möchte, und ein Artikel, der stillschweigend annimmt, dass Qwen 4 Max GPT-6 Sol übertrifft – weil die Versionsnummer höher ist –, führt ein Argument an, das der Anbieter nicht vorgebracht hat und das die Belege nicht stützen.
Drei Dinge, die gerade jetzt vergleichbar sind
• Eingabepreis — GPT-6 Sol 2,00 $ pro Million vs. Qwen3.8 Max 2,00 $ pro Million, exakt gleichauf
• Ausgabepreis — GPT-6 Sol 10,00 $ pro Million vs. Qwen3.8 Max 6,00 $ pro Million
• Zwischengespeicherte Eingabe — GPT-6 Sol 0,20 $ pro Million vs. Qwen3.8 Max 0,25 $ pro Million
• Kontextfenster — GPT-6 Sol 1.050.000 Tokens vs. Qwen3.8 Max 1.000.000 Tokens
• Eingabemodalitäten — beide akzeptieren Text, Bild und Video oder Datei; GPT-6 Sol Text, Bild und Datei, Qwen3.8 Max Text, Bild und Video
• Stufe für lange Anfragen — GPT-6 Sol berechnet die gesamte Anfrage oberhalb von 272.000 Eingabe-Tokens neu auf 4,00 $ / 15,00 $ vs. Qwen3.8 Max keine Stufe auf seiner Karte
• Intelligenzindex — GPT-6 Sol 47,6 vs. Qwen3.8 Max 45,4
• Coding-Index — GPT-6 Sol in dieser Revision nicht veröffentlicht vs. Qwen3.8 Max 76,2
• GPQA Diamond — GPT-6 Sol 96,1 vs. Qwen3.8 Max 92,8
• Terminal-Bench 4.0 — GPT-6 Sol 43,9 vs. Qwen3.8 Max 38,9
Zwei dieser Zeilen sind die, bei denen man verweilen sollte. Die Zeile für gecachte Eingaben läuft dem Muster zuwider — Qwen3.8 Max verlangt fünf Cent mehr pro Million für Cache-Lesevorgänge als GPT-6 Sol, was bei einem stark cache-lastigen Agent-Loop der Wert ist, der zuerst ausschlägt. Und die Klausel für lange Anfragen ist der Punkt, an dem der Gleichstand beim Eingabepreis endgültig bricht: Bei genau 2,00 $ Eingabe wirken die beiden austauschbar, bis ein Prompt 272 Token überschreitet; ab diesem Punkt wird die gesamte Anfrage bei GPT-6 Sol auf 4,00 $ / 15,00 $ neu bepreist, während die Tarifkarte von Qwen3.8 Max keinen solchen Schritt enthält. Bei einem Prompt mit vollem Kontext ist das Modell des Unternehmens nicht nur bei der Ausgabe günstiger. Es ist das einzige der beiden, dessen veröffentlichter Preis sich noch aus der Headline vorhersagen lässt.
Zwei Dinge, die nicht vergleichbar sind, und warum der Unterschied wichtig ist
Das Erste ist die Leistungsfähigkeit von Qwen 4 Max. Das Unternehmen präsentierte es als eine Stufe in einer Produktreihe statt als ein Produkt: keine Benchmark-Tabelle, keine Angabe zur Kontextgröße, keine Aussage zu Gewichten, keine Preisangabe. Alles, was darüber geschrieben wird, wie es abschneiden wird, ist eine Projektion aus der Entwicklung der Qwen-Reihe, einschließlich dieses Satzes. Das Einzige, was erkennbar ist, ist die Zielmarke – die Stufe, die es ersetzt, und das Modell, das der Nachfolger überholen soll –, und das verrät die Richtung der Bewegung, nicht das Ziel.
Der zweite Punkt ist die Frage der offenen Gewichte, und sie ist diejenige, die man am ehesten hervorheben sollte, bevor man eine Bereitstellung von Qwen 4 Max plant. Das Unternehmen veröffentlicht Gewichte für Teile der Qwen-Familie und für andere nicht. Qwen3.8 Max, das Flaggschiff, ist als geschlossenes API-Modell aufgeführt – keine Lizenzdatei, kein herunterladbarer Checkpoint – obwohl kleinere Geschwistermodelle derselben Generation veröffentlicht sind. Ob das Flaggschiff der 4er-Serie den kleineren Geschwistern folgt oder geschlossen bleibt, ist nicht beantwortet, und ein Team, das einen Self-Hosting-Plan auf der Erwartung offener Gewichte aufbaut, würde auf einen Präzedenzfall wetten, den das aktuelle Flaggschiff nicht setzt.
Der Vergleich, der tatsächlich läuft, ist GPT-6 Sol gegen Qwen3.8 Max, und er ist enger, als die Generationszahlen vermuten lassen: 47,6 gegen 45,4 im Intelligence Index, beide Werte von Dritten auf derselben Revision, und GPQA Diamond mit echten 96,1 gegen 92,8. Ein Index-Abstand von 2,2 Punkten bei drei Vierteln des Output-Preises ist die engste verfügbare Version dieses Duells, und von ihr ist auszugehen, bis das Unternehmen etwas für die 4-Serie veröffentlicht.

Wofür die Ankündigung selbst ein Beweis ist
Eine angekündigte, aber nicht spezifizierte Stufe ist kein leeres Signal. Sie sagt Ihnen, dass das Unternehmen beabsichtigt, sein nächstes Flaggschiff an der Spitze der Produktlinie zu positionieren, und dass es bereit ist, es öffentlich zu benennen, bevor es fertig ist – was eher eine Änderung der Kommunikationsgewohnheit ist als eine Aussage über die Leistungsfähigkeit. Sie setzt außerdem eine Uhr in Gang: Eine im September angekündigte Stufe erzeugt die Erwartung eines Lieferfensters, und die Lücke zwischen Ankündigung und Spezifikation ist der Punkt, an dem wettbewerbliche Positionierung üblicherweise stattfindet.
Für alle, die derzeit Qwen3.8 Max betreiben, bedeutet das praktisch, dass die Migration eine Frage der Leistungsfähigkeit und nicht der Kosten sein wird. Die Stufe, die Qwen 4 Max ersetzen soll, liegt bereits bei 2,00 $ / 6,00 $, und der Nachfolger muss ein Modell übertreffen, das 45,4 Punkte erzielt und bei den Ausgabekosten ein Drittel weniger als GPT-6 Sol kostet. Ob er auch die Lücke zu 47,6 schließt – und zu welchem Datum –, ist das Einzige, was es zu verfolgen lohnt, und in der Ankündigung steht nichts, was darauf eine Antwort gibt.

Ein Modell routen, das noch nicht existiert
Nur eines der beiden Qwen-Modelle in diesem Gespräch ist in unserem Katalog, und es ist nicht die 4er-Serie. Qwen3.8 Max wird über OrcaRouter unter der Modell-ID qwen/qwen3.8-max geroutet, über denselben Schlüssel wie GPT-6 Sol und 200+ weitere Modelle, und genau das ist die Paarung wert: eine Routenänderung statt eines Integrationsprojekts, wenn das Unternehmen den Nachfolger veröffentlicht. Qwen 4 Max wird hinzugefügt, sobald es etwas zu routen gibt – eine Karte, einen Tarif, einen Endpunkt – und nicht vorher, denn es gibt keine verantwortungsvolle Art, einen Slot gegen eine Spezifikation zu verkaufen, die noch nicht geschrieben wurde.
In der Zwischenzeit ist der Grund, beide Spalten offen zu halten, dass die beiden Modelle sich uneinig darüber sind, wo sie günstig sind. Qwen3.8 Max gibt beim Eingabepreis nichts nach und senkt GPT-6 Sols Ausgaberate um ein Drittel und hat keine Langkontext-Klippe; GPT-6 Sol bietet einen geringfügig besseren Index und einen deutlich großzügigeren Rabatt auf zwischengespeicherte Eingaben, um den Preis, dass die gesamte Anfrage oberhalb von 272.000 Token neu bepreist wird. Eine Arbeitslast, die lang und ausgabelastig ist, und eine Arbeitslast, die kurz und cache-freundlich ist, verlangen unterschiedliche Antworten, und beide sind nur eine Routing-Regel voneinander entfernt statt zwei Beschaffungsgespräche.
Failover ist hier aus einem Grund wichtig, der für diese Konstellation spezifisch ist. Qwen3.8 Max ist ein Volumenmodell auf unseren Routen – mehr als 110 Millionen Token in einem Sieben-Tage-Fenster – und genau das Volumen bringt Endpunktvarianz zum Vorschein. Eine zweite konfigurierte Route dahinter bedeutet, dass ein degradiertes Primärsystem ein Retry ist, und eine Tarifänderung auf der Firmenkarte – genau die Art von Ereignis, die eine Flaggschiff-Übergabe erzeugt – ist am selben Tag auf unserer Seite live, weil unser Katalog die Listenpreise der Anbieter ohne Aufschlag weitergibt.

Was diesen Monat damit tun?
Wenn Sie jetzt ein Qwen-Flaggschiff brauchen, ist das Modell der Wahl Qwen3.8 Max, und es ist bei Reasoning konkurrenzfähig mit GPT-6 Sol zu einer deutlich niedrigeren Ausgaberate — das ist der ehrliche Stand des Duells heute. Wenn Sie das stärkste veröffentlichte Ergebnis auf den Reasoning-Benchmarks in diesem Paar brauchen, ist GPT-6 Sols 47,6 die Zahl, und sein Rabatt auf zwischengespeicherte Eingaben ist der günstigste im Vergleich. Wenn Sie auf Qwen 4 Max warten, warten Sie auf eine Karte statt auf ein Datum, denn die Ankündigung hat Ihnen die Stufe und sonst nichts gegeben.
Und egal, wofür Sie sich entscheiden, prüfen Sie die GPT-6-Seite, bevor Sie sich darauf festlegen. GPT-6 Sol wurde bereits durch GPT-6.1 Sol ersetzt – bei denselben $2.00 / $10.00, wobei der Preis für gecachte Eingaben auf $0.10 halbiert wurde –, und die eigene Modellseite leitet Leser jetzt dorthin weiter. Ein Vergleich mit GPT-6 Sol ist ein Vergleich mit einem Modell, dessen Nachfolger bereits im Verkauf ist, und dieselbe Vorsicht gilt für jede Qwen-Zahl, die aus der 4-Max-Ankündigung abgeleitet wird: Beides sind Formen von Nachrichten, und nur eines davon ist derzeit ein käufliches Produkt.
In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
