
GPT-6 Sol Pro vs. DeepSeek V4 Pro: Eine Flatrate gegen einen Zeitplan
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
GPT-6 Sol Pro und DeepSeek V4 Pro sind derzeit die zwei günstigsten glaubwürdigen Wege, eine ernsthafte Reasoning-Workload über eine API laufen zu lassen, und sie werden nach völlig unterschiedlichen Prinzipien bepreist. GPT-6 Sol – das Modell des Anbieters, das die Konfiguration gpt-6-sol-pro ausführt, allgemein verfügbar seit dem 22. September 2026 – kostet 2,00 $ pro Million Eingabe-Token und 10,00 $ pro Million Ausgabe-Token, zu jeder Stunde eines jeden Tages. DeepSeek V4 Pro, das Open-Weights-Flaggschiff, dessen 0813-Checkpoint am 13. August 2026 allgemein verfügbar wurde, kostet 0,66 $ und 1,98 $ für den größten Teil der Woche und genau das Doppelte davon für zwei schmale Zeitfenster an Wochentagvormittagen. Jeder Vergleich, der einen einzelnen Tarif angibt, gibt nur den halben Preis an.
Der Zeitplan ist die eigentliche Geschichte. Alles andere an diesem Duell – die Indexwerte, die Kontextfenster, die Lizenzbedingungen – ist eine Folge der Tatsache, dass einer dieser beiden Anbieter entschieden hat, dass sein Listenpreis eine Funktion der Uhr ist.
Was jede Preiszeile tatsächlich ist
Die Preisliste von GPT-6 Sol umfasst nur eine Zeile. Eingabe 2,00 $, gecachte Eingabe 0,20 $, Cache-Schreiben 2,50 $, Ausgabe 10,00 $ pro Million Tokens, mit einer Neubepreisung für langen Kontext oberhalb einer Eingabeschwelle, die auf die gesamte Anfrage Anwendung findet, sobald sie überschritten wird. Es gibt keine Zeitdimension und kein Aktionsfenster. OpenAI senkte die Preise des Vorgängermodells am 22. September auf diese Werte und bezeichnete sie als dauerhaft.
DeepSeeks Preisliste ist eine Tabelle. Wie auf der eigenen Preisseite des Anbieters nachzulesen:
• Off-Peak-Eingabe — 0,66 $ pro Million Tokens, Cache-Miss; 0,022 $ pro Million Tokens, Cache-Hit
• Off-Peak-Output — 1,98 $ pro Million Tokens
• Eingabe in Spitzenzeiten — 1,32 $ pro Million Token, Cache-Miss; 0,044 $ pro Million Token, Cache-Hit
• Spitzenausgabe — 3,96 $ pro Million Token
• Spitzenzeitfenster — 01:00–04:00 und 06:00–10:00 UTC, Montag bis Freitag, ausgenommen chinesische Feiertage
• Alles andere – außerhalb der Hauptverkehrszeiten, einschließlich des gesamten Wochenendes, eine Regel, die am 23. August 2026 um Mitternacht Pekinger Zeit in Kraft trat
Sieben Spitzenstunden pro 168-Stunden-Woche, an fünf von sieben Tagen, machen ungefähr 21 % des Kalenders zum höheren Satz und 79 % zum niedrigeren aus. Die ehrliche Zusammenfassung von DeepSeek V4 Pro in einer einzigen Zahl ist also weder 0,66 $ noch 1,32 $ – sie liegt irgendwo dazwischen, und wo, hängt von der Form Ihres Traffics ab, nicht von der Großzügigkeit des Anbieters.
Die Preisanpassung, aus der diese Tabelle hervorgegangen ist.
Es lohnt sich zu wissen, wie neu diese Struktur ist, denn fast jede Vergleichsseite nennt noch die Zahl, die sie ersetzt hat. Am 22. Mai 2026 wandelte DeepSeek einen zeitlich begrenzten Rabatt auf V4 Pro in einen dauerhaften Preis um – eine Senkung um etwa 75 %, auf ungefähr 0,435 $ für Input und 0,87 $ für Output pro Million Token.
Am 17. August 2026 um Mitternacht Pekinger Zeit wurde das umgekehrt – und dann noch einiges mehr. Das Peak-/Off-Peak-System ging live, mit einer durchschnittlichen Erhöhung über die betroffenen Zeilen hinweg von etwa dem 3,5-Fachen und einem Maximum vom 12-Fachen – wobei die 12-fache Erhöhung genau auf den Cache-Hit-Eingabetarif entfiel, der zur Spitzenzeit von ¥0,025 auf ¥0,30 pro Million Tokens stieg. Der Cache-Miss-Input stieg um etwa 200 % und der Output um etwa 350 %. Sechs Tage später wurde die Wochenend-Ausnahmeregelung hinzugefügt, die einen Teil davon für alle zurückholte, deren Batch-Jobs verschoben werden konnten.
Daraus folgen zwei Konsequenzen. Erstens: Jede Seite, die Ihnen sagt, DeepSeek V4 Pro sei ein Sub-Dollar-Modell, zitiert eine Preisliste, die bereits zweimal überholt wurde. Zweitens: Die Form des Anstiegs ist ein Signal dafür, worauf DeepSeek optimiert: Der größte prozentuale Anstieg entfällt auf Cache-Treffer, also genau den Tarif, der für genau die Arbeitslast am wichtigsten ist – lange Agent-Schleifen, die einen stabilen Präfix erneut senden –, die das Modell überhaupt erst attraktiv gemacht hat.

Die Indexnummer, die alle zitieren, ist außer Dienst gestellt.
Artificial Analysis ist die neutrale Testumgebung für diesen Vergleich und hat seinen Intelligence Index bis 2026 mehrfach neu versioniert. Im aktuellen Ranking erreicht GPT-6 Sol bei maximalem Aufwand 48 Punkte bei Kosten von 1,06 $ pro Index-Aufgabe. DeepSeek V4 Pro erreicht mit dem 0813-Checkpoint bei maximalem Aufwand 36 Punkte bei Kosten von 0,67 $ pro Index-Aufgabe.
Die Zahl, die für DeepSeek kursiert, ist 53. Diese Zahl ist echt, und sie wurde veröffentlicht – in einer früheren Revision des Index, vor einer Neu-Versionierung, durch die sich die Scores der meisten Modelle verschoben. Eine 53 aus einem Artikel vor v4.3 mit einer aktuellen 48 zu vergleichen, heißt, eine eingestellte Messung mit einer aktiven zu vergleichen, und daraus entsteht der häufigste Fehler in diesem Vergleich: die Behauptung, die beiden Modelle lägen nur einen Punkt auseinander. Auf dem aktuellen Index liegen sie zwölf Punkte auseinander, und die Preisdifferenz pro abgeschlossener Aufgabe ist nicht das 3×, das die nominalen Tarife nahelegen, sondern eher 1,6×, weil DeepSeek mehr Tokens aufwendet, um zu seiner Antwort zu gelangen.
Zwei weitere unabhängige Datenpunkte gehören daneben, beide klar als das gekennzeichnet, was sie sind. Vals AI, das eine isolierte Testumgebung betreibt, setzt DeepSeek V4 Pro mit 96,40 % auf SWE-bench Verified bei 0,103 $ pro Test an – zweiter in dieser Rangliste hinter Claude Opus 5 mit 97,00 % und pro Test mit großem Abstand günstig. Das Coding-Agent-Board von Artificial Analysis zeigt 14 % bei Terminal-Bench 4.0 gegenüber 44 % von GPT-6 Sol. Die erste Zahl besagt, dass DeepSeek bei einer engen, klar definierten Coding-Aufgabe konkurrenzfähig ist. Die zweite besagt, dass es bei agentischer Terminal-Arbeit nicht konkurrenzfähig ist. Beide sind wahr, und sie messen unterschiedliche Dinge.
Wo die beiden Modelle strukturell unterschiedlich sind, nicht nur preislich unterschiedlich
• Lizenz — GPT-6 Sol ist eine geschlossene API ohne Gewichte; DeepSeek V4 Pro steht unter MIT-Lizenz und bietet öffentliche Checkpoints auf Hugging Face, einschließlich Basisvarianten für fortgesetztes Pretraining
• Maximale Ausgabe — GPT-6 Sol 128.000 Tokens vs. DeepSeek V4 Pro 384.000 Tokens, dreimal so hohe Obergrenze bei einem Fünftel der Ausgaberate
• Kontextfenster — GPT-6 Sol 1.050.000 Tokens vs. DeepSeek V4 Pro 1.048.576 Tokens, praktisch identisch
• Modalitäten — sowohl Text als Eingabe als auch Text als Ausgabe; keine von beiden akzeptiert Bilder über die API
• Preisgestaltung für lange Kontexte — GPT-6 Sol bepreist die gesamte Anfrage oberhalb seiner Eingabeschwelle neu; der Peak-/Off-Peak-Zeitplan von DeepSeek V4 Pro ist die einzige Preisstruktur, über die es verfügt
• Skalierung — DeepSeek V4 Pro ist ein Mixture-of-Experts-Modell mit 1,6 Billionen Parametern und 49 Milliarden aktiven Parametern pro Token; OpenAI veröffentlicht für GPT-6 Sol keine vergleichbare Zahl.
Ein Hinweis zu dieser Parameteranzahl, denn sie ist eine häufige Quelle der Verwirrung: Die 1,7-Billionen-Angabe, die in manchen Auflistungen auftaucht, ist die Hugging-Face-Paketgröße einschließlich des optionalen DSpark-Speculative-Decoding-Moduls, nicht ein breiteres Zielmodell. Die veröffentlichte Architektur umfasst insgesamt 1,6T. Die gerundeten Badges zu subtrahieren, um auf die Größe des Draft-Moduls zu schließen, ist keine gültige Berechnung, und ebenso wenig ist es zulässig, die größere Zahl als Beleg dafür zu lesen, dass das Modell gewachsen ist.

Der Rückzug, der das eigentliche Argument für offene Gewichte ist
Am 9. September 2026 kündigte DeepSeek an, V4 Pro auslaufen zu lassen, und dass ab dem 14. September um 04:00 UTC jede Anfrage an den Modell-String deepseek-v4-pro an DeepSeek V4.1 Flash weitergeleitet und zu Flash-Tarifen abgerechnet würde; dies würde fortgesetzt, bis ein V4.1 Pro Modell verfügbar war. Der Modell-String würde weiterhin antworten. Das dahinterstehende Modell wäre nicht das, das irgendjemand gebenchmarkt hatte.
Entwickler erhoben Einspruch, und die Weiterleitung wurde zurückgezogen. Das Änderungsprotokoll von DeepSeek gibt nun an, dass der V4 Pro API-Dienst über den 14. September hinaus fortgeführt wird, wobei die Abrechnung unverändert bleibt, und die Preistabelle führt deepseek-v4-pro weiterhin als aktive Zeile mit eigenen Tarifen und ohne Stilllegungs-Kennzeichnung auf. Die frühere Ankündigungsseite enthält weiterhin die Formulierung zum Routing, sodass die beiden Dokumente nicht übereinstimmen – und die aktive Preisseite ist diejenige, die beschreibt, was tatsächlich passiert, wenn man den Dienst aufruft.
Diese Episode ist das stärkste Argument in diesem gesamten Vergleich, und es ist kein Preisargument. Ein geschlossenes Modell kann nach dem Zeitplan eines Anbieters neu bepreist, umgeleitet oder eingestellt werden, und der einzige Ausweg ist die Migration. Ein Modell mit MIT-Gewichten in einem öffentlichen Repository kann von Ihrer eigenen Infrastruktur aus bedient werden, was bedeutet, dass der Checkpoint, den Sie evaluiert haben, der Checkpoint ist, den Sie weiterhin bedienen, unabhängig davon, was die Roadmap des Anbieters sechs Wochen später sagt. DeepSeek hat das Risiko demonstriert und die Abhilfe innerhalb derselben zwei Wochen geliefert.
Das ehrliche Gegengewicht ist, dass das Selbsthosting eines Modells mit 1,6 Billionen Parametern keine Entscheidung ist, die die meisten Teams mal eben treffen. Es ist eine echte Option mit echten Fixkosten, keine kostenlose Absicherung.
Wo eine Routing-Schicht die Arithmetik verändert
DeepSeek V4 Pro steht in OrcaRouters Katalog. Sowohl der aktuelle Checkpoint als auch der Basis-Modell-String lassen sich auflösen – deepseek/deepseek-v4-pro-0813 und deepseek/deepseek-v4-pro – zu den Off-Peak-Listenpreisen, wobei der Peak-Multiplikator nach demselben UTC-Zeitplan angewendet wird, mit einem Kontextfenster von 1.048.576 Token, einer Ausgabengrenze von 384.000 Token und einer p50-Zeit bis zum ersten Token von 3,56 Sekunden, gemessen auf unserer eigenen Modellseite. Die Listenpreise des Anbieters werden durchgereicht ohne Aufschlag obendrauf, was in diesem Fall bedeutet, dass die Peak-/Off-Peak-Grenze zum selben Zeitpunkt auf Ihrer Rechnung erscheint, zu dem sie auch bei DeepSeek erscheint.
GPT-6 Sol ist keine unserer Routen, daher ist nichts hier eine Aussage über seinen Preis bei uns.

Der Zeitplan ist genau das, was einen einzelnen Endpunkt hier besonders lohnenswert macht. Eine Workload, die sich verschieben lässt, ist doppelt so viel wert wie eine, die es nicht kann, und sie zu verschieben ist eine Routing-Entscheidung, keine Migration — derselbe Schlüssel, dieselbe Anfrageform, eine andere Stunde oder ein anderes Modell dahinter. DeepSeek V4 Pro mit DeepSeek V4.1 Flash an einem einzigen Endpunkt zu kombinieren, ist die schärfere Variante davon: Das Flash-Modell ist 4,4× günstiger beim Input und 3,3× günstiger beim Output als der Off-Peak-Tarif von V4 Pro, bei demselben Kontextfenster und denselben Peak-Fenstern, was es zum natürlichen Ziel für den Traffic macht, der das größere Modell überhaupt nicht braucht. Automatisches Failover ist aus demselben Grund wichtig wie immer — die günstige Stufe, auf der Ihre Pipeline aufbaut, sollte kein Single Point of Failure sein.
Die Entscheidungsregel
• Batch- und Offline-Arbeit, die geplant werden kann – DeepSeek V4 Pro, und planen Sie sie ein. Fünfundneunzig Prozent des Kalenders zu $0,66 und $1,98, wobei Wochenenden komplett in die Nebenzeit fallen, ist der günstigste glaubwürdige Tarif auf diesem Board – um den Faktor drei beim Input und fünf beim Output.
• Latenzempfindlicher interaktiver Datenverkehr, der in die Peak-Fenster fällt – GPT-6 Sol. Ein Pauschalpreis von 2,00 $ und 10,00 $ ist teurer als DeepSeeks Off-Peak-Tarif und günstiger als nichts, aber er ist im Voraus bekannt, und an zwei Stunden pro Tag ist er bei der Ausgabe der günstigere der beiden.
• Agenten-Loops mit einem großen stabilen Präfix – rechne die Cache-Treffer-Kalkulation durch, bevor du wählst. Der Cache-Treffer-Input von DeepSeek kostet außerhalb der Spitzenzeiten 0,022 $, was ein Neuntel von GPT-6 Sols 0,20 $ ist, aber es ist auch der Posten, den DeepSeek zu Spitzenzeiten um das Zwölffache erhöht hat. Der Vorteil ist real – und er hängt von der Uhrzeit ab.
• Alles Regulierte, oder alles, dessen Umleitung Sie sich nicht leisten können — DeepSeek V4 Pro, selbst gehostet vom MIT-Checkpoint. Der Rückzug im September ist die Fallstudie, und er ist ein besserer Grund, die festen Kosten zu akzeptieren als jeder Vergleich pro Token.
• Alles, was die Spitze des agentischen Spektrums erfordert – GPT-6 Sol. Zwölf Indexpunkte und dreißig Punkte bei Terminal-Bench sind keine Rundungsdifferenz, und die von DeepSeek selbst gemeldeten Anbieterzahlen schließen diese Lücke nicht.
Flatrate und Zeitplan sind beides ehrliche Preisgestaltungen. Sie beantworten nur unterschiedliche Fragen: Das eine sagt dir, was ein Token kostet, das andere sagt dir, was ein Token kostet, wenn du ihn brauchst.
In diesem Artikel verglichen4
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
