Eine generierte Hero-Karte mit dem Titel 'DeepSeek V4 Pro vs. Qwen3.8 Max' mit zwei abgerundeten Karten – einer DeepSeek V4 Pro-Karte mit dem Badge '$0,66 / $1,98 außerhalb der Spitzenzeiten · MIT-Offengewichte · 1M Kontext' und einer Qwen3.8 Max-Karte mit dem Badge '$2,00 / $6,00 · Kommerzielle Lizenz · 1M Kontext' – getrennt durch ein Waage-Symbol und die Fußzeile 'Dreifacher Preis, vier Punkte Intelligenz – was übersteht den Kontakt mit Ihrer Rechnung?'
Guides & Insights

DeepSeek V4 Pro vs. Qwen3.8 Max: Die dreifache Preisdifferenz – erneuter Testlauf nach der September-Gnadenfrist

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

DeepSeek V4 Pro und Qwen3.8 Max sind die beiden wichtigsten Open- oder Billig-Flaggschiffe dieser Generation, und die September-Ereignisse auf der Deep​Seek-Seite haben das Duell stärker verändert, als das Marketing beider Anbieter zugegeben hat. DeepSeek V4 Pro erschien am 13. August 2026, zehn Tage nachdem Aliba​bas Qwen3.8 Max am 3. August allgemein verfügbar wurde, und das Duo las sich stets wie ein einseitiger Wettbewerb: Qwen3.8 Max ist der 2,4-Billionen-Parameter-Allrounder bei 2 US-Dollar pro Million Input- und 6 US-Dollar pro Million Output-Tokens, während DeepSeek V4 Pro der 1,6-Billionen-Parameter-Reasoning-Spezialist zu einem Bruchteil dieses Preises ist, MIT-lizenziert, mit öffentlichen Gewichten. Der Grund, warum es sich lohnt, diesen Vergleich heute erneut anzustellen, sind nicht die Zahlen der Startwoche, sondern das, was einen Monat später geschah — Deep​Seek verbrachte die Woche ab dem 8. September damit, V4 Pro auszumustern, revidierte dies dann am 11. September und verpflichtete sich, es bei unveränderter Abrechnung online zu halten. Diese Kehrtwende ist derzeit die allerwichtigste Tatsache in diesem Duell, denn sie entscheidet, ob die günstige Hälfte eine sichere Wette oder eine Migrationsfalle ist.

Unabhängige Messungen in diesem Beitrag stammen von Artificial Analysis und wurden heute erhoben. Die eigenen Benchmark-Tabellen von Aliba​ba und Deep​Seek sind durchgängig als vom Anbieter gemeldet gekennzeichnet – die Startzahlen keines der beiden Unternehmen wurden von einem Dritten vollständig reproduziert, und die von Deep​Seek sind inzwischen vier Wochen alt gegenüber einer sich ständig verändernden Rangliste.

Die Atempause im September ist die eigentliche Geschichte, nicht der Start im August.

Am 8. September kündigte DeepSeek an, dass nach dem 14. September jede Anfrage an deepseek-v4-pro an V4.1 Flash weitergeleitet und zu Flash-Preisen abgerechnet würde, bis ein V4.1 Pro verfügbar wäre. Wer Qwen3.8 Max versus DeepSeek V4 Pro als ernsthaften Vergleich betrieb, musste damit beginnen, einzuplanen, dass die günstige Option verschwinden würde. Dann verschob DeepSeek den Stichtag, und am 11. September kehrte es die Entscheidung vollständig um: Es werde nach dem 14. September weiterhin API-Dienste für DeepSeek V4 Pro bereitstellen, bei unveränderter Abrechnung, und werde benachrichtigen, falls sich das jemals ändert. Die Kehrtwende wurde am selben Tag von chinesischen Staatsmedien und der Tech-Presse gemeldet.

Was dies für das Duell bedeutet: Die Asymmetrie, die die Entscheidungen still mitgelenkt hat, wird beseitigt. Während der ersten Septemberwoche wurde die ehrliche Antwort auf die Frage „Sollte ich auf dem $0,66-Ausgabemodell oder dem $6-Ausgabemodell aufbauen?“ durch Überlebensrisiko verfälscht: Der Preisführer hatte ein Abschaltdatum. Seit dem 15. September ist diese Verfälschung verschwunden. Die günstige Option ist dauerhaft, und beim Vergleich geht es endlich um das, worum es immer hätte gehen sollen – Intelligenz, Preis und Geschwindigkeit.

A generated scoreboard titled 'DeepSeek V4 Pro vs Qwen3.8 Max — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, License MIT open weights, Input text; right column Qwen3.8 Max rows AA Index 40 (#30/200), Price $2.00/$6.00, Speed ~41 tok/s, Context 1M, License Commercial, Input text + image + video; footer 'AA figures independent (current scale); DeepSeek price is vendor list off-peak.'

Preis: dasselbe Spiel zu einem Bruchteil der Ausgabekosten

Auf der aktuellen unabhängigen Rangliste liegen die beiden vier Punkte auseinander, und der Preisunterschied zwischen ihnen ist der größte in der Open-Weights-Klasse. Qwen3.8 Max kostet laut Alibabas Listenpreis 2,00 US-Dollar pro Million Eingabe- und 6,00 US-Dollar pro Million Ausgabe-Tokens, mit einem Cache-Rabatt von 88 %. DeepSeek V4 Pro kostet außerhalb der Spitzenzeiten 0,66 US-Dollar pro Million Eingabe- und 1,98 US-Dollar pro Million Ausgabe-Tokens; zu Spitzenzeiten verdoppeln sich diese Preise auf 1,32/3,96 US-Dollar, mit einem Cache-Rabatt von 97 %.

• Preis — DeepSeek V4 Pro 0,66 $/1,98 $ pro 1 Mio. außerhalb der Spitzenzeit (Spitzenzeit 1,32 $/3,96 $) vs. Qwen3.8 Max 2,00 $/6,00 $ pauschal

• Intelligenz-Index — V4 Pro 36 (#7/113) vs. Qwen3.8 Max 40 (#30/200)

• Ausgabegeschwindigkeit — V4 Pro ~81 Token/Sek. vs. Qwen3.8 Max ~41 Token/Sek.

• Kosten pro Aufgabe — V4 Pro 0,67 $ vs. Qwen3.8 Max 2,67 $ (pro Aufgabe im AA-Index)

• Kontext — beide 1M Token

• Lizenz — V4 Pro MIT offene Gewichte vs. Qwen3.8 Max proprietäre Gewichte, kommerzielle Lizenz

Das Verhältnis der Ausgabepreise ist das ganze Argument: Qwen3.8 Max kostet dreimal so viel pro Eingabe-Token und etwa dreimal so viel pro Ausgabe-Token zum Spitzensatz von V4 Pro — und die Lücke bei der Ausgabe weitet sich auf das Sechsfache, wenn V4 Pro zu seinem Off-Peak-Tarif abgerechnet wird, der den größten Teil der Woche außerhalb eines engen Zeitfensters abdeckt. Bei einer Arbeitslast mit hohem Reasoning-Anteil, bei der Ausgabe-Token die Rechnung dominieren, ist diese Lücke der Unterschied zwischen einem Modell, das man einfach laufen lassen kann, und einem, das man im Dashboard beobachtet. Die Cache-Zeilen vergrößern sie weiter: Der 97%ige Rabatt von V4 Pro gegenüber 88% bei Qw​en bedeutet, dass eine Long-Context-Aufgabe mit wiederverwendetem Präfix auf der Deep​Seek-Seite nur einen Bruchteil ihres Listenpreises kostet.

Intelligenz: vier Punkte Abstand, und der Abstand ist das eigentliche Produkt

Das unabhängige Scoreboard macht dies enger, als es das Preisverhältnis vermuten lässt. Im aktuellen Artificial Analysis Intelligence Index erreicht Qwen3.8 Max 40 Punkte gegenüber 36 von DeepSeek V4 Pro — eine Vier-Punkte-Lücke, die sich bei reasoning-lastiger Arbeit zeigt, aber bei token-lastiger Arbeit verschwindet. Der Vorsprung von Qwen3.8 Max ist real und beständig: Insgesamt belegt es Platz 30 von 200, knapp innerhalb der Frontier, während V4 Pro in seiner Open-Weights-Klasse Platz 7 von 113 belegt. In der eigenen Benchmark-Tabelle von Aliba​ba gibt Qwen3.8 Max einen Terminal-Bench 2.1 von 86,6, GPQA Diamond 92,6 und einen FrontierSWE 73,5 an, der den Wert seines Vorgängers von 40,7 fast verdoppelt — alles vom Anbieter angegeben, nichts unabhängig reproduziert. Die Modellkarte von Deep​Seek beansprucht eine Codeforces-Bewertung von 3.348 und einen Terminal-Bench 2.1 von 87,9 bei maximalem Reasoning-Aufwand — ebenfalls vom Anbieter angegeben und nicht von Dritten verifiziert.

Die ehrliche Einordnung ist, dass die beiden Unternehmen aneinander vorbeireden. Die Anbietertabelle von Qwen3.8 Max ist auf Unternehmens- und wissenschaftliche Arbeit ausgerichtet – das 0902-Refresh, das Alibaba am 2. September auslieferte, wurde weiter auf Coding und Cowork nachtrainiert, was laut Qwen genau dieses Profil stärkt. Die eigenen Angaben von DeepSeek V4 Pro drehen sich um tiefes Reasoning und agentische Tool-Nutzung, wo seine vier Wochen alten Codeforces- und Terminal-Bench-Zahlen noch immer stark aussehen. Keine der Anbietertabellen wurde von einem unabhängigen Evaluator reproduziert, und auf dem einzigen Scoreboard, das unabhängig ist, macht der Vier-Punkte-Abstand den gesamten Unterschied zwischen den Modellen aus.

Beim Tempo verliert Qwen3.8 Max still und leise an Boden

Die Dimension, die das Datenblatt verschweigt, ist die Ausgabegeschwindigkeit. Artificial Analysis misst DeepSeek V4 Pro mit etwa 81 Token pro Sekunde gegenüber Qwen3.8 Max mit ungefähr 41 – ein Unterschied um den Faktor zwei bei der Geschwindigkeit, mit der Antworten zurückkommen. Bei einer Chat-Workload ist das eine Pause, die der Nutzer bemerkt; bei einer Agent-Schleife mit vielen sequenziellen Aufrufen summiert es sich zu echter Wanduhrzeit. Das Preisverhältnis spricht bereits für V4 Pro, und die Geschwindigkeitslücke macht die effektive Kosten-pro-Antwort-Lücke noch größer, als die Token-Rechnung vermuten lässt.

In dieser Zahl steckt ein Kompromiss – nämlich die Ausführlichkeit von Qwen3.8 Max. Artificial Analysis merkt an, das Modell sei „merklich langsam und sehr ausführlich“, und seine Kosten pro Aufgabe – 2,67 $ gegenüber 0,67 $ bei V4 Pro – spiegeln sowohl den höheren Satz als auch die zusätzlichen Ausgabe-Tokens wider. Ein Reasoning-Modell, das pro Antwort mehr schreibt, kostet pro Aufgabe mehr, noch bevor Sie mit der Preisliste multiplizieren. Wenn Ihre Workload latenzempfindlich ist oder Ihre Agent-Loop Dutzende Aufrufe macht, ist das die Zahl, an der Sie Ihre eigene Evaluierung ansetzen sollten.

Gewichte: MIT versus eine kommerzielle Lizenz

DeepSeek V4 Pro ist MIT-lizenziert und die Gewichte sind öffentlich – Sie können sie herunterladen, selbst hosten, feinabstimmen und Ihre Änderungen geschlossen halten. Qwen3.8 Max ist das erste Qwen der Max-Klasse, das jemals offene Gewichte ausliefert (der 2,4T-A95B-Checkpoint erschien am 12. August), allerdings unter einer kommerziellen Lizenz mit gestaffelten Bedingungen, und Alibaba hat nicht den vollständigen Inferenz-Stack veröffentlicht, so wie DeepSeek es getan hat. Für ein Unternehmen, das die beiden vergleicht, gibt die Deployment-Geschichte den Ausschlag: V4 Pro lässt sich als Infrastruktur selbst hosten; Qwen3.8 Max ist in erster Linie ein Dienst, den man mietet. Der Unterschied bei den Gewichten ist am wichtigsten, wenn es Ihnen um Vendor-Lock-in geht oder wenn Sie die API-Preise vollständig umgehen möchten.

Wer sollte welche auswählen?

Wenn Ihre Workload stark auf Reasoning ausgerichtet ist, von Ausgabe-Tokens dominiert wird oder latenzempfindlich ist, ist DeepSeek V4 Pro die Antwort auf nahezu jeder Achse, die sich in der Rechnung niederschlägt: rund drei- bis sechsmal günstiger bei der Ausgabe, etwa doppelt so schnell, tieferer Cache-Rabatt und MIT-Gewichte als Notausgang. Die Vier-Punkte-Intelligenzlücke ist real, aber schmal, und sie übersteht selten den Kontakt mit dem Preisunterschied im Produktionsverkehr.

Wenn Ihre Workload enterprise-geprägt ist – komplexe mehrstufige Analysen, tiefe logische Herleitung, anspruchsvolle agentische Arbeit oder jede Aufgabe, bei der die marginale Antwortqualität das Drei- bis Sechsfache der Token-Kosten wert ist –, dann sind die zusätzlichen vier Punkte von Qwen3.8 Max auf dem unabhängigen Index und seine stärkeren Enterprise-Benchmark-Angaben der Grund, den Aufpreis zu zahlen. Das 0902-Refresh schärft dieses Profil. Und wenn Sie Bild- oder Videoeingabe benötigen, ist die Wahl nicht einmal knapp: Qwen3.8 Max akzeptiert Text, Bild und Video, während DeepSeek V4 Pro nur Text verarbeitet.

Beide Modelle sind über OrcaRouter mit einem einzigen Schlüssel aufrufbar – DeepSeek V4 Pro und Qwen3.8 Max laufen beide über die Plattform – und da OrcaRouter die Listenpreise der Anbieter ohne Aufschlag weitergibt, sind die Zahlen in diesem Artikel genau die Zahlen, die Sie tatsächlich zahlen, wobei Preissenkungen der Anbieter noch am selben Tag greifen. Mit der Routing-DSL können Sie den token-intensiven oder latenzempfindlichen Verkehr an DeepSeek V4 Pro und die multimodalen oder besonders kritischen Reasoning-Aufgaben an Qwen3.8 Max aus derselben Integration heraus senden – was genau der Art und Weise entspricht, wie die meisten Teams diese Kombination nutzen: beides, jeweils für das, was am besten passt.

A screenshot of the Artificial Analysis page for Qwen3.8 Max, captured September 15, 2026, showing the Intelligence Index score of 40 at rank 30 of 200, output speed 40.6 tokens per second, an input price of $2.00 and output price of $6.00 per million tokens with an 88% cache discount, and a cost of $2.67 per Intelligence Index task.A screenshot of the OrcaRouter model page for Qwen3.8 Max at orcarouter.ai/models/qwen/qwen3.8-max, captured September 15, 2026, showing the model listing with its provider Qwen, 1M-token context window, text+image+video input, and $2.00/$6.00 per-million-token pricing alongside the surrounding catalogue.

Das Urteil

Die September-Atempause hat die Frage geklärt, die diesen Vergleich zu ertränken drohte: Die günstige Hälfte ist kein Abwanderungsrisiko mehr. DeepSeek V4 Pro ist die Preis-Leistungs-Antwort – bei der Ausgabe drei- bis sechsmal günstiger, doppelt so schnell, MIT-lizenziert und nun verpflichtet, online zu bleiben. Qwen3.8 Max ist die Antwort, wenn es um Leistungsfähigkeit geht – vier unabhängige Indexpunkte höher, stärkere Enterprise-Zusagen, multimodale Eingabe und eine kommerzielle Lizenz, die verhindert, dass es in Ihrem Stack landet. Wählen Sie die vier Punkte, wenn Ihre Evals beweisen, dass sie zählen; wählen Sie den Preis, wenn Ihre Rechnung die Eval ist, die tatsächlich entscheidet.

Schicke den token-intensiven oder latenzempfindlichen Traffic an DeepSeek V4 Pro und das multimodale oder das Reasoning mit der höchsten Tragweite an Qwen3.8 Max – und zwar aus ein und derselben Integration heraus; genau so nutzen die meisten Teams diese Paarung am Ende: beide, für das, worin jedes am besten ist.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert