Eine generierte Hero-Karte mit dem Titel „DeepSeek V4 Pro vs Grok 4.6“, links ein Schild-Symbol, beschriftet mit „DeepSeek V4 Pro“ und mit dem Badge „MIT, offene Gewichte“ versehen, rechts ein Schlüssel-Symbol, beschriftet mit „Grok 4.6“ und mit dem Badge „Proprietär“ versehen, dazwischen eine ausgewogene Waage und in der Fußzeile „Gleiche Reasoning-Klasse, gegensätzliche Philosophien – ein Preiskrieg, der mit 24 Stunden Abstand ausgetragen wurde“.
Guides & Insights

DeepSeek V4 Pro vs. Grok 4.6: Ein Preiskrieg mit 24 Stunden Abstand, und wer ihn tatsächlich gewonnen hat

Autor

Elias Hawthorne

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Grok 4.6 shipped on August 12, 2026, and DeepSeek V4 Pro followed the next day — the two flagship launches of the same forty-eight hours, now a month behind us and newly worth revisiting because one of them spent last week trying to retire and then changing its mind. Both are frontier-class reasoning models, but they could not be more different products: Grok 4.6 is x​AI's proprietary flagship at $2.00 per million input tokens and $6.00 per million output tokens, and DeepSeek V4 Pro is the MIT-licensed open-weights model from Deep​Seek at $0.66/$1.98 off-peak (or $1.32/$3.96 at peak). The interesting thing about the matchup is how little the raw price ratio — about 3x on output, over 9x when you stack V4 Pro's off-peak and cache windows — tells you about who should use which. The two are aimed at different buyers, and the September events on the Deep​Seek side changed the calculus for exactly one of those buyers.

Die unabhängigen Zahlen in diesem Beitrag sind Messungen von Artificial Analysis. Die vom Anbieter erhobenen Werte sind als vom Anbieter gemeldet gekennzeichnet, da die Launch-Benchmarks keines der beiden Unternehmen von einer dritten Partei reproduziert wurden.

Dieselbe Woche, dieselbe Reasoning-Klasse, gegensätzliche Philosophien

Im Artificial Analysis Intelligence Index erzielt Grok 4.6 bei hohem Aufwand 44 Punkte – Rang 20 von 200 über den gesamten Index –, während DeepSeek V4 Pro 36 Punkte erzielt und damit in seiner eigenen Klasse auf Rang 7 liegt. Eine Acht-Punkte-Lücke, was bedeutet, dass der Aufpreis tatsächlich messbares Reasoning erkauft, nicht nur Verpackung. Doch gerade die Verpackung erklärt den Rest des Preisunterschieds: Grok 4.6 ist ein multimodales proprietäres Modell – Text- und Bildeingabe, 500K Kontext, standardmäßig Reasoning –, das Sie über die API von xAI oder einen Partner aufrufen. DeepSeek V4 Pro ist text-only, 1M Kontext und wird mit MIT-lizenzierten Gewichten ausgeliefert, die Sie selbst herunterladen und betreiben können.

• Intelligence Index — Grok 4.6 44 (#20/200) vs. V4 Pro 36 (#7/113)

• Preis — Grok 4.6 $2,00/$6,00 pro 1 Mio. vs. V4 Pro $0,66/$1,98 außerhalb der Stoßzeiten ($1,32/$3,96 zu Spitzenzeiten)

• Geschwindigkeit — Grok 4.6 ~57 Tokens/Sek. vs. V4 Pro ~81 Tokens/Sek.

• Kontext — Grok 4.6 500K vs V4 Pro 1M

• Eingabe — Grok 4.6 Text und Bild vs. V4 Pro nur Text

• Gewichte — Grok 4.6 proprietär vs. V4 Pro MIT offene Gewichte

Wo der 3-fache Preisaufschlag auftritt und wo nicht

Die Preislücke ist real, und sie ist teilweise eine Intelligenzlücke – aber nur teilweise. Grok 4.6 führt auf dem unabhängigen Index mit acht Punkten Vorsprung, und der Rest des Aufpreises erkauft einem andere Dinge als reine Leistungsfähigkeit: das Ökosystem von xAI, Bildeingabe und einen 500K-Kontext, bereitgestellt von einem Unternehmen, dessen gesamtes Geschäft genau dieses eine Produkt ist. Der stärkere Kontrast ist die Deployment-Geschichte. Grok 4.6 ist ein Dienst: Man mietet ihn, man besitzt ihn nie. DeepSeek V4 Pro ist ebenfalls ein Dienst, aber die unter MIT-Lizenz stehenden Modellgewichte bedeuten, dass es auch Infrastruktur ist: Wenn der API-Preis oder die Roadmap des Anbieters nicht mehr zu einem passt, kann man dasselbe Modell auf eigener Hardware zu den Grenzkosten der Rechenleistung aufsetzen. Das ist ein Unterschied der Art, nicht des Grades, und genau dieser macht die Einordnung als „billiger“ unvollständig.

Die Kehrtwende im September veränderte eine Hälfte dieser Geschichte.

In der Woche vom 8. September schickte DeepSeek V4 Pro auf einen Auslaufpfad: Ab dem 14. September würden Anfragen an deepseek-v4-pro an V4.1 Flash weitergeleitet und zu Flash-Preisen abgerechnet, bis ein V4.1 Pro verfügbar wäre. Dann verschob es den Stichtag, dann machte es am 11. September alles rückgängig, verpflichtete sich, V4 Pro zu unveränderten Abrechnungsbedingungen weiter zu bedienen, und erklärte, es werde rechtzeitig Bescheid geben, falls sich das jemals ändere. Die Kehrtwende wurde noch am selben Tag von chinesischen Staatsmedien und mehreren Tech-Medien bestätigt. Für dieses Duell zählt diese Nachricht auf der Grok-Seite mehr als auf der DeepSeek-Seite: Wer sich mit der Begründung „das günstige offene Modell verschwindet bald“ zu Grok 4.6 geneigt hatte, dem wurde diese Begründung stillschweigend entzogen. Die günstige Hälfte ist beständig, was die Premium-Hälfte zu einer Wahl statt zu einer erzwungenen Absicherung macht.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at $1.32 input and $3.96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Wen das Duell tatsächlich begünstigt

Wenn Sie ein Frontier-Reasoning-Modell mit Bildeingabe, langem Kontext und keinem Interesse daran wollen, eigene Gewichte zu betreiben, sind Grok 4.6s $2/$6 ein fairer Preis, und seine 44 im Index ist konkurrenzfähig mit allem in dieser Stufe. Wenn Ihre Workload textbasiert und token-intensiv ist, ist DeepSeek V4 Pro die bessere Antwort auf nahezu jeder Achse, die sich in der Rechnung niederschlägt: etwa dreimal günstiger zu Spitzenlastzeiten, tieferer Cache-Rabatt, schnellere Ausgabe, doppelter Kontext und offene Gewichte als Notausgang. Der wirklich schwierige Fall ist textbasiert und reasoning-intensiv mit engen Latenzanforderungen – dort zählt die Acht-Punkte-Lücke, und Ihre Evaluation sollte entscheiden, nicht das Marketing.

Beide sind heute auf OrcaRouter verfügbar — Grok 4.6 und DeepSeek V4 Pro laufen beide über die Plattform — Sie können also eines von beiden (oder beide) mit einem einzigen Schlüssel aufrufen, wobei die Listenpreise der Anbieter ohne Aufschlag weitergegeben werden. Da diese Weitergabe exakt erfolgt, sind die Preisspalten in diesem Artikel die Preise, die Sie tatsächlich zahlen, und dank der Routing-DSL können Sie Bild-Eingabe-Aufgaben an Grok 4.6 und Langtext-Aufgaben an DeepSeek V4 Pro aus derselben Integration heraus senden. Die Arbeitsannahme des Beitrags ist, dass Sie beide wollen würden, gerade weil keines die Stärken des anderen erreicht.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of $0.66 and output price of $1.98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Grok 4.6 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, Input text, Weights MIT; right column Grok 4.6 rows AA Index 44 (#20/200), Price $2.00/$6.00, Speed ~57 tok/s, Context 500K, Input text+image, Weights proprietary; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

Das Urteil

Grok 4.6 und DeepSeek V4 Pro sind beide starke Reasoning-Modelle mit wirklich vergleichbaren unabhängigen Bewertungen, und der Preisunterschied zwischen ihnen erkauft einen echten, aber schmalen Vorsprung bei der Intelligenz plus eine völlig andere Produktphilosophie: multimodale Eingabe und ein geschlossenes Ökosystem gegenüber nur Text, offenen Gewichten und einem drei- bis neunmal günstigeren Token. Wenn du Reasoning mietest, reicht jedes von beiden, und deine Evaluation entscheidet. Wenn du Infrastruktur baust, ist DeepSeek V4 Pro das Modell, das eine Woche Ruhestands-Drama nicht killen konnte — und seit dem 15. September ist es außerdem dasjenige mit einem schriftlichen Versprechen zu bleiben.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert