
DeepSeek V4 Pro vs. Grok 4.6: Ein Preiskrieg mit 24 Stunden Abstand, und wer ihn tatsächlich gewonnen hat
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiNEUOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleNEUGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenNEUQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenz72Coding
- anthropicNEUAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenz69Coding
Grok 4.6 shipped on August 12, 2026, and DeepSeek V4 Pro followed the next day — the two flagship launches of the same forty-eight hours, now a month behind us and newly worth revisiting because one of them spent last week trying to retire and then changing its mind. Both are frontier-class reasoning models, but they could not be more different products: Grok 4.6 is xAI's proprietary flagship at $2.00 per million input tokens and $6.00 per million output tokens, and DeepSeek V4 Pro is the MIT-licensed open-weights model from DeepSeek at $0.66/$1.98 off-peak (or $1.32/$3.96 at peak). The interesting thing about the matchup is how little the raw price ratio — about 3x on output, over 9x when you stack V4 Pro's off-peak and cache windows — tells you about who should use which. The two are aimed at different buyers, and the September events on the DeepSeek side changed the calculus for exactly one of those buyers.
Die unabhängigen Zahlen in diesem Beitrag sind Messungen von Artificial Analysis. Die vom Anbieter erhobenen Werte sind als vom Anbieter gemeldet gekennzeichnet, da die Launch-Benchmarks keines der beiden Unternehmen von einer dritten Partei reproduziert wurden.
Dieselbe Woche, dieselbe Reasoning-Klasse, gegensätzliche Philosophien
Im Artificial Analysis Intelligence Index erzielt Grok 4.6 bei hohem Aufwand 44 Punkte – Rang 20 von 200 über den gesamten Index –, während DeepSeek V4 Pro 36 Punkte erzielt und damit in seiner eigenen Klasse auf Rang 7 liegt. Eine Acht-Punkte-Lücke, was bedeutet, dass der Aufpreis tatsächlich messbares Reasoning erkauft, nicht nur Verpackung. Doch gerade die Verpackung erklärt den Rest des Preisunterschieds: Grok 4.6 ist ein multimodales proprietäres Modell – Text- und Bildeingabe, 500K Kontext, standardmäßig Reasoning –, das Sie über die API von xAI oder einen Partner aufrufen. DeepSeek V4 Pro ist text-only, 1M Kontext und wird mit MIT-lizenzierten Gewichten ausgeliefert, die Sie selbst herunterladen und betreiben können.
• Intelligence Index — Grok 4.6 44 (#20/200) vs. V4 Pro 36 (#7/113)
• Preis — Grok 4.6 $2,00/$6,00 pro 1 Mio. vs. V4 Pro $0,66/$1,98 außerhalb der Stoßzeiten ($1,32/$3,96 zu Spitzenzeiten)
• Geschwindigkeit — Grok 4.6 ~57 Tokens/Sek. vs. V4 Pro ~81 Tokens/Sek.
• Kontext — Grok 4.6 500K vs V4 Pro 1M
• Eingabe — Grok 4.6 Text und Bild vs. V4 Pro nur Text
• Gewichte — Grok 4.6 proprietär vs. V4 Pro MIT offene Gewichte
Wo der 3-fache Preisaufschlag auftritt und wo nicht
Die Preislücke ist real, und sie ist teilweise eine Intelligenzlücke – aber nur teilweise. Grok 4.6 führt auf dem unabhängigen Index mit acht Punkten Vorsprung, und der Rest des Aufpreises erkauft einem andere Dinge als reine Leistungsfähigkeit: das Ökosystem von xAI, Bildeingabe und einen 500K-Kontext, bereitgestellt von einem Unternehmen, dessen gesamtes Geschäft genau dieses eine Produkt ist. Der stärkere Kontrast ist die Deployment-Geschichte. Grok 4.6 ist ein Dienst: Man mietet ihn, man besitzt ihn nie. DeepSeek V4 Pro ist ebenfalls ein Dienst, aber die unter MIT-Lizenz stehenden Modellgewichte bedeuten, dass es auch Infrastruktur ist: Wenn der API-Preis oder die Roadmap des Anbieters nicht mehr zu einem passt, kann man dasselbe Modell auf eigener Hardware zu den Grenzkosten der Rechenleistung aufsetzen. Das ist ein Unterschied der Art, nicht des Grades, und genau dieser macht die Einordnung als „billiger“ unvollständig.
Die Kehrtwende im September veränderte eine Hälfte dieser Geschichte.
In der Woche vom 8. September schickte DeepSeek V4 Pro auf einen Auslaufpfad: Ab dem 14. September würden Anfragen an deepseek-v4-pro an V4.1 Flash weitergeleitet und zu Flash-Preisen abgerechnet, bis ein V4.1 Pro verfügbar wäre. Dann verschob es den Stichtag, dann machte es am 11. September alles rückgängig, verpflichtete sich, V4 Pro zu unveränderten Abrechnungsbedingungen weiter zu bedienen, und erklärte, es werde rechtzeitig Bescheid geben, falls sich das jemals ändere. Die Kehrtwende wurde noch am selben Tag von chinesischen Staatsmedien und mehreren Tech-Medien bestätigt. Für dieses Duell zählt diese Nachricht auf der Grok-Seite mehr als auf der DeepSeek-Seite: Wer sich mit der Begründung „das günstige offene Modell verschwindet bald“ zu Grok 4.6 geneigt hatte, dem wurde diese Begründung stillschweigend entzogen. Die günstige Hälfte ist beständig, was die Premium-Hälfte zu einer Wahl statt zu einer erzwungenen Absicherung macht.

Wen das Duell tatsächlich begünstigt
Wenn Sie ein Frontier-Reasoning-Modell mit Bildeingabe, langem Kontext und keinem Interesse daran wollen, eigene Gewichte zu betreiben, sind Grok 4.6s $2/$6 ein fairer Preis, und seine 44 im Index ist konkurrenzfähig mit allem in dieser Stufe. Wenn Ihre Workload textbasiert und token-intensiv ist, ist DeepSeek V4 Pro die bessere Antwort auf nahezu jeder Achse, die sich in der Rechnung niederschlägt: etwa dreimal günstiger zu Spitzenlastzeiten, tieferer Cache-Rabatt, schnellere Ausgabe, doppelter Kontext und offene Gewichte als Notausgang. Der wirklich schwierige Fall ist textbasiert und reasoning-intensiv mit engen Latenzanforderungen – dort zählt die Acht-Punkte-Lücke, und Ihre Evaluation sollte entscheiden, nicht das Marketing.
Beide sind heute auf OrcaRouter verfügbar — Grok 4.6 und DeepSeek V4 Pro laufen beide über die Plattform — Sie können also eines von beiden (oder beide) mit einem einzigen Schlüssel aufrufen, wobei die Listenpreise der Anbieter ohne Aufschlag weitergegeben werden. Da diese Weitergabe exakt erfolgt, sind die Preisspalten in diesem Artikel die Preise, die Sie tatsächlich zahlen, und dank der Routing-DSL können Sie Bild-Eingabe-Aufgaben an Grok 4.6 und Langtext-Aufgaben an DeepSeek V4 Pro aus derselben Integration heraus senden. Die Arbeitsannahme des Beitrags ist, dass Sie beide wollen würden, gerade weil keines die Stärken des anderen erreicht.


Das Urteil
Grok 4.6 und DeepSeek V4 Pro sind beide starke Reasoning-Modelle mit wirklich vergleichbaren unabhängigen Bewertungen, und der Preisunterschied zwischen ihnen erkauft einen echten, aber schmalen Vorsprung bei der Intelligenz plus eine völlig andere Produktphilosophie: multimodale Eingabe und ein geschlossenes Ökosystem gegenüber nur Text, offenen Gewichten und einem drei- bis neunmal günstigeren Token. Wenn du Reasoning mietest, reicht jedes von beiden, und deine Evaluation entscheidet. Wenn du Infrastruktur baust, ist DeepSeek V4 Pro das Modell, das eine Woche Ruhestands-Drama nicht killen konnte — und seit dem 15. September ist es außerdem dasjenige mit einem schriftlichen Versprechen zu bleiben.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
