
Grok 4.7 vs. DeepSeek V4 Pro: Das eine ist neu, das andere wird Ihnen unter den Füßen weggetauscht
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Ein am 10. September 2026 veröffentlichter Hinweis ändert, worum es in diesem Vergleich geht. „Wir schaffen V4-Pro ab“, heißt es darin, und ab 04:00 UTC am 14. September 2026 wird jede Anfrage an die Modellkennung deepseek-v4-pro zu DeepSeek-V4.1-Flash zu V4.1-Flash-Preisen weitergeleitet – ein Zustand, der laut dem Beitrag „bis zum Start von V4.1-Pro“ andauert. Die Modellkennung antwortet weiterhin. Das dahinterstehende Modell ist nicht das, das Sie gebenchmarkt haben. Dadurch ist ein direkter Vergleich mit Grok 4.7 – vom Anbieter am 21. September 2026 veröffentlicht, einen Tag bevor dies geschrieben wurde – ein Vergleich mit einem Ablaufdatum auf einer Seite. Was die vorhandenen Zahlen angeht, ist Grok 4.7 das stärkere Modell und DeepSeek V4 Pro das günstigere. Bei der Frage, die tatsächlich über eine Integration entscheidet, ist nur eines von beiden noch das, was es zu sein vorgibt.
Was die einzelnen Modelle sind, bevor die Bewertungen kommen
DeepSeek V4 Pro erreichte am 13. August 2026 als Checkpoint DeepSeek-V4-Pro-0813 die allgemeine Verfügbarkeit, nach einer Vorschau am 24. April. Es ist Open Weights unter MIT – die Lizenz erlaubt kommerzielle Nutzung, Modifikation und Weiterverbreitung ohne Umsatzschwelle oder regionale Ausnahme – mit 1,7 Billionen Gesamtparametern auf der GA-Modellkarte, einem Kontextfenster von 1 Mio. Tokens und einer maximalen Ausgabe von 384K, der höchsten Ausgabeobergrenze in diesem Vergleich. Es ist reines Textmodell: DeepSeeks eigene Preisseite gibt an, dass Vision auf v4-pro nicht unterstützt wird, was eine echte Einschränkung für alle darstellt, die ihm Screenshots oder PDFs zuführen. Es bietet einen Regler für den Reasoning-Aufwand mit niedrig, hoch und max und ist auf 500 gleichzeitige Anfragen pro Konto begrenzt, wobei eine Erweiterung auf Anfrage verfügbar ist.
Grok 4.7 hat geschlossene Gewichte und ist einen Tag alt. Es hat einen Kontext von 500k Token – halb so viel wie DeepSeek –, nimmt Text und Bilder entgegen und verfügt über einen eigenen Effort-Regler. Sein Listenpreis beträgt 2,00 $ pro Million Eingabe-Token und 6,00 $ pro Million Ausgabe-Token unterhalb von 200k Prompt-Token und verdoppelt sich auf 4,00 $ bzw. 12,00 $ bei oder über dieser Schwelle, wobei gecachte Lesezugriffe 0,50 $ und 1,00 $ kosten. xAI führt außerdem eine schnellere Variante mit etwa doppelter Ausgabegeschwindigkeit und doppeltem Preis auf. Keiner der beiden Anbieter veröffentlicht in der hier geprüften Dokumentation eine maximale Ausgabegröße für Grok 4.7, behandeln Sie diese Dimension daher als unbekannt und nicht als gleich.
Auf dem gemeinsamen Index ist die Lücke in eine Richtung schief.
Beide Modelle werden auf der am 19. September 2026 veröffentlichten Revision des Artificial Analysis Intelligence Index v4.3.2 bewertet. Die Spalte von Grok 4.7 wird bei xhigh effort gemessen; die von DeepSeek ist der 0813-Checkpoint bei max effort. Liest man sie zusammen, unterschätzt der zusammengesetzte Abstand, wie unterschiedlich diese beiden Modelle ausgeprägt sind.
• Gesamtwert — Grok 4.7: 46 im Artificial Analysis Intelligence Index v4.3.2. DeepSeek V4 Pro 0813: 36 in derselben Revision.
• Terminal-Agenten — Grok 4.7: Terminal-Bench 4.0 26. DeepSeek V4 Pro: 14. Fast doppelt so hoch, bei der Bewertung, die autonomer Softwarearbeit am nächsten kommt.
• Automatisierung — Grok 4.7: AutomationBench-AA 66 %. DeepSeek V4 Pro: 57 %. Beide glaubwürdig; Grok liegt mit neun vorn.
• Wissen und Halluzination — Grok 4.7: AA-Omniscience 32. DeepSeek V4 Pro: 1. Dies ist der Ausreißer auf der Rangliste, und es ist kein Rundungsartefakt — der Index bewertet sowohl, was ein Modell weiß, als auch, wie oft es eine Antwort erfindet, wenn es sie nicht weiß.
• Langer Kontext — Grok 4.7: AA-LCR v1.1 77 %, Fenster 500k. DeepSeek V4 Pro: 80 %, Fenster 1M. DeepSeeks einzig klarer Sieg, und es ist die Achse, für die sein 1M-Fenster gebaut wurde.
• Schwieriges Schlussfolgern — Grok 4.7: HLE 43, CritPt 18. DeepSeek V4 Pro: HLE 41, CritPt 18. Ein Gleichstand beim Physik-Benchmark und ein Zwei-Punkte-Vorsprung für Grok bei HLE.
• Ausführlichkeit — Grok 4.7: 240 Mio. Ausgabe-Token, um den Index zu betreiben, als ungewöhnlich ausführlich eingestuft. DeepSeek V4 Pro: 163 Mio. Beide sind gesprächig; Grok ist gesprächiger.

Beim Preis geht es nicht um eine einzelne Zahl, sondern um einen Zeitplan.
Das Aggressivste an DeepSeek ist seine Preisgestaltung – und das am wenigsten verlässlich zu Beziffernde. Der Listenpreis für deepseek-v4-pro beträgt 0,66 US-Dollar pro Million Input-Tokens bei einem Cache-Miss und 1,98 US-Dollar pro Million Output-Tokens – außerhalb der Spitzenzeiten. Zu Spitzenzeiten verdoppeln sich diese auf 1,32 US-Dollar und 3,96 US-Dollar. Spitzenzeit ist laut DeepSeeks eigener Dokumentation 01:00–04:00 und 06:00–10:00 UTC von Montag bis Freitag, mit Ausnahme chinesischer gesetzlicher Feiertage; alles andere, einschließlich ganzer Wochenenden, ist Nebenzeit zum exakt halben Preis. Gecachte Input-Reads sind die eigentliche Schlagzeile: 0,022 US-Dollar außerhalb der Spitzenzeiten und 0,044 US-Dollar zu Spitzenzeiten, dreißigmal günstiger als ein Cache-Miss, wodurch eine gut gecachte DeepSeek-Workload dramatisch günstiger wird, als es das Tarifblatt vermuten lässt.
Dagegen wirken die 2,00 $ und 6,00 $ von Grok 4.7 teuer – rund das Dreifache von DeepSeeks Off-Peak-Input und das Dreifache seines Off-Peak-Outputs. Der Abstand verringert sich auf Weisen, die man kennen sollte. Der Preis von Grok 4.7 ist innerhalb seiner Tarifstufe konstant und nicht uhrzeitabhängig, sodass eine Produktionsspitze um 09:00 UTC genauso viel kostet wie ein Batch am Sonntagabend; bei DeepSeek ist das nicht so. Und oberhalb von 200k Prompt-Tokens verdoppelt sich Grok 4.7, womit er dann das Vier- bis Sechsfache von DeepSeeks Off-Peak-Tarif beträgt statt das Dreifache. Einfach ausgedrückt: DeepSeek V4 Pro ist in jeder Hinsicht das günstigere Modell, und wie groß der Rabatt ausfällt, hängt davon ab, wann Sie ihn nutzen und wie gut Sie cachen.
Was der 14. September verändert hat
Das ist der Teil, der es schwerer macht, auf das Preisargument zu bauen. Ab dem 14. September 2026 leitet DeepSeek Anfragen für deepseek-v4-pro an DeepSeek-V4.1-Flash weiter und stellt sie zu Flash-Tarifen in Rechnung – die noch niedriger sind. Das Änderungsprotokoll und die Preisseite von DeepSeek erzählen eine etwas andere Geschichte als der News-Beitrag vom 10. September: Die Preistabelle führt deepseek-v4-pro weiterhin als aktive Zeile mit eigenen Tarifen und ohne Auslauf-Kennzeichnung, und der Eintrag im Änderungsprotokoll besagt, dass der API-Dienst für V4 Pro nach dem 14. September fortgeführt wird, wobei die Abrechnung unverändert bleibt. Unstrittig ist die Richtung der Entwicklung. V4.1-Pro ist bestätigt in Entwicklung, ohne angekündigtes Datum, und V4.1-Flash – veröffentlicht am 10. September – ist laut DeepSeeks eigener Ankündigung das, was V4 Pro bei „Leistung, Kosten, Geschwindigkeit und Gesamtlaufzeit“ übertrifft, eine Anbieterbehauptung, die in dieser Breite nicht unabhängig reproduziert wurde.
Die praktische Frage lautet also nicht „Grok 4.7 oder DeepSeek V4 Pro“, sondern „Grok 4.7 oder welches DeepSeek-Modell auch immer diese Zeichenfolge im nächsten Quartal auflöst“. Wenn Sie V4 Pro im August einem Benchmark unterzogen und Ihr Kontextbudget auf ein 1M-Fenster mit einer 384K-Ausgabegrenze ausgelegt haben, ist das Modell, das Sie im November aufrufen, möglicherweise nicht das, das Sie gemessen haben – und die Kontext- und Ausgabegrenzen des Nachfolgers sind nicht die, auf die Sie ausgelegt haben. Grok 4.7 hat das entgegengesetzte Risikoprofil: ein erst einen Tag altes Modell, dessen Zahlen vom Anbieter angegeben und weitgehend nicht reproduziert sind, dessen Identität aber nicht infrage steht.

Wo ein Router passt – und wo nicht
OrcaRouter führt DeepSeek V4 Pro, und die Modellseite listet es zum eigenen Tarif des Anbieters — 0,66 $ für Eingabe und 1,98 $ für Ausgabe bei einem Kontextfenster von 1M und einer maximalen Ausgabe von 384k —, weil wir die Listenpreise der Anbieter mit 0 % Aufschlag weitergeben. Das ist bei einem Anbieter, dessen Tarife sich nach einem Peak-/Off-Peak-Zeitplan ändern und dessen Ankündigung vom 10. September mit einer Preissenkung einherkam, wichtiger als sonst: Eine DeepSeek-Preisänderung ist am selben Tag unter demselben Key live, ohne Verzögerung bei der Preisanpassung und ohne zweiten Vertrag. Wenn ein Anbieter einen Modell-String auf seiner Seite umleitet, kommt die Änderung über denselben Endpunkt, statt eine Neuintegration auf Ihrer Seite zu erfordern, und automatisches Failover verhindert, dass ein Ratenlimit oder ein Kapazitätsereignis auf Anbieterseite zu einem Ausfall wird — nützlich, wenn eine Seite Ihres Stacks auf 500 gleichzeitige Anfragen begrenzt ist. Grok 4.7 ist zum Zeitpunkt dieses Schreibens nicht im OrcaRouter-Katalog; es aufzurufen bedeutet, über die eigene API von xAI und die Drittplattformen zu gehen, die es anbieten.
Die Aufteilung, die dies nahelegt, ist unspektakulär, aber vertretbar: Behalten Sie DeepSeek V4 Pro für die Workloads, bei denen Cache-Hit-Preise und das 1M-Fenster die Arbeit leisten, und richten Sie Ihre Erwartungen auf V4.1-Flash statt auf den August-Checkpoint. Setzen Sie Grok 4.7 für die Aufgaben ein, bei denen das Modell wissen muss, was es nicht weiß — ein AA-Omniscience-Index von 1 ist ein lautes Signal für die Bereitschaft eines Modells, selbstsicher und falsch zu antworten, und kein Preisvorteil überlebt, wenn ein nachgelagerter Nutzer einer erfundenen Antwort vertraut.
Der Anruf.
Grok 4.7 ist hier das bessere Modell, und das nicht gerade knapp: zehn Punkte Vorsprung im Composite, doppelte Punktzahl im Terminal-Bench, ein Vorsprung bei der Automatisierung und eine Lücke bei der Wissensehrlichkeit, die breit genug für einen Kategorienunterschied ist. DeepSeek V4 Pro ist außerhalb der Stoßzeiten rund dreimal günstiger und bietet den doppelten Kontextumfang, was ein echter und vertretbarer Grund ist, es zu behalten – aber man kauft nicht das Modell, das man gebenchmarkt hat, sondern einen Modell-String, den DeepSeek bereits angekündigt hat, umzuleiten, zu Preisen, die sich stündlich ändern, unter einer Lizenz und einem Gewichtssatz, die Self-Hosting zu einer echten dritten Option machen. Wenn die Arbeitslast langkontextig, hochvolumig und cachefähig ist, sind die DeepSeek-Ökonomie schwer zu schlagen, und man sollte für den Nachfolger statt für den Checkpoint planen. Wenn es um irgendetwas geht, bei dem falsch zu liegen teuer ist, zahle den dreifachen Preis und nimm das Modell, das Unsicherheit zugibt.

In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
