
DeepSeek V4 Pro vs. Kimi K3: Geschwindigkeit und Preis gegen eine 44-Punkte-Obergrenze beim Reasoning
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiNEUOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleNEUGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenNEUQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenz72Coding
- anthropicNEUAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenz69Coding
DeepSeek V4 Pro und Kimi K3 sind die beiden Flaggschiffe für reasoning mit offenen Gewichten und einem Fenster von einer Million Token, und ihr Wettstreit hat vor einem Monat eine stabile Form angenommen: Kimi K3 (Moonshot AIs Modell mit 2,8 Billionen Parametern, veröffentlicht am 16. Juli 2026) ist der Spitzenreiter bei der Intelligenz, und DeepSeek V4 Pro (veröffentlicht am 13. August 2026) führt bei Geschwindigkeit und Preis. Neu ist, dass die günstige Hälfte dieses Duos in der ersten Septemberhälfte beinahe gestrichen wurde — DeepSeek setzte V4 Pro am 8. auf einen Stilllegungspfad zum 14. September, verschob diesen und sagte die Stilllegung am 11. dann kurzerhand ab, mit der Zusage, das Modell zu unveränderten Abrechnungskonditionen weiterzubetreiben. Das ist für diesen Vergleich wichtiger als für die meisten, denn „günstig, schnell, 1 Mio. Token Kontext, offene Gewichte" ist eine Kombination, die schwer zu ersetzen ist, wenn die Alternative fünfmal so viel kostet.
Unabhängige Zahlen sind Messungen von Artificial Analysis. Die eigenen Launch-Benchmarks von DeepSeek und Moonshot sind als vom Hersteller angegebene Werte gekennzeichnet, weil keine von beiden unabhängig reproduziert wurde.
Kimi K3 gewinnt den Index; V4 Pro gewinnt die Rechnung
Das unabhängige Scoreboard lässt keinen Zweifel daran, wer intelligenter ist. Kimi K3 erreicht bei maximalem Aufwand 44 Punkte auf dem Artificial Analysis Intelligence Index und belegt Platz 2 unter vergleichbaren Modellen. DeepSeek V4 Pro erreicht 36 Punkte und liegt in seiner Klasse auf Platz 7. Diese Neun-Punkte-Lücke ist der einzige Grund, warum überhaupt jemand die Preise von Kimi K3 zahlt. Und die Preise sind der Grund, warum das Duell nicht allein durch den Index entschieden wird: Kimi K3 wird mit $3,00 pro Million Input-Tokens und $15,00 pro Million Output-Tokens gelistet, während V4 Pro mit $0,66/$1,98 außerhalb der Spitzenzeiten ($1,32/$3,96 zu Spitzenzeiten) gelistet wird. Beim Output ist das etwa 7,5-mal so viel – noch vor dem Cache-Rabatt. Die Cache-Lesevorgänge von V4 Pro kosten außerhalb der Spitzenzeiten etwa $0,02 pro Million Tokens, ein Rabatt von 97 %; der 90-%-Cache-Rabatt von Kimi K3 beginnt auf einer viel höheren Basis. Bei einer tokenintensiven Arbeitslast weitet sich die effektive Lücke in Richtung des Zehnfachen.
• Intelligenzindex — Kimi K3 44 (#2/113) vs. V4 Pro 36 (#7/113)
• Preis — Kimi K3 $3.00/$15.00 pro 1 Mio. vs. V4 Pro $0.66/$1.98 außerhalb der Spitzenzeiten ($1.32/$3.96 zu Spitzenzeiten)
• Geschwindigkeit — V4 Pro ~81 Token/Sek. vs. Kimi K3 ~35 Token/Sek.
• Kontext — beide 1M Token
• Parameter — Kimi K3 2,8T gesamt / 104B aktiv vs. V4 Pro 1,6T gesamt / 49B aktiv
• Gewichte — beide offen (Kimi K3 offene Gewichte, V4 Pro MIT)
• Eingabe – Kimi K3 Text und Bild vs. V4 Pro nur Text
Geschwindigkeit ist der Punkt, den jeder unterschätzt
Die Lücke, über die niemand spricht, ist der Durchsatz. V4 Pro gibt unabhängig gemessen etwa 81 Token pro Sekunde aus; Kimi K3 schafft etwa 35. In einer Agentenschleife, in der das Modell mehrere tausend Token pro Schritt schreibt, ist das der Unterschied zwischen einer Aufgabe, die in Minuten erledigt ist, und einer, die sich über einen ganzen Nachmittag hinzieht — und der Kostenunterschied verstärkt das, weil man bei ungefähr halber Geschwindigkeit 15 $ pro Million Ausgabe-Token zahlt. Für interaktive Coding-Assistenten, die Massenverarbeitung von Dokumenten und jede Arbeitslast, bei der die Wanduhrzeit ein Budgetposten ist, ist V4 Pros Kombination aus 2,3-facher Geschwindigkeit bei einem Siebtel des Ausgabepreises die dominierende Antwort.
Wenn die neun Punkte es wert sind
Das ehrliche Argument für Kimi K3 ist die Reasoning-Obergrenze. Seine Evaluierungskosten im Intelligence Index lagen für den Durchlauf bei etwa 3.658 US-Dollar – ein Ausdruck genuin langer und teurer Schlussfolgerungsketten, nicht eine Eigenheit der Preisgestaltung. Wenn Ihre Workload anspruchsvolles Schlussfolgern ist – tiefe mathematische Beweise, langfristige Planung, mehrstündige agentische Aufgaben, bei denen sich neun zusätzliche Indexpunkte als weniger Fehler niederschlagen –, dann verdient Kimi K3 seinen Aufpreis. Das ehrliche Argument dagegen ist alles andere: der Durchsatz, die Cache-Ökonomie, der pure Preis pro Token.
Der andere Grund, warum die September-Kehrtwende hier wichtig ist: Vor einem Monat lautete der vernünftige Rat: „Wenn Sie sich auf das günstige, schnelle offene Modell festlegen wollen, sichern Sie sich ab – es könnte eingestellt werden.“ Seit dem 15. September ist diese Absicherung überholt. DeepSeek hat sich öffentlich verpflichtet, V4 Pro in der API zu belassen, wobei im Fall von Änderungen eine Benachrichtigung zugesagt wurde, und die MIT-Lizenz bedeutet, dass das Modell unabhängig davon, was DeepSeek mit seiner API macht, auf Ihrer eigenen Hardware einsetzbar bleibt. Die offenen Gewichte von Kimi K3 bieten auf der anderen Seite dieselbe Freiheit, was dies zu einem echten Vergleich zweier offener Gewichtssätze macht, statt zu einem Kampf zwischen einem Dienst und einem Produkt.

Beide Modelle sind auf OrcaRouter verfügbar — DeepSeek V4 Pro und Kimi K3 laufen beide über die Plattform mit einem einzigen Schlüssel, wobei die Listenpreise der Anbieter ohne Aufschlag durchgereicht werden — und die Routing-DSL ist der natürliche Weg, dieses Kräftemessen aufzuteilen: Route die Long-Horizon-Reasoning-Aufgaben zu Kimi K3, wo die neun Punkte sich bezahlt machen, und route die tokenintensive Durchsatzarbeit zu DeepSeek V4 Pro, wo die 7,5-fache Preislücke und die 2,3-fache Geschwindigkeitslücke die Arbeit für dich erledigen. Die beiden ergänzen sich ebenso oft, wie sie Konkurrenten sind, und die Plattform macht das Betreiben beider genauso viel Arbeit wie das Betreiben eines einzelnen.


Das Fazit
Kimi K3 ist das klügere Open-Weights-Modell, neun Indexpunkte voraus, und sein Preisaufschlag – das 7,5-Fache bei den Output-Tokens, bei etwa halber Geschwindigkeit – ist ein echter Kostenfaktor, kein Rundungsfehler. DeepSeek V4 Pro ist das schnelle, günstige, belastbare Arbeitstier, und nach dem 11. September ist es kein Fluchtrisiko mehr. Die praktische Antwort ist die, auf die beide Preisspalten zeigen: Wenn es bei Ihren Aufgaben um anspruchsvolles Reasoning geht, kaufen Sie Kimi K3; wenn sie tokenlastig und zeitkritisch sind, kaufen Sie DeepSeek V4 Pro; und wenn Sie beide Arten haben, betreiben Sie beide und routen Sie je nach Aufgabe.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
