Kimi K3 vs DeepSeek V4: Die beiden Open-Weight-Titanen im Vergleich
Guides & Insights

Kimi K3 vs DeepSeek V4: Die beiden Open-Weight-Titanen im Vergleich

Autor

Fengya Tian

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Dies ist das hochkarätigste Duell der Open-Weight-Modelle im Jahr 2026. Kimi K3 und DeepSeek V4 sind beide große Mixture-of-Experts-Modelle mit offenen Gewichten, etwa 1 Million Token Kontext und aggressiver Preisgestaltung, und beide stammen aus chinesischen Laboren. Wenn Sie sich entschieden haben, dass Sie ein offenes, selbst hostbares Spitzenmodell wollen, sind dies Ihre beiden Finalisten.

Die Unterschiede sind real, aber spezifisch: DeepSeek V4 ist textbasiert und zum absoluten Mindestpreis erhältlich (mit einem Aufschlag zu Stoßzeiten, den die meisten übersehen); Kimi bietet natives Sehen und liegt in unabhängigen Indizes knapp vor DeepSeek in der allgemeinen Intelligenz. Auch die Lizenzierung unterscheidet sich: DeepSeek ist vollständig MIT, Kimi ist Modified MIT. So wählen Sie aus.

Zunächst eine ehrliche Anmerkung: Moonshot hat zum 15. Juli 2026 noch keine offiziellen K3-Spezifikationen oder Benchmarks veröffentlicht. Das durchgesickerte Launch-Promo ist echt, die Zahlen sind nicht bestätigt. Wo wir also Fähigkeiten vergleichen, verwenden wir Kimis aktuelle Linie, K2.6 und K2.7 Code, als Basis, auf die K3 voraussichtlich aufbauen wird, und wir sagen das jedes Mal. Behandeln Sie jede K3-Zahl als Gerücht, bis die Modellkarte live ist.

Kurzes Fazit

- Offenheit: Beide sind offen gewichtet und selbst hostbar. DeepSeek V4 ist vollständig MIT; Kimi ist modifiziertes MIT (fügt Markenanforderungen bei sehr großem Maßstab hinzu). DeepSeek ist die liberalere Lizenz.

- Preis: DeepSeek V4-Pro ist am günstigsten mit ~0,435 $ Eingabe / 0,87 $ Ausgabe pro 1M außerhalb der Spitzenzeiten, aber während der Spitzenzeiten kommt ein etwa 2-facher Aufschlag hinzu. Kimis Preise liegen bei ~0,60–0,95 $ / 2,80–4,00 $. DeepSeek gewinnt beim reinen Preis; achte auf die Preisgestaltung zu Spitzenzeiten.

- Intelligenz (unabhängig): Kimi K2.6 führt bei Open Weights auf dem Artificial Analysis Intelligence Index (54) knapp vor DeepSeek V4-Pro (52).

- Modalität: Kimi hat native Bildverarbeitung; DeepSeek V4 ist nur Text. Wenn Sie Bildeingabe in einem offenen Modell benötigen, gewinnt Kimi.

- Codierung: sehr nah, DeepSeek V4-Pro berichtet SWE-Bench Verified 80.6 und LiveCodeBench 93.5; Kimi K2.6 berichtet SWE-Bench Verified 80.2 und Open-Source-führendes SWE-Bench Pro 58.6 (vs DeepSeek's 55.4).

- Fazit: Wählen Sie DeepSeek V4 für die absolut niedrigsten Textkosten und die freizügigste Lizenz; wählen Sie Kimi K3 für natives Sehen, einen leichten Vorteil bei unabhängiger Intelligenz und (angeblich) längeren Kontext. Viele Teams sollten beide behalten und routen.

Auf einen Blick

- Kimi K3 (erwartet, basierend auf K2.6/K2.7): Open-Weight MoE, modifizierte MIT; gerüchteweise 2,5–4 Billionen Parameter; gerüchteweise 1M Kontextfenster; native Vision; Preis nicht angekündigt (ca. $0,60–$0,95 / $2,80–$4,00).

- DeepSeek V4-Pro: Open-Weight MoE, MIT; 1,6 Billionen Gesamt / 49 Milliarden aktiv; 1 Mio. Kontext / bis zu 384K Ausgabe; nur Text; ~$0,435 Eingabe / $0,87 Ausgabe außerhalb der Spitzenzeiten (Cache-Treffer ~$0,0036), etwa das Doppelte zu Spitzenzeiten; veröffentlicht am 24. April 2026. (Eine leichtere V4-Flash, 284 Milliarden/13 Milliarden, kostet etwa $0,14/$0,28.)

- Hinweis: Die veralteten API-Namen von DeepSeek (deepseek-chat / deepseek-reasoner) werden am 24. Juli 2026 eingestellt. Planen Sie die Migration, wenn Sie diese verwenden.

Preis und der Spitzenstundenfang

Auf dem Papier ist DeepSeek V4-Pro das günstigste leistungsfähige Open-Source-Modell, das verfügbar ist, mit etwa 0,435 $ Input und 0,87 $ Output pro Million Tokens, mit nahezu kostenlosen Cache-Hits. Kimis Preise liegen etwas höher bei 0,60–0,95 $ Input und 2,80–4,00 $ Output. Für reines Textvolumen gewinnt DeepSeek den Preiskampf.

Den Haken, den Konkurrenten selten erwähnen: DeepSeek hat seinen alten Nebenzeiten-Rabatt in einen Spitzenlast-Zuschlag umgewandelt, sodass die Preise während der chinesischen Geschäftszeiten (etwa 09:00–12:00 und 14:00–18:00) ungefähr doppelt so hoch sind. Wenn Ihr Datenverkehr stoßweise anfällt und auf die chinesische Tageszeit ausgerichtet ist, kann Ihre tatsächliche DeepSeek-Rechnung näher an der von Kimi liegen, als der Schlagzeilenpreis vermuten lässt. Genau diese Art von Landing-Cost-Detail zeigt sich erst, wenn man die Ausgaben pro Stunde misst, nicht pro Token.

Benchmarks: ein echtes Kopf-an-Kopf-Rennen

Diese beiden liegen näher beieinander als jedes andere Paar in dieser Serie. Beim Codieren meldet DeepSeek V4-Pro SWE-Bench Verified 80.6, LiveCodeBench 93.5 und eine bemerkenswerte Codeforces-Bewertung von 3206; Kimi K2.6 meldet SWE-Bench Verified 80.2, LiveCodeBench v6 89.6 und einen für Open Source führenden SWE-Bench Pro von 58.6 gegenüber DeepSeek's 55.4. In Wissenschaft und Mathematik tauschen sie Schläge aus (GPQA Diamond ~90 jeweils; AIME 2026 Kimi 96.4 vs DeepSeek 94.3).

Die Tiebreaker sind unabhängig und strukturell. Im Artificial Analysis Intelligence Index liegt Kimi K2.6 (54) knapp vor DeepSeek V4‑Pro (52) als bestes Open‑Weight‑Modell. Aber DeepSeek ist nur für Text, während Kimis native Bildverarbeitung und die angeblich längere Kimi K3 Kontext erweitern, was es tun kann. Die Coding‑Zahlen beider Anbieter aus erster Hand verdienen Ihre eigene Überprüfung.

Lizenzierung, Modalität und Self-Hosting

Wenn Sie ein offenes Modell auswählen, entscheiden drei praktische Punkte. Lizenz: DeepSeek's einfache MIT ist die freizügigste, Kimi's modifizierte MIT fügt nur bei sehr großem Umfang (100M+ Nutzer oder 20M+ USD/Monat Umsatz) sichtbare Branding-Anforderungen hinzu, für die meisten Teams irrelevant, aber erwähnenswert. Modalität: Kimi verarbeitet Bilder nativ; DeepSeek ist nur Text. Selbsthosting: Beide sind schwer, DeepSeek V4-Pro und vollwertiges Kimi benötigen jeweils etwa 8 High-End-GPUs, daher werden viele Teams sie über neutrale Jurisdiktions-Hosts (OpenRouter, DeepInfra) betreiben statt vor Ort. Beide First-Party-APIs unterliegen der chinesischen Jurisdiktion, also leiten Sie entsprechend weiter, wenn Datenresidenz wichtig ist.

Welches sollten Sie verwenden?

Wählen Sie DeepSeek V4, wenn Sie die niedrigstmöglichen Nur-Text-Kosten und die großzügigste Lizenz wünschen und Ihr Datenverkehr nicht auf die chinesischen Stoßzeiten konzentriert ist. Wählen Sie Kimi K3, wenn Sie natives Sehen benötigen, den leichten Vorteil der unabhängigen Intelligenz bevorzugen oder den gemunkelten längeren Kontext nutzen möchten. Für viele Teams ist die richtige Antwort beides – sie sind billig genug, um sie als redundante Open-Weight-Optionen zu behalten.

Diese Redundanz ist ein Feature, wenn beide hinter einem einzigen OrcaRouter-Endpunkt sitzen. Sie können reine Text-Bulk-Anfragen zu dem günstigeren Modell zur aktuellen Stunde leiten (wobei die Spitzenzuschläge von DeepSeek automatisch umgangen werden), Bildaufgaben an Kimi senden und zwischen ihnen ausweichen, falls einer der Anbieter drosselt – alles mit Kosten und Latenz pro Modell in einem Dashboard. Zwei offene Modelle, eine Integration, und das günstigere steht immer vorn.

FAQ

Welches ist billiger, Kimi K3 oder DeepSeek V4?

DeepSeek V4-Pro ist auf dem Papier billiger (~$0.435/$0.87 in Schwachlastzeiten gegenüber Kimis ~$0.60-$0.95/$2.80-$4.00), aber sein ~2x Spitzenlastzuschlag kann die Lücke für den auf Tages-China ausgerichteten Verkehr schließen.

Welches ist leistungsfähiger?

Sehr knapp. Kimi K2.6 übertrifft DeepSeek V4-Pro im unabhängigen Artificial Analysis Intelligence Index (54 vs 52) und im SWE-Bench Pro; DeepSeek führt bei der Codeforces-Bewertung und LiveCodeBench. K3 soll Kimis Zahlen erhöhen, bei der Einführung überprüfen.

Unterstützen beide Bilder?

Nein. Kimi hat eine native Bildverarbeitung; DeepSeek V4 ist nur Text. Wenn Sie Bildeingabe in einem offenen Modell benötigen, wählen Sie Kimi.

Kann ich beide ausführen und automatisch umschalten?

Ja, das ist ein starkes Muster. Ein Gateway wie OrcaRouter kann zu dem jeweils günstigeren oder besser geeigneten offenen Modell pro Aufgabe routen und zwischen ihnen hinter einem Endpunkt ausweichen.

Kimi K3 hat noch keine offiziellen Benchmarks, kann ich diesem Vergleich vertrauen?

Faire Frage. Zum 15. Juli 2026 ist K3 unbestätigt, daher verwendet dieser Vergleich Kimis ausgelieferte K2.6/K2.7-Linie als untere Grenze und kennzeichnet jede K3-Zahl als Gerücht. Der Konsens der Community lautet: „Aufgeregt, aber warten wir auf die echten Zahlen“, und unabhängige Ranglisten erscheinen in der Regel drei bis sechs Wochen nach einer Veröffentlichung. Die risikoarme Maßnahme: Die Einschätzung als richtungsweisend betrachten, jetzt aufgabenbasiertes Routing einrichten und am Tag, an dem Moonshots offizielle K3-Zahlen eintreffen, erneut benchmarken.

Das Fazit

Kimi K3 and DeepSeek V4 sind die beiden besten Open-Weight-Modelle des Jahres 2026, und sie sind nah genug beieinander, dass man beide vernünftigerweise betreiben kann. Entscheiden Sie sich für DeepSeek für extrem niedrige, reine Textkosten und eine sauberere Lizenz, wählen Sie Kimi für native Vision und einen leichten Leistungsvorsprung, und wenn Sie unsicher sind, routen Sie zwischen ihnen und lassen Sie das günstigere, besser geeignete Modell jede Anfrage gewinnen.




© 2026 OrcaRouter

Für Anbieter

Sie betreiben eine Inferenz-Plattform? Bringen Sie Ihre Modelle auf OrcaRouter.

Kontaktieren Sie uns

Community beitreten

DiscordEmailXGitHubYouTube