
DeepSeek V4 Pro vs Kimi K3: szybkość i cena wobec 44-punktowego pułapu rozumowania
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
DeepSeek V4 Pro i Kimi K3 to dwa flagowe modele rozumujące z otwartymi wagami i oknem miliona tokenów, a ich rywalizacja przybrała stabilny kształt miesiąc temu: Kimi K3 (model Moonshot AI o 2,8 bln parametrów, wydany 16 lipca 2026 r.) jest liderem pod względem inteligencji, a DeepSeek V4 Pro (wydany 13 sierpnia 2026 r.) jest liderem szybkości i ceny. Nowością jest to, że ta tańsza połowa tej pary została niemal usunięta w pierwszej połowie września — DeepSeek 8 września umieścił V4 Pro na ścieżce wycofania 14 września, opóźnił to, a następnie 11 września całkowicie anulował wycofanie, zobowiązując się do dalszego udostępniania modelu przy niezmienionym rozliczeniu. Ma to większe znaczenie dla tego starcia niż dla większości, ponieważ „tani, szybki, kontekst 1M, otwarte wagi” to kombinacja, którą trudno zastąpić, gdy alternatywa kosztuje pięć razy więcej.
Niezależne dane to pomiary Artificial Analysis. Własne benchmarki premierowe DeepSeek i Moonshot są oznaczone jako raportowane przez dostawcę, ponieważ ani jedne, ani drugie nie zostały niezależnie odtworzone.
Kimi K3 wygrywa w indeksie; V4 Pro wygrywa w rachunku
Niezależny ranking nie pozostawia wątpliwości, kto jest inteligentniejszy. Kimi K3 przy maksymalnym wysiłku uzyskuje 44 punkty w Artificial Analysis Intelligence Index, zajmując 2. miejsce wśród porównywalnych modeli. DeepSeek V4 Pro uzyskuje 36 punktów, zajmując 7. miejsce w swojej klasie. Ta dziewięciopunktowa różnica jest jedynym powodem, dla którego ktokolwiek płaci ceny Kimi K3. A ceny są powodem, dla którego pojedynek nie jest rozstrzygany wyłącznie przez indeks: Kimi K3 jest wyceniony na 3,00 USD za milion tokenów wejściowych i 15,00 USD za milion tokenów wyjściowych, podczas gdy V4 Pro jest wyceniony na 0,66 USD/1,98 USD poza godzinami szczytu (1,32 USD/3,96 USD w godzinach szczytu). Na wyjściu to około 7,5 razy — przed rabatem za pamięć podręczną. Odczyty z pamięci podręcznej V4 Pro kosztują około 0,02 USD za milion tokenów poza godzinami szczytu, co stanowi 97% rabatu; rabat 90% na pamięć podręczną w Kimi K3 zaczyna się od znacznie wyższej podstawy. W przypadku obciążenia z dużą liczbą tokenów efektywna różnica rośnie w kierunku dziesięciokrotności.
• Indeks Inteligencji — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)
• Cena — Kimi K3 3,00 USD/15,00 USD za 1 mln vs V4 Pro 0,66 USD/1,98 USD poza szczytem (1,32 USD/3,96 USD w szczycie)
• Szybkość — V4 Pro ~81 tokenów/s vs Kimi K3 ~35 tokenów/s
• Kontekst — oba po 1 mln tokenów
• Parametry — Kimi K3 2,8 bln łącznie / 104 mld aktywnych vs V4 Pro 1,6 bln łącznie / 49 mld aktywnych
• Wagi — obie otwarte (Kimi K3 z otwartymi wagami, V4 Pro MIT)
• Dane wejściowe — Kimi K3 tekst i obraz vs V4 Pro tylko tekst
Szybkość to część, której wszyscy nie doceniają
Luką, o której nikt nie mówi, jest przepustowość. V4 Pro generuje około 81 tokenów na sekundę w niezależnych pomiarach; Kimi K3 osiąga około 35. W pętli agentowej, w której model zapisuje kilka tysięcy tokenów na krok, to różnica między zadaniem kończonym w kilka minut a takim, które wlecze się przez całe popołudnie — a różnica w kosztach dodatkowo to pogłębia, ponieważ płacisz 15 USD za milion tokenów wyjściowych przy mniej więcej o połowę mniejszej szybkości. W przypadku interaktywnych asystentów kodowania, masowego przetwarzania dokumentów i każdego obciążenia, w którym czas rzeczywisty jest pozycją budżetową, połączenie w V4 Pro szybkości 2,3x przy jednej siódmej ceny za tokeny wyjściowe jest dominującą odpowiedzią.
Kiedy dziewięć punktów jest tego warte
Uczciwym argumentem za Kimi K3 jest górna granica rozumowania. Jego koszt ewaluacji w Intelligence Index wyniósł około 3 658 USD za przebieg — odzwierciedlenie naprawdę długich i kosztownych łańcuchów rozumowania, a nie osobliwość cennika. Jeśli Twoje obciążenie to wymagające rozumowanie — głębokie dowody matematyczne, planowanie długoterminowe, wielogodzinne zadania agentowe, w których dodatkowe dziewięć punktów indeksu przekłada się na mniej niepowodzeń — Kimi K3 uzasadnia swoją wyższą cenę. Uczciwy argument przeciwko niemu to wszystko inne: przepustowość, ekonomika pamięci podręcznej, sama cena za token.
Inny powód, dla którego wrześniowe odwrócenie ma tu znaczenie: miesiąc temu rozsądna rada brzmiała: „jeśli zamierzasz standaryzować na tanim, szybkim otwartym modelu, zabezpiecz się — może zostać wycofany”. Od 15 września to zabezpieczenie jest przestarzałe. DeepSeek publicznie zobowiązał się do utrzymania V4 Pro w API, obiecując powiadomienie, jeśli coś się zmieni, a licencja MIT oznacza, że model pozostaje możliwy do wdrożenia na własnym sprzęcie niezależnie od tego, co DeepSeek zrobi ze swoim API. Otwarte wagi Kimi K3 dają tę samą swobodę po drugiej stronie, co czyni to prawdziwym porównaniem dwóch modeli z otwartymi wagami, a nie walką między usługą a produktem.

Oba modele są dostępne w OrcaRouter — DeepSeek V4 Pro i Kimi K3 są kierowane przez tę platformę za pomocą jednego klucza, a ceny katalogowe dostawców są przekazywane bez marży — a DSL routingu to naturalny sposób rozdzielenia tego pojedynku: kieruj zadania rozumowania długiego horyzontu do Kimi K3, gdzie te dziewięć punktów zwraca się z nawiązką, a prace przepustowościowe o dużym zużyciu tokenów kieruj do DeepSeek V4 Pro, gdzie różnica cen 7,5x i różnica szybkości 2,3x robią robotę za Ciebie. Te dwa modele tak samo często się uzupełniają, jak ze sobą konkurują, a platforma sprawia, że uruchomienie obu wymaga tyle samo pracy co uruchomienie jednego.


Najważniejsze
Kimi K3 to mądrzejszy model z otwartymi wagami, wyprzedzający o dziewięć punktów indeksu, a jego narzut — 7,5× na tokenach wyjściowych, około połowy szybkości — to realny koszt, a nie błąd zaokrąglenia. DeepSeek V4 Pro to szybki, tani i wytrzymały koń roboczy, a po 11 września nie jest już ryzykiem ucieczki. Praktyczna odpowiedź to ta, na którą wskazują obie kolumny cen: jeśli twoje zadania wymagają trudnego rozumowania, kup Kimi K3; jeśli są tokenochłonne i wrażliwe na czas, kup DeepSeek V4 Pro; a jeśli masz oba rodzaje, używaj obu i kieruj zadania według ich typu.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
