Wygenerowana karta hero zatytułowana 'DeepSeek V4 Pro vs Kimi K3' z ikoną wskaźnika prędkości po lewej, opatrzoną etykietą 'DeepSeek V4 Pro' i plakietką '~81 tok/s · /bin/bash.66/.98', oraz ikoną mózgu po prawej, opatrzoną etykietą 'Kimi K3' i plakietką 'Index 44 · .00/5.00', z subtelnym separatorem w stylu toru wyścigowego między nimi i stopką 'Prędkość i cena w zestawieniu z pułapem rozumowania'.
Guides & Insights

DeepSeek V4 Pro vs Kimi K3: szybkość i cena wobec 44-punktowego pułapu rozumowania

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

DeepSeek V4 Pro i Kimi K3 to dwa flagowe modele rozumujące z otwartymi wagami i oknem miliona tokenów, a ich rywalizacja przybrała stabilny kształt miesiąc temu: Kimi K3 (model Moonshot AI o 2,8 bln parametrów, wydany 16 lipca 2026 r.) jest liderem pod względem inteligencji, a DeepSeek V4 Pro (wydany 13 sierpnia 2026 r.) jest liderem szybkości i ceny. Nowością jest to, że ta tańsza połowa tej pary została niemal usunięta w pierwszej połowie września — DeepSeek 8 września umieścił V4 Pro na ścieżce wycofania 14 września, opóźnił to, a następnie 11 września całkowicie anulował wycofanie, zobowiązując się do dalszego udostępniania modelu przy niezmienionym rozliczeniu. Ma to większe znaczenie dla tego starcia niż dla większości, ponieważ „tani, szybki, kontekst 1M, otwarte wagi” to kombinacja, którą trudno zastąpić, gdy alternatywa kosztuje pięć razy więcej.

Niezależne dane to pomiary Artificial Analysis. Własne benchmarki premierowe DeepSeek i Moonshot są oznaczone jako raportowane przez dostawcę, ponieważ ani jedne, ani drugie nie zostały niezależnie odtworzone.

Kimi K3 wygrywa w indeksie; V4 Pro wygrywa w rachunku

Niezależny ranking nie pozostawia wątpliwości, kto jest inteligentniejszy. Kimi K3 przy maksymalnym wysiłku uzyskuje 44 punkty w Artificial Analysis Intelligence Index, zajmując 2. miejsce wśród porównywalnych modeli. DeepSeek V4 Pro uzyskuje 36 punktów, zajmując 7. miejsce w swojej klasie. Ta dziewięciopunktowa różnica jest jedynym powodem, dla którego ktokolwiek płaci ceny Kimi K3. A ceny są powodem, dla którego pojedynek nie jest rozstrzygany wyłącznie przez indeks: Kimi K3 jest wyceniony na 3,00 USD za milion tokenów wejściowych i 15,00 USD za milion tokenów wyjściowych, podczas gdy V4 Pro jest wyceniony na 0,66 USD/1,98 USD poza godzinami szczytu (1,32 USD/3,96 USD w godzinach szczytu). Na wyjściu to około 7,5 razy — przed rabatem za pamięć podręczną. Odczyty z pamięci podręcznej V4 Pro kosztują około 0,02 USD za milion tokenów poza godzinami szczytu, co stanowi 97% rabatu; rabat 90% na pamięć podręczną w Kimi K3 zaczyna się od znacznie wyższej podstawy. W przypadku obciążenia z dużą liczbą tokenów efektywna różnica rośnie w kierunku dziesięciokrotności.

• Indeks Inteligencji — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)

• Cena — Kimi K3 3,00 USD/15,00 USD za 1 mln vs V4 Pro 0,66 USD/1,98 USD poza szczytem (1,32 USD/3,96 USD w szczycie)

• Szybkość — V4 Pro ~81 tokenów/s vs Kimi K3 ~35 tokenów/s

• Kontekst — oba po 1 mln tokenów

• Parametry — Kimi K3 2,8 bln łącznie / 104 mld aktywnych vs V4 Pro 1,6 bln łącznie / 49 mld aktywnych

• Wagi — obie otwarte (Kimi K3 z otwartymi wagami, V4 Pro MIT)

• Dane wejściowe — Kimi K3 tekst i obraz vs V4 Pro tylko tekst

Szybkość to część, której wszyscy nie doceniają

Luką, o której nikt nie mówi, jest przepustowość. V4 Pro generuje około 81 tokenów na sekundę w niezależnych pomiarach; Kimi K3 osiąga około 35. W pętli agentowej, w której model zapisuje kilka tysięcy tokenów na krok, to różnica między zadaniem kończonym w kilka minut a takim, które wlecze się przez całe popołudnie — a różnica w kosztach dodatkowo to pogłębia, ponieważ płacisz 15 USD za milion tokenów wyjściowych przy mniej więcej o połowę mniejszej szybkości. W przypadku interaktywnych asystentów kodowania, masowego przetwarzania dokumentów i każdego obciążenia, w którym czas rzeczywisty jest pozycją budżetową, połączenie w V4 Pro szybkości 2,3x przy jednej siódmej ceny za tokeny wyjściowe jest dominującą odpowiedzią.

Kiedy dziewięć punktów jest tego warte

Uczciwym argumentem za Kimi K3 jest górna granica rozumowania. Jego koszt ewaluacji w Intelligence Index wyniósł około 3 658 USD za przebieg — odzwierciedlenie naprawdę długich i kosztownych łańcuchów rozumowania, a nie osobliwość cennika. Jeśli Twoje obciążenie to wymagające rozumowanie — głębokie dowody matematyczne, planowanie długoterminowe, wielogodzinne zadania agentowe, w których dodatkowe dziewięć punktów indeksu przekłada się na mniej niepowodzeń — Kimi K3 uzasadnia swoją wyższą cenę. Uczciwy argument przeciwko niemu to wszystko inne: przepustowość, ekonomika pamięci podręcznej, sama cena za token.

Inny powód, dla którego wrześniowe odwrócenie ma tu znaczenie: miesiąc temu rozsądna rada brzmiała: „jeśli zamierzasz standaryzować na tanim, szybkim otwartym modelu, zabezpiecz się — może zostać wycofany”. Od 15 września to zabezpieczenie jest przestarzałe. Deep​Seek publicznie zobowiązał się do utrzymania V4 Pro w API, obiecując powiadomienie, jeśli coś się zmieni, a licencja MIT oznacza, że model pozostaje możliwy do wdrożenia na własnym sprzęcie niezależnie od tego, co Deep​Seek zrobi ze swoim API. Otwarte wagi Kimi K3 dają tę samą swobodę po drugiej stronie, co czyni to prawdziwym porównaniem dwóch modeli z otwartymi wagami, a nie walką między usługą a produktem.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Oba modele są dostępne w OrcaRouter — DeepSeek V4 Pro i Kimi K3 są kierowane przez tę platformę za pomocą jednego klucza, a ceny katalogowe dostawców są przekazywane bez marży — a DSL routingu to naturalny sposób rozdzielenia tego pojedynku: kieruj zadania rozumowania długiego horyzontu do Kimi K3, gdzie te dziewięć punktów zwraca się z nawiązką, a prace przepustowościowe o dużym zużyciu tokenów kieruj do DeepSeek V4 Pro, gdzie różnica cen 7,5x i różnica szybkości 2,3x robią robotę za Ciebie. Te dwa modele tak samo często się uzupełniają, jak ze sobą konkurują, a platforma sprawia, że uruchomienie obu wymaga tyle samo pracy co uruchomienie jednego.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

Najważniejsze

Kimi K3 to mądrzejszy model z otwartymi wagami, wyprzedzający o dziewięć punktów indeksu, a jego narzut — 7,5× na tokenach wyjściowych, około połowy szybkości — to realny koszt, a nie błąd zaokrąglenia. DeepSeek V4 Pro to szybki, tani i wytrzymały koń roboczy, a po 11 września nie jest już ryzykiem ucieczki. Praktyczna odpowiedź to ta, na którą wskazują obie kolumny cen: jeśli twoje zadania wymagają trudnego rozumowania, kup Kimi K3; jeśli są tokenochłonne i wrażliwe na czas, kup DeepSeek V4 Pro; a jeśli masz oba rodzaje, używaj obu i kieruj zadania według ich typu.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie