
Qwen 3.8 kontra Kimi K3: Dwaj chińscy giganci o otwartej wadze, twarzą w twarz
- metaNOWOŚĆMeta: Muse Spark 1.12026-07-1651Inteligencja71Kod
- kimiNOWOŚĆMoonshotAI: Kimi K32026-07-1557Inteligencja76Kod
- openaiNOWOŚĆOpenAI: GPT-5.6 Luna2026-07-0951Inteligencja71Kod
- openaiNOWOŚĆOpenAI: GPT-5.6 Terra2026-07-0955Inteligencja77Kod
- openaiNOWOŚĆOpenAI: GPT-5.6 Sol2026-07-0959Inteligencja77Kod
- grokNOWOŚĆxAI: Grok 4.52026-07-0854Inteligencja72Kod
- tencentTencent: Hy32026-07-0641Inteligencja59Kod
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligencja42Kod
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligencja39Kod
- anthropicAnthropic: Claude Sonnet 52026-06-3053Inteligencja72Kod
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligencja52Kod57Matematyka
- z-aiZ.ai: GLM 5.22026-06-1651Inteligencja69Kod60Matematyka
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Inteligencja61Kod61Matematyka
- anthropicAnthropic: Claude Fable 52026-06-0960Inteligencja77Kod
- qwenQwen: Qwen3.7 Plus2026-06-0139Inteligencja56Kod59Matematyka
- minimaxMiniMax: MiniMax M32026-05-3144Inteligencja59Kod59Matematyka
- AnthropicAnthropic: Claude Opus 4.82026-05-2856Inteligencja74Kod68Matematyka
- GoogleGemini 3.5 Flash2026-05-2350Inteligencja70Kod51Matematyka
- qwenQwen3.7 Max2026-05-2246Inteligencja66Kod71Matematyka
- qwenQwen3.7 Max (2026-05-20)2026-05-2046Inteligencja66Kod73Matematyka
Spośród wszystkich modeli, z którymi porównywany jest Qwen 3.8 Max,Kimi K3 od Moonshot jest najbardziej naturalnym rywalem: oba są ogromnymi chińskimi modelami Mixture-of-Experts, oba są otwartej klasy wagowej, oba są znane ze swojej gadatliwości, dokładności i powolności. Są w zasadzie dwoma największymi gigantami chińskiego świata otwartych wag – i co niezwykłe, nie musimy zgadywać, jak wypadają w porównaniu, ponieważ ktoś zestawił je ze sobą w tym samym zadaniu. To czyni to najbogatszym porównaniem w serii: nie twierdzenia sprzedawców w zestawieniu z audytowanymi liczbami, ale prawdziwe bezpośrednie starcie.
Przed szczegółami, uwaga dla budowniczych — uczciwy sposób na rozstrzygnięcie tak zaciętej rywalizacji to uruchomienie obu na własnym obciążeniu i obserwowanie kompromisu między dokładnością a szybkością. OrcaRouter udostępnia 200+ modeli za jednym punktem końcowym zgodnym z OpenAI, więc możesz porównać Qwen 3.8 z Kimi K3 na tych samych promptach bez konfigurowania dwóch SDK.
Podsumowanie TL;DR. W jedynym bezpośrednim porównaniu, jakie mamy (Trilogy AI, zadanie rozumienia architektury), Kimi K3 zdobył 83/100, a Qwen 3.8 Max 80/100 — wąska przewaga 3 punktów dla Kimiego. Ale Qwen był tym *dokładniejszym*: 354 cytaty repozytoriów vs 274, 22 żądania bramki vs 53 i zero nieudanych wywołań narzędzi vs dwa, kosztem większego opóźnienia i większej liczby tokenów. Oba osiągnęły 90% trafień w pamięci podręcznej i doszły do tego samego kluczowego wniosku architektonicznego. Dziś Kimi K3 jest bezpieczniejszym wyborem z otwartymi wagami – ma audytowany wynik (57.1, #3 na Artificial Analysis), koronę frontendu Arena oraz wagi, które są już praktycznie dostępne. Qwen 3.8 to ten, na który warto czekać: większy w ambicji, bardziej wyczerpujący w eksploracji, ale bez punktacji na publicznych tablicach, z wagami tylko "wkrótce".
Najważniejsze wnioski
• Qwen 3.8 Max to model MoE o parametrach 2.4T w wersji preview; Kimi K3 to MoE 2.8T z kontekstem 1M i natywną wizją — co oznacza, że Qwen jest mniej więcej mniejszy o 400B parametrów, co przypomina, że większa liczba parametrów nie oznacza lepszego modelu.
• W jedynym bezpośrednim teście (Trilogy AI), Kimi K3 minimalnie pokonało Qwen 80 do 83 ogólnie — ale Qwen uzyskało więcej cytatów repozytorium (354 vs 274), mniej zapytań do bramki (22 vs 53), i miało zero nieudanych wywołań narzędzi (vs dwa).
• Kimi K3 ma audytowany AA Intelligence Index wynoszący 57.1 (#3) — za Fable 5 i GPT-5.6 Sol, przed wszystkimi innymi. Qwen 3.8 ma żadnego niezależnego benchmarku w ogóle.
• Kimi K3 zajmuje także LMArena frontend-code #1 miejsce (1679); Qwen 3.8 nie został oceniony na publicznych tablicach wyników.
• Otwartość jest prawie na równi, ale terminy się różnią: wagi Kimi K3 są otwarte/obiecywane i zasadniczo gotowe; wagi Qwen 3.8 są "wkrótce", ale nie podano daty, licencji ani repozytorium.
Dane Qwen 3.8 to deklaracje sprzedawcy lub wczesne, niekontrolowane wrażenia praktyczne — niezależnie nieaudytowane. Wskaźniki i ceny Kimi K3 są przypisywane Artificial Analysis i mogą różnić się od raportów Moonshot. Bezpośrednie porównanie Trilogy AI to pojedyncze zadanie, a nie pełny zestaw testów. Cena promocyjna Qwen 3.8 to tymczasowy rabat; przed budżetowaniem zweryfikuj stawki.
Specyfikacje i cena, obok siebie
Oto twarde dane, każda liczba dotycząca konkurencji przypisana do swojego źródła.
• Producent / status — Qwen 3.8 Max: Alibaba; wersja zapoznawcza (19 lipca 2026); Kimi K3: Moonshot; wydanie z otwartymi wagami
• Architektura — Qwen 3.8 Max: ~2.4T łącznie, rzadki MoE (aktywne parametry nieujawnione); Kimi K3: 2.8T MoE, natywna wizja (źródło: Artificial Analysis)
• Okno kontekstu — Qwen 3.8 Max: Zgłoszono ~1M tokenów (niepotwierdzone formalnie); Kimi K3: 1M tokenów (źródło: Artificial Analysis)
• AA Intelligence Index — Qwen 3.8 Max: Brak jeszcze — nie oceniono; Kimi K3: 57.1 — #3 (Artificial Analysis)
• Arena / ranking — Qwen 3.8 Max: Nie oceniany publicznie; Kimi K3: Frontend-code #1, 1679 (LMArena)
• Ceny (wewn. / zewn.) — Qwen 3.8 Max: Tylko podgląd (~90% zniżki; API za token niepublikowane); Kimi K3: $3 / $15 na 1M (AA blended ~$2.31)
• Otwarte wagi — Qwen 3.8 Max: Obiecane "wkrótce" (nie wydane); Kimi K3: Otwarte wagi; wagi gotowe/blisko
• Szybkość — Qwen 3.8 Max: Najwolniejszy testowany model (praktyczne); Kimi K3: Rozwlekły i powolny (~34s TTFT, według AA)
Dwie rzeczy nadają ramy całemu porównaniu. Po pierwsze, pusta komórka „AA Intelligence Index" dla Qwen 3.8 opowiada historię: 57,1 Kimi K3 to neutralny werdykt sędziego, który plasuje go na 3. miejscu na świecie, za Fable 5 i GPT‑5.6 Sol; pozycja Qwen 3.8 opiera się na ramie dostawcy i garstce praktycznych testów. Po drugie, zwróć uwagę na odwrócenie rozmiaru — Qwen 3.8 (2,4 T) jest w rzeczywistości o 400 miliardów parametrów mniejszy niż Kimi K3 (2,8 T). Model Alibaby jest opisywany jako „większy w ambicjach”, ale pod względem surowej liczby parametrów Kimi jest większym gigantem i to on ma audytowany wynik, aby to potwierdzić. Oba są znane z rozwlekłości i powolności, więc opóźnienie jest wyrównane; prawdziwymi wyróżnikami są dowód i dostępność wagi, a dziś oba faworyzują Kimi.

Jedno prawdziwe bezpośrednie starcie, jakie mamy
To rzadki pojedynek, w którym nie musimy niczego domniemywać. Trilogy AI uruchomiło oba modele nad pojedynczym zadaniem zrozumienia architektury — czytanie i analizowanie prawdziwego kodu źródłowego — i opublikowało porównanie side-by-side. Kimi K3 wygrał pod względem ogólnego wyniku, ale zachowanie leżące u podstaw opowiada bardziej interesującą historię.
• Ogólna ocena — Qwen 3.8 Max: 80 / 100; Kimi K3: 83 / 100
• Cytowania repozytoriów — Qwen 3.8 Max: 354; Kimi K3: 274
• Żądania bramki — Qwen 3.8 Max: 22; Kimi K3: 53
• Nieudane wywołania narzędzi — Qwen 3.8 Max: 0; Kimi K3: 2
• Ocena używania narzędzi — Qwen 3.8 Max: 9 / 10; Kimi K3: 8 / 10
• Współczynnik trafień cache — Qwen 3.8 Max: >90%; Kimi K3: >90%
Przeczytaj kolumny, nie tylko pierwszy wiersz. Kimi K3 zdobyło 3-punktowe zwycięstwo, ale Qwen 3.8 był bardziej skrupulatnym pracownikiem: cytował 80 dodatkowych miejsc w repozytorium (354 vs 274), doszedł do wniosku w znacznie mniejszej liczbie zapytań do bramy (22 vs 53), wykonał zero nieudanych wywołań narzędzi wobec dwóch Kimiego, i wyprzedził Kimiego w ocenie użycia narzędzi (9 vs 8). Kompromis jest dokładnie taki, jakiego można oczekiwać od charakteru Qwena gdzie indziej – eksploruje wyczerpująco, co skutkuje wyższym opóźnieniem i większą liczbą tokenów. Co kluczowe, oba modele podjęły tę samą podstawową decyzję architektoniczną, więc nie chodzi o to, że jeden ma rację, a drugi nie; chodzi o to, że Kimi szybciej uzyskuje nieco wyżej ocenioną odpowiedź, a Qwen dociera tam z większą ilością dowodów i czystszą dyscypliną narzędziową. Jeśli Twoja praca nagradza wyczerpującą, dobrze zcytowaną eksplorację, profil Qwena jest atrakcyjny; jeśli wolisz sprawdzoną, szybszą odpowiedź, Kimi wygrał rundę.

Często zadawane pytania
Czy Qwen 3.8 jest lepszy od Kimi K3?
Nie na podstawie obecnie istniejących dowodów. W jedynym bezpośrednim porównaniu (Trilogy AI), Kimi K3 uzyskał 83/100, a Qwen 80/100, a Kimi ma audytowany Artificial Analysis Index wynoszący 57,1 (#3), plus koronę w kodzie frontendowym Arena, podczas gdy Qwen 3.8 nie ma żadnego niezależnego wyniku. Przewagą Qwena była dokładność — więcej cytatów z repozytoriów (354 vs 274), mniej żądań bramy i zero nieudanych wywołań narzędzi — ale to przewaga stylistyczna, a nie udowodniona przewaga w możliwościach.
Qwen 3.8 jest większy — czy to czyni go lepszym?
Nie, i w rzeczywistości jest odwrotnie, jeśli chodzi o rozmiar: Qwen 3.8 to ~2,4 biliona parametrów, podczas gdy Kimi K3 to ~2,8 biliona, więc Kimi jest większym modelem z tych dwóch o około 400 miliardów. Większa liczba parametrów nie oznacza jednak lepszej jakości — Kimi jest zarówno większy, jak i ma wyższe wyniki, co jest wyraźnym przypomnieniem, że architektura, trenowanie i dostrajanie mają większe znaczenie niż surowa liczba parametrów.
Jak porównują się ceny?
Kimi K3 ma opublikowaną, stałą cenę $3 / $15 za 1M tokenów (Artificial Analysis uśrednia to do około $2.31). Wersja preview Qwen 3.8 jest mocno przeceniona (~90% zniżki), ale nie ma opublikowanej ceny API za token, a zniżka jest tymczasowa, więc stabilne porównanie cen nie jest jeszcze możliwe. Przy dzisiejszym budżetowaniu, Kimi jest tym z realną ceną.
Który jest lepszym wyborem open-weight?
Obie należą do klasy otwartych wag, ale różni je czas. Wagi Kimi K3 są otwarte i w zasadzie gotowe; wagi Qwen 3.8 są obiecane jako „coming soon” bez podanej daty, licencji ani repozytorium. Jeśli otwarte wagi są powodem, dla którego wybierasz jedną z nich, Kimi jest wyborem, na który możesz działać teraz.
Którego powinienem dzisiaj użyć?
Kimi K3 to bezpieczniejszy domyślny wybór — otrzymał ocenę (#3), wagi są gotowe i wygrał w bezpośrednim porównaniu. Sięgaj po Qwen 3.8, gdy cenisz wyczerpującą, dobrze cytowaną eksplorację i czyste korzystanie z narzędzi ponad szybkość, i traktuj go jako model, na który warto czekać, gdy jego wagi zostaną opublikowane i pojawi się niezależna ocena.
Sedno sprawy
Qwen 3.8 kontra Kimi K3jest najbliższym odpowiednikiem sprawiedliwej walki w tej serii: dwa chińskie giganty z otwartymi wagami, oba rozbudowane, oba dokładne, oba wolne. Kimi K3 wygrywa tę rundę, ponieważ zdobywa to, co decyduje o adopcji — audytowany ranking #3, koronę frontendu Arena, opublikowaną cenę i gotowe wagi — i pokonało Qwena 80 do 83 w jedynym bezpośrednim porównaniu. Ale to bezpośrednie porównanie pokazuje również, dlaczego warto obserwować Qwena 3.8: był to bardziej skrupulatny model, cytujący więcej bazy kodu, używający mniej zapytań i nie popełniający żadnych nieudanych wywołań narzędzi. Jeśli twoja praca nagradza wyczerpującą eksplorację, a Alibaba udostępni wagi, a niezależny wynik znajdzie się blisko szczytu, ta rywalizacja może się odwrócić. Do tego czasu Kimi K3 jest bezpieczniejszym wyborem z otwartymi wagami, a Qwen 3.8 to pretendent, którego warto przetestować na własnych promptach.

