
DeepSeek V4 Pro vs Qwen3.8 Max: Specjalista od rozumowania vs chiński uniwersalista
- AlibabaNOWOŚĆQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiNOWOŚĆZ.ai: GLM 5.3 Flash2026-08-2658Inteligencja72Kod
- DeepSeekNOWOŚĆDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1860Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1552Inteligencja68Kod
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1261Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0557Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencja69Kod
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencja49Kod
- metaMeta: Muse Spark 1.12026-07-1653Inteligencja71Kod
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencja76Kod
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencja71Kod
W odstępie dziesięciu dni zadebiutowały dwie najbardziej obserwowane w Chinach modele: Alibaba wypuścił Qwen3.8 Max 3 sierpnia 2026 roku — sztandarowy model sparse-MoE o 2,4 biliona parametrów, który producent przedstawia jako wszechstronny do agentów, pracy biurowej i rozumienia multimodalnego — a DeepSeek udostępnił oficjalną wersję DeepSeek V4 Pro 12 sierpnia, swojego specjalistę od rozumowania i kodowania z łączną liczbą 1,6 biliona parametrów i ceną za tokeny wyjściowe wynoszącą około jednej siódmej ceny Qwen. Oba modele celują w te same portfele programistów, ale różnią się co do tego, do czego ma służyć flagowy model. Qwen3.8 Max chce być tym jednym modelem, przez który przepuszczasz wszystko; DeepSeek V4 Pro chce być tym, do którego kierujesz najtrudniejsze zadania.

Najważniejsze wnioski
• Qwen3.8 Max to model o wyższych surowych możliwościach na chińskich ogólnych rankingach (SuperCLUE #1, lipiec) oraz mocniejszy pakiet multimodalny/korporacyjny — wejście wideo, wbudowane narzędzia, ustrukturyzowane wyniki, wszystko w jednym API.
• DeepSeek V4 Pro jest dramatycznie tańszy (~7× na wyjściu), ma już otwarte wagi i obecnie utrzymuje wyższe wyniki w zadaniach kodowania/agentowych — Terminal-Bench 2.1 na poziomie 87,9 wobec deklarowanych przez producenta 86,6 dla modelu Qwen.
• Uważaj na koszt rozwlekłości: niezależne testy pokazują, że Qwen3.8 Max osiąga średnio ~64 kroki i ~1,14 USD za zadanie agentowe — to problem efektywnego kosztu, który specyfikacja ukrywa.
Uczciwy nagłówek: Qwen3.8 Max to flagowy model w „wojnie możliwości", który dorównuje cenom zamkniętych modeli amerykańskich; DeepSeek V4 Pro to kontrargument w kwestii stosunku jakości do ceny.
Dwie filozofie w jednej tabeli specyfikacji
• Łączne parametry — Qwen3.8 Max 2.4T (rzadki MoE, ~95B aktywnych) vs DeepSeek V4 Pro 1.6T (MoE, ~49B aktywnych)
• Kontekst / maksymalne wyjście — oba mają 1M kontekstu; Qwen osiąga maksymalnie około 128–131K wyjścia, a DeepSeek 384K
• Wejścia — Qwen obsługuje tekst, obraz i wideo; DeepSeek V4 Pro obsługuje tekst i obraz, z nowym natywnym wnioskowaniem obrazowym w oficjalnej wersji.
• Otwarte wagi — DeepSeek V4 Pro: wydany (MIT); Qwen3.8 Max: zapowiedziany na tydzień od 10 sierpnia, pierwszy w historii model Qwen klasy Max udostępniony jako open-source.
• Dodatki API — Qwen oferuje wbudowane narzędzia i ustrukturyzowane dane wyjściowe w standardzie; DeepSeek V4 Pro oferuje przełączniki myślenia, ustrukturyzowany JSON, API Responses i zgodność z Codex
• Cena — Qwen3.8 Max 2,00 USD / 6,00 USD za milion tokenów (0,25 USD z pamięci podręcznej) vs DeepSeek V4 Pro ~0,42 USD / 0,87 USD (0,0035 USD z pamięci podręcznej)

Gdzie Qwen3.8 Max wygrywa
Na osi ogólnej Qwen3.8 Max prowadzi i niezależne dane to potwierdzają. Artificial Analysis ocenia go na 58 punktów w indeksie inteligencji, 71,8 w indeksie kodowania i 58 w indeksie agentowym — to najlepszy wynik, jaki jakiekolwiek chińskie laboratorium osiągnęło w czołówce tego rankingu agentowego. W lipcowym rankingu chińskojęzycznym SuperCLUE zajmuje #1 z wynikiem 71,48, podczas gdy DeepSeek-V4-Pro jest #5 z 64,4. Demo startowe Alibaby — 16-dniowa autonomiczna sesja kodowania, odtworzenie artykułu naukowego, które pobiło wynik AIME24 z oryginalnej publikacji — to najmocniejszy dowód w całym cyklu wydawniczym, że jest to naprawdę wydajny agent o długim horyzoncie.
Dla dewelopera praktyczne korzyści mają charakter integracyjny: wejście wideo, wbudowane wywoływanie narzędzi, ustrukturyzowane dane wyjściowe bez konfiguracji oraz ekosystem (Model Studio, zestaw narzędzi Qwen), którego DeepSeek nie stara się dorównać. Jeśli obciążenie jest oparte na dokumentach, multimodalne lub wymaga integracji na poziomie przedsiębiorstwa, Qwen3.8 Max jest modelem, na który chiński rynek obecnie się decyduje.
Gdzie DeepSeek V4 Pro wygrywa
W kwestii kodowania i kosztów, oficjalny V4 Pro jest odpowiedzią. DeepSeek podaje, że oficjalna wersja uzyskuje 87.9 w Terminal-Bench 2.1 (wzrost z 72.1 w wersji preview) oraz 62.7 w DeepSWE — wobec deklarowanych przez Qwen 86.6 w Terminal-Bench. Wersja preview miała już 80.6 SWE-bench Verified, 90.1 GPQA Diamond i 93.5 LiveCodeBench, co jest najlepszym wynikiem w programowaniu konkurencyjnym wśród modeli open-source, a zmiany w oficjalnej wersji są skoncentrowane dokładnie na zadaniach agentowych i rozumowania, z których pochodzą te liczby.
Następnie jest kwestia ceny. Przy 0,42/0,87 USD za milion tokenów DeepSeek V4 Pro jest około 4,8× tańszy na wejściu i 6,9× tańszy na wyjściu niż Qwen3.8 Max za 2/6 USD. DeepSeek zasygnalizował również 6 sierpnia, że nadchodzi podwyżka cen, co czyni dzisiejszą stawkę oknem, a nie obietnicą — więcej o tym poniżej.

Wykonaj obliczenia na prawdziwym zadaniu agentowym.
Niezależne uruchomienia agentów to moment, w którym cena katalogowa Qwen przestaje być rzeczywistą ceną. W zadaniach agentowych Artificial Analysis Qwen3.8 Max osiągał średnio ~64 tury na zadanie i kosztował ~1,14 USD za zadanie, wobec ~0,53 USD dla poprzedniej generacji — model jest rozwlekły i dużo planuje. Uruchom ten sam typ zadania na DeepSeek V4 Pro przy 0,87 USD za milion tokenów wyjściowych, a koszt na zadanie będzie o około rząd wielkości niższy. Jeśli Twój produkt to pętla, która wywołuje model sto razy dziennie na użytkownika, to ta różnica jest Twoją marżą.
Zastrzeżenia dotyczące niezawodności po obu stronach
Uczciwość w pozyskiwaniu danych działa tu w obie strony. Niezależne testy wykazały, że wskaźnik halucynacji Qwen3.8 Max wzrósł z 23% do 40%, a wynik AA-Omniscience spadł o dziesięć punktów — model stał się bardziej wydajny, ale mniej godny zaufania w tej samej wersji. Wersja zapoznawcza DeepSeek miała udokumentowany 94% wskaźnik udzielania odpowiedzi w AA-Omniscience, co oznacza, że zwykle generuje odpowiedź, niezależnie od tego, czy ją zna. Obie kwestie mają znaczenie dla produkcji; żadna nie dyskwalifikuje modeli w zadaniach, do których są przeznaczone.
Dlaczego moment udostępnienia otwartych wag zmienia matematykę ceny.
Premiera Qwen3.8 Max z otwartymi wagami, gdy już nastąpi, w ciągu tygodnia zmieni ekonomikę tego pojedynku — self-hosterzy zyskają flagowca z 2.4T parametrów, a presja cenowa na API będzie realna. To dokładnie scenariusz, w którym model wyceny pass-through trzyma cię w ryzach. OrcaRouter przekazuje cenę cennikową dostawcy z zerową marżą, więc w chwili, gdy Alibaba lub DeepSeek zmieni cenę — w górę lub w dół — zmiana tego samego dnia jest aktywna na jednym kluczu, bez renegocjacji i bez czytania drugiej umowy. Kierujesz ruch do tego z Qwen3.8 Max lub DeepSeek V4 Pro, który preferuje Twoja bieżąca ewaluacja, a cena pozostaje dokładnie taka, jaką faktycznie nalicza dostawca.
Który z nich przy wyborze kreatora API?
Wybierz Qwen3.8 Max, gdy zadanie wymaga pełnego spektrum — wejścia multimodalnego, wyjścia strukturalnego, wbudowanych narzędzi, jakości w języku chińskim na szczycie obecnych rankingów — a Twój model kosztów toleruje rozwlekłe przebiegi agentowe. Wybierz DeepSeek V4 Pro, gdy zadanie opiera się głównie na rozumowaniu lub kodowaniu, wolumen tokenów jest wysoki, otwarte wagi mają znaczenie dla zgodności lub samodzielnego hostingu, albo gdy to budżet jest wiążącym ograniczeniem. Najbardziej naturalne odczytanie tego pojedynku to takie, które sygnalizują same firmy: Qwen3.8 Max to flagowiec, względem którego mierzysz wszystko, a DeepSeek V4 Pro to ten, który sprawia, że benchmark wygląda na drogi.
Porównane w tym artykule2
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
