Hero Nex-N2.5 Pro vs DeepSeek V4 Pro — wygenerowana karta tytułowa z napisem „Nex-N2.5 Pro vs DeepSeek V4 Pro”, podtytułem „Dwa open-weights typy — jeden do pobrania już dziś, drugi oznaczony jako wkrótce” i nadtytułem „Nex-AGI vs DeepSeek — wrzesień 2026”.
Guides & Insights

Nex-N2.5 Pro kontra DeepSeek V4 Pro: Tylko jeden zestaw tych otwartych wag jest faktycznie otwarty

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Oto rodzinny sekret, który sprawia, że to zestawienie jest dziwniejsze, niż się wydaje: Nex-N2.5 Max, model Nex-AGI z najwyższego szczebla rodziny obejmującej Nex-N2.5 Pro, sam został dotrenowany na bazie DeepSeek-V4-Pro-Base. Notatki wydania z 8 września otwarcie podają, że Mini i Pro są zbudowane na wariantach Qwen3.5, a tekstowy Max 1.6T stoi na otwartej bazie, którą DeepSeek opublikował w sierpniu. Zatem gdy Nex-N2.5 Pro porównuje się z DeepSeek V4 Pro, czytelnik patrzy, jak jeden projekt modeli otwartych pożycza fundament drugiego dla swojego flagowego szczebla, a następnie próbuje prześcignąć dawcę na szczeblu niższym. To nie obelga; tak działa ekonomia otwartych wag — i jest to najbardziej uczciwe możliwe ramy porównania, w którym oba modele są na otwartych licencjach, a tylko jeden z nich można dziś faktycznie pobrać.

Asymetria jest tu sednem sprawy. DeepSeek V4 Pro — build 0813, który 13 sierpnia osiągnął ogólną dostępność (GA) — ma teraz na Hugging Face wagi na licencji MIT. To duży model mixture-of-experts z około 1,6 biliona parametrów łącznie, z czego aktywnych jest około 49 miliardów, z kontekstem 1 miliona tokenów, limitem 384 tysięcy tokenów odpowiedzi i oficjalnym API. Nex-N2.5 Pro, ogłoszony 8 września, to rzadki model MoE (sparse MoE) o 397 miliardach parametrów, z czego aktywnych jest około 17 miliardów. Jest multimodalny, podczas gdy DeepSeek obsługuje wyłącznie tekst, i jest ukierunkowany na agentów sterujących komputerem, a nie na uniwersalne korzystanie z narzędzi. Jego karta na Hugging Face wciąż informuje, że wagi wkrótce zostaną udostępnione na licencji Apache-2.0, bez podanej daty, a na razie model jest serwowany wyłącznie przez bezpłatne hostowane endpointy. To samo filozoficzne zobowiązanie do otwartych wag. Zupełnie inny stan dostarczenia.

Dwie licencje, jeden zestaw wag faktycznie wydany

Kontrast licencyjny jest mniej istotny niż kontrast w sposobie dystrybucji, ale to on wyznacza warunki. DeepSeek V4 Pro jest na licencji MIT — możesz pobrać shardy już dziś, serwować je samodzielnie, dostroić je i zbudować na nich biznes bez pytania kogokolwiek o pozwolenie, a ponieważ wagi są publicznie dostępne, żaden pojedynczy podmiot nie kontroluje ceny. Nex-N2.5 Pro jest obiecany na Apache-2.0, równie permisywnej licencji wybranej przez sojusz, ale baner na karcie jest jednoznaczny: wagi nie są do pobrania i nie podano żadnej daty. Dla zespołu, którego wymogiem jest „model musi być nasz”, to zestawienie obecnie nie jest żadną konkurencją — DeepSeek V4 Pro to jedyny kandydat, którego możesz faktycznie posiadać. Praktyczne zastrzeżenie działa w obie strony: samodzielne hostowanie ~1.6T MoE to poważna infrastruktura, więc dla większości zespołów licencja MIT ma mniejsze znaczenie jako plan hostingu, a większe jako gwarancja ochrony przed uzależnieniem i punkt odniesienia dla cen. Nex-N2.5 Pro, gdy jego shardy w końcu się pojawią, będzie konstrukcją bardziej przyjazną do samodzielnego hostowania — 17B aktywnych parametrów na węźle z ośmioma H100 to znacznie mniejsza jednostka niż referencyjna infrastruktura DeepSeeka.

Wiersze, w których te dwa się różnią

Zestawione obok siebie, te dwa modele ledwo się pokrywają pod względem tego, do czego służą:

Wydano — Nex-N2.5 Pro: 8 września 2026 r. (hostowane punkty końcowe aktywne, wagi w przygotowaniu). DeepSeek V4 Pro: 13 sierpnia 2026 r. (wersja GA 0813), wagi dostępne.

Scale — Nex-N2.5 Pro: 397B łącznie / ~17B aktywnych. DeepSeek V4 Pro: ~1.6T łącznie / ~49B aktywnych.

Modalność — Nex-N2.5 Pro: wejście tekstowe i obrazowe, wyjście tekstowe; przystosowany do obsługi komputera przez odczyt ekranu. DeepSeek V4 Pro: w publicznym API tylko tekst — bez natywnego widzenia oraz wejścia obrazu i dźwięku.

Kontekst / wyjście — Nex-N2.5 Pro: kontekst 262 144 tokenów. DeepSeek V4 Pro: kontekst 1M tokenów, do 384K tokenów wyjściowych.

Kontrola rozumowania — Nex-N2.5 Pro: brak / średni (adaptacyjny, domyślny) / wysoki. DeepSeek V4 Pro: niski / wysoki / maksymalny wysiłek rozumowania przy tym samym ciągu modelu.

Wagi — Nex-N2.5 Pro: Apache-2.0, dostępne wkrótce. DeepSeek V4 Pro: MIT, do pobrania już teraz.

Zakres API — Nex-N2.5 Pro: wywołania czatu zgodne z OpenAI na bezpłatnych hostowanych punktach końcowych. DeepSeek V4 Pro: natywny interfejs OpenAI Responses API oraz punkty końcowe zgodne z Anthropic, wywołania narzędzi i wyjście JSON.

Dwa naprawdę różne produkty mają wspólne słowo „open”. Nex-N2.5 Pro jest stworzony do patrzenia na ekran i sterowania nim; DeepSeek V4 Pro jest stworzony do myślenia, pisania kodu i wywoływania narzędzi — różnica między operatorem a analitykiem.

A two-column scoreboard titled 'Nex-N2.5 Pro vs DeepSeek V4 Pro — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; Params 397B / ~17B active; Modality text + image; Context 262,144; Weights Apache-2.0 pending; Price free hosted / no list. Right column DeepSeek V4 Pro: GA Aug 13 2026 (0813); Params 1.6T / ~49B active; Modality text only; Context 1M / 384K output; Weights MIT live now; Price $0.44 / $0.88 flat route. Footer: 'Nex scores vendor-reported via NexCUA; DeepSeek price is the OrcaRouter-listed provider route.'

Co jest mierzone, a co pożyczone

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Obraz benchmarków jest równie nierówny, jak obraz dostępności. DeepSeek V4 Pro ma wymierną, niezależną obecność: wpis w indeksie Artificial Analysis Intelligence Index, tygodnie ruchu medialnego i produkcyjnego od czasu GA 0813 oraz podawane przez producenta wyniki dotyczące kodowania — Terminal-Bench 2.1: 87,9 i DeepSWE: 62,7 według raportów samego DeepSeeka — które przynajmniej odnoszą się do modelu, który każdy może pobrać i uruchomić ponownie. Nex-N2.5 Pro nie ma nic z tego. Jego flagowe wyniki — OSWorld-2: 56,4, Terminal-Bench 2.1: 82,7, SWE-Bench Pro: 61,2, BrowseComp: 89,7 — to wyłącznie własne pomiary Nex-AGI wykonane za pomocą jego harnessu NexCUA, który sojusz zamierza udostępnić jako open source, ale jak dotąd tego nie zrobił. W pierwszych 48 godzinach po premierze żadne niezależne laboratorium nie uruchomiło Nex-N2.5 Pro, ponieważ nikt spoza sojuszu nie może tego zrobić.

Przeczytaj oba zestawy twierdzeń obok siebie, a uczciwy wniosek nie brzmi: „DeepSeek jest mądrzejszy". Brzmi: „Liczby DeepSeeka można sprawdzić, a liczby Nex-N2.5 Pro — nie." Tam, gdzie arkusze obu producentów się pokrywają — Terminal-Bench 2.1 — DeepSeek twierdzi, że ma 87,9, podczas gdy Nex-N2.5 Pro ma 82,7; to pięciopunktowa przewaga na korzyść modelu już dostępnego na rynku, czyli dokładnie ten kierunek, jakiego powinien oczekiwać ostrożny czytelnik: model, który został wydany, osiąga wyższy wynik we wspólnym wierszu niż ten, który nie został.

Cena: liczba rzeczywista, liczba zaplanowana i żadna liczba

Cennik DeepSeek V4 Pro nie jest jedną liczbą, co samo w sobie jest historią. W momencie wydania GA 0813 oficjalne API podawało 0,435 USD za milion tokenów wejściowych i 0,87 USD za milion tokenów wyjściowych; 16 sierpnia DeepSeek przeniósł rodzinę modeli V4 na cennik ze stawkami szczytowymi i pozaszczytowymi, więc oficjalne API pobiera obecnie poza szczytem 0,66 USD za wejście i 1,98 USD za wyjście, a w szczycie odpowiednio 1,32 USD i 3,96 USD; wejście z pamięci podręcznej kosztuje 0,022 USD poza szczytem i 0,044 USD w szczycie. W zależności od tego, o której porze wywołujesz DeepSeek bezpośrednio, ten sam model kosztuje od około 50% więcej do 4,5-krotności stawki startowej. Trasa też ma znaczenie: strona modelu OrcaRouter dla DeepSeek V4 Pro podaje obecnie stałą stawkę 0,44 USD za wejście / 0,88 USD za wyjście za milion — stawkę dostawcy przekazaną dalej bez marży — która jest niższa nawet od oficjalnych stawek pozaszczytowych. Ta trasa ze stałą stawką to cena, którą trzeba pobić, jeśli porównujesz koszt na token; to zarazem liczba, która istnieje tylko dlatego, że warstwa routingu pokazuje prawdziwą stawkę dostawcy, a nie stawkę z doliczonym narzutem.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro) showing the header stats $0.44 input and $0.88 output per million tokens, a 1M-token context note, and the byline 'by DeepSeek - 2026-04-24'.

Nex-N2.5 Pro nie ma ceny, którą można by wpisać przy żadnej z tych pozycji. Jego wariant hostowany jest darmowy, a Nex-AGI nie opublikowało żadnej płatnej stawki za token dla tej rodziny modeli, więc ekonomika modelu jest po prostu nieznana — darmowe endpointy dowodzą tylko, że build działa, nic więcej. Jeśli wagi zostaną udostępnione i jakiś dostawca zacznie oferować Nex-N2.5 Pro po cenie katalogowej, uczciwe porównanie stanie się możliwe; do tego czasu „free” to mechanika podglądu, a nie sygnał rynkowy.

Dwa różne rodzaje agentów

Wybór między tymi dwoma to wybór między dwiema pracami, a nie dwoma wynikami. Nex-N2.5 Pro jest dla agenta, który obsługuje komputer: czyta ekran, przesuwa kursor, edytuje plik, sprawdza wynik wizualny i działa dalej — zademonstrowana sesja 468 akcji w Pokemon Platinum jest ucieleśnieniem tej ambicji. DeepSeek V4 Pro jest dla agenta, który obsługuje API: rozumuje, pisze kod w wielu plikach, wywołuje narzędzia i generuje długie, strukturalne wyjście — wszystko za pośrednictwem kanału tekstowego, któremu służą jego pułap wyjściowy 384K i kontekst 1M. Zespół budujący automatyzację przeglądarki powinien obserwować Nex-N2.5 Pro. Zespół tworzący agenta do kodowania lub pracy opartej na wiedzy powinien porównywać DeepSeek V4 Pro z zamkniętą czołówką, a Nex-N2.5 Pro nie jest jeszcze kandydatem do tego zadania — nie może usunąć obrazu z pętli, a jego deklaracje dotyczące kodowania są zarówno niższe, jak i mniej zweryfikowane niż w przypadku modelu, z którym jest porównywany.

Werdykt: poczekaj na jedno, zbuduj drugie.

DeepSeek V4 Pro to dziś jedyny racjonalny cel budowy w tym zestawieniu. Jego wagi można pobrać, cena jest znana — i przez trasę OrcaRouter o stałej stawce jest niższa niż w godzinach szczytu u samego DeepSeek — a jego deklaracje każdy może zweryfikować w jedno popołudnie. To także naturalny punkt wyjścia do zmierzenia, ile będzie kosztować otwarte computer-use: skieruj ruch jego agenta kodującego przez OrcaRouter z automatycznym failoverem wokół oficjalnego limitu ~500 równoczesnych połączeń API, a otrzymasz działający punkt odniesienia open-weights w realnej cenie. Nex-N2.5 Pro to ciekawszy zakład długoterminowy właśnie dlatego, że to konstrukcja bardziej wyspecjalizowana — multimodalny operator z 17B aktywnych parametrów, który mógłby podciąć liderów zamkniętego computer-use tak, jak DeepSeek podciął zamkniętych generalistów — ale darmowy endpoint, którego nie można zweryfikować, nie jest fundamentem. Gdy pojawią się shardy Apache-2.0, a niezależny harness uzyska ten wynik OSWorld-2, to zestawienie zmieni się z dnia na dzień. Do tego czasu to porównanie modelu, który można posiadać, z modelem, który można jedynie obserwować.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie