Nex-N2.5 Pro vs GLM-5.2 hero — wygenerowana plansza tytułowa z napisem 'Nex-N2.5 Pro vs GLM-5.2', podtytułem 'Dwa modele agentowe o otwartych wagach, jedna podejrzana zbieżność na poziomie 82.7' oraz nadtytułem 'Nex-AGI vs Z.ai — wrzesień 2026'.
Guides & Insights

Nex-N2.5 Pro kontra GLM-5.2: Te same 82.7 w Terminal-Bench, dwa bardzo różne pochodzenia

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Dwa modele agentowe o otwartych wagach, jeden podejrzany zbieg okoliczności: Nex-N2.5 Pro i GLM-5.2 oba osiągają 82.7 w Terminal-Bench 2.1. Nex-AGI podaje 82.7 dla Nex-N2.5 Pro na własnej karcie modelu, wynik zmierzony na własnym harnessie NexCUA sojuszu, którego publiczność nie widziała. Najlepszy raportowany wynik Z.ai dla GLM-5.2 w tym samym zestawie to również 82.7 — a gdy niezależny harness uruchomił ten model ponownie, wynik wyniósł 77.9, czyli około pięć punktów poniżej liczby podanej przez producenta. Idealny remis między liczbą, której nikt nie może sprawdzić, a liczbą, która już się skurczyła, gdy ją sprawdzono, wcale nie jest remisem. To najczystsza możliwa demonstracja tego, dlaczego różnica między „otwartymi wagami” a „wagami, które kiedyś powstaną” przesądza o tym starciu, zanim przeczytany zostanie choćby jeden wiersz benchmarku.

Oba modele działają w tej samej komercyjnej przestrzeni, a jednak nie mogłyby być bardziej różne w samej istocie. Nex-N2.5 Pro, ogłoszony 8 września 2026 r., to wielomodalny model obsługi komputera — łącznie 397 mld parametrów, z czego ok. 17 mld aktywnych, wywodzący się z rodziny Qwen3.5, zaprojektowany tak, by czytać ekran i sterować sesją przeglądarki lub pulpitu w pętli wizualnego sprzężenia zwrotnego. GLM-5.2 to flagowy model Z.ai (Zhipu AI) na licencji MIT, stworzony do długohoryzontowego rozumowania i kodowania — łącznie ok. 743 mld parametrów, z czego ok. 40 mld aktywnych, wyłącznie tekstowy, ogólnodostępny (GA) od 16 czerwca 2026 r. i od miesięcy stanowiący kotwicę niezależnych wyników w warstwie otwartych wag. Jeden patrzy na świat przez piksele i na niego oddziałuje. Drugi myśli w tekście i dostarcza kod. Licencja obu mówi, że można na nich budować biznes; różnica polega na tym, że w przypadku jednego z nich ta licencja jest obecnie obietnicą.

Ta sama liczba, dwa różne pochodzenia.

Zacznijmy od remisu, bo uczy on całego pojedynku. Karta Nex-AGI podaje Terminal-Bench 2.1 na poziomie 82.7 dla Nex-N2.5 Pro, obok OSWorld-2 na 56.4, SWE-Bench Pro na 61.2 i BrowseComp na 89.7 — każdy z nich uzyskano za pomocą środowiska NexCUA i żaden nie został niezależnie odtworzony w pierwszych dniach życia modelu, z prostego powodu: wagi nie są dostępne do pobrania. Wynik Z.ai wynoszący 82.7 dla GLM-5.2 na Terminal-Bench 2.1 to najlepsza opublikowana liczba samego dostawcy, ale dotyczy modelu, który każdy może pobrać z Hugging Face i uruchomić jeszcze dziś po południu; niezależny pomiar w środowisku testowym już istnieje i wynosi 77.9, czyli mniej więcej pięć punktów poniżej deklaracji Z.ai. Gdy liczba dostawcy maleje w niezależnych testach, to nie skandal — to normalny podatek od samodzielnego pomiaru. Gdy liczby konkurencyjnego dostawcy nie można w ogóle przetestować, brak tego podatku jest problemem, a nie oznaką, że liczba jest nieskazitelna.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GLM-5.2 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; License Apache-2.0 pending; Params 397B / ~17B active; Modality text + image (computer use); Terminal-Bench 2.1 82.7 vendor; Price free hosted / no list. Right column GLM-5.2: GA Jun 16 2026; License MIT live now; Params ~743B / ~40B active; Modality text only; Terminal-Bench 2.1 82.7 claimed / 77.9 independent; Price $1.40 / $4.40 per 1M. Footer: 'Nex and Z.ai figures vendor-reported; 77.9 per the OrcaRouter harness.'

Przeczytaj otaczające wiersze w ten sam sposób. GLM-5.2 ma najwyższy niezależny odczyt indeksu, jaki kiedykolwiek uzyskała otwarta warstwa modeli — nieco ponad 50 punktów w obecnym Intelligence Index serwisu Artificial Analysis — dlatego od miesięcy pozostaje referencyjnym otwartym modelem, mimo że nie jest najbardziej efektowną nowością. Nex-N2.5 Pro nie ma żadnego niezależnego wpisu w indeksie. W wierszach, w których obaj dostawcy podają liczby, weryfikowalne są te należące do dotychczasowego lidera; w wierszach, w których publikował tylko Nex-AGI, liczby pozostają niepotwierdzone. To nie jest werdykt o tym, który model jest mądrzejszy. To werdykt o tym, który model możesz zweryfikować.

Arkusze specyfikacji zgadzają się bardziej, niż można by się spodziewać.

Jeśli pominąć benchmarki, oba modele są do siebie bardzo zbliżone pod względem podstaw:

Wydano — Nex-N2.5 Pro: 8 września 2026 (hostowane punkty końcowe aktywne, wagi w przygotowaniu). GLM-5.2: GA 16 czerwca 2026, wagi dostępne.

Licencja — Nex-N2.5 Pro: Apache-2.0, wagi wkrótce dostępne. GLM-5.2: MIT, do pobrania już teraz.

Skala — Nex-N2.5 Pro: 397B łącznie / ~17B aktywnych. GLM-5.2: ~743B łącznie / ~40B aktywnych.

Modalność — Nex-N2.5 Pro: tekst i obraz na wejściu, tekst na wyjściu, pętla wizyjna do obsługi komputera. GLM-5.2: wyłącznie tekstowy model rozumowania.

Kontekst / wyjście — Nex-N2.5 Pro: kontekst 262 144 tokenów. GLM-5.2: kontekst 1M tokenów, limit wyjścia 128K.

Kontrola rozumowania — Nex-N2.5 Pro: brak / średni (adaptacyjny, domyślny) / wysoki. GLM-5.2: kontrola wysiłku rozumowania w tym samym ciągu modelu.

Cena za 1M tokenów — Nex-N2.5 Pro: darmowy poziom hostowany, brak ceny katalogowej. GLM-5.2: $1,40 za wejście / $4,40 za wyjście, $0,26 za wejście z pamięci podręcznej.

Zakresy możliwości różnią się między sobą tak, jak różnią się zadania obu modeli: GLM-5.2 wnosi do długich sesji inżynieryjnych pełny milion tokenów kontekstu tekstowego i górny pułap 128K tokenów na wyjściu, podczas gdy Nex-N2.5 Pro wymienia rozmiar kontekstu na kanał wizyjny i mniejsze okno 262K przeznaczone do obciążeń o rozmiarze ekranu. Żadna ze specyfikacji nie jest błędna – są po prostu dobrane pod różne zadania.

Otwarte wagi, dwa różne znaczenia

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

To jest punkt, w którym to porównanie przestaje mieć cokolwiek wspólnego z liczbami. GLM-5.2 jest otwarty tak, jak wypuszcza się produkt, na którym można zbudować firmę: licencja MIT, wagi na Hugging Face, bez ograniczeń w użyciu komercyjnym, bez klauzuli o udostępnianiu danych, bez dostawcy zaglądającego ci przez ramię. Możesz go pobrać, dostroić, udostępniać za własną granicą zgodności albo przenieść na dowolny hosting — a ponieważ wagi są publiczne, cena ma dolną granicę, której żaden pojedynczy dostawca nie może podbić. Nex-N2.5 Pro ma zostać wydany na równie permisywnej licencji Apache-2.0, ale baner na jego karcie na Hugging Face informuje, że wagi pojawią się wkrótce, i nie podano żadnej daty. Dla zespołu podlegającego reżimowi zarządzania danymi albo takiego, który na dużą skalę chce całkowicie uciec od opłat za token, ta różnica jest sednem całej decyzji: GLM-5.2 to model, który możesz mieć na własność już dziś, a Nex-N2.5 Pro to model, który został ci obiecany. Matematyka samodzielnego hostingu również przemawia na korzyść nowicjusza, gdy wagi w końcu się pojawią — 17B aktywnych parametrów na węźle z ośmioma H100 to znacznie bardziej przystępne wymagania sprzętowe niż ~40B aktywnych parametrów GLM-5.2 — ale to „kiedy wagi w końcu się pojawią” robi w tym zdaniu bardzo dużo pracy.

Rodziny przemieszczają się w przeciwnych kierunkach

Oba modele należą do szybko rozwijających się rodzin, a ich trajektorie biegną w różnych kierunkach. Linia GLM-5.2 jest przejrzysta i iteracyjna: Z.ai wypuściło GLM-5.3 w sierpniu jako potreningowe odświeżenie tej samej bazy 5.2 oraz GLM-5.3 Flash na początku września, więc wagi 5.2, na których budujesz dziś, są fundamentem, który rodzina stale ulepsza — Twoja wiedza o architekturze i Twoje dostrojenia są przenoszone dalej. Rodzina Nex-AGI to zakład na zupełnie nową generację: Nex-N2.5 Mini (35B), Nex-N2.5 Pro (397B) oraz tekstowy Nex-N2.5 Max (1,6T), którego bazą jest DeepSeek-V4-Pro-Base, a wagi Pro, które pozwoliłyby komukolwiek zweryfikować twierdzenia rodziny, wciąż nie zostały opublikowane. Zespół wybierający platformę, na której ma budować, wybiera między linią z opublikowaną mapą drogową odświeżeń a pierwszą wersją, której druga odsłona jeszcze nie nadeszła.

Który z nich zasługuje na miejsce w Twojej kompilacji

Jeśli twoim wymaganiem jest „model musi być nasz” — ze względu na zarządzanie danymi, audyt, produkt, nad którym nie chcesz, by kontrolę sprawował jeden dostawca — to GLM-5.2 nie jest w tym zestawieniu lepszym wyborem; jest jedynym wyborem, ponieważ to jedyny model w tej grupie, który możesz pobrać. Jest też jedynym z niezależną oceną, a jego cena to 1,40 USD za milion tokenów wejściowych i 4,40 USD za milion tokenów wyjściowych w cenniku Z.ai. Jeśli twoim wymaganiem jest multimodalny agent obsługi komputera, który mógłby ostatecznie podciąć zamkniętych liderów, Nex-N2.5 Pro to bardziej interesująca teza długoterminowa — operator wizyjny z 17B aktywnymi parametrami od sojuszu, który wyraźnie wie, co chce zbudować — ale teza to nie zależność, a darmowy hostowany endpoint to nie fundament.

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), marked FEATURED, showing the header stats $1.40 input and $4.40 output per million tokens and the byline 'by Z.ai - 2026-06-16'.

Praktyczne podejście do całej tej sprawy to budować na tym, co już istnieje, i zmierzyć obietnicę, gdy w końcu się zmaterializuje. GLM-5.2 jest na OrcaRouter w cenniku Z.ai — te same $1.40 / $4.40, bez żadnej marży — a dzięki otwartym wagom można go też uruchomić u siebie, jeśli chcesz, żeby pomiar obejmował Twój własny stack serwujący. To punkt odniesienia, na którym można już dziś uruchomić swoje rzeczywiste obciążenie agentowe, a routingowy DSL pełni tę rolę do dnia, w którym Nex-N2.5 Pro pojawi się u dostawcy w cenie katalogowej: gdy to nastąpi, przełączenie porównania to nowa reguła routingu, a nie migracja. Dopóki nie pojawią się shardy i niezależny harness nie potwierdzi — lub nie skoryguje — tej 82,7, Nex-N2.5 Pro vs GLM-5.2 to starcie modelu, który można zweryfikować, z liczbą, której nie można.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie