Nex-N2.5 Pro vs GLM-5.2-hero — een gegenereerde titelkaart met de tekst 'Nex-N2.5 Pro vs GLM-5.2', met de ondertitel 'Twee open-weights-agentische modellen, één verdacht toeval op 82,7' en een bovenregel 'Nex-AGI vs Z.ai — september 2026'.
Guides & Insights

Nex-N2.5 Pro vs GLM-5.2: dezelfde 82,7 op Terminal-Bench, twee zeer verschillende herkomsten.

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Twee agentische modellen met open gewichten, één verdachte toevalligheid: Nex-N2.5 Pro en GLM-5.2 komen op Terminal-Bench 2.1 allebei uit op 82,7. Nex-AGI vermeldt op de eigen modelkaart 82,7 voor Nex-N2.5 Pro, gemeten met de eigen NexCUA-harness van de alliantie, die het publiek niet heeft gezien. De beste door Z.ai gerapporteerde score voor GLM-5.2 op dezelfde suite is eveneens 82,7 — en toen een onafhankelijke harness het model opnieuw draaide, kwam het uit op 77,9, ongeveer vijf punten onder het eigen cijfer van de leverancier. Een perfecte gelijke stand tussen een getal dat niemand kan controleren en een getal dat al was geslonken zodra het gecontroleerd werd, is helemaal geen gelijke stand. Het is de duidelijkst mogelijke demonstratie van waarom het verschil tussen 'open gewichten' en 'gewichten die uiteindelijk ooit zullen komen' deze wedstrijd beslist voordat er ook maar één benchmarkrij is gelezen.

Beide modellen bevinden zich in hetzelfde commerciële segment en zouden qua aard niet verder uit elkaar kunnen liggen. Nex-N2.5 Pro, aangekondigd op 8 september 2026, is een multimodaal computergebruiksmodel — 397 miljard parameters in totaal met ongeveer 17 miljard actieve parameters, voortgekomen uit de Qwen3.5-lijn, ontworpen om een scherm te lezen en een browser- of desktop-sessie aan te sturen via een visuele feedbackloop. GLM-5.2 is Z.ai's (Zhipu AI's) vlaggenschip met MIT-licentie voor langdurig redeneren en coderen — ongeveer 743 miljard parameters in totaal met circa 40 miljard actieve parameters, uitsluitend tekstgebaseerd, algemeen beschikbaar sinds 16 juni 2026, en het model dat maandenlang de onafhankelijke scores in de open-gewichten-categorie heeft verankerd. Het ene kijkt naar de wereld door pixels en handelt daarnaar. Het andere denkt in tekst en levert code op. De licentie van beide stelt dat je er een bedrijf op kunt bouwen; het verschil is dat die licentie bij een van beide momenteel slechts een belofte is.

Hetzelfde nummer, twee verschillende herkomsten.

Start with the tie, because it teaches the whole matchup. Nex-AGI's card lists Terminal-Bench 2.1 at 82.7 for Nex-N2.5 Pro, alongside OSWorld-2 at 56.4, SWE-Bench Pro at 61.2 and BrowseComp at 89.7 — every one of them produced through the NexCUA harness and none independently reproduced in the first days of the model's life, for the simple reason that the weights are not downloadable. Z.ai's figure of 82.7 for GLM-5.2 on Terminal-Bench 2.1 is the vendor's own best-reported number, but it sits on a model anyone can pull from Hugging Face and re-run this afternoon; the independent harness measurement of 77.9 already exists, and it is roughly five points below Z.ai's claim. When a vendor number shrinks under independent testing, that is not a scandal — it is the normal tax on self-measurement. When a competing vendor number cannot even be tested, the absence of the tax is the problem, not a sign the number is pristine.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GLM-5.2 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; License Apache-2.0 pending; Params 397B / ~17B active; Modality text + image (computer use); Terminal-Bench 2.1 82.7 vendor; Price free hosted / no list. Right column GLM-5.2: GA Jun 16 2026; License MIT live now; Params ~743B / ~40B active; Modality text only; Terminal-Bench 2.1 82.7 claimed / 77.9 independent; Price $1.40 / $4.40 per 1M. Footer: 'Nex and Z.ai figures vendor-reported; 77.9 per the OrcaRouter harness.'

Lees de omringende rijen op dezelfde manier. GLM-5.2 heeft de hoogste onafhankelijke indexscore die de open categorie heeft opgeleverd — in de lage vijftig op de huidige Intelligence Index van Artificial Analysis — en is daardoor al maanden het open referentiemodel, ook al is het niet de opvallendste nieuwe release. Nex-N2.5 Pro heeft geen enkele notering in de onafhankelijke index. Op de rijen waar beide leveranciers cijfers claimen, is het verifieerbare cijfer dat van de gevestigde leverancier; op de rijen waar alleen Nex-AGI cijfers heeft gepubliceerd, zijn die cijfers niet gereproduceerd. Dat is geen oordeel over welk model slimmer is. Het is een oordeel over welk model je mag verifiëren.

De specificatiebladen komen meer overeen dan je zou verwachten.

Strip de benchmarks eraf en de twee modellen liggen dicht bij elkaar op de fundamenten:

Uitgebracht — Nex-N2.5 Pro: 8 september 2026 (gehoste endpoints live, gewichten volgen nog). GLM-5.2: GA 16 juni 2026, gewichten live.

Licentie — Nex-N2.5 Pro: Apache-2.0, gewichten binnenkort beschikbaar. GLM-5.2: MIT, nu te downloaden.

Schaal — Nex-N2.5 Pro: 397B in totaal / ~17B actief. GLM-5.2: ~743B in totaal / ~40B actief.

Modaliteit — Nex-N2.5 Pro: tekst en afbeelding in, tekst uit, computer-use vision loop. GLM-5.2: tekstgebaseerd redeneermodel.

Context / output — Nex-N2.5 Pro: 262,144-token context. GLM-5.2: 1M-token context, 128K output ceiling.

Redeneercontrole — Nex-N2.5 Pro: geen / gemiddeld (adaptief, standaard) / hoog. GLM-5.2: instellingen voor redeneerinspanning op dezelfde modelstring.

Prijs per 1M tokens — Nex-N2.5 Pro: gratis gehoste laag, geen lijstprijs. GLM-5.2: $1,40 input / $4,40 output, $0,26 voor input uit de cache.

De enveloppen verschillen op de manieren waarop de taken van de twee modellen verschillen: GLM-5.2 levert een vol miljoen tokens aan tekstcontext en een uitvoerplafond van 128K voor lange technische sessies, terwijl Nex-N2.5 Pro contextgrootte inruilt voor een visiekanaal en een kleiner 262K-venster dat gericht is op schermgebonden workloads. Geen van beide specificaties is fout; ze zijn gespecificeerd voor verschillende taken.

Open gewichten, twee verschillende betekenissen

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Dit is waar de vergelijking helemaal niet meer over cijfers gaat. GLM-5.2 is open zoals je een product uitbrengt waar je een bedrijf omheen kunt bouwen: MIT-licentie, gewichten op Hugging Face, geen beperking op commercieel gebruik, geen clausule over datadeling, geen leverancier die over je schouder meekijkt. Je kunt het downloaden, fine-tunen, achter je eigen compliance-grens serveren of naar elke host meenemen die je maar wilt — en omdat de gewichten vrij beschikbaar zijn, zit er een bodem onder de prijs die geen enkele leverancier kan verhogen. Voor Nex-N2.5 Pro is Apache-2.0 toegezegd, een even permissieve licentie, maar de banner op zijn Hugging Face-modelkaart zegt dat de gewichten binnenkort beschikbaar komen, en er is geen datum aan verbonden. Voor een team dat onder datagovernance-regels valt, of een team dat op schaal volledig aan per-token-prijzen wil ontsnappen, draait de hele beslissing om dat verschil: GLM-5.2 is een model dat je al vandaag kunt bezitten, en Nex-N2.5 Pro is een model dat je is beloofd. De rekensom voor self-hosting valt ook gunstig uit voor de nieuwkomer wanneer de gewichten eindelijk landen — 17B actieve parameters op een node met acht H100's is een veel toegankelijkere footprint dan de ~40B-actieve box van GLM-5.2 — maar "wanneer de gewichten landen" moet in die zin heel wat werk verzetten.

De gezinnen verhuizen in tegengestelde richtingen.

Beide modellen zitten in snel evoluerende families, en de trajecten trekken in verschillende richtingen. De afstammingslijn van GLM-5.2 is transparant en iteratief: Z.ai bracht GLM-5.3 in augustus uit als een post-training-refresh van dezelfde 5.2-basis en GLM-5.3 Flash begin september, dus de 5.2-gewichten waarop je vandaag bouwt, vormen de fundering die de familie blijft verbeteren — je architectuurkennis en je fine-tunes worden meegenomen. De familie van Nex-AGI is een gok op een gloednieuwe generatie: Nex-N2.5 Mini met 35B, Nex-N2.5 Pro met 397B, en een tekst-only Nex-N2.5 Max met 1.6T waarvan de eigen basis DeepSeek-V4-Pro-Base is, terwijl de Pro-gewichten waarmee iedereen de claims van de familie zou kunnen valideren nog niet zijn gepubliceerd. Een team dat een platform kiest om op te bouwen, kiest tussen een afstammingslijn met een gepubliceerde roadmap van refreshes en een eerste release waarvan het tweede bedrijf nog niet is gearriveerd.

Welke verdient een plek in jouw build?

Als uw vereiste luidt: "het model moet van ons zijn" — voor datagovernance, voor audits, voor een product waarbij u niet wilt dat één enkele leverancier de controle heeft — dan is GLM-5.2 in deze vergelijking niet de betere keuze; het is de enige keuze, want het is het enige model in deze vergelijking dat u kunt downloaden. Het is ook het enige model met een onafhankelijke score, en volgens de prijslijst van Z.ai kost het $1,40 per miljoen inputtokens en $4,40 per miljoen outputtokens. Als uw vereiste een multimodale computeragent is die de gesloten koplopers uiteindelijk zou kunnen onderbieden, dan is Nex-N2.5 Pro de interessantere langetermijnthese — een vision-operator met 17B actieve parameters van een alliantie die duidelijk weet wat ze wil bouwen — maar een these is geen afhankelijkheid, en een gratis gehost eindpunt is geen fundament.

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), marked FEATURED, showing the header stats $1.40 input and $4.40 output per million tokens and the byline 'by Z.ai - 2026-06-16'.

De praktische manier om op dit alles in te spelen is voort te bouwen op wat er al is en de belofte te meten wanneer die uitkomt. GLM-5.2 staat op OrcaRouter tegen de lijstprijs van Z.ai — dezelfde $1.40 / $4.40, zonder opslag doorberekend — en omdat het een open-weightsmodel is, is het ook zelf te hosten als je wilt dat de meting je eigen serving-stack omvat. Het is vandaag het referentiepunt waartegen je je daadwerkelijke agentische workload laat draaien, met de routing-DSL als tijdelijke vervanger in afwachting van de dag dat Nex-N2.5 Pro tegen de lijstprijs bij een provider verschijnt: wanneer dat gebeurt, is het omzetten van de vergelijking een routeringsregel, geen migratie. Totdat de shards vrijkomen en een onafhankelijke testopstelling de 82.7 bevestigt — of corrigeert —, is Nex-N2.5 Pro vs GLM-5.2 een duel tussen een model dat je kunt verifiëren en een getal dat je niet kunt.