Hero för 'Nex-N2.5 Pro vs GLM-5.2' – ett genererat titelkort med texten 'Nex-N2.5 Pro vs GLM-5.2', undertexten 'Två agentiska modeller med öppna vikter, ett misstänkt sammanträffande vid 82,7' och en övertext 'Nex-AGI vs Z.ai – september 2026'.
Guides & Insights

Nex-N2.5 Pro vs GLM-5.2: Samma 82.7 på Terminal-Bench, två mycket olika ursprung

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Två agentiska modeller med öppna vikter, en misstänkt slump: Nex-N2.5 Pro och GLM-5.2 når båda 82,7 på Terminal-Bench 2.1. Nex-AGI anger 82,7 för Nex-N2.5 Pro på sitt eget modellkort, mätt med alliansens egen NexCUA-harness, som allmänheten inte har sett. Z.ai:s bästa rapporterade siffra för GLM-5.2 på samma testsvit är också 82,7 – och när en oberoende harness körde om modellen hamnade den på 77,9, ungefär fem poäng under leverantörens egen siffra. En perfekt oavgjord match mellan en siffra som ingen kan kontrollera och en siffra som redan krympte när den kontrollerades är inte alls oavgjord. Det är den tydligaste möjliga demonstrationen av varför skillnaden mellan "öppna vikter" och "vikter som kommer att finnas så småningom" avgör den här uppgörelsen innan en enda benchmarkrad har lästs.

Båda modellerna befinner sig i samma kommersiella område och kunde inte vara mer olika till sin natur. Nex-N2.5 Pro, som tillkännagavs den 8 september 2026, är en multimodal datoranvändningsmodell – 397 miljarder parametrar totalt med cirka 17 miljarder aktiva, baserad på Qwen3.5-linjen, utformad för att läsa en skärm och styra en webbläsar- eller skrivbordssession med en visuell återkopplingsslinga. GLM-5.2 är Z.ai:s (Zhipu AI:s) MIT-licensierade flaggskepp för långsiktigt resonerande och kodning – cirka 743 miljarder parametrar totalt med ungefär 40 miljarder aktiva, endast text, allmänt tillgänglig sedan den 16 juni 2026, och den modell som i månader har varit ankaret för de oberoende poängen i segmentet med öppna vikter. Den ena ser på världen genom pixlar och agerar på den. Den andra tänker i text och levererar kod. Licensen för båda säger att man kan bygga en verksamhet på dem; skillnaden är att för en av dem är den licensen för närvarande ett löfte.

Samma nummer, två olika ursprung

Börja med det oavgjorda resultatet, eftersom det säger allt om hela uppgörelsen. Nex-AGI:s modellkort listar Terminal-Bench 2.1 på 82,7 för Nex-N2.5 Pro, tillsammans med OSWorld-2 på 56,4, SWE-Bench Pro på 61,2 och BrowseComp på 89,7 — alla framtagna via NexCUA:s testmiljö och ingen oberoende reproducerad under modellens första dagar, av det enkla skälet att vikterna inte går att ladda ner. Z.ai:s siffra för GLM-5.2 på Terminal-Bench 2.1, 82,7, är det bästa värde som leverantören själv rapporterat för modellen, men den gäller en modell som vem som helst kan hämta från Hugging Face och köra om redan i eftermiddag; den oberoende mätningen i testmiljö har redan gett 77,9, ungefär fem poäng under Z.ai:s påstående. När en leverantörssiffra krymper vid oberoende testning är det ingen skandal — det är den normala avgiften för egenmätning. När en konkurrerande leverantörs siffra inte ens kan testas är frånvaron av avgiften problemet, inte ett tecken på att siffran är fläckfri.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GLM-5.2 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; License Apache-2.0 pending; Params 397B / ~17B active; Modality text + image (computer use); Terminal-Bench 2.1 82.7 vendor; Price free hosted / no list. Right column GLM-5.2: GA Jun 16 2026; License MIT live now; Params ~743B / ~40B active; Modality text only; Terminal-Bench 2.1 82.7 claimed / 77.9 independent; Price $1.40 / $4.40 per 1M. Footer: 'Nex and Z.ai figures vendor-reported; 77.9 per the OrcaRouter harness.'

Läs de omgivande raderna på samma sätt. GLM-5.2 har den högsta oberoende indexavläsningen som har uppmätts bland öppna modeller — det låga 50-talet på Artificial Analysis nuvarande Intelligence Index — vilket är anledningen till att den har varit referensmodellen i månader, trots att den inte är det flashigaste nya släppet. Nex-N2.5 Pro har ingen oberoende indexpost överhuvudtaget. På de rader där båda leverantörerna hävdar siffror tillhör den verifierbara siffran den etablerade aktören; på de rader där endast Nex-AGI har publicerat siffror har de inte kunnat reproduceras. Det är inte ett omdöme om vilken modell som är smartare. Det är ett omdöme om vilken modell du tillåts verifiera.

Specifikationsbladen stämmer överens mer än du skulle förvänta dig.

Tar man bort riktmärkena ligger de två modellerna nära varandra i grunderna:

Släppt — Nex-N2.5 Pro: 8 september 2026 (värdbaserade endpoints live, vikter väntar). GLM-5.2: GA 16 juni 2026, vikter live.

Licens — Nex-N2.5 Pro: Apache-2.0, vikter kommer snart. GLM-5.2: MIT, nedladdningsbar nu.

Skala — Nex-N2.5 Pro: 397B totalt / ~17B aktiva. GLM-5.2: ~743B totalt / ~40B aktiva.

Modalitet — Nex-N2.5 Pro: text och bild in, text ut, visionloop för datoranvändning. GLM-5.2: textbaserad resonemangsmodell.

Kontext/utdata — Nex-N2.5 Pro: kontext på 262 144 token. GLM-5.2: kontext på 1M token, utdatatak på 128K.

Resonemangskontroll — Nex-N2.5 Pro: ingen / medel (adaptiv, standard) / hög. GLM-5.2: kontroller för resonemangsansträngning på samma modellsträng.

Pris per 1M tokens — Nex-N2.5 Pro: gratis värdbaserad nivå, inget listpris. GLM-5.2: $1,40 för input / $4,40 för output, $0,26 för cachad input.

Kuverten skiljer sig på samma sätt som de två modellernas arbetsuppgifter skiljer sig: GLM-5.2 ger en full miljon tokens textkontext och ett 128K-utdatatak för långa ingenjörssessioner, medan Nex-N2.5 Pro byter kontextstorlek mot en visionskanal och ett mindre 262K-fönster inriktat på skärmbaserade arbetsbelastningar. Ingen specifikation är fel; de är specade för olika uppgifter.

Öppna vikter, två olika betydelser

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Det är här som jämförelsen helt och hållet slutar handla om siffror. GLM-5.2 är öppen på det sätt du släpper en produkt du kan bygga ett företag på: MIT-licens, vikter på Hugging Face, inga begränsningar för kommersiell användning, ingen datadelningsklausul, ingen leverantör som ser över axeln på dig. Du kan ladda ner den, finjustera den, köra den bakom din egen compliance-gräns eller ta den till vilken värd du vill — och eftersom vikterna ligger ute har dess pris ett golv under sig som ingen enskild leverantör kan höja. Nex-N2.5 Pro utlovas under Apache-2.0, en lika tillåtande licens, men banderollen på dess Hugging Face-modellkort säger att vikterna kommer snart, och inget datum är angivet. För ett team som omfattas av datastyrningsregler, eller ett som i stor skala vill slippa prissättning per token helt och hållet, är den skillnaden hela beslutet: GLM-5.2 är en modell du kan äga i dag, och Nex-N2.5 Pro är en modell du har blivit lovad. Matematiken för egen drift talar också till nykomlingens fördel när vikterna väl landar — 17B aktiva parametrar på en nod med åtta H100:er har ett betydligt mer lättillgängligt fotavtryck än GLM-5.2:s ~40B-aktiva maskin — men ”när vikterna landar” gör en hel del jobb i den meningen.

Familjerna rör sig i motsatta riktningar.

Båda modellerna befinner sig i snabbrörliga familjer, och banorna drar åt olika håll. GLM-5.2:s härstamning är transparent och iterativ: Z.ai släppte GLM-5.3 i augusti som en efterträningsuppdatering av samma 5.2-bas och GLM-5.3 Flash i början av september, så de 5.2-vikter du bygger på idag är den grund som familjen ständigt förbättrar — din arkitekturkunskap och dina finjusteringar förs vidare. Nex-AGI:s familj är en satsning på en helt ny generation: Nex-N2.5 Mini på 35B, Nex-N2.5 Pro på 397B och en textbaserad Nex-N2.5 Max på 1.6T vars egen bas är DeepSeek-V4-Pro-Base, medan Pro-vikterna som skulle låta vem som helst verifiera familjens påståenden fortfarande är opublicerade. Ett team som väljer plattform att bygga på väljer mellan en härstamning med en publicerad färdplan för uppdateringar och en första utgåva vars andra akt ännu inte har anlänt.

Vilken förtjänar en plats i din build?

Om ditt krav är att "modellen måste vara vår" — för data governance, för granskning, för en produkt där du inte vill att en enskild leverantör ska ha kontroll — så är GLM-5.2 inte det bättre valet i den här jämförelsen; det är det enda valet, eftersom det är den enda modellen i den som du kan ladda ner. Det är också den enda med ett oberoende betyg, och den är prissatt enligt Z.ai:s lista på 1,40 $ per miljon token i indata och 4,40 $ per miljon token i utdata. Om ditt krav är en multimodal datoranvändningsagent som så småningom skulle kunna underprisa de stängda ledarna, är Nex-N2.5 Pro den mer intressanta långsiktiga tesen — en visionoperatör med 17B aktiva parametrar från en allians som tydligt vet vad den vill bygga — men en tes är inte ett beroende, och en gratis värdbaserad slutpunkt är inte en grund.

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), marked FEATURED, showing the header stats $1.40 input and $4.40 output per million tokens and the byline 'by Z.ai - 2026-06-16'.

Det praktiska sättet att agera på allt detta är att bygga vidare på det som finns och mäta löftet när det väl landar. GLM-5.2 finns på OrcaRouter till Z.ai:s listpris – samma $1.40 / $4.40, utan påslag – och eftersom modellen har öppna vikter går den även att driva i egen regi om du vill att mätningen inkluderar din egen servingstack. Den är i dag den referenspunkt du kör din faktiska agentiska arbetsbelastning mot. Routing-DSL:et fungerar som platshållare för den dag då Nex-N2.5 Pro dyker upp till listpris hos en leverantör – då är byte av jämförelseobjekt en routingregel, inte en migrering. Tills shardarna släpps och en oberoende testharness bekräftar – eller korrigerar – siffran 82.7, är Nex-N2.5 Pro mot GLM-5.2 en matchning mellan en modell du kan verifiera och en siffra du inte kan.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen