
Grok 4.7 vs GLM-5.2: De licentie overleeft het model
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Het meest waardevolle aan GLM-5.2 is niet zijn benchmarkscore. Het zijn de vier letters MIT. Z.ai bracht GLM-5.2 op 16 juni 2026 uit onder een standaard MIT-licentie, zonder regionale beperkingen, zonder omzetdrempel en zonder commerciële gebruiksvoorwaarde anders dan het behouden van de copyrightmelding — en toen Z.ai twee maanden later GLM-5.3 uitbracht, deed het dat niet nog eens. De opvolger heeft een aangepaste "GLM-5.3-licentie" die een uitzondering toevoegt: een exploitant van model-as-a-service met meer dan 10 miljard dollar omzet over twaalf opeenvolgende maanden moet een beveiligingsonderzoek ondergaan, waarbij de reikwijdte van dat onderzoek "redelijkerwijs door Z.AI wordt bepaald". GLM-5.2 is het laatste tekstvlaggenschip dat Z.ai zonder die voorwaarde heeft uitgebracht. Afgezet tegen Grok 4.7 — op 21 september 2026 door de leverancier uitgebracht, closed-weight en een dag oud — maakt dat dit een vergelijking tussen het sterkste model in de ranglijst en het vrijste.
Een van deze kun je helemaal bezitten
GLM-5.2 is een mixture-of-experts-model met 753 miljard parameters en ongeveer 40 miljard actieve parameters per token, gepubliceerd in BF16 en FP8 op Hugging Face onder de organisatie zai-org. Het heeft een contextvenster van 1M tokens en een maximale uitvoer van 128K. Het is tekst in, tekst uit — geen native vision — met functieaanroepen, MCP-integratie, gestructureerde JSON-uitvoer en contextcaching, en een denkmodus die standaard is ingeschakeld met een instelling voor redeneerinspanning. De first-party API van Z.ai voert het op voor $1,40 per miljoen inputtokens, $0,26 voor gecachte input en $4,40 per miljoen output.
Grok 4.7 is gesloten. Het heeft een context van 500k tokens, accepteert tekst en afbeeldingen, en kost $2,00 per miljoen tokens voor invoer en $6,00 voor uitvoer onder de 200k prompttokens, oplopend naar $4,00 en $12,00 boven die grens, met gecachte leesbewerkingen tegen $0,50 en $1,00. Er is geen gewichtsdownload, geen self-hostpad, en geen enkele manier om het te blijven aanroepen als xAI van gedachten verandert — dezelfde structurele positie als elke gesloten旗舰. Beide modellen zijn capabel; slechts één ervan is een bezit dat je op een schijf kunt zetten.
Wat de index zegt, en wat "deprecated" hier betekent
Artificial Analysis geeft GLM-5.2 een score van 34 op Intelligence Index v4.3.2 — de revisie die op 19 september 2026 is gepubliceerd — en Grok 4.7 een score van 46 op dezelfde revisie. Dat verschil van twaalf punten is reëel, en de vorm ervan is belangrijker dan de omvang. GLM-5.2 heeft ook een label "deprecated" op zijn Artificial Analysis-pagina, met een opmerking dat er een nieuwer model bestaat en dat alleen de standaardworkload van 10k tokens nog wordt gebenchmarkt. Dat label gaat over opvolging, niet over stopzetting: Z.ai levert glm-5.2 vandaag nog steeds en vermeldt het nog steeds in zijn prijstabel.
• Samengesteld — Grok 4.7 (xhigh): 46 op de Artificial Analysis Intelligence Index v4.3.2. GLM-5.2 (max): 34 op dezelfde revisie.
• Agentische terminals — Grok 4.7: Terminal-Bench 4.0 26. GLM-5.2: 1. Dit is het meest extreme afzonderlijke cijfer in deze reeks vergelijkingen, en er hoort een voorbehoud bij. Z.ai's eigen modelkaart rapporteert GLM-5.2 op 81,0 op Terminal-Bench 2.1, beste harness 82,7. Beide cijfers zijn eerlijk; ze hebben betrekking op verschillende benchmarkversies, en de v4.3.2-index heeft 2.1 buiten gebruik gesteld ten gunste van 4.0. Een leveranciersscore op een buiten gebruik gestelde benchmark vertelt je wat een model kon doen tegen de oude test, niet wat het nu doet.
• Workflowautomatisering — Grok 4.7: AutomationBench-AA 66%. GLM-5.2: 28%. Beide gemeten op v4.3.2, dus hiervoor is geen versievoorbehoud nodig.
• Kennisintegriteit — Grok 4.7: AA-Omniscience 32. GLM-5.2: 4. Opnieuw dezelfde versie aan beide kanten.
• Redeneren en lange context — Grok 4.7: HLE 43, CritPt 18, AA-LCR v1.1 77%, venster 500k. GLM-5.2: HLE 41, CritPt 21, AA-LCR v1.1 78%, venster 1M. GLM-5.2 wint twee van deze vier, en het contextvenster met een factor twee.
• Snelheid — Grok 4.7: nog niet gemeten door Artificial Analysis. GLM-5.2: 73 tokens per seconde met een tijd tot het eerste token van 5,98 seconden via Z.ai's API, beschreven als langzamer dan gemiddeld voor open-weights-peers.
• Prijs — Grok 4.7: $2,00 / $6,00 per 1M, verdubbelt bij 200k prompttokens. GLM-5.2: $1,40 / $4,40 per 1M met $0,26 voor gecachte leesbewerkingen, ongewijzigd sinds de lancering.

De economie van zelf hosten is het echte argument.
Per token is GLM-5.2 bij korte prompts ruwweg dertig procent goedkoper op input en zevenentwintig procent goedkoper op output dan Grok 4.7 — een bescheiden korting die op zichzelf niets zou beslissen. Waarom het ertoe doet, is dat de prijs per token optioneel is. De gewichten van GLM-5.2 zijn downloadbaar onder een licentie die commercieel gebruik, wijziging, redistributie en sublicentiëring toestaat, wat betekent dat de relevante vergelijking niet $1,40 tegen $2,00 is, maar $1,40 tegen wat je eigen GPU's per miljoen tokens kosten. Een model van 753B met 40B actief is geen laptopworkload; het is een serieuze inference-implementatie, en het FP8-checkpoint bestaat precies daarvoor. Maar het is een implementatie die je kunt draaien, begrenzen en auditen — en voor een gereguleerde workload of een air-gapped omgeving is dat helemaal geen kostenkwestie.
Het tegenwicht is opvolgingsrisico in de andere richting. GLM-5.2 loopt twee releases achter: GLM-5.3 verscheen op 18 augustus en GLM-5.3-Flash op 26 augustus, en de nieuwere topmodellen scoren hoger — GLM-5.3 staat op 45 op v4.3.2, één punt onder Grok 4.7. De eerlijke formulering is dus dat GLM-5.2 de vrije variant is, niet de beste, en dat de eigen nieuwere modellen van Z.ai zowel sterker als restrictiever gelicentieerd zijn. Als een permissieve licentie is wat je nodig hebt, is GLM-5.2 het eindpunt om te bevriezen; als ruwe capaciteit op een open-weightset is wat je nodig hebt, is de opvolger degene om te evalueren, met een advocatenblik op de omzet-carve-out.

Beide draaien zonder twee stacks te draaien
OrcaRouter heeft GLM-5.2, vermeld op zijn eigen modelpagina voor $1,40 input en $4,40 output met het contextvenster van 1M en een maximale output van 128K, omdat we de lijstprijzen van providers met 0% opslag doorberekenen. Bij een open-weightmodel heeft die doorberekening een tweede nut: de gehoste prijs en de self-hosted optie zijn beide keuzes die je nu kunt maken, en een router laat je verkeer tussen beide verplaatsen per verzoek in plaats van per contract. Z.ai heeft de lijstprijs van GLM-5.2 sinds juni ongewijzigd gehouden, terwijl hosts van derden de hunne hebben rondgeschoven, dus een doorberekening van dezelfde dag is het verschil tussen het offreren van het tarief van vandaag en het offreren van een tarief dat je vorige maand hebt gekopieerd. Automatische failover dekt het geval waarin een self-hosted implementatie verzadigd raakt en het gehoste endpoint de overloop moet opvangen — de routing-DSL voegt de twee samen tot één aanroep. Grok 4.7 staat op het moment van schrijven niet in de OrcaRouter-catalogus; om het aan te roepen moet je via xAI's eigen API en de platforms van derden die het aanbieden.
De beslissingsregel die hieruit voortvloeit is ongewoon helder. Als je het model in eigendom moet hebben — on-premise, geauditeerd, licentieerbaar zonder een omzettoets — is GLM-5.2 de enige van deze twee die dat biedt, en het verschil van twaalf punten in de index is de prijs van die vrijheid. Als je het model nodig hebt dat agentisch werk afrondt, loopt het verschil de andere kant op, en het is niet subtiel: 66 procent tegen 28 procent bij workflowautomatisering, 26 tegen 1 bij terminalagents, 32 tegen 4 bij kennisintegriteit. Niets in de licentiekwestie verandert die cijfers.
De oproep
Grok 4.7 wint de capaciteitsvergelijking en wint die op de evaluaties die voorspellen of een agent een taak voltooit. GLM-5.2 wint op de twee dingen die geen enkele benchmark meet: het is goedkoper, en het is van jou. Het detail dat dit de moeite waard maakt om op te schrijven, is dat het tweede voordeel afloopt — de nieuwere topmodellen van Z.ai hebben de onbeperkte MIT-licentie laten varen, dus een model dat in juni 2026 is uitgebracht onder voorwaarden die niets van je vragen, is nu eerder een historisch artefact dan een beleid. Als permissieve open weights dragend zijn voor je product, is dat een reden om te standaardiseren op GLM-5.2 terwijl het nog de goedkope gehoste optie is en nog downloadbaar. Als dat niet het geval is, koop de twaalf punten.

Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
