
Dots vs GLM-5.2: de twee uiteinden van de agenttoeleveringsketen
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 349 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 210 tok/s
- OrcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- xAISpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
Dots and GLM-5.2 sit at opposite ends of the same supply chain, and neither one is the other's rival. Dots is the agent surface the company announced at DevDay on September 29, 2026 — an always-on worker with its own cloud computer and browser, connections to more than 4,000 apps, reachable in ChatGPT, Slack and Teams, powered by GPT-6 Astra and included with Pro and Business Premium at no extra cost. GLM-5.2 is Z.ai's open-weight flagship text model, released June 16, 2026, with a one-million-token context window, up to 128,000 tokens of output and a published rate of $1.40 per million input tokens and $4.40 per million output tokens. One is the layer you rent and cannot see inside; the other is the layer you can download, inspect and price to the token. If you are deciding how to run agents this quarter, that is the pair of decisions in front of you.
Wat elk ervan is, in één doorgang
• Wat het is — een gehoste, altijd actieve agent zonder eigen modelidentificatie (Dots) tegenover een downloadbaar tekstmodel met gepubliceerde gewichten (GLM-5.2)
• Wie maakt het — OpenAI, aangekondigd tijdens DevDay op 2026-09-29, tegenover Z.ai (Zhipu AI), uitgebracht op 2026-06-16
• Waar het draait — OpenAI's cloudcomputer en browser, geïsoleerd van je machine tenzij je ze koppelt, tegenover waar je het ook uitrolt: je eigen hardware, een cloud naar keuze, of ons endpoint
• Onderliggend model — GPT-6 Astra, door OpenAI genoemd in zijn lanceringsmateriaal (volgens de leverancier), tegenover GLM-5.2 zelf, een mixture-of-experts-model dat Z.ai met open gewichten heeft uitgebracht
• Modaliteit: berichten, app-gegevens en een browser aan de ene kant, tegenover alleen tekst in en tekst uit, zonder beeld- of audio-invoer.
• Capaciteit — niet-gedocumenteerde responslimieten voor een dot, tegen {{1}}1.000.000 tokens aan context{{/1}} en {{2}}128.000 tokens maximale uitvoer{{/2}}
• Prijs — het eerste punt inbegrepen bij Pro of Business Premium, toegestane hoeveelheid niet gepubliceerd, tegen $1,40 per miljoen input en $4,40 per miljoen output, zoals vermeld in onze catalogus
• Bewijs — leveranciersdemo's, geen onafhankelijke benchmark voor dots, tegenover een Artificial Analysis Intelligence Index van 33,7 en een door de leverancier gerapporteerde 99,1 op τ²-Bench, beide met hun bronnen opgenomen in onze catalogus
De open-weights-helft, en het addertje onder het gras vanaf dag één
De stelling van GLM-5.2 is de bekende open-weight-stelling, en die is hier sterker dan gebruikelijk omdat het model naar elke maatstaf goedkoop is en de gewichten betekenen dat de implementatiebeslissing aan jou is. De eigen gepubliceerde resultaten van Z.ai beginnen met agentisch toolgebruik — 99,1 op τ²-Bench, 76,8 op MCP-Atlas en 74,4 op FrontierSWE — en dat zijn cijfers van de leverancier, wat ronduit gezegd moet worden, want dat zijn de getallen waardoor het model als een koopje lijkt. Onafhankelijke metingen zijn gematigder: een Artificial Analysis Intelligence Index van 33,7 plaatst het in de middenmoot op dat bord, een τ-banking-deel van 34,6 is bescheiden, en 78,3 op long-context-recall blijft achter bij de huidige koplopers. Onze catalogus draagt 123,2 miljoen tokens aan verkeer op dit model over de afgelopen zeven dagen, wat het duidelijkste beschikbare teken is dat mensen het daadwerkelijk draaien.
Dit is het addertje onder het gras, en het is de reden dat dit artikel bestaat in plaats van een rechtstreekse specificatievergelijking. Artificial Analysis markeert GLM-5.2 als verouderd ten gunste van een nieuwere release, GLM-5.3, en de livepagina ervan vermeldt dit bovenaan: het model is nog steeds routeerbaar en nog steeds algemeen beschikbaar, maar de roadmap van de leverancier is verder opgeschoven en de indexcijfers die aan GLM-5.2 zijn gekoppeld, zijn een momentopname in plaats van een blijvende meting. De andere onafhankelijke cijfers blijven om dezelfde reden statisch — de mededeling van AA legt uit dat het na deprecatie alleen de standaardworkload voor het model blijft benchmarken, en dat resultaten voor al het overige historisch worden.

Daaruit volgen twee lessen, en beide gelden ruim buiten dit model. Ten eerste: een prijs en een licentie zijn blijvende feiten over een open-weight release; een positie op een leaderboard is veranderlijk, en een model kan goedkoop en downloadbaar zijn en toch worden opgevolgd. Ten tweede: de opvolger is er al: Z.ai heeft GLM-5.3 uitgebracht als zijn huidige vlaggenschipmodel, geprijsd onder GLM-5.2 op $1,26 input en $3,96 output per miljoen, met een onafhankelijke Intelligence Index van 44,8 tegenover 33,7 van GLM-5.2. Wie nu bouwt, moet het nieuwere model als eerste prijzen en GLM-5.2 behandelen als de goedkopere ondergrens eronder, niet als de frontier van de familie.
Wat een stip kost, en waarom geen van jullie tweeën ervoor kan budgetteren
OpenAI heeft één prijs gepubliceerd voor dots — de eerste is inbegrepen bij Pro en Business Premium, met ruimere limieten in de eerste maand en gesprekken die geen ChatGPT-gebruikslimieten verbruiken. Geen opgave van een gebruikstoelage, geen prijs voor een tweede dot, geen tarief voor extra snelheid of capaciteit, geen kosten per afgeronde taak, en geen enterprise-prijs voor de gespecialiseerde dots die momenteel intern worden getest. In de keynote-verslaggeving van CNBC prijst financieel directeur Sarah Friar de nieuwe $500 Pro 500-tier als een gebruikstoelage plus de Ultrafast-modus, in plaats van als een tarief per dot; ook het duurste abonnement op de prijslijst van OpenAI valt evenmin om te rekenen naar een kostenbedrag per eenheid agentwerk.
GLM-5.2 heeft het tegenovergestelde probleem, wat het betere probleem is: te veel getallen, allemaal controleerbaar. De tariefkaart is $1,40 en $4,40 per miljoen tokens, met cached reads tegen $0,26, en het model is downloadbaar, dus de marginale kosten van een verzoek dat je zelf draait zijn hardware en elektriciteit in plaats van de factuur van een leverancier. Dat is de afweging in één zin. Een dot geeft je een worker en geen meter; GLM-5.2 geeft je een meter en geen worker.

Een metered model onder een agent die je huurt plaatsen
De nuttige manier om beide te gebruiken is elk de helft van het werk te geven die het goed doet. Een dot regelt de coördinatie: een project in de gaten houden, de betrokken mensen en systemen achternazitten, terugkomen met iets dat af is. GLM-5.2 — of de opvolger die je qua prijs tegen GLM-5.2 hebt afgezet — neemt het redeneerwerk voor zijn rekening dat je zelf in de hand moet houden: de extractieronde over een archief van een miljoen tokens, de lange generatie, de classificatiewachtrij, het deel waar een fout antwoord meer kost dan de tokens die het heeft bespaard.
Die splitsing vereist dat de redeneerhelft overdraagbaar is, wat veeleer een routeringsprobleem is dan een modelprobleem. OrcaRouter levert GLM-5.2 als z-ai/glm-5.2 tegen de lijstprijs van de provider, doorgegeven met 0% opslag — niets extra erbovenop, dus een tariefverlaging van Z.ai bereikt je account dezelfde dag — in een catalogus van meer dan 200 modellen achter één sleutel, met de failover- en routeringstools waarmee een taak naar het nieuwere of goedkopere model kan verhuizen zonder codewijziging. Wat het niet biedt, is een dot: er is geen dots-endpoint, geen model-ID voor de agent, en geen manier om de intelligentie die erin draait te verwisselen. De grens is reëel, en doen alsof dat niet zo is, zou de enige oneerlijke slide in deze vergelijking zijn.
De aanbeveling, eenmalig vermeld
Als je wilt dat het werk gebeurt zonder dat jij het aanstuurt, koop de dot — die kost niets bovenop een abonnement dat je misschien al hebt, en de beperking ervan is dat je nog niet kunt bewijzen wat het je heeft bespaard. Als je wilt weten wat je redenering kost en die later wilt kunnen verplaatsen, zet GLM-5.2 of zijn opvolger achter je eigen endpoint en meet het verbruik. De teams die dit eind 2026 goed doen, doen beide, en de discipline die het laat werken is weigeren om de gehuurde laag iets te laten bezitten dat ze niet zouden kunnen vervangen.

Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
