
Dots vs GLM-5.2: De två ändarna av agentförsörjningskedjan
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 349 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 210 tok/s
- OrcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- xAISpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Dots and GLM-5.2 sit at opposite ends of the same supply chain, and neither one is the other's rival. Dots is the agent surface the company announced at DevDay on September 29, 2026 — an always-on worker with its own cloud computer and browser, connections to more than 4,000 apps, reachable in ChatGPT, Slack and Teams, powered by GPT-6 Astra and included with Pro and Business Premium at no extra cost. GLM-5.2 is Z.ai's open-weight flagship text model, released June 16, 2026, with a one-million-token context window, up to 128,000 tokens of output and a published rate of $1.40 per million input tokens and $4.40 per million output tokens. One is the layer you rent and cannot see inside; the other is the layer you can download, inspect and price to the token. If you are deciding how to run agents this quarter, that is the pair of decisions in front of you.
Vad var och en är, i ett svep
• Vad det är — en hostad agent som alltid är på, utan egen modellidentifierare (Dots), mot en nedladdningsbar textmodell med publicerade vikter (GLM-5.2)
• Vem som ligger bakom — OpenAI, tillkännagavs på DevDay 2026-09-29, mot Z.ai (Zhipu AI), släppt 2026-06-16
• Var det körs — OpenAI:s molndator och webbläsare, isolerade från din maskin om du inte länkar dem, mot var du än distribuerar det: din egen hårdvara, ett moln du väljer, eller vår slutpunkt
• Underliggande modell — GPT-6 Astra, namngiven av OpenAI i dess lanseringsmaterial (enligt leverantören), mot GLM-5.2 självt, en mixture-of-experts-modell som Z.ai har släppt med öppna vikter
• Modalitet – meddelanden, appdata och en webbläsare i ena änden, mot enbart text in och text ut, utan bild- eller ljudinmatning
• Kapacitet — odokumenterade svarsgränser för en punkt, jämfört med 1 000 000 tokens kontext och 128 000 tokens maximal utdata
• Pris — den första punkten ingår i Pro eller Business Premium, kvot ej publicerad, mot 1,40 USD per miljon indata och 4,40 USD per miljon utdata enligt vår katalog
• Evidens — leverantörsdemos, ingen oberoende benchmark för dots, mot ett Artificial Analysis Intelligence Index på 33,7 och ett leverantörsrapporterat 99,1 på τ²-Bench, båda med sina källor i vår katalog
Halvan med öppna vikter, och haken från dag ett
GLM-5.2:s proposition är den välbekanta med öppna vikter, och den är starkare än vanligt här eftersom modellen är billig enligt vilket mått som helst och vikterna innebär att beslutet om driftsättning är ditt. Z.ai:s egna publicerade resultat leder med agentisk verktygsanvändning – 99,1 på τ²-Bench, 76,8 på MCP-Atlas och 74,4 på FrontierSWE – och det är leverantörssiffror, vilket är värt att säga rakt ut eftersom det är siffrorna som får modellen att framstå som ett fynd. Oberoende mätningar är mer återhållsamma: ett Artificial Analysis Intelligence Index på 33,7 placerar den i mitten av fältet på den tavlan, en τ-banking-del på 34,6 är blygsam, och 78,3 på återkallning över lång kontext ligger bakom de nuvarande ledarna. Vår katalog bär 123,2 miljoner tokens trafik på den här modellen under de senaste sju dagarna, vilket är det tydligaste tecknet som finns på att folk faktiskt kör den.
Här är haken, och det är anledningen till att den här artikeln finns i stället för en ren specifikationsjämförelse. Artificial Analysis markerar GLM-5.2 som föråldrad till förmån för en nyare version, GLM-5.3, och dess livesida säger det högst upp: modellen är fortfarande routbar och fortfarande allmänt tillgänglig, men leverantörens färdplan har gått vidare och de indexsiffror som är knutna till GLM-5.2 är en ögonblicksbild snarare än en bestående sådan. Dess andra oberoende siffror stannar av samma anledning – AA:s meddelande förklarar att efter depreceringen fortsätter man att benchmarka endast standardarbetsbelastningen för modellen, och resultat för allt annat blir historiska.

Två lärdomar följer av det, och båda gäller långt bortom den här modellen. För det första: ett pris och en licens är bestående fakta om en utgåva med öppna vikter; en placering på en resultattavla är en rörlig sådan, och en modell kan vara billig, nedladdningsbar och ändå bli överträffad. För det andra: efterträdaren är redan här: Z.ai har släppt GLM-5.3 som sin nuvarande flaggskeppsmodell, prissatt lägre än GLM-5.2 till $1,26 för indata och $3,96 för utdata per miljon, med ett oberoende Intelligence Index på 44,8 mot GLM-5.2:s 33,7. Den som bygger nu bör prissätta den nyare modellen först och betrakta GLM-5.2 som det billigare prisgolvet under den, inte som familjens frontlinje.
Vad en prick kostar, och varför ingen av er kan budgetera för den
OpenAI har publicerat ett pris för dots — den första ingår i Pro och Business Premium, med utökade gränser under den första månaden och konversationer som inte räknas mot ChatGPTs användningsgränser. Ingen kvotangivelse, inget pris för en andra dot, ingen taxa för extra hastighet eller kapacitet, ingen kostnad per slutförd uppgift och inget företagspris för de specialiserade dots som för närvarande är under intern testning. I CNBC:s bevakning av keynoten prissätter finanschefen Sarah Friar den nya $500 Pro 500-nivån som en användningskvot plus Ultrafast-läget snarare än som en per-dot-taxa; den dyraste planen på OpenAIs prislista omvandlas inte heller till en kostnad per enhet agentarbete.
GLM-5.2 har det motsatta problemet, vilket är det bättre problemet: för många siffror, och alla går att kontrollera. Prislistan är $1,40 och $4,40 per miljon tokens med cachade läsningar på $0,26, och modellen går att ladda ner, så marginalkostnaden för en förfrågan du kör själv är hårdvara och el i stället för en leverantörs faktura. Det är avvägningen i en mening. En punkt ger dig en arbetare och ingen mätare; GLM-5.2 ger dig en mätare och ingen arbetare.

Att sätta en mätarbaserad modell under en agent som du hyr
Det användbara sättet att hålla båda är att ge var och en den halva av jobbet som den gör bra. En dot sköter koordineringen: bevaka ett projekt, jaga människorna och systemen som är inblandade, komma tillbaka med något färdigt. GLM-5.2 – eller efterföljaren du har prissatt mot den – sköter det resonemang du behöver äga: extraktionspasset över ett arkiv på en miljon token, den långa genereringen, klassificeringskön, delen där ett felaktigt svar kostar mer än de token det sparade.
Den uppdelningen kräver att den resonerande halvan är portabel, vilket är ett routingproblem snarare än ett modellproblem. OrcaRouter tillhandahåller GLM-5.2 som z-ai/glm-5.2 till leverantörens listpris vidarebefordrat med 0 % påslag – inget läggs på ovanpå, så en prissänkning från Z.ai når ditt konto samma dag – i en katalog med över 200 modeller bakom en enda nyckel, med verktygen för failover och routing som låter ett jobb flytta till den nyare eller billigare modellen utan kodändring. Det den inte erbjuder är en punkt: det finns ingen dots-endpoint, ingen modellidentifierare för agenten och inget sätt att byta ut intelligensen som körs inuti den. Gränsen är verklig, och att låtsas något annat skulle vara den enda oärliga sliden i den här jämförelsen.
Rekommendationen, uttalad en gång
Om du vill att arbetet ska ske utan att du driver det, köp punkten — den kostar inget utöver en prenumeration du kanske redan har, och dess begränsning är att du ännu inte kan bevisa vad den har sparat åt dig. Om du vill veta vad ditt resonemang kostar och kunna flytta det senare, sätt GLM-5.2 eller dess efterföljare bakom din egen slutpunkt och mät det. De team som gör detta rätt i slutet av 2026 gör båda, och disciplinen som får det att fungera är att vägra låta det hyrda lagret äga något som de inte skulle kunna ersätta.

Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
