
Grok 4.7 vs. GLM-5.2: Die Lizenz überdauert das Modell
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Das Wertvollste an GLM-5.2 ist nicht sein Benchmark-Ergebnis. Es sind die vier Buchstaben MIT. Z.ai veröffentlichte GLM-5.2 am 16. Juni 2026 unter einer standardmäßigen MIT-Lizenz ohne regionale Beschränkungen, ohne Umsatzschwelle und ohne kommerzielle Nutzungsbedingung außer der Beibehaltung des Urheberrechtshinweises – und als Z.ai zwei Monate später GLM-5.3 herausbrachte, wiederholte es das nicht. Der Nachfolger trägt eine maßgeschneiderte „GLM-5.3 License“, die eine Ausnahmeregelung hinzufügt: Ein Model-as-a-Service-Betreiber mit mehr als 10 Milliarden US-Dollar Umsatz über einen beliebigen Zeitraum von zwölf aufeinanderfolgenden Monaten muss sich einer Sicherheitsüberprüfung unterziehen, wobei der Umfang dieser Überprüfung „nach vernünftigem Ermessen von Z.AI“ festgelegt wird. GLM-5.2 ist das letzte Text-Flaggschiff, das Z.ai ohne diese Klausel veröffentlicht hat. Gegenüber Grok 4.7 – am 21. September 2026 vom Anbieter veröffentlicht, mit geschlossenen Gewichten und einen Tag alt – ist dies damit ein Vergleich zwischen dem stärksten Modell auf dem Markt und dem freiesten.
Eines davon können Sie ganz Ihr Eigen nennen
GLM-5.2 ist ein Mixture-of-Experts-Modell mit 753 Milliarden Parametern und ungefähr 40 Mrd. aktiven pro Token, veröffentlicht in BF16 und FP8 auf Hugging Face unter der Organisation zai-org. Es hat ein Kontextfenster von 1 Mio. Token und eine maximale Ausgabe von 128K. Es ist Text rein, Text raus – keine native Vision – mit Funktionsaufrufen, MCP-Integration, strukturierter JSON-Ausgabe und Kontext-Caching sowie einem standardmäßig aktivierten Denkmodus mit einer Reasoning-Effort-Einstellung. Die First-Party-API von Z.ai listet es mit 1,40 $ pro Million Eingabe-Token, 0,26 $ für gecachte Eingabe und 4,40 $ pro Million Ausgabe.
Grok 4.7 ist geschlossen. Es verfügt über einen 500k-Token-Kontext, nimmt Text und Bilder entgegen und kostet laut Liste $2,00 für Eingabe und $6,00 für Ausgabe pro Million Token unter 200k Prompt-Token, oberhalb dieser Grenze dann $4,00 und $12,00, wobei Cache-Lesezugriffe $0,50 bzw. $1,00 kosten. Es gibt keinen Download der Gewichte, keinen Self-Hosting-Pfad und keine Möglichkeit, es weiterhin aufzurufen, falls xAI seine Meinung ändert – dieselbe strukturelle Position wie jedes geschlossene Flaggschiff. Beide Modelle sind leistungsfähig; nur eines davon ist ein Asset, das man auf eine Festplatte legen kann.
Was der Index aussagt und was "deprecated" hier bedeutet
Artificial Analysis bewertet GLM-5.2 mit 34 im Intelligence Index v4.3.2 – der am 19. September 2026 veröffentlichten Revision – und Grok 4.7 mit 46 in derselben Revision. Diese Zwölf-Punkte-Lücke ist real, und ihre Ausprägung ist wichtiger als ihre Größe. GLM-5.2 trägt auf seiner Artificial-Analysis-Seite außerdem das Label „deprecated“, mit dem Hinweis, dass ein neueres Modell existiert und dass nur der standardmäßige 10k-Token-Workload weiterhin gebenchmarkt wird. Dieses Label betrifft die Nachfolge, nicht die Abschaltung: Z.ai stellt glm-5.2 auch heute noch bereit und führt es weiterhin in seiner Preistabelle auf.
• Composite — Grok 4.7 (xhigh): 46 auf dem Artificial Analysis Intelligence Index v4.3.2. GLM-5.2 (max): 34 in derselben Revision.
• Agentische Terminals — Grok 4.7: Terminal-Bench 4.0 26. GLM-5.2: 1. Dies ist die extremste Einzelzahl in dieser Vergleichsgruppe, und sie erfordert den dazugehörigen Vorbehalt. In der eigenen Modellkarte von Z.ai wird GLM-5.2 mit 81,0 auf Terminal-Bench 2.1 angegeben, bestes Harness 82,7. Beide Zahlen sind ehrlich; sie beziehen sich auf unterschiedliche Benchmark-Versionen, und der Index v4.3.2 hat 2.1 zugunsten von 4.0 eingestellt. Ein Anbieterwert auf einer eingestellten Benchmark sagt Ihnen, was ein Modell gegen den alten Test leisten konnte, nicht, was es heute leistet.
• Workflow-Automatisierung — Grok 4.7: AutomationBench-AA 66%. GLM-5.2: 28%. Beide auf v4.3.2 gemessen, daher braucht diese hier keinen Versionshinweis.
• Wissens-Ehrlichkeit — Grok 4.7: AA-Omniscience 32. GLM-5.2: 4. Wieder die gleiche Version auf beiden Seiten.
• Reasoning und langer Kontext — Grok 4.7: HLE 43, CritPt 18, AA-LCR v1.1 77 %, Kontextfenster 500k. GLM-5.2: HLE 41, CritPt 21, AA-LCR v1.1 78 %, Kontextfenster 1M. GLM-5.2 gewinnt zwei dieser vier und das Kontextfenster um den Faktor zwei.
• Geschwindigkeit — Grok 4.7: noch nicht von Artificial Analysis gemessen. GLM-5.2: 73 Token pro Sekunde bei einer Zeit bis zum ersten Token von 5,98 Sekunden über die API von Z.ai, beschrieben als langsamer als der Durchschnitt für Open-Weights-Vergleichsmodelle.
• Preis — Grok 4.7: 2,00 $ / 6,00 $ pro 1 Mio., Verdopplung bei 200k Prompt-Tokens. GLM-5.2: 1,40 $ / 4,40 $ pro 1 Mio. mit 0,26 $ für Cache-Lesevorgänge, unverändert seit Markteinführung.

Die Ökonomie des Self-Hostings ist das eigentliche Argument
Pro Token ist GLM-5.2 bei kurzen Prompts rund 30 Prozent günstiger bei der Eingabe und 27 Prozent günstiger bei der Ausgabe als Grok 4.7 – ein bescheidener Rabatt, der für sich genommen nichts entscheiden würde. Der Grund, warum es zählt, ist, dass der Preis pro Token optional ist. Die Gewichte von GLM-5.2 sind unter einer Lizenz herunterladbar, die kommerzielle Nutzung, Modifikation, Weiterverbreitung und Unterlizenzierung gestattet, was bedeutet, dass der relevante Vergleich nicht 1,40 $ gegenüber 2,00 $ ist, sondern 1,40 $ gegenüber dem, was Ihre eigenen GPUs pro Million Token kosten. Ein 753B-Modell mit 40B aktiven Parametern ist keine Laptop-Arbeitslast; es ist ein ernsthaftes Inferenz-Deployment, und der FP8-Checkpoint existiert genau dafür. Aber es ist ein Deployment, das Sie betreiben, begrenzen und auditieren können – und für eine regulierte oder eine luftgetrennte Arbeitslast ist das überhaupt keine Kostenfrage.
Das Gegengewicht ist das Nachfolgerisiko in die andere Richtung. GLM-5.2 liegt zwei Releases zurück: GLM-5.3 erschien am 18. August und GLM-5.3-Flash am 26. August, und die neueren Flaggschiffe erzielen höhere Werte — GLM-5.3 mit 45 auf v4.3.2, einen Punkt unter Grok 4.7. Die ehrliche Einordnung lautet also, dass GLM-5.2 das kostenlose ist, nicht das beste, und dass die neueren Modelle von Z.ai selbst sowohl stärker als auch restriktiver lizenziert sind. Wenn permissive Lizenzierung das ist, was Sie brauchen, ist GLM-5.2 der Endpunkt, den man einfrieren sollte; wenn reine Leistungsfähigkeit auf einem offenen Gewichts-Set das ist, was Sie brauchen, ist der Nachfolger derjenige, den es zu bewerten gilt — mit dem prüfenden Blick eines Anwalts auf die Umsatz-Ausnahmeregelung.

Beides ausführen, ohne zwei Stacks laufen zu lassen
OrcaRouter führt GLM-5.2, gelistet auf der eigenen Modellseite mit 1,40 $ Input und 4,40 $ Output, mit 1M-Kontextfenster und maximal 128K Output, weil wir die Listenpreise der Anbieter mit 0 % Aufschlag weitergeben. Bei einem Open-Weight-Modell hat diese Weitergabe einen zweiten Nutzen: Der gehostete Preis und die Option des Selbsthostings sind beide live verfügbare Wahlmöglichkeiten, und ein Router erlaubt es, Traffic pro Anfrage statt pro Vertrag zwischen ihnen zu verschieben. Z.ai hat den Listenpreis von GLM-5.2 seit Juni unverändert gelassen, während Drittanbieter-Hosts ihre Preise hin und her verschoben haben, sodass eine tagesaktuelle Weitergabe den Unterschied ausmacht zwischen dem Nennen des heutigen Preises und dem Nennen eines Preises, den man letzten Monat kopiert hat. Automatisches Failover deckt den Fall ab, dass eine selbst gehostete Bereitstellung gesättigt ist und der gehostete Endpunkt die Überlast auffangen muss – die Routing-DSL fügt beide zu einem einzigen Aufruf zusammen. Grok 4.7 ist zum Zeitpunkt dieses Schreibens nicht im OrcaRouter-Katalog; ein Aufruf bedeutet, über xAIs eigene API und die Drittanbieter-Plattformen zu gehen, die es führen.
Die Entscheidungsregel, die sich aus all dem ergibt, ist ungewöhnlich klar. Wenn Sie das Modell besitzen müssen – On-Premises, auditiert, lizenzierbar ohne Umsatzprüfung –, ist GLM-5.2 das einzige dieser beiden, das dies bietet, und die Zwölf-Punkte-Lücke im Index ist der Preis für diese Freiheit. Wenn Sie das Modell brauchen, das agentische Arbeit abschließt, verläuft die Lücke in die andere Richtung, und sie ist alles andere als subtil: 66 Prozent gegenüber 28 Prozent bei der Workflow-Automatisierung, 26 gegenüber 1 bei Terminal-Agenten, 32 gegenüber 4 bei Wissensehrlichkeit. Nichts an der Lizenzfrage ändert diese Zahlen.
Der Anruf.
Grok 4.7 gewinnt den Fähigkeitsvergleich, und er gewinnt ihn bei den Evaluierungen, die vorhersagen, ob ein Agent eine Aufgabe abschließt. GLM-5.2 gewinnt bei den zwei Dingen, die kein Benchmark misst: Es ist günstiger, und es gehört Ihnen. Das Detail, das dies festzuhalten lohnt, ist, dass der zweite Vorteil ausläuft – die neueren Flaggschiffe von Z.ai haben die uneingeschränkte MIT-Lizenz aufgegeben, sodass ein im Juni 2026 veröffentlichtes Modell unter Bedingungen, die nichts von Ihnen verlangen, nun ein historisches Artefakt statt einer Richtlinie ist. Wenn permissive offene Gewichte für Ihr Produkt tragend sind, ist das ein Grund, sich auf GLM-5.2 zu standardisieren, solange es noch die günstige gehostete Option und noch herunterladbar ist. Wenn nicht, kaufen Sie die zwölf Punkte.

In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
