Een gegenereerde titelkaart voor het artikel 'Mistral Large 4 vs GLM-5.5' met de titel in een vet geometrisch sans-serif-lettertype, daaronder de ondertitel 'Een echt model tegenover een naam', en daarboven een rij van drie platte lijnpictogrammen — een gevulde modelkaart naast een lege kaart met streeplijnomtrek — op een witte achtergrond met blauw-cyaan gradiëntaccenten en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

Mistral Large 4 vs GLM-5.5: Een echt model tegenover een naam

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Er is geen GLM-5.5 om mee te vergelijken Mistral Large 4. Op 6 oktober 2026 heeft die naam geen modelkaart, geen API-identifier, geen prijsregel, geen checkpoint en geen licentiebestand, en Z.ai's eigen site gebruikt die nergens. Het model aan het einde van die nummerreeks is GLM-5.3, dat Z.ai op 18 augustus 2026 uitbracht — hetzelfde Z.ai open-weight vlaggenschip dat Mistral in zijn eigen lanceringsbericht bij naam als benchmark voor Mistral Large 4 noemt. De vergelijking die daadwerkelijk kan worden uitgevoerd is dus een preview die vandaag is uitgebracht tegen een twee maanden oud open-weight model met een actuele prijs, vier en een half miljard tokens per week aan reëel verkeer, en een licentiebestand dat je kunt lezen. Dat blijkt toch de nuttigere confrontatie te zijn.

Het is ook een zuiverdere test van Mistrals centrale bewering dan de GLM-vergelijking die de lanceringspost uitvoert. Mistral zegt dat Mistral Large 4 het sterkste open-weightmodel is dat buiten China is gebouwd. GLM-5.3 is het sterkste open-weightmodel dat daarbinnen is gebouwd. De twee beweringen zijn op dezelfde index tegen elkaar te controleren, en een van beide berust momenteel op gewichten die niet zijn vrijgegeven.

Wat bestaat, en wat niet

De controle duurt ongeveer tien minuten, en elk van deze is een plek waar een uitgebracht Z.ai-vlaggenschip zou verschijnen:

• Op Z.ai's eigen model-api-pagina staan precies drie kaarten — GLM-5.3, GLM-5.3-FlashX en GLM-5.2. Er is geen vierde vermelding onder welke 5.4- of 5.5-naam dan ook.

• Artificial Analysis heeft een live GLM-5.3-pagina; artificialanalysis.ai/models/glm-5-5 en /glm-5-4 geven beide een 404.

• De nieuwste repositories van de zai-org Hugging Face-organisatie zijn de GLM-5.3-serie, aangemaakt op 25 augustus 2026 — waaronder GLM-5.3, GLM-5.3-BF16 en GLM-5.3-Flash. Er bestaat niets dat later is.

• Onze eigen catalogus geeft 'model niet gevonden' voor z-ai/glm-5.5, z-ai/glm-5.4 en z-ai/glm-6.0, terwijl z-ai/glm-5.3 wel wordt gevonden met een actuele prijs.

• Tijdens de winstcall van Z.ai op 31 augustus 2026 werd GLM-6.0 genoemd als het basismodel van de volgende generatie, waarbij 5.4 en 5.5 volledig werden overgeslagen.

De naam circuleert omdat Z.ai in augustus 5.3 uitbracht en het volgende vlaggenschipmodel natuurlijk leest als het volgende nummer. Dat is een naamgevingsconventie, geen product. Niets in dit artikel moet worden gelezen als een specificatieblad voor GLM-5.5, want er een maken zou betekenen dat je elk cijfer erin verzint.

A screenshot of Mistral's own documentation, the Models Overview page at docs.mistral.ai, showing the GENERALIST MODELS card grid with 'Mistral Large 4' at version v26.10 described as 'A state-of-the-art, open-weight, general-purpose multimodal model' and no licence badge, beside Mistral Large 3 at v25.12 with an APACHE 2.0 badge, and Mistral Small 4, Mistral Medium 3.5, Z.ai GLM 5.3 and the Ministral 3 sizes. Z.ai GLM 5.3 appears as the first card in the grid.

De echte vergelijking: Mistral Large 4 preview vs GLM-5.3

De cijfers van Mistral komen uit het eigen lanceringsbericht en de eigen modelkaart; die van GLM-5.3 komen uit de live catalogusvermelding op OrcaRouter en de Artificial Analysis-pagina, beide gelezen op 6 oktober.

• Architectuur — 1,05 biljoen totaal / 49 miljard actieve sparse MoE met een visie-encoder van 1,6 miljard vs. een tekst-only MoE met gepubliceerde open gewichten

• Modaliteiten — tekst en afbeelding in, tekst uit vs tekst in, tekst uit

• Contextvenster — 1M opgegeven door Mistral, 524.288 op de configuratie die Artificial Analysis test, vs 1M geserveerd

• Uitvoerplafond — niet gepubliceerd vs. 128K tokens

• Prijs per miljoen, invoer / uitvoer — $1,36 / $4,18 lijstprijs, momenteel $0,68 / $2,09 in promotie, vs. $1,40 / $4,40 lijstprijs, momenteel $1,26 / $3,96 geleverd

• Gecachte invoer per miljoen — $0,14, momenteel $0,07, vs $0,26 lijstprijs, $0,234 geleverd

• Intelligence Index v4.3 — 38,4 vs 44,8

• Kosten per indextaak — €1,13 vs €2,01

• Terminal-Bench 4.0 — 26,8% vs. 41,9%

• AutomationBench — 59,9% vs 62,2%

• Gewichten — beloofd eind oktober, licentie niet genoemd vs. nu beschikbaar onder Z.ai's eigen voorwaarden

Simpel gezegd: GLM-5.3 is het betere model op de onafhankelijke index, met 6,4 punten voorsprong, en het is al te downloaden. Mistral Large 4 is 44% goedkoper per voltooide taak en is, op de Terminal-Bench-regel, de zwakkere coder met vijftien punten. De prijssymmetrie is toevallig en dicht genoeg bij elkaar om verwarrend te zijn — $1,36 / $4,18 tegen $1,40 / $4,40 voor de lijsttarieven, hoewel OrcaRouter GLM-5.3 levert voor $1,26 / $3,96, wat Mistrals lijsttarief ronduit onderbiedt. Mistrals promotionele $0,68 / $2,09 is wat de preview vandaag goedkoper maakt, en het is een introductieprijs.

Waar Mistral de overhand heeft

Twee rijen doen ertoe, en geen van beide is de index.

De eerste is multimodaal. GLM-5.3 is een tekst-in-tekst-uit-model, en de cataloguskaart is daar expliciet over. Mistral Large 4 wordt geleverd met een vision-encoder met 1,6 miljard parameters en Mistral claimt state-of-the-art visuele grounding onder open modellen — met een verwijzing naar 42% tegenover 41% van GPT-6 Astra op Dense 200, en demo's van gigapixel-satellietbeelden, technische tekeningen en dense documentretrieval. Op dezelfde testomgeving verschijnt de multimodale score van GLM-5.3 niet, omdat er niets te scoren valt. Voor elke pipeline die grafieken, tekeningen, gedeponeerde stukken of screenshots leest, reduceert de vergelijking tot één kandidaat.

Het tweede is beveiligingswerk. Mistral claimt 82% op de Artificial Analysis Cyber Index-test die een model vraagt een echte kwetsbaarheid te reproduceren en vervolgens te patchen — beschreven als de hoogste van alle modellen — plus 93% op de 40 competitieoefeningen van Cybench, en een algehele top-vijfpositie in de Cyber Index die vooroploopt op open-weight modellen die buiten China zijn gebouwd. Z.ai heeft ook cybersecurityclaims voor GLM-5.3 gepubliceerd, en de eigen beschrijving van GLM-5.3 schrijft het de verdienste toe Mythos 5 te evenaren op geselecteerde cybersecuritycapaciteiten. Beide reeksen cijfers zijn door de leverancier aangehaald en beide moeten als zodanig worden gelabeld. Het verschil is dat die van Mistral op een bij naam genoemde onafhankelijke index staan en aan een specifieke test zijn gekoppeld, waardoor ze makkelijker te controleren en makkelijker te falsificeren zijn.

A generated two-column scoreboard titled 'Mistral Large 4 vs GLM 5.3 — the scoreboard'. Left column 'Mistral Large 4 Preview': Intelligence Index v4.3 38.4; cost per index task $1.13; Terminal-Bench 4.0 26.8%; AutomationBench 59.9%; multimodal vision encoder; weights promised end of October. Right column 'GLM 5.3': Intelligence Index v4.3 44.8; cost per index task $2.01; Terminal-Bench 4.0 41.9%; AutomationBench 62.2%; multimodal text only; weights open and available now.

Al het andere pleit in het voordeel van de gevestigde partij, en het argument over de kosten van een preview is juist het punt waar je voorzichtig mee moet zijn. In het aankondigingsbericht van Mistral staat dat de preview wordt aangeboden op dezelfde Europese infrastructuur waarop hij is getraind — 3.800 NVIDIA Grace Blackwell-GPU's in de eigen datacenters van Mistral — en dat de gewichten eind oktober volgen. Wat je daarmee vandaag krijgt, is een aanroepbaar model met een aangegeven einde aan de previewperiode; wat je er niet mee krijgt, is datgene waarop de hele pitch van Mistral berust.

Wat zou van GLM-5.5 een model maken

Als Z.ai daadwerkelijk een 5.4 of een 5.5 uitbrengt, zouden de artefacten in een vaste volgorde verschijnen en elk is controleerbaar zonder Z.ai iets te hoeven vragen:

• Een modelkaart op de eigen model-api-pagina van Z.ai, die vandaag drie vermeldingen bevat en niet meer

• Een API-identifier die resolveert, zoals z-ai/glm-5.3 resolveert en z-ai/glm-5.5 niet.

• Een prijsregel met een tarief per miljoen tokens in de documentatie van Z.ai

• Een Hugging Face-repository van de organisatie zai-org met een licentiebestand — de huidige reeks eindigt op 25 augustus 2026

• Een pagina bij een neutrale benchmarkorganisatie, waar glm-5.5 momenteel een 404 geeft

Het toekomstgerichte bewijs wijst veeleer van de naam af dan erheen: het eigen resultatengesprek van het bedrijf sloeg 5.4 en 5.5 over en noemde GLM-6.0 als de volgende generatie. Wie deze maand een specsheet voor GLM-5.5 schrijft, schrijft fictie met een plausibele titel.

Kiezen tussen de twee die bestaan

Als je vandaag het betere model wilt, is het antwoord GLM-5.3, en op de onafhankelijke index is het verschil allesbehalve klein. Het staat 6,4 punten voor op Intelligence Index v4.3, vijftien punten voor op Terminal-Bench 4.0, voor op workflowautomatisering, is een echte open-weightrelease met een checkpoint dat je kunt downloaden, en het verwerkt wekelijks meer dan vijf miljard tokens in onze catalogus — een volume dat je vertelt dat de faalmodi bekend zijn. De context is een miljoen geserveerde tokens en het outputplafond een gepubliceerde 128K, tegenover een preview waarvan de contextwaarde met een factor twee verschilt, afhankelijk van op wiens pagina je kijkt, en waarvan het outputplafond helemaal niet is vermeld.

Als je vision nodig hebt, als je beveiligingswerk nodig hebt, of als een preview met een vermelde einddatum een acceptabel risico is voor een model dat misschien je eigen model wordt om te draaien, dan is Mistral Large 4 de interessante kant van de afweging. Op OrcaRouter staat GLM-5.3 in de catalogus tegen het tarief van de provider met 0% opslag in hetzelfde OpenAI-compatibele endpoint als 200-plus andere modellen, met automatische failover tussen providers en een routing-DSL die classificatie en extractie naar het model kan sturen dat die week het goedkoopst is. Mistral Large 4 staat niet in onze catalogus; de preview is bereikbaar via Mistral's eigen API en verschillende platforms van derden.

A screenshot of the OrcaRouter model page for z-ai/glm-5.3, showing the model identity, a 1M-token context window, a 128K maximum output, text-only input with text output, the 2026-08-18 release date, a p-50 time-to-first-token figure of 3.99 seconds, pricing of $1.26 per million input and $3.96 per million output, and a code sample against the api.orcarouter.ai base URL. The page describes the model as Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks, text-in and text-out.

Wees expliciet over wat je koopt. GLM-5.3 is een product. Mistral Large 4 is een product met een belofte eraan verbonden, en de belofte is het deel dat nog niet is uitgeleverd. Het gat tussen hen is niet de 6,4 indexpunten — die zullen nog verschuiven — het is dat een van deze modellen bestaat in een vorm die je kunt vasthouden, en het andere is een naamgevingsconventie met een leverdatum.

Vergeleken in dit artikel3

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt