
Qwen3.8-27B vs Meta Muse Glimmer: De lokale agentrace, één kant is er al
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenNIEUWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNIEUWDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokNIEUWSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligentie77Coderen
- grokxAI: Grok 4.52026-07-0856Intelligentie72Coderen
Meta Muse Glimmer is op 10 augustus 2026 uitgekomen — Apache 2.0, ruwweg 30 miljard parameters, volledig gericht op lokale agentische workloads — en het model dat vrijwel zeker de grootste concurrent wordt, is nog niet verschenen. Alibaba kondigde Qwen3.8-27B op 3 augustus aan als het zelf-hostbare lid van de Qwen3.8-generatie, beloofde de open gewichten voor de week van 10 augustus, en op het moment van schrijven is de officiële repository nog niet verschenen. Dat maakt deze vergelijking opzettelijk scheef: de ene kant is echt en vandaag te downloaden, de andere is nog onbevestigd. En dat is precies waarom het nu de moeite waard is om dit te schrijven — Meta heeft Glimmers eigen benchmarktabel opgesteld tegen de voorganger van de 27B, dus de strijd is al ingekaderd voordat de 27B bestaat.
De wedstrijd in één oogopslag
Beide modellen mikken op dezelfde koper: iemand die bijna-vlaggenschip agentische en codeermogelijkheden wil op hardware die ze zelf bezitten, niet op een API. De dimensies komen zo overeen, waarbij de Qwen-kant als ongeverifieerd is gemarkeerd waar de repository het nog niet heeft bevestigd:
• Status — Meta Muse Glimmer nu beschikbaar vs Qwen3.8-27B aangekondigd, gewichten volgen nog.
• Grootte — Glimmer is ~29,6B in totaal (27,9B tekstdecoder + 1,9B beeld-encoder) versus de ~27B van de 27B, architectuur niet bevestigd.
• Licentie — Apache 2.0, die gewichten, quants, drafter en encoder dekt, versus niet aangekondigd, met de Tongyi Qianwen 100M-MAU-clausule als een reële mogelijkheid.
• Context — Glimmer ondersteunt een tokenvenster van 128K versus de context van de 27B, onbevestigd.
• Modaliteit — Glimmer neemt tekst- en beeldinvoer via een perceptie-encoder versus de 27B, waarschijnlijk tekst-first, onbevestigd.
• Lokale voetafdruk — Glimmer draait in ~17 GB bij de 4-bit K-Quant-17GB-instelling versus een verwachte ~17 GB bij Q4_K_M voor de 27B.
• Snelheidstechnologie — Glimmer levert DFlash-speculatieve decoding (Meta rapporteert 74,9 tot 233,4 tokens/s op een RTX 5090, een sprong van 3,1×) vergeleken met de 27B, dergelijke claims zijn er nog niet.
Waarom Meta hierop mikte
Muse Glimmer is een gedestilleerde en gekwantiseerde versie van Meta's gesloten vlaggenschip Muse Spark 1.2, uitgebracht door Meta Superintelligence Labs en specifiek afgestemd op altijd-aan, on-device agents: het aanroepen van tools, meerstapsredenering, foutherstel en retry, interleaved tekst- en beeldbegrip, en meer dan 100 talen. Meta's eigen cijfers plaatsen het voor op de Gemma 4-familie en Qwen3.6-27B bij verschillende agentische tests — MCP Atlas 75.5, DeepSearch QA 74.6, SWE-Bench Pro 51.2 — en net achter bij een paar andere. Dit alles is door de leverancier gerapporteerd en onafhankelijk niet gereproduceerd, en het is de moeite waard om het ronduit te zeggen: op de agentische benchmarks die Meta koos, staat Glimmer voor op de vorige Qwen-generatie, en op de benchmarks die het niet koos, staat Qwen nog steeds voor.
Twee dingen maken Glimmer opmerkelijk naast de scores. Ten eerste de licentie: Apache 2.0, geen MAU-clausule, geen drempel voor commerciële besprekingen — het meest permissieve dat Meta in lange tijd heeft uitgebracht, en het bijbehorende essay van Zuckerberg maakte de strategische gok expliciet. Ten tweede de toolchain vanaf dag één: llama.cpp, Hugging Face Transformers, Ollama, LM Studio en SGLang ondersteunden het allemaal bij of nabij de lancering, wat precies is wat een lokaal model nodig heeft om bruikbaar te zijn in plaats van alleen maar downloadbaar.

Meta heeft de tegenstander al gekozen.
Het nuttigste feit in Glimmers release voor deze vergelijking is tegen wie Meta heeft gebenchmarkt: Qwen3.6-27B, de directe voorganger van Qwen3.8-27B. Op Meta's eigen tabel wint Glimmer nipt van de Qwen 27B op SWE-Bench Pro (51,2 tegen 50,2) en blijft het erop achter bij SWE-Bench Verified (76,0 tegen 77,2), en Qwen leidt op OSWorld-Verified, Terminal-Bench 2.1 en de meeste multimodale benchmarks. Met andere woorden, de twee families wisselen klappen uit op de lokale 27–30B-schaal, en de 3.8-generatie van de Qwen-kant is het vervolg op precies het model dat Meta als referentiepunt gebruikte. Dat is de echte kop van deze matchup: de 27B is geen hypothetische concurrent van Glimmer, het is de volgende versie van de gevestigde speler, en Meta heeft ons al verteld hoe dicht de basislijn ligt.
Wat is er nog niet geverifieerd aan de Qwen-kant?
Totdat de repository uitkomt, is de Qwen3.8-27B-kolom grotendeels een rij vraagtekens: of het model dense of MoE is, de contextvenster, of het multimodaal is, en cruciaal: de licentie. De licentie is de vraag die deze vergelijking op zichzelf kan beslissen — een model met een Tongyi Qianwen-licentie is een ander inkoopbesluit dan een met Apache 2.0, zeker voor commerciële producten boven de MAU-drempel. Er bestaan nog geen benchmarkscores voor de 27B, en de door de leverancier gerapporteerde cijfers voor de bredere 3.8-generatie horen bij de Max, niet bij de 27B.

Welke moet je kiezen?
Als je vandaag een werkend lokaal agentmodel nodig hebt, ligt de beslissing voor de hand: Meta Muse Glimmer bestaat, draait op een 24 GB-kaart, heeft runtime-ondersteuning vanaf dag één en is Apache 2.0. Qwen3.8-27B is een belofte. Als je al gestandaardiseerd bent op het Qwen-ecosysteem, of als je vereiste een specifieke benchmark is waarvan de 3.8-generatie naar verwachting de score zal verbeteren, dan is de 27B het wachten waard — maar het wachten heeft reële opportuniteitskosten, en de licentie zou je antwoord kunnen veranderen nadat de 27B uitkomt.
Teams die noch het wachten noch de lock-in willen, hebben een middenweg. OrcaRouter routeert meer dan 200 modellen via één API tegen de lijstprijs van de provider, zonder opslag en met automatische failover — Qwen3.8 Max staat er vandaag op voor $2,00/$6,00 per miljoen tokens, en Meta's eigen gesloten Muse Spark-lijn is bereikbaar met dezelfde sleutel. Wanneer de 27B uitkomt en vertrouwen wint op onafhankelijke benchmarks, is failover de manier om het tegen een productiewerklast uit te proberen zonder de hele route op een onbewezen model te wedden: stuur een deel van het verkeer ernaartoe, houd de rest bij het huidige model, en laat het echte gebruik beslissen.

Geen van beide zijden is nog onafhankelijk gecontroleerd — Glimmers cijfers zijn Meta's, en de 27B heeft helemaal geen cijfers. De eerlijke score na de eerste week: Glimmer is het model dat je daadwerkelijk kunt draaien, de 27B is degene waarmee je het over een maand zult vergelijken, en het is het licentiebestand, niet de benchmarktabel, dat de beslissing van een team het meest waarschijnlijk zal doen omslaan.
