Een titelkaart voor het Qwen3.8-27B- en Artificial Analysis-artikel: een vergrootglas dat boven een chip zweeft met een lege scorekaart 'wachtend op gegevens', getiteld 'Qwen3.8-27B op Artificial Analysis' met de ondertitel 'Nog geen onafhankelijke score — hier zijn de gegevens die in de plaats komen'.
Guides & Insights

Qwen3.8-27B op Artificial Analysis: Nog geen index, en de gegevens die als vervanging dienen

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Artificial Analysis heeft Qwen3.8 27B niet geïndexeerd. Gecontroleerd op 15-08-2026: de modelpagina op artificialanalysis.ai geeft een 404 — geen Intelligence Index, geen outputsnelheid, geen AA-prijs, geen onafhankelijke benchmark. De Apache 2.0-gewichten zijn op 13–14 augustus uitgebracht, dus dat zal waarschijnlijk binnen dagen of weken veranderen; het is nog niet veranderd. Tot die tijd is elk Qwen3.8 27B-cijfer dat je vindt afkomstig van Ali​baba's eigen modelkaart of van een nieuwsmedium dat het herhaalt. Hier is het antwoord in één zin, de AA-gegevens die er wél zijn voor de Qwen3.8-familie, de officiële specificaties en een eerlijke lezing van wat de koppen 'het verslaat alles' werkelijk betekenen.

Bronvermelding: alles hieronder is gelabeld. Officieel betekent overgenomen van Ali​baba's Qwen/Qwen3.8-27B modelkaart op Hugging Face (augustus 2026). Onafhankelijk betekent gemeten en gereproduceerd door een externe partij — niets voor de 27B komt daarvoor nog in aanmerking. Doorgegeven betekent dat een nieuwsmedium cijfers van de leverancier overneemt, wat niet onafhankelijk is.

Het eenregelige antwoord, gedateerd

Qwen3.8 27B op Artificial Analysis: geen pagina, geen score. De URL artificialanalysis.ai/models/qwen-3-8-27b gaf "404 Page not found" terug bij controle op 2026-08-15.

• De "Qwe​n 3.8" AA-scores die online circuleren — Intelligence 58, Agentic Index #1 — behoren toe aan Qwen3.8-Max, het API-vlaggenschip met 2,4 biljoen parameters. Niet de 27B.

• De meest recente 27B die AA bijhoudt is de voorganger Qwen3.6-27B: Intelligentie-index ~37–38 in redeneermodus, ~55–59 tokens/sec output. Dat is je uitgangspunt voor hoe een geïndexeerde 27B eruitziet.

A status card for Qwen3.8-27B on Artificial Analysis, checked 2026-08-15: the model is marked NOT INDEXED (no page, no score, no price; the model URL returns 404), while Qwen3.8-Max 2.4T A95B is indexed at Intelligence 58 and Agentic Index #1, and the predecessor Qwen3.6-27B is indexed at Intelligence ~37–38 and ~55–59 tokens/sec.

Wat Artificial Analysis feitelijk toont voor de Qwen3.8-familie

Het leaderboard van AA vermeldt "Qwen3.8 2.4T A95B" — dat is Qwen3.8-Max — op Intelligence Index 58, het op één na beste open-weights model op de index (pagina met Artificial Analysis-modellen, geraadpleegd op 2026-08-15). Op 6 augustus 2026 plaatste AA's Agentic Index Qwen3.8-Max op #1 wereldwijd — de eerste keer dat een Chinees lab de top bereikte, vóór Claude Opus 5 en GPT-5.6 — zoals die dag breed werd gerapporteerd op basis van AA's leaderboard.

Geen van die getallen zijn van toepassing op de 27B. Qwen3.8-Max is een mixture-of-experts API-model met 2,4T parameters en ongeveer 95B actieve parameters; de 27B is een dense, zelf-hostbare download. Ze delen een generatielabel, geen evaluatie.

De voorganger is uw baseline: Qwen3.6-27B op AA

AA volgt Qwen3.6-27B al maanden. Afhankelijk van de snapshot scoort het ~37–38 op de Intelligence Index in reasoning-modus (rond de 31 in niet-reasoning-modus) bij ~55–59 tokens/sec — een single-GPU-model dat zijn mannetje staat tegenover mid-tier frontier-modellen van een jaar geleden. Dat is de vorm van data die je kunt verwachten wanneer AA de 3.8-27B indexeert: een index in dezelfde orde van grootte, een snelheid op consumentenhardware, en een prijs die vooral de hostingkeuze weerspiegelt. Zie het als een basislijn, niet als een voorspelling — de 3.8-27B voegt hybride aandacht en native video-invoer toe, waarvan elk de cijfers zou kunnen beïnvloeden.

De officiële gegevens: Alibaba's modelkaart, niet onafhankelijk.

A data card for Qwen3.8-27B from Alibaba's official model card: specifications (27B dense, 28B with vision encoder, 64 layers, hidden size 5,120, vocabulary 248,320, 48 linear + 16 full attention heads, 262K native to 1M context via YaRN, text+image+video input, ~55.6 GB BF16) and vendor-reported benchmarks (Terminal-Bench 2.1 73.0, SWE-bench Pro 61.7, LiveCodeBench v6 90.3, GPQA Diamond 89.2, OSWorld-Verified 84.3), labeled Alibaba-reported, unreproduced.

Dit zijn de geverifieerde specificaties van de Qwen/Qwen3.8-27B-modelkaart (Apache 2.0, augustus 2026):

• 27B dense parameters (28B met de vision-encoder), 64 lagen, verborgen grootte 5.120, vocabulaire 248.320.

• Hybride aandacht: 48 lineaire-aandachtskoppen (Gated DeltaNet) plus 16 volledige Gated Attention-koppen — ruwweg een 3:1-verdeling lineair-volledig.

• Context: 262,144 tokens native, uitbreidbaar tot 1,000,000 via YaRN.

• Invoer: tekst, afbeelding en video native; denkmodus standaard ingeschakeld.

• Grootte: ~55,6 GB in BF16; ~16–17 GB aan gewichten bij Q4 — een 24 GB GPU is het praktische doel voor een enkele kaart.

Door de leverancier gerapporteerde benchmarks van dezelfde kaart (Alibaba's woord, niet gereproduceerd): Terminal-Bench 2.1 73.0; SWE-bench Pro 61.7; LiveCodeBench v6 90.3; GPQA Diamond 89.2; OSWorld-Verified 84.3.

Wat de koppen "het verslaat alles" eigenlijk zijn

Een Chinese technieuwsaggregator (Gate.it, half augustus 2026) opent met "Qwen3.8 27B verslaat Meta's Muse Glimmer op alle 8 benchmarks" — Terminal-Bench 2.1 73.0 tegen 51.7, SWE-bench Pro 61.7 tegen 51.2 — en claimt overwinningen op Claude Opus 4.6 in 15 van de 19 overlappende tests. Die cijfers zijn de modelkaartcijfers van Ali​baba, overgenomen in een nieuwssamenvatting. Geen extern lab heeft de 27B getest, en de aggregator beweert ook niet dat dat is gebeurd. "Third-party coverage" betekent hier herhaling door derden, niet verificatie door derden.

A screenshot of the Qwen/Qwen3.8-27B model card on Hugging Face, showing the Apache 2.0 license, the model type 'Causal Language Model with Vision Encoder', BF16 tensor type, the note that the Qwen Cloud hosted version is coming soon with 1M context, and 4 adapters, 46 finetunes and 304 quantizations.

Waarom de 27B geen AA-prijs heeft — en wat dat je vertelt

AA prijst modellen per API-endpoint. De 27B heeft nog geen officiële gehoste API: de hosting van Ali​baba's Qwe​n Cloud is "binnenkort beschikbaar" met een context van 1M tokens. Er valt niets te prijzen. Dat is het echte contrast in de kern van dit model. Qwen3.8 27B is een download met open gewichten; de prijs is je elektriciteitsrekening. Met Q4 op een 24 GB-kaart kost het $0 per token. Het alleen-API-vlaggenschip Qwen3.8-Max is $2 per miljoen input / $6 per miljoen output. Een zelf-gehost model verschijnt niet in een API-prijsindex juist omdat het gratis is per token — de tegenovergestelde situatie van elk API-model dat AA prijst.

Wat te gebruiken totdat AA het indexeert

U wilt vandaag een onafhankelijk beoordeelde Qwe​n 27B: draai of bel Qwen3.6-27B. Het is AA-geïndexeerd (Intelligentie ~37–38 in redeneermodus), Apache 2.0, zelf-hostbaar, en het is het model dat de 3.8-27B moet verslaan. Als u het liever via een API aanroept dan het te draaien, staat het in de OrcaRouter-catalogus tegen de lijstprijs van de provider met 0% opslag — één sleutel, geen tweede contract.

Je wilt het API-vlaggenschip: Qwen3.8-Max heeft een AA-index van 58 en is Agentic #1, voor $2/$6 per 1M tokens. Je betaalt voor een 2.4T MoE, niet voor een lokaal model.

Je wilt specifiek de 3.8-27B: download de Apache-2.0-gewichten en host het zelf. Beschouw elke benchmark als het woord van Ali​baba totdat een onafhankelijke harness publiceert. Houd de AA-modelpagina (artificialanalysis.ai/models/qwen-3-8-27b) en de open harnesses in de gaten — wanneer een echt getal verschijnt, zal het duidelijk zijn.

De bottom line

Qwen3.8 27B heeft geen Artificial Analysis-score, omdat Artificial Analysis het niet heeft gemeten — en geen AA-prijs, omdat het een zelf-gehost model is, geen API. Elke "Qwe​n 3.8 verslaat X"-kop die je vandaag kunt vinden, is Ali​baba's modelkaart in een nieuwscostuum. De cijfers die werkelijk onafhankelijk zijn in dit verhaal zijn die van de siblingmodellen: Qwen3.8-Max met Intelligence 58 en de #1 Agentic Index, en Qwen3.6-27B op ~37–38. Houd die als anker; behandel de eigen cijfers van de 27B als claims van de leverancier totdat een onafhankelijke partij ze draait. Kom terug — deze pagina zal veranderen op de dag dat AA publiceert.

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube