Qwen 3.8 vs Claude Fable 5: De 0902-build neemt de leiding op het gebied van coderen
Guides & Insights

Qwen 3.8 vs Claude Fable 5: De 0902-build neemt de leiding op het gebied van coderen

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Toen Alibaba Qwen3.8-Max previewde in Shanghai op 19 juli 2026, deed het één bewering luider dan alle andere: dit model met 2,4 biljoen parameters zit dicht bij fronterniveau en staat slechts achter Claude Fable 5. Op dat moment was dat onmogelijk te beoordelen. Er was geen prijslijst, geen benchmarktabel en geen licentie — alleen een positioneringsverklaring.

Op 3 augustus 2026 werd Qwen3.8-Max algemeen beschikbaar — een echte prijslijst van $2 / $6 per miljoen tokens, een benchmarktabel met cijfers, en een endpoint dat compatibel is met OpenAI en DashScope. Op 2 september leverde Alibaba de volgende stap zonder het versienummer te wijzigen: Qwen3.8-Max-0902, een post-training-refresh gericht op programmeren en agentisch werk, die debuteerde op #1 van de Code Arena: WebDev-ranglijst met 1.691 Elo. Claude Fable 5, het model waarachter Alibaba zich in juli direct positioneerde, staat op 1.628 op dezelfde ranglijst. De vraag van juli is aangescherpt: is Qwen 3.8 nog steeds 'alleen tweede na Fable 5', of is de programmeer-as al omgedraaid?

Een tip voor ontwikkelaars — de snelste manier om een dergelijke claim te beslechten is door beide modellen op je eigen prompts te draaien. OrcaRouter plaatst 200+ modellen achter één OpenAI-compatibel endpoint, zodat je Qwen 3.8 Max tegen Fable 5 kunt laten strijden op dezelfde taak zonder twee SDK's te integreren.

TL;DR-oordeel. Qwen3.8-Max-0902 is tot nu toe de sterkste versie van Alibaba’s vlaggenschip met 2,4 biljoen parameters, en het nieuwe onderdeel van zijn bewijsvoering is niet langer louter een eigen claim: het debuteerde op #1 van de onafhankelijke Code Arena: WebDev-ranglijst met 1.691 Elo, boven Claude Fable 5 (1.628, #8) op die ranglijst. De prijs is ongewijzigd en nog altijd doorslaggevend — tegen een vast tarief van $2 / $6 per 1M tokens onderbiedt Qwen de $10 / $50 van Fable 5 met ruwweg 5× op input en 8× op output. Wat niet is gedicht, is de kloof in algemene prestaties: Artificial Analysis geeft Qwen3.8-Max een score van 56 op de Intelligence Index, tegenover 62 voor Claude Fable 5. En op de algemene Arena-ranglijst staat Fable 5 in de laatst gepubliceerde week (24–30 aug) op #1 (1.508 Elo), terwijl Qwen3.8-Max op #20 staat (1.479). Er zijn dus twee oordelen: op het vlak van coderen heeft de 0902-refresh van Qwen nu een scheidsrechter en een overwinning; op breed en onafhankelijk getoetst redeneren houden Claude Fable 5 — en de nieuwere Claude Fable 5.1 van Anthropic, die de AA-index met 66 aanvoert — nog altijd stand.

Belangrijkste conclusies

Qwen3.8-Max bereikte GA op 3 augustus 2026 en de 0902-refresh volgde op 2 september — geen versieverhoging, dezelfde tariefkaart van $2 / $6, dezelfde context van 1M tokens.

Het prijsverschil is enorm: Qwen voor $2 / $6 per 1M versus Fable 5 voor $10 / $50. Dat is ~5× op input en ~8× op output, en het tarief van Qwen is gelijk voor de volledige 1M-token context, zonder opslag voor lange prompts.

Beide kanten hebben nu onafhankelijke scores — en die wijzen in verschillende richtingen. Qwen3.8-Max scoort 56 op de Artificial Analysis Intelligence Index (Claude Fable 5: 62), en zijn 0902-build voert Code Arena: WebDev aan met 1.691 Elo tegen de 1.628 van Fable 5.

De eigen benchmarktabel van Qwen is nog steeds sterk en nog steeds door de leverancier geproduceerd. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — maar de update van 2 september is het eerste Qwen-resultaat dat een onafhankelijke arena op #1 heeft geplaatst.

De architectuurkloof in het specificatieblad is gesloten. Qwen3.8-2.4T-A95B heeft ~95B actieve parameters van in totaal 2.4T, verspreid over 512 experts — bekendgemaakt met de open-weights-release van 12 augustus. De architectuur van Fable 5 blijft onbekend.

Open gewichten zijn er, niet alleen beloofd. Qwen3.8-2.4T-A95B (BF16 en FP8) is op 12 augustus beschikbaar gekomen op Hugging Face en ModelScope onder een aangepaste Qwen3.8-Max-licentie. Qwen3.8-27B volgde op 14 augustus onder Apache 2.0. Fable 5 is permanent gesloten en uitsluitend via API beschikbaar.

Nauwkeurigheidsopmerking: cijfers uit Alibaba's eigen benchmarktabel blijven door de leverancier gerapporteerd en niet gerepliceerd. Onafhankelijke cijfers hier zijn voorzien van tijdstempels en zijn van derden: de Artificial Analysis Intelligence Index (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), de Code Arena: WebDev Elo-lijst, en het algemene Arena-weekbord — arena-scores verschuiven naarmate er stemmen bijkomen, en de #1 van de 0902-build is volgens Alibaba's aankondiging van een momentopname-lijst. Fable 5's 95,0% SWE-bench Verified is door Anthropic gerapporteerd; Qwen's prijzen komen uit de GA-prijslijst van Alibaba Model Studio.

De specificaties en prijs, naast elkaar

Hier zijn de harde gegevens, elk cijfer met vermelding van de bron.

• Fabrikant / status — Qwen3.8-Max: Alibaba; GA 3 augustus 2026; 0902-refresh 2 september 2026. Claude Fable 5: Anthropic; GA-vlaggenschip.

• Architectuur — Qwen3.8-Max: 2.4T totaal / ~95B actief, sparse MoE, 512 experts (bekendgemaakt op 12 aug.); Fable 5: niet bekendgemaakt

• Contextvenster — Qwen3.8-Max: 1M tokens (983.616 met denken; maximale output 131.072); Fable 5: vlaggenschip met lange context

• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (Sep 1): 66, staat aan kop.

• SWE-bench Verified — Qwen3.8-Max: Niet gerapporteerd (Alibaba rapporteert in plaats daarvan FrontierSWE 73.5); Fable 5: 95,0% (Anthropic / buildfastwithai)

• Onafhankelijke + door leverancier gerapporteerde sterke punten — Qwen3.8-Max: Code Arena WebDev #1 op 1.691 (0902, onafhankelijk); leverancierstabel: GPQA Diamond 92,6, PaperBench 93,0, Terminal-Bench 2.1 86,6. Claude Fable 5: AA 62; SWE-bench Verified 95,0%

• Prijzen (in / uit) — Qwen3.8-Max: $2.00 / $6.00 per 1M, vast voor 1M context; gecachte invoer $0.25; Fable 5: $10 / $50 per 1M

• Open gewichten — Qwen3.8-Max: uitgebracht op 12 augustus 2026 (aangepaste licentie, niet Apache); Qwen3.8-27B onder Apache 2.0 op 14 augustus. Fable 5: nee — gesloten / alleen API

• Multimodaliteit — Qwen3.8-Max: tekst, beeld, video in → tekst uit; Fable 5: multimodaal vlaggenschip

Twee zaken zijn bepalend voor de hele vergelijking. De eerste veranderde op 3 augustus en geldt nog steeds; de tweede veranderde opnieuw op 2 september.

Ten eerste, de prijskolom is nu het opvallendste element op de pagina. In juli was het kostenvoordeel van Qwen een kortingsbon — 90% korting op credits, tijdelijk, zonder een tarief per token om tegen te plannen. Nu is het een prijslijst, en het verschil is structureel in plaats van promotioneel. Bij $6 output tegenover Fable's $50 kun je voor de prijs van één Fable-aanroep grofweg acht Qwen-aanroepen uitvoeren. Voor elke workload waarbij je betaalt voor volume in plaats van voor het enige moeilijkste antwoord, verandert die verhouding de architectuur van wat je bouwt.

Ten tweede is de benchmarkkolom niet langer eenzijdig. Gedurende het grootste deel van augustus was de eerlijke inschatting beperkt: Alibaba rapporteerde een score van 73,5 op FrontierSWE en een tabel met zelfgedraaide cijfers; Anthropic rapporteerde een door een derde partij gecontroleerde score van 95,0% op SWE-bench Verified; en geen enkele onafhankelijke evaluator had Qwen ook maar een score toegekend. De 0902-build maakte daaraan een einde. Code Arena: WebDev is een blinde arena waarin mensen paarsgewijs stemmen — het project dat voorheen WebDev Arena heette en door niemand van Alibaba wordt gerund — en Qwen3.8-Max-0902 kwam er op #1 binnen met 1.691 Elo, boven Claude Opus 5 (1.688), Kimi K3 (1.674) en Claude Fable 5 (1.628, #8). Twee kanttekeningen zorgen ervoor dat deze vergelijking eerlijk blijft: het is één leaderboard waarop agentische front-endontwikkeling wordt gemeten in plaats van algemene capaciteit, en “debuteerde op #1” is Alibaba’s aankondiging van een momentopname van het leaderboard. Maar de bewering dat Qwen helemaal geen scheidsrechter heeft, is niet langer waar, en dat verandert de vergelijking meer dan welk getal op dat leaderboard ook.

Wat het prijsverschil je eigenlijk oplevert

Abstracte veelvouden zijn minder nuttig dan een uitgewerkt voorbeeld, dus hier is er een. Neem een code-review-agent die 150.000 tokens aan repository-context verstuurt en 6.000 tokens aan review genereert per aanroep.

Qwen3.8-Max: 0.15M × $2 = $0.30, plus 0.006M × $6 = $0.036. ≈ $0.34 per aanroep.

Claude Fable 5: 0,15M × $10 = $1,50, plus 0,006M × $50 = $0,30. ≈ $1,80 per aanroep.

• Bij 2,000 oproepen/dag: Qwen ≈ $672/dag; Fable ≈ $3,600/dag. Over een maand is dat ruwweg $20,000 tegenover $108,000.

• Met prompt-caching in een stabiele repo-context verlaagt Qwens gecachte invoer van $0,25/1M de invoerkant van $0,30 tot onder $0,04, waardoor de aanroep uitkomt op ≈ $0.08 — ongeveer 22× goedkoper dan Fable per aanroep.

Dat is geen marginale besparing; het is het verschil tussen het inzetten van een reviewer op elke pull request en het inzetten van een reviewer op de risicovolle. En de vaste contextprijs van Qwen maakt het effect sterker naarmate prompts groeien: omdat Alibaba geen toeslag voor lange prompts toepast, kost het doorvoeren van een context van 900.000 tokens per token hetzelfde als een context van 5.000 tokens.

Het eerlijke tegenwicht is dat de prijs per token niet de prijs per opgeloste taak. Als Fable 5 een probleem in één keer oplost terwijl een goedkoper model drie pogingen plus menselijke correctie nodig heeft, kan het goedkopere model in totaal duurder uitvallen — en bij het moeilijkste redeneerwerk is de gecontroleerde #1-ranking van Fable het beste beschikbare bewijs dat het inderdaad meer in één keer oplost. Het kostenargument voor Qwen is het sterkst bij workloads met een hoog volume en tolerantie, en het zwakst bij workloads met een laag volume en hoge inzet.

De 0902-benaming: de functionaliteit schoot omhoog, het versienummer niet.

Het opmerkelijke aan 2 september is wat Alibaba niet deed: Qwen 3.9 uitbrengen. De verbetering werd uitgebracht als een gedateerd checkpoint onder dezelfde modelnaam — Qwen3.8-Max-0902 — en de API leverde het onder dezelfde naam en tegen dezelfde prijs. Dit is de richting die de industrie opgaat: wanneer een capaciteitssprong geen nieuw versienummer meer garandeert, wordt 'welk model moet ik gebruiken' een vraag over builds en datums, niet alleen over familienamen.

Het betekent ook dat een benchmarkscore die aan “Qwen3.8-Max” is gekoppeld een beperkte houdbaarheid heeft: een score die is gemeten tegen de build van juli of augustus beschrijft mogelijk niet het model dat de API vandaag retourneert. Controleer de build-ID op het endpoint dat je daadwerkelijk aanroept — het getal 0902 is het verschil tussen een model dat achterliep op Claude Fable 5 en een model dat vooroploopt op Code Arena: WebDev.

Bewijs, en waarom het deze matchup nog steeds beslist

Het meest aangehaalde praktijkbewijs voor Qwen3.8-Max komt van een review uit de previewperiode (thomas-wiegold.com) die het model door vier echte builds liet draaien. De resultaten waren ronduit indrukwekkend: Qwen voltooide in één keer een Go-pokersimulatie — slechts het derde model ooit dat die prompt in één keer wist te volbrengen, naast Fable 5 en Grok 4.5 — en bij een prompt voor een koffiebranderwebsite leverde het de beste output op die de reviewer ooit uit die test had gezien, waarbij het uit pure grondigheid een niet gevraagde winkelwagen, groothandelsectie en Instagram-integratie toevoegde.

Het probleem was de snelheid: 30+ minuten op de website en 1 uur 20 minuten op de pokersimulatie, waarmee het het traagste model was dat die recensent had gebruikt. Die bevinding behoeft nu een kanttekening die in juli nog niet nodig was. Het werd gemeten op preview-infrastructuur, door één recensent, tijdens uitzonderlijk lange agentische runs. GA-serving is een ander systeem. Voor wat het waard is: OrcaRouter's eigen 7-daagse telemetrie toont momenteel een p50-time-to-first-token van 1,64 seconden voor Qwen3.8-Max — een first-party-meting, hoewel TTFT en end-to-end-doorvoer bij builds van een uur verschillende grootheden zijn. Het eerlijke standpunt is dat de bevinding over de trage preview opnieuw getest zou moeten worden in plaats van herhaald als actueel feit.

Wat na de 0902-update overeind blijft, is dat het sterkste bewijs aan beide zijden nog steeds uit verschillende hoeken komt. De nummer 1 van Qwen3.8-Max-0902 op Code Arena: WebDev is een onafhankelijke uitslag op basis van blind stemmen, maar die heeft slechts betrekking op één ranglijst, en Alibaba's eigen benchmarktabel blijft een artefact van de leverancier — labs kiezen zelf welke benchmarks ze rapporteren, en Alibaba's laagste gerapporteerde score (IFBench 82,8, instructie-opvolging) komt nog steeds overeen met de klacht uit de preview dat het model meer levert dan nodig en zich niet aan de reikwijdte houdt. Het bewijs voor Claude Fable 5 is breder en komt grotendeels van derden: 62 op de AA Intelligence Index, nummer 1 op de algemene Arena-ranglijst, 95,0% SWE-bench Verified — en Anthropic's eigen nieuwere Claude Fable 5.1 heeft sinds 1 september de AA-index aangevoerd met 66. Bij de vraag “welk model kan werk aan dat ik me niet kan veroorloven te verknoeien?” blijft het antwoord voor algemeen gebruik ongewijzigd. Bij de vraag “welk model levert de beste front-end voor een tiende van de prijs?” sloeg dat antwoord op 2 september om.

Openheid: de as waarop Qwen al heeft gewonnen.

Fable 5 zal nooit zelf te hosten zijn. Qwen3.8-Max is dat al wel: op 12 augustus verschenen de gewichten voor Qwen3.8-2.4T-A95B — BF16 en een officiële FP8-variant — op Hugging Face en ModelScope, waarmee het de eerste Max-klasse Qwen is die iedereen kan downloaden. Twee kanttekeningen wegen even zwaar.

Het eerste is legaal. De release wordt uitgebracht onder een aangepaste “Qwen3.8-Max”-licentie, niet onder Apache 2.0: aanbieders die model-as-a-service- of AI-werkassistent-bedrijven runnen met een omzet van meer dan $50M over de afgelopen periode, moeten met Qwen over een aparte licentie onderhandelen, en commerciële producten die meer dan 100M maandelijkse actieve gebruikers of $20M maandelijkse omzet behalen, moeten de modelnaam vermelden. Voor intern gebruik en startups zijn de drempels zelden bindend — maar dit is geen vrijbrief.

De tweede is fysiek. Een MoE met in totaal 2,4T parameters komt neer op ongeveer 4,9 TB in BF16 (ongeveer de helft in de officiële FP8-checkpoint) tegenover ongeveer 141 GB geheugen per H200 — dus het zelf hosten van het vlaggenschip betekent een rek vol acceleratoren voordat je ook maar één token serveert. De bekendgemaakte ~95B actieve parameters laten je tenminste inschatten wat dat rek zou opleveren. Voor bijna elk team is de gehoste API voor $2 / $6 de praktische weg.

Daarom blijft Qwen3.8-27B, waarvan de Apache-2.0-gewichten op 14 augustus volgden en die naar verluidt draait in ~17GB VRAM, de praktisch belangrijke self-hostrelease. Als uw reden om Qwen boven Fable 5 te verkiezen data-residentie of on-premisecontrole is, in plaats van ruwe capaciteit, dan is de 27B het model dat dat daadwerkelijk levert — en aan beide kanten is de vergelijking op het gebied van openheid niet langer theoretisch.

Veelgestelde vragen

Is Qwen 3.8 beter dan Claude Fable 5?

Het hangt nu af van de as, wat een echte verandering is ten opzichte van augustus. Op het gebied van coderen leidt Qwen3.8-Max-0902: #1 op Code Arena: WebDev met 1.691 Elo tegen Claude Fable 5’s 1.628, voor $2 / $6 versus Fable 5’s $10 / $50. Op brede, gecontroleerde kwaliteit leidt Fable 5 nog steeds: 62 op de AA Intelligence Index tegen Qwen’s 56, 95,0% SWE-bench Verified, en #1 op het algemene Arena-bord. Voor werk waarbij een fout antwoord duur is, is Fable 5 de beter gedocumenteerde keuze; voor grootschalige codering en agentisch webwerk is de nieuwste Qwen zowel goedkoper als hoger gerangschikt op Arena.

Is de bewering 'alleen achter Fable 5' waar?

Alibaba’s positionering is tot stand gekomen zonder onafhankelijke cijfers, en de 0902-build is sindsdien van vorm veranderd. Qwen3.8-Max-0902 staat hoger dan Claude Fable 5 op Code Arena: WebDev (1.691 tegen 1.628), maar lager op de AA Intelligence Index (56 tegen 62) en op de algemene Arena-ranglijst (Qwen #20 op Elo 1.479; Fable 5 #1 op 1.508). Dus “alleen Fable 5 doet beter” is veranderd in “hoger dan Fable 5 op de coderanglijst waarop deze refresh was gericht, maar lager dan Fable 5 op de brede algemene ranglijsten”.

Hoeveel goedkoper is Qwen 3.8 dan Fable 5?

Substantieel, en het is nu een reëel tarief in plaats van een korting. Qwen3.8-Max is $2 / $6 per 1M tokens vergeleken met Fable 5's $10 / $50 — ongeveer 5× goedkoper voor input en 8× voor output. Qwen's tarief is ook gelijk over de volledige 1M-context, en gecachte input tegen $0.25/1M maakt workloads met herhaalde context nog goedkoper.

Is Qwen 3.8 Max uit preview gegaan?

Ja. Het werd algemeen beschikbaar op 3 augustus 2026 met een gepubliceerde tariefkaart en een OpenAI- en DashScope-compatibel eindpunt. De Qoder-creditscampagne en de preview-framing met 90% korting die in juli circuleerden, beschrijven niet langer hoe het model wordt verkocht.

Is Qwen 3.8 nog steeds het langzaamste model, zoals vroege recensies zeiden?

Die bevinding kwam van één reviewer op preview-infrastructuur die uur lange agentische builds draaide, en het zou opnieuw getest moeten worden tegen GA-serving in plaats van als huidig feit te worden behandeld. De 7-daagse telemetrie van OrcaRouter toont een p50 time-to-first-token van 1,64 seconden, hoewel dat de first-token-latentie meet in plaats van de doorvoer bij zeer lange builds.

Kan ik Qwen 3.8 zelf hosten in plaats van te betalen voor Fable 5?

Ja voor Qwen, met kanttekeningen. Qwen3.8-2.4T-A95B is sinds 12 augustus downloadbaar onder een aangepaste licentie (niet Apache 2.0), en Qwen3.8-27B onder Apache 2.0 sinds 14 augustus. De praktische barrière is hardware: een MoE van in totaal 2,4T heeft grofweg 4,9TB in BF16 nodig — een rack vol versnellers — dus de meeste teams zullen nog steeds de gehoste API aanroepen voor $2 / $6 in plaats van het vlaggenschip te draaien. Fable 5 is permanent gesloten.

Welke moet ik vandaag gebruiken?

Voor algemeen werk waarbij een fout antwoord duur is — complex redeneren, productieprocessen met hoge inzet — is Claude Fable 5 nog steeds de beter gedocumenteerde keuze, en Anthropic's Claude Fable 5.1 vergroot die voorsprong. Voor codeerwerk met hoge volumes en agentische webontwikkeling heeft Qwen3.8-Max-0902 nu de onafhankelijke arena-voorsprong en een outputprijs die ruwweg 8× lager ligt: bulkcode-review, front-endgeneratie, analyse van lange documenten. Veel teams zouden beide moeten draaien en per taak moeten routeren.

Kortom

De vergelijking tussen Qwen 3.8 en Claude Fable 5 is anders dan een maand geleden, en weer anders dan een week geleden. Qwen3.8-Max is een algemeen beschikbaar model met een prijslijst die Fable 5 onderbiedt met 5× op input en 8× op output, gelijk over een miljoen tokens — en sinds 2 september staat dezelfde naam voor de 0902-build, die een onafhankelijke arena nu op #1 plaatst voor agentische webontwikkeling, boven Fable 5 op dat leaderboard.

Geen van beide modellen domineert nu het hele vergelijk. Claude Fable 5 — en Anthropic's Claude Fable 5.1, die sinds 1 september de AA Intelligence Index op 66 aanvoert — houden het brede, gecontroleerde, algemene terrein, en Alibaba's eigen benchmarktabel blijft een leveranciersartefact. Maar de reden dat deze vergelijking in juli zo scheef was — dat Qwen helemaal geen onafhankelijke scheidsrechter had — is op 2 september vervallen: Qwen3.8-Max-0902 is het #1-model op Code Arena: WebDev. Het verstandige antwoord is nog steeds om te splitsen op inzet en taak — Fable 5 voor algemeen redeneren waar fouten duur zijn, Qwen3.8-Max voor hoogvolume coderen waar zowel het prijsverschil als de arena-rand in zijn voordeel werken — en om beide te testen met je eigen prompts.

Vergeleken in dit artikel3

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt