Qwen 3.8 vs Claude Fable 5: 0902-bygget tar ledningen inom kodning
Guides & Insights

Qwen 3.8 vs Claude Fable 5: 0902-bygget tar ledningen inom kodning

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

När Alibaba förhandsvisade Qwen3.8-Max i Shanghai den 19 juli 2026, framförde man ett påstående högre än alla andra: denna modell med 2,4 biljoner parametrar är nära frontlinjenivå och ligger bara efter Claude Fable 5. Vid den tidpunkten var det omöjligt att utvärdera. Det fanns ingen prislista, inga benchmarktabeller och ingen licens – bara ett positioneringsuttalande.

Den 3 augusti 2026 blev Qwen3.8-Max allmänt tillgänglig — en riktig prislista på 2/6 dollar per miljon tokens, en benchmarktabell med siffror och en OpenAI- och DashScope-kompatibel slutpunkt. Den 2 september levererade Alibaba nästa steg utan att ändra versionsnumret: Qwen3.8-Max-0902, en efterträningsuppdatering inriktad på kodning och agentiskt arbete som debuterade på första plats på Code Arena: WebDev-topplistan med 1 691 Elo. Claude Fable 5, modellen som Alibaba i juli positionerade sig direkt bakom, ligger på 1 628 på samma lista. Frågan från juli har skärpts: är Qwen 3.8 fortfarande ”näst efter Fable 5”, eller har kodningsaxeln redan vänt?

En notis till byggare — det snabbaste sättet att avgöra en sådan fråga är att köra båda modellerna på dina egna prompts. OrcaRouter erbjuder 200+ modeller bakom en OpenAI-kompatibel endpoint, så du kan ställa Qwen 3.8 Max mot Fable 5 på samma uppgift utan att koppla ihop två SDK:er.

TL;DR-slutsats. Qwen3.8-Max-0902 är den starkaste versionen hittills av Alibabas 2,4T-flaggskepp, och det nya inslaget i dess argumentation är inte längre självrapporterat: den debuterade som #1 på den oberoende topplistan Code Arena: WebDev med 1 691 Elo, före Claude Fable 5 (1 628, #8) på den listan. Priset är oförändrat och fortfarande avgörande – till $2 / $6 fast per 1M tokens ligger Qwen ungefär 5× under Fable 5:s $10 / $50 på input och 8× under på output. Det som inte har stängts är gapet i generell förmåga: Artificial Analysis ger Qwen3.8-Max 56 på sitt Intelligence Index mot Claude Fable 5:s 62, och på den allmänna Arena-topplistans senast publicerade vecka (24–30 aug) innehar Fable 5 #1 (1 508 Elo) medan Qwen3.8-Max ligger på #20 (1 479). Två slutsatser, alltså: inom kodning har Qwens 0902-uppdatering nu en domare och en seger; inom bred, oberoende granskad resonemangsförmåga håller Claude Fable 5 – och Anthropics nyare Claude Fable 5.1, som toppar AA-indexet med 66 – fortfarande ställningarna.

Viktiga slutsatser

Qwen3.8-Max nådde GA den 3 augusti 2026 och dess 0902-uppdatering följde den 2 september — ingen versionshöjning, samma $2 / $6-prislista, samma 1M-token-kontext.

Prisgapet är enormt: Qwen för $2 / $6 per 1M jämfört med Fable 5 för $10 / $50. Det är ~5× på indata och ~8× på utdata, och Qwens pris är konstant över hela 1M-token-kontexten utan extra avgift för långa promptar.

Båda sidorna har nu oberoende poäng — och de pekar åt olika håll. Qwen3.8-Max får 56 på Artificial Analysis Intelligence Index (Claude Fable 5: 62), och dess 0902-version toppar Code Arena: WebDev med 1 691 Elo mot Fable 5:s 1 628.

Qwens egen benchmarktabell är fortfarande stark och fortfarande producerad av leverantören. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — men 2 september-uppdateringen är det första Qwen-resultat som en oberoende arena har rankat som #1.

Arkitekturgapet i specifikationsbladet är stängt. Qwen3.8-2.4T-A95B har ~95B aktiva parametrar av totalt 2.4T, över 512 experter — offentliggjordes med open-weights-släppet den 12 augusti. Fable 5:s arkitektur är fortfarande inte offentliggjord.

Öppna vikter är ute, inte utlovade. Qwen3.8-2.4T-A95B (BF16 och FP8) publicerades på Hugging Face och ModelScope den 12 augusti under en anpassad Qwen3.8-Max-licens, och Qwen3.8-27B följde den 14 augusti under Apache 2.0. Fable 5 är sluten och endast tillgänglig via API, permanent.

Noggrannhetsanteckning: siffror från Alibabas egna benchmark-tabell förblir leverantörsrapporterade och inte oberoende replikerade. Oberoende siffror här är tidsstämplade och från tredje part: Artificial Analysis Intelligence Index (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), Code Arena: WebDev Elo-listan och den allmänna Arena-veckolistan — arenapoäng förändras i takt med att röster ackumuleras, och 0902-byggets #1 är enligt Alibabas tillkännagivande av en tidpunktsspecifik lista. Fable 5:s 95,0 % SWE-bench Verified är rapporterat av Anthropic; Qwens prissättning är GA-prislistan från Alibaba Model Studio.

Specarna och priset, sida vid sida

Här är de hårda uppgifterna, varje siffra med angiven källa.

• Tillverkare / status — Qwen3.8-Max: Alibaba; GA 3 augusti 2026; 0902-uppdatering 2 september 2026. Claude Fable 5: Anthropic; GA-flaggskepp

• Arkitektur — Qwen3.8-Max: 2,4T totalt / ~95B aktiva, gles MoE, 512 experter (offentliggjordes 12 aug); Fable 5: ej offentliggjord

• Kontextfönster — Qwen3.8-Max: 1M tokens (983 616 med tänkande; max utdata 131 072); Fable 5: flaggskepp för lång kontext

• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1 sep): 66, leder

• SWE-bench Verified — Qwen3.8-Max: Ej rapporterat (Alibaba rapporterar FrontierSWE 73.5 istället); Fable 5: 95.0% (Anthropic / buildfastwithai)

• Oberoende + leverantörsrapporterade styrkor — Qwen3.8-Max: Code Arena WebDev #1 på 1,691 (0902, oberoende); leverantörstabell: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%

• Priser (in / ut) — Qwen3.8-Max: $2.00 / $6.00 per 1M, fast över 1M kontext; cachad input $0.25; Fable 5: $10 / $50 per 1M

• Öppna vikter — Qwen3.8-Max: släppt 12 aug 2026 (anpassad licens, inte Apache); Qwen3.8-27B under Apache 2.0 14 aug. Fable 5: nej — stängd / endast API

• Multimodalitet — Qwen3.8-Max: Text, bild, video in → text ut; Fable 5: Multimodalt flaggskepp

Två saker ramar in hela jämförelsen. Den första ändrades den 3 augusti och gäller fortfarande; den andra ändrades igen den 2 september.

För det första, priskolumnen är nu det mest framträdande på sidan. I juli var Qwens kostnadsfördel en rabattkupong – 90 % rabatt på krediter, tillfälligt, utan ett pris per token att planera utifrån. Nu är det en prislista, och skillnaden är strukturell snarare än kampanjmässig. Med $6 i utdata mot Fables $50 kan du köra ungefär åtta Qwen-anrop för priset av ett Fable-anrop. För alla arbetsbelastningar där du betalar för volym snarare än för det enskilt svåraste svaret, förändrar den kvoten arkitekturen för det du bygger.

För det andra har benchmarkkolumnen slutat vara ensidig. Under större delen av augusti var den ärliga läsningen snäv: Alibaba rapporterade FrontierSWE 73,5 och en tabell med självgenomförda resultat, Anthropic rapporterade en tredjepartskontrollerad 95,0 % på SWE-bench Verified, och ingen oberoende utvärderare hade alls poängsatt Qwen. 0902-bygget ändrade på det. Code Arena: WebDev är en blind parvis arena med mänsklig röstning – projektet som tidigare kallades WebDev Arena, och som inte drivs av någon på Alibaba – och Qwen3.8-Max-0902 gick in där som #1 med 1 691 i Elo, ovanför Claude Opus 5 (1 688), Kimi K3 (1 674) och Claude Fable 5 (1 628, #8). Två förbehåll håller detta ärligt: det är en enda lista som mäter agentisk frontendutveckling snarare än generell förmåga, och ”debuterade som #1” är Alibabas tillkännagivande av en ögonblicksbild över listningen. Men påståendet att Qwen inte har någon domare alls är inte längre sant, och det förändrar jämförelsen mer än något enskilt nummer på den.

Vad prisskillnaden faktiskt ger dig

Att ge flera abstrakta exempel är mindre användbart än ett genomarbetat exempel, så här är ett. Ta en kodgranskningsagent som skickar 150 000 tokens av repositorykontext och genererar 6 000 tokens av granskning per anrop.

Qwen3.8-Max: 0.15M × $2 = $0.30, plus 0.006M × $6 = $0.036. ≈ $0.34 per anrop.

Claude Fable 5: 0.15M × $10 = $1.50, plus 0.006M × $50 = $0.30. ≈ $1.80 per anrop.

• Vid 2 000 samtal/dag: Qwen ≈ $672/dag; Fable ≈ $3 600/dag. Under en månad är det ungefär $20 000 jämfört med $108 000.

• Med prompt caching i en stabil repokontext sjunker Qwens cachade input (till $0.25/1M) inputsidan från $0.30 till under $0.04, vilket gör att anropet kostar ≈ $0.08 — ungefär 22× billigare än Fable per anrop.

Det är inte en marginell besparing; det är skillnaden mellan att köra en granskare på varje pull request och att köra en på de riskfyllda. Och Qwens enhetliga kontextpris förstärker effekten när promptarna växer: eftersom Alibaba inte tar ut något påslag för långa prompter, kostar det lika mycket per token att skicka en kontext på 900 000 tokens som en på 5 000 tokens.

Den ärliga motvikten är att pris per token inte är pris per löst uppgift. Om Fable 5 löser ett problem i en enda omgång där en billigare modell behöver tre försök plus mänsklig korrigering, kan den billigare modellen kosta mer totalt — och på det svåraste resonemangsarbetet är Fables granskade #1-ranking de bästa tillgängliga bevisen på att den faktiskt löser mer i en enda omgång. Kostnadsargumentet för Qwen är starkast för högvolymiga, toleranta arbetsbelastningar och svagast för lågvolymiga arbetsbelastningar med höga insatser.

0902-namngivningen: kapaciteten hoppade, versionsnumret gjorde inte det.

Det anmärkningsvärda med den 2 september är vad Alibaba inte gjorde: släppa Qwen 3.9. Förbättringen levererades som en daterad checkpoint under samma modellnamn — Qwen3.8-Max-0902 — och API:et serverade den under samma namn och till samma pris. Det är åt det hållet branschen driver: när ett kapacitetssprång inte längre garanterar ett nytt versionsnummer blir frågan "vilken modell ska jag använda" en fråga om byggen och datum, inte bara familjenamn.

Det innebär också att ett benchmarkresultat kopplat till ”Qwen3.8-Max” har en begränsad hållbarhet: ett resultat som mätts mot juli- eller augustibygget kanske inte beskriver den modell som API:et returnerar idag. Kontrollera byggidentifieraren på den slutpunkt du faktiskt anropar — 0902-numret är skillnaden mellan en modell som låg efter Claude Fable 5 och en som ligger före den på Code Arena: WebDev.

Bevis, och varför det fortfarande avgör denna matchup.

Det mest citerade praktiska beviset för Qwen3.8-Max kommer från en recension från förhandsperioden (thomas-wiegold.com) som testade modellen på fyra verkliga byggen. Resultaten var genuint imponerande: Qwen löste en Go-pokersimulering på första försöket — endast den tredje modellen någonsin att klara den prompten i ett enda pass, tillsammans med Fable 5 och Grok 4.5 — och på en prompt för en kaffebrännarwebbplats producerade den det bästa resultat recensenten någonsin hade sett från det testet, genom att av ren grundlighet lägga till en oombedd varukorg, grossistsektion och Instagram-integration.

Haken var hastigheten: 30+ minuter på webbplatsen och 1 timme 20 minuter på pokersimuleringen, vilket gjorde den till den långsammaste modell som den granskaren hade använt. Det fyndet behöver ett förbehåll nu som det inte behövde i juli. Det mättes på preview-infrastruktur, av en granskare, på ovanligt långa agentiska körningar. GA-tjänsten är ett annat system. För vad det är värt visar OrcaRouters egen 7-dagars telemetri för närvarande en p50-tid till första token på 1,64 sekunder för Qwen3.8-Max — en förstapartsmätning, även om TTFT och end-to-end-genomströmning på timslånga byggen är olika storheter. Den ärliga hållningen är att preview-långsamhetsfyndet bör omtestas snarare än upprepas som aktuellt faktum.

Vad som överlever 0902-uppdateringen är att de starkaste bevisen på varje sida fortfarande kommer från olika håll. Qwen3.8-Max-0902:s #1 på Code Arena: WebDev är ett oberoende, blindröstat resultat, men det mäter en enda topplista, och Alibabas egen benchmark-tabell förblir en leverantörsartefakt — labb väljer vilka benchmarks de rapporterar, och Alibabas svagaste rapporterade siffra (IFBench 82.8, instruktionsföljning) stämmer fortfarande överens med förhandsvisningens klagomål att modellen överlevererar och ignorerar avgränsningar. Claude Fable 5:s bevisning är bredare och till största delen från tredje part: 62 på AA Intelligence Index, #1 på den allmänna Arena-topplistan, 95.0% SWE-bench Verified — och Anthropics egen nyare Claude Fable 5.1 har toppat AA-indexet med 66 sedan 1 september. När det gäller ”vilken modell kan ta sig an arbete jag inte har råd att misslyckas med” är svaret för allmänt bruk oförändrat. När det gäller ”vilken modell levererar den bästa front-end för en tiondel av priset” vände svaret den 2 september.

Öppenhet: den axel som Qwen redan har vunnit.

Fable 5 kommer aldrig att bli självhostningsbart. Qwen3.8-Max är det redan: den 12 augusti publicerades vikterna för Qwen3.8-2.4T-A95B — BF16 och en officiell FP8-variant — på Hugging Face och ModelScope, vilket gör den till den första Max-klassade Qwen som vem som helst kan ladda ner. Två varningar förtjänar lika stor vikt.

Det första är lagligt. Släppet distribueras under en anpassad “Qwen3.8-Max”-licens, inte Apache 2.0: leverantörer som driver model-as-a-service- eller AI-arbetsassistentverksamheter med rullande intäkter över 50 miljoner dollar måste förhandla fram en separat licens med Qwen, och kommersiella produkter som överstiger 100 miljoner aktiva användare per månad eller 20 miljoner dollar i månatliga intäkter måste visa modellnamnet. För internt bruk och nystartade företag är tröskelvärdena sällan bindande — men detta är inte ett fritt fram.

Det andra är fysiskt. En MoE med totalt 2,4T parametrar blir ungefär 4,9 TB i BF16 (ungefär hälften i den officiella FP8-checkpointen), jämfört med ungefär 141 GB minne per H200 — så att driva flaggskeppsmodellen själv innebär ett rack med acceleratorer innan du har serverat en enda token. De redovisade ~95B aktiva parametrarna låter dig åtminstone uppskatta vad det racket ger dig. För nästan varje team är det hostade API:t för $2 / $6 den praktiska vägen.

Vilket är anledningen till att Qwen3.8-27B, vars Apache-2.0-vikter släpptes den 14 augusti och som enligt uppgift körs i ~17GB VRAM, fortfarande är den praktiskt viktiga releasen för självhostning. Om ditt skäl till att föredra Qwen framför Fable 5 är datalokalisering eller lokal kontroll snarare än rå kapacitet, så är 27B modellen som faktiskt levererar det — och på båda sidor är öppenhetsjämförelsen inte längre teoretisk.

FAQ

Är Qwen 3.8 bättre än Claude Fable 5?

Det beror nu på axeln, vilket är en verklig förändring jämfört med i augusti. När det gäller kodning leder Qwen3.8-Max-0902: #1 på Code Arena: WebDev med 1 691 Elo mot Claude Fable 5:s 1 628, till $2 / $6 kontra Fable 5:s $10 / $50. När det gäller bred, granskad kvalitet leder Fable 5 fortfarande: 62 på AA Intelligence Index mot Qwens 56, 95,0 % SWE-bench Verified och #1 på den allmänna Arena-listan. För arbete där ett felaktigt svar är dyrt är Fable 5 det bättre dokumenterade valet; för högvolymskodning och agentiskt webbarbete är den senaste Qwen både billigare och högre rankad på arenan.

Är påståendet "endast efter Fable 5" sant?

Alibabas positionering gjordes utan oberoende siffror, och 0902-bygget har sedan dess ändrat form. Qwen3.8-Max-0902 rankas före Claude Fable 5 på Code Arena: WebDev (1 691 mot 1 628) men efter den på AA Intelligence Index (56 mot 62) och på den allmänna Arena-listan (Qwen #20 med Elo 1 479; Fable 5 #1 med 1 508). Så ”endast näst efter Fable 5” har blivit ”före Fable 5 på kodtavlan som denna uppdatering riktade sig mot, men efter den på de breda allmänna tavlorna.”

Hur mycket billigare är Qwen 3.8 än Fable 5?

Avsevärt, och det är nu en verklig taxa snarare än en rabatt. Qwen3.8-Max är $2 / $6 per 1M token jämfört med Fable 5:s $10 / $50 — ungefär 5× billigare på inmatning och 8× på utmatning. Qwens taxa är också enhetlig över hela 1M-kontexten, och cachad inmatning till $0,25/1M gör att återkommande kontextarbetsbelastningar blir ännu billigare.

Har Qwen 3.8 Max lämnat förhandsversionen?

Ja. Den nådde allmän tillgänglighet den 3 augusti 2026 med en publicerad prislista och en OpenAI- och DashScope-kompatibel slutpunkt. Qoder-kreditkampanjen och förhandsvisningserbjudandet med 90 % rabatt som cirkulerade i juli beskriver inte längre hur modellen säljs.

Är Qwen 3.8 fortfarande den långsammaste modellen, som tidiga recensioner sa?

Den slutsatsen kom från en enda granskare på förhandsversionsinfrastruktur som körde timslånga agentiska byggen, och den bör omtestas mot GA-servning snarare än att behandlas som ett aktuellt faktum. OrcaRouters 7-dagars telemetri visar en p50-tid-till-första-token på 1,64 sekunder, även om den mäter första-token-latens snarare än genomströmning vid mycket långa byggen.

Kan jag köra Qwen 3.8 på egen server istället för att betala för Fable 5?

Ja för Qwen, med förbehåll. Qwen3.8-2.4T-A95B har varit nedladdningsbar sedan 12 augusti under en anpassad licens (inte Apache 2.0), och Qwen3.8-27B under Apache 2.0 sedan 14 augusti. Den praktiska barriären är hårdvara: en MoE på totalt 2,4T kräver ungefär 4,9 TB i BF16 — en rack med acceleratorer — så de flesta team kommer fortfarande att anropa den värdbaserade API:n till $2 / $6 snarare än att själva betjäna flaggskeppsmodellen. Fable 5 är permanent stängd.

Vilken ska jag använda idag?

För generellt arbete där ett felaktigt svar är kostsamt – krävande resonemang, högriskproduktionsvägar – är Claude Fable 5 fortfarande det bättre dokumenterade valet, och Anthropics Claude Fable 5.1 utökar det försprånget. För storskalig kodning och agentisk webbutveckling har Qwen3.8-Max-0902 nu övertaget på den oberoende arenan och ett outputpris som är ungefär 8× lägre: masskodgranskning, frontend-generering, analys av långa dokument. Många team bör köra båda och dirigera efter uppgift.

Slutsats

Qwen 3.8 vs Claude Fable 5 är en annan jämförelse än den var för en månad sedan, och återigen annorlunda jämfört med för en vecka sedan. Qwen3.8-Max är en allmänt tillgänglig modell med en prislista som underskrider Fable 5 med 5× på input och 8× på output, platt över en miljon tokens — och sedan den 2 september avser samma namn 0902-versionen, som en oberoende arena nu rankar #1 för agentisk webbutveckling, högre än Fable 5 på den listan.

Ingen av modellerna äger nu hela jämförelsen. Claude Fable 5 – och Anthropics Claude Fable 5.1, som har toppat AA Intelligence Index med 66 sedan 1 september – innehar den breda, granskade marken för allmänna ändamål, och Alibabas egen benchmarktabell förblir en leverantörsartefakt. Men anledningen till att denna match var ojämn i juli – att Qwen inte hade någon oberoende domare alls – upphörde den 2 september: Qwen3.8-Max-0902 är #1-modellen på Code Arena: WebDev. Det vettiga svaret är fortfarande att dela upp efter insatser och uppgift – Fable 5 för allmänt resonerande där fel är dyra, Qwen3.8-Max för högvolymskodning där prisskillnaden och arenans fördel båda talar till dess fördel – och att testa båda på dina egna promptar.

Jämförda i den här artikeln3

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen