
Qwen 3.8 vs. Claude Fable 5: Der 0902-Build übernimmt die Führung beim Programmieren
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiNEUOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Als Alibaba Qwen3.8-Max am 19. Juli 2026 in Shanghai vorstellte, hob es eine Behauptung stärker hervor als jede andere: dieses Modell mit 2,4 Billionen Parametern ist nahe am Spitzenniveau und liegt nur hinter Claude Fable 5. Damals war das nicht zu bewerten. Es gab keine Preisliste, keine Benchmark-Tabelle und keine Lizenz – nur eine Positionierungsaussage.
Am 3. August 2026 wurde Qwen3.8-Max allgemein verfügbar – eine echte Preisliste mit 2 $ / 6 $ pro Million Tokens, eine Benchmark-Tabelle mit konkreten Zahlen, ein mit OpenAI und DashScope kompatibler Endpunkt. Am 2. September lieferte Alibaba den nächsten Schritt, ohne die Versionsnummer zu ändern: Qwen3.8-Max-0902, ein nachtrainiertes Update, das auf Code- und Agentenarbeit abzielt und auf dem Code-Arena-WebDev-Leaderboard mit 1.691 Elo debütierte. Claude Fable 5, das Modell, hinter dem Alibaba den Juli damit verbrachte, sich direkt zu positionieren, liegt auf derselben Tabelle bei 1.628. Die Frage aus dem Juli hat sich zugespitzt: Ist Qwen 3.8 immer noch „nur nach Fable 5 an zweiter Stelle“ oder hat sich die Coding-Achse bereits umgedreht?
Ein Hinweis für Entwickler — der schnellste Weg, eine solche Behauptung zu klären, ist, beide Modelle mit eigenen Prompts zu testen. OrcaRouter stellt über 200 Modelle hinter einem OpenAI-kompatiblen Endpoint bereit, sodass du Qwen 3.8 Max gegen Fable 5 bei derselben Aufgabe antreten lassen kannst, ohne zwei SDKs einzubinden.
TL;DR-Fazit. Qwen3.8-Max-0902 ist die bisher stärkste Version von Alibabas 2,4-Billionen-Flaggschiff, und der neue Teil der Beweisführung basiert nicht mehr nur auf Eigenangaben: Das Modell debütierte mit 1.691 Elo auf Platz 1 der unabhängigen Code-Arena-WebDev-Rangliste und liegt damit vor Claude Fable 5 (1.628, Platz 8) auf dieser Liste. Der Preis ist unverändert und weiterhin entscheidend – bei pauschal 2 $ / 6 $ pro 1 Million Tokens unterbietet Qwen Fable 5 (10 $ / 50 $) um etwa das Fünffache beim Input und das Achtfache beim Output. Nicht geschlossen hat sich dagegen die Lücke bei den allgemeinen Fähigkeiten: Artificial Analysis bewertet Qwen3.8-Max auf seinem Intelligenzindex mit 56, Claude Fable 5 mit 62, und in der zuletzt veröffentlichten Woche der allgemeinen Arena-Rangliste (24.–30. Aug.) hält Fable 5 Platz 1 (1.508 Elo), während Qwen3.8-Max auf Platz 20 (1.479) liegt. Zwei Urteile also: Beim Programmieren hat das 0902-Update von Qwen nun einen Schiedsrichter und einen Sieg; beim breiten, geprüften Denken behaupten Claude Fable 5 – und Anthropics neueres Claude Fable 5.1, das den AA-Index mit 66 anführt – weiterhin das Feld.
Wichtige Erkenntnisse
• Qwen3.8-Max erreichte am 3. August 2026 die allgemeine Verfügbarkeit (GA), und am 2. September folgte das 0902-Refresh — keine Versionserhöhung, gleiche Preisliste ($2 / $6), gleicher 1M-Token-Kontext.
• Der Preisunterschied ist enorm: Qwen liegt bei 2 $ / 6 $ pro 1 M, während Fable 5 bei 10 $ / 50 $ liegt. Das ist etwa das 5-fache beim Input und das 8-fache beim Output, und Qwens Preis ist über den gesamten 1M-Token-Kontext konstant, ohne Aufschlag für lange Prompts.
• Beide Seiten haben nun unabhängige Punktzahlen – und sie weisen in unterschiedliche Richtungen. Qwen3.8-Max erreicht 56 auf dem Artificial Analysis Intelligence Index (Claude Fable 5: 62), und sein 0902-Build führt Code Arena: WebDev mit 1.691 Elo an, gegenüber 1.628 von Fable 5.
• Qwens eigene Benchmark-Tabelle ist weiterhin stark und weiterhin vom Anbieter erstellt. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — aber das Update vom 2. September ist das erste Qwen-Ergebnis, das eine unabhängige Arena auf Platz 1 gesetzt hat.
• Die Architekturlücke im Datenblatt ist geschlossen. Bei Qwen3.8-2.4T-A95B sind ~95 Mrd. der insgesamt 2,4 Bio. Parameter aktiv, auf 512 Experten verteilt — bekannt gegeben mit der Open-Weights-Veröffentlichung vom 12. August. Die Architektur von Fable 5 bleibt weiterhin nicht offengelegt.
• Offene Gewichte sind veröffentlicht, nicht nur versprochen. Qwen3.8-2.4T-A95B (BF16 und FP8) wurde am 12. August unter einer eigenen Qwen3.8-Max-Lizenz auf Hugging Face und ModelScope veröffentlicht, Qwen3.8-27B folgte am 14. August unter Apache 2.0. Fable 5 ist geschlossen und dauerhaft nur über die API verfügbar.
Hinweis zur Genauigkeit: Die Zahlen aus Alibabas eigener Benchmark-Tabelle sind weiterhin vom Anbieter gemeldet und nicht repliziert. Die unabhängigen Zahlen hier sind mit Zeitstempel versehen und stammen von Dritten: der Artificial Analysis Intelligence Index (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), die Auflistung der Code Arena: WebDev Elo und das allgemeine wöchentliche Arena-Board — Arena-Werte driften, während Stimmen hinzukommen, und die #1 des 0902-Builds entspricht Alibabas Ankündigung einer zeitpunktbezogenen Auflistung. Die 95,0 % SWE-bench Verified von Fable 5 sind von Anthropic gemeldet; die Preisgestaltung von Qwen entspricht der GA-Rate-Card aus dem Alibaba Model Studio.
Die technischen Daten und der Preis, Seite an Seite
Hier sind die harten Daten, jede Zahl mit ihrer Quelle versehen.
• Hersteller / Status — Qwen3.8-Max: Alibaba; GA 3. August 2026; 0902-Refresh 2. September 2026. Claude Fable 5: Anthropic; GA-Flaggschiff
• Architektur — Qwen3.8-Max: 2,4 T insgesamt / ~95 B aktiv, spärliches MoE, 512 Experten (am 12. Aug. offengelegt); Fable 5: nicht offengelegt
• Kontextfenster — Qwen3.8-Max: 1M Tokens (983.616 mit Denken; maximale Ausgabe 131.072); Fable 5: Flaggschiff für lange Kontexte
• AA Intelligence Index – Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1. Sep.): 66, führt
• SWE-bench Verified — Qwen3.8-Max: Nicht gemeldet (Alibaba meldet stattdessen FrontierSWE 73.5); Fable 5: 95.0% (Anthropic / buildfastwithai)
• Unabhängige und vom Anbieter gemeldete Stärken — Qwen3.8-Max: Code Arena WebDev #1 mit 1.691 (0902, unabhängig); Anbietertabelle: GPQA Diamond 92,6, PaperBench 93,0, Terminal-Bench 2.1 86,6. Claude Fable 5: AA 62; SWE-bench Verified 95,0%
• Preisgestaltung (Eingabe / Ausgabe) — Qwen3.8-Max: $2,00 / $6,00 pro 1M, pauschal über 1M Kontext; Cache-Eingabe $0,25; Fable 5: $10 / $50 pro 1M
• Offene Gewichte — Qwen3.8-Max: veröffentlicht am 12. August 2026 (eigene Lizenz, nicht Apache); Qwen3.8-27B unter Apache 2.0 am 14. August. Fable 5: nein — geschlossen / nur über API.
• Multimodalität — Qwen3.8-Max: Text, Bild, Video rein → Text raus; Fable 5: Multimodales Flaggschiff
Zwei Dinge bilden den Rahmen für den gesamten Vergleich. Das erste änderte sich am 3. August und gilt weiterhin; das zweite änderte sich erneut am 2. September.
Zunächst ist die Preisspalte nun das auffälligste Element auf der Seite. Im Juli war Qwens Kostenvorteil ein Rabattgutschein — 90 % Rabatt auf Credits, befristet, ohne einen Preis pro Token als Planungsgrundlage. Jetzt ist er eine Preisliste, und der Abstand ist strukturell, nicht aktionsbedingt. Bei einem Output-Preis von 6 $ gegenüber 50 $ bei Fable können Sie für den Preis eines einzigen Fable-Aufrufs etwa acht Qwen-Aufrufe ausführen. Für jede Arbeitslast, bei der Sie für Volumen bezahlen und nicht für die einzelne, schwierigste Antwort, verändert dieses Verhältnis die Architektur dessen, was Sie bauen.
Zweitens ist die Benchmark-Spalte nicht mehr einseitig. Den größten Teil des Augusts war die ehrliche Bilanz dünn: Alibaba meldete im FrontierSWE 73,5 und eine Tabelle mit selbst ermittelten Zahlen; Anthropic meldete im SWE-bench Verified ein von Dritten geprüftes Ergebnis von 95,0 %; und kein unabhängiger Evaluator hatte Qwen überhaupt bewertet. Der Build 0902 beendete das. Code Arena: WebDev — das Projekt, das früher als WebDev Arena bekannt war und von niemandem bei Alibaba betrieben wird — ist eine Arena, in der Menschen blind und paarweise abstimmen. Qwen3.8-Max-0902 startete dort mit 1.691 Elo auf Platz 1, vor Claude Opus 5 (1.688), Kimi K3 (1.674) und Claude Fable 5 (1.628, Platz 8). Zwei Einschränkungen halten diese Bewertung ehrlich: Es ist nur ein einziges Leaderboard, das agentische Frontend-Entwicklung statt allgemeiner Fähigkeiten misst, und „Debüt auf Platz 1“ ist Alibabas Ankündigung einer Momentaufnahme. Doch die Behauptung, Qwen habe überhaupt keinen unabhängigen Evaluator, stimmt nicht mehr, und das verändert den Vergleich stärker als jede einzelne Zahl auf diesem Leaderboard.

Was die Preisdifferenz tatsächlich einbringt
Viele abstrakte Beispiele sind weniger nützlich als ein ausgearbeitetes Beispiel, hier ist also eines. Nehmen Sie einen Code-Review-Agenten, der 150.000 Token an Repository-Kontext sendet und 6.000 Token an Review pro Aufruf generiert.
• Qwen3.8-Max: 0,15 M × 2 $ = 0,30 $, plus 0,006 M × 6 $ = 0,036 $. ≈ 0,34 $ pro Aufruf.
• Claude Fable 5: 0,15M × 10 $ = 1,50 $, plus 0,006M × 50 $ = 0,30 $. ≈ 1,80 $ pro Anruf.
• Bei 2.000 Aufrufen pro Tag: Qwen ≈ $672/Tag; Fable ≈ $3.600/Tag. Über einen Monat sind das grob $20.000 gegenüber $108.000.
• Mit Prompt-Caching in einem stabilen Repo-Kontext senkt Qwens gecachter Input bei 0,25 $/1M die Input-Seite von 0,30 $ auf unter 0,04 $, was den Aufruf auf ≈ 0,08 $ bringt — etwa 22× günstiger als Fable pro Aufruf.
Das ist keine marginale Ersparnis; es ist der Unterschied zwischen einem Reviewer für jeden Pull-Request und einem nur für die riskanten. Und Qwens Flatrate-Kontext verstärkt den Effekt, je größer die Prompts werden: Da Alibaba keinen Aufpreis für lange Prompts erhebt, kostet das Durchschieben eines 900.000-Token-Kontexts pro Token genauso viel wie ein 5.000-Token-Kontext.
Das ehrliche Gegengewicht ist, dass der Preis pro Token nicht der Preis pro gelöste Aufgabe ist. Wenn Fable 5 ein Problem in einem Durchlauf löst, während ein günstigeres Modell drei Versuche plus menschliche Korrektur braucht, kann das günstigere Modell in der Summe teurer sein — und bei der schwierigsten Denkarbeit ist das geprüfte #1-Ranking von Fable 5 der beste verfügbare Beleg, dass es in einem Durchlauf tatsächlich mehr löst. Das Kostenargument für Qwen ist bei hochvolumigen, fehlertoleranten Arbeitslasten am stärksten und bei niedrigvolumigen, risikoreichen am schwächsten.
Die 0902-Benennung: Die Leistungsfähigkeit ist gestiegen, die Versionsnummer nicht.
Das Bemerkenswerte am 2. September ist, was Alibaba nicht getan hat: Qwen 3.9 zu veröffentlichen. Die Verbesserung wurde als datierter Checkpoint unter demselben Modellnamen ausgeliefert — Qwen3.8-Max-0902 — und die API stellte sie unter demselben Namen und zum selben Preis bereit. Das ist die Richtung, in die sich die Branche bewegt: Wenn ein Fähigkeitssprung keine neue Versionsnummer mehr garantiert, wird die Frage „Welches Modell soll ich verwenden?“ zu einer Frage nach Builds und Daten, nicht nur nach Familiennamen.
Es bedeutet auch, dass ein Benchmark-Score für „Qwen3.8-Max“ nur eine begrenzte Haltbarkeit hat: Ein Ergebnis, das mit dem Juli- oder August-Build erzielt wurde, beschreibt unter Umständen nicht das Modell, das die API heute zurückgibt. Überprüfen Sie die Build-Kennung auf dem Endpunkt, den Sie tatsächlich aufrufen – die Zahl 0902 ist der Unterschied zwischen einem Modell, das auf Code Arena: WebDev hinter Claude Fable 5 zurücklag, und einem, das es dort übertrifft.
Beweis, und warum es dieses Matchup immer noch entscheidet
Der am häufigsten zitierte Praxisbeleg für Qwen3.8-Max stammt aus einem Review aus der Vorschauzeit (thomas-wiegold.com), das das Modell durch vier reale Builds schickte. Die Ergebnisse waren wirklich beeindruckend: Qwen meisterte eine Go-Poker-Simulation in einem einzigen Durchgang – erst das dritte Modell überhaupt, das diesen Prompt in einem einzigen Durchgang schaffte, neben Fable 5 und Grok 4.5 – und bei einem Prompt für eine Kaffeeröster-Website erzeugte es die beste Ausgabe, die der Tester je bei diesem Test gesehen hatte, und fügte aus purer Gründlichkeit einen nicht angeforderten Warenkorb, einen Großhandelsbereich und eine Instagram-Integration hinzu.
Der Haken war die Geschwindigkeit: 30+ Minuten auf der Website und 1 Stunde 20 Minuten bei der Pokersimulation, was es zum langsamsten Modell machte, das dieser Rezensent je verwendet hatte. Diese Feststellung benötigt nun eine Einschränkung, die sie im Juli nicht brauchte. Gemessen wurde auf der Preview-Infrastruktur, von einem Rezensenten, bei ungewöhnlich langen Agentenläufen. Das GA-Serving ist ein anderes System. Was auch immer das wert ist, OrcaRouters eigene 7-Tage-Telemetrie zeigt derzeit eine p50-Zeit bis zum ersten Token von 1,64 Sekunden für Qwen3.8-Max — eine Messung aus erster Hand, auch wenn TTFT und End-to-End-Durchsatz bei einstündigen Builds unterschiedliche Größen sind. Die ehrliche Position ist, dass der Befund zur Langsamkeit der Preview erneut getestet werden sollte, anstatt als aktuelle Tatsache wiederholt zu werden.
Was das 0902-Update übersteht, ist, dass die stärksten Belege auf beiden Seiten weiterhin aus unterschiedlichen Quellen stammen. Der #1-Platz von Qwen3.8-Max-0902 bei Code Arena: WebDev ist ein unabhängiges Blind-Vote-Ergebnis, aber es misst nur ein Board, und Alibabas eigene Benchmark-Tabelle bleibt ein Artefakt des Anbieters – Labs wählen aus, welche Benchmarks sie melden, und Alibabas schwächster gemeldeter Wert (IFBench 82,8, Instruction-Following) deckt sich weiterhin mit der Beschwerde aus der Vorschau, dass das Modell zu viel liefert und den Rahmen ignoriert. Die Belege für Claude Fable 5 sind breiter gefächert und stammen überwiegend von Dritten: 62 im AA Intelligence Index, #1 auf dem allgemeinen Arena-Board, 95,0 % bei SWE-bench Verified – und Anthropics eigenes neueres Claude Fable 5.1 führt den AA-Index seit dem 1. September mit 66 an. Bei der Frage, welches Modell Arbeiten bewältigt, die ich mir nicht leisten kann zu vermasseln, bleibt die Allgemeinantwort unverändert. Bei der Frage, welches Modell das beste Frontend zu einem Zehntel des Preises ausliefert, hat sich die Antwort am 2. September geändert.

Offenheit: die Achse, auf der Qwen bereits gewonnen hat.
Fable 5 wird niemals selbst hostbar sein. Qwen3.8-Max ist es bereits: Am 12. August sind die Gewichte für Qwen3.8-2.4T-A95B — BF16 und eine offizielle FP8-Variante — auf Hugging Face und ModelScope erschienen, wodurch es das erste Qwen der Max-Klasse ist, das jeder herunterladen kann. Zwei Einschränkungen verdienen gleichermaßen Beachtung.
Das Erste ist legal. Die Veröffentlichung erfolgt unter einer eigenen „Qwen3.8-Max“-Lizenz, nicht Apache 2.0: Anbieter, die Model-as-a-Service- oder KI-Arbeitsassistenten-Geschäfte mit einem Umsatz von über 50 Millionen US-Dollar in den letzten zwölf Monaten betreiben, müssen eine separate Lizenz von Qwen aushandeln, und kommerzielle Produkte, die über 100 Millionen monatlich aktive Nutzer oder 20 Millionen US-Dollar Monatsumsatz überschreiten, müssen den Modellnamen anzeigen. Für den internen Gebrauch und Startups greifen die Schwellenwerte selten — aber das ist kein Freifahrtschein.
Der zweite Aspekt ist physischer Natur. Ein MoE mit insgesamt 2.4T Parametern benötigt in BF16 etwa 4.9TB (etwa die Hälfte beim offiziellen FP8-Checkpoint) – gegenüber etwa 141GB Speicher pro H200. Das Flaggschiff selbst zu hosten bedeutet also ein Rack voller Beschleuniger, bevor auch nur ein Token ausgeliefert wird. Die genannten ~95B aktiven Parameter lassen zumindest abschätzen, was dieses Rack einem bringt. Für nahezu jedes Team ist die gehostete API für $2 / $6 der praktikable Weg.
Genau deshalb bleibt Qwen3.8-27B, dessen Apache-2.0-Gewichte am 14. August folgten und das Berichten zufolge in ~17 GB VRAM läuft, das praktisch wichtige Self-Hosting-Release. Wenn Ihr Grund, Qwen gegenüber Fable 5 den Vorzug zu geben, Datenresidenz oder On-Premise-Kontrolle ist und nicht die rohe Leistungsfähigkeit, dann ist das 27B das Modell, das genau das tatsächlich liefert — und auf beiden Seiten ist der Offenheitsvergleich nicht mehr nur Theorie.
FAQ
Ist Qwen 3.8 besser als Claude Fable 5?
Es kommt nun auf die Achse an, was eine echte Änderung gegenüber August ist. Beim Coding führt Qwen3.8-Max-0902: #1 in Code Arena: WebDev mit 1,691 Elo (gegenüber 1,628 von Claude Fable 5) und bei $2 / $6 (gegenüber $10 / $50 von Fable 5). Bei umfassender, geprüfter Qualität führt weiterhin Fable 5: 62 im AA Intelligence Index gegenüber 56 von Qwen, 95.0% SWE-bench Verified und #1 in der allgemeinen Arena-Rangliste. Für Arbeiten, bei denen eine falsche Antwort teuer ist, ist Fable 5 die besser dokumentierte Wahl; für umfangreiches Coding und agentische Web-Arbeit ist das neueste Qwen sowohl günstiger als auch im Arena-Ranking weiter vorne.
Ist die Behauptung "nur hinter Fable 5" wahr?
Alibabas Positionierung wurde ohne unabhängige Zahlen vorgenommen, und der 0902-Build hat das Bild seither verändert. Qwen3.8-Max-0902 liegt bei Code Arena: WebDev vor Claude Fable 5 (1.691 gegenüber 1.628), aber hinter ihm beim AA Intelligence Index (56 gegenüber 62) und auf der allgemeinen Arena-Rangliste (Qwen #20 mit Elo 1.479; Fable 5 #1 mit 1.508). So ist aus „nur hinter Fable 5“ die Aussage „vor Fable 5 auf dem Coding-Board, das dieses Update anvisierte, aber hinter ihm auf den breiten Allzweck-Boards“ geworden.
Wie viel günstiger ist Qwen 3.8 als Fable 5?
Erheblich, und es ist jetzt ein echter Preis und kein Rabatt. Qwen3.8-Max kostet 2 $ / 6 $ pro 1M Token, während Fable 5 bei 10 $ / 50 $ liegt – etwa 5× günstiger beim Input und 8× beim Output. Qwens Preis ist außerdem über den gesamten 1M-Kontext hinweg konstant, und zwischengespeicherter Input zu 0,25 $/1M macht wiederkehrende Kontext-Workloads noch günstiger.
Hat Qwen 3.8 Max die Vorschauphase verlassen?
Ja. Es wurde am 3. August 2026 allgemein verfügbar, mit einer veröffentlichten Preisliste und einem OpenAI- und DashScope-kompatiblen Endpunkt. Die Qoder-Credits-Kampagne und das im Juli kursierende Framing des Previews mit 90 % Rabatt beschreiben nicht mehr, wie das Modell verkauft wird.
Ist Qwen 3.8 immer noch das langsamste Modell, wie frühe Rezensionen sagten?
Diese Erkenntnis stammt von einem einzigen Reviewer auf Preview-Infrastruktur, auf der einstündige Agentic-Builds ausgeführt wurden, und sie sollte gegen GA-Serving erneut getestet werden, statt als aktuelle Tatsache behandelt zu werden. Die 7-Tage-Telemetrie von OrcaRouter zeigt eine p50-Time-to-First-Token von 1,64 Sekunden, wobei dies die First-Token-Latenz misst und nicht den Durchsatz bei sehr langen Builds.
Kann ich Qwen 3.8 selbst hosten, anstatt für Fable 5 zu bezahlen?
Ja für Qwen, mit Einschränkungen. Qwen3.8-2.4T-A95B ist seit dem 12. August unter einer angepassten Lizenz (nicht Apache 2.0) herunterladbar, und Qwen3.8-27B seit dem 14. August unter Apache 2.0. Die praktische Hürde ist die Hardware: Ein MoE mit insgesamt 2,4T benötigt in BF16 etwa 4,9 TB – ein Rack voller Beschleuniger –, daher werden die meisten Teams weiterhin die gehostete API für 2 $ / 6 $ nutzen, anstatt das Flaggschiff selbst zu hosten. Fable 5 ist dauerhaft geschlossen.
Welches sollte ich heute verwenden?
{{1}}Für allgemeine Aufgaben, bei denen eine falsche Antwort teuer ist — anspruchsvolles Denken, risikoreiche Produktionsabläufe — ist Claude Fable 5 immer noch die besser dokumentierte Wahl, und Anthropics Claude Fable 5.1 baut diesen Vorsprung aus.{{/1}} {{2}}Für die Verarbeitung großer Codemengen und agentische Webentwicklung hat Qwen3.8-Max-0902 jetzt den Vorsprung in der unabhängigen Arena und einen etwa 8× niedrigeren Ausgabepreis: Massen-Code-Review, Frontend-Generierung, Langdokument-Analyse.{{/2}} {{3}}Viele Teams sollten beide Modelle einsetzen und je nach Aufgabe weiterleiten.{{/3}}
Fazit
Qwen 3.8 gegen Claude Fable 5 ist ein anderer Vergleich als noch vor einem Monat und wiederum ein anderer als vor einer Woche. Qwen3.8-Max ist ein allgemein verfügbares Modell mit einer Preisliste, die Fable 5 beim Input um das 5-Fache und beim Output um das 8-Fache unterbietet – einheitlich über eine Million Tokens – und seit dem 2. September steht derselbe Name für den Build 0902, den eine unabhängige Arena inzwischen auf Platz #1 für agentische Webentwicklung führt, noch vor Fable 5 auf dieser Rangliste.
Keines der Modelle hat nun den Gesamtvergleich für sich allein. Claude Fable 5 – und Anthropics Claude Fable 5.1, die seit dem 1. September mit 66 den AA Intelligence Index anführt – behaupten das breite, unabhängig geprüfte Allzweck-Segment, und Alibabas eigene Benchmark-Tabelle bleibt ein reines Anbieter-Artefakt. Doch der Grund, der dieses Duell im Juli so einseitig machte – dass Qwen überhaupt keinen unabhängigen Schiedsrichter hatte –, entfiel am 2. September: Qwen3.8-Max-0902 ist das Modell auf Platz 1 in der Code Arena: WebDev. Die vernünftige Antwort ist weiterhin, nach Risiko und Aufgabe zu unterscheiden – Fable 5 für allgemeine Denkaufgaben, bei denen Fehler teuer sind; Qwen3.8-Max für umfangreiche Codierungsaufgaben, bei denen die Preisdifferenz und der Arena-Vorsprung beide in seine Richtung wirken – und beide mit den eigenen Prompts zu testen.

In diesem Artikel verglichen3
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
