
Claude Sonnet 5.5 vs Qwen 4 Max: Het ene model heeft een kaart, het andere heeft een naam
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 931 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 192 tok/s
- OrcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- xAISpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
De twee helften van deze titel zijn niet hetzelfde soort object, en dat is het eerste wat een lezer moet weten. Claude Sonnet 5.5is uitgebracht op 28 september 2026: het heeft een API-identifier, een tariefkaart, een contextvenster, een gepubliceerde retirement floor en een regel op de onafhankelijke leaderboards. Qwen 4 Maxwerd op 22 september 2026 gepresenteerd tijdens de Yunqi-conferentie in Hangzhou, als het vlaggenschip van een aangekondigde Qwen 4-lijn van vier modellen — en sinds vandaag heeft het geen prijs, geen contextvenster, geen gepubliceerde score, geen modelkaart en geen pagina op Artificial Analysis om te openen. Dat is geen schandaal; zo wordt een tier aangekondigd. Maar het verandert hoe een nuttige vergelijking eruitziet. De vergelijking die de moeite waard is, is die tussen de nieuwste uitgebrachte Sonnet en het Qwen-model dat je vandaag daadwerkelijk kunt aanroepen, namelijk Qwen3.8 Max — want dat heeft wél een tariefkaart, en die tariefkaart is leerzaam.
Wat Alibaba daadwerkelijk op tafel legde
Qwen 4 Max werd genoemd als een naam in een line-up, niet als een product. De conferentiepreview introduceerde de tierstructuur van de Qwen 4-familie, en niets daarvan is sindsdien omgezet in een specificatie waar een ontwikkelaar op kon plannen: geen prijs per miljoen tokens, geen venstergrootte, geen maximale output, geen benchmarktabel, geen Hugging Face-repository, geen vermelding in de eigen modellenlijst van de leverancier. Of het wordt uitgebracht als een gesloten API-tier, als open weights, of in beide vormen, staat nergens in wat de leverancier heeft gepubliceerd. Als een tier zo vroeg is, is het enige eerlijke dat een artikel over de specificaties kan zeggen dat die er niet zijn — en elke pagina die nu een specificatieblad voor Qwen 4 Max aanbiedt, drukt een projectie af.

Het enige wat de aankondiging nuttig vaststelt, is de richting. Alibaba's meest recente vlaggenschip dat al verkrijgbaar is, Qwen3.8 Max, wordt door de eigen migratiegids van de leverancier rechtstreeks tegenover GPT-5.5, Claude Opus 4.7 en Gemini 3.1 Pro gepositioneerd, en het is de tier die Qwen 4 Max moet gaan vervangen. Het doelwit van de opvolger is dus duidelijk, zelfs wanneer zijn cijfers dat niet zijn, en het model dat het qua prijs moet verslaan, is het model dat al te koop is.
De Qwen die je vandaag kunt aanroepen, qua prijs afgezet tegen de nieuwe Sonnet
Qwen3.8 Max is algemeen beschikbaar sinds 3 augustus 2026. Het is Alibaba's meest capabele niveau tot nu toe: native multimodaal met tekst-, beeld- en video-invoer en tekstuitvoer, een venster van 1.000.000 tokens, denkmodus, functieaanroepen, ingebouwde tools en gestructureerde uitvoer, aangeboden via OpenAI-compatibele, Anthropic-compatibele en native DashScope-endpoints. Alibaba positioneert het voor dezelfde veeleisende meerstapsanalyse en agentische werk waarvoor de leverancier Claude Sonnet 5.5 positioneert, en de twee komen uit op vrijwel exact hetzelfde hoofdtarief — en dat is waar de vergelijking interessant wordt.
• Invoerprijs — Claude Sonnet 5.5 $2,00 per miljoen vs Qwen3.8 Max $2,00 per miljoen, identiek
• Prijs voor output — Claude Sonnet 5.5 $10,00 per miljoen vs. Qwen3.8 Max $6,00 per miljoen
• Cacheread — Claude Sonnet 5.5 $0,20 per miljoen vs. Qwen3.8 Max $0,25 per miljoen
• Cache schrijven — Claude Sonnet 5.5 $2,50 per miljoen vs Qwen3.8 Max $2,50 per miljoen
• Context — Claude Sonnet 5.5 1.000.000 tokens vs Qwen3.8 Max 1.000.000 tokens op het specificatieblad van de leverancier; Artificial Analysis legt de momentopname vast die het op 983.616 heeft gemeten
• Maximale output — Claude Sonnet 5.5 128.000 synchroon, 300.000 bij Batches vs Qwen3.8 Max niet gepubliceerd door de leverancier
• Invoermodaliteit — Claude Sonnet 5.5 tekst, afbeelding en bestand vs Qwen3.8 Max tekst, afbeelding en video
Een identiek inputtarief en een 40% goedkoper outputtarief vormen een oprecht sterke prijspositie, en dat is de reden waarom Qwen3.8 Max blijft opduiken in vergelijkingen met frontier-modellen. Dan kijk je naar de onafhankelijke metingen, en verhuist het voordeel naar een heel andere plek.
Wat de onafhankelijke cijfers zeggen over het prijsvoordeel
Beide modellen staan op dezelfde Artificial Analysis Intelligence Index, revisie v4.3.2, en beide zijn gemeten in plaats van geschat.
• Intelligentie-index — Claude Sonnet 5.5 56 bij Max Effort vs. Qwen3.8 Max 45 op de snapshot van 2 september
• Kosten per Index-taak — Claude Sonnet 5.5 $7.60 vs Qwen3.8 Max $5.41
• Uitvoersnelheid — Claude Sonnet 5.5 138,7 tokens/sec vs. Qwen3.8 Max 38,2 tokens/sec
• Tijd tot eerste chunk — Claude Sonnet 5.5 370,8 s bij Max Effort vs. Qwen3.8 Max 3,0 s
• Uitvoertokens gegenereerd in de Index — Claude Sonnet 5.5 410M vs Qwen3.8 Max 190M, die het bestuur bestempelt als zeer verbose vergeleken met een mediaan van 88M
• GPQA Diamond — Claude Sonnet 5.5 niet gepubliceerd op het huidige scorebord vs Qwen3.8 Max 92,8%
• Humanity's Last Exam — Claude Sonnet 5.5 55,0% vs Qwen3.8 Max 43,1%
• Recall bij lange context — Claude Sonnet 5.5 82,7% vs Qwen3.8 Max 80,3%
Twee dingen vallen op, en geen van beide is de prijs. Het eerste is dat een 40% goedkoper outputtarief samendrukt tot een 30% goedkopere taak wanneer je rekening houdt met tokenaantallen — Qwen3.8 Max genereert 190M tokens over de index tegenover 410M van Claude Sonnet 5.5, wat zuiniger is, maar niet zuinig genoeg om het volledige tariefverschil te behouden. Het tweede is snelheid, en hier keert de richting hard om: Claude Sonnet 5.5 genereert output 3,6 keer sneller dan Qwen3.8 Max, 138,7 tokens per seconde tegenover 38,2. Bij een lange generatie is dat het verschil tussen één minuut en meerdere minuten, en dat is geen verschil dat welke korting per token dan ook goedmaakt.
De first-tokenwaarde wijst juist de andere kant op en verdient het dat de kanttekening er ronduit bij wordt vermeld. 370,8 seconden is Claude Sonnet 5.5 op Max Effort met standaard fallback, een configuratie voor redeneren die een zeer groot denkbudget besteedt voordat er wordt geantwoord; een aanroeper die een lagere effort instelt, krijgt binnen enkele seconden een eerste token. De 3,0 seconden van Qwen3.8 Max zijn gemeten op een model waarvan het denkgedrag verschilt. De vergelijking is reëel, maar het is een vergelijking van configuraties, niet van leveranciers.

Waar de ontbrekende Sonnet-migratiekosten terechtkomen
Eén operationeel verschil komt in geen van de bovenstaande rijen voor en is voor iedereen met draaiende code belangrijker dan het prijsverschil. Claude Sonnet 5.5 veranderde zes gedragingen ten opzichte van Claude Sonnet 5, en vijf ervan verbreken bestaande integraties: niet-standaard temperature, top_p en top_k geven nu een 400 terug; thinking: {"type": "disabled"} geeft een 400 terug en moet between_tools worden, waarbij effort beperkt is tot low, medium of high; "any" of een benoemde tool wordt geweigerd, dus loops moeten overstappen op auto met strikt toolgebruik of gestructureerde outputs; de computer_20251124 computer-use-tool wordt geweigerd op de Claude API en Google Cloud; en thinking-blokken zijn nu gebonden aan het producerende model en account, dus redeneringen gaan mee vanaf Sonnet 5, maar niet naar een andere familie. De zesde wijziging laat niets mislukken en is daarom de gemakkelijkste om kapot uit te rollen: tekst tussen toolaanroepen wordt nu binnen thinking-blokken teruggegeven, dus een streamingapplicatie blijft stil tussen aanroepen totdat deze een displaywaarde instelt of thinking vooraf uitschakelt.
Qwen3.8 Max vraagt niets van dat alles van een Qwen-aanroeper — het is een OpenAI-compatibel endpoint met het volledige sampling-oppervlak en de standaardvorm voor tool-calling — en het Anthropic-compatibele endpoint bestaat precies zodat code die tegen Claude is geschreven, er met een base-URL-wijziging naar kan verwijzen. Voor een team dat al op Sonnet 5 draait, is de overstap naar Sonnet 5.5 een dag migratiewerk met een lijst van vijf punten om te controleren; de overstap naar Qwen3.8 Max is een configuratiewijziging met een andere set risico's, vooral rond gedragsdrift in plaats van API-vorm.
De bereikbare op dezelfde toets krijgen
Een realistische pipeline eind september 2026 kiest niet een van deze. Hij draait een Claude-model voor het agentische pad en een Qwen-model waar de video-invoer of de prijs belangrijk is, en de kosten van die regeling zijn normaal gesproken twee contracten, twee sleutels, twee rate-limit-oppervlakken en twee plaatsen waar een verzoek kan mislukken. OrcaRouter vouwt het samen tot één OpenAI-compatibel eindpunt over meer dan 200 modellen, met de lijstprijs van de provider doorgegeven en zonder opslag, zodat een tariefwijziging van een leverancier aan beide zijden hier dezelfde dag ingaat in plaats van bij de volgende verlenging, plus automatische failover tussen upstream providers en een routing-DSL voor het samenstellen van calls uit meerdere modellen.
Qwen3.8 Max is hier vandaag routeerbaar als qwen/qwen3.8-max tegen Alibaba's $2,00 input en $6,00 output over het volledige venster van 1.000.000 tokens, en de snapshot van 2 september die Artificial Analysis heeft gemeten is te adresseren als qwen/qwen3.8-max-0902 wanneer je de exacte revisie nodig hebt waarop een score is gebaseerd. Noch Qwen 4 Max noch enige andere Qwen 4-tier staat in onze catalogus, en geen enkele Qwen 4-tier zal dat zijn totdat Alibaba iets publiceert om te routeren. Claude Sonnet 5.5 staat ook niet in de catalogus — het is een dag oud, en de route ernaartoe is Anthropic's eigen API, met Claude Sonnet 5 hier beschikbaar tegen Anthropic's $2,00 en $10,00 als failover-doel in de tussentijd. Qwen3.8 Max verwerkt wekelijks 52,0 miljoen tokens aan verkeer via deze catalogus en Claude Sonnet 5 verwerkt er 7,9 miljoen, wat de praktische versie van het bovenstaande argument is: de Qwen-tier is niet alleen in naam een fallback.

De regel voor een aangekondigde tier
Behandel een aangekondigde tier als een planningsinput, niet als een inkoopoptie. Qwen 4 Max is de moeite waard om te volgen, omdat het laat zien waar het vlaggenschip van Alibaba naartoe gaat en omdat het uiteindelijk Qwen3.8 Max aan de top van de reeks zal verdringen. Het is niet de moeite waard om er je planning op te baseren, omdat er niets is om je planning op te baseren: geen identificatie, geen prijs, geen contextvenster, geen gewichten, geen gemeten score. Het bewijs dat het echt zal maken, is specifiek en gemakkelijk te herkennen — een vermelding in Alibaba's eigen modellenlijst, een prijsregel, een gepubliceerd contextvenster, een Hugging Face-repository als de gewichten open zijn, en een pagina op Artificial Analysis, omdat een model dat niemand heeft gemeten geen model is dat je kunt vergelijken.
Tot die tijd gaat de beslissing tussen twee modellen die beide bestaan. Als je werk agentisch is, zijn de zeventien Index-punten en de 3,6× outputsnelheid wat je koopt, en de hogere kosten per taak van Claude Sonnet 5.5 zijn de prijs daarvoor. Als je werk video-invoer vereist, een native Anthropic-compatibel endpoint nodig heeft op een Qwen-factuur, of simpelweg een outputtarief van $10 niet kan rechtvaardigen, dan is Qwen3.8 Max nu in de aanbieding tegen dezelfde invoerprijs met een 40% goedkopere output en een eerste token dat binnen enkele seconden aankomt — en de eerlijke kanttekening is dat het traag zal aanvoelen zodra de generatie begint, wat de ruil is die het goedkopere tarief oplevert.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
