
Qwen 4 Max vs Claude Opus 5: de benchmark die onder hen beiden verschoof
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max werd gepresenteerd tijdens de Yunqi-conferentie in Hangzhou op 22 september 2026 — de flagship-tier van een Qwen 4-lijn met vier modellen die is aangekondigd maar nog niet uitgebracht, zonder prijs, zonder contextvenster en zonder gepubliceerde score. Claude Opus 5 is algemeen beschikbaar sinds 24 juli 2026 voor $5,00 per miljoen inputtokens en $25,00 per miljoen outputtokens, en het is het doelwit geweest waar elke flagship sinds de release van Qwen3.8-Max op heeft gemikt. De voor de hand liggende manier om deze vergelijking te schrijven is een specificatieblad met één kolom leeg. De nuttige manier is op te merken dat Artificial Analysis op 19 september 2026, drie dagen voor de aankondiging, de scores van zijn Intelligence Index herzag en dat Claude Opus 5 niet langer het model bovenaan die index was. Die enkele verandering herdefinieert wat Qwen 4 Max moet verslaan.
Wat is er veranderd op 19 september
Artificial Analysis publiceerde op 19 september 2026 indexrevisie v4.3.2. Onder de huidige revisie scoort Claude Opus 5 51 op de Intelligence Index bij de maximale redeneerinspanning — 50 bij xhigh, 48 bij high, 45 bij medium en 39 bij low — en staat achter Claude Fable 5.1 en GPT-6 Astra, beide op 53. De kosten per taak op die index bedragen $5,86.
Als dat als een downgrade klinkt, is het er geen. Het model is niet veranderd. De index wel. Onze eigen berichtgeving in juli en augustus noemde Claude Opus 5 op 61 tot 63 en bovenaan de tabel, en die cijfers klopten volgens de herzieningen die toen van kracht waren. Wie ze nog steeds citeert zonder herzieningsdatum, citeert een afgevoerd cijfer, en dit is de meest voorkomende fout in vergelijkingen die deze maand zijn geschreven. De praktische consequentie is dat een bewering als "Claude Opus 5 is het hoogst scorende model dat beschikbaar is" niet langer waar is, en een vergelijking die daarop is gebouwd, valt in duigen.
Aan de Qwen-kant is het gevolg nog scherper. Een vlaggenschipklasse die in september 2026 wordt aangekondigd, mikt op een doel dat in september 2026 opnieuw is gedefinieerd. Wat Alibaba uiteindelijk ook publiceert voor Qwen 4 Max, het zal worden beoordeeld tegen een ranglijst waarop 53 het getal is dat verslagen moet worden, niet 63.

De vergelijking, eerlijk weergegeven
De ene kant van deze tabel is compleet en de andere kant is leeg, en doen alsof het anders is, zou de hele faalmodus van dit artikel zijn. Dit is wat daadwerkelijk bekend is:
• Status — Claude Opus 5 algemeen beschikbaar sinds 24 juli 2026, tegenover Qwen 4 Max, aangekondigd op 22 september 2026 zonder releasedatum
• Invoerprijs — Claude Opus 5 $5,00 per 1M tokens, tegenover Qwen 4 Max niet gepubliceerd
• Prijs voor output — Claude Opus 5 $25,00 per 1 miljoen tokens, tegenover Qwen 4 Max niet gepubliceerd
• Gecachte invoer — Claude Opus 5 $0,50 per 1 miljoen tokens bij een cacheread, tegenover Qwen 4 Max: niet gepubliceerd
• Context — Claude Opus 5: 1M tokens bij de standaard en het maximum, versus Qwen 4 Max: niet gepubliceerd
• Uitvoerplafond — Claude Opus 5: 128K tokens synchroon en 300K via de Batches API met een bètaheader, tegenover Qwen 4 Max: niet gepubliceerd
• Modaliteit — Claude Opus 5 tekst-, afbeeldings- en bestandsinvoer met tekstuitvoer, versus Qwen 4 Max niet gepubliceerd
• Prijsstelling voor lange context — Claude Opus 5 rekent geen toeslag, dus een verzoek van 900.000 tokens wordt gefactureerd tegen hetzelfde tarief per token als een verzoek van 9.000 tokens, terwijl voor Qwen 4 Max geen prijzen zijn gepubliceerd.
• Onafhankelijke score — Claude Opus 5 51 op de Artificial Analysis Intelligence Index v4.3.2 bij maximale inspanning, tegenover Qwen 4 Max: er bestaat geen onafhankelijke evaluatie
• Door de leverancier gerapporteerde scores — Claude Opus 5 SWE-bench Verified 96,0%, SWE-bench Pro 79,2%, OSWorld 2.0 70,6%, Terminal-Bench 2.1 in de midden-80 afhankelijk van de harness, tegenover Qwen 4 Max waarvoor niets is gerapporteerd
• Redeneerbeheersing — adaptief denken van Claude Opus 5 standaard aan, met een inspanningsladder van vijf stappen, tegenover Qwen 4 Max dat niet is gepubliceerd
Tien rijen met 'niet gepubliceerd' zijn geen retorisch middel. Het is de stand van het bewijsmateriaal, en de eerlijke conclusie daaruit is dat nog niemand een capaciteitsvergelijking tussen deze twee modellen kan maken.
Het deel van de kloof dat niet dichtgaat
Prijzen en context worden uiteindelijk gepubliceerd. Eén verschil zal na de release blijven bestaan, en het is de moeite waard om daar nu over te beslissen in plaats van in de week dat Qwen 4 Max uitkomt: de twee modellen zijn gemaakt om op verschillende manieren te worden gekocht.
Claude Opus 5 is één enkel gesloten model tegen één enkele prijs van één enkele leverancier, met een gepubliceerde toezegging dat het niet eerder dan 24 juli 2027 wordt uitgefaseerd. Dat is een stabiel doel voor capaciteitsplanning. Qwen 4 Max is het vlaggenschip van een familie die Alibaba herhaaldelijk heeft uitgebracht over een veel breder prijsbereik — de Qwen 3.8-generatie omvat een frontier-vlaggenschip van $2,00 per input en een Flash-tier ver daaronder — en de vlaggenschip-tier van de Qwen-lijn is historisch gezien degene met de kortste nuttige levensduur voordat een goedkopere tier het gat dicht.
Het andere verschil zijn open gewichten, en dat wijst de andere kant op. De Qwen 3.8-generatie publiceerde de gewichten voor zijn grootste model onder een aangepaste Qwen-licentie, wat fine-tuning, kwantisatie en self-hosting überhaupt mogelijk maakt. Claude Opus 5 heeft geen vrijgave van gewichten en zal die ook niet krijgen. Als je workload een model nodig heeft dat je binnen je eigen perimeter kunt draaien, of kunt aanpassen, dan is dat een structureel voordeel dat geen enkele benchmarkherziening Alibaba kan afnemen — en het is de sterkste reden waarom deze specifieke vergelijking ertoe doet, in plaats van haar te zien als het ene vlaggenschip tegen het andere.

Hoe u deze vergelijking vandaag kunt uitvoeren
Claude Opus 5 is nu beschikbaar, en OrcaRouter routeert het als anthropic/claude-opus-5 tegen de lijstprijs van Anthropic met 0% opslag — het tarief van de provider wordt ongewijzigd doorberekend, dus de bovenstaande bedragen van $5,00 en $25,00 zijn wat u in rekening wordt gebracht in plaats van een met opslag verhoogd equivalent. Dat is belangrijker dan gewoonlijk voor een model in deze prijsklasse: een platformmarge van 10 procent op een outputtarief van $25,00 is $2,50 per miljoen tokens, wat meer is dan de volledige inputkosten van de meeste open-weight alternatieven. Daarnaast bevat de catalogus bijna 200 modellen op één OpenAI-compatibel endpoint, met automatische failover wanneer een providerpad verslechtert, en een routing-DSL om het beleid expliciet uit te drukken in plaats van een modelnaam hard te coderen in uw applicatie.
Wat OrcaRouter niet aanbiedt, is Qwen 4 Max, of welke Qwen 4-tier dan ook. De catalogus bevat nul vermeldingen voor de familie, wat je zou verwachten voor een model dat is aangekondigd maar niet uitgebracht. Wanneer de tiers wél verschijnen, zouden ze op dezelfde plek staan, en tot die tijd is het Qwen-model dat het waard is om met Claude Opus 5 te vergelijken het model dat je daadwerkelijk kunt aanroepen: Qwen3.8-Max, algemeen beschikbaar sinds 3 augustus 2026 voor $2,00 input en $6,00 output per miljoen tokens, met gepubliceerde gewichten en een geregistreerde onafhankelijke intelligentiescore van 56 bij $1,14 per taak — een cijfer dat onder een eerdere indexrevisie is vastgelegd, dus vergelijk het alleen met de 51 van Claude Opus 5 met die kanttekening erbij.
Wat te doen met dit voordat er een modelkaart bestaat
Er valt hier geen oordeel te vellen, want een van de twee modellen bestaat niet als product. Wat wel gezegd kan worden, is dat de vergelijking op 19 september 2026 van vorm veranderde zonder dat een van beide leveranciers iets deed: Claude Opus 5 is niet langer het best scorende model op de onafhankelijke index waarop de meeste vergelijkingen leunen, en staat nu twee punten achter twee andere modellen. Een lancering van Qwen 4 Max zal in die tabel belanden, niet in die van juli.
Dus de beslissing voor de komende maanden is niet Qwen 4 Max versus Claude Opus 5. Het is Claude Opus 5 versus het Qwen-model dat al is uitgebracht — een flagship tegen een vijfde van de invoerprijs met gepubliceerde gewichten — en die vergelijking is nu beschikbaar, met echte cijfers aan beide kanten. Kom erop terug wanneer Alibaba een modelkaart publiceert, en beschouw elke Qwen 4 Max-benchmarktabel die je daarvoor ziet als niet-geverifieerd.

Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
