
Qwen 4 Max vs Claude Opus 5: benchmarken som förändrades under bådas fötter
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max visades upp på Yunqi-konferensen i Hangzhou den 22 september 2026 — flaggskeppsnivån i en Qwen 4-linje med fyra modeller som är annonserad men ännu inte släppt, utan pris, utan kontextfönster och utan publicerad poäng. Claude Opus 5 har varit allmänt tillgänglig sedan den 24 juli 2026 för 5,00 USD per miljon indatatoken och 25,00 USD per miljon utdatatoken, och den har varit måltavlan för varje flaggskepp sedan Qwen3.8-Max-släppet. Det uppenbara sättet att skriva den här jämförelsen är ett specifikationsblad med en kolumn tom. Det användbara sättet är att lägga märke till att den 19 september 2026, tre dagar före tillkännagivandet, räknade Artificial Analysis om sitt Intelligence Index och Claude Opus 5 slutade vara modellen i toppen av det. Den enda förändringen ändrar bilden av vad Qwen 4 Max måste överträffa.
Vad ändrades den 19 september?
Artificial Analysis publicerade indexrevision v4.3.2 den 19 september 2026. Under den aktuella revisionen får Claude Opus 5 51 på Intelligence Index vid sin maximala resonemangsansträngning — 50 vid xhigh, 48 vid high, 45 vid medium och 39 vid low — och den ligger bakom Claude Fable 5.1 och GPT-6 Astra, båda på 53. Kostnaden per uppgift i det indexet är $5,86.
Om det låter som en nedgradering är det inte en sådan. Modellen förändrades inte. Indexet gjorde det. Vår egen bevakning under juli och augusti angav Claude Opus 5 till 61–63 och i toppen av tabellen, och siffrorna var korrekta enligt de revideringar som gällde då. Den som fortfarande citerar dem utan ett revisionsdatum citerar en utgången siffra, och detta är det enskilt vanligaste felet i jämförelser som skrivits den här månaden. Den praktiska konsekvensen är att ett påstående som ”Claude Opus 5 är den modell som får högst poäng av alla tillgängliga” inte längre är sant, och en jämförelse som bygger på det faller samman.
För Qwen-sidan är konsekvensen ännu skarpare. En flaggskeppsnivå som annonserades i september 2026 siktar mot ett mål som omdefinierades i september 2026. Vad Alibaba än till slut publicerar för Qwen 4 Max kommer att läsas mot en resultattavla där 53 är siffran att slå, inte 63.

Jämförelsen, ärligt uttryckt
Den ena sidan av den här tabellen är komplett och den andra sidan är tom, och att låtsas något annat skulle vara hela felmoden för den här artikeln. Här är vad som faktiskt är känt:
• Status — Claude Opus 5 allmänt tillgänglig sedan 24 juli 2026, jämfört med Qwen 4 Max som tillkännagavs den 22 september 2026 utan releasedatum
• Indatapris — Claude Opus 5 $5.00 per 1 miljon tokens, jämfört med Qwen 4 Max som inte har publicerats
• Pris för utdata — Claude Opus 5 $25.00 per 1 miljon tokens, jämfört med Qwen 4 Max som inte är publicerat
• Cachad indata — Claude Opus 5 $0.50 per 1 miljon tokens vid cacheläsning, jämfört med Qwen 4 Max som inte är publicerad
• Kontext — Claude Opus 5 1M tokens vid standardvärdet och maxvärdet, mot Qwen 4 Max som inte är publicerad
• Tak för utdata — Claude Opus 5 128K tokens synkront och 300K på Batches API:et med en beta-header, jämfört med Qwen 4 Max som inte är publicerad
• Modalitet — Claude Opus 5 text-, bild- och filinmatning med textutmatning, mot Qwen 4 Max: ej publicerad
• Prissättning för långa kontexter — Claude Opus 5 har ingen tilläggsavgift, så en begäran på 900 000 token debiteras till samma pris per token som en på 9 000 token, medan Qwen 4 Max inte har någon publicerad prissättning
• Oberoende poäng — Claude Opus 5 51 på Artificial Analysis Intelligence Index v4.3.2 vid maximal ansträngning, jämfört med Qwen 4 Max, för vilken ingen oberoende utvärdering finns
• Leverantörsrapporterade poäng — Claude Opus 5 SWE-bench Verified 96,0 %, SWE-bench Pro 79,2 %, OSWorld 2.0 70,6 %, Terminal-Bench 2.1 i mitten av 80-procentsintervallet beroende på testramverk, jämfört med Qwen 4 Max där inget rapporterats
• Resonemangsstyrning — Claude Opus 5 adaptivt tänkande aktiverat som standard med en femstegs ansträngningsstege, jämfört med Qwen 4 Max som inte har publicerats
Tio rader av ”inte publicerad” är inte ett retoriskt grepp. Det är bevisläget, och den ärliga slutsatsen av det är att ingen kapacitetsjämförelse mellan dessa två modeller ännu kan göras av någon.
Den del av gapet som inte kommer att slutas
Prissättning och kontext kommer så småningom att publiceras. En skillnad kommer att bestå efter lanseringen, och det är värt att fatta beslut om nu snarare än under veckan då Qwen 4 Max släpps: de två modellerna är byggda för att köpas på olika sätt.
Claude Opus 5 är en enda sluten modell till ett enda pris från en enda leverantör, med ett offentliggjort åtagande om avveckling tidigast den 24 juli 2027. Det är ett stabilt mål för kapacitetsplanering. Qwen 4 Max är flaggskeppet i en familj som Alibaba upprepade gånger har släppt över ett mycket bredare prisspann – Qwen 3.8-generationen spänner från ett banbrytande flaggskepp med 2,00 USD i indatapris till en Flash-nivå långt under det – och flaggskeppsnivån i Qwen-serien har historiskt varit den med kortast användbar livstid innan en billigare nivå kommer ikapp den.
Den andra skillnaden är öppna vikter, och den pekar åt andra hållet. Qwen 3.8-generationen publicerade vikter för sin största modell under en anpassad Qwen-licens, vilket är vad som överhuvudtaget gör finjustering, kvantisering och självhostning möjligt. Claude Opus 5 har inte släppt några vikter och kommer inte att göra det. Om din arbetsbelastning behöver en modell som du kan köra inom din egen perimeter, eller modifiera, är det en strukturell fördel som ingen benchmarkrevidering kan ta ifrån Alibaba — och det är det starkaste skälet att bry sig om just denna jämförelse i stället för att behandla den som ett flaggskepp mot ett annat.

Hur man kör den här jämförelsen idag
Claude Opus 5 är tillgänglig nu, och OrcaRouter dirigerar den som anthropic/claude-opus-5 till Anthropics listpris med 0 % påslag — leverantörens pris förs vidare oförändrat, så siffrorna $5.00 och $25.00 ovan är vad du faktureras i stället för en uppräknad motsvarighet. Det spelar större roll än vanligt för en modell i detta prissegment: en plattformsmarginal på 10 procent på ett utpris på $25.00 är $2.50 per miljon token, vilket är mer än hela ingångskostnaden för de flesta alternativa modeller med öppna vikter. Vid sidan av den rymmer katalogen nära 200 modeller på en enda OpenAI-kompatibel endpoint, med automatisk failover när en leverantörsväg försämras och en routing-DSL för att uttrycka policyn explicit i stället för att hårdkoda ett modellnamn i din applikation.
Det som OrcaRouter inte har är Qwen 4 Max, eller någon Qwen 4-nivå. Katalogen har noll poster för familjen, vilket är vad man kan förvänta sig för en modell som har tillkännagivits men inte släppts. När nivåerna väl levereras skulle de dyka upp på samma ställe, och fram till dess är den Qwen-modell som är värd att jämföra med Claude Opus 5 den du faktiskt kan anropa: Qwen3.8-Max, allmänt tillgänglig sedan 3 augusti 2026 till $2.00 för indata och $6.00 för utdata per miljon tokens, med publicerade vikter och en registrerad oberoende intelligenspoäng på 56 till $1.14 per uppgift — en siffra som bokförts under en tidigare indexrevision, så jämför den med Claude Opus 5:s 51 endast med den reservationen.
Vad ska man göra med detta innan ett modellkort finns?
Det finns ingen dom att fälla här, eftersom en av de två modellerna inte existerar som produkt. Vad som kan sägas är att jämförelsen ändrade skepnad den 19 september 2026 utan att någon av leverantörerna gjorde något: Claude Opus 5 är inte längre den högst rankade modellen på det oberoende index som de flesta jämförelser lutar sig mot, och den ligger nu två poäng efter två andra modeller. En lansering av Qwen 4 Max kommer att landa i den tabellen, inte den från juli.
Så beslutet för de kommande månaderna är inte Qwen 4 Max mot Claude Opus 5. Det är Claude Opus 5 mot den Qwen-modell som redan har släppts – en flaggskeppsmodell till en femtedel av indatapriset med publicerade vikter – och den jämförelsen är tillgänglig nu, med verkliga siffror på båda sidor. Återvänd till den när Alibaba publicerar ett modellkort, och behandla alla Qwen 4 Max-benchmarktabeller du ser före dess som overifierade.

Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
