Genererat hero-titelkort för Claude Sonnet 5.5 vs Claude Opus 5, med undertexten 'En prissänkning på 60 % och en skillnad på fem punkter', som visar $2.00 och $10.00 per miljon tokens mot $5.00 och $25.00, med OrcaRouter-logotypen komponerad i det nedre högra hörnet.
Guides & Insights

Claude Sonnet 5.5 vs Claude Opus 5: Billigare på varje punkt – och före i indexet

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Claude Opus 5 lanserades den 24 juli 2026 för 5,00 USD per miljon indatatokens och 25,00 USD per miljon utdatatokens. Claude Sonnet 5.5 blev allmänt tillgänglig den 28 september 2026 för 2,00 USD respektive 10,00 USD. Det är en minskning med 60 % för indata och 60 % för utdata för en modell som är två generationer nyare – och, i det testramverk som Artificial Analysis kör för båda, en modell som hamnar på 56 i Intelligence Index v4.3 mot Claude Opus 5:s 51. Detta är en sällsynt jämförelse där den nyare och billigare modellen också är den som får högst poäng i ett tredjepartsindex, och där det kvarvarande argumentet för den etablerade modellen inte är placering i benchmark utan en specifik typ av arbete. Båda modellerna har ett kontextfönster på 1M tokens, båda producerar upp till 128K tokens, båda läser text, bilder och filer, och båda konfigurerar resonemang via en effort-parameter i stället för en budget för tanketokens. Eftersom gränssnitten är desamma är valet mellan dem enbart en fråga om vad en slutförd uppgift kostar och vilka uppgifter som misslyckas.

Två versioner, ett gränssnitt

Börja med hur lite som förändras, för det är mer än i de flesta generationskliv.

• Kontextfönster — 1 000 000 tokens på båda

• Maximal utdata — 128 000 tokens på båda

• Indatamodalitet — text, bild och fil på båda; varken ljud eller video på någon av dem

• Resonemang — adaptivt tänkande med konfigurerbar ansträngning på båda, så djupet är en förfrågningsparameter snarare än en separat modellsträng

• Kapaciteter — vision, verktyg, JSON och resonemang på båda, enligt OrcaRouter-katalogens poster för anthropic/claude-opus-5 och Sonnet-serien

Den praktiska konsekvensen är att en prompt skriven för Claude Opus 5 inte behöver skrivas om för att köras på Claude Sonnet 5.5, och en agentloop som är trimmad för ett utdatatak på 128K behöver inte en ny nivå. Migrering är ett byte av modellsträng plus en ny kontroll av vilken effort-inställning du hade låst — inget mer. För team som levde igenom de multimodala, multiparametriska omställningarna under de senaste två åren är det huvudnyheten, inte benchmarkresultatet.

Det enda som verkligen ändras är priset, och det ändras vid varje rad, inte bara de två på marknadsföringsbilden.

• Indata — 2,00 USD per miljon mot 5,00 USD, en sänkning med 60 %

• Utdata — $10,00 per miljon mot $25,00, en sänkning med 60 %

• Cacheläsning — $0,20 per miljon mot $0,50, en sänkning med 60 %

• Cache-skrivning — 2,50 USD per miljon mot 10,00 USD för femminutersfönstret, en minskning med 75 %

Om du kör en agent som läser om ett långt prefix vid varje tur, är raden för cache-läsning den som betalar för migreringen. Med $0.20 mot $0.50 hamnar varje cachad token i en lång session på 40 % av sin tidigare kostnad, och cache-läsningar utgör merparten av tokenantalet i de flesta agentiska loopar. Besparingen ackumuleras på ett sätt som rubriken per token inte fångar.

Varifrån kommer de fem punkterna?

Artificial Analysis ger Claude Sonnet 5.5 betyget 56 och Claude Opus 5 betyget 51 på Intelligence Index v4.3, båda uppmätta under konfigurationen ”Adaptive Reasoning, Max Effort”. Fem poäng är inte ett avrundningsfel på den skalan – för att sätta det i sammanhang placerar samma utvärderare Sonnet 5 på 38 och Gemini 3.1 Pro Preview på 30, så gapet mellan Claude Opus 5 och Claude Sonnet 5.5 är en tredjedel av gapet mellan Claude Opus 5 och den föregående Sonnet-generationen.

Anthropics egna lanseringssiffror för Claude Sonnet 5.5 pekar i samma riktning med ett annat instrument. Företaget rapporterar 70,6 % på Terminal-Bench 4.0 – samma test där Claude Opus 5 dokumenteras med 89,1 % i en tidigare Anthropic-tabell, en siffra som byggde på en annan revision av testramverket och inte bör subtraheras från den nyare. Det är den enskilt viktigaste källkritiska varningen i den här artikeln: Terminal-Bench gick över till 4.0 en bit in på 2026, indexet som innehöll det reviderades till v4.3 för att matcha, och jämförelser mellan versioner av det benchmarket kan inte göras med enkel aritmetik. När en siffra har en version kopplad till sig ska versionen anges.

Det som kan jämföras på ett rättvist sätt är leverantörens egen progression för Sonnet 5 – 10,3 % på Terminal-Bench 4.0 för Sonnet 5 till 70,6 % för Sonnet 5.5 – och tredjepartsindexets mätvärde, där båda siffrorna kommer från samma testramverk samma dag. Utifrån den bevisningen har efterföljaren verkligen gått om juliflaggskeppet när det gäller allmän resonemangsförmåga, vilket är ett starkare påstående än vad någon leverantörspresentation gör.

Utdatalängdsfällan

Det är här som aritmetiken slutar vara snäll mot den nyare modellen.

Artificial Analysis rapporterar att det kostar 7,60 dollar per uppgift att utvärdera Claude Sonnet 5.5 i deras indexsvit. Claude Opus 5 kostar 5,86 dollar per uppgift i samma svit. Den nyare modellen, med 60 % rabatt på varje rad i prislistan, är ungefär 30 % dyrare när man slutför en uppgift med den. Anledningen finns i samma rapport: Sonnet 5.5 genererade 410 miljoner tokens i sviten, jämfört med en median på 88 miljoner bland de modeller som följs, vilket utvärderaren kallar "mycket mångordig." Claude Opus 5 genererade 140 miljoner i samma svit.

Räknar man ut det är mekanismen enkel. Sonnet 5.5 producerar ungefär tre gånger så många utdatatokens som Claude Opus 5 för identiskt arbete, till 40 % av utdatapriset. Tre gånger 0,4 är 1,2 – en straffavgift på 20 % innan cacheeffekter, vilket ligger i närheten av resultatet 7,60 $ mot 5,86 $. Priset per token är inte fel; det är bara inte talet som styr fakturan.

Detta gör inte den nyare modellen till det sämre köpet. Det gör att beslutet beror på något som de flesta jämförelser utelämnar: huruvida din arbetsbelastning låter dig begränsa utdatan. Ett sammanfattningsjobb med en längdinstruktion, en pipeline för strukturerad extraktion som producerar JSON, en klassificerare som returnerar en etikett – i alla dessa gör sig mångordigheten aldrig gällande, och 60-procentminskningen av prislistan är riktiga pengar. En öppen agent som ombeds "fixa repot" utan utdatadisciplin ger Sonnet 5.5 tre gånger så mycket rep.

Inställningar för arbetsinsats och migreringen som ingen budgeterar för

Båda modellerna exponerar resonemangsdjup genom en effort-parameter med flera nivåer, och båda levereras med ett standardvärde snarare än ett fast värde – högt på Claude Platform, medium i Claude-apparna. Frestelsen vid en migrering är att lämna inställningen där den var på den gamla modellen och anse jobbet gjort.

Det är ett misstag av en mätbar anledning. Anthropics egen fotnot för Claude Sonnet 5.5 anger att konfigurationen Max effort får lägre poäng än Xhigh på FrontierCode, vilket innebär att effort inte är ett monotont reglage och att den högsta inställningen inte är en gratis uppgradering. Ställ in effort genom att mäta din uppgift, inte genom att välja det dyraste tillgängliga alternativet.

Det finns också en påtaglig beteendeskillnad på Sonnet-sidan som är värd att känna till före en utrullning. Anthropic uppger att Claude Sonnet 5.5 är den första Sonnet-modellen som levereras med cyberskydd och reservvägar som matchar deras toppmodeller, så säkerhetsförfrågningar med högre risk faller synligt tillbaka till den tidigare Sonnet i stället för att hanteras av modellen du angav. Om din arbetsbelastning ligger inom det området kommer dina loggar att visa en modell som du inte begärde. Claude Opus 5 föregår den ordningen på Sonnet-linjen, även om samma typ av routning finns i Anthropics produkter för biologi- och cybersäkerhetsarbete på flaggskeppsnivåerna.

På OrcaRouter är båda slutpunkterna live idag – anthropic/claude-opus-5 och anthropic/claude-sonnet-5 finns i samma katalog som allt annat, prissatta enligt leverantörens lista med 0 % påslag – och Claude Sonnet 5.5 kommer att vara nåbar med samma autentiseringsuppgift så snart den listas. Den relevanta funktionen under tiden är automatisk failover: om en Anthropic-nivå är hastighetsbegränsad eller returnerar fel, kan begäran styras om till den andra utan kodändring, vilket är den billigaste möjliga säkringen mot att ha fel om den här jämförelsen.

Beslutet, formulerat som en regel

Om ditt arbete är avgränsat – du styr utdatans form, prompterna är strukturerade och antalet token per uppgift är förutsägbart – gå över till Claude Sonnet 5.5 och ta 60-procentminskningen. Indexet håller med, prislistan håller med, och det finns inget kapacitetsargument kvar på andra sidan.

Om ditt arbete är öppet och agentiskt, kör experimentet innan du tror på någon av prislistorna. Mät tokens per slutförd uppgift på din egen trafik under en vecka för varje modell; resultatet 7,60 $ mot 5,86 $ från tredje part är en specifik varning om att den billigare pristabellen kan ge den större räkningen. Claude Opus 5 förblir ett säkrare standardval för långsiktigt autonomt arbete tills du har den siffran.

Den ärliga domen: detta är den första Sonnet-generationen där flaggskeppets argument vilar på uppgiftens utformning snarare än rå kapacitet, och den som fortfarande fattar beslutet enbart utifrån modellnamnet lämnar nu 60 % på bordet eller betalar 30 % mer per slutförd uppgift, beroende bara på åt vilket håll de gissar.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Opus 5 across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run, 410M output tokens on the index suite. Right column Claude Opus 5: input $5.00, output $25.00, cache read $0.50, cache write $10.00, 1M context with 128K max output, AA Intelligence Index v4.3 score 51, $5.86 per task on the index run, 140M output tokens on the index suite. A footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Sonnet 5.5 is 60% cheaper on input, output and cache reads and 75% cheaper on cache writes, and still costs about 30% more per finished task."Screenshot of the OrcaRouter model page for Anthropic Claude Opus 5 (anthropic/claude-opus-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.19-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-07-24" line, and the $5.00 input and $25.00 output prices per million tokens.Screenshot of Artificial Analysis's model page for Claude Sonnet 5.5, named in full as "Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" and marked released September 2026, showing the In $2.00 and Out $10.00 rates, the Intelligence Index score of 56, the $7.60 average cost per task, and the 410M output tokens described as very verbose against a median of 88M.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen