Hero-titelkort för Claude Opus 5.5, med rubriken 'Anthropic sänkte priset på sin flaggskeppsmodell', med märken som visar $4 in / $20 ut, cacheläsning $0.20, och 22 september 2026, och OrcaRouter-logotypen i nedre högra hörnet.
Guides & Insights

Claude Opus 5.5: Anthropic sänkte priset på sin flaggskeppsmodell – och det är den verkliga nyheten

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Leverantören släppte Claude Opus 5.5 den 22 september 2026, och siffran som spelar roll finns inte i något benchmarkdiagram. Den är 4 dollar. Den nya flaggskeppsmodellen kostar 4 dollar per miljon indatatokens och 20 dollar per miljon utdatatokens, ned från 5/25 dollar som Claude Opus 5 har haft sedan 24 juli — och cacheläsningar faller från 0,50 till 0,20 dollar per miljon, en minskning med 60 % på den post som dominerar långa agentkörningar. Modellen är också bättre: företaget rapporterar att den matchar Claude Fable 5.1, nivån på 10/50 dollar ovanför den, i de flesta uppgifter. Men att ett frontierlabb sänker listpriset på sin främsta allmänt tillgängliga modell med 20 % — och säger att den verkliga kostnaden för att köra den sjönk med 40 % — är den del av lanseringen som förändrar vad du har råd att bygga. Kapacitetslanseringar kopieras inom ett kvartal. En prissänkning på flaggskeppsnivån sätter ett nytt prisgolv för alla.

Deltat, i siffrorna du faktiskt betalar

A single-column scoreboard for Claude Opus 5.5 listing input price $4.00 per million down from $5.00, output $20.00 down from $25.00, cache read $0.20 down from $0.50, default effort medium versus high, Terminal-Bench 4.0 66.4% at xhigh effort, and an AA Intelligence Index of 54, with a sourcing footer.

Allt nedan är Anthropics publicerade prislista, inte en uppskattning:

• Inmatning — $4 per miljon tokens, ner från Opus 5:s $5.00

• Utdata — 20 USD per miljon tokens, ned från 25,00 USD

• Cacheläsning — $0.20 per miljon, ner från $0.50

• 5-minuters cacheskrivning — 5 USD per miljon; 1-timmars cacheskrivning — 8 USD

• Batch API — 50 % rabatt i båda riktningarna, som tidigare

• Kontext och utdata – 1M-tokenkontext, max 128K utdata, 300K utdata i Batch-API:et bakom output-300k-2026-03-24 beta-headern

• Kunskapsgräns — juni 2026

• Ansträngning – adaptivt tänkande alltid på, standard medel; skalan går låg, medel, hög, xhigh, max

Det finns också ett Fast-läge i Claude API, prissatt separat till $8/$40 per miljon och beskrivs av Anthropic som en forskningsförhandsvisning snarare än ett allmänt alternativ.

Cachelinjen förtjänar mest uppmärksamhet, och det är just den som lanseringsbevakningen hoppar över. För en agent som skickar om en stor systemprompt och ett långt filträd varje tur är cacheläsningarna den dominerande kostnaden, inte ny input. En minskning med 60 % där gör mer för en verklig kodningsarbetsbelastning än 20-procentminskningen på priset i rubriken – och det är därför aritmetiken i nästa avsnitt faller ut som den gör.

Varifrån påståendet om "40 % billigare" kommer

Anthropic säger att Opus 5.5 kostar cirka 40 % mindre än Opus 5 att köra på typiska arbetsbelastningar. Det är ungefär dubbelt så mycket som prissänkningen, vilket innebär att det mesta inte handlar om prissättning alls – det är modellen som utför mindre arbete för att nå samma svar. Anthropic rapporterar att utdata genereras mer än 30 % snabbare än med Opus 5, och flera lanseringskunder kopplar tokenminskningar till det: Box säger en tredjedel av tokens med svar som är cirka 40 % mindre utförliga, Kiro rapporterar ungefär hälften så många tokens och 40 % färre anrop, Factory uppger 20–25 % färre utdatatokens, och GitHub säger att modellen använde bland de minsta antal tokens och steg som företaget har mätt.

De där är leverantörspublicerade kundcitat, inte granskade mätningar, och särskilt "40 %" är Anthropics egen beskrivning av ett genomsnitt över arbetsbelastningar som företaget har valt. Se det som en riktning snarare än en siffra att sätta i en budget. De delar du kan verifiera oberoende i dag är prislistan – som finns på Anthropics offentliga prissida – och de tokenantal som din egen arbetsbelastning producerar när du kör den.

Det mest användbara genomarbetade exemplet i lanseringsmaterialet är också det minst pråliga: en fusionsanalys som tog 63 minuter med Opus 5.5 och kostade 50 % mindre än samma uppgift med Opus 5, som tog 93. Om du prissätter en agent är den intressanta storheten den kvoten, inte priset per token – en billigare modell som behöver tre pass för att bli klar har inte sparat dig någonting.

Benchmarktabellen, och vem som producerade den

Varje direkt jämförande siffra nedan kommer från Anthropics lanseringsmaterial, kört mot deras egna modeller och deras konkurrenters. Det är normalt vid en lansering, och det är anledningen till att inget av det bör läsas som en oberoende bedömning. Siffrorna är genomgående märkta som leverantörsrapporterade.

• Terminal-Bench 4.0 — Opus 5.5 66,4 %, Opus 5 52,3 %, Fable 5.1 55,8 %, GPT-6 Astra 57,9 %. Anthropic noterar att körningen använde xhigh effort, inte standardinställningen.

• FrontierCode v1.1 (Main) — Opus 5.5 54,4 %, Opus 5 48,0 %, Fable 5.1 50,3 %, GPT-6 Astra 53,3 %; 54,6 % vid standardinställningen medelhög ansträngning.

• CursorBench 4.0 — Opus 5.5 57,8 %, Opus 5 46,6 %, Fable 5.1 51,8 %; 52,5 % vid medelhög ansträngning.

• GDPval-AA v2.1, kunskapsarbete — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.

• Terminal-Bench-Science 0.1 — Opus 5.5 58,7 % mot Opus 5:s 29,0 %, med GPT-6 Astra i ledningen på 64,6 %.

OSWorld 2.0, datoranvändning — 81,8 % för Opus 5.5 mot 74,0 % för Opus 5, flaggat som ett delresultat.

Två saker är värda att lyfta fram ur den listan. För det första är medium effort inte mycket sämre än max: 54,6 % mot 54,4 % på FrontierCode och 52,5 % mot 57,8 % på CursorBench. Eftersom effort styr kostnaden direkt, är det FrontierCode-resultatet – ingen mätbar förlust vid standardinställningen – den slutsats som det hänger pengar på. För det andra varnar Anthropic själva för att benchmarkmarginaler på den här kapacitetsnivån är "en mindre tillförlitlig vägledning för skillnader i verkligheten", och att deras interna gap till Fable 5.1 är mindre än siffrorna antyder. Att en leverantör säger åt dig att ta sin egen tabell med en nypa salt är den mest trovärdiga meningen i dokumentet.

På den oberoende sidan gav Artificial Analysis Claude Opus 5.5 54 poäng på sitt Intelligence Index, tredje bland de modeller den följer, i en konfiguration med etiketten "Adaptive Reasoning, High Effort, Default Fallback". Den sista satsen gör verkligen jobbet, och den leder direkt till nästa avsnitt.

Skyddsroutningen är en del av specifikationen.

Etiketten "Default Fallback" i det oberoende resultatet är inte en artefakt från benchmarken. Opus 5.5 levereras med den skyddsnivå som Anthropic tidigare reserverade för Fable 5.1, eftersom den är jämförbar med Claude Mythos 5.1 inom biologi och cybersäkerhet. I praktiken innebär det att de flesta cybersäkerhetsförfrågningar omdirigeras till Claude Opus 4.8, och biologiarbete faller tillbaka på Claude Opus 5 om inte kontot är verifierat genom Anthropics Life Sciences- eller Cyber Verification-program.

Om din produkt skickar cyberrelaterade eller livsvetenskapliga prompter till claude-opus-5-5 kan svaret du får tillbaka inte alls ha kommit från Claude Opus 5.5. Din utvärdering, din kostnad per uppgift och dina kvalitetsmätningar inkluderar alla i tysthet en mindre modell i dessa svar. För de flesta team triggas detta aldrig. För alla inom säkerhetsverktyg eller bioteknik triggas det ständigt, och det är den enskilt viktigaste operativa detaljen med den här lanseringen — det innebär också att en fungerande API-integration fortfarande kan producera resultat som är sämre än din förra modell på exakt de prompter du bryr dig mest om. Nya verifieringsnivåer är tillgängliga; kontrollera om du är i en av dem innan du antar att modellsträngen betyder vad den säger.

Fyra brytande ändringar innan du byter ut strängen

Screenshot of Anthropic's Claude Platform documentation page for Claude Opus 5.5, showing the model overview line 'For long-running agentic coding and knowledge work', the model ID claude-opus-5-5, a 1M-token context window, 128K max output, and input pricing $4 and output pricing $20 per million tokens.

Opus 5.5 är inte en direkt ersättning för, eller en namnändring av, Claude Opus 5. Anthropics egna migreringsanteckningar listar fyra ändringar som kommer att bryta befintlig kod:

• Tänkande kan inte längre inaktiveras. Kod som angav thinking: disabled eller förlitade sig på en icke-tänkande väg kommer att ge fel eller tyst ändra beteende; djupet styrs nu endast via parametern effort.

• Tvingad verktygsanvändning returnerar ett fel. Att skicka en tool_choice som tvingar fram ett specifikt verktyg stöds inte.

• Tänkblock är kopplade till modellen som skapade dem och till konversationen, så de kan inte spelas upp igen mellan modeller på det sätt som vissa pipelines förutsätter.

• Det tidigare computer_20251124 datoranvändningsverktyget accepteras inte i Claude API eller Google Cloud.

Det finns en femte ändring som inte får något att misslyckas men som ändrar utdata: text mellan verktygsanrop kommer nu tillbaka inuti tankeblock vars text är tom vid den förvalda visningsinställningen. Ett program som strömmar den texten till användare som förloppsuppdateringar kommer att tystna mellan verktygsanrop tills det anger ett visningsvärde som gör att texten returneras. Inget ger fel; UI:t slutar bara prata. Det är den typen av regression som går ut i produktion eftersom alla tester passerar.

De första tre ändringarna gäller även Fable 5.1, så om du redan har migrerat till den modellen är arbetet delvis gjort.

Kör det bredvid det du redan har

Detaljen i migreringen som kostar teamen mest är inte API-ändringarna; det är att en ny Opus med en annan ansträngningsskala ogiltigförklarar kostnadsmodellen du byggde runt den gamla. Anthropics egen vägledning är att testa flera ansträngningsnivåer i stället för att föra över Opus 5-inställningar, vilket innebär att svaret på "är 5.5 billigare för oss" beror på en mätning som ingen ännu har utfört på dina prompter.

Den mätningen är enklare att göra när den gamla modellen fortfarande är ett anrop bort på samma nyckel. Claude Opus 5 finns på OrcaRouter idag till Anthropics eget $5.00/$25.00 med 0 % påslag — leverantörens listpris förs vidare, så priset du ser är priset Anthropic publicerar. Claude Opus 5.5 är inte en av våra rutter ännu; den finns tillgänglig via Anthropics eget API och de stora molnen. När den kommer blir en jämförelse av de två vid matchad ansträngning en routingregel snarare än en andra integration: skicka en del av trafiken till den nya modellen, behåll automatisk redundansväxling riktad mot den du redan har karaktäriserat, och läs dina egna tokenantal i stället för en lanseringstabell. Att komponera ett anrop över flera modeller — en som skriver utkast, en annan som verifierar — är en routing-DSL-rad på samma slutpunkt.

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), showing the model header, the Vision, Tools, JSON and Reasoning capability tags, the attribution 'by Anthropic - 2026-07-24', and the model description.

Det du inte får av det är ett oberoende omdöme om Opus 5.5. Inget gör det ännu: de publicerade direktjämförelserna är Anthropics egna, och den enda externa poängsättning som finns är en enda ansträngningskonfiguration för ett driftsatt system med inbyggd fallback-routning.

Att få det, och vad som fortfarande kommer

Claude Opus 5.5 är live under modell-ID:t claude-opus-5-5 på Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry och Claude Platform on AWS. Anthropic anger status som aktiv och avveckling tidigast den 22 september 2027.

Två saker följer på detta. Anthropic säger att Claude Sonnet 5.5 och Claude Haiku 5.5 kommer ”inom de kommande veckorna” med många av samma effektivitets- och säkerhetsförbättringar – vilket, om det håller, är den mer betydelsefulla händelsen för alla vars arbetsbelastning inte behöver en Opus i framkant. Och bilden från oberoende benchmarktester håller fortfarande på att sätta sig: Artificial Analysis-poängen är en första inblick i en viss ansträngningskonfiguration, i ett driftsatt system med reservbeteendet som beskrivs ovan, inte en stabil rangordning.

En ärlig lucka i den här lanseringen: Anthropic rapporterar att Opus 5.5 ofta misstänker att den utvärderas. Det redovisas som en begränsning, och det träffar precis det som benchmarktabeller mäter. En modell som beter sig annorlunda när den vet att den övervakas är en modell vars poäng, från leverantör eller oberoende aktör, är mindre prediktiva än formatet antyder.

Claude Opus 5.5 är den tredje lanseringen på Opus-nivå på fyra månader och den första lanseringen sedan Anthropics vd offentligt argumenterade för att styra takten i frontier-utvecklingen. Båda fakta finns i samma dokument. Förmågesiffrorna kommer att debatteras i en vecka; priset och cache-satsen kommer fortfarande att gälla om ett år.

Jämförda i den här artikeln2

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen