
Claude Opus 5.5-prissättning: Hela prislistan, cachelinjen och vad en uppgift egentligen kostar
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 177 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1323 tok/s
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
Claude Opus 5.5 har ett listpris på $4.00 per miljon input-tokens och $20.00 per miljon output-tokens, en rak 20 % sänkning från $5.00/$25.00 som Claude Opus 5 har haft, med cacheläsningar ned 60 % till $0.20 per miljon. Det är Anthropics publicerade priser, lästa från Anthropics egen prisdokumentation den 24 september 2026, två dagar efter att modellen släpptes. Prislappen är den enkla delen. Anthropic säger också att modellen kostar "cirka 40 % mindre att köra" vid typiska arbetsbelastningar, och den siffran finns inte på prislistan — den är en leverantörsbeskrivning byggd på sänkningen per token plus ett antagande att modellen gör av med färre tokens och färre turer för att slutföra samma jobb. Den här sidan skiljer på de två: varje pris du kan verifiera på listan i dag, och aritmetiken bakom det du inte kan. Claude Fable 5.1, nivån på $10/$50 ovanför den, förekommer genomgående som den jämförelse Anthropic själv gör.
Den fullständiga prislistan, varje rad precis som Anthropic publicerar den
Allt i det här avsnittet lästes från Anthropic's prisdokumentation på platform.claude.com och claude.com den 24 september 2026. Ingenting här är överfört från någon annan sammanställning.
• Indata — $4.00 per miljon tokens (Anthropics publicerade pris).
• Utdata — 20,00 USD per miljon tokens. Tänkande tokens debiteras som utdata-tokens, och Claude Opus 5.5:s adaptiva tänkande är alltid aktiverat och kan inte inaktiveras.
• Cacheläsning — $0,20 per miljon tokens. Anthropic dokumenterar detta som 0,05 gånger baspriset för indata, ett eget fotnotsundantag för denna modell.
• 5-minuters cache-skrivning — $5.00 per miljon tokens, den standardmässiga 1,25x basindata-multiplikatorn som Anthropic tillämpar på varje modell i tabellen.
• 1 timmes cacheskrivning — 8,00 USD per miljon tokens, standardmultiplikatorn på 2x för basindata.
• Batch API – 50 % rabatt i båda riktningarna: 2,00 USD för indata och 10,00 USD för utdata per miljon. Anthropic publicerar de rabatterade siffrorna direkt i stället för att låta dig halvera dem.
• Snabbläge — $8,00 för indata och $40,00 för utdata per miljon, exakt 2x standard. Anthropics dokumentation kallar sidan "Snabbläge (forskningsförhandsvisning)".
• US-only inference — en multiplikator på 1,1x för indata, utdata, cacheskrivningar och cacheläsningar när inference_geo: "us" är inställt. Global routning, som är standard, använder standardprissättning.
• Kontext och tak för utdata — 1M tokens kontext och 128K synkron utdata till standardpris, utan tilläggsavgift för lång kontext. Anthropic uppger att en begäran på 900k tokens faktureras till samma pris per token som en på 9k tokens. I Batch-API:et höjs taket för utdata till 300K bakom output-300k-2026-03-24 beta-huvudet.
Anthropic anger också att cachemultiplikatorerna "staplas med andra prisjusteringar såsom Batch API-rabatten och data residency" – så en batchad, cachad, USA-låst förfrågan multiplicerar alla tre, och aritmetiken blir kumulativ snarare än ersättande.
Här är vad de två modelläsarna faktiskt väger kostnaden på samma ark:
• Claude Opus 5 — 5,00 USD för indata, 25,00 USD för utdata, 0,50 USD för cacheläsning, 6,25 USD för en cacheskrivning på 5 minuter, 10,00 USD för en skrivning på 1 timme, 2,50/12,50 USD för Batch (Anthropics publicerade priser, avlästa 2026-09-24).
• Claude Fable 5.1 — $10.00 för indata, $50.00 för utdata, $0.25 för cacheläsning, $12.50 för en cacheskrivning på 5 minuter, $20.00 för en skrivning på 1 timme, $5.00/$25.00 för Batch (Anthropics publicerade priser, hämtade 2026-09-24).

Det är i cachelinjen som en agentfaktura faktiskt avgörs.
Lanseringsbevakningen behandlar cache-läsningen som en fotnot. Den är den största enskilda hävstången på arket för varje arbetsbelastning som skickar om ett stort prefix, vilket gäller de flesta kodnings- och agentarbetsbelastningar.
Anthropics egen fotnot är ovanligt explicit om kvoterna: cacheträffar och cacheuppdateringar kostar 0,1x baspriset för indata på de flesta Claude-modeller, 0,025x på Claude Fable 5.1, och 0,05x på Claude Opus 5.5. Så Claude Opus 5.5:s cachekvot är dubbelt så dålig som standardkvoten, och dubbelt så dålig som Claude Fable 5.1:s.
I dollar vinner det ändå, och det här är delen som är värd att internalisera: en bättre multiplikator vinner inte i dollar när basfrekvensen är två och en halv gånger högre.
• Claude Fable 5.1 — 2,5 % av ett basbelopp på 10,00 $ är $0,25 per miljon cachade tokens.
• Claude Opus 5.5 — 5 % av en bas på 4,00 $ är 0,20 $ per miljon cachade tokens.
• Claude Opus 5 — 10 % av en bas på 5,00 $ är 0,50 $ per miljon cachade tokens.
Samma inversion gäller för skrivningar. Claude Fable 5.1 tar $12.50 för att skriva en miljon tokens till 5-minuterscachen och $20.00 för 1-timmarsfönstret; Claude Opus 5.5 tar $5.00 och $8.00. Cacheläsningar är den enda posten där Claude Opus 5.5 slår båda syskonen i absoluta dollarbelopp trots att den har den mittersta kvoten.
Två regler avgör om skrivningen är värd att betala för överhuvudtaget. Anthropics dokumentation säger att en 5-minutersskrivning kostar 1,25x basindata och därför lönar sig efter en enda cacheläsning, medan en 1-timmarsskrivning kostar 2x basindata och behöver två läsningar för att löna sig. Och cachen är knuten till det prefix som skapade den: Anthropic noterar att växling mellan snabb och standardhastighet ogiltigförklarar cachen, eftersom förfrågningar vid olika hastigheter inte delar cachade prefix. Att ändra modell, ansträngningsnivå eller verktygsdefinitionerna har samma effekt. En billigare modell som tvingar fram en prefixomskrivning vid varje växling kan kosta mer än den dyra modell den ersatte.
Vad en lång agentloop faktiskt kostar
Ta en kodningsagent med 40 turer som skickar om ett prefix på 120 000 token – systemprompt, verktygsscheman, filträd – vid varje tur, lägger till 1 000 nya indatatoken per tur från verktygsresultat och producerar 800 utdatatoken per tur. Substitution är poängen här: ändra något av dessa fyra nummer så att det matchar din egen trafik, och aritmetiken nedan gäller fortfarande.
Om Claude Opus 5.5:
• Cache-skrivning, en gång — 120 000 tokens till 5,00 $ per miljon = 0,60 $
• Cacheläsningar, 39 turer — 4 680 000 tokens à $0.20 per miljon = $0.94
• Ny indata, 40 turer — 40 000 tokens till 4,00 dollar per miljon = $0,16
• Utdata, 40 turer — 32 000 tokens till $20,00 per miljon = $0,64
• Sessionens totalsumma — $2.34, varav cacheläsningar står för cirka 40 %.
På Claude Opus 5, identiska tokenantal: $0,75 i cache-skrivning, $2,34 i cacheläsningar, $0,20 i ny indata och $0,80 i utdata — $4,09.
På Claude Fable 5.1, identiska tokenantal: $1,50 för cacheskrivning, $1,17 för cacheläsningar, $0,40 för ny indata och $1,60 för utdata — $4,67.
Samma tokens, samma turer, inget effektivitetsanspråk krävs: Claude Opus 5.5 hamnar 43 % under Claude Opus 5 och 50 % under Claude Fable 5.1. Och 1,40 dollar av gapet på 1,75 dollar mot Claude Opus 5 – åttio procent av besparingen – kommer enbart från raden för cacheläsning, inte från den angivna indatatakten.
Kör nu den motsatta formen: ett single-shot-anrop med 20 000 indatatoken och 8 000 utdatatoken, ingen cachelagring. Claude Opus 5.5 kostar 0,08 USD i indata plus 0,16 USD i utdata – 0,24 USD. Claude Opus 5 kostar 0,10 USD plus 0,20 USD – 0,30 USD. Det är exakt den 20-procentiga sänkningen på prislappen, och inte en procentenhet mer.
Så prislistan i sig ger någonstans mellan 20 % och 43 %, beroende på hur mycket av din faktura som är cacheläsningar. Alla påståenden över det intervallet kommer från tokenantal, inte från priser.
Varifrån Anthropics "cirka 40 % billigare att köra" kommer
Anthropics lanseringsmaterial säger att Claude Opus 5.5 "kräver mindre beräkningskapacitet för att serva än Opus 5" och att dess tester visar att den "kommer att kosta 40 % mindre än Opus 5 vid typiska arbetsbelastningar" med standardinställningar. Den uppdelning som Anthropic gör är att modellen "kostar mindre per token än Opus 5 och använder färre tokens per uppgift, vilket netto resulterar i en kostnadsminskning på 40 %."
Kalla det vad det är: en leverantörs karakterisering av ett genomsnitt över arbetsbelastningar som Anthropic valde, inte ett granskat resultat och inte ett pris publicerat i prislistan. Den verifierbara hälften är den första hälften — 20 % rabatt på input och output, 60 % rabatt på cacheläsningar, båda går att läsa i listan i dag. Den andra hälften beror på att modellen förbrukar färre tokens och färre turer på din arbetsbelastning, som bara kan kontrolleras genom att köra den.
Beviset Anthropic erbjuder för tokenhalvan är en uppsättning kundutlåtanden från lanseringen. Alla följande är leverantörspublicerade och beskriver arbetsbelastningar som leverantören och dess kunder valde:
• Box – modellen "använde en tredjedel av de tokens som Opus 5 gjorde", med svar som "40 % mindre ordrika utan att förlora noggrannhet".
• Kiro — den "löste mer än Opus 5 samtidigt som den gjorde omkring 40 % färre anrop och använde hälften av tokens".
• Factory — den "matchade Opus 5 vid hög ansträngning, samtidigt som den använde 20 till 25 % färre utdatatokens."
• GitHub — den "använde bland de minsta antalet token och steg vi mätte", och i VS Code "löste fler terminaluppgifter än Opus 5 på mindre än hälften så många steg."
• Fusionsanalys, ett genomarbetat exempel — två fiktiva HR-programvaruföretag, där varje modell bygger en Excel-modell och en presentation för ledningen. Anthropic rapporterar att Claude Opus 5.5 blev klar på 63 minuter jämfört med 93 för Claude Opus 5 och "kostade 50 % mindre att ta fram". Leverantörsrapporterat, n=1.
Den oberoende motvikten spelar roll här, eftersom den pekar i motsatt riktning. Artificial Analysis mätte Claude Opus 5.5 vid maximal ansträngning till ungefär 119 000 utdatatoken per uppgift i Intelligence Index, mot ungefär 73 000 för Claude Opus 5 vid maximal ansträngning – antalet tokens går upp, inte ner. Dess sammanfattning av den konfigurationen är att Claude Opus 5.5 är "i nivå med Opus 5 när det gäller kostnad per uppgift trots 1,6 gånger så många utdatatoken", till en publicerad kostnad på 5,98 USD per uppgift i Intelligence Index. Det är en oberoende mätning vid maximal ansträngning, och den motsäger inte Anthropics påstående – det är den andra änden av ansträngningsskalan.
Vilket för oss in på det förbehåll som styr varje siffra i det här avsnittet. Anthropic uppger att om inget annat anges använder alla dess Claude Opus 5.5-resultat adaptivt tänkande vid maximal ansträngning. Claude Opus 5.5 använder som standard medium ansträngning; Claude Opus 5 hade hög som standard, och samma namngivna nivå är inte samma tänkandebudget för de två modellerna. Så en leverantörstabell som körts vid maximal ansträngning och en oberoende tabell som körts vid maximal ansträngning med standardåterfall aktiverat är inte samma konfiguration, och inte heller är standardinställningen något en läsare faktiskt skulle använda. Ett genomsnitt på 40 % uppmätt över en utvald uppsättning arbetsbelastningar, vid inställningar du kanske inte använder, är en utgångshypotes – inte en budgetpost.
Snabbläge är en forskningsförhandsvisning, inte en nivå
Fast mode på Claude Opus 5.5 är $8.00 per miljon input och $40.00 per miljon output — exakt dubbelt så mycket som standardpriset — för upp till 2,5 gånger fler output-tokens per sekund. Det förbättrar inte tiden till första token; vinsten ligger i utdatahastigheten, och den märks tydligast vid streaming.
Säg resten rakt ut, för det är lätt att budgetera detta som en nivå när det inte är en. Anthropic kallar snabbläget för en forskningsförhandsvisning. Åtkomst begärs via en kontohanterare eller väntelistan. Det kräver beta-headern fast-mode-2026-02-01 och speed: "fast" i anropet. Det är endast tillgängligt på Claude API — inte på Amazon Bedrock, Google Cloud, Microsoft Foundry eller Claude Platform on AWS. Det kan inte kombineras med Batch API eller med ett Priority Tier-åtagande. Det staplas med prompt-cachning och multiplikatorer för dataresidens, så en US-pinnad cachad begäran i snabbläge betalar 1,1x ovanpå 2x. Och att växla en arbetsbelastning mellan snabb och standardhastighet ogiltigförklarar prompt-cachen, vilket i en lång agentloop kan kosta mer än vad hastigheten sparar.
Claude Opus 5 och Claude Opus 4.8 stöder även snabbläge, för $10,00/$50,00. Claude Opus 4.7 avvisar parametern rakt av.
Enheten som avgör fakturan är kostnaden per slutförd uppgift.
Varje taxa ovan är ett pris per token. Ingen köper tokens. Ett pris per token blir en kostnad först när det multipliceras med antalet tokens som en uppgift förbrukar och antalet försök som krävs för att slutföra den.
Räkna på exemplet med liten cache från tidigare. Vid 0,24 dollar per pass kostar en modell som slutför en uppgift i första försöket 0,24 dollar. Samma uppgift hos en konkurrent med 0,30 dollar per pass kostar 0,30 dollar – så den billigare modellen ser ut att ligga 20 % före. Låt nu den billigare modellen behöva 1,2 pass per slutförd uppgift, vilket är en generös framgångsgrad för agentiskt arbete: 1,2 × 0,24 dollar är 0,288 dollar, mot 0,30 dollar för alternativet med ett enda pass. Besparingen är borta. Vid tre pass är kostnaden 0,72 dollar, och modellen som såg 20 % billigare ut per token är 140 % dyrare per slutfört jobb.
Det är därför Anthropics egna effektivitetsanspråk – färre tokens, färre anrop, färre steg – uttrycks i rätt enhet. Det är också därför inget av dem bör betraktas som en budgetpost förrän du har reproducerat dem. Kontrollen är mekanisk: pris per pass gånger antal pass per slutförd uppgift, mätt på din egen trafik. Båda siffrorna är dina att ta fram, och ingen leverantör publicerar den andra för din arbetsbelastning.
Om du vill ha en enda referenspunkt från en utomstående part, anger Artificial Analysis Claude Opus 5.5 till 5,98 USD per Intelligence Index-uppgift i dess max-effort-konfiguration — en oberoende siffra vid en inställning som de flesta produktionsflöden inte kommer att använda, användbar som ett tak snarare än en prognos.

Linjer som inte ingår i det annonserade priset
• Residency.Endast USA-baserad inferens är 1,1x för varje tokenkategori, inklusive cacheläsningar och cacheskrivningar. Det kombineras med snabbläget och med Batch-rabatten.
• Verktygsdefinitioner. Anthropic publicerar en modellspecifik systemprompt-overhead för verktygsanvändning: att deklarera verktyg adderar 286 tokens till varje Claude Opus 5.5-begäran. Lite vid 4,00 dollar per miljon, men det debiteras per begäran, och en agentloop skickar många begäranden.
• Cache-invalidering. Ett prefix som skrivs om efter en ändring av modell, effort, verktygsdefinition eller hastighet debiteras enligt skrivavgiften – 5,00 $ eller 8,00 $ per miljon på Claude Opus 5.5 – inte läsavgiften på 0,20 $.
• Modellen under den. Claude Sonnet 5 ligger på $2.00 för input och $10.00 för output per miljon, vilket Anthropics prisfotnot bekräftar nu är standardpriset snarare än det introduktionspris som det annonserades som. Claude Opus 5.5 är exakt 2x Sonnet 5 i båda riktningarna.

Anropar Claude Opus 5.5 till Anthropics listpris
Claude Opus 5.5 finns på OrcaRouter som anthropic/claude-opus-5.5 för $4,00 input och $20,00 output per miljon — Anthropics eget listpris, vidarefakturerat med 0 % påslag. Denna vidareföring är värd att uttrycka exakt på en prissida: eftersom leverantörens pris förs vidare i stället för att cachas i en tabell, är en leverantörsprisändring live här samma dag som den publiceras, inte efter ett synkfönster. Om Anthropic ändrar detta prisblad följer taxan du anropar med.
Samma nyckel når de nivåer som den här sidan jämför den mot — anthropic/claude-opus-5 till $5.00/$25.00 och anthropic/claude-fable-5.1 till $10.00/$50.00 — tillsammans med resten av Claude-utbudet och över 200 andra modeller, så att testa om den billigare per-token-taxan håller när den möter dina egna körningsantal kräver varken ett andra avtal eller en kodändring. Automatisk failover finns där för fallet då du vill köra en obekant modell i en produktionsväg utan att satsa vägen på den.
Det tvåradiga svaret på vad den här sidan handlar om: prislistan är 4,00 USD in, 20,00 USD ut och 0,20 USD per miljon cachade läsningar, och 20%-sänkningen är verklig och verifierbar i dag. De 40% är Anthropics genomsnitt över de arbetsbelastningar som bolaget valde. Kör en av dina egna agentloopar genom den innan du budgeterar mot den andra siffran.
Jämförda i den här artikeln3
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
