
Claude Sonnet 5.5: Mellannivåns standardval, fullt specificerad
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Claude Sonnet 5.5 är mellanklassmodellen i Claude-serien, släppt den 28 september 2026, och prissättningen är hela anledningen till att den förtjänar en egen sida: 2 dollar per miljon input-tokens och 10 dollar per miljon output-tokens, mot 4 och 20 dollar för Claude Opus 5.5, flaggskeppet som släpptes sex dagar tidigare. Det är halva outputpriset för 1,62 poäng på Artificial Analysis Intelligence Index – 56,00 för mellanklassmodellen mot 57,62 för flaggskeppet, båda siffrorna uppmätta av Artificial Analysis på indexrevision v4.3.2 och inte av oss och inte av leverantören. Ovanför dem båda ligger Claude Fable 5.1, på 10 / 50 dollar och 53,35 på samma revision: dyrare än flaggskeppet, och sämre än det. På samma listpris om 2 / 10 dollar som Claude Sonnet 5.5 ligger OpenAIs GPT-6.1 Sol, på 51,83 – 417 indexhundradelar på andra sidan linjen, vilket är den jämförelse en läsare som väger mellanklassmodellen mot andra faktiskt måste göra.
Den här sidan är en referens, och datumen säger varför snarare än färskheten. Claude Sonnet 5.5 är tio dagar gammal den 2026-10-08, vilket placerar den utanför det sjudagarsfönster som den här bloggen rapporterar nyheter inom. Det som ligger inom det fönstret är en händelse som är sex dagar gammal: två inlägg på X daterade 2026-10-02, som hävdar att en modell i den här familjen slår en rival som dess egen leverantör till slut höll tillbaka. Det påståendet har inget modell-id, ingen prislista, inget kontextfönster och inget modellkort bakom sig i något register som går att nå härifrån, och det är inte den här sidans — källkedjan, kontrollen av leverantörens frånvaro och själva indexspridningen ägs helt och hållet av artikeln som den här sidan redan har under titeln Claude Fint 5.5 slog GPT-6.1 Astra innan det existerar — och det är det intressanta, som är daterad 2026-10-03. Det påståendet skapade faktiskt en kö av läsare som frågade vilken levererad modell de ska standardisera kring medan de väntar, och den frågan behöver en sida om den modell som finns. Det här är den.
Vad släpptes den 28 september 2026
Leverantörens egen dokumentation ger specifikationen direkt, och den är en fortsättning på nivån snarare än en ny form. Allt nedan lästes från Anthropics Claude Platform-dokumentation den 2026-10-08, så det är Anthropics specifikation, inte ett oberoende test av den.
• Släppt — 28 september 2026. Modellens egen dokumentationssida inleds med raden "Senaste. Släppt 28 september 2026."
• Positionering — "Den bästa kombinationen av snabbhet och intelligens", där jämförande latens anges som Snabb mot Måttlig för Claude Opus 5.5, Långsammare för Claude Fable 5.1 och Snabbast för den lilla nivån.
• Modell-ID — claude-sonnet-5-5 på Claude API, Google Cloud, Microsoft Foundry och Claude Platform on AWS; anthropic.claude-sonnet-5-5 på Amazon Bedrock. Varje Claude-modell-ID är en fastnålad ögonblicksbild, så strängen är inte en pekare som driver iväg under dig.
• Kontext och utdata — 1 000 000 tokens kontext och 128 000 tokens synkron utdata i Messages API, vilket ökar till 300 000 bakom output-300k-2026-03-24 beta-headern i Message Batches API.
• Thinking — adaptivt, alltid på som standard, med en standardansträngning på high. Den lägsta inställningen är between_tools, vilket stänger av tänkande i förväg och accepteras vid high ansträngning eller lägre. Att ställa in temperature, top_p eller top_k till något annat än standardvärdet returnerar ett 400-fel, så en förfrågan migrerad från en äldre Claude-modell med en justerad temperatur misslyckas högljutt i stället för tyst.
• Kunskapsgräns — juni 2026, för både den tillförlitliga gränsen och gränsen för träningsdata.
• Livscykel — Aktiv (senaste), med ett åtagande om att inte avvecklas tidigare än den 28 september 2027 på de plattformar som Anthropic driver. Amazon Bedrock och Google Cloud sätter sina egna datum.
Leverantörens lanseringsinramning är värd att citera eftersom den är ett påstående och inte en mätning: Anthropics tillkännagivande beskriver Claude Sonnet 5.5 som ”en tydlig uppgradering jämfört med Sonnet 5 som är 30 % snabbare och kostar upp till 30 % mindre för de flesta typer av arbete”. Den meningen är leverantörens egen, inte återgiven av oss, och det är en sådan typ av påstående som helt beror på vilket arbete man ställer framför det. Det finns också en migreringskostnad kopplad till utgåvan som den här sidan inte är rätt plats för: fem brytande ändringar påverkar kod som redan körs på Claude Sonnet 5, och en sjätte ändrar svarformen utan att någon förfrågan misslyckas. Den redogörelsen hör hemma i den utrullningsartikel som den här bloggen publicerade under lanseringsveckan, och den är det första du bör läsa om du har Sonnet 5 i produktion i dag.

De 1,62 poängen och halva priset
Oberoende poäng för den här modellen kommer från en enda plats, och de bär på ett nummer som avgör saken. Artificial Analysis mäter Claude Sonnet 5.5 till 56,00 på sitt Intelligence Index, revision v4.3.2, i den konfiguration som sidan anger som ”Claude Sonnet 5.5 (Max, Default Fallback)”. Vi läste den sidan 2026-10-08. På samma revision, samma dag:
• Claude Opus 5.5 — 57,62, släppt 2026-09-22, $4 / $20
• Claude Sonnet 5.5 — 56.00, släpptes 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53,35, släppt 2026-09-01, 10 $ / 50 $
• GPT-6 Astra — 52,67, utgiven 2026-09-03, $10 / $50, med en långkontextnivå över 272 000 prompttokens till $20 / $75
• GPT-6.1 Sol — 51,83, släppt 2026-09-29, 2 $ / 10 $
Att ange vilken revision det gäller är viktigt, eftersom en poäng från en version av indexet inte är jämförbar med en poäng från en annan: v4.3.2 omfattar tio utvärderingar — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience och AA-LCR v1.1 — och sammansättningen av den uppsättningen har förändrats mellan revisioner. Alla fem siffror ovan kommer från samma revision, vilket är anledningen till att de kan läsas mot varandra, och varför ingen av dem kan läsas mot en siffra som citeras från en tidigare version.
Prisjämförelsen är den del som avgör beteendet. Claude Sonnet 5.5:s utdatapris är hälften av Claude Opus 5.5:s, och dess indatapris är också hälften; på leverantörens egen prislista kostar mellanklassmodellen $2 / $10 medan flaggskeppet kostar $4 / $20. Lägger man samman de två publicerade siffrorna blir förhållandet slående: per dollar av utdatapriset bär Claude Sonnet 5.5 5,60 indexpoäng och Claude Opus 5.5 bär 2,88 — nästan dubbelt så mycket index per dollar utdata, enligt Anthropics egen prislista och Artificial Analysiss egen mätning. Det är aritmetik på två publicerade siffror snarare än en mätning av något, och det är den ärliga formen av argumentet för mellanklassmodellen. Det är inte heller en dom: en indexpoäng är inte en enhet för korrekthet, och poängen med resten av den här sidan är vad 1,62 består av och inte består av.

Prislistan, och de två linjer som rör sig mest
Anthropics fullständiga prislista, läst 2026-10-08. Varje siffra i det här avsnittet är leverantörens.
• Indata — 2,00 USD per miljon tokens. Utdata — 10,00 USD per miljon, och tanketokens faktureras som utdata, vilket inte går att stänga av här eftersom adaptivt tänkande är aktiverat som standard.
• Cacheläsning — 0,10 USD per miljon, vilket Anthropic anger som 5 procent av baspriset för indata. Det är samma proportionella rabatt som Claude Opus 5.5 har, så cachning förändrar inte rangordningen mellan de två, och det innebär att en lång agentkörning som behåller ett stabilt prefix betalar en tiondel av indata-priset för allt den läser om.
• Cache-skrivning — 2,50 USD per miljon för femminuterscachen, 4,00 USD för en timmes cache. Den minsta cachebara promptlängden är 512 tokens, så korta prompter kan inte alls få rabatten.
• Batch API — 50 procents rabatt i båda riktningarna, så 1,00 USD in och 5,00 USD ut för arbete som kan vänta.
• Ingen avgift för lång kontext — Anthropic debiterar hela fönstret på 1M tokens till standardpriset per token för den här modellen, så en begäran på 900 000 tokens kostar lika mycket per token som en på 9 000. Det är en verklig skillnad mot GPT-6 Astra, vars långkontextnivå över 272 000 prompttokens kliver upp till $20 / $75 — värt att nämna eftersom det är den enda platsen där de två leverantörernas rubriksiffror skiljer sig kraftigt när en prompt blir lång.
Två rader avgör sedan de flesta fakturor snarare än rubrikpriset: cache-läsningsrabatten under en lång agentkörning, batchrabatten för allt asynkront. Rubrikpriset $2 / $10 är det som jämförs på en resultattavla; cache- och batchraderna är det som en månadsfaktura faktiskt byggs från.
Vad gapet innebär och inte innebär
Intelligence Index är ett enda tal över en fast uppgiftsmix, och denna enda egenskap förklarar det mesta av förvirringen kring det. De tio utvärderingarna bakom v4.3.2 omfattar agentisk kodning och terminalarbete, naturvetenskapligt resonemang på avancerad nivå, en uppsättning för mjukvaruteknik, en uppsättning för agentisk automatisering och en uppsättning för långkontexthämtning, viktade till ett sammansatt mått. En modell som ligger 1,62 poäng efter en annan ligger efter i det sammansatta måttet – inte i din arbetsbelastning, som kan vikta dessa tio i en helt annan proportion och kan innehålla uppgifter som ingen av dem representerar.
Vad det innebär i praktiken är en uppdelning efter arbetets form snarare än efter nivåns prestige. Anthropics egen modellväljare gör uppdelningen explicit, och den är värd att läsa eftersom den inte smickrar mellannivån: dokumentationen uppmanar läsarna att "börja med Claude Opus 5.5 för de flesta arbetsbelastningar", och att ta till Claude Fable 5.1 "för krävande resonemang och agentiskt arbete över långa tidshorisonter, eller när dina utvärderingar av Claude Opus 5.5 med högre ansträngning fortfarande inte räcker". Claude Sonnet 5.5 är inte modellen som den meningen börjar med. Det är modellen som samma dokumentation beskriver som den bästa kombinationen av snabbhet och intelligens, med den snabbaste jämförande latenstiden utanför den lilla nivån — vilket är ett annat argument, och ett snävare sådant.
Så den ärliga tolkningen är denna. Mellanklassen är vanligtvis rätt svar för välavgränsat arbete i hög volym: funktioner och buggfixar mot en känd kodbas, extraktion och klassificering med en definierad utdataform, loopar för verktygsanrop där det svåra är ramverket snarare än resonemanget, och allt där en snabb första token och låg kostnad per anrop betyder mer än de sista två procenten av kapaciteten. Flaggskeppet förtjänar sitt pris när arbetet har en genuint lång horisont – agentkörningar över flera timmar, refaktoreringar som spänner över filer som prompten inte kan hålla på en gång, och utvärderingar på mellanklassen som mätbart kommer till korta vid högre ansträngning. Det sista villkoret är leverantörens eget, och det är testbart: höj ansträngningsnivån på mellanklassen, kör din egen utvärdering och se om den sluter gapet. Om den gör det var 1,62 inte bärande för dig. Om den inte gör det har du köpt ditt svar med dina egna siffror i stället för med någon annans sammanvägda poäng.
Vad gapet inte betyder är att 1,62 poäng är ingenting. Det är hela marginalen mellan två modeller, och på en fast testbänk utvärderad under identiska förhållanden är det en verklig rangordning. Det är helt enkelt en rangordning av en specifik uppgiftsmix, vid maximal ansträngning med standardreserv, och det säger ingenting om vilken av de två som är det bättre köpet för en arbetsbelastning som ingen av dem har benchmarkats på.
Namnfällan: vilken Claude Sonnet 5.5-sida detta är
En läsare som söker på den här modellens namn stöter på flera sidor på den här bloggen som ser ut som den här, men som inte är det. Den som är daterad 2026-09-24 är förväntanssidan: den skrevs innan modellen släpptes, och dess ämne var ett enda X-inlägg som hävdade ett smygtest, rekonstruerat utifrån siffrorna för modellen den skulle ersätta. Den som publicerades i släppveckan är utrullningsgenomgången: dess ämne är de fem brytande ändringarna som påverkar kod som redan körs på Claude Sonnet 5, plus den sjätte ändringen som ändrar svarformen utan att orsaka ett fel. Det finns också en samling jämförelsesidor som ställer den här modellens namn mot andra leverantörers modeller, och en tillämpad sida om vad släppets kampanj omfattar.
Ingen av dem är modellsidan, och det är gapet som den här artikeln fyller. Den här sidan är referensen en läsare når efter att ha sökt på modellens eget namn: vad den är, vad den kostar, vad den mäter, och vilket arbete som hör till den. Rollout-sidans migreringsdetaljer och förväntningssidans källkritik ligger kvar där de är; om du har Sonnet 5-kod i produktion är rollout-sidan ditt första klick, och den här sidan är det som säger dig huruvida modellen du migrerar till är den du vill ha.
En namngivningsvana är värd att rätta till medan vi ändå är här, för den vilseleder i sig. Ett 5.5-suffix markerar en generation, inte en rang. Claude Sonnet 5.5 och Claude Opus 5.5 är samma generation i samma familj, och siffran framför punkten är nivån. Inget i suffixet säger vilken som vinner ett benchmark.
Tillgänglighet, daterad
Claude Sonnet 5.5 har funnits på OrcaRouter sedan det lanserades, som anthropic/claude-sonnet-5.5, till Anthropics eget listpris utan påslag ovanpå: 2,00 USD in och 10,00 USD ut per miljon tokens, de två siffrorna hämtade från vår egen modelländpunkt den 2026-10-08 och överensstämmande med leverantörens prislista rad för rad. Vår sida för den anger samma kontextfönster på 1 M tokens och maximal utdata på 128 K, listar text, bild och fil som godkända indatatyper och text som den enda utdata, markerar den som släppt 2026-09-28 och inte föråldrad, och visar att den nås både via den OpenAI-kompatibla chat-completions-ändpunkten och via Anthropics egen messages-ändpunkt – vilket är det som gör den till en drop-in-ändring för en integration som redan talar någon av dem.
Allt annat i samma katalog nås från samma nyckel: ett API för 200+ modeller, med leverantörens listpris vidarebefordrat med 0 % påslag så att en leverantörs prissänkning når en kund samma dag som den annonseras, automatisk failover när en slutpunkt försämras, och en routing-DSL för de fall där du vill låsa en modell eller kombinera flera till ett svar. Den kombinationen är vad som gör frågan på den här sidan billig att besvara i stället för dyr. Båda modellerna i jämförelsen ovan ligger bakom samma autentiseringsuppgift, så priset du jämför mot är leverantörens eget publicerade pris i stället för en återförsäljares, och versionstestet kostar en eval-körning i stället för ett migreringsprojekt: rikta en del av trafiken mot anthropic/claude-sonnet-5.5, behåll resten på flaggskeppet och låt dina egna siffror för kostnad per slutförd uppgift avgöra vilken som ska vara standard.

Den korta versionen
Claude Sonnet 5.5 är en mellanklassmodell med flaggskeppsnära siffror och halva flaggskeppets outputpris, och de tre fakta som avgör om den är ditt standardval är dessa. Den ligger 1,62 poäng efter Claude Opus 5.5 i Artificial Analysis v4.3.2-index, på 56,00 mot 57,62, där båda siffrorna är uppmätta på samma revision och i samma max-effort-konfiguration med standardfallback. Den kostar 2 / 10 dollar mot flaggskeppets 4 / 20 dollar, med cache- och batchrabatter som är proportionella snarare än olika, så prisskillnaden överlever varje rabatt som endera modellen erbjuder. Och den har som standard hög ansträngning medan flaggskeppet som standard har medium, vilket innebär att en inställning som ärvts från flaggskeppet hamnar en nivå högre här i stället för lägre, och kostnaden för det är upp till dig att mäta i stället för att anta.
Anthropics egen väljare börjar fortfarande vid Claude Opus 5.5 för de flesta arbetsbelastningar, och det är värt att veta innan du standardiserar på något. Men för de flesta läsare som kommer till den här sidan genom att söka på modellens namn är mellannivån ett förnuftigt standardval och flaggskeppet undantaget du köper när dina egna utvärderingar kräver det – väl avgränsat arbete i volym, snabb latens, ett fönster på en miljon tokens utan långkontextpåslag, och en taxa som halverar utdataposten. Båda nås med en enda nyckel på OrcaRouter, och utvärderingen som avgör mellan dem kostar en eftermiddag snarare än en migrering.
Jämförda i den här artikeln4
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
