
Claude Sonnet 5.5 vs Claude Sonnet 5: Identiska priser, olika fakturor
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 984 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 195 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Två modeller från samma leverantör, samma nivå, samma namn och – på varje rad i den publicerade prislistan – samma pris. Claude Sonnet 5 lanserades den 30 juni 2026 till $2.00 per miljon indatatoken och $10.00 per miljon utdatatoken. Claude Sonnet 5.5 blev allmänt tillgänglig den 28 september 2026 till $2.00 och $10.00, med cacheläsningar på $0.20 och cacheskrivningar med fem minuters varaktighet på $2.50 för båda. Ingenting med priset förändrades. Det som förändrades är allt som en prislista inte mäter, och resultatet är att en av dessa två modeller är avsevärt billigare att driva än den andra, trots att de kostar exakt lika mycket per token. Anthropics egen rubrik för lanseringen säger lika mycket utan att riktigt säga det: upp till 30 % lägre kostnad för de flesta typer av arbete, på en oförändrad prislista. Det enda sättet båda meningarna kan vara sanna på är om den nyare modellen slutför samma uppgift med färre tokens, vilket är vad benchmarkarna visar och vad de oberoende siffrorna per uppgift bekräftar.
Är Claude Sonnet 5.5 dyrare än Claude Sonnet 5?
Nej – och frågan är ändå värd att ta på allvar, eftersom väldigt många migreringar har gått fel genom att behandla en prislista med fasta priser som en fast faktura.
Per token är de två modellerna identiska: 2,00 $ in, 10,00 $ ut, 0,20 $ för att läsa en cachad token, 2,50 $ för att skriva en. Det finns inget nivåindelat intervall och ingen tilläggsavgift för lång kontext. Vad den nyare modellen än är, så är den inte en prisökning utklädd till en generation.
Per slutförd uppgift skiftar bilden beroende på vems arbetsbelastning man beskriver. Artificial Analysis rapporterar en kostnad på 5,09 USD per uppgift för Claude Sonnet 5 och 7,60 USD per uppgift för Claude Sonnet 5.5 i samma svit för Intelligence Index v4.3 – den nyare modellen är 49 % dyrare att slutföra en uppgift med, till identisk taxa. Samma rapport noterar att Sonnet 5.5 genererade 410 miljoner tokens i sviten, mot Sonnet 5:s 370 miljoner, båda jämfört med en median på 88 miljoner för det bevakade fältet. På utvärderarens öppna uppmaningar skriver den nyare modellen helt enkelt mer, och vid lika priser innebär fler tokens en större räkning.
Anthropics påstående om att vara 30 % billigare är ett leverantörspåstående om sina egna valda arbetsbelastningar. Tredjepartens 7,60 dollar mot 5,09 dollar är en mätning på en annan uppsättning. Ingendera är fel; oenigheten är hela historien, och den avgörande faktorn är huruvida dina uppgifter begränsar sin egen output.
Vad som faktiskt förändrades mellan de två generationerna
Prislistan är statisk; modellen är det inte. Uppställda i en enda lista är deltavärdena stora och mestadels enkelriktade.
• Terminal-Bench 4.0 — 70,6 % för Claude Sonnet 5.5 mot 10,3 % för Claude Sonnet 5, det största generationshoppet som Anthropic har publicerat på detta test
• CursorBench 4.0 — 55,5 % mot 34,1 %
• Chartography, inga verktyg — 61,6 % mot 15,6 %
• GDPval-AA v2.1 — 1844 mot 1449
• AA-Briefcase v1.1 — 1811 mot 1359
• Humanity's Last Exam, med verktyg – 64,5 % mot 54,9 %
• OSWorld 2.1, partiellt slutförande – 80,1 % mot 57,0 %
• Artificial Analysis Intelligence Index v4.3 — 56 mot 38, ett artonpunktsgap på en tredjepartsskala mätt under samma konfiguration "Adaptive Reasoning, Max Effort"
Formen på listan är inte enhetliga framsteg. Chartography som går från 15,6 % till 61,6 % och Terminal-Bench från 10,3 % till 70,6 % ser ut som förmågor som saknades och nu finns, inte förmågor som förbättrades. Att Humanity's Last Exam förflyttar sig tio punkter och OSWorld tjugotre punkter vid ett oförändrat pris är mönstret för en generation som stängde specifika luckor snarare än en som blev allmänt smartare. Indexgapet på arton punkter är det aritmetiska medelvärdet av detta: verkligt, stort och koncentrerat till verktygsanvändning, kodkörning och visuellt arbete.
En fotnot är viktig för alla som läser leverantörstabellen noggrant. Anthropic uppger att Max effort-konfigurationen på FrontierCode får lägre poäng än Xhigh, och påpekar att körningarna med GDPval-AA och AA-Briefcase utfördes på en driftsättning före lansering som hade en bugg i strukturerade utdata. Siffrorna ovan är fortfarande de bästa tillgängliga, men betrakta dem som en ögonblicksbild från en driftsättning snarare än en permanent egenskap hos modellen.
Varför priset är lika och räkningen inte
Tre mekanismer, i fallande ordning efter hur mycket de påverkar en verklig faktura.
Det första är disciplin kring utdatalängd. Sonnet 5.5 är en mer kapabel agent, vilket innebär att den gör mer innan den svarar, och i en svit utan längdbegränsning skriver den ungefär 11 % mer än Sonnet 5 samtidigt som den kostar lika mycket per token. I en arbetsbelastning som sätter ett tak för utdatan – extrahering till ett fast schema, klassificering, avgränsade sammanfattningar – materialiseras aldrig de 11 %, och påståendet om 30 % blir trovärdigt, eftersom vinsten består i att komma fram till svaret på färre turer i stället för i färre token per tur.
Det andra är cachebeteende, och det är anledningen till att ett oförändrat pris för cacheläsning inte innebär en oförändrad cachekostnad. Cacheläsningar och cacheskrivningar har samma pris i båda modellerna, så varje förändring i volymen cachade tokens slår direkt igenom på fakturan. En modell som tar färre turer att slutföra en agentisk uppgift läser sitt prefix färre gånger. Det är en besparing utan någon prisändring bakom sig alls, och den är osynlig i varje jämförelsetabell som bara listar prislisteposter.
Den tredje är den som de flesta team missar på migreringsdagen: standardvärdet för effort. Claude Sonnet 5.5 konfigurerar resonemang via en effort-parameter med inställningarna low, medium, high, xhigh och max, med standardvärdet high på Claude Platform och medium i Claude-apparna. Om du migrerade från en Sonnet 5-distribution där du hade låst en resonemangsbudget kan det nya standardvärdet vara ett annat djup än det du betalade för. Mät innan du antar antingen en besparing eller en ökning.
Det finns också en beteendemässig konsekvens som är värd att flagga före utrullning snarare än efter. Anthropic uppger att Claude Sonnet 5.5 är den första Sonnet-modellen som lanseras med cybersäkerhetsskydd och fallbacks på samma nivå som sina toppmodeller, så mer riskfyllda cybersäkerhetsförfrågningar faller synligt tillbaka till den tidigare Sonnet. Dina loggar kommer att visa en modell som du inte begärde. Relaterat: om du kör Sonnet med tänkande inaktiverat måste du byta till ett between-tools-beteende – en kodändring, inte en flagga.
På OrcaRouter kan anthropic/claude-sonnet-5 routas idag med en enda autentiseringsuppgift till leverantörens listpris med 0 % påslag, tillsammans med Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro och Gemini 3.1 Pro Preview. Claude Sonnet 5.5 är i sig ännu inte en rutt på vår plattform, så den praktiska formen av den här jämförelsen just nu är att ett team som redan kör Sonnet 5 kan mäta deltat samma dag som den listas utan att röra en API-nyckel, och kan under tiden växla över mellan nivåer genom att ändra en sträng.
Frågor folk ställer innan de byter
Kan jag köra båda samtidigt och jämföra på min egen trafik? Inte genom en och samma OrcaRouter-autentiseringsuppgift ännu, eftersom Claude Sonnet 5.5 inte är en listad rutt. Omvägen är att köra den nyare modellen på Anthropics eget API och den äldre genom oss, och sedan jämföra tokens per slutförd uppgift i stället för kostnad per token, eftersom det är den siffra som de två modellerna faktiskt skiljer sig åt i.
Innebär det oförändrade priset att Anthropic inte tar betalt för den nya förmågan? Det innebär att listpriset hålls oförändrat medan modellen förbättras, vilket är samma mönster som för de två tidigare Sonnet-generationerna. Huruvida det består är en kommersiell fråga, inte en teknisk, och det publicerade avvecklingsfönstret – tidigast i september 2027 – är det enda åtagandet som är kopplat till det.
Vilken siffra bör jag lita på, Anthropics 30 % eller tredjepartens 49 %?Ingen av dem som ett generellt påstående. Anthropics siffra beskriver arbetsbelastningar där modellen når ett svar på färre turer; siffran från Artificial Analysis beskriver en obegränsad indexsvit där utförligheten fritt kan växa. Välj den som liknar din promptuppsättning, och om du inte kan avgöra vilken det är, är den tvetydigheten själva svaret – mät den.
Slutsats
Claude Sonnet 5.5 är inte en prishöjning, men inte heller automatiskt en besparing. Anthropic höll varje rad i prislistan oförändrad och bytte ut modellen under den, vilket innebär att hela det ekonomiska argumentet vilar på tokens per slutförd uppgift – ett tal som är 30 % bättre i det urval leverantören gjorde och 49 % sämre i den testsvit en oberoende utvärderare valde. Om dina uppgifter begränsar sin egen utdata, byt och ta vinsten. Om de inte gör det är det oförändrade priset inte ett skäl att hoppa över mätningen, för du kan betala en och en halv gång så mycket per uppgift för en modell som är otvetydigt bättre på arbetet.



