
Claude Haiku 5.5 i OpenCode Go: Vad 10 dollar i månaden faktiskt ger
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Anthropic släppte Claude Haiku 5.5 den 7 oktober 2026, och inom ett dygn fanns den listad i OpenCodes kataloger Go och Zen — de kodagent-abonnemang som mäter en månatlig dollarram i stället för att fakturera per token. Den där andra listningen är den del som är värd att stanna upp vid, för den ram som OpenCode publicerar för Claude Haiku 5.5 är inte en rabatt på modellen. Den är en budgetmätare satt till Anthropics eget listpris, och varje siffra bakom den går att kontrollera mot de två sidor som publicerar den. Om du fortfarande funderar på vad du ska anropa i stället för Claude Haiku 4.5 är ramen beslutet, inte prislappen.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Vad Anthropic förde till protokollet den 7 oktober
Leverantören släppte inte detta i tysthet. Anthropics nyhetsrum innehåller ett daterat tillkännagivande, en produktsida med en benchmarktabell, ett systemkort, en pristabell och sex namngivna kundcitat. Det finns inget repo och inget släpp av vikter att granska, eftersom det inte finns något att släppa: Artificial Analysis registrerar Claude Haiku 5.5 som proprietär, med parametrantalet ej offentliggjort. Den som beskriver detta som en läckt eller oannonserad modell läser ett repo som inte finns.
Anthropics egen beskrivning är en volymmodell snarare än en frontiermodell:
• Positionering – "den billigaste, snabbaste och mest kapabla lilla modellen vi någonsin har släppt", inriktad på sammanfattningar, komprimeringar, databasfrågor och klassificering, och lanseras som en underagent som kombineras med Claude Opus 5.5 och Claude Sonnet 5.5 i kodningsarbete.
• Pris — 0,10 USD per miljon indatatokens och 0,50 USD per miljon utdatatokens för prompter på upp till 100 000 tokens; 0,50 USD och 2,50 USD däröver. Cacheläsningar 0,01 USD / 0,05 USD, cacheskrivningar 0,125 USD / 0,625 USD.
• Kontext och utdata – ett fönster på 1M tokens med en maximal utdata på 128 000 tokens, samma ram som de större modellerna i 5.5-nivån har, återgiven på den billigaste nivån.
• Effort — den första modellen i Haiku-klassen med en justerbar effort-inställning, som sträcker sig från Low till Max och har medium som standard. Anthropic publicerar kurvor för noggrannhet kontra kostnad vid varje inställning i stället för en enda siffra.
• Benchmarks, rapporterade av leverantören och inte oberoende reproducerade – GDPval-AA v2.1 1620 mot Claude Haiku 4.5:s 735; AA-Briefcase v1.1 1578 mot 614; OSWorld 2.1 72,4 % mot 15,7 %; Humanity's Last Exam 45,9 % utan verktyg och 57,4 % med dem, mot 10,2 % och 18,7 %; Terminal-Bench 4.0 39,2 % mot 0,0 %; Chartography 46,4 % mot 6,4 %.
• Leverantörens eget tak – Anthropics kommentar till sitt Terminal-Bench-diagram säger att Claude Sonnet 5.5 och Claude Opus 5.5 "förblir bättre val för komplexa agentiska kodningsuppgifter." Kundcitaten i samma inlägg är partners med tidig tillgång som beskriver sina egna utvärderingar, inte granskningar: Asana rapporterar över 30 % lägre latens och upp till 2,5 gånger snabbare inferens per agentomgång, HubSpot 92,8 % i genomsnitt över tre körningar, AlphaSense 0,84 mot 0,76 över 400 frågor i en arbetsbelastning på ungefär 8 miljoner anrop i veckan, Box 11 punkter högre vid ungefär halva latensen, och Cognition en FrontierCode-poäng på 66,2 med Haiku 5.5 som sidekick.

Anthropic använde också lanseringen för att ändra två närliggande priser: cacheläsningar på Claude Sonnet 5.5 halverades till 0,10 USD per miljon tokens, vilket företaget säger gör Sonnet 5.5 cirka 20 % billigare för det mesta agentiska arbetet, och en ny månatlig API-kredit för prenumeranter på Claude Max och Team. Båda är ändringar i nivån ovanför, och båda har större betydelse för ett team som redan har standardiserat på Sonnet än för någon som letar efter en liten modell.
Ersättningen är en dollarbudget, inte en rabatt.
Här är delen som tweetet med tillkännagivandet inte nämner. OpenCodes Go-dokumentation anger att ”användningsgränser definieras som månatliga dollarbelopp”, att tokenprissättningen är densamma för båda planerna och att varje modells tilldelning trappas ner enligt ett fast schema: 20 % av månadsgränsen per fem timmar, 50 % per vecka, 100 % per månad. Dokumentationen publicerar också den tokenprofil per begäran som den förutsätter för den här modellen – 1 100 indatatokens, 55 000 cachade tokens, 240 utdatatokens.
Kör dem genom Anthropics listpris, så slutar de publicerade förfrågningsantalen att se ut som en godtycklig allokering:
• Kostnad per begäran enligt listpris — 1 100 indata vid $0,10/M plus 55 000 cachelagrade läsningar vid $0,01/M plus 240 utdata vid $0,50/M uppgår till $0,00078.
Antalet förfrågningar per månad – 15 $ delat med 0,00078 $ är 19 230, vilket är talet som dokumentationen skriver ut. Planen för 40 $ har en tilldelning på 60 $ som räknas ut till 76 923, och dokumentationen skriver ut 76 920.
• Nedtrappningen – 20 % av 19 230 är 3 846, anges som 3 850 per fem timmar; 50 % är 9 615, anges som 9 620 per vecka. Go Plus följer samma aritmetik vid 15 380 och 38 460.
• Vad det innebär i dollar – tilldelningen är värd 15 dollar i Anthropic-p-tokens på 10-dollarsplanen och 60 dollar på 40-dollarsplanen. En prenumeration för 10 dollar köper därför som mest 15 dollar i månaden av den här modellens tokens om du lägger hela tilldelningen på Claude Haiku 5.5 och inget annat.
Det är det ärliga sättet att läsa "New"-märket på Go-sidan. Prenumerationen är billig, modellen är billig, och de två fakta är oberoende av varandra: tilldelningen är en mätarbudget enligt leverantörens egen taxa, så planen begränsar hur mycket du får spendera snarare än hur lite modellen kostar. Tunga användare når taket och betalar Anthropic direkt — eller routar modellen själva.

Nittio procent, sjuttiofem procent och femgångersstupet
Anthropics rubrik är att Claude Haiku 5.5 kostar cirka 90 % mindre än Claude Haiku 4.5 för prompter på upp till 100 000 tokens, och att det i genomsnitt "nu kostar omkring 75 % mindre att köra". Båda siffrorna är leverantörens. De är också båda korrekta, och gapet mellan dem är hela prissättningsrisken.
• Inom prisbandet – 0,10 $ in och 0,50 $ ut, jämfört med Haiku 4.5:s enhetliga 1 $ och 5 $. Anthropic säger att omkring 90 % av förfrågningarna till dess tidigare Haiku-modell föll inom detta prisband, vilket är varifrån siffran 90 % kommer.
• Ovanför bandet – samma begäran faktureras med 0,50 USD in och 2,50 USD ut, en femfaldig höjning för indata. Det är fortfarande hälften av Haiku 4.5:s pris, men det är långt ifrån en sänkning på 90 %.
• Det sammanvägda påståendet – siffran 75 % är Anthropics egen uppskattning över en verklig trafikmix, inte en prislista, och det är siffran som ska användas i en prognos.
• Tokenizern — den nyare tokenizern som delas med Claude 4.7 och senare producerar ungefär 30 % fler tokens för samma text, enligt Anthropics egen dokumentation, så en nedskärning per token leder inte ett-till-ett till en mindre faktura.
Ansträngningsreglaget förstärker allt detta. Eftersom standardvärdet är medium och de publicerade kurvorna sträcker sig upp till Max kan samma prompt kosta flera gånger mer beroende på en parameter som de flesta anropare aldrig ställer in – och OpenCodes uppskattningar av förfrågningar utgår från en fast tokenprofil vid en implicit inställning. Om dina prompter ligger nära 100 000 token, kör en subagent för begränsad användning, eller om du flyttar ansträngningsreglaget, är 90 %-rubriken inte siffran du kommer att se.
Den oberoende styrelsen är överens om poängen och flaggar för sin egen matematik
Artificial Analysis poängsätter Claude Haiku 5.5 till 43 på sitt Intelligence Index v4.3.2 i modellens Max-konfiguration, mot en median på 13 på resultattavlan, och uppmäter 241,9 output-tokens per sekund mot en median på 110,9 för jämförbara modeller. Samma sida anger kostnaden till 0,21 USD per Intelligence Index-uppgift och rapporterar att modellen genererade 440 miljoner output-tokens under utvärderingen mot en median på 100 miljoner – och beskriver den som "mycket ordrik."
Mångordighet är där de två resultattavlorna interagerar. Tilldelningsaritmetiken ovan debiteras per token, så en modell som resonerar utförligt förbrukar budgeten snabbare än antalet förfrågningar antyder, och OpenCodes per förfrågan-profil på 55 000 cachade tokens är ett antagande om prompt-cachning som en prenumerationsanvändare kanske eller kanske inte återskapar. Två upplysningar på Artificial Analysis-sidan är värda mer än dess rubrik: 43:an är Max-konfigurationen snarare än den ansträngningsinställning du får genom att göra ingenting, och sidan har en uttrycklig notering om att Claude Haiku 5.5 "har 5x högre prissättning på indata med längre kontext vilket för närvarande inte återspeglas" i dess kostnadssiffror. Långkontextklippan är verklig, och den oberoende resultattavlan har berättat för dig att den ännu inte finns i dess egna siffror.

Retentionsraden som de flesta köpare hoppar över
OpenCodes Go-dokumentation innehåller en sekretesstabell per modell, och det här är raden där Claude Haiku 5.5 skiljer sig från större delen av katalogen. Leverantörens egen formulering är noll kvarhållning med undantag. De flesta modeller i den Go-tabellen anger "0 dagar". Den här anger "30 dagar", med noteringen att förfrågningar behålls i 30 dagar i enlighet med Anthropics datapolicyer – samma behandling som den ger GPT-6 Luna och GPT-5.6 Luna, och motsatsen till de nolldagarsrader som utgör merparten av listan.
För en kodagent innebär det att prompter, filsökvägar och inklistrad källkod kan ligga hos den uppströms leverantören i en månad, på en plan vars marknadsföringsspråk är noll retention. Det är inte ett skäl att undvika modellen; det är ett skäl att läsa raden i stället för bannern. Inget i Anthropics lanseringsmaterial förändrar samtidigt positionen på API-sidan: Claude API har erbjudit noll datalagring, och modellkortets retentionsvillkor är de som styr en direkt integration.
Vad är bekräftat, och vad är inte
Den bekräftade uppsättningen är stor och specifik, vilket är ovanligt för något så här nytt. Det som inte är bekräftat är, och värt att namnge snarare än att släta över:
• Bekräftat — modellen finns, är endast tillgänglig via API under id:t claude-haiku-5-5, släpptes den 7 oktober på Claude API samt Amazon Web Services, Google Cloud och Microsoft Azure, till priserna ovan, med ett 1M-tokensfönster, justerbar ansträngning och ett publicerat systemkort.
• Bekräftat — två tredjepartsplattformar har det listat med modell-id:n, slutpunkter och mätbaserade kvoter samma dag.
• Inte bekräftat — ingen oberoende benchmark vi kan hitta har reproducerat leverantörens tabell. Varje noggrannhetssiffra i Anthropics lanseringsinlägg kommer från Anthropics egen testrigg, och varje kundcitat är en partners självrapporterade tidiga testning.
• Inte bekräftat — det finns inga vikter, inget repo, ingen checkpoint och ingen licens att granska. Modellen är stängd, och varje påstående om dess arkitektur eller storlek är en slutledning.
• Inte bekräftat — huruvida plattformens uppskattningar av förfrågningar håller vid något annat än dess antagna tokenprofil, och huruvida (eller när) prissättningen för 5x lång kontext hamnar i de oberoende panelernas kostnadssiffror.
Att köra det bredvid det du redan kallar
Den praktiska frågan som den här lanseringen skapar är inte "är Haiku 5.5 bra" — leverantörens tabell säger att den är det, och ingen utanför Anthropic har kontrollerat. Det är "vad blir notan, och vad händer när den billiga nivån inte är rätt nivå för just det här anropet." Båda halvorna är routingproblem.
Vad gäller kostnaden är mätaren tokennotan, inte prislappen: en 90-procentig minskning av indata plus en 30 % större tokenizer plus en ordrik resonemangsmodell plus ett femfaldigt långkontextsteg innebär att siffran du prognostiserar och siffran du betalar glider isär om du inte mäter din egen fördelning av promptlängder. En modell som är 5 gånger dyrare över 100 000 tokens belönar kompaktering – och Haiku 5.5 lanseras själv som kompakteringsmodellen, vilket är en loop värd att lägga märke till.
Riskmässigt är en obeprövad nivå precis fallet där man inte ska satsa en produktionsväg på den. Claude Haiku 4.5 finns redan på OrcaRouter till Anthropics listpris med 0 % påslag, så den gamla nivån behöver inget nytt avtal, och en rutt som faller tillbaka från en ny modell till en känd sådan är en konfigurationsändring snarare än en omskrivning. Effort-parametern är per anrop, vilket innebär att samma endpoint kan köra en sammanfattning med låg effort och en krävande extraktion med hög effort utan att underhålla två integrationer — routing-DSL:en finns till för just den här formen av beslut, och automatisk failover är det som låter dig sätta en modell som är några dagar gammal framför verklig trafik innan du har oberoende siffror för den. Det som ännu inte är sant är det uppenbara: Claude Haiku 5.5 finns inte på våra rutter i dag, och om du vill ha den här veckan vänder du dig direkt till Anthropic eller går via plattformen som tillkännagav den.
Vilka som bör agera: team vars volym är sammanfattningar, klassificering, kompaktering och subagentarbete, där 90 %-bandet gäller och tokeniserarens 30 % är aritmetik du kan absorbera. Vilka som bör vänta: alla vars prompter rutinmässigt överskrider 100 000 tokens, alla som behöver ett oberoende benchmark innan de bestämmer sig, och alla vars kod inte kan ligga i ett bevarandefönster på 30 dagar. Lanseringen är verklig och prissättningen är verklig. Beviset är fortfarande leverantörens.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
