
Claude Haiku 5.5 vs Gemini 3.8 Flash: Två indexpoäng, sex gånger kostnaden per uppgift
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Claude Haiku 5.5 och Gemini 3.8 Flash ligger närmare varandra i uppmätt kapacitet än något annat par i detta prisintervall — 43,40 mot 40,93 på Artificial Analysis Intelligence Index v4.3.2, båda placerade bland de femtio bästa på en resultattavla med 225 modeller. Det som skiljer dem åt är vad en av dessa indexpoäng kostar. I samma oberoende mätning kostar en slutförd Intelligence Index-uppgift $0,21 för Claude Haiku 5.5 och $1,24 för Gemini 3.8 Flash.
Det är en sexfaldig skillnad för en poängskillnad på två och en halv poäng, och det är den siffran som bör avgöra den här jämförelsen. Allt annat – listpriserna, modalitetslistan, tidsfristerna som är kopplade till Googles prissättning – är en argumentation om kanterna.
Båda modellerna, på de siffror som spelar roll
Per miljon tokens i amerikanska dollar, från Anthropics och Googles egen prisdokumentation, med de oberoende mätningarna tillskrivna Artificial Analysis. Cachad 2026-10-08.

• Indata — Claude Haiku 5.5 $0,10 upp till 100 000 tokens och $0,50 däröver; Gemini 3.8 Flash $0,75 fast, stiger till $1,50 den 1 januari 2027.
• Utdata — Claude Haiku 5.5 $0.50 upp till 100 000 token och $2.50 däröver; Gemini 3.8 Flash $3.75 i fast pris, som stiger till $7.50 samma datum.
• Cachad indata — Claude Haiku 5.5 0,01 $ och 0,05 $; Gemini 3.8 Flash 0,075 $, plus en lagringsavgift på 0,50 $ per miljon tokens per timme.
• Kontext — 1M tokens för båda. Maximal utdata — 128 000 tokens för Claude Haiku 5.5 mot 65 536 för Gemini 3.8 Flash.
• Indatamodalitet – text och bilder för Claude Haiku 5.5; text, bilder, tal och video för Gemini 3.8 Flash. Det här är den enda raden där Googles lista är strikt längre.
• Oberoende poäng — 43,40 för Claude Haiku 5.5 (Max) mot 40,93 för Gemini 3.8 Flash (High), på Intelligence Index v4.3.2.
• Oberoende kostnad per uppgift — 0,21 $ mot 1,24 $ på samma kort.
• Hastighet — 241,9 utdatatokens per sekund mot 125,2, båda uppmätta av Artificial Analysis.
Varifrån siffran sex gånger kommer
Gapet i kostnad per uppgift är större än gapet i prislapp, och det är det intressanta, för det innebär att prislistan ensam inte förklarar det.
Prislappsmatematiken är enkel nog: 0,10 dollar mot 0,75 dollar för indata är sju och en halv gånger billigare, och 0,50 dollar mot 3,75 dollar för utdata är samma förhållande. Om båda modellerna genererade samma tokens för samma arbete skulle det förhållandet gå rakt igenom till fakturan.
Det håller inte hela vägen, och båda effekterna är till Googles fördel. Claude Haiku 5.5 är mångordig på ett sätt som dess egen leverantör erkänner: Artificial Analysis registrerade 440 miljoner utdatatoken när den körde Index, mot en median på 100 miljoner, och kallar modellen mycket mångordig. Gemini 3.8 Flash genererade 170 miljoner mot en median på 81 miljoner – också flaggad som mångordig, men en tredjedel av tokenantalet. Anthropics egen dokumentation tillägger den andra effekten: Claude Haiku 5.5 använder den nyare tokenizer som delas med Claude 4.7 och senare, så samma text räknas som ungefär 30 % fler token än på modellen den ersätter.
Sammantaget är den ärliga versionen av prispåståendet denna: en fördel på tio mot ett i indatapris och en fördel på sju och ett halvt mot ett i utdatapris, delvis uppäten av en modell som skriver fler tokens per svar, vilket landar i en fördel på sex mot ett i det mått som debiterar för hela jobbet. Fortfarande en utklassning, och en mindre sådan än prislistan antyder.
Googles pris har ett datum på sig
Det enskilt mest användbara på Googles prissida är en mening som de flesta jämförelsetabeller utelämnar.
Gemini 3.8 Flash listas till $0.75 för indata och $3.75 för utdata "till och med den 31 december 2026", och till $1.50 och $7.50 "från och med den 1 januari 2027". Cachad indata går från $0.075 till $0.15 samma datum. Det är ett introduktionspris med ett utgångsdatum tryckt intill sig, ungefär elva veckor från när detta skrivs.
Ingenting i Anthropics kort lyder så. Claude Haiku 5.5:s priser anges som just priser, med en tvåskiktsstruktur knuten till promptlängd snarare än till en kalender, och ett åtagande om avveckling tidigast den 7 oktober 2027. Om du modellerar en pipeline som sträcker sig in i nästa år, är Googles steg i januari en fördubbling och det hör hemma i modellen; Anthropics har inte någon motsvarande händelse att planera för.
Det skär åt båda hållen, och den rimliga tolkningen är inte ”en leverantör är ärlig och den andra inte”. Ett kampanjpris är ett riktigt pris så länge det varar, och Google har rätt att prissätta en lansering på det sättet. Det är helt enkelt ett faktum i jämförelsen att den till synes billigare sidan av januarisiffrorna är den med tidsfristen.

Vad är två indexpoäng värda?
En skillnad på 2,47 punkter på ett index som går upp till sextiotalet är inte ett avrundningsfel och inte heller en avgrund. Båda modellerna ligger i samma arbetsintervall, och den praktiska frågan är om skillnaden visar sig i de uppgifter du faktiskt kör.
Enligt leverantörernas egna siffror mäts de två inte på samma testbänk, så de kan inte jämföras direkt — Anthropic publicerar resultaten för Claude Haiku 5.5 i GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 och FrontierCode, och Google publicerar sin egen uppsättning för Gemini 3.8 Flash, och ingen av leverantörerna körde den andras testsvit. Den enda jämförelsen på lika villkor som finns tillgänglig är den oberoende resultattavlan, och där är svaret att Anthropic ligger före med en marginal som är mätbar men liten.
Den kapacitetsskillnad som kommer att spela större roll för vissa team gäller modaliteten. Gemini 3.8 Flash tar emot tal och video som indata; Claude Haiku 5.5 tar emot text och bilder. En pipeline som inbyggt tar in samtalsinspelningar eller skärminspelning väljer inte alls mellan dessa två modeller utifrån pris — en av dem kan inte utföra jobbet utan ett transkriberings- eller bildruteutvinningssteg framför sig, och det steget har sin egen kostnad och sina egna felmoder.
Att köra den billigare sidan av paret
Gemini 3.8 Flash finns i OrcaRouter-katalogen till Googles listpris med 0 % påslag, vilket spelar större roll här än vanligt: leverantörens pris förs vidare i stället för att blandas, så om du vill se vad januaristeget faktiskt gör med en faktura ändras siffran när Googles gör det. Claude Sonnet 5.5 och Claude Opus 5.5 finns också i katalogen, vilket gör ett trevägs-routningstest — Googles Flash-ben, en Anthropic-nivå i mellanskiktet och en Anthropic-nivå i det mindre skiktet senare — till en konfiguration i stället för ett projekt. En nyckel, ett SDK, automatisk failover under huven, och routing-DSL:et om du hellre vill uttrycka eskaleringen i rutten än i applikationskoden.
Claude Haiku 5.5 finns ännu inte i katalogen, och det är bättre att säga det än att lämna det oklart. Anthropic-benet i den här jämförelsen går för närvarande endast att nå hos Anthropic, medan Google-benet kan anropas från oss redan idag till priset som visas ovan.

Vilken, och för vem?
Om ditt arbete är text in och text ut, dina prompter ligger under 100 000 tokens och du betalar per token för verklig volym, är Claude Haiku 5.5 den billigare modellen enligt varje mått i den här artikeln och den som får högst poäng på den enda gemensamma resultattavlan – med förbehållet att fördelen är sexfaldig vad gäller kostnad per uppgift snarare än den tiofaldiga som prislappen antyder.
Om du behöver ljud eller video som indata, eller behöver ett svar på 65 000+, eller om dina prompter regelbundet är långa, ändras kalkylen: Gemini 3.8 Flash tar emot indata som Anthropics mindre nivå inte klarar, och över 100 000 tokens är Anthropics egen andra nivå prissatt långt över Googles fasta pris.
Det enda man ska hålla fast vid är datumen. Googles taxa gäller till årets slut och fördubblas därefter. Anthropics anges som fast med ett längdsteg. Oavsett vilken sida av det du är på, bygg in kalendern i kalkylarket innan du bygger pipelinen.
