
Claude Haiku 5.5 vs Gemini 3.6 Flash: 7,5 gånger kostnaden per svar, nio poäng lägre modell
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Claude Haiku 5.5 och Gemini 3.6 Flash ligger i samma nivå i sina respektive produktlinjer – den lilla, snabba och billiga – och det är där likheten slutar. I Artificial Analysis Intelligence Index v4.3.2 får Claude Haiku 5.5 43,40 i sin Max-konfiguration mot 33,98 för Gemini 3.6 Flash i dess High-konfiguration. I samma körning kostar en slutförd Index-uppgift 0,21 USD med Claude Haiku 5.5 och 1,60 USD med Gemini 3.6 Flash.
Läs det paret tillsammans, för var för sig vilseleder de. Den billigare modellen är inte marginellt billigare; den är 7,5 gånger billigare per slutförd uppgift. Och modellen som den slår är inte marginellt svagare; den är 9,42 indexpunkter svagare, vilket på en resultatlista med 182 modeller är avståndet mellan den övre kvartilen och mitten.
Båda uppgifterna kommer från samma oberoende körning, vilket spelar roll eftersom leverantörskorten här inte avslöjar någon av dem. Anthropic lanserade Claude Haiku 5.5 den 7 oktober 2026; Google släppte Gemini 3.6 Flash den 21 juli 2026. De tre månaderna mellan dem är det intressanta.
De två korten, sida vid sida
Per miljon tokens i US-dollar. Anthropics och Googles priser kommer från deras egen prissättningsdokumentation; de gemensamma raderna är Artificial Analysis Intelligence Index v4.3.2. Cachad 2026-10-08.

• Indata — Claude Haiku 5.5 $0.10 upp till 100 000 tokens och $0.50 därutöver; Gemini 3.6 Flash $0.75 i fast pris idag, stiger till $1.50 den 1 januari 2027.
• Utdata — Claude Haiku 5.5 $0.50 upp till 100 000 tokens och $2.50 däröver; Gemini 3.6 Flash $3.75 i fast pris idag, stiger till $7.50 samma datum.
• Cachad indata – Claude Haiku 5.5 $0.01 och $0.05; Gemini 3.6 Flash $0.075, plus en lagringsavgift på $0.50 per miljon tokens per timme.
• Kontext och utdatatak — 1M tokens för båda. Claude Haiku 5.5 begränsar ett svar till 128 000 tokens; Gemini 3.6 Flash till 65 536.
• Modalitet — Claude Haiku 5.5 tar text och bilder. Gemini 3.6 Flash tar text, bilder, video, ljud och filer. Det här är den enda raden där Googles sida ligger otvetydigt före, och för en pipeline för medieförståelse kan det avgöra hela frågan.
• Oberoende poäng — 43,40 för Claude Haiku 5.5 (Max) mot 33,98 för Gemini 3.6 Flash (High).
• Kostnad per slutförd uppgift — $0,21 mot $1,60, i samma utvärderingskörning.

Varför per uppgift, inte per token, är det tal man bör använda
Prislistans multipel ser redan ut som 7,5 på input och 7,5 på output, så siffran per uppgift är inte överraskande här – men det är värt att visa varför de två modellerna hamnar på samma ställe i ett mått och så långt ifrån varandra i det andra, eftersom samma aritmetik slår åt andra hållet i den här batchens andra matchningar.
Gemini 3.6 Flash är den mindre mångordiga av de två. Den avger 41 606 utdatatokens per Intelligence Index-uppgift – 20 061 för resonemang och 21 545 för svar – mot Claude Haiku 5.5:s 162 164, uppdelat på 129 047 resonemang och 33 118 svar. Anthropics modell gör av med nästan fyra gånger så många tokens för samma jobb, och det är den vars utdatahastighet är en sjundedel av Googles, så tokenklyftan och hastighetsklyftan multipliceras i stället för att ta ut varandra.
Den kombinationen – billig mätare gånger tung användning – är den ärliga beskrivningen av Claude Haiku 5.5:s ekonomi, och Anthropics eget lanseringsinlägg erkänner den andra sidan av det: modellen är "särskilt prisvärd när den används för uppgifter med prompter på upp till 100 000 tokens, vilka utgör omkring 90 % av förfrågningarna till vår tidigare Haiku-modell." Över 100 000 tokens blir ingångsmätaren $0,50 och utgångsmätaren $2,50, vid vilken punkt multipeln gentemot Gemini 3.6 Flash minskar till ungefär 1,5x.
Vad Googles egen nivå gjorde medan den här jämförelsen stod still
Det är här stycket upphör att vara en jämförelse mellan två modeller och blir en varning om vilken Gemini du faktiskt jämför med.
Google har hållit Flash-priset oförändrat över tre generationer. Gemini 3.6 Flash, Gemini 3.7 Flash och Gemini 3.8 Flash listas alla till $0,75 för indata och $3,75 för utdata i Googles egen prisdokumentation, med samma cache-pris på $0,075 och samma höjning den 1 januari 2027 till $1,50 och $7,50. Googles kort för 3.6-serien beskriver den som "vår Flash-modell från föregående generation", vilket är leverantörens egna ord för den.
Det som rörde sig var poängen, inte priset. På den oberoende resultattavlan får Gemini 3.6 Flash 33,98, Gemini 3.7 Flash 39,06 och Gemini 3.8 Flash 40,93 – alla i sin publicerade konfiguration med högsta intensitet. Nio indexpoäng tillkom inom Googles flash-nivå på sex veckor, utan att priset förändrades.
Konsekvensen för den som befinner sig mitt i en utvärdering är konkret: om du benchmarkade den här jämförelsen för tre veckor sedan mot Gemini 3.7 Flash är ditt resultat inaktuellt, och om du benchmarkar den mot Gemini 3.8 Flash minskar gapet till Claude Haiku 5.5 till 2,47 poäng. Gemini 3.6 Flash är den version av den här jämförelsen som smickrar Anthropic mest, och det är också den version som Google är längst ifrån att sälja.
Artificial Analysis flaggar 3.6-posten som föråldrad. Googles prisdokumentation publicerar fortfarande taxan, och dess modellista hänvisar fortfarande till ett 3.6-avsnitt, så den ärliga tolkningen är inte ”borta” utan ”ersatt två gånger inom sin egen familj på tio veckor” — och det är ett faktum om hur snabbt den här nivån rör sig, inte ett skäl att hoppa över jämförelsen.
Vem detta egentligen avgör för
Det finns ett verkligt argument för Gemini 3.6 Flash, och det är inte poängen.
Om du behöver ljud eller video i prompten kan Claude Haiku 5.5 inte alls göra det – den läser text och bilder och inget annat. Gemini 3.6 Flash läser text, bilder, video, ljud och filer, och vår egen katalog registrerar den till uppmätta 582 utdatatokens per sekund med en median på 4,1 sekunder till första token under den senaste veckan, vilket är en snabb modell även med Flash-mått mätt. För en pipeline för medieförståelse är modalitetslistan hela beslutet och indexgapet en fotnot.
Om ditt arbete består av text och bilder är kalkylen inte ens nära nog att diskutera. Vid en input-tung blandning på 7:2:1 – den form som merparten av produktionstrafiken har – landar Claude Haiku 5.5 på 0,077 USD per miljon token mot 0,63 USD för Gemini 3.6 Flash. För över en miljon blandade token per dag är det 77 cent mot 6,30 USD, och den andra siffran blir sämre den 1 januari 2027 medan den första inte rör sig.
100 000-token-klippan är det enda villkoret som vänder på det. En hämtnings- eller långdokumentpipeline som rutinmässigt sätter samman prompter på 150 000 token betalar Anthropics $0,50/$2,50-nivå för hela begäran, och vid det laget ligger de två modellerna inom en faktor 1,5 från varandra i pris, medan Gemini 3.6 Flash fortfarande vinner på modalitet och på den siffra på 91,8 % som Google publicerar för multi-needle-hämtning vid ett genomsnitt på 128k. Det är leverantörsrapporterat och inte reproducerat, och det hör hemma i precis den inramningen.

Ringer båda, eller ringer en
Gemini 3.6 Flash finns i OrcaRouter-katalogen i dag på google/gemini-3.6-flash, till Googles listpris med 0 % påslag — $0.75 och $3.75 med $0.075 för cacheläsning, förda vidare precis som leverantören debiterar dem. Det spelar roll för just den här modellen eftersom Googles höjning den 1 januari är en taxaändring, och en vidarebefordrande katalog tar den samma dag den sker i stället för vid nästa avtalsförnyelse. En API-nyckel och ett SDK-anrop når antingen den här modellen eller någon av de över 200 andra i katalogen, så en A/B mellan ett Google-ben och ett Anthropic-ben är ett byte av modellsträng med automatisk failover under huven i stället för en andra integration.
Claude Haiku 5.5 finns inte i katalogen. Anthropics modell går att nå via Anthropics eget API och via AWS, Google Cloud och Microsoft Azure, och det är hela det ärliga svaret. Det vi däremot har från den serien är Claude Sonnet 5.5 och Claude Opus 5.5 – vilket är det som gör eskaleringsvägen från ett billigt klassificeringsanrop upp till ett agentiskt anrop på mellannivå till ett routningsbeslut snarare än ett projekt.
Vilket gör omdömet enkelt nog att säga rakt ut. För text- och bildarbete vid korta promptlängder vinner Claude Haiku 5.5 på alla axlar utom svarstaket. För allt med ljud eller video i är Gemini 3.6 Flash den enda av de två som överhuvudtaget kan svara — och om du ska betala Googles pris för den förmågan, fråga vilken Gemini du betalar för, för på den här nivån kan du få nio fler indexpoäng för samma pengar från ett nyare syskon.
Ett API för över 200 modeller, en nyckel, automatisk redundansväxling under huven, så ett A/B mellan en Google-gren och en Anthropic-gren är en ändring av modellsträngen snarare än en andra integration.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
