En titelruta för jämförelsen mellan Gemini 3.7 Flash och DeepSeek V4 Flash, som visar två blixtar: en stängd låst låda märkt Gemini 3.7 Flash med en prislapp på $0.75 / $3.75, och en öppen låda med en nedladdningspil märkt DeepSeek V4 Flash med en prislapp på $0.14 / $0.28.
Guides & Insights

Gemini 3.7 Flash mot DeepSeek V4 Flash: Två "Flash"-modeller, motsatta svar på samma fråga

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

De två mest förvirrande namngivna modellerna 2026 heter båda Flash, och de kunde inte ha svarat på samma fråga mer olika. Gemini 3.7 Flash, som släpptes den 13 augusti 2026, är Go​ogles slutna arbetshäst: ungefär 340 utdatatoken per sekund, ett intelligensindex på 56 och ett kampanjpris på 0,75 dollar per miljon inmatningstoken och 3,75 dollar per miljon utdatatoken. DeepSeek V4 Flash är den del av Deep​Seeks V4-familj som har öppna vikter, släppt i april och uppdaterad i slutet av juli: MIT-licensierad, nedladdningsbar och prissatt till 0,14 dollar per miljon inmatningstoken och 0,28 dollar per miljon utdatatoken via Deep​Seeks eget API – ungefär en femtedel av Go​ogles kampanjpris för inmatning och en trettondel av priset för utdata. Båda är ”flash”-modeller, byggda för att vara snabba och billiga för högvolymarbete. Ordet är där likheten slutar.

Frågan de besvarar olika är den som definierar den här generationen: hyr du intelligens eller äger du den? DeepSeek V4 Flash är en mixture-of-experts-modell med 284 miljarder parametrar, cirka 13B aktiva per token, en kontext på 1M token och ett outputtak på 384K, släppt under MIT-licens — vikterna är en nedladdning på ~160GB, och 31 juli-uppdateringen (V4-Flash-0731) tillförde betydligt starkare agentiska förmågor. Gemini 3.7 Flash är en proprietär modell byggd på Gemini 3.6 Flash med 1M kontext, ett outputtak på 64K, multimodala indata och ingen väg till egen drift. En av dessa modeller kan vara nätverksisolerad, finjusteras och köras på egen hårdvara. Den andra körs bara där Google kör den.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

De två Flashes, sida vid sida

Båda modellerna riktar sig till samma köpare — högvolymiga produktionsarbetsbelastningar som inte har råd med en flaggskeppsmodell per token — men de når dit genom motsatta arkitekturer. DeepSeek V4 Flash:s hybrida attention (komprimerad sparse plus kraftigt komprimerad attention) är det som gör att dess 1M-kontext är tillräckligt kostnadseffektiv för att kunna säljas till dessa priser; det är modellen som Deep​Seek pekar de äldre `deepseek-chat`- och `deepseek-reasoner`-slutpunkterna på, pensionerad i juli. Gemini 3.7 Flash är Go​ogles algoritmiska förfining av den egna Flash-serien, och dess fördel är genomströmningen vid serving: oberoende mätning visar cirka 340 tokens/s jämfört med DeepSeek V4 Flash:s cirka 113, och den uppnår det samtidigt som den hanterar ljud- och videoinmatning som DeepSeek V4 Flash inte gör.

Intelligensindex — 56 för Gemini 3.7 Flash jämfört med 50 för DeepSeek V4 Flash, enligt Artificial Analysis.

Utmatningshastighet — ~340 tokens/s jämfört med ~113 tokens/s, båda enligt Artificial Analysis.

Kontextfönster — 1M tokens för båda; DeepSeek V4 Flash producerar upp till 384K jämfört med Gemini 3.7 Flash:s 64K.

Inmatningspris — $0.75 (kampanjpris, till och med 2026) jämfört med $0.14 på Deep​Seeks eget API.

Utpris — $3,75 (kampanjpris) jämfört med $0,28.

Vikter — proprietära kontra MIT-licensierade och nedladdningsbara.

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

Vad sex indexpunkter faktiskt köper

Sexpoängsgapet i Index är betydande men inte avgrundsdjup, och det ligger mestadels inom områden som DeepSeek V4 Flash inte var optimerad för. Gemini 3.7 Flash:s rapporterade siffror inom agentisk kodning (65,3 på DeepSWE v1.1, 43,6 på FrontierCode 1.1 Main, leverantörsrapporterade) ligger väl före, och dess Elo inom webbutveckling (1588, även det leverantörsrapporterat) återspeglar verkliga förbättringar inom UI-generering. DeepSeek V4 Flash:s egna rapporterade siffror — 79,0 på SWE-bench Verified, 91,6 på LiveCodeBench, ett τ²-Bench-resultat på 95,0 som oberoende spårare bekräftar — står sig väl inom avgränsad kodning och verktygsanvändning, och dess 1M-kontextsökning (78,7 på MRCR, 60,5 på CorpusQA) är konkurrenskraftig med allt i sin prisklass. Mönstret: Gemini 3.7 Flash leder inom agentiskt djup och webbarbete; DeepSeek V4 Flash byter bort dessa mot rå tokenekonomi och ett långkontexttak som ingen sluten arbetshäst matchar.

Öppna vikter förändrar upphandlingen, inte bara priset.

MIT-licensen är den del av den här jämförelsen som ingen benchmarktabell fångar. DeepSeek V4 Flash kan laddas ner och köras på din egen hårdvara, finjusteras på dina egna data och användas i miljöer där API-anrop inte är tillåtna — och licensen har inga skalbaserade begränsningar, så ingenting i din tillväxt ändrar villkoren. Den praktiska kostnaden är operativ: att servera en 284B MoE-modell i den hastighet ett produktions-team vill ha kräver reellt GPU-inventarium, och för de flesta team är det ärliga valet det värdbaserade API:t. Det är där prisskillnaden gör sitt verkliga arbete: även den värdbaserade vägen, till $0,14 / $0,28, är tillräckligt billig för att vara standardvalet för långsvansen av trafik. Gemini 3.7 Flash erbjuder ingen del av ägarskapsvägen — vad du köper är en tillförlitligt hanterad, snabb, multimodal tjänst med en kampanjprislapp och en prisklippa i januari.

Volymfakturan

Kör samma dag på båda: 20 miljoner input-tokens och 4 miljoner output-tokens. På DeepSeek V4 Flash:s eget API blir det $2,80 + $1,12, ungefär $3,92. På Gemini 3.7 Flash till kampanjpriset blir det $15 + $15, ungefär $30 — en skillnad på 7,6 gånger även medan Google kör sin rabatt. Efter den 1 januari 2027, när Gemini 3.7 Flash återgår till $1,50 / $7,50, kostar samma dag ungefär $58, femton gånger DeepSeeks siffra. Hastighetsfördelen kompenserar delvis för detta på interaktiva arbetsbelastningar — snabbare tokens innebär färre samtidiga förfrågningar — men för batch- och bakgrundsarbete vinner den öppna modellen fakturan utan konkurrens. De två modellerna siktar inte ens på samma kostnadskurva, vilket är hela poängen.

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

Vem ska bygga på vilken

Välj DeepSeek V4 Flash när kostnaden per token är den bindande begränsningen, när du vill ha långa utdata på upp till 384K, när du behöver möjligheten till självhosting eller air-gapped-driftsättning, eller när du bygger något vars marginaler inte överlever tokenpriser i flaggskeppsklass. Välj Gemini 3.7 Flash när du behöver hastighet i en interaktiv loop, multimodal indata, Go​ogles hanterade tillförlitlighet, eller de starkare resultaten inom agentisk kodning som Go​ogle rapporterar — och när du är bekväm med att kampanjpriset är tillfälligt. De är inte rivaler på det sätt som två flaggskepp är rivaler; de är två olika upphandlingsstrategier som bär samma namn. Routinglagret är där strategierna möts: DeepSeek V4 Flash är live på OrcaRouter till Deep​Seeks listpris med 0 % påslag, och failover-mönstret passar denna kombination naturligt — en regel som kör merparten av trafiken på V4 Flash och eskalerar den svåra delmängden till en starkare sluten modell, med Gemini 3.7 Flash nåbar via Go​ogles eget Gemini API på den andra grenen av samma router.

Den ärliga läsningen

Om du kan självhosta eller om du enbart är kostnadsdriven, är DeepSeek V4 Flash den bättre modellen att bygga på, {{1}}och licensen gör det till ett beslut du aldrig behöver ompröva{{/1}}. Om du behöver Go​ogles serveringshastighet, multimodala indata eller det rapporterade övertaget inom agentisk kodning, är Gemini 3.7 Flash den bättre tjänsten {{2}}så länge kampanjen varar — med prisdubblingen i januari redan inbokad i kalendern{{/2}}. Två modeller, ett namn, och marknaden får se vilken filosofi som nästa års trafik röstar på.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen