
Gemini 3.7 Flash mot DeepSeek V4 Flash: Två "Flash"-modeller, motsatta svar på samma fråga
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
De två mest förvirrande namngivna modellerna 2026 heter båda Flash, och de kunde inte ha svarat på samma fråga mer olika. Gemini 3.7 Flash, som släpptes den 13 augusti 2026, är Googles slutna arbetshäst: ungefär 340 utdatatoken per sekund, ett intelligensindex på 56 och ett kampanjpris på 0,75 dollar per miljon inmatningstoken och 3,75 dollar per miljon utdatatoken. DeepSeek V4 Flash är den del av DeepSeeks V4-familj som har öppna vikter, släppt i april och uppdaterad i slutet av juli: MIT-licensierad, nedladdningsbar och prissatt till 0,14 dollar per miljon inmatningstoken och 0,28 dollar per miljon utdatatoken via DeepSeeks eget API – ungefär en femtedel av Googles kampanjpris för inmatning och en trettondel av priset för utdata. Båda är ”flash”-modeller, byggda för att vara snabba och billiga för högvolymarbete. Ordet är där likheten slutar.
Frågan de besvarar olika är den som definierar den här generationen: hyr du intelligens eller äger du den? DeepSeek V4 Flash är en mixture-of-experts-modell med 284 miljarder parametrar, cirka 13B aktiva per token, en kontext på 1M token och ett outputtak på 384K, släppt under MIT-licens — vikterna är en nedladdning på ~160GB, och 31 juli-uppdateringen (V4-Flash-0731) tillförde betydligt starkare agentiska förmågor. Gemini 3.7 Flash är en proprietär modell byggd på Gemini 3.6 Flash med 1M kontext, ett outputtak på 64K, multimodala indata och ingen väg till egen drift. En av dessa modeller kan vara nätverksisolerad, finjusteras och köras på egen hårdvara. Den andra körs bara där Google kör den.

De två Flashes, sida vid sida
Båda modellerna riktar sig till samma köpare — högvolymiga produktionsarbetsbelastningar som inte har råd med en flaggskeppsmodell per token — men de når dit genom motsatta arkitekturer. DeepSeek V4 Flash:s hybrida attention (komprimerad sparse plus kraftigt komprimerad attention) är det som gör att dess 1M-kontext är tillräckligt kostnadseffektiv för att kunna säljas till dessa priser; det är modellen som DeepSeek pekar de äldre `deepseek-chat`- och `deepseek-reasoner`-slutpunkterna på, pensionerad i juli. Gemini 3.7 Flash är Googles algoritmiska förfining av den egna Flash-serien, och dess fördel är genomströmningen vid serving: oberoende mätning visar cirka 340 tokens/s jämfört med DeepSeek V4 Flash:s cirka 113, och den uppnår det samtidigt som den hanterar ljud- och videoinmatning som DeepSeek V4 Flash inte gör.
• Intelligensindex — 56 för Gemini 3.7 Flash jämfört med 50 för DeepSeek V4 Flash, enligt Artificial Analysis.
• Utmatningshastighet — ~340 tokens/s jämfört med ~113 tokens/s, båda enligt Artificial Analysis.
• Kontextfönster — 1M tokens för båda; DeepSeek V4 Flash producerar upp till 384K jämfört med Gemini 3.7 Flash:s 64K.
• Inmatningspris — $0.75 (kampanjpris, till och med 2026) jämfört med $0.14 på DeepSeeks eget API.
• Utpris — $3,75 (kampanjpris) jämfört med $0,28.
• Vikter — proprietära kontra MIT-licensierade och nedladdningsbara.

Vad sex indexpunkter faktiskt köper
Sexpoängsgapet i Index är betydande men inte avgrundsdjup, och det ligger mestadels inom områden som DeepSeek V4 Flash inte var optimerad för. Gemini 3.7 Flash:s rapporterade siffror inom agentisk kodning (65,3 på DeepSWE v1.1, 43,6 på FrontierCode 1.1 Main, leverantörsrapporterade) ligger väl före, och dess Elo inom webbutveckling (1588, även det leverantörsrapporterat) återspeglar verkliga förbättringar inom UI-generering. DeepSeek V4 Flash:s egna rapporterade siffror — 79,0 på SWE-bench Verified, 91,6 på LiveCodeBench, ett τ²-Bench-resultat på 95,0 som oberoende spårare bekräftar — står sig väl inom avgränsad kodning och verktygsanvändning, och dess 1M-kontextsökning (78,7 på MRCR, 60,5 på CorpusQA) är konkurrenskraftig med allt i sin prisklass. Mönstret: Gemini 3.7 Flash leder inom agentiskt djup och webbarbete; DeepSeek V4 Flash byter bort dessa mot rå tokenekonomi och ett långkontexttak som ingen sluten arbetshäst matchar.
Öppna vikter förändrar upphandlingen, inte bara priset.
MIT-licensen är den del av den här jämförelsen som ingen benchmarktabell fångar. DeepSeek V4 Flash kan laddas ner och köras på din egen hårdvara, finjusteras på dina egna data och användas i miljöer där API-anrop inte är tillåtna — och licensen har inga skalbaserade begränsningar, så ingenting i din tillväxt ändrar villkoren. Den praktiska kostnaden är operativ: att servera en 284B MoE-modell i den hastighet ett produktions-team vill ha kräver reellt GPU-inventarium, och för de flesta team är det ärliga valet det värdbaserade API:t. Det är där prisskillnaden gör sitt verkliga arbete: även den värdbaserade vägen, till $0,14 / $0,28, är tillräckligt billig för att vara standardvalet för långsvansen av trafik. Gemini 3.7 Flash erbjuder ingen del av ägarskapsvägen — vad du köper är en tillförlitligt hanterad, snabb, multimodal tjänst med en kampanjprislapp och en prisklippa i januari.
Volymfakturan
Kör samma dag på båda: 20 miljoner input-tokens och 4 miljoner output-tokens. På DeepSeek V4 Flash:s eget API blir det $2,80 + $1,12, ungefär $3,92. På Gemini 3.7 Flash till kampanjpriset blir det $15 + $15, ungefär $30 — en skillnad på 7,6 gånger även medan Google kör sin rabatt. Efter den 1 januari 2027, när Gemini 3.7 Flash återgår till $1,50 / $7,50, kostar samma dag ungefär $58, femton gånger DeepSeeks siffra. Hastighetsfördelen kompenserar delvis för detta på interaktiva arbetsbelastningar — snabbare tokens innebär färre samtidiga förfrågningar — men för batch- och bakgrundsarbete vinner den öppna modellen fakturan utan konkurrens. De två modellerna siktar inte ens på samma kostnadskurva, vilket är hela poängen.

Vem ska bygga på vilken
Välj DeepSeek V4 Flash när kostnaden per token är den bindande begränsningen, när du vill ha långa utdata på upp till 384K, när du behöver möjligheten till självhosting eller air-gapped-driftsättning, eller när du bygger något vars marginaler inte överlever tokenpriser i flaggskeppsklass. Välj Gemini 3.7 Flash när du behöver hastighet i en interaktiv loop, multimodal indata, Googles hanterade tillförlitlighet, eller de starkare resultaten inom agentisk kodning som Google rapporterar — och när du är bekväm med att kampanjpriset är tillfälligt. De är inte rivaler på det sätt som två flaggskepp är rivaler; de är två olika upphandlingsstrategier som bär samma namn. Routinglagret är där strategierna möts: DeepSeek V4 Flash är live på OrcaRouter till DeepSeeks listpris med 0 % påslag, och failover-mönstret passar denna kombination naturligt — en regel som kör merparten av trafiken på V4 Flash och eskalerar den svåra delmängden till en starkare sluten modell, med Gemini 3.7 Flash nåbar via Googles eget Gemini API på den andra grenen av samma router.
Den ärliga läsningen
Om du kan självhosta eller om du enbart är kostnadsdriven, är DeepSeek V4 Flash den bättre modellen att bygga på, {{1}}och licensen gör det till ett beslut du aldrig behöver ompröva{{/1}}. Om du behöver Googles serveringshastighet, multimodala indata eller det rapporterade övertaget inom agentisk kodning, är Gemini 3.7 Flash den bättre tjänsten {{2}}så länge kampanjen varar — med prisdubblingen i januari redan inbokad i kalendern{{/2}}. Två modeller, ett namn, och marknaden får se vilken filosofi som nästa års trafik röstar på.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
