DeepSeek V4.1 Flash

deepseek/deepseek-v4.1-flash
NyUtvalt
VisionVerktygJSONResonemang
av DeepSeek · 2026-09-10

DeepSeek-V4.1-Flash är den minsta modellen i DeepSeeks nya arkitekturfamilj, släppt den 10 september 2026, med inbyggd multimodal visuell förståelse – den produktionsredo efterföljaren till både V4 Flash och V4 Flash Vision-experimentet. Den nya arkitekturen siktar på en högre kapacitetstak, snabbare inferens och högre genomströmning, och DeepSeek rapporterar att V4.1 Flash på ett övergripande sätt överträffar V4 Pro när det gäller prestanda, kostnad, hastighet och total uppgiftstid. Den tar emot text och bilder med textutdata, erbjuder ett kontextfönster på 1M-token med upp till 384K utdatatokens, och stöder lägena thinking (standard, med valbar ansträngning låg / hög / max) och non-thinking i Chat Completions, Responses och Anthropic-kompatibla API:er, tillsammans med JSON-utdata, verktygsanrop och chat prefix completion; FIM fungerar endast i non-thinking-läge. Modellvikterna är öppna på Hugging Face (deepseek-ai/DeepSeek-V4.1-Flash). Officiella riktmärken vid lansering: 90.6 på Terminal-Bench 2.1, 74.2 på DeepSWE v1.1, 65.4 på NL2Repo-Bench, 90.9 på GPQA Diamond, 63.9 på HLE med verktyg, och starka resultat för inbyggda vision-agenter (89.6 BabyVision, 78.9 Chartography med verktyg). Priserna sänktes i samband med lanseringen: $0.15/M för inmatning (cache miss), $0.60/M för utdata och $0.003/M vid cacheträffar till lågtrafikpriser, som fördubblas under vardagar vid högtrafik (01:00-04:00 och 06:00-10:00 UTC); alla andra timmar, inklusive helger, är lågtrafik.

ctx1M tokens
Max output384K
Inmatningtext + image
Utdatatext
p50 TTFT412 ms
INMATNING$0.15/ 1M token
UTDATA$0.60/ 1M token
p50 TTFT412 ms7d
p95 TTFT1.60 s7d
TRAFIK299.5Mtokens/7d

DeepSeek V4.1 Flash är en DeepSeek-modell som är tillgänglig via OrcaRouter, den OpenAI-kompatibla API-gatewayen. Den tar emot text- och bildindata, har ett kontextfönster på 1 048 576 tokens och kan…

Vad är DeepSeek V4.1 Flash?

Vem är DeepSeek V4.1 Flash byggd för?

Varför spelar kontextfönstret på 1,048,576 token roll?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Priser

Priser
Inmatning / 1M token · Lågtrafik$0.150
Utdata / 1M tokens · Lågtrafik$0.600
Cacheläsning / 1M · Lågtrafik$0.0030
Topptimmar01:00–04:00, 06:00–10:00 ×2 (UTC)
Inmatning / 1M token · ×2$0.300
Utdata / 1M tokens · ×2$1.20
Cacheläsning / 1M · ×2$0.0060
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $2.85 · Med promptcachning $2.34

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000303

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
412 ms
Utdatahastighet
215 tok/s
p95 TTFT
1.60 s
Felfrekvens
0.07%

Offentliga benchmarks

Agents' Last Exam
31.8
Automation-Bench
54.8
BabyVision (with tools)
89.6
Chartography (with tools)
78.9
CyberGym
88.1
DeepSWE v1.1
74.2
ExploitGym
15.3
GPQA Diamond
90.9
HLE
36.8
HLE (with tools)
63.9
MathArena Apex
65.6
NL2Repo-Bench
65.4
ProgramBench
20.3
SEC-Bench Pro
62.8
Terminal-Bench 2.1
90.6
Terminal-Bench 3.0
30.0
Terminal-Bench 4.0
31.2
ZeroBench-main (with tools)
49.0
Källa: api-docs.deepseek.com

Community-buzz

Vad utvecklare säger den här veckan

Hacker News13 omnämnanden · 7dupp 13 jämfört med föregående vecka

Så jämför den sig

DeepSeek V4.1 FlashDeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)
Input $/M$0.15$0.73$0.24$0.24
Output $/M$0.60$2.18$0.73$0.73
Kontext1.0M1.0M1.0M1.0M
Kvalitet8/108/107/107/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar DeepSeek V4.1 Flash på OrcaRouter?
OrcaRouter debiterar $0.15 per 1 miljon indatatokens och $0.60 per 1 miljon utdatatokens för DeepSeek V4.1 Flash, vidaredebiterat till leverantörens pris utan påslag. Ingen separat avgift beskrivs för själva kontextfönstret: 1 048 576 tokens är en gräns, inte en avgift. Indatatokens omfattar text, bilder och konversationshistorik som du skickar; utdatatokens täcker allt som genereras, upp till 384 000 tokens.
Hur stora är kontextfönstret och den maximala utmatningen?
DeepSeek V4.1 Flash har ett kontextfönster på 1,048,576 tokens och en maximal utdata på 384,000 tokens. Inmatningsfönstret låter dig skicka in hela dokument, transkriptioner eller repository-ögonblicksbilder i ett enda anrop, medan utdatataket stöder långa artefakter i en enda genomkörning, såsom specifikationer, migreringsplaner eller utökade diffar.
Vad är DeepSeek V4.1 Flash bäst på?
Det är byggt för arbete med långa indata och långa utdata: analys av hela dokument, kodförståelse i stora kodbaser, multimodal granskning av text plus bilder samt arbetsflöden som behöver omfattande genererade svar i stället för korta svar. Dess poäng på 90,9 i GPQA Diamond pekar också på gedigen naturvetenskaplig och teknisk resonemangsförmåga på avancerad nivå. Indata stöder både text och bilder; utdata är endast text.
Hur står det sig jämfört med större frontlinjemodeller?
Frontier-modeller kan ligga i framkant i de svåraste benchmarkarna för resonemang och tar vanligtvis mer betalt per token, medan DeepSeek V4.1 Flash erbjuder ett kontextfönster på 1 048 576 token och en utdatagräns på 384 000 token till $0.15 per 1M indata och $0.60 per 1M utdata-token. För arbete med lång kontext och hög volym är det ofta det praktiska valet; för de svåraste enskilda resonemangsstegen är det ett rimligt mönster att dirigera dessa anrop till en dyrare modell på OrcaRouter.
Hur hanteras data när jag anropar den här modellen?
OrcaRouter dirigerar begäranden till DeepSeeks API och fakturerar enligt leverantörens taxa utan påslag. Lagring, användning för träning och relaterade villkor regleras av leverantörens policyer snarare än en separat överenskommelse som beskrivs här, så bekräfta leverantörens aktuella villkor innan du skickar känsligt material. Maskera identifierare du inte behöver och håll prompter till det minimum som uppgiften kräver; en mindre kontext sänker också indatakostnaden på $0.15 per 1M tokens.
Hur anropar jag det via ett OpenAI-kompatibelt API?
Ange klientens bas-URL till https://api.orcarouter.ai/v1 och använd modell-id:t deepseek/deepseek-v4.1-flash med din OrcaRouter API-nyckel. Förfrågningar och svar följer OpenAI:s schema för chat completions, så befintliga SDK:er, streaminghanterare och parsning av verktygsanrop fungerar utan ändringar. Migrering innebär vanligtvis att du ändrar bas-URL och modellsträng samt kör om din utvärderingsuppsättning.
Kan DeepSeek V4.1 Flash ta emot bilder?
Ja. Bildindata stöds via den standardiserade arrayen för multimodalt innehåll, med text- och bilddelar i samma användarmeddelande. Bildtoken räknas som indata och debiteras med $0.15 per 1M indatatoken på OrcaRouter. Utdata förblir endast text, så modellen beskriver eller extraherar från bilder i stället för att generera dem.
Är ett 90,9 på GPQA Diamond tillräckligt för att lita på det för min uppgift?
Det är en användbar signal, inte en garanti. GPQA Diamond mäter vetenskapligt resonemang på avancerad nivå under ett fast promptformat, vilket är relevant för tekniskt frågebesvarande men säger lite om återkallning i långa kontexter, ton eller extraktionsnoggrannhet på dina data. Bygg en liten utvärderingsuppsättning från verkliga indata, kör den mot DeepSeek V4.1 Flash och alla alternativa modell-id:n på OrcaRouter, och jämför kostnad och kvalitet innan du routar produktionstrafik.

Bädda in denna badge

DeepSeek: DeepSeek V4.1 Flash$0.15/M in412ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg" alt="DeepSeek: DeepSeek V4.1 Flash på OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4.1 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash)

Modellkort som data

GET /api/public/models/deepseek/deepseek-v4.1-flashÖppna