DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
NieuwUitgelicht
ToolsJSONRedeneren
door DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 is de opnieuw post-getrainde officiële release van DeepSeek's efficiënte V4 Flash mixture-of-experts-model — 284B totaal / 13B actieve parameters, identiek in architectuur en omvang aan de V4 Flash-release van april, met de post-training volledig opnieuw uitgevoerd. Het bedient een contextvenster van 1M tokens met maximaal 384K output-tokens, ondersteunt zowel denk- als niet-denkmodi (denken standaard ingeschakeld), plus JSON-output en tool calls, en ondersteunt native de Responses API met een gerichte aanpassing voor Codex-achtige codeeragenten. De 0731-revisie is een grote vooruitgang in agentmogelijkheden en scoort zelfs hoger dan DeepSeek V4 Pro Preview op de door DeepSeek gepubliceerde agent-benchmarks — 82.7 op Terminal Bench 2.1, 76.7 op Cybergym, 70.3 op Toolathlon Verified, 54.4 op DeepSWE en 54.2 op NL2Repo. Op de first-party API van DeepSeek bedient deze revisie nu het model-id deepseek-v4-flash; de gedateerde identifier vermeldt dezelfde revisie voor aanroepers die het op datum refereren. Het is een sterke keuze voor codeeragenten, terminal- en toolgebruik-workloads, en agentische pipelines met hoge volumes tegen flash-tier-kosten.

ctx1M tokens
Max. uitvoer384K
Invoertext
Uitvoertext
p50 TTFT791 ms
INPUT$0.15/ 1M tokens
OUTPUT$0.29/ 1M tokens
p50 TTFT791 ms7d
p95 TTFT1.42 s7d
VERKEER4.3Mtokens / 7d

DeepSeek V4 Flash 0731 is een tekst-only taalmodel van de provider deepseek, beschikbaar via OrcaRouter onder de model-ID deepseek/deepseek-v4-flash-0731. De belangrijkste specificaties zijn een…

Wat is DeepSeek V4 Flash 0731?

Voor wie is dit model?

Waar past dit model in de DeepSeek-familie op OrcaRouter?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Prijzen

Invoer / 1M tokens$0.147
Uitvoer / 1M tokens$0.295
Cache lezen / 1M$0.020
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $1.91 · Met prompt-caching $1.47

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000150

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
791 ms
Outputsnelheid
101 tok/s
p95 TTFT
1.42 s
Foutpercentage
0%

Openbare benchmarks

69.1
AA Coding
Beter dan 85% van de vergeleken modellen
#18 van 124
49.9
AA Intelligence
Beter dan 80% van de vergeleken modellen
#24 van 126
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
Bron: artificialanalysis.ai, api-docs.deepseek.com

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News7 vermeldingen · 7 d7 meer dan vorige week

Vergelijking

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
Invoer $/M$0.15$0.44$0.15$0.15
Uitvoer $/M$0.29$0.88$0.29$0.29
Context1.0M1.0M1.0M1.0M
Kwaliteit6/108/107/105/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat kost DeepSeek V4 Flash 0731?
Het kost $0,15 per 1.000.000 invoertokens en $0,29 per 1.000.000 uitvoertokens. OrcaRouter factureert tegen het providerstarief zonder opslag, dus dit zijn de tarieven die u betaalt. De modelkaart beschrijft geen prijzen voor gecachte invoer of batchkortingen.
Welke context window en outputlimiet ondersteunt het?
Het ondersteunt 1.048.576 tokens aan invoercontext en tot 384.000 tokens aan uitvoer. De invoermodaliteit is alleen tekst. De modelkaart specificeert geen afzonderlijke gecombineerde tokenlimiet naast deze twee limieten.
Waar is het model het beste in?
Op basis van de verstrekte feiten is de sterkte het afronden van terminal- en opdrachtregeltaken, zoals blijkt uit een score van 82.7 op Terminal Bench 2.1. De grote context- en uitvoerlimieten ondersteunen ook de verwerking van lange documenten en het genereren van lange teksten. Er worden geen andere benchmarkscores verstrekt.
Hoe verhoudt het zich tot andere modellen?
De verstrekte feiten hebben alleen betrekking op dit model. Vergelijk kandidaten in de OrcaRouter-catalogus op contextvenster, maximale uitvoer, modaliteiten en prijzen per 1M tokens. Dit model is uitsluitend tekst, heeft een context van 1M tokens, een uitvoer van 384K en kost $0,15/$0,29 per 1M tokens.
Hoe wordt data verwerkt bij gebruik van dit model via OrcaRouter?
De beschikbare feiten beschrijven geen gegevensbewaring, trainingsgebruik of opslag voor dit model. Gegevensverwerking valt onder de voorwaarden van OrcaRouter en het beleid van provider deepseek. Raadpleeg de documentatie van OrcaRouter voordat u gevoelige gegevens verzendt.
Hoe roep ik dit model aan?
Gebruik de OpenAI-compatibele API van OrcaRouter op basis-URL https://api.orcarouter.ai/v1 met het model-ID deepseek/deepseek-v4-flash-0731. Verstuur standaard chatcompletion-verzoeken met je OrcaRouter API-sleutel en alleen-tekstberichten.
Ondersteunt het streaming of functie-aanroepen?
De beschikbare feiten vermelden niet of er streaming of function calling wordt ondersteund. De API is OpenAI-compatibel, dus test die functies voordat u erop vertrouwt. Stel max_tokens in binnen de uitvoerlimiet van 384.000.
Is dit een multimodaal model?
Nee. De invoermodaliteit is alleen tekst. Voor afbeeldingen, audio of video heb je een multimodaal model nodig in de catalogus van OrcaRouter of een aparte voorverwerkingsstap.

Sluit deze badge in

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="DeepSeek: DeepSeek V4 Flash 0731 op OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

Modelkaart als data

GET /api/public/models/deepseek/deepseek-v4-flash-0731Openen
Machineleesbaar:/llms.txt/llms-full.txt