DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
NouveauEn vedette
OutilsJSONRaisonnement
par DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 est la version officielle du modèle V4 Flash à mélange d'experts efficace de DeepSeek, issue d'un post-entraînement entièrement refait à partir de zéro — 284B de paramètres au total / 13B actifs, identique en architecture et en taille à la version V4 Flash d'avril. Il fournit une fenêtre de contexte de 1M de jetons avec jusqu'à 384K jetons de sortie, prend en charge les modes avec et sans réflexion (réflexion activée par défaut), ainsi que la sortie JSON et les appels d'outils, et parle nativement l'API Responses avec une adaptation ciblée pour les agents de codage de style Codex. La révision 0731 marque un bond majeur en capacités agentiques, surpassant même DeepSeek V4 Pro Preview sur les benchmarks agentiques publiés par DeepSeek — 82,7 sur Terminal Bench 2.1 ; 76,7 sur Cybergym ; 70,3 sur Toolathlon Verified ; 54,4 sur DeepSWE et 54,2 sur NL2Repo. Sur l'API officielle de DeepSeek, cette révision est désormais celle que sert l'identifiant de modèle deepseek-v4-flash ; l'identifiant daté pointe vers la même révision pour les appelants qui le référencent par date. C'est un choix solide pour les agents de codage, les charges de travail de type terminal et d'utilisation d'outils, ainsi que pour les pipelines agentiques à haut volume, pour un coût de niveau flash.

ctx1M tokens
Sortie max384K
Entréetext
Sortietext
p50 TTFT791 ms
ENTRÉE$0.15/ 1M tokens
SORTIE$0.29/ 1M tokens
p50 TTFT791 ms7 j
TTFT p951.42 s7 j
TRAFIC4.3Mtokens / 7 j

DeepSeek V4 Flash 0731 est un modèle linguistique exclusivement textuel du fournisseur deepseek, disponible via OrcaRouter sous l'identifiant de modèle deepseek/deepseek-v4-flash-0731. Ses…

Qu'est-ce que DeepSeek V4 Flash 0731 ?

Pour qui est ce modèle ?

Où ce modèle se situe-t-il dans la famille DeepSeek sur OrcaRouter ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Tarifs

Entrée / 1M tokens$0.147
Sortie / 1M tokens$0.295
Lecture cache / 1M$0.020
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $1.91 · Avec cache de prompt $1.47

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000150

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
791 ms
Vitesse de sortie
101 tok/s
TTFT p95
1.42 s
Taux d'erreur
0%

Benchmarks publics

69.1
AA Coding
Meilleur que 85 % des modèles comparés
n°18 sur 124
49.9
AA Intelligence
Meilleur que 80 % des modèles comparés
n°24 sur 126
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
Source: artificialanalysis.ai, api-docs.deepseek.com

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News7 mentions · 7 jen hausse de 7 vs la semaine précédente

Comparatif

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
Entrée $/M$0.15$0.44$0.15$0.15
Sortie $/M$0.29$0.88$0.29$0.29
Contexte1.0M1.0M1.0M1.0M
Qualité6/108/107/105/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte DeepSeek V4 Flash 0731 ?
Cela coûte 0,15 $ par 1 000 000 de jetons d'entrée et 0,29 $ par 1 000 000 de jetons de sortie. OrcaRouter facture au tarif du fournisseur sans aucune majoration, ce sont donc ces tarifs que vous payez. La fiche du modèle ne mentionne pas de tarification pour les entrées en cache ni de remises pour traitement par lots.
Quelle fenêtre de contexte et quelle limite de sortie prend-il en charge ?
Il prend en charge 1,048,576 tokens de contexte d'entrée et jusqu'à 384,000 tokens de sortie. La modalité d'entrée est uniquement du texte. La fiche du modèle ne précise pas de limite combinée de tokens distincte au-delà de ces deux plafonds.
Dans quoi le modèle est-il le meilleur ?
D'après les faits inclus, sa force réside dans l'exécution de tâches en terminal et en ligne de commande, comme l'indique un score de 82,7 sur Terminal Bench 2.1. Sa grande fenêtre de contexte et ses limites de sortie élevées prennent également en charge le traitement de longs documents et la génération de textes longs. Aucun autre score de benchmark n'est fourni.
Comment se compare-t-il à d'autres modèles ?
Les faits fournis ne couvrent que ce modèle. Comparez les candidats du catalogue OrcaRouter selon la fenêtre de contexte, la sortie maximale, les modalités et les prix par 1M de jetons. Ce modèle est exclusivement textuel, dispose d'une fenêtre de contexte de 1M de jetons, d'une sortie de 384K, et coûte 0,15 $/0,29 $ par 1M de jetons.
Comment les données sont-elles traitées lors de l'utilisation de ce modèle via OrcaRouter ?
Les faits disponibles ne décrivent pas la conservation des données, l'utilisation pour l'entraînement ou le stockage pour ce modèle. Le traitement des données est régi par les conditions d'OrcaRouter et les politiques du fournisseur deepseek. Consultez la documentation d'OrcaRouter avant d'envoyer des données sensibles.
Comment appeler ce modèle ?
Utilisez l'API compatible OpenAI d'OrcaRouter à l'URL de base https://api.orcarouter.ai/v1 avec l'identifiant de modèle deepseek/deepseek-v4-flash-0731. Envoyez des requêtes standard de complétion de chat avec votre clé API OrcaRouter et des messages texte uniquement.
Est-ce qu'il prend en charge le streaming ou l'appel de fonction ?
Les faits disponibles ne précisent pas si le streaming ou le function calling sont pris en charge. L'API est compatible OpenAI, alors testez ces fonctionnalités avant de vous y fier. Définissez max_tokens dans la limite de sortie de 384 000.
Est-ce un modèle multimodal ?
Non. La modalité d'entrée est textuelle uniquement. Pour les images, l'audio ou la vidéo, vous aurez besoin d'un modèle multimodal dans le catalogue d'OrcaRouter ou d'une étape de prétraitement séparée.

Intégrer ce badge

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="DeepSeek: DeepSeek V4 Flash 0731 sur OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

Fiche du modèle en données

GET /api/public/models/deepseek/deepseek-v4-flash-0731Ouvrir
Lisible par machine:/llms.txt/llms-full.txt