DeepSeek V4 Flash

deepseek/deepseek-v4-flash
OutilsJSONRaisonnement
par DeepSeek · 2026-04-24

DeepSeek V4 Flash MoE efficace — 284B total / 13B paramètres actifs, contexte de 1M, optimisé pour les charges de travail quotidiennes rapides.

Points de terminaison:/v1/chat/completions/v1/responses
ctx1M tokens
Sortie max384K
Entréetext
p50 TTFT608 ms
ENTRÉE$0.15/ 1M tokens
SORTIE$0.29/ 1M tokens
p50 TTFT608 ms7 j
TTFT p951.88 s7 j
TRAFIC31437.8Mtokens / 7 j

DeepSeek V4 Flash est un modèle de langage de grande taille de l'entreprise chinoise d'IA DeepSeek. Il ne traite que des entrées textuelles et est conçu pour des scénarios nécessitant une grande…

Qu'est-ce que DeepSeek V4 Flash ?

Qui devrait utiliser DeepSeek V4 Flash ?

Quelles modalités d'entrée DeepSeek V4 Flash prend-il en charge ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Tarifs

Entrée / 1M tokens · Heures creuses$0.147
Sortie / 1M tokens · Heures creuses$0.295
Lecture cache / 1M · Heures creuses$0.020
Heures de pointe01:00–04:00, 06:00–10:00 ×2 (UTC)
Entrée / 1M tokens · ×2$0.294
Sortie / 1M tokens · ×2$0.590
Lecture cache / 1M · ×2$0.040
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $1.91 · Avec cache de prompt $1.47

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000150

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
608 ms
Vitesse de sortie
117 tok/s
TTFT p95
1.88 s
Taux d'erreur
5.3%

Benchmarks publics

69.1
AA Coding
Meilleur que 82 % des modèles comparés
n°23 sur 133
51.8
AA Intelligence
Meilleur que 76 % des modèles comparés
n°32 sur 135
50.0
AA Math
Meilleur que 26 % des modèles comparés
n°61 sur 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
74.3
MMLU-Pro
57.0 index
SciCode
49.9
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
τ²-Bench
95.0
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News8 mentions · 7 jen baisse de 8 vs la semaine précédente

Comparatif

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Flash Vision (Exp)DeepSeek V4 Pro 0813
Entrée $/M$0.15$0.44$0.15$0.44
Sortie $/M$0.29$0.88$0.29$0.88
Contexte1.0M1.0M1.0M1.0M
Qualité7/108/107/107/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte DeepSeek V4 Flash sur OrcaRouter ?
Le coût des tokens d'entrée est de 0,14 $ pour 1 million de tokens, et le coût des tokens de sortie est de 0,28 $ pour 1 million de tokens. OrcaRouter facture exactement le tarif du fournisseur sans marge.
Quelle est la fenêtre de contexte de DeepSeek V4 Flash ?
La fenêtre de contexte est de 1,048,576 tokens (1 million de tokens). La sortie maximale par requête est de 384,000 tokens.
Quels sont les principaux atouts de DeepSeek V4 Flash ?
Ses points forts sont la très grande fenêtre de contexte et la limite élevée de tokens de sortie, combinés à un prix bas et à un score τ²-Bench de 95,0, indiquant de bonnes capacités de raisonnement et d'utilisation d'outils.
Comment DeepSeek V4 Flash se compare-t-il à GPT-4 ou Claude ?
DeepSeek V4 Flash offre un contexte beaucoup plus large (1M contre 128k/200k) et une sortie (384k contre ~4k) pour une fraction du coût. Cependant, il est limité au texte et peut avoir des connaissances générales ou un réglage de sécurité moins étendus.
Est-ce qu'OrcaRouter majore le prix de DeepSeek V4 Flash ?
Non. OrcaRouter transmet le tarif du fournisseur sans aucune marge. Vous payez $0.14 par 1M d'entrée et $0.28 par 1M de sortie exactement comme facturé par DeepSeek.
Comment appeler DeepSeek V4 Flash via l'API OrcaRouter ?
Utilisez l'URL de base compatible OpenAI https://api.orcarouter.ai/v1, définissez le paramètre model sur "deepseek/deepseek-v4-flash", et incluez votre clé API OrcaRouter dans l'en-tête Authorization.
Quelles politiques de traitement des données s'appliquent à DeepSeek V4 Flash ?
Les données passent par OrcaRouter vers les serveurs de DeepSeek en Chine. Consultez la politique de confidentialité d'OrcaRouter et les conditions de DeepSeek. Aucune protection supplémentaire des données n'est explicitement offerte.
Est-ce que DeepSeek V4 Flash est multimodal ?
Non, il n'accepte que les entrées textuelles. Pour les images, l'audio ou la vidéo, vous devrez les prétraiter en texte ou utiliser un modèle différent.
Quels paramètres puis-je définir lors de l'utilisation de DeepSeek V4 Flash ?
Paramètres standards des complétions de chat OpenAI : model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, etc. Le max_tokens ne peut pas dépasser 384,000.
Quels cas d'utilisation conviennent le mieux à DeepSeek V4 Flash ?
Analyse de longs documents, génération de code avec raisonnement étendu, conversations multi-tours nécessitant un contexte profond, et tâches produisant de grandes sorties comme des rapports ou des plans détaillés.

Intégrer ce badge

DeepSeek: DeepSeek V4 Flash$0.15/M in608ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash sur OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Fiche du modèle en données

GET /api/public/models/deepseek/deepseek-v4-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt