DeepSeek V4 Pro

deepseek/deepseek-v4-pro
PhareEn vedette
OutilsJSONRaisonnement
par DeepSeek · 2026-04-24

DeepSeek V4 Pro flagship MoE — 1.6T total / 49B paramètres actifs, 1M de contexte, raisonnement de premier ordre + utilisation agentique d'outils.

Points de terminaison:/v1/chat/completions/v1/responses
ctx1M tokens
Sortie max384K
Entréetext
p50 TTFT1.96 s
ENTRÉE$0.66/ 1M tokens
SORTIE$1.98/ 1M tokens
p50 TTFT1.96 s7 j
TTFT p9510.00 s7 j
TRAFIC1240.7Mtokens / 7 j

DeepSeek V4 Pro est le modèle phare de génération de texte proposé par DeepSeek et disponible via l'API d'OrcaRouter. Il est conçu pour les tâches nécessitant le traitement de volumes très importants…

Qu'est-ce que DeepSeek V4 Pro ?

À qui ce modèle est-il destiné ?

Quelles sont les spécifications clés ?

Comment OrcaRouter fournit-il l'accès ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Tarifs

Tarifs
Entrée / 1M tokens · Heures creuses$0.660
Sortie / 1M tokens · Heures creuses$1.98
Lecture cache / 1M · Heures creuses$0.022
Heures de pointe01:00–04:00, 06:00–10:00 ×2 (UTC)
Entrée / 1M tokens · ×2$1.32
Sortie / 1M tokens · ×2$3.96
Lecture cache / 1M · ×2$0.044
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $10.56 · Avec cache de prompt $8.33

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.001001

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
1.96 s
Vitesse de sortie
76.6 tok/s
TTFT p95
10.00 s
Taux d'erreur
0.56%

Benchmarks publics

68.8
AA Coding
Meilleur que 75 % des modèles comparés
n°30 sur 138
36.0
AA Intelligence
Meilleur que 71 % des modèles comparés
n°41 sur 147
62.5
AA Math
Meilleur que 49 % des modèles comparés
n°42 sur 82
GPQA Diamond
92.8
Humanity's Last Exam
41.0
IFBench
76.5
Long-Context Recall
80.3
MMLU-Pro
73.5 index
SciCode
51.0
tau_banking
39.6
TerminalBench Hard
46.2
terminalbench_v2_1
78.7
terminalbench_v4_0
14.1
τ²-Bench
96.2
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News2 mentions · 7 jen hausse de 2 vs la semaine précédente

Comparatif

DeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)
Entrée $/M$0.66$0.15$0.22$0.22
Sortie $/M$1.98$0.60$0.66$0.66
Contexte1.0M1.0M1.0M1.0M
Qualité8/108/107/107/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par jeton pour DeepSeek V4 Pro ?
Les tokens d'entrée coûtent $0.44 par 1M tokens ; les tokens de sortie coûtent $0.87 par 1M tokens. Il n'y a pas de majoration par OrcaRouter.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 1,048,576 jetons (environ 1M jetons).
Quelle est la longueur maximale de sortie ?
Le modèle peut générer jusqu'à 384 000 tokens en une seule réponse.
Quels sont les points forts de DeepSeek V4 Pro ?
Ses atouts incluent une capacité de contexte et de sortie extrêmement large, et un score élevé (96,2) sur τ²-Bench, indiquant une forte performance d'utilisation d'outils agentiques.
Comment DeepSeek V4 Pro se compare-t-il aux autres modèles phares ?
Il possède l'une des plus grandes fenêtres de contexte et limites de sortie parmi les modèles phares, mais il est uniquement textuel. Son score τ²-Bench fournit une comparaison directe pour les tâches agentiques, bien qu'aucun autre benchmark ne soit spécifié ici.
Est-ce qu'OrcaRouter ajoute une majoration au prix ?
Non, OrcaRouter facture au tarif du fournisseur avec zéro marge. Vous payez exactement $0.44/$0.87 par million de jetons.
Comment appeler DeepSeek V4 Pro via une API compatible OpenAI ?
Utilisez l'URL de base https://api.orcarouter.ai/v1, l'ID du modèle 'deepseek/deepseek-v4-pro', et les paramètres standard de complétions de chat.
Quelles politiques de traitement des données ou de confidentialité s'appliquent ?
Aucun détail spécifique sur le traitement des données pour ce modèle n'a été fourni. Consultez les politiques de confidentialité de DeepSeek et d'OrcaRouter pour obtenir des informations sur l'utilisation des données.
Est-ce que DeepSeek V4 Pro peut traiter des images ou de l'audio ?
Non, il s'agit d'un modèle textuel uniquement. Il ne peut ni traiter ni générer des entrées ou sorties multimodales.
Quand devrais-je choisir un modèle moins cher à la place ?
Pour les tâches avec des contextes courts (<10K tokens) ou des requêtes simples, un modèle moins cher sera plus rentable. Réservez DeepSeek V4 Pro pour les cas d'usage qui bénéficient de son immense contexte et de ses capacités de sortie.

Intégrer ce badge

DeepSeek: DeepSeek V4 Pro•$0.66/M in•1964ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro.svg" alt="DeepSeek: DeepSeek V4 Pro sur OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Pro](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro)

Fiche du modèle en données

GET /api/public/models/deepseek/deepseek-v4-proOuvrir
Lisible par machine:/llms.txt/llms-full.txt