DeepSeek V4 Pro

deepseek/deepseek-v4-pro
PhareEn vedette
OutilsJSONRaisonnement
par DeepSeek · 2026-04-24

DeepSeek V4 Pro flagship MoE — 1.6T total / 49B paramètres actifs, 1M de contexte, raisonnement de premier ordre + utilisation agentique d'outils.

Points de terminaison:/v1/chat/completions/v1/responses
ctx1M tokens
Sortie max384K
Entréetext
p50 TTFT946 ms
ENTRÉE$0.44/ 1M tokens
SORTIE$0.88/ 1M tokens
p50 TTFT946 ms7 j
TTFT p951.97 s7 j
TRAFIC7954.0Mtokens / 7 j

DeepSeek V4 Pro est le modèle phare de génération de texte proposé par DeepSeek et disponible via l'API d'OrcaRouter. Il est conçu pour les tâches nécessitant le traitement de volumes très importants…

Qu'est-ce que DeepSeek V4 Pro ?

À qui ce modèle est-il destiné ?

Quelles sont les spécifications clés ?

Comment OrcaRouter fournit-il l'accès ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Tarifs

Entrée / 1M tokens · Heures creuses$0.442
Sortie / 1M tokens · Heures creuses$0.884
Lecture cache / 1M · Heures creuses$0.060
Heures de pointe01:00–04:00, 06:00–10:00 ×2 (UTC)
Entrée / 1M tokens · ×2$0.884
Sortie / 1M tokens · ×2$1.768
Lecture cache / 1M · ×2$0.120
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $5.75 · Avec cache de prompt $4.41

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000450

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
946 ms
Vitesse de sortie
67.4 tok/s
TTFT p95
1.97 s
Taux d'erreur
0.07%

Benchmarks publics

68.8
AA Coding
Meilleur que 78 % des modèles comparés
n°25 sur 133
53.2
AA Intelligence
Meilleur que 83 % des modèles comparés
n°21 sur 135
62.5
AA Math
Meilleur que 49 % des modèles comparés
n°42 sur 82
GPQA Diamond
92.8
Humanity's Last Exam
41.0
IFBench
76.5
Long-Context Recall
75.3
MMLU-Pro
73.5 index
SciCode
49.2
tau_banking
39.6
TerminalBench Hard
46.2
terminalbench_v2_1
78.7
τ²-Bench
96.2
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News8 mentions · 7 jen baisse de 9 vs la semaine précédente

Comparatif

DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)DeepSeek V4 Pro 0813
Entrée $/M$0.44$0.15$0.15$0.44
Sortie $/M$0.88$0.29$0.29$0.88
Contexte1.0M1.0M1.0M1.0M
Qualité8/107/107/107/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par jeton pour DeepSeek V4 Pro ?
Les tokens d'entrée coûtent $0.44 par 1M tokens ; les tokens de sortie coûtent $0.87 par 1M tokens. Il n'y a pas de majoration par OrcaRouter.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 1,048,576 jetons (environ 1M jetons).
Quelle est la longueur maximale de sortie ?
Le modèle peut générer jusqu'à 384 000 tokens en une seule réponse.
Quels sont les points forts de DeepSeek V4 Pro ?
Ses atouts incluent une capacité de contexte et de sortie extrêmement large, et un score élevé (96,2) sur τ²-Bench, indiquant une forte performance d'utilisation d'outils agentiques.
Comment DeepSeek V4 Pro se compare-t-il aux autres modèles phares ?
Il possède l'une des plus grandes fenêtres de contexte et limites de sortie parmi les modèles phares, mais il est uniquement textuel. Son score τ²-Bench fournit une comparaison directe pour les tâches agentiques, bien qu'aucun autre benchmark ne soit spécifié ici.
Est-ce qu'OrcaRouter ajoute une majoration au prix ?
Non, OrcaRouter facture au tarif du fournisseur avec zéro marge. Vous payez exactement $0.44/$0.87 par million de jetons.
Comment appeler DeepSeek V4 Pro via une API compatible OpenAI ?
Utilisez l'URL de base https://api.orcarouter.ai/v1, l'ID du modèle 'deepseek/deepseek-v4-pro', et les paramètres standard de complétions de chat.
Quelles politiques de traitement des données ou de confidentialité s'appliquent ?
Aucun détail spécifique sur le traitement des données pour ce modèle n'a été fourni. Consultez les politiques de confidentialité de DeepSeek et d'OrcaRouter pour obtenir des informations sur l'utilisation des données.
Est-ce que DeepSeek V4 Pro peut traiter des images ou de l'audio ?
Non, il s'agit d'un modèle textuel uniquement. Il ne peut ni traiter ni générer des entrées ou sorties multimodales.
Quand devrais-je choisir un modèle moins cher à la place ?
Pour les tâches avec des contextes courts (<10K tokens) ou des requêtes simples, un modèle moins cher sera plus rentable. Réservez DeepSeek V4 Pro pour les cas d'usage qui bénéficient de son immense contexte et de ses capacités de sortie.

Intégrer ce badge

DeepSeek: DeepSeek V4 Pro$0.44/M in946ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro.svg" alt="DeepSeek: DeepSeek V4 Pro sur OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Pro](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro)

Fiche du modèle en données

GET /api/public/models/deepseek/deepseek-v4-proOuvrir
Lisible par machine:/llms.txt/llms-full.txt