DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
NuevoDestacado
HerramientasJSONRazonamiento
por DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 es la versión oficial re-entrenada después del entrenamiento inicial del eficiente modelo de mezcla de expertos V4 Flash de DeepSeek: 284B total / 13B de parámetros activos, idéntico en arquitectura y tamaño a la versión V4 Flash de abril, con el post-entrenamiento rehecho desde cero. Admite una ventana de contexto de 1M de tokens con hasta 384K de tokens de salida, soporta tanto modos de razonamiento como de no razonamiento (razonamiento activado por defecto), además de salida JSON y llamadas a herramientas, y habla de forma nativa la API de Respuestas con una adaptación específica para agentes de codificación tipo Codex. La revisión 0731 supone un gran avance en capacidad de agentes, superando incluso a DeepSeek V4 Pro Preview en los benchmarks de agentes publicados por DeepSeek: 82.7 en Terminal Bench 2.1, 76.7 en Cybergym, 70.3 en Toolathlon Verified, 54.4 en DeepSWE y 54.2 en NL2Repo. En la API de primera parte de DeepSeek, esta revisión es la que sirve ahora el ID de modelo deepseek-v4-flash; el identificador con fecha lista la misma revisión para quienes la referencian por fecha. Es una opción excelente para agentes de codificación, cargas de trabajo de terminal y uso de herramientas, y pipelines agénticos de alto volumen a costo de nivel flash.

ctx1M tokens
Salida máx.384K
Entradatext
Salidatext
p50 TTFT791 ms
ENTRADA$0.15/ 1M tokens
SALIDA$0.29/ 1M tokens
p50 TTFT791 ms7 d
p95 TTFT1.42 s7 d
TRÁFICO4.3Mtokens / 7 d

DeepSeek V4 Flash 0731 es un modelo de lenguaje solo de texto del proveedor deepseek, disponible a través de OrcaRouter con el ID de modelo deepseek/deepseek-v4-flash-0731. Sus especificaciones…

I don't have any information about a model called "DeepSeek V4 Flash 0731." As of my knowledge cutoff, there isn't a publicly known DeepSeek model by that exact name. DeepSeek has released models like DeepSeek-V2, DeepSeek-V3, and DeepSeek-R1, but I'm not aware of a "V4 Flash 0731" version. The string "0731" looks like a date (July 31), so this could potentially refer to a future or internal model version, or it could be a nickname, a typo, or a model from a different source that I don't have knowledge about. If you can provide more context — like where you encountered this name — I might be able to help better. Otherwise, I'd suggest checking DeepSeek's official website or announcements for the latest model lineup.

¿Para quién es este modelo?

¿Dónde se sitúa este modelo en la familia DeepSeek en OrcaRouter?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Precios

Entrada / 1M tokens$0.147
Salida / 1M tokens$0.295
Lectura caché / 1M$0.020
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $1.91 · Con caché de prompts $1.47

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000150

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
791 ms
Velocidad de salida
101 tok/s
p95 TTFT
1.42 s
Tasa de error
0%

Pruebas de referencia públicas

69.1
AA Coding
Mejor que el 85 % de los modelos comparados
n.º 18 de 124
49.9
AA Intelligence
Mejor que el 80 % de los modelos comparados
n.º 24 de 126
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
Fuente: artificialanalysis.ai, api-docs.deepseek.com

Actividad de la comunidad

De qué hablan los desarrolladores esta semana

Hacker News7 menciones · 7 d7 más que la semana anterior

Comparativa

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
Entrada $/M$0.15$0.44$0.15$0.15
Salida $/M$0.29$0.88$0.29$0.29
Contexto1.0M1.0M1.0M1.0M
Calidad6/108/107/105/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuánto cuesta DeepSeek V4 Flash 0731?
Cuesta $0.15 por 1,000,000 de tokens de entrada y $0.29 por 1,000,000 de tokens de salida. OrcaRouter factura a la tarifa del proveedor sin margen de ganancia, por lo que estas son las tarifas que paga. La tarjeta del modelo no describe precios de entrada en caché ni descuentos por lotes.
¿Qué ventana de contexto y límite de salida soporta?
Admite 1,048,576 tokens de contexto de entrada y hasta 384,000 tokens de salida. La modalidad de entrada es solo texto. La tarjeta del modelo no especifica un límite de tokens combinado separado más allá de estos dos límites.
¿En qué es mejor el modelo?
Según los hechos incluidos, su fortaleza es la finalización de tareas de terminal y línea de comandos, indicada por una puntuación de 82.7 en Terminal Bench 2.1. Sus amplios límites de contexto y salida también permiten el procesamiento de texto de documentos largos y la generación de formato largo. No se proporcionan otras puntuaciones de referencia.
¿Cómo se compara con otros modelos?
Los hechos proporcionados solo cubren este modelo. Compare los candidatos en el catálogo de OrcaRouter por ventana de contexto, salida máxima, modalidades y precios por 1M de tokens. Este modelo es solo de texto, tiene una ventana de contexto de 1M de tokens, una salida de 384K, y cuesta $0.15/$0.29 por 1M de tokens.
¿Cómo se manejan los datos al usar este modelo a través de OrcaRouter?
Los hechos disponibles no describen la retención de datos, el uso para entrenamiento ni el almacenamiento de este modelo. El manejo de datos se rige por los términos de OrcaRouter y las políticas del proveedor deepseek. Revise la documentación de OrcaRouter antes de enviar datos sensibles.
¿Cómo llamo a este modelo?
Usa la API compatible con OpenAI de OrcaRouter en la URL base https://api.orcarouter.ai/v1 con el ID de modelo deepseek/deepseek-v4-flash-0731. Envía solicitudes estándar de finalización de chat con tu clave de API de OrcaRouter y mensajes de solo texto.
¿Soporta streaming o llamada a funciones?
La información disponible no indica si se admiten streaming o function calling. La API es compatible con OpenAI, así que prueba esas funciones antes de confiar en ellas. Establece max_tokens dentro del límite de salida de 384,000.
¿Es este un modelo multimodal?
No. La modalidad de entrada es solo texto. Para imágenes, audio o video, necesitará un modelo multimodal en el catálogo de OrcaRouter o un paso de preprocesamiento separado.

Insertar esta insignia

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="DeepSeek: DeepSeek V4 Flash 0731 en OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

Ficha del modelo como datos

GET /api/public/models/deepseek/deepseek-v4-flash-0731Abrir
Legible por máquina:/llms.txt/llms-full.txt