DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
NovoDestaque
FerramentasJSONRaciocínio
por DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 é a versão oficial com pós-treinamento refeito do eficiente modelo de mistura de especialistas V4 Flash da DeepSeek — 284B de parâmetros totais / 13B de parâmetros ativos, idêntico em arquitetura e tamanho ao lançamento do V4 Flash de abril, com o pós-treinamento refeito do zero. Ele atende a uma janela de contexto de 1M de tokens com até 384K tokens de saída, suporta modos de raciocínio e não raciocínio (raciocínio ativado por padrão), além de saída JSON e chamadas de ferramentas, e fala nativamente a API Responses com uma adaptação direcionada para agentes de codificação estilo Codex. A revisão 0731 é um grande avanço em capacidade de agentes, superando até mesmo o DeepSeek V4 Pro Preview nos benchmarks de agentes publicados pela DeepSeek — 82.7 no Terminal Bench 2.1, 76.7 no Cybergym, 70.3 no Toolathlon Verified, 54.4 no DeepSWE e 54.2 no NL2Repo. Na API de primeira parte da DeepSeek, esta revisão é o que o ID de modelo deepseek-v4-flash serve atualmente; o identificador datado lista a mesma revisão para chamadores que a referenciam por data. É uma escolha forte para agentes de codificação, cargas de trabalho de terminal e uso de ferramentas, e pipelines agênticos de alto volume com custo de nível flash.

ctx1M tokens
Saída máx.384K
Entradatext
Saídatext
p50 TTFT791 ms
ENTRADA$0.15/ 1M tokens
SAÍDA$0.29/ 1M tokens
p50 TTFT791 ms7 d
p95 TTFT1.42 s7 d
TRÁFEGO4.3Mtokens / 7 d

DeepSeek V4 Flash 0731 é um modelo de linguagem somente de texto do provedor deepseek, disponível através da OrcaRouter no ID de modelo deepseek/deepseek-v4-flash-0731. Suas principais especificações…

O que é DeepSeek V4 Flash 0731?

Para quem é este modelo?

Onde este modelo se posiciona na família DeepSeek no OrcaRouter?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preços

Entrada / 1M tokens$0.147
Saída / 1M tokens$0.295
Leitura de cache / 1M$0.020
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $1.91 · Com cache de prompt $1.47

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000150

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
791 ms
Velocidade de saída
101 tok/s
p95 TTFT
1.42 s
Taxa de erro
0%

Benchmarks públicos

69.1
AA Coding
Melhor que 85% dos modelos comparados
nº 18 de 124
49.9
AA Intelligence
Melhor que 80% dos modelos comparados
nº 24 de 126
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
Fonte: artificialanalysis.ai, api-docs.deepseek.com

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News7 menções · 7 d7 a mais que na semana anterior

Comparativo

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
Entrada $/M$0.15$0.44$0.15$0.15
Saída $/M$0.29$0.88$0.29$0.29
Contexto1.0M1.0M1.0M1.0M
Qualidade6/108/107/105/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o DeepSeek V4 Flash 0731?
Custa US$ 0,15 por 1.000.000 de tokens de entrada e US$ 0,29 por 1.000.000 de tokens de saída. A OrcaRouter cobra a tarifa do provedor sem margem de lucro, portanto, essas são as tarifas que você paga. O cartão do modelo não descreve preços para entrada em cache nem descontos por lote.
Qual janela de contexto e limite de saída ele suporta?
Ele suporta 1.048.576 tokens de contexto de entrada e até 384.000 tokens de saída. A modalidade de entrada é somente texto. O card do modelo não especifica um limite combinado de tokens separado além desses dois limites.
No que o modelo é melhor?
Com base nos fatos incluídos, seu ponto forte é a conclusão de tarefas em terminal e linha de comando, indicada por uma pontuação de 82,7 no Terminal Bench 2.1. Seus grandes limites de contexto e de saída também suportam o processamento de documentos longos e a geração de textos extensos. Nenhuma outra pontuação de benchmark é fornecida.
Como ele se compara a outros modelos?
Os fatos fornecidos cobrem apenas este modelo. Compare os candidatos no catálogo do OrcaRouter por janela de contexto, saída máxima, modalidades e preços por 1M de tokens. Este modelo é somente texto, tem contexto de 1M de tokens, saída de 384K e custa $0,15/$0,29 por 1M de tokens.
Como os dados são tratados ao usar este modelo através do OrcaRouter?
Os fatos disponíveis não descrevem retenção de dados, uso para treinamento ou armazenamento para este modelo. O tratamento de dados é regido pelos termos da OrcaRouter e pelas políticas do provedor deepseek. Revise a documentação da OrcaRouter antes de enviar dados sensíveis.
Como faço para chamar este modelo?
Use a API compatível com OpenAI da OrcaRouter na URL base https://api.orcarouter.ai/v1 com o ID do modelo deepseek/deepseek-v4-flash-0731. Envie solicitações padrão de conclusão de chat com sua chave de API da OrcaRouter e mensagens somente de texto.
Ele suporta streaming ou chamada de funções?
Os fatos disponíveis não indicam se streaming ou chamada de função é suportado. A API é compatível com OpenAI, portanto teste esses recursos antes de depender deles. Defina max_tokens dentro do limite de saída de 384.000.
Este é um modelo multimodal?
Não. A modalidade de entrada é somente texto. Para imagens, áudio ou vídeo, você precisará de um modelo multimodal no catálogo do OrcaRouter ou de uma etapa separada de pré-processamento.

Incorporar este selo

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="DeepSeek: DeepSeek V4 Flash 0731 no OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

Ficha do modelo como dados

GET /api/public/models/deepseek/deepseek-v4-flash-0731Abrir
Legível por máquina:/llms.txt/llms-full.txt