DeepSeek V4 Flash

deepseek/deepseek-v4-flash
FerramentasJSONRaciocínio
por DeepSeek · 2026-04-24

DeepSeek V4 Flash eficiente MoE — 284B total / 13B parâmetros ativos, contexto de 1M, otimizado para cargas de trabalho rápidas do dia a dia.

ctx1M tokens
Saída máx.384K
Entradatext
p50 TTFT608 ms
ENTRADA$0.15/ 1M tokens
SAÍDA$0.29/ 1M tokens
p50 TTFT608 ms7 d
p95 TTFT1.88 s7 d
TRÁFEGO31437.8Mtokens / 7 d

DeepSeek V4 Flash é um modelo de linguagem de grande porte da empresa chinesa de IA DeepSeek. Ele processa apenas entradas de texto e foi projetado para cenários que exigem uma grande janela de…

O que é DeepSeek V4 Flash?

Quem deve usar DeepSeek V4 Flash?

Quais modalidades de entrada o DeepSeek V4 Flash suporta?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Preços

Entrada / 1M tokens · Fora de pico$0.147
Saída / 1M tokens · Fora de pico$0.295
Leitura de cache / 1M · Fora de pico$0.020
Horário de pico01:00–04:00, 06:00–10:00 ×2 (UTC)
Entrada / 1M tokens · ×2$0.294
Saída / 1M tokens · ×2$0.590
Leitura de cache / 1M · ×2$0.040
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $1.91 · Com cache de prompt $1.47

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000150

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
608 ms
Velocidade de saída
117 tok/s
p95 TTFT
1.88 s
Taxa de erro
5.3%

Benchmarks públicos

69.1
AA Coding
Melhor que 82% dos modelos comparados
nº 23 de 133
51.8
AA Intelligence
Melhor que 76% dos modelos comparados
nº 32 de 135
50.0
AA Math
Melhor que 26% dos modelos comparados
nº 61 de 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
74.3
MMLU-Pro
57.0 index
SciCode
49.9
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
τ²-Bench
95.0
Fonte: artificialanalysis.ai

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News8 menções · 7 d8 a menos que na semana anterior

Comparativo

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Flash Vision (Exp)DeepSeek V4 Pro 0813
Entrada $/M$0.15$0.44$0.15$0.44
Saída $/M$0.29$0.88$0.29$0.88
Contexto1.0M1.0M1.0M1.0M
Qualidade7/108/107/107/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o DeepSeek V4 Flash no OrcaRouter?
Tokens de entrada custam $0.14 por 1 milhão de tokens, e tokens de saída custam $0.28 por 1 milhão de tokens. OrcaRouter cobra exatamente a taxa do provedor sem margem de lucro.
Qual é a janela de contexto do DeepSeek V4 Flash?
A janela de contexto é de 1.048.576 tokens (1 milhão de tokens). O máximo de saída por solicitação é de 384.000 tokens.
Quais são os principais pontos fortes do DeepSeek V4 Flash?
Suas vantagens são a janela de contexto muito grande e o alto limite de tokens de saída, combinados com um preço baixo e uma forte pontuação τ²-Bench de 95,0, indicando boas capacidades de raciocínio e uso de ferramentas.
Como o DeepSeek V4 Flash se compara ao GPT-4 ou ao Claude?
DeepSeek V4 Flash oferece um contexto muito maior (1M contra 128k/200k) e saída (384k contra ~4k) a uma fração do custo. No entanto, é apenas texto e pode ter menos conhecimento geral amplo ou ajuste de segurança.
O OrcaRouter aumenta o preço do DeepSeek V4 Flash?
Não. O OrcaRouter repassa a taxa do provedor sem margem de lucro. Você paga $0.14 por 1M de entrada e $0.28 por 1M de saída exatamente como cobrado pela DeepSeek.
Como faço para chamar o DeepSeek V4 Flash através da API do OrcaRouter?
Use a URL base compatível com OpenAI https://api.orcarouter.ai/v1, defina o parâmetro model como "deepseek/deepseek-v4-flash" e inclua sua chave de API do OrcaRouter no cabeçalho Authorization.
Quais políticas de tratamento de dados se aplicam ao DeepSeek V4 Flash?
Os dados passam pelo OrcaRouter para os servidores da DeepSeek na China. Revise a política de privacidade do OrcaRouter e os termos da DeepSeek. Nenhuma proteção adicional de dados é explicitamente oferecida.
DeepSeek V4 Flash é multimodal?
Não, ele aceita apenas entradas de texto. Para imagens, áudio ou vídeo, você precisaria pré-processá-los em texto ou usar um modelo diferente.
Quais parâmetros posso definir ao usar o DeepSeek V4 Flash?
Parâmetros padrão de chat completions da OpenAI: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, etc. O max_tokens não pode exceder 384,000.
Quais casos de uso são mais adequados para o DeepSeek V4 Flash?
Análise de documentos longos, geração de código com raciocínio estendido, conversas de múltiplas voltas que precisam de contexto profundo e tarefas que produzem saídas grandes, como relatórios detalhados ou planos.

Incorporar este selo

DeepSeek: DeepSeek V4 Flash$0.15/M in608ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash no OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Ficha do modelo como dados

GET /api/public/models/deepseek/deepseek-v4-flashAbrir
Legível por máquina:/llms.txt/llms-full.txt