DeepSeek V4 Flash

deepseek/deepseek-v4-flash
StrumentiJSONRagionamento
di DeepSeek · 2026-04-24

DeepSeek V4 Flash MoE efficiente — 284B totali / 13B parametri attivi, contesto 1M, ottimizzato per carichi di lavoro quotidiani veloci.

ctx1M token
Output max384K
Inputtext
p50 TTFT608 ms
INGRESSO$0.15/ 1M token
USCITA$0.29/ 1M token
p50 TTFT608 ms7 g
p95 TTFT1.88 s7 g
TRAFFICO31437.8Mtoken / 7 g

DeepSeek V4 Flash è un modello linguistico di grandi dimensioni dell'azienda cinese di IA DeepSeek. Elabora solo input testuali ed è progettato per scenari che richiedono una finestra di contesto…

Cos'è DeepSeek V4 Flash?

Chi dovrebbe utilizzare DeepSeek V4 Flash?

Quali modalità di input supporta DeepSeek V4 Flash?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Prezzi

Input / 1M token · Fuori punta$0.147
Output / 1M token · Fuori punta$0.295
Lettura cache / 1M · Fuori punta$0.020
Ore di punta01:00–04:00, 06:00–10:00 ×2 (UTC)
Input / 1M token · ×2$0.294
Output / 1M token · ×2$0.590
Lettura cache / 1M · ×2$0.040
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $1.91 · Con cache dei prompt $1.47

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000150

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
608 ms
Velocità di output
117 tok/s
p95 TTFT
1.88 s
Tasso di errore
5.3%

Benchmark pubblici

69.1
AA Coding
Migliore del 82% dei modelli confrontati
n. 23 su 133
51.8
AA Intelligence
Migliore del 76% dei modelli confrontati
n. 32 su 135
50.0
AA Math
Migliore del 26% dei modelli confrontati
n. 61 su 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
74.3
MMLU-Pro
57.0 index
SciCode
49.9
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
τ²-Bench
95.0
Fonte: artificialanalysis.ai

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News8 menzioni · 7 gg8 in meno rispetto alla settimana scorsa

A confronto

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Flash Vision (Exp)DeepSeek V4 Pro 0813
Input $/M$0.15$0.44$0.15$0.44
Output $/M$0.29$0.88$0.29$0.88
Contesto1.0M1.0M1.0M1.0M
Qualità7/108/107/107/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Quanto costa DeepSeek V4 Flash su OrcaRouter?
Il costo dei token di input è di $0,14 per 1 milione di token, e il costo dei token di output è di $0,28 per 1 milione di token. OrcaRouter applica esattamente la tariffa del fornitore, con margine zero.
Qual è la finestra di contesto di DeepSeek V4 Flash?
La finestra di contesto è di 1.048.576 token (1 milione di token). L'output massimo per richiesta è di 384.000 token.
Quali sono i principali punti di forza di DeepSeek V4 Flash?
I suoi punti di forza sono la finestra di contesto molto ampia e l'elevato limite di token di output, combinati con un prezzo basso e un punteggio elevato di 95.0 nel τ²-Bench, che indica buone capacità di ragionamento e utilizzo di strumenti.
Come si confronta DeepSeek V4 Flash con GPT-4 o Claude?
DeepSeek V4 Flash offre un contesto molto più ampio (1M vs 128k/200k) e output (384k vs ~4k) a una frazione del costo. Tuttavia, è solo testo e potrebbe avere una conoscenza generale meno ampia o una regolazione della sicurezza ridotta.
OrcaRouter applica un ricarico sul prezzo di DeepSeek V4 Flash?
No. OrcaRouter applica la tariffa del fornitore senza alcun ricarico. Paghi $0.14 per 1M di input e $0.28 per 1M di output, esattamente come addebitato da DeepSeek.
Come faccio a chiamare DeepSeek V4 Flash tramite l'API OrcaRouter?
Utilizza l'URL di base compatibile con OpenAI https://api.orcarouter.ai/v1, imposta il parametro model su "deepseek/deepseek-v4-flash", e includi la tua chiave API OrcaRouter nell'intestazione Authorization.
Quali politiche di gestione dei dati si applicano a DeepSeek V4 Flash?
I dati passano attraverso OrcaRouter verso i server di DeepSeek in Cina. Rivedere l'informativa sulla privacy di OrcaRouter e i termini di DeepSeek. Non vengono offerte esplicitamente protezioni aggiuntive per i dati.
DeepSeek V4 Flash è multimodale?
No, accetta solo input di testo. Per immagini, audio o video, dovresti preprocessarli in testo o usare un modello diverso.
Quali parametri posso impostare quando utilizzo DeepSeek V4 Flash?
Parametri standard delle completazioni chat OpenAI: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, ecc. Il max_tokens non può superare 384,000.
Quali casi d'uso sono più adatti per DeepSeek V4 Flash?
Analisi di documenti lunghi, generazione di codice con ragionamento esteso, conversazioni multi-turno che richiedono contesto profondo, e compiti che producono output di grandi dimensioni come report dettagliati o piani.

Incorpora questo badge

DeepSeek: DeepSeek V4 Flash$0.15/M in608ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash su OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Scheda del modello come dati

GET /api/public/models/deepseek/deepseek-v4-flashApri
Leggibile dalle macchine:/llms.txt/llms-full.txt