DeepSeek V4 Flash

deepseek/deepseek-v4-flash
AlatJSONPenalaran
oleh DeepSeek · 2026-04-24

DeepSeek V4 Flash MoE yang efisien — 284B total / 13B parameter aktif, konteks 1M, dioptimalkan untuk beban kerja sehari-hari yang cepat.

ctx1M token
Output maks384K
Masukantext
p50 TTFT1.95 s
INPUT$0.22/ 1M token
OUTPUT$0.66/ 1M token
p50 TTFT1.95 s7h
p95 TTFT10.00 s7h
LALU LINTAS11962.8Mtoken / 7h

DeepSeek V4 Flash adalah model bahasa besar dari perusahaan AI Tiongkok, DeepSeek. Model ini hanya memproses input teks dan dirancang untuk skenario yang membutuhkan jendela konteks besar (1,048,576…

Apa itu DeepSeek V4 Flash?

Siapa yang harus menggunakan DeepSeek V4 Flash?

Apa saja modalitas input yang didukung DeepSeek V4 Flash?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Harga

Harga
Input / 1M token · Di luar jam sibuk$0.220
Output / 1M token · Di luar jam sibuk$0.660
Baca cache / 1M · Di luar jam sibuk$0.0070
Jam sibuk01:00–04:00, 06:00–10:00 ×2 (UTC)
Input / 1M token · ×2$0.440
Output / 1M token · ×2$1.32
Baca cache / 1M · ×2$0.014
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $3.52 · Dengan cache prompt $2.77

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000334

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
1.95 s
Kecepatan output
170 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
17.5%

Benchmark publik

69.1
AA Coding
Lebih baik dari 79% model yang dibandingkan
#28 dari 138
34.3
AA Intelligence
Lebih baik dari 69% model yang dibandingkan
#44 dari 147
50.0
AA Math
Lebih baik dari 26% model yang dibandingkan
#61 dari 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
79.7
MMLU-Pro
57.0 index
SciCode
50.3
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
terminalbench_v4_0
12.1
τ²-Bench
95.0
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News1 sebutan · 7 hrturun 1 dari minggu lalu

Perbandingan

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 Flash Vision (Exp)
Input $/M$0.22$0.66$0.15$0.22
Output $/M$0.66$1.98$0.60$0.66
Konteks1.0M1.0M1.0M1.0M
Kualitas7/108/108/107/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya DeepSeek V4 Flash di OrcaRouter?
Biaya token input adalah $0.14 per 1 juta token, dan biaya token output adalah $0.28 per 1 juta token. OrcaRouter mengenakan tarif persis sama dengan tarif penyedia tanpa markup.
Berapa jendela konteks dari DeepSeek V4 Flash?
Jendela konteks adalah 1.048.576 token (1 juta token). Output maksimum per permintaan adalah 384.000 token.
Apa saja kekuatan utama dari DeepSeek V4 Flash?
Keunggulannya adalah jendela konteks yang sangat besar dan batas token output yang tinggi, dikombinasikan dengan harga yang rendah serta skor τ²-Bench yang kuat sebesar 95,0, yang menunjukkan kemampuan penalaran dan penggunaan alat yang baik.
Bagaimana perbandingan DeepSeek V4 Flash dengan GPT-4 atau Claude?
DeepSeek V4 Flash menawarkan konteks yang jauh lebih besar (1M vs 128k/200k) dan output (384k vs ~4k) dengan biaya yang lebih rendah. Namun, ini hanya teks dan mungkin memiliki pengetahuan umum atau penyetelan keamanan yang kurang luas.
Apakah OrcaRouter menaikkan harga DeepSeek V4 Flash?
Tidak. OrcaRouter meneruskan tarif penyedia tanpa markup. Anda membayar $0.14 per 1M input dan $0.28 per 1M output persis seperti yang dikenakan oleh DeepSeek.
Bagaimana cara memanggil DeepSeek V4 Flash melalui OrcaRouter API?
Gunakan URL dasar yang kompatibel dengan OpenAI https://api.orcarouter.ai/v1, atur parameter model menjadi "deepseek/deepseek-v4-flash", dan sertakan kunci API OrcaRouter Anda di header Authorization.
Kebijakan penanganan data apa yang berlaku untuk DeepSeek V4 Flash?
Data melewati OrcaRouter ke server DeepSeek di China. Tinjau kebijakan privasi OrcaRouter dan ketentuan DeepSeek. Tidak ada perlindungan data tambahan yang ditawarkan secara eksplisit.
Apakah DeepSeek V4 Flash multimodal?
Tidak, hanya menerima input teks. Untuk gambar, audio, atau video, Anda perlu memprosesnya menjadi teks atau menggunakan model yang berbeda.
Parameter apa yang dapat saya atur saat menggunakan DeepSeek V4 Flash?
Parameter standar chat completions OpenAI: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, dll. max_tokens tidak boleh melebihi 384.000.
Kasus penggunaan mana yang paling cocok untuk DeepSeek V4 Flash?
Analisis dokumen panjang, generasi kode dengan penalaran yang diperluas, percakapan multi-putaran yang membutuhkan konteks mendalam, dan tugas yang menghasilkan keluaran besar seperti laporan atau rencana terperinci.

Sematkan lencana ini

DeepSeek: DeepSeek V4 Flash•$0.22/M in•1946ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash di OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Kartu model sebagai data

GET /api/public/models/deepseek/deepseek-v4-flashBuka