DeepSeek V4 Flash

deepseek/deepseek-v4-flash
Công cụJSONSuy luận
bởi DeepSeek · 2026-04-24

DeepSeek V4 Flash MoE hiệu quả — 284B tổng / 13B params hoạt động, ngữ cảnh 1M, được tối ưu hóa cho khối lượng công việc hàng ngày nhanh chóng.

ngữ cảnh1M token
Đầu ra tối đa384K
Đầu vàotext
TTFT p50608 ms
ĐẦU VÀO$0.15/ 1M token
ĐẦU RA$0.29/ 1M token
TTFT p50608 ms7 ngày
p95 TTFT1.88 s7 ngày
LƯU LƯỢNG31437.8Mtokens / 7 ngày

DeepSeek V4 Flash là một mô hình ngôn ngữ lớn từ công ty AI Trung Quốc DeepSeek. Nó chỉ xử lý đầu vào văn bản và được thiết kế cho các tình huống yêu cầu cửa sổ ngữ cảnh lớn (1,048,576 token) và đầu…

DeepSeek V4 Flash là gì?

Ai nên sử dụng DeepSeek V4 Flash?

DeepSeek V4 Flash hỗ trợ những phương thức nhập liệu nào?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Giá

Đầu vào / 1M tokens · Ngoài giờ cao điểm$0.147
Đầu ra / 1M tokens · Ngoài giờ cao điểm$0.295
Đọc cache / 1M · Ngoài giờ cao điểm$0.020
Giờ cao điểm01:00–04:00, 06:00–10:00 ×2 (UTC)
Đầu vào / 1M tokens · ×2$0.294
Đầu ra / 1M tokens · ×2$0.590
Đọc cache / 1M · ×2$0.040
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $1.91 · Có cache prompt $1.47

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000150

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
608 ms
Tốc độ đầu ra
117 tok/s
p95 TTFT
1.88 s
Tỷ lệ lỗi
5.3%

Benchmark công khai

69.1
AA Coding
Tốt hơn 82% số mô hình được so sánh
#23 / 133
51.8
AA Intelligence
Tốt hơn 76% số mô hình được so sánh
#32 / 135
50.0
AA Math
Tốt hơn 26% số mô hình được so sánh
#61 / 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
74.3
MMLU-Pro
57.0 index
SciCode
49.9
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
τ²-Bench
95.0
Nguồn: artificialanalysis.ai

Thảo luận cộng đồng

Điều các nhà phát triển đang nói tuần này

Hacker News8 lượt nhắc · 7 ngàygiảm 8 so với tuần trước

So sánh

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Flash Vision (Exp)DeepSeek V4 Pro 0813
Đầu vào $/M$0.15$0.44$0.15$0.44
Đầu ra $/M$0.29$0.88$0.29$0.88
Ngữ cảnh1.0M1.0M1.0M1.0M
Chất lượng7/108/107/107/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

DeepSeek V4 Flash trên OrcaRouter có giá bao nhiêu?
Chi phí token đầu vào là $0.14 cho mỗi 1 triệu token, và token đầu ra có giá $0.28 cho mỗi 1 triệu token. OrcaRouter tính phí đúng bằng tỷ lệ nhà cung cấp, không có phí chênh lệch.
Cửa sổ ngữ cảnh của DeepSeek V4 Flash là gì?
Cửa sổ ngữ cảnh là 1,048,576 token (1 triệu token). Đầu ra tối đa cho mỗi yêu cầu là 384,000 token.
Các điểm mạnh chính của DeepSeek V4 Flash là gì?
Điểm mạnh của nó là cửa sổ ngữ cảnh rất lớn và giới hạn token đầu ra cao, kết hợp với mức giá thấp và điểm số τ²-Bench mạnh mẽ là 95.0, cho thấy khả năng suy luận và sử dụng công cụ tốt.
DeepSeek V4 Flash so sánh thế nào với GPT-4 hoặc Claude?
DeepSeek V4 Flash cung cấp ngữ cảnh lớn hơn nhiều (1M so với 128k/200k) và đầu ra (384k so với ~4k) với chi phí chỉ bằng một phần nhỏ. Tuy nhiên, nó chỉ hỗ trợ văn bản và có thể có kiến thức tổng quát kém rộng hơn hoặc tinh chỉnh an toàn kém hơn.
OrcaRouter có tăng giá của DeepSeek V4 Flash không?
Không. OrcaRouter truyền qua tỷ giá của nhà cung cấp mà không có phụ phí. Bạn trả $0.14 cho mỗi 1M đầu vào và $0.28 cho mỗi 1M đầu ra chính xác theo mức phí của DeepSeek.
Làm cách nào để gọi DeepSeek V4 Flash thông qua OrcaRouter API?
Sử dụng URL cơ sở tương thích OpenAI https://api.orcarouter.ai/v1, đặt tham số model thành "deepseek/deepseek-v4-flash", và bao gồm khóa API OrcaRouter của bạn trong tiêu đề Authorization.
Các chính sách xử lý dữ liệu nào áp dụng cho DeepSeek V4 Flash?
Dữ liệu đi qua OrcaRouter đến máy chủ của DeepSeek tại Trung Quốc. Hãy xem xét chính sách bảo mật của OrcaRouter và các điều khoản của DeepSeek. Không có biện pháp bảo vệ dữ liệu bổ sung nào được cung cấp một cách rõ ràng.
DeepSeek V4 Flash có đa phương thức không?
Không, nó chỉ chấp nhận đầu vào dạng văn bản. Đối với hình ảnh, âm thanh hoặc video, bạn sẽ cần tiền xử lý chúng thành văn bản hoặc sử dụng một mô hình khác.
Khi sử dụng DeepSeek V4 Flash, tôi có thể thiết lập những tham số nào?
Các tham số hoàn tất trò chuyện tiêu chuẩn của OpenAI: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, v.v. Giá trị max_tokens không được vượt quá 384.000.
Các trường hợp sử dụng nào phù hợp nhất với DeepSeek V4 Flash?
Phân tích tài liệu dài, tạo mã với suy luận mở rộng, các cuộc trò chuyện nhiều lượt cần ngữ cảnh sâu, và các nhiệm vụ tạo ra đầu ra lớn như báo cáo hoặc kế hoạch chi tiết.

Nhúng huy hiệu này

DeepSeek: DeepSeek V4 Flash$0.15/M in608ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash trên OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/deepseek/deepseek-v4-flashMở
Máy đọc được:/llms.txt/llms-full.txt