DeepSeek V4.1 Flash

deepseek/deepseek-v4.1-flash
精選
視覺工具JSON推理
來自 DeepSeek · 2026-09-10

DeepSeek-V4.1-Flash 是 DeepSeek 新架構系列中最小的模型,於 2026 年 9 月 10 日發布,具備原生多模態視覺理解——是 V4 Flash 和 V4 Flash Vision 實驗兩者的生產後繼者。新架構 旨在達成更高的能力上限、更快的推理速度和更高的吞吐量,DeepSeek 報告稱 V4.1 Flash 在效能、成本、速度和總任務時間上全面超越 V4 Pro。它接受文字和圖像輸入並產生文字輸出,提供 1M token 的上下文視窗,最高 可達 384K 輸出 token,並支援思考(預設,可選擇努力程度:低 / 高 / 最高)和非思考模式,適用於 Chat Completions、Responses 和 Anthropic 相容的 API,以及 JSON 輸出、工具呼叫和聊天前綴補全;FIM 僅在非思考 模式下運作。模型權重在 Hugging Face 上開放(deepseek-ai/DeepSeek-V4.1-Flash)。 發布時的官方基準:Terminal-Bench 2.1 上 90.6,DeepSWE v1.1 上 74.2,NL2Repo-Bench 上 65.4,GPQA Diamond 上 90.9,使用工具的 HLE 上 63.9,以及強勁的原生視覺智能體結果(BabyVision 89.6,使用工具的 Chartography 78.9)。定價也隨發布下調: 離峰時段輸入 $0.15/M(快取未命中)、輸出 $0.60/M、快取命中 $0.003/M,平日尖峰時段(01:00-04:00 和 06:00-10:00 UTC)價格翻倍;其他所有時段(包括週末)皆為離峰。

上下文1M tokens
最大輸出384K
輸入模態text + image
輸出模態text
p50 首字節412 ms
輸入$0.15/ 百萬 tokens
輸出$0.60/ 百萬 tokens
p50 首字節412 ms7 天
p95 首字節1.60 s7 天
流量299.5Mtokens / 7 天

DeepSeek V4.1 Flash 是一款可透過 OrcaRouter(相容於 OpenAI 的 API 閘道)使用的 DeepSeek 模型。它接受文字與圖片輸入,具備 1,048,576 個 token 的上下文視窗,單次回應最多可生成 384,000 個 token。OrcaRouter 依供應商費率計價,每 100 萬個輸入 token 收費 $0.15,每 100 萬個輸出…

什麼是 DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash 是為誰打造的?

為什麼 1,048,576-token 的上下文視窗很重要?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

價格

價格
輸入 / 1M tokens · 離峰$0.150
輸出 / 1M tokens · 離峰$0.600
快取讀取 / 1M · 離峰$0.0030
尖峰時段01:00–04:00, 06:00–10:00 ×2 (UTC)
輸入 / 1M tokens · ×2$0.300
輸出 / 1M tokens · ×2$1.20
快取讀取 / 1M · ×2$0.0060
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $2.85 · 啟用提示快取後 $2.34

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.000301

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
412 ms
輸出速度
215 tok/s
p95 首字節
1.60 s
錯誤率
0.07%

公開基準測試

Agents' Last Exam
31.8
Automation-Bench
54.8
BabyVision (with tools)
89.6
Chartography (with tools)
78.9
CyberGym
88.1
DeepSWE v1.1
74.2
ExploitGym
15.3
GPQA Diamond
90.9
HLE
36.8
HLE (with tools)
63.9
MathArena Apex
65.6
NL2Repo-Bench
65.4
ProgramBench
20.3
SEC-Bench Pro
62.8
Terminal-Bench 2.1
90.6
Terminal-Bench 3.0
30.0
Terminal-Bench 4.0
31.2
ZeroBench-main (with tools)
49.0
來源: api-docs.deepseek.com

社群熱度

本週開發者的討論

Hacker News13 次提及 · 近 7 天較上週增加 13

比較一覽

DeepSeek V4.1 FlashDeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)
輸入 $/百萬$0.15$0.73$0.24$0.24
輸出 $/百萬$0.60$2.18$0.73$0.73
上下文1.0M1.0M1.0M1.0M
品質8/108/107/107/10
並排比較並排比較並排比較並排比較

更多 DeepSeek 模型

常見問題

DeepSeek V4.1 Flash 在 OrcaRouter 上的費用是多少?
OrcaRouter 對 DeepSeek V4.1 Flash 的計費為每 100 萬個輸入 token 0.15 美元,以及每 100 萬個輸出 token 0.60 美元,並以供應商費率原樣傳遞,零加成。並未描述針對上下文視窗本身另有單獨收費:1,048,576 個 token 是限制,不是費用。輸入 token 包含您傳送的文字、圖像和對話歷史;輸出 token 涵蓋所有生成的內容,最多 384,000 個 token。
上下文視窗和最大輸出有多大?
DeepSeek V4.1 Flash 的上下文視窗為 1,048,576 個 token,最大輸出為 384,000 個 token。輸入視窗讓你能在一次呼叫中提交整份文件、逐字稿或儲存庫快照,而輸出上限則支援可單次產出的長篇成品,例如規格書、遷移計畫或延伸 diff。
DeepSeek V4.1 Flash 最擅長什麼?
它專為長輸入、長輸出的工作而打造:整份文件分析、大型程式碼庫的程式碼理解、文字加圖像的多模態檢視,以及需要大量生成內容而非簡短回覆的工作流程。它在 GPQA Diamond 上拿下 90.9 分,也顯示其具備紮實的研究所程度科學與技術推理能力。輸入支援文字與圖像;輸出僅限文字。
它與規模更大的前沿模型相比如何?
前沿模型或許能在最困難的推理基準測試上領先,且通常每 token 收費較高,而 DeepSeek V4.1 Flash 提供 1,048,576 token 的上下文視窗與 384,000 token 的輸出上限,每 100 萬輸入 token 收費 $0.15、每 100 萬輸出 token 收費 $0.60。對於長上下文與高流量的工作而言,它往往是實務上的選擇;至於最困難的個別推理步驟,將那些呼叫導向 OrcaRouter 上成本較高的模型,是合理的做法。
當我呼叫此模型時,資料是如何處理的?
OrcaRouter 會將請求路由至 DeepSeek 的 API,並以供應商費率計費,零加成。資料保留、訓練用途及相關條款係由供應商的政策所規範,而非本文所述之另行安排,因此,在傳送敏感資料前,請確認供應商現行條款。請遮蔽你不需要的識別碼,並將提示詞保持在任務所需的最低限度;較小的上下文也能降低輸入成本,價格為每 100 萬個 token $0.15。
我要如何透過與 OpenAI 相容的 API 呼叫它?
將你的用戶端基礎 URL 設為 https://api.orcarouter.ai/v1,並使用模型 ID deepseek/deepseek-v4.1-flash 搭配你的 OrcaRouter API 金鑰。請求和回應遵循 OpenAI 聊天完成結構描述,因此現有的 SDK、串流處理常式與工具呼叫解析都能維持不變地運作。遷移通常只需要變更基礎 URL 與模型字串,並重新執行你的評估集。
DeepSeek V4.1 Flash 可以接受圖片嗎?
是的。圖片輸入可透過標準多模態內容陣列支援,文字與圖片部分可放在同一則使用者訊息中。圖片 token 計為輸入,並在 OrcaRouter 上以每 1M 個輸入 token $0.15 計費。輸出仍僅限文字,因此模型會描述或擷取圖片內容,而非生成圖片。
GPQA Diamond 上 90.9 的分數,足以讓我在自己的任務中信任它嗎?
這是一個有用的訊號,不是保證。GPQA Diamond 在固定提示格式下衡量研究所程度的科學推理,這對技術問答有相關性,但幾乎無法說明長上下文回憶、語氣,或對你的資料的擷取準確度。用真實輸入建立一個小型評估集,讓它跑在 DeepSeek V4.1 Flash 以及 OrcaRouter 上任何替代模型 ID 上,並在將正式流量路由之前比較成本與品質。

嵌入此徽章

DeepSeek: DeepSeek V4.1 Flash$0.15/M in412ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg" alt="DeepSeek: DeepSeek V4.1 Flash 於 OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4.1 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash)

以資料形式取得模型卡

GET /api/public/models/deepseek/deepseek-v4.1-flash開啟