DeepSeek V4 Pro 0813

deepseek/deepseek-v4-pro-0813
旗舰精选
工具JSON推理
来自 DeepSeek · 2026-08-12

DeepSeek V4 Pro 0813 是 DeepSeek 旗舰级 V4 Pro 模型的官方正式版本,取代了四月份的预览版,并在 App、Web 和 API 上同步上线。它提供 100 万 token 的上下文窗口,最高支持 384K 输出 token,支持思考模式与非思考模式,并可选低/高/最大推理强度,同时支持 JSON 输出和工具调用,原生支持 Responses API,并针对 Codex 风格的编码智能体进行了定向适配。 0813 版本在智能体能力上实现了重大飞跃,DeepSeek 报告称其发布的智能体基准测试在生产环境中表现尤为强劲——Terminal Bench 2.1 得分 87.9,Cybergym 得分 83.3,Toolathlon Verified 得分 74.1,DeepSWE 得分 62.7,NL2Repo 得分 61.5,HLE(无工具/有工具)得分分别为 42.7 和 60.0。在 DeepSeek 官方 API 上,此版本即为 deepseek-v4-pro 模型 ID 当前所服务的版本;带日期的标识符则为按日期调用该版本的调用方提供相同版本。它是要求苛刻的编码智能体、终端及工具使用工作负载,以及复杂智能体管线的强力选择。

上下文1M tokens
最大输出384K
输入模态text
输出模态text
p50 首字节2.21 s
输入$0.66/ 百万 tokens
输出$1.98/ 百万 tokens
p50 首字节2.21 s7 天
p95 首字节6.52 s7 天
流量263698.8Mtokens / 7 天

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro-0813",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

价格

价格
输入 / 1M tokens · 非高峰$0.660
输出 / 1M tokens · 非高峰$1.98
缓存读取 / 1M · 非高峰$0.022
高峰时段01:00–04:00, 06:00–10:00 ×2 (UTC)
输入 / 1M tokens · ×2$1.32
输出 / 1M tokens · ×2$3.96
缓存读取 / 1M · ×2$0.044
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $10.56 · 启用提示缓存后 $8.33

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.000994

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
2.21 s
输出速度
78.4 tok/s
p95 首字节
6.52 s
错误率
0.05%

公共基准测试

68.8
AA Coding
优于所参与对比模型中的 75%
第 30 / 共 138
36.0
AA Intelligence
优于所参与对比模型中的 72%
第 39 / 共 145
Agent Last Exam
25.7
Automation Bench (Public)
31.8
Cybergym
83.3
DeepSWE
62.7
GPQA Diamond
92.8
HLE (no tools)
42.7
HLE (with tools)
60.0
Humanity's Last Exam
41.0
Long-Context Recall
80.3
NL2Repo
61.5
SciCode
51.0
tau_banking
39.6
Terminal Bench 2.1
87.9
terminalbench_v2_1
78.7
Toolathlon Verified
74.1
来源: artificialanalysis.ai, api-docs.deepseek.com

社区热度

本周开发者的讨论

Hacker News0 次提及 · 近 7 天

对比一览

DeepSeek V4 Pro 0813DeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 Flash
输入 $/百万$0.66$0.66$0.15$0.22
输出 $/百万$1.98$1.98$0.60$0.66
上下文1.0M1.0M1.0M1.0M
质量7/108/108/107/10
并排对比并排对比并排对比并排对比

更多 DeepSeek 模型

常见问题

在 OrcaRouter 上,DeepSeek: DeepSeek V4 Pro 0813 的价格是多少?
DeepSeek: DeepSeek V4 Pro 0813 通过 OrcaRouter 的定价为每百万输入 token $0.66,每百万输出 token $1.98。定价从路由层实时获取。
DeepSeek: DeepSeek V4 Pro 0813的上下文窗口是多少?
DeepSeek: DeepSeek V4 Pro 0813 支持 1M 个 token 的上下文窗口。可使用长上下文功能(RAG、摘要)直至该限制。
如何通过 OpenAI SDK 调用 DeepSeek: DeepSeek V4 Pro 0813?
将 OpenAI base_url 设置为 https://api.orcarouter.ai/v1,提供您的 OrcaRouter API 密钥,并在 chat.completions.create 调用中传递 model="deepseek/deepseek-v4-pro-0813"。
OrcaRouter 是否对 DeepSeek: DeepSeek V4 Pro 0813 进行速率限制?
每个模型的速率限制遵循您的 OrcaRouter 计划。免费套餐设有保守的上限;付费套餐则会提升这些上限。请查看 /pricing 了解当前配额。

嵌入此徽章

DeepSeek: DeepSeek V4 Pro 0813•$0.66/M in•2213ms p50•通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg" alt="DeepSeek: DeepSeek V4 Pro 0813 在 OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Pro 0813](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813)

以数据形式获取模型卡

GET /api/public/models/deepseek/deepseek-v4-pro-0813打开