DeepSeek V4 Pro 0813

deepseek/deepseek-v4-pro-0813
신규플래그십추천
도구JSON추론
제공 DeepSeek · 2026-08-12

DeepSeek V4 Pro 0813은 DeepSeek의 플래그십 V4 Pro 모델의 공식 릴리스로, 4월 프리뷰를 대체하며 앱, 웹, API 전반에 동시에 출시되었습니다. 1M 토큰 컨텍스트 창과 최대 384K 출력 토큰을 제공하며, 추론 모드와 비추론 모드를 지원하고 낮음/높음/최대 추론 노력을 선택할 수 있습니다. 또한 JSON 출력과 도구 호출을 지원하며, Responses API를 기본적으로 지원하고 Codex 스타일 코딩 에이전트에 맞춰 특별히 적응되었습니다. 0813 개정판은 에이전트 기능의 큰 도약으로, DeepSeek는 공개된 에이전트 벤치마크에서 특히 프로덕션 환경에서의 강력한 향상을 보고했습니다. Terminal Bench 2.1에서 87.9, Cybergym에서 83.3, Toolathlon Verified에서 74.1, DeepSWE에서 62.7, NL2Repo에서 61.5, 그리고 도구 없이 42.7 / 도구 사용 시 60.0을 HLE에서 기록했습니다. DeepSeek 공식 API에서 이 개정판은 이제 deepseek-v4-pro 모델 ID가 제공하는 버전입니다. 날짜 기반 식별자는 날짜로 참조하는 호출자에게 동일한 개정판을 나열합니다. 까다로운 코딩 에이전트, 터미널 및 도구 사용 워크로드, 그리고 복잡한 에이전트 파이프라인에 강력한 선택입니다.

컨텍스트1M 토큰
최대 출력384K
입력text
출력text
p50 TTFT958 ms
입력$0.44/ 100만 토큰
출력$0.88/ 100만 토큰
p50 TTFT958 ms7일
p95 TTFT1.89 s7일
트래픽87.9M토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro-0813",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

가격

입력 / 1M tokens$0.442
출력 / 1M tokens$0.884
캐시 읽기 / 1M$0.060
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $5.75 · 프롬프트 캐싱 사용 시 $4.41

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000446

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
958 ms
출력 속도
65.0 tok/s
p95 TTFT
1.89 s
오류율
0%

공개 벤치마크

Agent Last Exam
25.7
Automation Bench (Public)
31.8
Cybergym
83.3
DeepSWE
62.7
HLE (no tools)
42.7
HLE (with tools)
60.0
NL2Repo
61.5
Terminal Bench 2.1
87.9
Toolathlon Verified
74.1
소스: api-docs.deepseek.com

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News9 회 언급 · 7일지난주 대비 9 증가

비교

DeepSeek V4 Pro 0813DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash 0731
입력 $/100만$0.44$0.44$0.15$0.15
출력 $/100만$0.88$0.88$0.29$0.29
컨텍스트1.0M1.0M1.0M1.0M
품질7/108/107/106/10
나란히 비교나란히 비교나란히 비교나란히 비교

DeepSeek의 다른 모델

FAQ

OrcaRouter에서 DeepSeek: DeepSeek V4 Pro 0813 비용은 얼마인가요?
DeepSeek: DeepSeek V4 Pro 0813는 OrcaRouter를 통해 1M 입력 토큰당 $0.44, 1M 출력 토큰당 $0.88에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
DeepSeek: DeepSeek V4 Pro 0813의 컨텍스트 윈도우는 얼마인가요?
DeepSeek: DeepSeek V4 Pro 0813는 1M 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 DeepSeek: DeepSeek V4 Pro 0813를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="deepseek/deepseek-v4-pro-0813"를 전달하세요.
OrcaRouter가 DeepSeek: DeepSeek V4 Pro 0813를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

DeepSeek: DeepSeek V4 Pro 0813$0.44/M in958ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg" alt="OrcaRouter 의 DeepSeek: DeepSeek V4 Pro 0813" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Pro 0813](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813)

모델 카드를 데이터로

GET /api/public/models/deepseek/deepseek-v4-pro-0813열기
기계 판독 가능:/llms.txt/llms-full.txt