DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
신규추천
도구JSON추론
제공 DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731은 DeepSeek의 효율적인 V4 Flash mixture-of-experts 모델의 재포스트트레이닝 공식 릴리스입니다 — 총 284B / 활성 파라미터 13B, 4월 V4 Flash 릴리스와 아키텍처 및 크기가 동일하며, 포스트트레이닝이 처음부터 다시 수행되었습니다. 1M 토큰 컨텍스트 창과 최대 384K 출력 토큰을 제공하며, thinking 및 non-thinking 모드(기본적으로 thinking 활성화)와 JSON 출력 및 도구 호출을 지원하고, Responses API를 기본 지원하며 Codex 스타일 코딩 에이전트에 맞춘 타겟 적응을 제공합니다. 0731 리비전은 에이전트 역량에서 큰 도약으로, DeepSeek가 발표한 에이전트 벤치마크에서 DeepSeek V4 Pro Preview조차 능가합니다 — Terminal Bench 2.1에서 82.7, Cybergym에서 76.7, Toolathlon Verified에서 70.3, DeepSWE에서 54.4, NL2Repo에서 54.2입니다. DeepSeek 자사 API에서 이 리비전은 현재 deepseek-v4-flash 모델 ID가 서비스하는 버전이며, 날짜 기반 식별자는 날짜로 참조하는 호출자에게 동일한 리비전을 제공합니다. 코딩 에이전트, 터미널 및 도구 사용 워크로드, 그리고 flash 등급 비용의 대규모 에이전틱 파이프라인에 강력한 선택입니다.

컨텍스트1M 토큰
최대 출력384K
입력text
출력text
p50 TTFT791 ms
입력$0.15/ 100만 토큰
출력$0.29/ 100만 토큰
p50 TTFT791 ms7일
p95 TTFT1.42 s7일
트래픽4.3M토큰 / 7일

DeepSeek V4 Flash 0731은 deepseek 프로바이더의 텍스트 전용 언어 모델로, OrcaRouter를 통해 모델 ID deepseek/deepseek-v4-flash-0731로 제공됩니다. 주요 사양은 1,048,576토큰 컨텍스트 창, 384,000토큰 최대 출력, 그리고 Terminal Bench 2.1에서 82.7점입니다. 가격은…

DeepSeek V4 Flash 0731은 무엇인가요?

이 모델은 누구를 위한 것인가요?

OrcaRouter에서 이 모델은 DeepSeek 제품군 중 어디에 해당하나요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

가격

입력 / 1M tokens$0.147
출력 / 1M tokens$0.295
캐시 읽기 / 1M$0.020
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $1.91 · 프롬프트 캐싱 사용 시 $1.47

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000149

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
791 ms
출력 속도
101 tok/s
p95 TTFT
1.42 s
오류율
0%

공개 벤치마크

69.1
AA Coding
비교된 모델 중 85%보다 우수
124개 중 18위
49.9
AA Intelligence
비교된 모델 중 80%보다 우수
126개 중 24위
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
소스: artificialanalysis.ai, api-docs.deepseek.com

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News7 회 언급 · 7일지난주 대비 7 증가

비교

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
입력 $/100만$0.15$0.44$0.15$0.15
출력 $/100만$0.29$0.88$0.29$0.29
컨텍스트1.0M1.0M1.0M1.0M
품질6/108/107/105/10
나란히 비교나란히 비교나란히 비교나란히 비교

DeepSeek의 다른 모델

FAQ

DeepSeek V4 Flash 0731은 얼마인가요?
입력 토큰 1,000,000개당 $0.15, 출력 토큰 1,000,000개당 $0.29의 비용이 듭니다. OrcaRouter는 마크업 없는 제공업체 요율로 청구하므로, 이는 사용자가 지불하는 요율입니다. 모델 카드에는 캐시된 입력 가격이나 배치 할인에 대한 설명이 없습니다.
어떤 컨텍스트 창과 출력 제한을 지원하나요?
1,048,576개의 입력 컨텍스트 토큰과 최대 384,000개의 출력 토큰을 지원합니다. 입력 모달리티는 텍스트 전용입니다. 모델 카드는 이 두 상한선 외에 별도의 결합 토큰 제한을 명시하지 않습니다.
모델이 가장 잘하는 것은 무엇인가요?
포함된 사실에 기반하여, 이 제품의 강점은 터미널 및 명령줄 작업 완료이며, Terminal Bench 2.1에서 82.7점을 기록했습니다. 또한 대규모 컨텍스트와 출력 한도 덕분에 긴 문서 텍스트 처리와 장문 생성도 지원합니다. 다른 벤치마크 점수는 제공되지 않았습니다.
다른 모델들과 비교하면 어떻습니까?
제공된 정보는 이 모델에만 해당됩니다. OrcaRouter 카탈로그의 후보들을 컨텍스트 창, 최대 출력 길이, 모달리티, 100만 토큰당 가격으로 비교하세요. 이 모델은 텍스트 전용이며, 100만 토큰 컨텍스트, 384K 출력을 지원하고, 100만 토큰당 $0.15/$0.29의 비용이 듭니다.
OrcaRouter를 통해 이 모델을 사용할 때 데이터는 어떻게 처리되나요?
제공된 정보에는 이 모델의 데이터 보존, 학습 사용 또는 저장에 대한 설명이 포함되어 있지 않습니다. 데이터 처리는 OrcaRouter의 약관과 제공업체 deepseek의 정책에 따라 관리됩니다. 민감한 데이터를 전송하기 전에 OrcaRouter의 문서를 검토하십시오.
이 모델을 어떻게 호출하나요?
OrcaRouter의 OpenAI 호환 API를 기본 URL https://api.orcarouter.ai/v1에서 모델 ID deepseek/deepseek-v4-flash-0731과 함께 사용하세요. OrcaRouter API 키와 텍스트 전용 메시지로 표준 채팅 완료 요청을 보내세요.
스트리밍이나 함수 호출을 지원하나요?
현재 제공된 정보에는 streaming 또는 function calling 지원 여부가 명시되어 있지 않습니다. API는 OpenAI와 호환되므로 이러한 기능을 신뢰하기 전에 먼저 테스트하십시오. max_tokens를 384,000 출력 상한 이내로 설정하십시오.
이것은 멀티모달 모델인가요?
아니요. 입력 형식은 텍스트뿐입니다. 이미지, 오디오, 또는 비디오의 경우, OrcaRouter의 카탈로그에 있는 멀티모달 모델이나 별도의 전처리 단계가 필요합니다.

이 배지 임베드

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="OrcaRouter 의 DeepSeek: DeepSeek V4 Flash 0731" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

모델 카드를 데이터로

GET /api/public/models/deepseek/deepseek-v4-flash-0731열기
기계 판독 가능:/llms.txt/llms-full.txt