
DeepSeek V4 Pro API 가격: 오프피크 $0.73/$2.18, 그리고 9월 14일 셧다운이 취소된 이유
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 223 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
DeepSeek V4 Pro는 서비스 종료되지 않습니다.2026년 9월 11일, DeepSeek은 9월 14일 이후에도 API를 통해 이 모델을 계속 제공하며 과금 방식도 그대로 유지하겠다고 밝혔습니다. 이는 이틀 전 발표된 계획을 뒤집은 것입니다. 그 계획에 따르면 모든 deepseek-v4-pro 요청이 DeepSeek V4.1 Flash로 재라우팅되어 Flash 요금으로 청구될 예정이었습니다. 프롬프트, temperature 설정, 툴 호출 스키마를 V4 Pro에 맞춰 조정해 둔 사람이라면, 이번 주에 중요한 사실은 바로 이것입니다. 즉, 여러분이 기반으로 삼아 구축한 모델은 그대로 남아 있고, 월요일에 예정해 두었을 수도 있는 마이그레이션은 진행할 필요가 없습니다.
가격은 별개의 문제이고, 이 페이지는 한 달 동안 가격을 잘못 적어 두었습니다. DeepSeek V4 Pro는 더 이상 100만 토큰당 $0.44/$0.88이 아닙니다. 오프피크에는 OrcaRouter에서 100만 토큰당 입력 $0.726, 출력 $2.178로 청구되며, 피크 시간대에는 $1.452/$4.356로 두 배가 되고, 캐시 읽기는 $0.024입니다. 주말은 이제 전부 오프피크입니다. 그리고 공급업체 자체의 요금표 — DeepSeek의 API 문서에 있는 바로 그 요금표 — 는 동일한 가격표에 대한 각주로 계속 안내문을 싣고 있는데, 이는 가격 페이지가 1차 출처에 거의 맞먹을 만큼 가깝습니다.
DeepSeek가 실제로 말한 것, 그리고 그것이 되돌리는 것
타임라인이 중요한 이유는, 세 가지 발표 중 두 가지가 서로를 뒤집은 것이었고 사람들이 기억하는 건 가운데 것이기 때문이다.
• 9월 9일 — DeepSeek은 V4.1 Pro가 출시될 때까지 V4 Pro로의 요청이 DeepSeek V4.1 Flash로 라우팅되며 V4.1 Flash 요금으로 청구될 것이라고 사용자들에게 알렸다.
• 9월 10일 — V4.1 Flash가 출시되었고, DeepSeek는 전환 시점을 2026년 9월 14일 베이징 시간 12:00으로 고정했습니다. 이후 V4 Pro는 오프라인이 되고 그 트래픽은 Flash가 처리하게 됩니다.
• 9월 11일 — DeepSeek이 번복했다. 그 문구는 이제 자사 API 문서의 Models & Pricing 페이지에 각주로 그대로 실려 있다: "사용자 요구에 부응하여, 당사는 2026년 9월 14일 이후에도 DeepSeek V4 Pro에 대한 API 서비스를 계속 제공하기로 결정했습니다. 청구 방식은 변경되지 않습니다. 변경 사항이 있을 경우 추가로 공지하겠습니다."
그것은 벤더가 자사 제품에 대해 말하는 것이며, 여기에서 얻을 수 있는 가장 강력한 출처입니다 — 하지만 그것이 무엇을 확정하고 무엇을 확정하지 않는지는 읽어 보십시오. 그것은 연속성과 청구를 확정합니다. V4 Pro는 유지되며, 이미 시행 중인 요율이 적용됩니다. 다만 시점은 약속하지 않습니다. 추가 공지하겠습니다라는 말이 약속의 전부이며, 같은 문장은 해당 플랜이 다시 돌아올 여지를 남겨 둡니다. 여러 분기에 걸친 약속을 하고 있다면, 유지할 수 있는 모델보다는 벗어날 수 있는 모델을 염두에 두고 계획하십시오.
이번 철회를 강제한 역풍은 이해할 가치가 있다. 그것은 당신이 곧 내리게 될지도 모르는 결정과 맞닿아 있기 때문이다. 개발자들이 반대한 것은 V4.1 Flash가 아니었다. DeepSeek은 V4.1 Flash가 성능, 가격, 속도, 총 작업 시간에서 V4 Pro를 능가한다고 말한다. 그들이 문제 삼은 것은 자동 교체였다. 안정적인 모델 ID 뒤의 모델을 바꾸는 것은 코드를 바꾸지 않고도 동작을 바꾼다. 튜닝된 프롬프트, 작동하던 temperature, 파싱되는 도구 호출 스키마는 모두 특정 체크포인트의 속성이기 때문이다. CLS(科创板日报), 36Kr, IT之家, ifeng, 그리고 영어로는 TheBlockBeats의 보도는 DeepSeek이 처음에는 계획을 미뤘다가 이후 폐기하는 과정을 묘사한다. DeepSeek 자체 문서는 그 대비를 깔끔하게 보여주는데, 레거시 deepseek-v4-flash 이름들은 폐기되었고 이제 V4.1 Flash를 제공하며, 그 전환은 정착했다. Pro 전환은 그렇지 않았다.
공급업체 자체 요율표와 대조하여 확인한 오늘의 가격

두 개의 숫자가 중요하며, 이는 두 통화로 표시된 동일한 정가입니다.
• 오프피크(아래 피크 시간대를 제외한 모든 시간) — 캐시 미스 시 입력은 100만 개당 $0.726 또는 ¥4.5, 출력은 $2.178 또는 ¥13.5, 캐시 적중 입력은 $0.024 또는 ¥0.15.
• 피크 — 정확히 두 배. 입력 $1.452 / ¥9, 출력 $4.356 / ¥27, 캐시 적중 입력 $0.048 / ¥0.30.
• DeepSeek 자체의 달러 환산 — 공급업체 문서에는 동일한 위안 목록이 비수기 $0.66 입력 / $1.98 출력, 피크 시 $1.32 / $3.96으로 표시되어 있으며, 캐시 적중 시에는 $0.022 및 $0.044입니다. OrcaRouter의 달러 수치와의 차이는 추가 토큰 수수료가 아니라 양측이 환산에 적용하는 환율입니다. OrcaRouter는 공급업체 요율을 마크업 없이 그대로 전달하므로, 목록에 표시된 숫자가 곧 지불하는 숫자입니다.
• V4 Pro에는 무료 등급이 없습니다. 디렉터리에는 무료 Flash 등급이 있지만, 플래그십은 유료 전용입니다.
• 참고로 사양표를 보면 — V4 Pro는 MIT 라이선스의 오픈 웨이트 모델로, 총 1.6T 파라미터에 토큰당 49B가 활성화되며, 1M 토큰 컨텍스트 창과 최대 384K 출력 토큰, 동시성 제한 500을 갖추고 있습니다. Artificial Analysis는 초당 출력 토큰 72.3개로 기재하고 있습니다.
이 모든 것의 기반이 되는 모델 버전은 DeepSeek-V4-Pro-0813으로, 8월 13일 정식 출시 이후 변함이 없다 — 바로 그것이 핵심이다. 9월 11일에 체크포인트 자체는 아무것도 달라지지 않았다. 달라진 것은 오직 그 미래에 관한 결정뿐이었다.
피크, 오프피크, 그리고 계산을 바꾸는 주말 규칙
이 페이지의 이전 버전에서 8월 17일 도입된다고 설명했던 피크/비피크 제도는 이제 도입된 지 한 달이 되었으며, 그 이후 한 차례 개정되었다.
• 피크 시간대 — UTC 기준 01:00–04:00 및 06:00–10:00, 월요일부터 금요일까지. 베이징 시간으로는 09:00–12:00 및 14:00–18:00이며, DeepSeek 자체의 근무 시간입니다. 비피크 요금은 피크 요금의 정확히 절반이며, 피크 요금에 추가로 적용되는 할인 구간이 아닙니다.
• 주말은 전적으로 비피크 시간대입니다. 2026년 8월 23일 베이징 시간 00:00부터 DeepSeek는 토요일과 일요일에 피크 요금 적용을 중단했습니다. 배치 작업을 옮길 수 있다면 주말로 옮기는 것만으로 비용이 절반으로 줄어듭니다 — 그리고 아메리카 지역 사용자에게 서비스를 제공하는 팀이라면, 근무 주간의 대부분이 별도의 일정 조정 없이도 이미 비피크 시간대에 들어갑니다.
• 이번 변경으로 비용이 어떻게 달라졌는지 — 해당 모델이 8월 13일에 출시했을 당시의 ¥3/¥6과 비교하면: 오늘의 오프피크 출력은 출시 요금의 2.25배, 피크 출력은 4.5배이며, 피크 캐시 적중 입력은 기존 ¥0.025의 12배다.
여기에는 셧다운이 취소된 뒤에도 마이그레이션 문제가 계속 제기되는 이유를 설명해 주는 비대칭성이 있다. V4 Pro의 가격은 8월에 올랐고, 그 후속 제품의 가격은 내렸다: DeepSeek은 9월 10일부로 Flash-series API 가격을 최대 60% 인하했다. 이전해야 한다는 압박은 사실 9월 14일 공지 때문이 아니었다; 그 공지는 단지 이를 긴급하게 만들었을 뿐이다.
요청의 실제 비용
오늘의 오프피크 요금 기준 세 가지 실제 예시. 각각은 피크 시간대 안에서 두 배가 됩니다.
• 입력 100K + 출력 50K — $0.0726 + $0.1089 ≈ $0.18.
• 1M 입력 + 1M 출력 — $0.726 + $2.178 = $2.90. 같은 호출은 피크 시 $5.81이고, 8월 중순에는 $1.32였습니다.
• 에이전틱 세션, 500K 입력 + 200K 출력 — $0.363 + $0.4356 ≈ $0.80.
월간 보기는 모델 페이지에 있으며, 예전 헤드라인이 여전히 청구서를 설명하는지 판가름하는 정직한 시험대입니다. 한 달에 1,000만 토큰을 쓰고 입력 비중이 70%라면, 비용 계산기는 $11.62를 산출하며, 프롬프트 캐싱을 켜면 약 $9.16이 됩니다. 예산을 $0.44 기준으로 세웠다면, 이제 그 예산은 청구서의 약 60%를 감당하는 셈입니다.
캐시는 아무도 꺼내지 않는 지렛대다
프롬프트 캐싱은 요금이 올랐을 때 덜 가치 있어진 것이 아니라 더 가치 있어졌습니다 — 그리고 그 이유는 두 숫자의 방향에 있습니다. OrcaRouter에서 캐시 읽기는 이제 100만 토큰당 $0.024로 청구되는 반면 캐시되지 않은 경우는 $0.726이며, 다시 보내는 모든 입력에 대해 96.7% 할인입니다. 이 페이지의 이전 버전에서는 캐시 요율이 $0.060이었고 입력 가격은 $0.442로, 86% 할인이었습니다. 캐시 읽기 가격은 절반 이상 떨어졌고 캐시되지 않은 입력 가격은 64% 올랐기 때문에, 캐시된 토큰과 캐시되지 않은 토큰 사이의 실질적인 격차는 상당히 벌어졌습니다.
매 턴마다 큰 시스템 프롬프트와 긴 컨텍스트를 다시 보내는 에이전트에게, 캐시된 입력은 요금이 대화 길이에 따라 늘어나는지 그렇지 않은지를 가르는 차이입니다. 실용적인 규칙은 변하지 않았고 되풀이할 가치가 있습니다. 안정적인 시스템 프롬프트와 참고 자료를 먼저 두고 변동성이 큰 콘텐츠를 마지막에 두어, 다시 보내는 프리픽스가 실제로 캐시에 적중하게 하십시오. 이 모델에서 그 단 하나의 구조적 선택은 그 아래에 있는 어떤 라우팅이나 스케줄링 결정보다 더 가치가 있습니다.
V4 Pro 가격이 경쟁 제품과 어떻게 비교되는지

1M 토큰당 입력/출력 디렉터리 정가, 2026-09-12 확인, V4 Pro의 오프피크 $0.726/$2.178와 비교. 이 중 두 개는 이 페이지가 처음 게시된 이후 변동되었으며, 그중 하나는 결론을 바꿉니다.
• Claude Fable 5 — $10 / $50. V4 Pro는 입력 비용이 13.8배, 출력 비용이 23배 더 저렴합니다.
• Claude Opus 5 — $5 / $25. 6.9× / 11.5×.
• GPT-5.6 Sol — 컨텍스트 272K까지 $4 / $20, 그 이상은 $8 / $30. 짧은 구간에서는 5.5× / 9.2×, 긴 구간에서는 11× / 13.8×.
• Kimi K3 — $3 / $15. 4.1× / 6.9×.
• Qwen3.8 Max — $2 / $6. 2.8× / 2.8×.
• Grok 4.5 — $2 / $6. 2.8× / 2.8×.
• Gemini 3.6 Flash — $0.75 / $3.75. 입력 기준으로는 1.03배로 거의 동등한 수준이고, 출력 기준으로는 1.7배입니다. 이 페이지가 작성된 이후 이 모델의 가격은 절반으로 떨어졌습니다.
• MiniMax M3 — $0.30 / $1.20. 이제 V4 Pro보다 저렴합니다 — 두 라인 모두에서: V4 Pro는 입력 비용이 2.4배, 출력 비용이 1.8배 더 높으며, 1M 토큰 윈도우는 동일합니다.
• DeepSeek V4 Flash — 디렉터리 기준 $0.242 / $0.726. 두 라인 모두 약 3배 저렴하며, 동일한 1M 컨텍스트.
정직한 프레이밍이 바뀌었으므로, 이 페이지는 예전 최상급 표현을 그대로 유지하기보다는 그렇게 말해야 한다. DeepSeek V4 Pro는 더 이상 이 목록에서 가장 저렴한 1M 컨텍스트 모델이 아니다: Gemini 3.6 Flash와 MiniMax M3 둘 다 이 모델을 밑돌며, MiniMax M3는 컨텍스트 창을 맞추면서도 그렇게 한다. V4 Pro가 여전히 프런티어 계층에서 가장 저렴한 모델이라는 점인데, 그 격차는 10배가 넘는다 — 그 목록의 모든 서구 플래그십급 모델은 입력과 출력 양쪽 모두에서 이 모델의 몇 배에 달한다. 질문이 "가능한 가장 저렴한 1M 컨텍스트 호출"이라면, 답은 더 이상 이 모델이 아니다. 질문이 "프런티어 모델처럼 작동하는 가장 저렴한 모델"이라면, 당분간은 여전히 이 모델이다.
V4 Pro가 잘못된 선택일 때
• 트래픽이 베이징의 낮 시간대에 가장 많은 경우. 피크 시간에는 요금이 두 배가 되며, 피크 구간은 중국의 근무일과 정확히 겹칩니다. 사용자가 미주 지역에 있다면 트래픽 대부분이 이미 비피크 시간대에 발생하므로 이는 실질적인 구조적 이점입니다. 중국 사용자를 위해 구축 중이라면 약정하기 전에 피크 청구액을 명시적으로 모델링하고 — 주말 규칙이 무엇이든 옮기는 데 도움이 되는지 확인하세요.
• 프롬프트가 짧다면. 대략 10K 토큰 미만의 컨텍스트에서는 플래그십 등급은 낭비되는 용량입니다. 디렉터리에서 $0.242/$0.726인 DeepSeek V4 Flash는 동일한 1M 컨텍스트를 약 3분의 1 가격으로 처리하며, 정말 짧은 작업에는 더 저렴한 모델이 여전히 낫습니다.
• 비전이 필요하다면. V4 Pro는 텍스트 전용입니다 — 이미지나 오디오 입력이 없습니다 — 그리고 Artificial Analysis는 입력 모달리티를 텍스트로 명시합니다. 모달리티가 핵심이라면 Gemini 3.6 Flash나 Claude Fable 5가 더 적합합니다. DeepSeek 자체 API도 여기서 주목할 만합니다: 이제 레거시 플래시 모델 이름들을 V4.1 Flash로 제공하며, 이 모델은 이미지를 입력받습니다.
• 컨텍스트당 가격보다 벤치마크 최상위 원점수를 사려는 경우라면. Artificial Analysis의 현재 척도에서 V4 Pro는 Intelligence Index에서 36점으로, 작성 시점 기준 113개 모델 중 8위이며, OrcaRouter 디렉터리에 실린 Coding index에서는 69점을 기록합니다. 이는 경쟁력 있는 수준이지 선두는 아닙니다: Claude Fable 5, Claude Opus 5, GPT-5.6 Sol 모두 코딩에서 V4 Pro보다 높은 점수를 냅니다. V4 Pro의 강점은 모든 차트의 정상이 아니라, 토큰당 가격의 일부로 제공하는 프런티어에 근접한 성능입니다.
OrcaRouter에서 그것을 호출하는 방법

DeepSeek V4 Pro는 OrcaRouter에서 모델 ID deepseek/deepseek-v4-pro로 호스팅되며, api.orcarouter.ai/v1의 OpenAI 호환 엔드포인트를 통해 공급자 요율로 마크업 없이 제공됩니다. 기존 OpenAI 클라이언트에서의 마이그레이션은 base-URL과 모델 ID를 변경하는 것 외에는 아무것도 필요하지 않습니다.
이 번복은 이에 대해 무엇을 해야 하는지를 바꿉니다. 9월 14일 마이그레이션이 일정에 잡혀 있었다면 — Pro가 사라질 예정이어서 V4 Pro에서 DeepSeek V4.1 Flash로 대상을 바꾸려던 — 일정에서 빼도 되고, 적어도 마감 기한에서 테스트로 격하해도 됩니다. 두 모델 모두 하나의 OrcaRouter 키 뒤에 있으므로, 두 모델을 비교하는 일은 두 번째 계약과 두 번째 SDK가 아니라 요청에서 모델 ID를 바꾸는 것에 지나지 않습니다. 그리고 V4.1 Flash를 프로덕션 경로에 걸지 않고 실제 트래픽에서 평가하고 싶다면, 자동 페일오버는 V4 Pro를 폴백으로 유지하면서 V4.1 Flash에 실제 요청을 보내는 위험이 낮은 방법입니다. 이것이 9월 11일 결정의 실질적인 형태입니다: 선택은 계속 여러분의 것이며, 되돌릴 수 있는 상태로 남습니다.
가격 페이지에서 중요한 정직성 고지: 우리는 모델로 라우팅할 뿐, 그 가격을 정하지 않습니다. $0.726/$2.178 오프피크 수치는 DeepSeek의 요율을 그대로 전달한 것이며, DeepSeek가 이 요율을 바꾸면 함께 바뀝니다 — 바로 그래서 이 페이지에는 날짜가 찍혀 있고, 지금 읽고 계신 버전이 덧붙여진 것이 아니라 다시 작성된 것입니다.
출처 및 날짜
이 페이지의 가격과 사양은 2026-09-12에 다시 검증되었습니다. DeepSeek V4 Pro와 비교 대상에 포함된 모든 모델의 달러 수치는 다음 출처에서 가져옵니다: OrcaRouter 모델 디렉터리, 같은 날 확인했으며, 매개변수 수, 라이선스, 컨텍스트 윈도, 모달리티 및 속도 수치는 Artificial Analysis의 DeepSeek V4 Pro 0813 모델 페이지에서 가져왔습니다. 위안화 요금, 피크 시간대, 9월 11일 지속 공지는 DeepSeek 자체의 Models & Pricing 문서에서 나온 것으로, 이 문서는 해당 성명을 가격표 각주로 그대로 수록하고 있습니다. 세 단계로 이어진 발표 순서 — 9월 9일 라우팅 공지, 9월 14일 베이징 시간 12:00으로의 9월 10일 연기, 그리고 9월 11일의 번복 — 는 CLS(科创板日报), 36Kr, IT之家, ifeng가 보도했으며, 영어로는 TheBlockBeats가 보도했습니다. 8월 23일 주말 과금 규칙과 9월 10일 Flash 가격 인하는 IT之家, The Paper, 21st Century Business Herald가 보도한 DeepSeek의 발표에서 비롯되었습니다.
신뢰성에 관한 마지막 한마디인데, 이 특정 가격이 한 달에 세 번이나 바뀌었기 때문입니다 — 8월 13일의 출시 요금, 8월 17일의 피크/오프피크, 8월 23일의 주말 수정. 날짜가 없는 "V4 Pro pricing" 페이지는 사용할 수 없는 것으로 취급하세요. 이것의 이전 버전은 $0.44/$0.88과 Artificial Analysis Intelligence index 44.3을 인용했는데, 둘 다 작성 당시에는 정확했지만 어느 것도 그달을 넘기지 못했습니다.
이 글에서 비교한 모델3
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
