
Step 5 Preview vs DeepSeek V4 Pro: 하나는 약속이고, 다른 하나는 MIT 라이선스
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
이 맞대결의 모든 것은 벤치마크와 전혀 무관한 한 가지 질문으로 귀결됩니다. 실제로 무엇을 다운로드할 수 있는가? DeepSeek V4 Pro — 벤더가 2026년 8월 13일에 DeepSeek-V4-Pro-0813이라는 이름으로 출시한 빌드 — 는 MIT 라이선스 하의 1.6조 파라미터 전문가 혼합(MoE) 모델이며, 가중치는 지금 Hugging Face에 올라와 있습니다. Step 5 Preview는 StepFun이 2026년 9월 20일에 발표한 6000억 파라미터 희소 MoE로, 같은 독립 리더보드에서 8점 더 높은 점수를 받았지만, Hugging Face 저장소에는 파일이 정확히 하나, .gitattributes만 들어 있습니다. StepFun은 BF16 체크포인트가 10월 15일에 제공된다고 합니다. 그러므로 이 비교의 정직한 본질은 "어느 모델이 더 나은가"가 아닙니다. "이 둘 중 이번 분기에 어느 것을 기반으로 개발할 수 있고, 어느 것을 기다리고 있는가"입니다.
그러한 구성은 벤치마크 맞대결보다 덜 흥미롭고 훨씬 더 유용하다. 왜냐하면 8점 격차와 25일 대기는 같은 종류의 사실이 아니기 때문이다. 그중 하나는 오늘 당장 계획에 반영할 수 있다.
여덟 가지 포인트, 그리고 중요한 네 가지
Artificial Analysis는 두 모델을 Intelligence Index v4.3.2 — 10개의 평가 — 를 통해 실행하는데, 이는 이 두 모델이 동일한 주체에 의해 측정된 유일한 곳입니다.
• 인텔리전스 지수 — Step 5 Preview 44 대 DeepSeek V4 Pro 36
• 해당 보드에서의 순위 — Step 5 Preview 200개 중 24위 vs DeepSeek V4 Pro 동급 113개 중 7위
• Terminal-Bench 4.0 — Step 5 Preview 33.3%; DeepSeek V4 Pro는 같은 보드에 등재되어 있지 않으므로, 동등하게 비교할 수 있는 에이전트 행을 제시할 수 없습니다
• 출력 속도 — Step 5 Preview 99.8 토큰/초 vs DeepSeek V4 Pro 88.8 토큰/초
• 첫 토큰까지 걸리는 시간 — Step 5 Preview 2.96초 vs DeepSeek V4 Pro 1.69초
• 100만 토큰당 가격 — Step 5 Preview는 $1.00 입력 / $2.70 출력, DeepSeek V4 Pro는 DeepSeek의 피크 요금 기준 $1.32 입력 / $3.96 출력이며, 오프피크에는 $0.66 / $1.98로 절반이 됩니다
• 캐시 할인 — Step 5 Preview 95% vs DeepSeek V4 Pro 97%
• 맥락 — 둘 다 1M 토큰이며, DeepSeek는 384,000토큰 출력 상한을 공개하지만 StepFun은 공개하지 않았다
• 가중치 — Step 5 Preview 종료, BF16 체크포인트는 10월 15일 예정; DeepSeek V4 Pro MIT, 지금 다운로드 가능
헤드라인과 상충하는 두 개의 행이 있다. DeepSeek V4 Pro는 첫 토큰을 1.69초에 내놓는 반면 Step 5 Preview는 2.96초로, 매 호출마다 43% 앞서 출발하며, 이는 긴 에이전트 루프에서 실제 벽시계 시간으로 누적된다. 그리고 캐시 할인은 2포인트 더 좋은데, 이는 두 모델 모두가 판매 대상으로 삼는 바로 그 워크로드에 가장 중요하다. 매 턴마다 동일한 시스템 프롬프트와 저장소 컨텍스트를 다시 보내는 에이전트는 거의 전적으로 그 할인 안에 머문다.
8점이라는 종합 격차는 실재하며, 8점이라는 말이 들리는 것보다 좁기도 하다. 지수는 열 가지 평가의 합성물이고, 두 모델이 갈리는 지점은 바로 그 구성에 있다. Step 5 Preview가 Terminal-Bench 4.0에서 기록한 33.3%는 진정한 에이전트적 결과다. DeepSeek V4 Pro 자체의 대표 강점은 오픈 웨이트 계층에서 다른 어떤 것도 필적하지 못하는 가격에 제공되는 장기 호라이즌 추론이다. 어느 리더보드도 두 모델이 직접 맞붙은 행을 공개하지 않으며, 이것이 이 비교가 단일 숫자로 결판날 수 없는 솔직한 이유다.

벤더가 마음을 바꿀 때 "오픈"이 당신에게 주는 이점
스펙 시트가 담을 수 없는 이 맞대결의 한 부분이 여기 있으며, Step 5 Preview가 발표되기 11일 전에 일어난 일이기에 실제 날짜와 함께 말할 가치가 있습니다.
DeepSeek는 사용자들에게 V4 Pro 서비스를 종료한다고 알렸습니다. 9월 9일 회사는 요청이 더 새로운 DeepSeek V4.1 Flash로 라우팅될 것이라고 밝혔습니다. 9월 10일에는 날짜를 9월 14일 베이징 시간 12:00으로 확정했습니다. 9월 11일에는 이를 번복했습니다 — DeepSeek의 표현대로 V4 Pro API 서비스는 9월 14일 이후에도 계속되며, 요금 청구는 변경되지 않습니다. 모델 문자열, 100만 토큰 컨텍스트, 500개 요청 동시성 한도는 모두 그대로입니다. 그리고 DeepSeek의 Models & Pricing 페이지는 이 번복을 각주로 표시합니다: deepseek-v4-pro 행.
그것을 오픈 웨이트가 실제로 당신을 보호해 주는 것과, 그렇지 않은 것에 대한 실증으로 읽어라. 그 API는 일정 결정 하나로 거의 사라질 뻔했다. 가중치는 그럴 수 없었다. 자신의 하드웨어에 있는 MIT 라이선스 체크포인트에는 단종을 발표할 수 있는 벤더가 없으며, 그것은 가격 약속과는 다른 종류의 보장이다 — 그것은 아예 약속이 아니다.
바로 그 공백에 Step 5 Preview가 놓여 있다. StepFun은 BF16 체크포인트를 10월 15일로 확정했고, 이미 예약해 둔 저장소 이름 — stepfun-ai/Step-5-Preview-BF16 — 은 생성 시점에 이름이 정해지고 나중에 채워지는, 당신이 파인튜닝하고 양자화하는 기반이 되는 형식이다. 이것은 일정 신호이지, 부산물이 아니다. 저장소에 .gitattributes 외에 다른 것이 담기기 전까지, Step 5 Preview는 한 벤더의 조건 아래에서 빌려 쓰는 모델이며, 읽을 수 있는 라이선스도, 조건이 바뀔 때의 대안도 없다.
저렴한 옵션이 되는 두 가지 방법
이 두 모델은 모두 폐쇄형 프런티어를 큰 폭으로 밑돌며, 그 메커니즘은 서로 다르고, 이는 가격이 얼마나 지속될 수 있는지에 중요하다.
DeepSeek V4 Pro가 저렴한 것은 한 연구소가 가중치를 공개했고 경쟁적인 서빙 시장이 마진을 거의 없애버렸기 때문이다. 그것은 구조적 하한선이다. 누구나 체크포인트를 서빙할 수 있으므로 가격은 기업의 가격 전략이 아니라 GPU-시간 비용에 의해 결정된다. DeepSeek 자체 API는 이를 두 개의 시간대로 가격을 책정한다 — 피크 시간에는 $1.32와 $3.96, 그 외 시간에는 그 절반 — 그리고 피크는 좁아서 UTC 기준 평일 아침 몇 시간에 불과하므로, 대부분의 트래픽은 더 저렴한 요율에 해당하고 주말에는 더 높은 요율이 결코 적용되지 않는다.
Step 5 Preview가 저렴한 것은 StepFun이 그렇게 가격을 책정하기로 했기 때문이다. 엔드포인트가 하나, 가격표가 하나뿐이고 두 번째 소스는 없다. 그것은 비난이 아니다 — 600B/27B 희소 모델은 실제로 서빙 비용이 매개변수 수가 시사하는 것보다 적게 들며, 활성 매개변수 비율이 그 이유다. 그것은 단지 다른 종류의 가격일 뿐이며, 그 차이는 StepFun이 이 프리뷰가 제 역할을 다했다고 판단하는 날 드러난다.
둘 사이의 가격 차이는 무엇도 좌우하지 않을 만큼 작다: $1.00와 $2.70 대 $1.32와 $3.96은 입력에서 24%, 출력에서 32% 차이로, 캐시 할인, 출력 길이 차이, 재시도율이 지워버릴 수 있는 범위 안에 충분히 들어 있다. 장황함 문제에서는 둘이 비슷하다 — Step 5 Preview는 index run에서 160M 출력 토큰을 생성했고 이는 92M 중앙값과 대비되며, DeepSeek V4 Pro 자체의 실행도 같은 구간에 있다. 둘 다 알뜰한 모델이 아니며, 둘 모두 작업당 저렴하기보다는 토큰당 저렴하다는 점으로 팔린다.

각각이 실제 스택에서 어디에 속하는지
미세 조정하고, 양자화하고, 자체 VPC에 호스팅하거나, 법무팀이 읽을 수 있는 라이선스 파일과 함께 법무팀에 넘겨야 하는 모델이 필요하다면, 이건 애매한 문제가 아니며 벤치마크의 문제도 아닙니다. DeepSeek V4 Pro는 오늘 MIT 라이선스로 제공됩니다. Step 5 Preview에는 라이선스도, 설정도, 파라미터 파일도 없으며, 계획을 세울 수 있는 가장 이른 시점은 10월 중순입니다. 8포인트 지수 격차는 그 계산을 바꾸지 않습니다. 다운로드할 수 없는 모델은 배포할 수 없기 때문입니다.
백만 입력 토큰당 1달러로 이용할 수 있는 가장 강력한 에이전트 결과를 원한다면, Step 5 Preview는 둘 모두를 측정한 유일한 리더보드에서 앞서 있으며, 에이전트 루프의 대부분을 차지하는 시행착오 작업 — 추출, 분류, 테스트 스캐폴딩, 그리고 중요한 두 작업 사이의 일상적인 호출 — 에 더 나은 기본값입니다. 초당 99.8토큰은 DeepSeek V4 Pro의 88.8보다 출력을 더 빨리 완료하여, 비용만이 아니라 루프 자체를 단축합니다.
어색한 경우는 대부분의 팀이 실제로 처한 바로 그 상황입니다. Step 5 Preview 수치는 원하지만, 출시 당일에 열렸고 공개된 출력 상한도 없는 프리뷰 엔드포인트를 프로덕션 경로에 둘 수는 없습니다. 이는 라우팅 문제이며, 이 비교가 마지막으로 다루는 주제입니다. DeepSeek V4 Pro는 OrcaRouter를 통해 백만 토큰당 $0.66 및 $1.98에 이용할 수 있습니다. 이는 DeepSeek의 $1.32 및 $3.96 요금표 중 비피크 시간대의 절반 가격이며, 주변 텍스트 모델들도 함께 — 0% 마크업으로 200개 이상의 모델을 하나의 키 뒤에 두고 — 이용할 수 있으므로, DeepSeek의 가격이 바뀌면 갱신 시점이 아니라 같은 날 청구서에 반영됩니다. 트래픽의 탐색적 부분은 프리뷰로 돌리고, 프로덕션 경로는 라이선스가 뒷받침하는 모델에 유지하되, 프리뷰 엔드포인트의 용량 곡선 때문에 반드시 필요해진 작업은 제공자 간 자동 장애 조치가 수행하게 하세요.

무엇이 그것을 해결할까요?
세 가지입니다. 그리고 세 가지 모두 논쟁의 여지가 있는 것이 아니라 확인 가능한 것입니다.
첫 번째는 라이선스입니다. BF16 체크포인트가 공개되면, 저장소는 기업이 그것으로 무엇을 할 수 있다고 말합니까? 허용형 라이선스는 이 격차의 대부분을 스스로 해소합니다. 8점 우위를 빌리는 것이 아니라 소유할 수 있는 것으로 만들어 주기 때문입니다. 제한형 라이선스는 DeepSeek V4 Pro를, 이 둘 중 실제로 제품을 만들 수 있는 유일한 모델로 남겨 둡니다.
두 번째는 출력 상한이다. DeepSeek은 384,000 토큰을 공개한다. StepFun의 발표는 1M 컨텍스트를 말하며 출력 상한은 언급하지 않는데, 유출 당시 떠돌던 별개의 서드파티 구성에는 350,000 컨텍스트와 64,000 출력 최대치가 적혀 있었다. 두 모델이 모두 판매되는 장기 지평의 에이전트 작업에서 그 숫자는 각주가 아니다.
세 번째는 프리뷰 접미사가 떨어져 나간 뒤에도 가격이 유지되는지 여부다. 프리뷰 가격은 고객 확보를 위한 숫자이고, 출시 가격은 비즈니스 모델이다. DeepSeek V4 Pro의 하한선은 경쟁적인 서빙 시장에 의해 정해지므로 크게 움직일 수 없다. Step 5 Preview의 가격은 화요일에라도 바뀔 수 있다.
처음 두 가지가 답해지기 전까지, 실무적인 해석은 DeepSeek V4 Pro는 배포하는 모델이고 Step 5 Preview는 벤치마크 비교 대상으로 삼는 모델이라는 것입니다 — 단, 며칠밖에 안 된 프리뷰 엔드포인트가 성숙한 MIT 라이선스 플래그십보다 8점 위에 있다는 것은 실제 결과이며, 10월 15일이 어깨를 으쓱할 일이 아니라 달력에 적어 둘 만한 이유라는 점을 전제로 합니다.
이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
