'DeepSeek V4 Pro vs Qwen3.8 Max'라는 제목의 생성된 히어로 카드로, 두 장의 둥근 카드가 있습니다. 하나는 '$0.66 / $1.98 오프피크 · MIT 오픈 웨이트 · 1M 컨텍스트' 배지가 달린 DeepSeek V4 Pro 카드이고, 다른 하나는 '$2.00 / $6.00 · 상업용 라이선스 · 1M 컨텍스트' 배지가 달린 Qwen3.8 Max 카드이며, 두 카드는 저울 아이콘과 '세 배 가격, 네 점의 지능 — 청구서와 맞닥뜨렸을 때 어느 쪽이 살아남을까?'라는 하단 문구로 구분됩니다.
Guides & Insights

DeepSeek V4 Pro vs Qwen3.8 Max: 3배 가격 격차, 9월 유예 이후 재실행

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

DeepSeek V4 ProQwen3.8 Max는 이 세대에서 가장 중요한 오픈소스 또는 저가 플래그십 두 가지이며, DeepSeek 측의 9월 사건들은 어느 벤더의 마케팅이 인정한 것보다 더 많이 이 맞대결 구도를 바꾸어 놓았다. DeepSeek V4 Pro는 2026년 8월 13일에 출시되었는데, 이는 Alibaba의 Qwen3.8 Max가 8월 3일에 일반 제공되기 시작한 지 10일 후였으며, 이 짝은 항상 일방적인 대결로 읽혀 왔다. Qwen3.8 Max는 2.4조 파라미터의 올라운더로 백만 입력 토큰당 2달러, 백만 출력 토큰당 6달러인 반면, DeepSeek V4 Pro는 1.6조 파라미터의 추론 전문가로 그 가격의 일부에 불과하며, MIT 라이선스에 공개 가중치를 갖추고 있다. 오늘 이 비교를 다시 하는 것이 가치 있는 이유는 출시 주간의 수치가 아니라 한 달 후에 일어난 일 때문이다. DeepSeek은 9월 8일이 포함된 주에 V4 Pro를 은퇴시키려고 애썼다가, 9월 11일에 번복하고 변경되지 않은 요금으로 계속 온라인에 유지하겠다고 약속했다. 그 번복은 현재 이 맞대결에 관한 가장 중요한 단일 사실이다. 왜냐하면 그것이 저렴한 쪽이 안전한 선택인지 마이그레이션 함정인지를 결정하기 때문이다.

이 글에 실린 독립적 측정치는 오늘 수집된 Artificial Analysis에서 나온 것입니다. Alibaba와 DeepSeek이 자체적으로 내놓은 벤치마크 표는 전부 벤더 보고로 표시되어 있습니다 — 어느 회사의 출시 수치도 제3자가 완전히 재현한 적이 없으며, 게다가 DeepSeek의 수치는 이제 계속 움직이는 스코어보드에 비추어 볼 때 4주나 지난 것입니다.

9월의 유예가 핵심이지, 8월의 출시가 아니다

9월 8일, DeepSeek은 9월 14일 이후 deepseek-v4-pro로 들어오는 모든 요청이 V4.1 Flash로 라우팅되고 V4.1 Pro가 출시될 때까지 Flash 가격으로 청구될 것이라고 발표했습니다. Qwen3.8 Max와 DeepSeek V4 Pro를 진지하게 비교하던 사람이라면 누구나 저렴한 옵션이 사라질 것에 대비해 계획을 세우기 시작해야 했습니다. 그러다 DeepSeek은 중단 시점을 연기했고, 9월 11일에는 완전히 번복하여 9월 14일 이후에도 DeepSeek V4 Pro에 대한 API 서비스를 계속 제공하며 청구 방식은 변경하지 않겠다고 밝혔고, 만약 그런 변화가 생기면 공지하겠다고 했습니다. 이 번복 소식은 같은 날 중국 국영 매체와 기술 언론에 의해 보도되었습니다.

이것이 맞대결에 미치는 영향은 조용히 의사 결정을 좌우하던 비대칭성을 제거한다는 것이다. 9월 첫째 주까지 "출력 단가가 $0.66인 모델을 기반으로 개발해야 할까, 출력 단가가 $6인 모델을 기반으로 개발해야 할까?"에 대한 솔직한 답은 생존 위험으로 오염되고 있었다. 가격 선도 모델에는 서비스 종료 날짜가 있었기 때문이다. 9월 15일부로 그 오염은 사라졌다. 저렴한 선택지는 지속 가능하며, 이제 그 비교는 마침내 원래 항상 그래야 했던 것 — 지능, 가격, 속도 — 에 관한 것이 되었다.

A generated scoreboard titled 'DeepSeek V4 Pro vs Qwen3.8 Max — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, License MIT open weights, Input text; right column Qwen3.8 Max rows AA Index 40 (#30/200), Price $2.00/$6.00, Speed ~41 tok/s, Context 1M, License Commercial, Input text + image + video; footer 'AA figures independent (current scale); DeepSeek price is vendor list off-peak.'

가격: 동일한 게임을, 출력 비용의 몇 분의 일로

현재 독립 스코어보드에서 두 모델은 4점 차로 자리 잡고 있으며, 두 모델 간 가격 격차는 오픈 웨이트 티어에서 가장 크다. Qwen3.8 Max는 Alibaba 정가 기준 백만 입력 토큰당 $2.00, 백만 출력 토큰당 $6.00이며 88% 캐시 할인이 적용된다. DeepSeek V4 Pro는 비피크 시간대 백만 입력 토큰당 $0.66, 백만 출력 토큰당 $1.98이고, 피크 시간대에는 $1.32/$3.96로 두 배가 되며 97% 캐시 할인이 적용된다.

• 가격 — DeepSeek V4 Pro는 100만 토큰당 오프피크 $0.66/$1.98 (피크 $1.32/$3.96), Qwen3.8 Max는 $2.00/$6.00 고정

• Intelligence Index — V4 Pro 36 (#7/113) 대 Qwen3.8 Max 40 (#30/200)

• 출력 속도 — V4 Pro 초당 약 81토큰 vs Qwen3.8 Max 초당 약 41토큰

• 작업당 비용 — V4 Pro $0.67 vs Qwen3.8 Max $2.67 (AA 지수 작업 기준)

• 컨텍스트 — 둘 다 1M 토큰

• 라이선스 — V4 Pro MIT 오픈 웨이트 대 Qwen3.8 Max 독점 웨이트, 상업적 라이선스

출력 가격 비율이 논쟁의 핵심입니다. Qwen3.8 Max는 입력 토큰당 비용이 세 배이고, V4 Pro의 피크 요금 기준 출력 토큰당으로도 대략 세 배이며, V4 Pro가 오프피크 요금으로 청구될 때—이는 좁은 시간대를 제외한 주중 대부분을 포함합니다—출력에서의 격차는 여섯 배로 벌어집니다. 출력 토큰이 청구서를 지배하는 추론 중심 워크로드에서는, 이 격차가 계속 돌려둘 수 있는 모델과 대시보드를 들여다보게 되는 모델의 차이입니다. 캐시 항목은 이 격차를 더욱 벌립니다. V4 Pro의 97% 할인 대 Qwen의 88% 할인은, 재사용되는 프리픽스가 있는 장문 컨텍스트 작업이 DeepSeek 쪽에서는 정가의 일부만 드는 것을 의미합니다.

지능: 4점 차이, 그리고 그 격차가 진짜 결과물이다

독립적인 스코어보드는 이것이 가격 비율이 시사하는 것보다 더 접전임을 보여준다. 현재 Artificial Analysis Intelligence Index에서 Qwen3.8 Max는 40점으로 DeepSeek V4 Pro의 36점을 상회한다 — 추론 집약적 작업에서는 드러나지만 토큰 집약적 작업에서는 사라지는 4점 차이다. Qwen3.8 Max의 우위는 실재하며 일관된다: 전체 200개 중 30위로, 프런티어 바로 안쪽에 위치하며, V4 Pro는 오픈 웨이트 부문에서 113개 중 7위다. Alibaba 자체 벤치마크 표에서 Qwen3.8 Max는 Terminal-Bench 2.1 86.6, GPQA Diamond 92.6, 그리고 전작의 40.7을 거의 두 배로 늘린 FrontierSWE 73.5를 주장한다 — 모두 벤더 보고이며, 어느 것도 독립적으로 재현되지 않았다. DeepSeek의 모델 카드는 최대 추론 강도에서 Codeforces 레이팅 3,348과 Terminal-Bench 2.1 87.9를 주장한다 — 마찬가지로 벤더 보고이며 제3자에 의해 검증되지 않았다.

솔직히 말하면, 두 회사는 서로 평행선을 달리고 있다. Qwen3.8 Max의 벤더 표는 기업 및 과학 작업을 중심으로 구성되어 있다 — Aliba​ba가 9월 2일에 출시한 0902 리프레시는 Coding and Cowork에 대해 추가 포스트트레이닝을 거쳤고, Qw​en은 이것이 바로 그 프로필을 강화한다고 말한다. DeepSeek V4 Pro의 자체 주장은 심층 추론과 에이전트형 도구 사용에 집중되어 있으며, 여기서 4주 전에 나온 Codeforces 및 Terminal-Bench 수치는 여전히 강해 보인다. 어느 벤더의 표도 독립 평가자에 의해 재현되지 않았고, 유일하게 독립적인 스코어보드에서는 4점 차이가 두 모델 간 차이의 전부다.

속도는 Qwen3.8 Max가 조용히 밀리는 지점이다

스펙 시트가 숨기고 있는 차원은 출력 속도다. Artificial Analysis는 DeepSeek V4 Pro를 약 초당 81토큰으로 측정한 반면 Qwen3.8 Max는 약 초당 41토큰으로 측정한다 — 답변이 돌아오는 속도에서 두 배 차이다. 채팅 워크로드에서는 사용자가 체감하는 멈춤이고, 순차 호출이 많은 에이전트 루프에서는 실제 소요 시간으로 누적된다. 가격 비율은 이미 V4 Pro에 유리하며, 속도 격차는 토큰 계산이 시사하는 것보다 답변당 실효 비용 격차를 더 벌린다.

그 숫자 안에는 하나의 트레이드오프가 숨어 있는데, 그것은 Qwen3.8 Max의 장황함입니다. Artificial Analysis는 이 모델이 "눈에 띄게 느리고 매우 장황하다"고 지적하며, 작업당 비용 — V4 Pro의 $0.67에 맞선 $2.67 — 은 더 높은 요율과 추가 출력 토큰을 모두 반영합니다. 답변마다 더 많이 쓰는 추론 모델은 요금표를 곱하기도 전에 작업당 비용이 더 많이 듭니다. 워크로드가 지연 시간에 민감하거나 에이전트 루프가 수십 번의 호출을 수행한다면, 바로 그 숫자에 대해 자체 평가를 돌려봐야 합니다.

가중치: MIT 대 상용 라이선스

DeepSeek V4 Pro는 공개 가중치와 함께 MIT 라이선스로 제공됩니다 — 다운로드하고, 직접 서빙하고, 미세 조정하고, 수정 사항을 비공개로 유지할 수 있습니다. Qwen3.8 Max는 Max급 Qwen 중 최초로 공개 가중치를 출시했지만(2.4T A95B 체크포인트는 8월 12일에 공개됨), 규모 등급 조건이 붙은 상용 라이선스 하에 있으며, Alibaba는 DeepSeek처럼 전체 추론 스택을 공개하지 않았습니다. 두 제품을 비교하는 기업에게는 배포 방식이 결정적 판단 기준이 됩니다: V4 Pro는 인프라로서 자체 호스팅할 수 있고, Qwen3.8 Max는 주로 임대하는 서비스입니다. 가중치 차이는 공급업체 종속이 걱정되거나 API 가격에서 완전히 벗어나고 싶을 때 가장 중요합니다.

누가 어떤 것을 골라야 하나요

워크로드가 추론 중심이거나 출력 토큰 비중이 크거나 지연 시간에 민감하다면, DeepSeek V4 Pro가 청구서에 드러나는 거의 모든 축에서 답입니다: 출력 비용은 대략 3~6배 저렴하고, 속도는 약 2배 빠르며, 캐시 할인은 더 깊고, MIT 가중치라는 탈출구도 있습니다. 4점의 지능 격차는 실재하지만 좁으며, 프로덕션 트래픽에서는 가격 차이와 맞닥뜨리면 좀처럼 살아남지 못합니다.

워크로드가 엔터프라이즈형이라면 — 복잡한 다단계 분석, 심층 논리 도출, 까다로운 에이전트 작업, 또는 한계적인 답변 품질이 토큰 비용의 3~6배 가치가 있는 모든 작업 — Qwen3.8 Max가 독립 지수에서 추가로 얻는 4점과 더 강력한 엔터프라이즈 벤치마크 주장은 프리미엄을 지불할 이유입니다. 0902 리프레시는 그 프로필을 더욱 선명하게 만듭니다. 그리고 이미지나 비디오 입력이 필요하다면 선택은 비교조차 되지 않습니다: Qwen3.8 Max는 텍스트, 이미지, 비디오를 받아들이는 반면, DeepSeek V4 Pro는 텍스트 전용입니다.

두 모델 모두 OrcaRouter를 통해 단일 키로 호출할 수 있습니다 — DeepSeek V4 Pro와 Qwen3.8 Max가 모두 이 플랫폼을 통해 라우팅됩니다 — 그리고 OrcaRouter는 공급자 정가를 마크업 없이 그대로 전달하기 때문에, 이 글에 나오는 숫자가 바로 여러분이 실제로 지불하는 금액이며, 벤더의 가격 인하도 같은 날 그대로 반영됩니다. 라우팅 DSL을 사용하면 토큰 소모가 많거나 지연에 민감한 트래픽은 DeepSeek V4 Pro로, 멀티모달 또는 가장 중요한 추론 작업은 Qwen3.8 Max로 같은 통합 환경에서 보낼 수 있습니다 — 이는 대부분의 팀이 이 조합을 활용하는 방식과 정확히 일치합니다. 즉, 각자가 가장 잘하는 일에 두 모델을 모두 사용하는 것입니다.

A screenshot of the Artificial Analysis page for Qwen3.8 Max, captured September 15, 2026, showing the Intelligence Index score of 40 at rank 30 of 200, output speed 40.6 tokens per second, an input price of $2.00 and output price of $6.00 per million tokens with an 88% cache discount, and a cost of $2.67 per Intelligence Index task.A screenshot of the OrcaRouter model page for Qwen3.8 Max at orcarouter.ai/models/qwen/qwen3.8-max, captured September 15, 2026, showing the model listing with its provider Qwen, 1M-token context window, text+image+video input, and $2.00/$6.00 per-million-token pricing alongside the surrounding catalogue.

평결

9월의 유예는 이 맞대결을 삼키고 있던 의문을 종결지었다: 저렴한 쪽은 더 이상 이탈 위험이 아니다. DeepSeek V4 Pro는 가성비의 답이다 — 출력 기준 3~6배 더 저렴하고, 두 배 더 빠르며, MIT 라이선스이고, 이제는 온라인 유지를 약속한 상태다. Qwen3.8 Max는 역량의 답이다 — 독립 지표 4포인트 더 높고, 더 강력한 엔터프라이즈 주장, 멀티모달 입력, 그리고 당신의 스택에 들이지 못하게 하는 상용 라이선스다. 당신의 평가가 그 4포인트가 중요함을 입증할 때는 4포인트를 택하고, 청구서가 실제로 결정하는 평가일 때는 가격을 택하라.

토큰 소모가 많거나 지연에 민감한 트래픽은 DeepSeek V4 Pro로, 멀티모달 또는 가장 중요한 추론은 Qwen3.8 Max동일한 통합에서 말이죠 — 이는 대부분의 팀이 결국 이 조합을 사용하게 되는 방식과 정확히 같습니다: 각자가 가장 잘하는 일에 둘 다 활용하는 겁니다.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트