
DeepSeek V4 Pro vs Kimi K3: 44점 추론 상한에 맞선 속도와 가격
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
DeepSeek V4 Pro와 Kimi K3는 100만 토큰 컨텍스트 창을 갖춘 두 오픈 웨이트 추론 플래그십이며, 두 모델의 경쟁 구도는 한 달 전에 안정적인 형태로 자리 잡았습니다. Kimi K3(문샷 AI의 2.8T 파라미터 모델, 2026년 7월 16일 출시)는 지능 부문 선두주자이고, DeepSeek V4 Pro(2026년 8월 13일 출시)는 속도와 가격 부문 선두주자입니다. 새로운 점은 이 짝의 저렴한 쪽이 9월 상반기에 거의 삭제될 뻔했다는 것입니다 — DeepSeek은 8일에 V4 Pro를 9월 14일 서비스 종료 경로에 올렸다가 이를 연기했고, 11일에는 서비스 종료를 아예 취소하며 요금 변경 없이 계속 서비스하겠다고 약속했습니다. 이는 대부분의 맞대결보다 이번 맞대결에서 더 중요한데, "저렴하고, 빠르고, 1M 컨텍스트, 오픈 웨이트"라는 조합은 대안이 다섯 배 더 비쌀 때 대체하기 어렵기 때문입니다.
독립적인 수치는 Artificial Analysis의 측정값입니다. DeepSeek과 Moonshot 자체의 출시 벤치마크는 공급업체 보고로 표시되어 있는데, 이는 둘 다 독립적으로 재현된 적이 없기 때문입니다.
Kimi K3는 인덱스에서 이기고, V4 Pro는 요금에서 이긴다
독립적인 스코어보드는 누가 더 똑똑한지에 대해 명확히 말해준다. 최대 노력 설정의 Kimi K3는 Artificial Analysis Intelligence Index에서 44점을 기록해 비교 가능한 모델 중 2위에 올랐다. DeepSeek V4 Pro는 36점으로 동급 7위다. 그 9점 격차가 사람들이 Kimi K3의 가격을 지불하는 이유의 전부다. 그리고 가격은 이 맞대결이 지수만으로 결판나지 않는 이유다: Kimi K3는 백만 입력 토큰당 $3.00, 백만 출력 토큰당 $15.00로 책정되어 있고, V4 Pro는 비피크 시간대 $0.66/$1.98(피크 시간대 $1.32/$3.96)로 책정되어 있다. 출력 기준으로 이는 약 7.5배다 — 캐시 할인을 적용하기 전에 말이다. V4 Pro의 캐시 읽기는 비피크 시간대에 백만 토큰당 약 $0.02로, 97% 할인이다; Kimi K3의 90% 캐시 할인은 훨씬 높은 기준에서 시작한다. 토큰 사용이 많은 워크로드에서는 실질 격차가 10배에 가까워진다.
• 지능 지수 — Kimi K3 44(#2/113) vs V4 Pro 36(#7/113)
• 가격 — Kimi K3 100만 개당 $3.00/$15.00 vs V4 Pro 오프피크 $0.66/$1.98 (피크 $1.32/$3.96)
• 속도 — V4 Pro 초당 약 81토큰 vs Kimi K3 초당 약 35토큰
• 컨텍스트 — 둘 다 1M 토큰
• 파라미터 — Kimi K3 2.8T 전체 / 104B 활성 vs V4 Pro 1.6T 전체 / 49B 활성
• 가중치 — 둘 다 공개 (Kimi K3 공개 가중치, V4 Pro MIT)
• 입력 — Kimi K3 텍스트 및 이미지 vs V4 Pro 텍스트 전용
속도는 누구나 과소평가하는 부분이다.
아무도 이야기하지 않는 격차는 바로 처리량입니다. V4 Pro는 독립적으로 측정했을 때 초당 약 81토큰을 출력하고, Kimi K3는 약 35토큰을 처리합니다. 모델이 단계마다 수천 개의 토큰을 작성하는 에이전트 루프에서, 이는 몇 분 만에 끝나는 작업과 오후 내내 질질 끄는 작업 사이의 차이입니다. 게다가 비용 차이가 이 문제를 가중시킵니다. 대략 절반의 속도로 출력 토큰 100만 개당 $15를 지불해야 하기 때문입니다. 대화형 코딩 어시스턴트, 대량 문서 처리, 그리고 실제 경과 시간이 예산 항목인 모든 워크로드에서, 출력 가격이 7분의 1인 데다 속도는 2.3배라는 V4 Pro의 조합은 가장 강력한 답입니다.
9점이 그만한 가치가 있을 때
Kimi K3에 대한 솔직한 찬성 논거는 추론 한계치다. Intelligence Index에서의 평가 비용은 해당 실행에 약 $3,658였는데, 이는 가격 책정의 변덕이 아니라 정말로 길고 값비싼 추론 체인을 반영한 결과다. 워크로드가 고난도 추론 — 심도 깊은 수학적 증명, 장기 계획, 인덱스 점수 9점이 더해지면 더 적은 실패로 이어지는 수시간짜리 에이전트 작업 — 이라면 Kimi K3는 그 프리미엄 값을 한다. 그에 반대하는 솔직한 논거는 나머지 전부다: 처리량, 캐시 경제성, 토큰당 가격 그 자체.
9월의 반전이 여기서 중요한 또 다른 이유: 한 달 전만 해도 현명한 조언은 "값싸고 빠른 오픈 모델로 표준화할 생각이라면 헤지하라 — 그 모델은 은퇴할 수도 있다"였다. 9월 15일부로 그 헤지는 무효가 되었다. DeepSeek는 V4 Pro를 API에 유지하겠다고 공개적으로 약속했고, 변경이 있으면 통지하겠다고 약속했으며, MIT 라이선스는 DeepSeek가 자사 API로 무엇을 하든 이 모델을 자체 하드웨어에 계속 배포할 수 있음을 의미한다. Kimi K3의 오픈 웨이트는 반대편에서도 같은 자유를 주며, 그래서 이것은 서비스와 제품 간의 싸움이 아니라 진정한 두 오픈 웨이트 비교가 된다.

두 모델 모두 OrcaRouter에 있습니다 — DeepSeek V4 Pro와 Kimi K3 모두 플랫폼을 통해 라우팅됩니다하나의 키로, 제공업체 정가가 마크업 없이 그대로 전달되며 — 그리고 라우팅 DSL은 이 맞대결을 나누는 자연스러운 방법입니다: 장기 지평 추론 작업은 9점이 제값을 하는 Kimi K3로 라우팅하고, 토큰 집약적인 처리량 작업은 7.5배의 가격 차이와 2.3배의 속도 차이가 알아서 해 주는 DeepSeek V4 Pro로 라우팅하세요. 두 모델은 경쟁자인 만큼이나 자주 상호 보완적이며, 플랫폼은 둘 다 실행하는 것을 하나를 실행하는 것과 같은 수고로 만들어 줍니다.


요점
Kimi K3는 더 똑똑한 오픈 웨이트 모델로, 지수 9점 앞서 있으며, 그 프리미엄 — 출력 토큰 기준 7.5배, 속도는 대략 절반 — 은 반올림 오차가 아니라 실질적인 비용이다. DeepSeek V4 Pro는 빠르고 저렴하며 오래가는 일꾼이고, 9월 11일 이후로는 더 이상 이탈 위험 요인이 아니다. 실용적인 답은 두 가격 열이 모두 가리키는 바로 그 답이다: 작업이 어려운 추론이라면 Kimi K3를 사고, 토큰을 많이 쓰고 시간에 민감한 작업이라면 DeepSeek V4 Pro를 사며, 두 종류를 모두 가지고 있다면 둘 다 실행해 작업별로 라우팅하라.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
