
DeepSeek V4 Pro vs MiniMax M3: 다섯 배 가격에 똑같은 오픈 웨이트 게임
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (MiniMax's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, DeepSeek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.
아래의 독립적 측정값은 Artificial Analysis에서 제공한 것입니다. 공급업체가 보고한 수치는 그렇게 표기되어 있습니다.
가성비 오픈 웨이트 플래그십 둘, 단 1점 차이
Artificial Analysis Intelligence Index에서 MiniMax M3는 30점으로 해당 클래스에서 #16위를 기록했고, DeepSeek V4 Pro는 36점으로 #7위를 기록했습니다. 토큰당 비용이 거의 같은 두 모델 사이의 6점 차이입니다. 이것이 핵심입니다: 더 비싼 모델이 측정 가능하게 더 똑똑한 모델이기도 하지만, 그 차이는 단 6점이며, V4 Pro가 속한 텍스트 전용 축에서만 그렇습니다. MiniMax M3는 텍스트, 이미지, 비디오 입력을 지원하지만, V4 Pro는 텍스트 전용입니다. 멀티모달 입력이 요구사항이라면 비교는 거기서 끝입니다 — MiniMax M3는 둘 중 유일하게 비디오를 읽습니다.
• 인텔리전스 지수 — V4 Pro 36 (#7/113) vs MiniMax M3 30 (#16/113)
• 가격 — MiniMax M3 100만 토큰당 $0.30/$1.20 vs V4 Pro 비혼잡 시간대 $0.66/$1.98 (혼잡 시간대 $1.32/$3.96)
• 속도 — MiniMax M3 ~103 토큰/초 vs V4 Pro ~81 토큰/초
• 컨텍스트 — 둘 다 1M 토큰
• 파라미터 — MiniMax M3 총 428B / 활성 23B vs V4 Pro 총 1.6T / 활성 49B
• 입력 — MiniMax M3 텍스트/이미지/비디오 vs V4 Pro 텍스트 전용
• License — MiniMax Community License vs V4 Pro MIT
가격 경쟁은 스티커가 시사하는 것보다 더 치열하다
일대일로 비교하면 MiniMax M3는 입력에서 V4 Pro의 오프피크 요율보다 2.2배 저렴하고, 출력에서는 1.65배 저렴합니다. 하지만 표시 가격은 캐시와 피크 메커니즘을 숨깁니다. V4 Pro의 오프피크 시간대는 이미 낮은 가격을 절반으로 깎고, 캐시 읽기 할인은 약 97%에 이릅니다 — 오프피크 기준 백만 캐시 토큰당 약 $0.02입니다. MiniMax M3의 캐시 가격 책정은 덜 공격적입니다. 큰 프리픽스 — 대형 시스템 프롬프트, 긴 문서, 검색 코퍼스 — 를 재사용하는 워크로드의 경우, V4 Pro의 오프피크 캐시 시간대에서 토큰당 실효 비용은 MiniMax M3의 대표 가격을 밑돌 수 있으며, 이는 표시 가격 순위의 놀라운 역전입니다. 새 토큰 워크로드에서는 MiniMax M3가 더 저렴하고, 캐시가 많은 워크로드에서는 V4 Pro가 이길 수 있습니다.
속도는 비슷한 이야기를 거꾸로 들려준다. MiniMax M3는 초당 약 103개 토큰을 출력하는 반면 V4 Pro는 81개다. 이는 같은 가격대의 어떤 모델보다도 빠르고, 다섯 배 비용이 드는 여러 모델보다도 빠르다. 속도 우위는 실재하지만 그리 크지는 않다. 가격 우위가 더 중요하며, 이는 작업 부하에 따라 달라진다.
라이선스와 내구성: 9월이 답을 바꾼 곳
Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINIMAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.
한 달 전에는 실질적인 문제였던 지속성 질문이 이제 9월의 뉴스다. DeepSeek는 9월 상순을 V4 Pro의 9월 14일 서비스 종료 발표, 연기, 그리고 11일의 취소에 썼으며, 변경되지 않은 과금으로 모델을 계속 제공하고 상황이 바뀌면 공지하겠다고 공개적으로 약속했다. MiniMax M3에는 그런 소동이 없는데, 예상되지 않았기 때문이다: 서비스 종료 계획이 없는 젊은 플래그십이다. 그러나 효과는 같다: 이 맞대결의 양측 모두 이제 명확한 로드맵을 갖고 있으며, 이는 2주 전 둘 중 한쪽에 대해서는 할 수 없었던 말이다.

누가 어떤 것을 골라야 하나요
워크로드에 이미지나 동영상 입력이 포함된다면 결정은 이미 내려졌습니다: MiniMax M3는 둘 중 유일하게 이를 읽는 모델이며, 동급 최저 가격입니다. 워크로드가 텍스트 전용이고 캐시 비중이 높다면 — 대규모 시스템 프롬프트를 사용하는 에이전트, 장문 문서 RAG, 대규모 코퍼스 요약 — V4 Pro의 오프피크 캐시 윈도와 MIT 라이선스가 답변당 비용 측면에서 더 나은 선택이 되게 해줍니다, 특히 이제 유지가 보장되었으므로 더욱 그렇습니다. 워크로드가 텍스트 전용이고 지연 시간에 민감하다면, MiniMax M3의 초당 103 토큰과 $0.30/$1.20는 시장에서 가장 빠른 저렴한 옵션입니다.
두 모델 모두 하나의 키로 OrcaRouter를 통해 사용할 수 있으며, 공급자 정가가 마크업 없이 그대로 전달되므로 — 위의 숫자가 곧 지불하는 금액입니다 — 공급자 간 자동 페일오버는 이번 비교에서 미리 결론 낼 수 없는 단 한 가지, 즉 실제 부하에서 어느 모델의 공급자가 버텨줄지에 대한 실질적인 해답입니다. 멀티모달 트래픽을 MiniMax M3로, 롱컨텍스트 텍스트 작업을 DeepSeek V4 Pro로 라우팅하는 것은 두 줄짜리 라우팅 DSL 변경이며, 페일오버 덕분에 어느 쪽이든 공급자가 흔들리는 것은 장애가 아니라 재시도일 뿐입니다.


평결
DeepSeek V4 Pro 라인업에서 가장 접전인 맞대결입니다. 두 모델 모두 저렴하고, 둘 다 오픈 웨이트이며, 둘 다 빠르기 때문입니다. MiniMax M3는 순수 가격, 속도, 멀티모달 입력에서 앞섭니다. DeepSeek V4 Pro는 지능, 라이선스 청결성, 그리고 — 9월 11일 이후로는 — 지속성 확실성에서 앞섭니다. 한 줄로 답하면: 멀티모달이거나 지연이 중요한 텍스트는 MiniMax M3로, 캐시가 많거나 텍스트 전용이거나 법적으로 민감한 워크로드는 DeepSeek V4 Pro로 갑니다.
멀티모달 트래픽은 MiniMax M3로, 롱 컨텍스트 텍스트 작업은 DeepSeek V4 Pro로 라우팅하세요: MiniMax M3 라우팅 DSL을 두 줄만 바꾸면 됩니다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
