
DeepSeek V4 Pro vs MiniMax M3: O Mesmo Jogo de Pesos Abertos a Cinco Vezes o Preço
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligência69Código
DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (MiniMax's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, DeepSeek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.
As medições independentes abaixo são da Artificial Analysis. Os valores reportados pelos fornecedores estão identificados como tal.
Dois carros-chefe de pesos abertos e baixo custo, separados por um ponto no índice
No Artificial Analysis Intelligence Index, o MiniMax M3 obtém 30 pontos, ficando em #16 na sua categoria, e o DeepSeek V4 Pro obtém 36 pontos, ficando em #7. Uma diferença de seis pontos entre modelos que custam quase o mesmo por token. Essa é a manchete: o modelo mais caro também é o mensuravelmente mais inteligente — mas apenas por seis pontos, e apenas no eixo de texto puro, onde o V4 Pro atua. O MiniMax M3 aceita entrada de texto, imagem e vídeo; o V4 Pro é somente texto. Se a entrada multimodal for um requisito, a comparação termina aí — o MiniMax M3 é o único dos dois que lê vídeo.
• Índice de Inteligência — V4 Pro 36 (#7/113) vs MiniMax M3 30 (#16/113)
• Preço — MiniMax M3 $0.30/$1.20 por 1M vs V4 Pro $0.66/$1.98 fora de pico ($1.32/$3.96 em pico)
• Velocidade — MiniMax M3 ~103 tokens/seg vs V4 Pro ~81 tokens/seg
• Contexto — ambos com 1M tokens
• Parâmetros — MiniMax M3 428B no total / 23B ativos vs V4 Pro 1.6T no total / 49B ativos
• Entrada — MiniMax M3 texto/imagem/vídeo vs V4 Pro apenas texto
• License — MiniMax Community License vs V4 Pro MIT
A corrida de preços está mais acirrada do que a etiqueta sugere.
Comparados lado a lado, o MiniMax M3 é 2,2 vezes mais barato na entrada e 1,65 vez mais barato na saída do que a tarifa fora de pico do V4 Pro. Mas os preços de tabela escondem a mecânica de cache e de pico. A janela fora de pico do V4 Pro corta pela metade seus preços já baixos, e seu desconto de leitura de cache chega a cerca de 97% — aproximadamente US$ 0,02 por milhão de tokens em cache fora de pico. O preço de cache do MiniMax M3 é menos agressivo. Para uma carga de trabalho que reutiliza um grande prefixo — um grande prompt de sistema, um documento longo, um corpus de recuperação —, o custo efetivo por token do V4 Pro em sua janela de cache fora de pico pode ficar abaixo do preço anunciado do MiniMax M3, o que é uma inversão surpreendente do ranking de preços de tabela. Em cargas de trabalho com tokens novos, o MiniMax M3 é mais barato; em cargas de trabalho com uso intenso de cache, o V4 Pro pode vencer.
A velocidade conta uma história semelhante em sentido inverso. O MiniMax M3 gera cerca de 103 tokens por segundo, em comparação com 81 do V4 Pro — o mais rápido de qualquer modelo na sua faixa de preço, e mais rápido do que vários modelos que custam cinco vezes mais. A vantagem de velocidade é real, mas não é enorme; a vantagem de preço importa mais, e depende da carga de trabalho.
Licença e durabilidade: onde setembro mudou a resposta
Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINIMAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.
A questão da durabilidade, que era real um mês atrás, é a notícia de setembro. A DeepSeek passou a primeira metade de setembro anunciando a aposentadoria do V4 Pro para 14 de setembro, adiando-a e, depois — no dia 11 —, cancelando-a, com um compromisso público de continuar a servir o modelo com cobrança inalterada e de avisar caso isso mude. O MiniMax M3 não tem esse drama porque nenhum era esperado: é um modelo flagship jovem, sem aposentadoria à vista. Mas o efeito é o mesmo: ambos os lados deste confronto agora têm um roteiro claro, o que é mais do que se poderia dizer de um deles duas semanas atrás.

Quem deve escolher qual
Se sua carga de trabalho inclui entrada de imagem ou vídeo, a decisão está tomada: o MiniMax M3 é o único dos dois que consegue lê-las, pelo preço mais baixo da categoria. Se sua carga de trabalho for somente texto e intensiva em cache — agentes com grandes prompts de sistema, RAG de documentos longos, sumarização de grandes corpora —, a janela de cache fora de pico e a licença MIT do V4 Pro fazem dele a melhor escolha de custo por resposta, especialmente porque agora há garantia de que ele continuará disponível. Se sua carga de trabalho for somente texto e sensível à latência, os 103 tokens/s e US$ 0,30/US$ 1,20 do MiniMax M3 fazem dele a opção barata mais rápida do mercado.
Ambos os modelos estão disponíveis pelo OrcaRouter em uma única chave, com os preços de tabela dos provedores repassados sem markup — então os números acima são os números que você paga — e o failover automático entre provedores é a resposta prática para a única coisa que esta comparação não consegue resolver de antemão: qual provedor de modelo vai aguentar sob a sua carga real. Encaminhar o tráfego multimodal para o MiniMax M3 e o trabalho de texto de contexto longo para o DeepSeek V4 Pro é uma alteração de duas linhas no DSL de roteamento, e o failover significa que uma oscilação de um provedor de qualquer lado é uma nova tentativa, não um incidente.


O veredito
Este é o confronto mais acirrado da linha DeepSeek V4 Pro, porque ambos os modelos são baratos, ambos têm pesos abertos e ambos são rápidos. O MiniMax M3 vence em preço bruto, velocidade e entrada multimodal. O DeepSeek V4 Pro vence em inteligência, clareza de licença e — desde 11 de setembro — certeza de durabilidade. A resposta em uma linha: texto multimodal ou crítico em termos de latência vai para o MiniMax M3; cargas de trabalho com uso intenso de cache, somente texto ou juridicamente sensíveis vão para o DeepSeek V4 Pro.
Encaminhe o tráfego multimodal para o MiniMax M3 e o trabalho de texto de contexto longo para o DeepSeek V4 Pro: MiniMax M3 uma alteração de duas linhas no DSL de roteamento.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
