Um cartão de destaque gerado intitulado 'DeepSeek V4 Pro vs MiniMax M3' com um ícone de carteira fino à esquerda rotulado 'MiniMax M3' com o selo '$0.30/$1.20 · texto+imagem+vídeo' e um ícone de carteira um pouco maior à direita rotulado 'DeepSeek V4 Pro' com o selo '$0.66/$1.98 fora de pico · MIT', com um pequeno ícone de saldo entre eles e o rodapé 'O mesmo jogo de pesos abertos a cinco vezes o preço'.
Guides & Insights

DeepSeek V4 Pro vs MiniMax M3: O Mesmo Jogo de Pesos Abertos a Cinco Vezes o Preço

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (Mini​Max's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, Deep​Seek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.

As medições independentes abaixo são da Artificial Analysis. Os valores reportados pelos fornecedores estão identificados como tal.

Dois carros-chefe de pesos abertos e baixo custo, separados por um ponto no índice

No Artificial Analysis Intelligence Index, o MiniMax M3 obtém 30 pontos, ficando em #16 na sua categoria, e o DeepSeek V4 Pro obtém 36 pontos, ficando em #7. Uma diferença de seis pontos entre modelos que custam quase o mesmo por token. Essa é a manchete: o modelo mais caro também é o mensuravelmente mais inteligente — mas apenas por seis pontos, e apenas no eixo de texto puro, onde o V4 Pro atua. O MiniMax M3 aceita entrada de texto, imagem e vídeo; o V4 Pro é somente texto. Se a entrada multimodal for um requisito, a comparação termina aí — o MiniMax M3 é o único dos dois que lê vídeo.

• Índice de Inteligência — V4 Pro 36 (#7/113) vs MiniMax M3 30 (#16/113)

• Preço — MiniMax M3 $0.30/$1.20 por 1M vs V4 Pro $0.66/$1.98 fora de pico ($1.32/$3.96 em pico)

• Velocidade — MiniMax M3 ~103 tokens/seg vs V4 Pro ~81 tokens/seg

• Contexto — ambos com 1M tokens

• Parâmetros — MiniMax M3 428B no total / 23B ativos vs V4 Pro 1.6T no total / 49B ativos

• Entrada — MiniMax M3 texto/imagem/vídeo vs V4 Pro apenas texto

• License — Mini​Max Community License vs V4 Pro MIT

A corrida de preços está mais acirrada do que a etiqueta sugere.

Comparados lado a lado, o MiniMax M3 é 2,2 vezes mais barato na entrada e 1,65 vez mais barato na saída do que a tarifa fora de pico do V4 Pro. Mas os preços de tabela escondem a mecânica de cache e de pico. A janela fora de pico do V4 Pro corta pela metade seus preços já baixos, e seu desconto de leitura de cache chega a cerca de 97% — aproximadamente US$ 0,02 por milhão de tokens em cache fora de pico. O preço de cache do MiniMax M3 é menos agressivo. Para uma carga de trabalho que reutiliza um grande prefixo — um grande prompt de sistema, um documento longo, um corpus de recuperação —, o custo efetivo por token do V4 Pro em sua janela de cache fora de pico pode ficar abaixo do preço anunciado do MiniMax M3, o que é uma inversão surpreendente do ranking de preços de tabela. Em cargas de trabalho com tokens novos, o MiniMax M3 é mais barato; em cargas de trabalho com uso intenso de cache, o V4 Pro pode vencer.

A velocidade conta uma história semelhante em sentido inverso. O MiniMax M3 gera cerca de 103 tokens por segundo, em comparação com 81 do V4 Pro — o mais rápido de qualquer modelo na sua faixa de preço, e mais rápido do que vários modelos que custam cinco vezes mais. A vantagem de velocidade é real, mas não é enorme; a vantagem de preço importa mais, e depende da carga de trabalho.

Licença e durabilidade: onde setembro mudou a resposta

Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINI​MAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.

A questão da durabilidade, que era real um mês atrás, é a notícia de setembro. A Deep​Seek passou a primeira metade de setembro anunciando a aposentadoria do V4 Pro para 14 de setembro, adiando-a e, depois — no dia 11 —, cancelando-a, com um compromisso público de continuar a servir o modelo com cobrança inalterada e de avisar caso isso mude. O MiniMax M3 não tem esse drama porque nenhum era esperado: é um modelo flagship jovem, sem aposentadoria à vista. Mas o efeito é o mesmo: ambos os lados deste confronto agora têm um roteiro claro, o que é mais do que se poderia dizer de um deles duas semanas atrás.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at $1.32 input and $3.96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Quem deve escolher qual

Se sua carga de trabalho inclui entrada de imagem ou vídeo, a decisão está tomada: o MiniMax M3 é o único dos dois que consegue lê-las, pelo preço mais baixo da categoria. Se sua carga de trabalho for somente texto e intensiva em cache — agentes com grandes prompts de sistema, RAG de documentos longos, sumarização de grandes corpora —, a janela de cache fora de pico e a licença MIT do V4 Pro fazem dele a melhor escolha de custo por resposta, especialmente porque agora há garantia de que ele continuará disponível. Se sua carga de trabalho for somente texto e sensível à latência, os 103 tokens/s e US$ 0,30/US$ 1,20 do MiniMax M3 fazem dele a opção barata mais rápida do mercado.

Ambos os modelos estão disponíveis pelo OrcaRouter em uma única chave, com os preços de tabela dos provedores repassados sem markup — então os números acima são os números que você paga — e o failover automático entre provedores é a resposta prática para a única coisa que esta comparação não consegue resolver de antemão: qual provedor de modelo vai aguentar sob a sua carga real. Encaminhar o tráfego multimodal para o MiniMax M3 e o trabalho de texto de contexto longo para o DeepSeek V4 Pro é uma alteração de duas linhas no DSL de roteamento, e o failover significa que uma oscilação de um provedor de qualquer lado é uma nova tentativa, não um incidente.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of $0.66 and output price of $1.98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs MiniMax M3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, Input text, Weights MIT; right column MiniMax M3 rows AA Index 30 (#16/113), Price $0.30/$1.20, Speed ~103 tok/s, Context 1M, Input text+image+video, Weights Community License; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

O veredito

Este é o confronto mais acirrado da linha DeepSeek V4 Pro, porque ambos os modelos são baratos, ambos têm pesos abertos e ambos são rápidos. O MiniMax M3 vence em preço bruto, velocidade e entrada multimodal. O DeepSeek V4 Pro vence em inteligência, clareza de licença e — desde 11 de setembro — certeza de durabilidade. A resposta em uma linha: texto multimodal ou crítico em termos de latência vai para o MiniMax M3; cargas de trabalho com uso intenso de cache, somente texto ou juridicamente sensíveis vão para o DeepSeek V4 Pro.

Encaminhe o tráfego multimodal para o MiniMax M3 e o trabalho de texto de contexto longo para o DeepSeek V4 Pro: MiniMax M3 uma alteração de duas linhas no DSL de roteamento.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente