Cartão de título comparando Step 5 Preview e MiniMax M3 no custo por tarefa do Artificial Analysis Intelligence Index, mostrando $0,71 em um índice de 44 para Step 5 Preview e $0,51 em um índice de 29 para MiniMax M3.
Guides & Insights

Step 5 Preview vs MiniMax M3: Mais Barato por Token, Mais Caro por Ponto

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

O preço unitário favorece o MiniMax M3 por uma margem ampla. A $0,30 por milhão de tokens de entrada e $1,20 por milhão de tokens de saída, o modelo esparso de 428B do fornecedor cobra menos da metade dos $1,00 e $2,70 do Step 5 Preview, tanto na entrada quanto na saída. Mas o preço unitário é o denominador errado para um modelo que você usa para responder perguntas, e quando se divide pelo que cada modelo realmente entrega, o ranking se inverte. O Step 5 Preview custa $0,71 por tarefa do Intelligence Index com uma pontuação de 44. O MiniMax M3 custa $0,51 por tarefa do índice com uma pontuação de 29. Por ponto de capacidade medida, o modelo com o preço de etiqueta mais alto é o mais barato — e a razão é uma diferença de quinze pontos no índice que nenhum desconto consegue fechar.

Dois tipos muito diferentes de "disponível"

O MiniMax M3 está disponível de forma geral desde 1º de junho de 2026, quando a MiniMax o disponibilizou por meio do MiniMax Code, do seu Token Plan e da API — sem qualquer rótulo de pré-visualização no lançamento. Os pesos vieram em 12 de junho, onze dias depois, conforme prometido. O repositório MiniMaxAI/MiniMax-M3 carrega aproximadamente 428 bilhões de parâmetros totais, com cerca de 23 bilhões ativos por token, construído sobre o MiniMax Sparse Attention, além de uma versão separada quantizada em MXFP8.

O Step 5 Preview abriu sua API em 20 de setembro de 2026. Seus pesos não foram publicados — o repositório no Hugging Face stepfun-ai/Step-5-Preview-BF16 é uma casca vazia — e a StepFun se comprometeu com uma data de 15 de outubro de 2026. Portanto, a diferença prática é que o M3 é um modelo que você pode baixar, hospedar por conta própria e inspecionar, enquanto o Step 5 Preview é um endpoint hospedado com uma intenção publicada.

Vale a pena destacar: a própria página do modelo da MiniMax ainda diz que o M3 "em breve terá seu código totalmente aberto", o que contradiz o repositório que ela publicou em junho. Trate isso como uma página desatualizada do fornecedor, e não como evidência de que os pesos estão faltando.

A história do preço não é a história do custo

A Artificial Analysis calcula um valor de custo por tarefa de índice executando o mesmo conjunto de avaliação por cada modelo e somando o que os tokens custam. É o que o setor tem de mais próximo de um número de custo total de propriedade para uma quantidade fixa de trabalho, e incorpora os dois efeitos que os preços dos tokens escondem: quão verboso é um modelo e quanto de raciocínio ele faz.

O Step 5 Preview fica em $0,71 por tarefa de índice, com um custo total de execução do índice de $922,84. O MiniMax M3 fica em $0,51, com um custo total de execução de $537,98. Em termos de vazão bruta de tarefas, o M3 é cerca de 28% mais barato. Divida pela pontuação do índice — 44 contra 29 — e o Step 5 Preview chega a aproximadamente 1,6 centavo por ponto de índice, contra 1,8 centavo do M3.

Uma ressalva cabe bem aqui: trata-se de uma única execução do índice por modelo, e uma execução do índice é uma amostra pequena. A aritmética por ponto é uma verificação de sanidade sobre o valor por tarefa, não um benchmark por si só. Mas a direção é consistente com os números por tarefa, e esses são os números que as próprias listas de preços dos dois fornecedores não conseguem mostrar.

Intelligence Index — Step 5 Preview 44 (#24 de 200) vs. MiniMax M3 29 (#15 de 113), ambos na versão atual do índice

Preço de entrada — $1,00 por milhão vs $0,30 por milhão

Preço de saída — $2,70 por milhão vs $1,20 por milhão

Custo por tarefa de indexação — $0,71 vs $0,51

Parâmetros ativos — 27B vs 23B

Janela de contexto — 1M tokens vs 1M tokens

Velocidade de saída — 99,8 tokens/s vs 210,4 tokens/s

Pesos — prometido para 15 de outubro de 2026 vs disponível desde 12 de junho de 2026

A comparison scoreboard for Step 5 Preview and MiniMax M3 covering Intelligence Index, output price, cost per index task, output speed, weight availability, and licensing terms.

A armadilha da versão do índice que torna isso confuso

Há um risco genuíno ao ler os números do M3, e vale um parágrafo porque isso confunde quase todas as páginas de comparação de terceiros. A Artificial Analysis recalibrou seu Intelligence Index em 7 de setembro de 2026, e a recalibração comprimiu as pontuações em geral. Na escala atual, o M3 mede 29. Na escala anterior a setembro, ele media 44 a 45 — e vários rastreadores ainda publicam 44,4 ou 45,4 para ele.

Essa colisão importa mais do que o habitual aqui, porque a pontuação atual do Step 5 Preview também é 44. Uma página que coloca um número desatualizado do M3 ao lado de um número atual do Step 5 Preview parece mostrar dois modelos empatados, quando a diferença atual é de quinze pontos. Ambos os números neste artigo são da versão atual do índice e são comparáveis entre si; qualquer coisa publicada antes de 7 de setembro não é.

Onde o MiniMax M3 é genuinamente difícil de superar

Duas coisas sobre o M3 não estão nem perto. A primeira é a velocidade: 210,4 tokens de saída por segundo, o quarto mais rápido dos 113 modelos que o Artificial Analysis acompanha, contra uma mediana de 76,3. Os 99,8 tokens por segundo do Step 5 Preview são respeitáveis e menos da metade disso. O tempo até o primeiro token do M3, de 1,01 segundo, também é o número mais rápido, contra 2,96 segundos.

A segunda é a modalidade de entrada. O M3 aceita texto, imagem e vídeo e retorna texto, e o MiniMax documenta operação de desktop e de uso do computador. O Step 5 Preview aceita texto e imagens. Se seu pipeline alimenta gravações de tela ou quadros de vídeo em um modelo, isso não é uma preferência — é uma diferença de capacidade.

A diferença de preço reforça ambos. A US$ 0,30 e US$ 1,20 com um desconto permanente de 50% aplicado a uma tabela de US$ 0,60 e US$ 2,40, e um desconto de cache de 80% que reduz as leituras de cache para US$ 0,06 por milhão, o M3 é uma das formas mais baratas de mover um grande volume de tokens por um modelo capaz. Observe o escalonamento: entradas acima de 512 mil tokens dobram a requisição inteira, e o nível de serviço prioritário custa 1,5×.

Onde isso se desfaz

O conjunto de avaliação próprio da MiniMax para o M3 é sólido e deve ser interpretado como dados divulgados pelo fornecedor: SWE-bench Verified com 80,5%, SWE-bench Pro com 59,0%, Terminal-Bench 2.1 com 66,0%, MCP Atlas com 74,2%, BrowseComp com 83,5 e OSWorld-Verified com 70,06%. A MiniMax executou esses testes em sua própria infraestrutura, usando Claude Code como scaffolding, com média de quatro execuções, e a configuração de pontuação não é pública — portanto, no estado atual, eles não são reproduzíveis por terceiros.

O quadro medido de forma independente é muito mais severo em relação ao trabalho agêntico. A Artificial Analysis registrou Terminal-Bench 4.0 em 2% para o M3 — uma versão diferente do benchmark em comparação com o valor de Terminal-Bench 2.1 do fornecedor, e não comparável a ele, mas ainda assim contundente. SciCode ficou em 47%, AutomationBench-AA em 21% e CritPt em 4%. Os resultados independentes mais fortes do M3 são em contexto longo e trabalho de conhecimento: AA-LCR v1.1 em 83%, Humanity's Last Exam em 39%.

Step 5 Preview inverte esse perfil. Terminal-Bench 4.0 com 33,3% no mesmo harness que os 2% do M3, SciCode com 59% contra 47%. Se o trabalho for agêntico ou tiver formato de código, esta não é uma comparação acirrada, e a vantagem de preço não compensa isso.

The Hugging Face repository page for stepfun-ai Step-5-Preview-BF16, showing an empty repository with no model card and no files, indicating the weights have not been published.

A cláusula de licença que a maioria das comparações ignora

O MiniMax M3 tem pesos abertos, mas não é open source no sentido da OSI, e os termos são mais rigorosos do que a expressão "pesos abertos" sugere. O repositório traz a MiniMax Community License: gratuita para uso não comercial, com o uso comercial condicionado a exibir com destaque "Built with MiniMax M3" — e qualquer produto com mais de US$ 20 milhões em receita anual exige autorização prévia por escrito da MiniMax. Não é MIT, nem Apache, nem o tipo de licença que um departamento jurídico aprova sem objeções.

O Step 5 Preview ainda não pode ser avaliado de forma alguma neste eixo, porque não há licença para ler. A StepFun comprometeu-se a fazer um lançamento de pesos em 15 de outubro e não publicou os termos que o regerão. Qualquer pessoa que planeje desenvolver com base nele deve tratar a licença como uma questão em aberto, em vez de presumir que ela se assemelhará à da Moonshot ou da DeepSeek.

Esta é a assimetria honesta entre os dois: os termos do M3 são restritivos, mas conhecidos; os do Step 5 Preview são desconhecidos. Uma licença restritiva com que se pode planear é melhor do que uma não anunciada com que não se pode.

Ligando para qualquer um deles

O MiniMax M3 está no nosso catálogo em /models/minimax/minimax-m3, acessível através da mesma chave e formato de requisição do restante dos mais de 200 modelos que roteamos, com o preço de tabela do fornecedor repassado a 0% de margem — por isso, o desconto permanente de 50% aplicado pela MiniMax é o preço que você vê, e ele muda no dia em que a MiniMax o mudar. O failover automático é a outra metade disso: o M3 a 210 tokens por segundo é atraente para trabalhos de alto volume, e trabalhos de alto volume são exatamente onde um único endpoint degradado causa mais dano.

O Step 5 Preview não está no nosso catálogo. Os modelos de texto da StepFun não estão entre os que atendemos, portanto ele está disponível por meio da própria API da StepFun e de várias plataformas de terceiros — e não é acessível com a chave que você usaria para o M3.

OrcaRouter model page for MiniMax M3, showing the model in the catalogue with its provider, context window and per-million-token pricing.

O veredito

Escolha o MiniMax M3 quando volume, latência ou entrada de vídeo forem a restrição, quando você quiser um modelo que possa baixar hoje e quando puder conviver com a licença comunitária — incluindo o limite de receita de 20 milhões de dólares. Aceite que pontuações agênticas independentes o colocam muito atrás e que seus benchmarks do fornecedor não foram reproduzidos fora da própria infraestrutura da MiniMax.

Opte pelo Step 5 Preview quando o trabalho for agêntico ou envolver muito código, quando você quiser capacidade por dólar em vez de token por dólar, e quando estiver confortável em ser um cliente inicial de um endpoint hospedado cujos pesos chegam no próximo mês. Aceite que você não pode verificar a licença antes de construir e que uma diferença de 2% contra 33,3% no Terminal-Bench 4.0 é o tipo de lacuna que decide um projeto.

O desconto é real. Apenas não é o item que está sendo comprado.

O MiniMax M3 é um dos modelos que roteamos com 0% de markup com failover automático, então uma alteração de preço do fornecedor entra em vigor na mesma chave no mesmo dia.