Cartão principal com o título 'MiMo-V2.6-Pro vs MiMo-V2.6', com o subtítulo 'Um é um checkpoint. O outro é um rótulo.', e dois painéis: um painel à esquerda com o título 'MiMo-V2.6-Pro' exibindo 'Pesos, preço, índice 46,3' e 'Custo por tarefa $0,13', e um painel à direita com o título 'MiMo-V2.6' exibindo 'O nome da série' e 'Abrange Pro e Flash', sobre um rodapé exibindo 'Diferença de preço entre os dois checkpoints que abrange: 3,1x'.
Guides & Insights

MiMo-V2.6-Pro vs MiMo-V2.6: Quando um Nome de Modelo Deixa de Ser um Modelo

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Artificial Analysis tem uma página para o MiMo-V2.5. Não tem uma página para o MiMo-V2.6. Essa ausência é toda a história deste confronto: na geração passada, o número de versão puro apontava para um checkpoint que você podia baixar e chamar. Nesta geração, não. O Xiaomi MiMo-V2.6-Pro é um modelo com pesos, um preço e uma pontuação medida de forma independente. "MiMo-V2.6" é um rótulo que fica acima dele, e os dois não estão na mesma categoria de coisa — o que faz disto uma comparação entre um checkpoint e um nome, não entre dois modelos.

Vale a pena ser preciso sobre isso, porque a diferença tem um preço atrelado. O Xiaomi MiMo-V2.6-Pro está listado a $0,435 por milhão de tokens de entrada e $0,87 por milhão de saída. O Xiaomi MiMo-V2.6-Flash, o outro checkpoint que o rótulo abrange, está listado a $0,14 e $0,28. Se você escolheu o errado entre esses porque um catálogo, um arquivo de configuração ou uma planilha de compras dizia "MiMo-V2.6" e nada mais, você está errado por um fator de três antes mesmo de fazer uma única chamada.

Para o que "MiMo-V2.6" resolve

Três coisas diferentes, dependendo de onde você lê.

O primeiro é a série. O próprio material de lançamento da Xiaomi descreve a geração V2.6 como contendo dois checkpoints omnimodais nativos, Pro e Flash, publicados como execuções de treinamento separadas. A coleção do Hugging Face que os contém chama-se, simplesmente, MiMo-V2.6 — atualmente ela lista três itens, contando com a camada de serviço Pro-UltraSpeed, e esse nome de coleção é o lugar mais provável para alguém descobrir o número de versão isolado e presumir que ele nomeia um modelo.

A segunda é uma forma abreviada de se referir ao carro-chefe. Na maioria da cobertura de lançamento e na maioria das conversas abreviadas, "MiMo-V2.6" significa o nível de um trilhão de parâmetros, porque é o modelo sobre o qual a cobertura tratava. Esta é a interpretação que causa menos dano, já que geralmente corresponde ao modelo que as pessoas queriam dizer.

O terceiro é o que custa dinheiro: um catálogo ou uma configuração em que "MiMo-V2.6" acabou reduzido ao checkpoint que o fornecedor por acaso disponibiliza. Os repositórios têm os nomes MiMo-V2.6-Pro-RL e MiMo-V2.6-Flash-RL, e o sufixo -RL é linhagem de pós-treinamento, e não um adaptador sobre um modelo base — um detalhe que vale a pena saber antes de sair à procura dos pesos não-RL que fazem par com eles, porque não existe nenhum.

O segmento intermediário que deixou de existir

A ambiguidade é nova, e a razão é que o meio da escalação desapareceu.

A Artificial Analysis ainda lista um modelo chamado MiMo-V2.5, lançado em 22 de abril de 2026, com pontuação de 25,17 no índice a US$ 0,14 por milhão de tokens de entrada e US$ 0,28 de saída, com pesos abertos. Ele fica abaixo do MiMo-V2.5-Pro, que obteve 26,0 na mesma escala a US$ 0,435 e US$ 0,87 com contexto de 1M e 1023B de parâmetros totais. Essa foi uma geração de três níveis: um modelo barato de nome simples, um carro-chefe, e nada que o forçasse a escolher entre os dois extremos.

A geração V2.6 tem dois níveis que qualquer pessoa pode chamar: Pro no topo e Flash na base. Não há um checkpoint de nível intermediário para absorver o tráfego que fica entre eles, e nenhum dos materiais de lançamento descreve um. A Xiaomi de fato publicou um ponto de partida MiMo-V2.6-Distill-Qwen-9B e um framework de RL junto com os pesos, mas um ponto de partida de destilação para trabalho de treinamento não é um nível intermediário hospedado para inferência.

Na prática, isso significa que a decisão descrita nesta página — Pro ou o nome simples — é, na verdade, uma decisão sobre em qual degrau você está. Se o que você realmente quer é o antigo espaço do MiMo-V2.5, a coisa mais próxima na nova geração é o Flash, nos mesmos $0.14/$0.28 e com uma alegação de capacidade muito mais alta associada.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6 — the scoreboard'. The left column, MiMo-V2.6-Pro, reads What it is a checkpoint, Index 46.3 measured, Price $0.435 / $0.87, Weights MIT on Hugging Face, Context 1M tokens, API providers one. The right column, MiMo-V2.6, reads What it is the series label, Index not measured, Price $0.14 to $0.87, Weights held by Pro and Flash, Context 1M on both, API providers none per the model cards. A footer reads 'Pro figures measured by Artificial Analysis v4.3.2; series facts per Xiaomi's release material.'

A atualização que o nome esconde

Deixe de lado a questão do nome e há um fato claro, amplo e bem comprovado por baixo disso: o carro-chefe avançou muito em uma geração sem alterar seu preço.

• Pontuação no índice — MiMo-V2.5-Pro 26,0 no Artificial Analysis Intelligence Index, contra 46,3 do Xiaomi MiMo-V2.6-Pro, ambos conforme medidos pela Artificial Analysis e não pela Xiaomi
• Preço por token — inalterado: US$ 0,435 na entrada, US$ 0,87 na saída, em ambas as gerações
• Custo por tarefa do índice — US$ 0,054 para o MiMo-V2.5-Pro contra US$ 0,1332 para o MiMo-V2.6-Pro, sendo o aumento proveniente da verbosidade, e não de uma alteração de tarifa
• Parâmetros — 1023B no total e 42B ativos, contra 1,02T no total e 42B ativos
• Contexto — 1M tokens, inalterado
• Licença — MIT, inalterada
• Data de lançamento — 22 de abril de 2026, contra 21 de setembro de 2026

A pontuação é a parte que importa, e é a parte que a nomenclatura obscurece. Vinte pontos no índice em cinco meses, com uma tabela de preços inalterada, é um salto geracional maior do que a cobertura do lançamento fez parecer — a maior parte dela foi para "melhor modelo de pesos abertos", o que é uma afirmação sobre o campo, e não sobre a atualização. Se você está executando o antigo carro-chefe e se perguntando se uma migração vale o trabalho de engenharia, essa única linha é a resposta, e é um argumento mais forte do que qualquer coisa no material de marketing.

A ressalva é a mesma que acompanha todos os números da Xiaomi neste lançamento. O 26.0 e o 46.3 são ambos medições da Artificial Analysis, o que os torna comparáveis entre si e com outros modelos na mesma versão do índice. As próprias tabelas de benchmark do fornecedor — DeepSWE v1.1, Terminal Bench, AutomationBench e as demais — não são, e não devem ser usadas para calcular um delta de atualização. Misturar uma pontuação medida com uma pontuação do fornecedor para produzir um número de "pontos ganhos" é o erro mais comum na cobertura deste lançamento.

Por que um nome é um problema operacional

Nada disso é pedantismo quando o rótulo chega a um sistema. Um identificador de modelo que se resolve em dois checkpoints com uma diferença de preço de 3,1x é um incidente de cobrança à espera de um gatilho, e há três lugares onde isso dá errado de forma confiável. Arquivos de configuração e de ambiente, onde uma string como mimo-v2.6 é escrita uma vez e nunca mais revisitada. Planilhas de custos, onde uma estimativa por token é vinculada ao nome da série e depois aplicada ao nível errado. E linhas de avaliação, onde um resultado é arquivado sob a família e mais tarde lido como uma propriedade do carro-chefe.

Há um quarto ponto, e é o que afetou especificamente esta versão: as contagens de parâmetros. O Xiaomi MiMo-V2.6-Pro está documentado com 1,02T no total e 42B ativos, e seu repositório no Hugging Face reporta um tamanho de modelo Safetensors de 524B. O MiMo-V2.6-Flash está documentado com aproximadamente 309B no total e 15B ativos, e seu repositório reporta 159B. Nenhum dos pares bate. Se seu planejamento de capacidade lê o model card e seu provisionamento lê o repositório, você dimensionará a mesma implantação de duas maneiras diferentes.

Fixe o nome do checkpoint em todos os lugares, não o nome da série. Esse é o remédio completo, e não custa nada até o dia em que economiza o orçamento de um trimestre.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the repository name, MIT licence and fp8 tags, a Safetensors panel reporting a model size of 524B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a collection block headed MiMo-V2.6 holding three items, and the model card introduction describing MiMo-V2.6-Pro-RL as the flagship checkpoint of the MiMo-V2.6 series with native omnimodal input and a 1M-token context.

Como isso se resolve em um roteador

O problema de nomenclatura é um problema de catálogo, e um catálogo é o único lugar onde é fácil corrigi-lo. Dirigirmo-nos aos modelos por um identificador preciso através de uma única chave de API, em vez de pelo nome da família em várias contas de fornecedores, significa que a string na sua configuração é a mesma string que o sistema de faturação vê — que é a propriedade que um nome como "MiMo-V2.6" destrói. É também por isso que repassamos o preço de tabela do fornecedor com 0% de margem, em vez de aplicarmos a nossa própria margem: o preço na página é o preço que o fornecedor definiu, pelo que um nível que identificou mal está errado na mesma direção para todos, em vez de errado numa direção específica nossa.

Para ser franco quanto aos limites: não hospedamos nenhum dos checkpoints do MiMo-V2.6, portanto nenhum dos dois é roteável através de nós hoje, e nenhum dos dois é implantado por qualquer provedor de inferência de terceiros, de acordo com seu próprio repositório no Hugging Face. A rota para ambos é a própria plataforma da Xiaomi e os catálogos que a disponibilizam. Mas a disciplina de identificadores que esta página defende aplica-se a todos os modelos que você invoca, e é a razão pela qual vale a pena ter uma camada de roteamento mesmo para os modelos que você ainda não está roteando.

O que levar

Se você veio aqui para comparar dois modelos, a comparação não está disponível — uma dessas coisas não é um modelo. Xiaomi MiMo-V2.6-Pro é o checkpoint: 46,3 no índice, $0,435 e $0,87 por milhão de tokens, pesos MIT, contexto de 1M, e a única entrada de pesos abertos na linha de Pareto de custo da Artificial Analysis acima da camada quase gratuita. MiMo-V2.6 é o rótulo acima dele e o rótulo ao lado dele, cobrindo um checkpoint mais barato a um terço do preço e uma camada de serviço mais rápida a um preço dez vezes maior.

A comparação que vale a pena fazer, em vez disso, é a que a nomenclatura esconde: o carro-chefe desta geração contra o último que trazia apenas um número de versão. Vinte pontos de índice, cinco meses, taxas inalteradas. Esse é o número a colocar diante de quem der o aval à migração — não o de ser o primeiro no ranking.

Screenshot of the Artificial Analysis model page for MiMo-V2.5-Pro, showing 'Released April 2026', an Intelligence card reading 26 ranked #24 of 114, a Speed card reading 45.9 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.05 cost per Intelligence Index task ranked #3 of 114, a Verbosity card reading 110M output tokens, and a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.