Um cartão de título gerado com o texto MiMo-V2.6-Pro vs GPT-5.6 Sol, com o subtítulo 15x o custo por tarefa para um ponto de índice abaixo dele e três ícones de linha planos acima do título sugerindo um medidor de custo, um cartão de pontuação e um aviso datado. O logotipo do OrcaRouter está composto no canto inferior direito.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: Um Ponto de Índice Custa Quinze Vezes Mais por Tarefa

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

No Artificial Analysis Intelligence Index v4.3.2, consultado em 25 de setembro de 2026, o GPT-5.6 Sol com esforço máximo obtém 47, e o MiMo-V2.6-Pro da Xiaomi obtém 46. Um ponto. O número que de fato os separa não é a pontuação e não é a taxa por token — é o custo de uma única tarefa do índice, que a Artificial Analysis divulga como US$ 1,99 para o GPT-5.6 Sol e US$ 0,13 para o MiMo-V2.6-Pro. Quinze vezes o dinheiro por um ponto. E, no momento desta consulta, a própria página do avaliador para esse modelo traz um aviso de descontinuação, porque o GPT-6 Sol o substituiu.

A Xiaomi publicou os pesos e o relatório técnico do MiMo-V2.6-Pro em 21 de setembro de 2026, quatro dias antes desta leitura; a OpenAI lançou o GPT-5.6 Sol em 9 de julho de 2026. Ambos os fatos acima são novos desde a última vez em que este pareamento foi escrito, e eles puxam em direções opostas. O aviso de descontinuação diz que a comparação é com um modelo que a OpenAI já deixou para trás. O número por tarefa diz que aquilo que parecia um erro de arredondamento quando ambos os modelos eram cotados pelo preço de tabela é, em uma carga de trabalho real, a decisão inteira. Qual dos dois importa depende de você estar comprando um modelo ou substituindo um.

O que as duas páginas agora dizem

O GPT-5.6 Sol foi lançado em 9 de julho de 2026 como o carro-chefe da família GPT-5.6. Seu preço de tabela é de US$ 4,00 por milhão de tokens de entrada e US$ 20,00 por milhão de saída na API própria da OpenAI, com 90% de desconto de cache, e a página registra 90 milhões de tokens de saída gerados ao longo da execução do índice, em comparação com uma mediana de 88 milhões. Ele mediu 73 tokens de saída por segundo, o que a mesma página considera mais rápido que a média, em comparação com uma mediana de 72 t/s. Sua entrada no índice está na posição 19 de 210 modelos em sua classe.

O Xiaomi MiMo-V2.6-Pro é um checkpoint de mistura esparsa de especialistas com 1,02 trilhão de parâmetros totais e 42 bilhões ativos, licenciado sob a licença MIT, com uma janela de contexto de 1M tokens e entrada de texto, imagem, fala e vídeo com saída de texto. Tem preço de tabela de US$ 0,43 e US$ 0,87 por milhão de tokens, com 99% de desconto de cache — um décimo da tarifa de entrada do Sol e um vinte e três avos da tarifa de saída dele. Ele gerou 140 milhões de tokens de saída na execução do índice e registrou 43,6 tokens de saída por segundo, o que sua página descreve como notavelmente lento em comparação com uma mediana de 67,1 t/s.

• Custo da tarefa de índice — MiMo-V2.6-Pro $0.13; GPT-5.6 Sol $1.99 — a diferença é de 15× • Preço de tabela — MiMo-V2.6-Pro $0.43 / $0.87 por 1M; GPT-5.6 Sol $4.00 / $20.00 • Desconto de cache — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Tokens de saída na execução do índice — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Velocidade de saída — MiMo-V2.6-Pro 43,6 t/s, contra uma mediana de 67,1; GPT-5.6 Sol 73 t/s, contra uma mediana de 72 • Contexto e pesos — MiMo-V2.6-Pro 1M e licenciado sob MIT; GPT-5.6 Sol 1M e proprietário

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

O aviso de descontinuação é a linha mais relevante.

A Artificial Analysis agora abre a página do GPT-5.6 Sol com um aviso em destaque: “Este modelo está obsoleto. Continuamos apenas o benchmarking de desempenho para a carga de trabalho padrão de 10k tokens de entrada”, seguido pela frase de que a OpenAI lançou um modelo mais novo, o GPT-6 Sol (max), e que ele deve ser considerado em vez deste. O 47 no índice é, portanto, uma leitura de um modelo que já não é o que se deve comprar. Isso não torna a leitura errada — ela foi medida no mesmo índice, no mesmo dia, na mesma configuração de esforço que o 46 —, mas muda para que serve a comparação. Já não é “qual flagship devo usar”. É “quanto custa o topo do ranking de modelos proprietários, no momento em que ele era o topo”.

Esse enquadramento importa mais do que parece, porque avisos de descontinuação em páginas de avaliadores são um dos poucos lugares em que a cadência de produtos de um fornecedor aparece como uma mudança nos dados, e não como um comunicado à imprensa. A pontuação está congelada; o modelo não está disponível. Qualquer coisa que você construa com base no 47 estará construindo com base em um snapshot.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

Por que o número por tarefa é aquele com o qual se deve modelar

As taxas por token favorecem modelos baratos e enganam em cargas de trabalho que não são neutras em tokens. O custo da tarefa do índice é uma medição diferente: é o que o avaliador realmente gastou para obter uma resposta de cada modelo, o que incorpora tanto a taxa quanto o número de tokens que o modelo escolheu emitir. O MiMo-V2.6-Pro emite mais tokens do que o Sol na execução do índice — 140 milhões contra 90 milhões, cerca de 1,6 vezes mais — e ainda custa US$ 0,13 por tarefa contra US$ 1,99. A vantagem de taxa é de aproximadamente vinte e três vezes na saída; a penalidade de verbosidade é de 1,6×; o produto é a diferença de quinze vezes por tarefa.

Essa é a aritmética na qual um modelo de custos deveria se basear, e é a aritmética que fica invisível se você comparar US$ 0,87 com US$ 20,00 e parar por aí. Ela também mostra o que quebraria a conclusão. Se sua carga de trabalho for dominada por saídas muito curtas, a contagem de tokens do Sol cai na direção da sua, e a diferença de preço de vinte e três vezes faz a maior parte do trabalho, de modo que o múltiplo real se aproxima da diferença de preço, e não se afasta dela. Se sua carga de trabalho for dominada por longos traços de raciocínio, a verbosidade de 1,6× do MiMo-V2.6-Pro se acumula, e US$ 0,13 passa a ser o teto, não a estimativa. O número publicado é uma medição do formato de um benchmark, não uma cotação que você pode entregar ao financeiro.

A linha de latência é o contrapeso honesto

A 43,6 tokens de saída por segundo, o MiMo-V2.6-Pro é mais lento que o GPT-5.6 Sol, medido no mesmo dia em 73 — e mais lento que os modelos com os quais a própria página dele o compara, cuja mediana é 67,1. A página dele diz isso com todas as letras: “notavelmente lento”. Para um pipeline em lote, este é um custo de throughput que você consegue precificar. Para um agente interativo, é uma decisão de produto, e ser quinze vezes mais barato por tarefa não torna um modelo lento rápido. Se a sua restrição é um orçamento por turno, e não uma conta mensal, a razão que importa é 43,6 contra 73, e o MiMo-V2.6-Pro sai perdendo.

Onde isso chega em um roteador

A forma útil deste emparelhamento não é “escolher um”. É que ambos os modelos respondem ao mesmo índice e o avaliador publica um custo por tarefa para cada um, pelo que a divisão pode ser feita com base no custo medido e não em níveis de fornecedor. No OrcaRouter, o catálogo vai até mais de 200 modelos atrás de uma única chave, ao preço de tabela de cada fornecedor com 0% de margem — um corte de preço do fornecedor chega à sua fatura no mesmo dia, sem um segundo contrato para renegociar — e a DSL de encaminhamento permite que uma carga de trabalho envie as chamadas baratas e de grande volume para um modelo e as difíceis para outro, por tarefa e não por marca. O failover automático cobre o caso em que a rota mais barata está degradada. O Xiaomi MiMo-V2.6-Pro não está nas nossas rotas — não listamos um modelo antes de um fornecedor o ter integrado —, pelo que, para esse lado da comparação, a resposta honesta é a própria API do fornecedor ou a plataforma alojada com que já tenha uma relação.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

O que fazer com isso até a próxima semana

Duas coisas mudaram a 25 de setembro de 2026 e apenas uma delas é sobre preço. O GPT-5.6 Sol tem um aviso de descontinuação no índice onde foi medido em 47, o que o retira como decisão de compra e o deixa como referência de benchmark. O MiMo-V2.6-Pro é medido em $0,13 por tarefa de índice, contra os $1,99 do Sol, o que é quinze vezes o dinheiro por um ponto de índice — e é 43,6 tokens por segundo, o que é mais lento do que o modelo com que está a ser comparado e mais lento do que a mediana da sua própria classe. Confronte os dois números com o seu próprio tráfego antes que qualquer deles se torne uma decisão: o custo por tarefa é uma medição, não uma tarifa, e a latência é uma medição, não uma opinião. Se os seus resultados são curtos e não interativos, o argumento a favor do checkpoint aberto é mais forte do que o fosso do índice sugere. Se os seus resultados são longos ou os seus utilizadores estão à espera, a poupança de quinze vezes compra-lhe um produto mais lento, e isso é uma troca que só a sua carga de trabalho pode avaliar.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente