Tarjeta de título que compara Step 5 Preview y MiniMax M3 en cuanto al costo por tarea del Artificial Analysis Intelligence Index, mostrando $0,71 con un índice de 44 para Step 5 Preview y $0,51 con un índice de 29 para MiniMax M3.
Guides & Insights

Step 5 Preview vs MiniMax M3: más barato por token, más caro por punto

Autor

Alistair Wren

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

El precio unitario favorece a MiniMax M3 por un amplio margen. A 0,30 $ por millón de tokens de entrada y 1,20 $ por millón de salida, el modelo disperso de 428B del proveedor deja por debajo los 1,00 $ y 2,70 $ de Step 5 Preview en más de un factor de dos en ambos lados. Pero el precio unitario es el denominador equivocado para un modelo que se usa para responder preguntas, y una vez que se divide por lo que cada modelo entrega realmente, la clasificación se invierte. Step 5 Preview cuesta 0,71 $ por tarea del Índice de Inteligencia con una puntuación de 44. MiniMax M3 cuesta 0,51 $ por tarea del índice con una puntuación de 29. Por punto de capacidad medida, el modelo con el precio de etiqueta más alto es el más barato, y la razón es una brecha de quince puntos en el índice que ningún descuento puede cerrar.

Dos tipos muy diferentes de «disponible»

MiniMax M3 está disponible de forma general desde el 1 de junio de 2026, cuando MiniMax lo abrió a través de MiniMax Code, su Token Plan y la API — sin ninguna etiqueta de vista previa en el lanzamiento. Los pesos llegaron el 12 de junio, once días después, tal como se prometió. El repositorio MiniMaxAI/MiniMax-M3 cuenta con aproximadamente 428 mil millones de parámetros totales y unos 23 mil millones activos por token, construido sobre MiniMax Sparse Attention, junto con una versión cuantizada MXFP8 independiente.

Step 5 Preview abrió su API el 20 de septiembre de 2026. Sus pesos no se han publicado —el repositorio de Hugging Face stepfun-ai/Step-5-Preview-BF16 es una carcasa vacía— y StepFun ha fijado como fecha el 15 de octubre de 2026. Así que la diferencia práctica es que M3 es un modelo que puedes descargar, autoalojar e inspeccionar, mientras que Step 5 Preview es un endpoint alojado con una intención publicada.

Vale la pena señalarlo: la propia página del modelo de MiniMax todavía dice que M3 «pronto será totalmente de código abierto», lo que contradice el repositorio que publicó en junio. Considera eso una página desactualizada del proveedor, en lugar de evidencia de que falten los pesos.

La historia del precio no es la historia del coste

Artificial Analysis calcula una cifra de coste por tarea de índice ejecutando el mismo conjunto de evaluación en cada modelo y sumando lo que cuestan los tokens. Es lo más parecido que tiene el sector a una cifra de coste total de propiedad para una cantidad fija de trabajo, e incorpora los dos efectos que los precios de los tokens ocultan: lo verboso que es un modelo y cuánto piensa.

Step 5 Preview se sitúa en $0,71 por tarea de índice, con un coste total de ejecución del índice de $922,84. MiniMax M3 se sitúa en $0,51, con un coste total de ejecución de $537,98. En rendimiento bruto de tareas, M3 es aproximadamente un 28% más barato. Divide por la puntuación del índice — 44 frente a 29 — y Step 5 Preview sale a aproximadamente 1,6 centavos por punto de índice frente a los 1,8 centavos de M3.

Una advertencia corresponde justo aquí: esa es una ejecución de índice por modelo, y una ejecución de índice es una muestra pequeña. La aritmética por punto es una verificación de cordura sobre la cifra por tarea, no un benchmark en sí misma. Pero la dirección es consistente con los números por tarea, y esas son las cifras que las propias listas de precios de los dos proveedores no pueden mostrar.

Índice de Inteligencia — Vista previa del paso 5: 44 (#24 de 200) frente a MiniMax M3 29 (#15 de 113), ambos en la versión actual del índice

Precio de entrada — $1.00 por millón frente a $0.30 por millón

Precio de salida — 2,70 $ por millón frente a 1,20 $ por millón

Costo por tarea de indexación — $0.71 vs $0.51

Parámetros activos — 27B vs 23B

Ventana de contexto — 1M de tokens vs 1M de tokens

Velocidad de salida — 99,8 tokens/s vs 210,4 tokens/s

Pesas — prometidas para el 15 de octubre de 2026 vs. disponibles desde el 12 de junio de 2026

A comparison scoreboard for Step 5 Preview and MiniMax M3 covering Intelligence Index, output price, cost per index task, output speed, weight availability, and licensing terms.

La trampa de la versión del índice que hace que esto resulte confuso

Existe un peligro real al leer los números de M3, y merece un párrafo porque confunde a casi todas las páginas de comparación de terceros. Artificial Analysis recalibró su Intelligence Index el 7 de septiembre de 2026, y la recalibración comprimió las puntuaciones en todos los ámbitos. Según la escala actual, M3 mide 29. Según la escala anterior a septiembre, medía entre 44 y 45, y varios rastreadores siguen publicando 44,4 o 45,4 para él.

Esa colisión importa más de lo habitual aquí, porque la puntuación actual de Step 5 Preview también es 44. Una página que coloca una cifra obsoleta de M3 junto a una cifra actual de Step 5 Preview parece mostrar dos modelos empatados, cuando la diferencia actual es de quince puntos. Ambas cifras de este artículo provienen de la versión actual del índice y son comparables entre sí; cualquier cosa publicada antes del 7 de septiembre no lo es.

Donde MiniMax M3 es realmente difícil de superar

Dos cosas sobre M3 no están ni cerca. La primera es la velocidad: 210,4 tokens de salida por segundo, el cuarto más rápido de los 113 modelos que sigue Artificial Analysis, frente a una mediana de 76,3. Los 99,8 tokens por segundo de Step 5 Preview son respetables y suponen menos de la mitad. El tiempo de M3 hasta el primer token de 1,01 segundos es asimismo la cifra más rápida frente a 2,96 segundos.

El segundo es la modalidad de entrada. M3 acepta texto, imagen y vídeo, y devuelve texto, y MiniMax documenta la operación de escritorio y de uso de computadora. Step 5 Preview acepta texto e imágenes. Si tu pipeline alimenta grabaciones de pantalla o fotogramas de vídeo a un modelo, eso no es una preferencia: es una diferencia de capacidades.

La diferencia de precio refuerza ambos aspectos. A $0,30 y $1,20 con un descuento permanente del 50% aplicado a una lista de $0,60 y $2,40, y un descuento de caché del 80% que reduce las lecturas de caché a $0,06 por millón, M3 es una de las formas más económicas de mover un gran volumen de tokens a través de un modelo capaz. Ten en cuenta la estructura por niveles: una entrada superior a 512K tokens duplica toda la solicitud, y el nivel de servicio prioritario cuesta 1,5×.

Donde se desmorona

El propio conjunto de evaluación de MiniMax para M3 es sólido y debe interpretarse como reportado por el proveedor: SWE-bench Verified con 80,5 %, SWE-bench Pro con 59,0 %, Terminal-Bench 2.1 con 66,0 %, MCP Atlas con 74,2 %, BrowseComp con 83,5 y OSWorld-Verified con 70,06 %. MiniMax los ejecutó en su propia infraestructura usando Claude Code como andamiaje, promediados sobre cuatro ejecuciones, y la configuración de puntuación no es pública, por lo que no son reproducibles por un tercero tal como están las cosas.

El panorama medido de forma independiente es mucho más severo con el trabajo agéntico. Artificial Analysis registró Terminal-Bench 4.0 con un 2% para M3 —una versión diferente del benchmark que la cifra de Terminal-Bench 2.1 del proveedor, y no comparable con ella, pero igualmente contundente. SciCode obtuvo un 47%, AutomationBench-AA un 21% y CritPt un 4%. Los resultados independientes más sólidos de M3 son en contexto largo y trabajo de conocimiento: AA-LCR v1.1 con un 83%, Humanity's Last Exam con un 39%.

Step 5 Preview invierte ese perfil. Terminal-Bench 4.0 con un 33,3 % en el mismo harness en el que M3 obtiene un 2 %, y SciCode con un 59 % frente a un 47 %. Si el trabajo es agéntico o tiene forma de código, esta no es una comparación reñida y la ventaja de precio no lo compensa.

The Hugging Face repository page for stepfun-ai Step-5-Preview-BF16, showing an empty repository with no model card and no files, indicating the weights have not been published.

La cláusula de licencia que la mayoría de las comparativas omite

MiniMax M3 es de pesos abiertos, pero no es de código abierto en el sentido de la OSI, y los términos son más estrictos de lo que sugiere la frase "pesos abiertos". El repositorio incluye la Licencia Comunitaria de MiniMax: gratuita para uso no comercial, con el uso comercial condicionado a mostrar de forma destacada "Creado con MiniMax M3" — y cualquier producto con más de 20 millones de USD en ingresos anuales requiere autorización previa por escrito de MiniMax. No es MIT, ni Apache, ni el tipo de licencia que un equipo legal deja pasar sin más.

Step 5 Preview todavía no se puede evaluar en absoluto en este eje, porque no hay una licencia que leer. StepFun se ha comprometido a publicar los pesos el 15 de octubre y no ha publicado los términos que los regirán. Cualquiera que planee construir sobre ello debería tratar la licencia como una cuestión abierta en lugar de asumir que se parecerá a la de Moonshot o a la de DeepSeek.

Esta es la asimetría honesta entre las dos: los términos de M3 son restrictivos pero conocidos; los de Step 5 Preview son desconocidos. Una licencia restrictiva con la que puedes planificar es mejor que una no anunciada con la que no puedes.

Llamando a cualquiera de ellos

MiniMax M3 está en nuestro catálogo en /models/minimax/minimax-m3, accesible mediante la misma clave y la misma estructura de solicitud que el resto de los más de 200 modelos que enrutamos, con el precio de lista del proveedor traspasado con un 0 % de margen —por lo que el descuento permanente del 50 % que ha aplicado MiniMax es el precio que ves, y cambia el día que MiniMax lo cambie. La conmutación automática por error es la otra mitad de eso: M3 a 210 tokens por segundo es atractivo para trabajos de gran volumen, y el trabajo de gran volumen es exactamente donde más perjudica un único endpoint degradado.

Step 5 Preview no está en nuestro catálogo. Los modelos de texto de StepFun no están entre los que servimos, por lo que está disponible a través de la propia API de StepFun y varias plataformas de terceros — y no es accesible con la clave que usarías para M3.

OrcaRouter model page for MiniMax M3, showing the model in the catalogue with its provider, context window and per-million-token pricing.

El veredicto

Toma MiniMax M3 cuando el volumen, la latencia o la entrada de vídeo sean la limitación, cuando quieras un modelo que puedas descargar hoy y cuando puedas vivir dentro de la licencia comunitaria —incluido el umbral de ingresos de 20 millones de dólares—. Acepta que las puntuaciones agénticas independientes lo sitúan muy por detrás, y que sus benchmarks de proveedor no se han reproducido fuera de la propia infraestructura de MiniMax.

Elige Step 5 Preview cuando el trabajo sea agéntico o con mucho código, cuando quieras la capacidad por dólar en lugar del token por dólar, y cuando te sientas cómodo siendo un cliente temprano de un endpoint alojado cuyos pesos llegan el próximo mes. Acepta que no puedes verificar la licencia antes de construir, y que una diferencia de 2% versus 33.3% en Terminal-Bench 4.0 es el tipo de brecha que decide un proyecto.

El descuento es real. Simplemente no es lo que se está comprando.

MiniMax M3 es uno de los modelos que enrutamos con un margen del 0 %, con conmutación por error automática, así que un cambio de precio del proveedor se aplica el mismo día en la misma clave.