Una tarjeta principal generada titulada 'Dots vs MiniMax M3', con el subtítulo 'Alquilar al trabajador o descargar al lector'. Una línea vertical divide la tarjeta: el panel izquierdo, etiquetado 'Dots', dice 'sin precio por tarea - sin techo publicado'; el de la derecha, etiquetado 'MiniMax M3', dice 'pesos abiertos - entrada de texto, imagen y vídeo - $0.30 / $1.20'. El logotipo de OrcaRouter está integrado en la esquina inferior derecha.
Guides & Insights

Dots vs MiniMax M3: ¿Alquilar al trabajador o descargar el lector?

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

El modelo más barato de este lote es también el que se te permite conservar, y esa combinación es toda la comparación. MiniMax M3, publicado el 31 de mayo de 2026, se describe como el modelo fundacional de pesos abiertos insignia de MiniMax: entrada de texto, imagen y video con salida de texto, una ventana de contexto de 1.048.576 tokens, hasta 512.000 tokens de salida en una sola respuesta, y un precio de lista de $0,30 por millón de tokens de entrada y $1,20 por millón de tokens de salida, con lecturas en caché a $0,06 — aproximadamente una decimotercera parte de lo que cobran los modelos de frontera por los mismos tokens. Dots es el agente siempre activo de la empresa, anunciado en DevDay el 29 de septiembre de 2026: obtiene su propia computadora en la nube y su propio navegador, funciona en más de 4.000 aplicaciones conectadas, se ejecuta sobre GPT-6 Astra y viene incluido con Pro y Business Premium, sin que se haya publicado en ninguna parte una cifra de asignación. Uno es un componente que puedes tener en tus manos. El otro es un servicio al que solo puedes suscribirte.

El precio no es el número interesante

Treinta centavos por millón de tokens de entrada es el titular, pero las cifras interesantes son las dos que determinan lo que puedes pedir. La primera son 512.000 tokens de salida máxima — seis veces lo que GPT-5.6 Sol emitirá en una respuesta, y el mayor límite de salida de cualquier modelo de este conjunto de comparación. La segunda es 83 en recuerdo de contexto largo, lo suficientemente alto como para que la ventana de contexto sea una superficie de trabajo utilizable y no un número en una hoja de especificaciones.

Si combinas todo eso, una clase específica de tareas se vuelve barata: generar la cosa larga a partir de la fuente larga. Un manual técnico de 400 páginas reescrito para otro público. Una guía de migración producida a partir de un repositorio entero. Un resumen de investigación que, de por sí, tiene la longitud de un informe. A $0.30 y $1.20 por millón, un trabajo que en un modelo de frontera sería una partida de cuatro cifras aquí es un error de redondeo — y el hecho de que el techo de salida se mida en cientos de miles de tokens en lugar de decenas de miles es lo que hace que sea una sola solicitud en vez de veinte.

Hay una advertencia que vale la pena señalar sobre la medición. El panel de latencia de nuestro catálogo informa una mediana de 10,00 segundos hasta el primer token para M3 durante la misma ventana de siete días que muestra 18,35 millones de tokens de tráfico, y esa cifra se sitúa exactamente en el límite superior del rango mostrado por el panel. Léalo como un artefacto de la ventana en lugar de una caracterización del modelo. La cifra de tráfico es la que le dice que la gente realmente lo está usando.

A screenshot of the OrcaRouter model page for MiniMax M3, showing the identifier 'minimax/minimax-m3' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-05-31, a description of it as MiniMax's flagship open-weight foundation model with MiniMax Sparse Attention and native multimodality, a side panel reading 1M tokens of context and 512K of maximum output over text, image and video input, and a price strip reading $0.30 and $1.20.

El vídeo es una entrada con la que nadie cuenta

La visión ya es un requisito indispensable, así que la modalidad que todavía marca la diferencia es el video. M3 lo acepta de forma nativa, junto con texto e imágenes, y eso cambia la forma de un pipeline en lugar de limitarse a añadir una capacidad a una lista. Un archivo de soporte de grabaciones de pantalla, un conjunto de clips de dashcam, un semestre de grabaciones de clase —antes eran un problema de preprocesamiento, en el que se muestreaban fotogramas con una herramienta y se describían con otra. Un modelo que lee video directamente colapsa dos etapas en una sola llamada.

También hace que la aritmética de costos sea menos predecible, porque el video es caro de ver de una forma en que el texto no lo es, y el número más grande en una factura suele ser la entrada que nadie presupuestó. Una tarifa baja por token es lo que hace que sea seguro experimentar con ello: a $0,30 por millón de tokens de entrada, una ingesta ocasional de cinco horas es lo bastante asequible como para prototiparla en lugar de discutirla en una reunión de planificación.

Qué cambian realmente los pesos abiertos

MiniMax describe M3 como un modelo de pesos abiertos, lo que significa que los pesos se publican en lugar de limitarse a servirse, y eso es un tipo de garantía distinto al de una suscripción. Si MiniMax dejara de servirlo mañana, o cambiara sus precios, o declarara obsoleto el identificador, el modelo no desaparecería: seguiría funcionando en hardware que ya hubieras comprado, con la cuantización que encajara. Eso no hace que el autoalojamiento sea más barato en el caso general; servir uno mismo una gran mezcla de expertos dispersa es un verdadero proyecto de ingeniería. Hace que la dependencia pueda sobrevivir, lo cual es una afirmación distinta y la que importa cuando estás decidiendo sobre qué construir.

Un dot ofrece la garantía opuesta. OpenAI controla el ordenador, el navegador, los conectores y el cupo, y tu única solución si algo de eso cambia es dejar de usarlo. Es un acuerdo justo —alquilar es como debería empezar la mayoría de los equipos—, pero no es el mismo acuerdo, y la diferencia solo se vuelve visible el día en que importa.

A generated scoreboard titled 'Dots vs MiniMax M3 - capability and control', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; cost per task not published; computer its own cloud computer and browser; connectors 4,000+ apps; independent benchmark none. The right column, 'MiniMax M3', lists: context 1,048,576 tokens; max output 512,000 tokens; input text, image, video; price $0.30 in / $1.20 out per 1M; cached reads $0.06 per 1M; weights downloadable. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; MiniMax M3 figures as listed in the OrcaRouter catalogue.'

Seis diferencias que cambian una decisión

• Garantía — un servicio que puede cambiar los términos, frente a pesos que puedes conservar (se describe a MiniMax M3 como de pesos abiertos; un punto no es descargable en ningún sentido)

• Costo por unidad de trabajo — no publicado para dot, frente a $0.30 y $1.20 por millón de tokens con lecturas en caché a $0.06, la tarifa más baja de este conjunto de comparación

• Techo de solicitud única — sin documentar ni un ápice, frente a 1.048.576 tokens de entrada y 512.000 tokens de salida

• Modalidades de entrada: mensajes y datos de aplicaciones conectadas para un dot, frente a texto, imagen y video para el modelo

• Modalidades fuera — cambios dentro de otro software, frente a texto y solo texto

• Posición independiente — no existe ningún benchmark para dot; M3 tiene un Artificial Analysis Intelligence Index de 29.2, lo que lo sitúa en el sexagésimo lugar de 145 modelos medidos, lo cual está a mitad de la tabla y vale la pena saberlo antes de asumir que la tarifa barata compra razonamiento de frontera. No lo hace.

Donde cada uno se gana su línea en la factura

La lectura honesta del perfil publicado de M3 es que es un modelo de volumen, no uno de frontera: 92,9 en GPQA Diamond es competitivo, 59 en SWE Bench Pro es respetable, y el Intelligence Index de campo medio es lo revelador. En lo que gana es en coste por unidad de trabajo, techo de salida, vídeo y capacidad de despliegue, en ese orden. Ese es un buen modelo para poner debajo de la capa cara de un pipeline —los pasos de resumir, extraer, transcribir, generar texto largo y abrir en abanico muchos intentos— y uno malo para poner en la cima de este.

OrcaRouter lo sirve como minimax/minimax-m3 al precio de lista del proveedor de MiniMax con 0% de recargo, en el mismo catálogo que el de más de 200 modelos detrás de una única clave, con failover automático entre proveedores upstream y un DSL de enrutamiento para enviar una solicitud individual al modelo que debería gestionarla. Esa disposición es lo que hace que la división en dos capas sea práctica en lugar de teórica: la misma clave que llega a un modelo barato para volumen llega a un modelo de frontera para las llamadas que deben ser correctas, y nada llega dentro de un punto porque los puntos no están en el catálogo en absoluto — sin endpoint, sin identificador, sin inteligencia sustituta.

Qué hacer el lunes

Si tienes un corpus de audio o vídeo y ninguna forma barata de examinarlo, empieza por ahí: M3 es el único modelo de este conjunto que lee vídeo de forma nativa a este precio, y el experimento cuesta casi nada. Si tienes un tipo de trabajo que se sigue dejando de lado porque nadie lo persigue, el dot es el producto diseñado para eso, y el modelo de pago por uso no pretenderá serlo.

Los dos solo entran en conflicto si asumes que uno debe ganar. La suscripción persigue; el lector descargado lee. Sé dueño del segundo, alquila el primero y mantén el límite entre ellos lo suficientemente explícito como para que puedas reemplazar cualquiera de los dos sin reescribir el otro.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards visible beneath.