
Boreal vs Kimi K3: Ninguno de los dos funciona en tu hardware
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiNUEVOOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleNUEVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenNUEVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencia72Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencia69Código
Noventa y seis fragmentos de Safetensors. Eso es lo que te da descargar Kimi K3: un modelo de mezcla de expertos de 2,8 billones de parámetros con 104 mil millones de parámetros activos por token, publicado bajo una licencia MIT modificada el 27 de julio de 2026, once días después de que Moonshot AI lo lanzara. La propia guía de Moonshot para servirlo recomienda configuraciones de supernodo de al menos 64 aceleradores. Boreal no se puede descargar en absoluto: el modelo de vídeo publicitario de Creatify, lanzado el 15 de septiembre de 2026, es cerrado y de autoservicio, con un precio de un centavo por segundo de vídeo acabado de clase 720p. Uno de estos te entrega los pesos y la factura del hardware. El otro se queda con los pesos y te cobra por segundo. Ninguno de los dos se ejecuta en tu hardware, y las razones son opuestas, que es exactamente por lo que merece la pena hacer la comparación.
Lo que "open weights" realmente te entrega
La etiqueta open-weights hace un trabajo real en esta comparación, y hace menos trabajo del que parece.
Lo que realmente obtienes con Kimi K3 es durabilidad. Los pesos existen como archivos. Si Moonshot AI cambiara sus precios, dejara de priorizar el modelo o desapareciera, el checkpoint seguiría ahí —y también las pilas de servicio que lo soportan, con vLLM, SGLang y TokenSpeed incluidos entre las rutas compatibles. Eso no es una afirmación de marketing; es una propiedad del artefacto. Para una organización cuyo registro de riesgos incluye la concentración de proveedores, es lo más valioso del lanzamiento.
Lo que no obtienes es un despliegue que puedas ejecutar. Un modelo disperso de 2,8 billones de parámetros con 896 expertos no es una propuesta de cuantizar y listo. La recomendación oficial de 64 o más aceleradores no es una base conservadora que un equipo decidido pueda rebajar mucho: es la descripción de la clase de máquina para la que se diseñó el modelo. Los equipos que ejecutan Kimi K3 a algo que se parezca a escala de producción están, en la práctica, alquilándolo a alguien que opera un supernodo. Lo cual significa que la cuestión de la disponibilidad práctica no cambia porque los pesos sean públicos: sigues comprando inferencia a un tercero, y la licencia es lo único que se ha movido.
Hay un detalle de la licencia que merece una lectura atenta, porque es la parte que la mayoría de los resúmenes omite. Los términos modificados de MIT condicionan las obligaciones de marca y atribución a superar los 100 millones de usuarios activos mensuales o los 20 millones de dólares en ingresos mensuales, y exigen que las empresas de modelo como servicio cuyos ingresos de licenciatarios y afiliados superen los 20 millones de dólares durante cualquier período de doce meses consecutivos celebren un acuerdo por separado con Moonshot. El uso interno y el ajuste fino están ampliamente permitidos. La reventa está restringida. Esa es una licencia razonable para un modelo de frontera, y es algo materialmente distinto de MIT; para una startup que planee construir un producto sobre él, el umbral es una negociación futura, no un derecho presente.
Lo que Boreal te envía en su lugar
Boreal hace el intercambio opuesto, y es más deliberado de lo que parece.
Creatify afirma que posee los pesos y que los sirve ella misma, y que el modelo base sobre el que hizo el post-entrenamiento es uno de código abierto que genera audio y video conjuntamente. Esos dos hechos, en conjunto, son toda la estrategia de producto. El linaje de código abierto te dice a grandes rasgos qué clase de modelo se está usando y que el audio no es un añadido posterior. La propiedad te dice que nadie más puede servirlo, que es lo que hace posible un precio por segundo en primer lugar.
Lo que obtienes no es durabilidad — es rendimiento. Creatify afirma que el renderizado es de aproximadamente 1:1 con el tiempo real: un segundo de vídeo terminado por segundo de reloj de pared. Eso es un resultado de ingeniería de inferencia más que un resultado de calidad del modelo, y es lo que sobreviviría a que los pesos se publiquen mañana. Si el checkpoint apareciera en Hugging Face la próxima semana, la capacidad de renderizar un clip de cinco segundos en unos cinco segundos por cinco centavos seguiría perteneciendo a quien construyó la pila de servicio — y la implementación de referencia, con el rendimiento equivalente a más de 64 aceleradores ya ajustado, seguiría siendo de Creatify.
Así que la simetría honesta es esta: Kimi K3 te da un checkpoint que no puedes permitirte servir, y Boreal te da un servicio que no puedes quitarle a su proveedor. Ninguno de los dos es autoalojable. Solo uno de ellos es una cobertura contra el riesgo de proveedor, y es aquel en el que la cobertura cuesta más que aquello que se está cubriendo.

El contraste de especificaciones
• Salida — Boreal: vídeo renderizado, clase 720p, texto a vídeo e imagen a vídeo. Kimi K3: solo texto.
• Pesos — Boreal: propietarios, propiedad de Creatify y servidos por esta. Kimi K3: publicado el 27 de julio de 2026, 96 fragmentos de Safetensors, MIT modificado con condiciones de reventa sujetas a umbral de ingresos.
• Autoalojamiento — Boreal: no es posible. Kimi K3: posible en principio, con Moonshot recomendando al menos 64 aceleradores.
• Precio — Boreal: $0.01 por segundo de vídeo finalizado. Kimi K3: $3.00 por 1M de entrada / $15.00 por 1M de salida, con lecturas en caché a $0.30 por 1M y una tarifa plana en toda la ventana de contexto.
• Contexto — Boreal: no publicado. Kimi K3: 1.048.576 tokens, sin recargo por contexto largo.
• Latencia — Boreal: cotizada a 1:1 con el tiempo real. Kimi K3: tiempo p50 hasta el primer token de 10,00 segundos en nuestra placa — el techo que reporta nuestra instrumentación, así que léelo como "lento" en lugar de como una medición precisa.
• Evidencia — Boreal: solo ejecutados por el proveedor. Kimi K3: filas del proveedor que incluyen 93,5 en GPQA Diamond y 88,3 en Terminal-Bench 2.1, un primer puesto en la Frontend Code Arena con 1679 Elo, y hallazgos independientes que incluyen una tasa de fallos del 36 % en problemas con invariantes ocultos.
El rastro que no puedes desactivar
Kimi K3 tiene una propiedad de facturación que es inusual incluso entre los modelos de razonamiento, y es la diferencia de costo más concreta en esta comparación.
El modo de pensamiento no se puede desactivar, y el esfuerzo de razonamiento predeterminado está configurado al máximo. Cada solicitud genera una traza de razonamiento completa, y cada token de esa traza se factura a $15.00 por millón de salida. Para una tarea en la que la respuesta es una sola palabra, sigues pagando por una deliberación. Las lecturas de caché a $0.30 por millón suavizan considerablemente el lado de la entrada, y el precio uniforme en todo el contexto de 1M es genuinamente más amigable que las estructuras por niveles que usan sus competidores, pero el lado de la salida no tiene ningún modo económico.
El costo de Boreal no tiene una palanca equivalente que pueda estar mal. Un clip de cinco segundos cuesta cinco centavos, ya sea que el modelo haya trabajado mucho o de manera trivial, porque el artefacto es la unidad y el artefacto es fijo. Eso no es obviamente mejor — simplemente no se ve afectado por nada de lo que el modelo haga internamente.
Kimi K3 está en nuestro catálogo, y es el modelo con más tráfico de nuestro panel por un amplio margen: 3.150,6 millones de tokens en los últimos siete días, más de diecisiete veces el tráfico de Grok 4.6 y trece veces el de GPT-5.6 Sol. Ese volumen es lo que representa un modelo frontera de pesos abiertos en producción: muchos solicitantes, sensibles al precio, dispuestos a enrutar hacia otro lado antes que quedarse con quien peor se lo sirve. Está detrás de la misma clave que el resto del catálogo, a la tarifa de lista del proveedor con 0% de recargo, lo cual importa más en un modelo de pesos abiertos que en uno cerrado: cuando el checkpoint es público, el precio lo fija el proveedor que lo sirve, así que el precio es la variable competitiva y se mueve.
Boreal no está en nuestro catálogo. OrcaRouter no ofrece modelos de generación de video, y la capa de texto de un pipeline publicitario — los briefs, las variantes de gancho, la revisión de cumplimiento — es donde nos situamos con respecto a él.

¿Cuál, y qué ver?
Si tu restricción es la concentración de proveedores y tienes acceso a cómputo serio, Kimi K3 es el único de estos dos que ofrece una respuesta real, y la tasa de fallos del 36 % en problemas de invariantes ocultos es el número que hay que sopesar frente a eso. Es un modelo de clase frontera con una auténtica válvula de escape incorporada, y la válvula de escape es lo bastante costosa como para que la mayoría de los equipos nunca la use.
Si tu restricción es el costo por activo publicitario terminado, Boreal es la opción más barata y mucho más predecible, y su restricción es la calidad en un formato específico: un clip de una sola persona hablando obtuvo un 60 % en la propia prueba de 40 casos del proveedor, frente al 83 % y el 85 % en escenas de producto y de creador. Prueba ese formato antes de comprometer una campaña con él.
Una advertencia sobre la evidencia, porque aplica a ambos. Las cifras de inteligencia publicadas de Kimi K3 se han reformulado al menos una vez, y los números antiguos en el rango de 57 a 60 no deberían citarse junto con los actuales del mismo evaluador — un recordatorio de que una puntuación de benchmark es una observación fechada, no una propiedad del modelo. Y cada cifra de calidad atribuida a Boreal proviene del propio post de lanzamiento de Creatify. La primera evaluación independiente de Boreal, cuando llegue, valdrá más que todo lo publicado actualmente sobre él.

