
Filtración de Nemotron 4: la respuesta de NVIDIA a la frontera con un billón de parámetros y pesos abiertos
- metaNUEVOMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenNUEVOQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekNUEVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxNUEVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2278 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencia77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencia77Código
- grokxAI: Grok 4.52026-07-0856Inteligencia72Código
- tencentTencent: Hy32026-07-0642Inteligencia59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligencia42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligencia39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3055Inteligencia72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligencia52Código57Matemáticas
1 billón de parámetros. Ese es el mínimo reportado para el modelo más grande de Nemotron 4, el buque insignia de la próxima familia de pesos abiertos de NVIDIA — y el número solo suena grande hasta que lo pones junto a lo que ya se ha lanzado. El mes pasado, Moonshot AI lanzó Kimi K3 con 2,8 billones de parámetros totales, Alibaba presentó Qwen3.8-Max con 2,4 billones, y el actual buque insignia de NVIDIA, Nemotron 3 Ultra, se sitúa en 550 mil millones. The Information informó el 11 de agosto de 2026 — citando a múltiples empleados que trabajan en el proyecto — que Nemotron 4 es la respuesta de NVIDIA: una familia de pesos abiertos cuyo modelo más grande se espera que comience en aproximadamente 1 billón de parámetros, aproximadamente el doble de Nemotron 3 Ultra.
Nada de esto ha sido lanzado. NVIDIA ha reconocido que está construyendo una familia Nemotron 4, pero no ha confirmado el objetivo de parámetros, el presupuesto, el cronograma ni los detalles de la alianza que The Information atribuye a empleados anónimos. Trata cada número de este artículo como «reportado», no como «especificado». El objetivo de un artículo de filtraciones es separar el pequeño núcleo confirmado del halo reportado más amplio — y decirte qué partes importan cuando llegue la hoja de especificaciones real.
La filtración de una línea, desglosada.
Primero, el nombre, porque te confundirá en los resultados de búsqueda: NVIDIA ya lanzó un modelo llamado Nemotron-4-340B en junio de 2024. El nuevo Nemotron 4 es una familia diferente y más grande — la sucesora de la línea Nemotron 3 (Nano, Super, Ultra) que se lanzó este año — y reutiliza el nombre "Nemotron 4" para la generación posterior. Este artículo trata sobre el nuevo.
Lo que The Information realmente informó: NVIDIA está desarrollando Nemotron 4 como una familia de modelos de código abierto dirigidos a la cima del ranking de pesos abiertos, y se espera que el buque insignia tenga "al menos 1 billón de parámetros". NVIDIA no ha fijado una fecha de lanzamiento, no ha comenzado la ejecución final del entrenamiento — un proceso que los empleados esperan que tome meses — y solo ha definido los datos de preentrenamiento y la arquitectura; la especificación sigue cambiando. Dos empleados dijeron que la familia podría estar lista a más tardar a finales de otoño; otros esperan que sea más tarde.
El mismo informe incluye un presupuesto: aproximadamente {{1}}28 mil millones de dólares en acuerdos plurianuales de servicios en la nube que se extienden hasta principios de 2031{{/1}}, {{2}}alrededor de tres veces lo que NVIDIA reveló un año antes{{/2}}, {{3}}con unos 7 mil millones de dólares destinados al año fiscal actual{{/3}}. También señala que {{4}}el artículo de investigación del anterior buque insignia listaba 570 autores{{/4}} {{5}}y Nemotron 4 involucra a más{{/5}} — {{6}}un ex empleado le dijo a The Information que "todo el mundo quiere participar"{{/6}}. {{7}}Nada de esto fue reportado por NVIDIA{{/7}}.

Por qué el número de talla es la parte menos interesante
La historia evidente es que «NVIDIA va camino a los billones de parámetros». La menos evidente es que la frontera de pesos abiertos llegó primero allí. Kimi K3 abrió sus pesos el 27 de julio con 2,8 billones de parámetros en total — unos 104 mil millones activos por token en una configuración de mezcla de expertos — y el Qwen3.8-Max de Alibaba, presentado el 19 de julio, es un modelo de 2,4 billones en total con aproximadamente 95 mil millones activos. Frente a ellos, un buque insignia Nemotron 4 con «al menos 1 billón» duplicaría al Nemotron 3 Ultra, pero aún así quedaría rezagado frente a los líderes en tamaño, y ambos líderes son chinos.

Eso convierte al número total de parámetros en la lente equivocada por completo. En un modelo de mezcla de expertos, lo que determina el costo y la velocidad es el número de parámetros activos por token, no el total de cara al titular. Un Nemotron 4 con un billón en total podría quedarse en unos 100 mil millones activos — justo en el nivel de Kimi K3 y Qwen3.8-Max — o en la mitad de eso. El número que se filtre a continuación es el que importa, y todavía no se ha filtrado.

También vale la pena señalar la otra dirección: DeepSeek V4-Flash, lanzado el 31 de julio bajo licencia MIT, tomó el camino opuesto — 284 mil millones en total, posicionado en el precio más que en la escala, con un costo estimado de alrededor de $0.14 por millón de tokens de entrada. El mercado está recompensando ambos extremos. La escala no es la estrategia; es una estrategia.
La posición de NVIDIA explica el movimiento. The Information informa que Nemotron 3 Ultra ocupa el segundo lugar entre los modelos de pesos abiertos de EE. UU., por detrás de Inkling de Thinking Machines, y fuera del nivel superior del ranking global abierto. Nemotron 4 es el intento de volver a la conversación de frontera, y los propios ejecutivos de NVIDIA lo enmarcan como una jugada de soberanía: la vicepresidenta de IA generativa, Kari Briski, dijo que NVIDIA invierte en Nemotron porque «todas las empresas y todos los países necesitan modelos de código abierto de frontera accesibles para fortalecer la seguridad y la protección, acelerar la innovación y proporcionar una base en la que puedan confiar de una generación a la siguiente». Jensen Huang ha estado defendiendo lo mismo en X, argumentando que los modelos abiertos «fortalecen la seguridad y la ciberseguridad, aceleran la innovación y la difusión, y permiten la soberanía». La tensión estructural es real: se informa que NVIDIA posee aproximadamente $30 mil millones de OpenAI, pero la apuesta es que los modelos abiertos expanden el pastel de las GPU en lugar de reducirlo. Como dijo el CEO de LMArena, Anastasios Angelopoulos: «No importa qué empresa cree un gran modelo de código abierto; NVIDIA gana».
La Coalición Nemotron es la parte a observar.
Nemotron 4 no es un proyecto en solitario, y ese es el detalle que la mayor parte de la cobertura pasa por alto. En la GTC del 16 de marzo de 2026, NVIDIA anunció la Coalición Nemotron —ocho miembros fundadores: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam y Thinking Machines Lab— organizados para aunar investigación, datos y capacidad de cómputo en apoyo de los "modelos abiertos de frontera". Su primer proyecto es un modelo base desarrollado conjuntamente por Mistral AI y NVIDIA, entrenado en NVIDIA DGX Cloud, que, según la coalición, será de código abierto y servirá de base para la familia Nemotron 4.
The Information añade los detalles operativos: Reflection, Cursor, Thinking Machines y Mistral son contribuyentes confirmados; Prime Intellect aportó 300 000 entornos de simulación para el entrenamiento; Cognition ha hablado de suministrar datos de entrenamiento de código. El CEO de Prime Intellect, Vincent Weisser, planteó la alianza como una acción colectiva contra lo que llamó un monopolio de modelo único "similar a un dios". En términos operativos, esto significa que Nemotron 4 podría distribuirse como una base de consorcio que cada miembro ajusta posteriormente para su propio producto, en lugar del checkpoint de un único proveedor. Eso haría que "modelo NVIDIA de pesos abiertos" fuera la categoría equivocada: la base es el artefacto interesante.
Confirmado, reportado, desconocido
• Confirmado — NVIDIA está trabajando en una familia Nemotron 4 (declaración de la empresa). La Coalición Nemotron existe y está construyendo un modelo base abierto con Mistral AI (NVIDIA, marzo de 2026).
• Reportado, sin confirmar — el objetivo insignia de "al menos 1 billón"; el cronograma de finales de otoño; el compromiso en la nube de ~$28 mil millones con ~$7 mil millones este año fiscal; qué contribuye cada miembro de la coalición.
• Desconocido: cantidad de parámetros activos, longitud de contexto, combinación de modalidades, términos de licencia, precio, qué checkpoints se lanzan primero y si la base codesarrollada con Mistral realmente se convierte en la base de la familia.
Cronología y qué ver
No hay fecha de lanzamiento. La ejecución final de entrenamiento no ha comenzado; los empleados la describen como de varios meses de duración, y las estimaciones van desde «finales de otoño» (dos fuentes) hasta más tarde. NVIDIA ha mantenido la familia en movimiento mientras tanto: lanzó Nemotron 3.5 Lightning, un agente trabajador de 31.6B parámetros publicado el 11 de agosto — el mismo día en que se difundió el informe de Nemotron 4 — junto con NeMo Switchyard, el software de enrutamiento de código abierto de NVIDIA. En otras palabras, NVIDIA está iterando activamente la línea mientras el buque insignia sigue aún en la mesa de diseño.
Qué ver, en orden aproximado de importancia:
• Parámetros activos: el total es la cifra principal; el número de activos determina el costo y la velocidad. Un MoE de ~1T total con ~100B activos cambia todo el panorama en comparación con uno de ~50B.
• Puntuaciones independientes — no existe evaluación de terceros para un modelo que no ha sido entrenado. Vigila el Artificial Analysis Intelligence Index cuando aparezca un checkpoint alojado.
Condiciones de licencia: Nemotron 3 Ultra se distribuye bajo OpenMDW-1.1, una licencia permisiva pero que no es MIT ni Apache 2.0. Aún no se ha decidido si Nemotron 4 mantendrá este enfoque o lo endurecerá, y para una empresa que desarrolla sobre los pesos, esta decisión lo determina todo.
• ¿Qué tamaños se envían primero? — Nemotron 3 llegó como una familia (Nano, Super, Ultra). Espera una gama de tamaños de Nemotron 4, y espera los pequeños antes que el buque insignia.
• La base Mistral — si el modelo base de la coalición se convierte realmente en el fundamento de la familia es la cuestión estructural detrás de toda la discusión sobre parámetros.
• Precio: no se aloja nada, por lo que no hay nada con precio. Cuando un socio de alojamiento publique Nemotron 4, el precio de transferencia será lo que realmente pague.
Qué significa para tu capa de inferencia
No puedes llamar a Nemotron 4 hoy — nadie puede — así que la pregunta práctica es cuánto de tu stack debe cambiar para acomodar un modelo cuya ficha técnica aún se está moviendo. La respuesta es la misma que para cualquier modelo frontera no lanzado: mantén la capa de inferencia agnóstica al modelo. Si enrutas a través de una única API que da acceso a más de 200 modelos, una nueva familia Nemotron es un cambio de configuración, no una reescritura. OrcaRouter traspasa el precio de lista del proveedor con un margen del 0%, así que lo que un host finalmente cobre por Nemotron 4 es exactamente lo que pagas, y un recorte de precio del proveedor se aplica el mismo día en que se realiza. El failover automático es la herramienta para un primer lanzamiento no probado: dirige el tráfico inicial hacia el nuevo modelo, recurre a una alternativa estable cuando se detiene o falla, y promuévelo a producción solo después de que se gane tus cargas de trabajo. Nada de eso requiere apostar una ruta de producción por una filtración — que es exactamente la postura correcta cuando la ficha técnica es tan provisional.
Preguntas frecuentes
¿Cuándo se lanzará Nemotron 4?
No se ha fijado ninguna fecha. Empleados dijeron a The Information que la ejecución final del entrenamiento no ha comenzado y tomará meses; dos dijeron que es posible finales de otoño de 2026, y otros esperan que sea más tarde. Trate "finales de otoño" como una estimación optimista desde dentro del proyecto, no como una hoja de ruta.
¿Será Nemotron 4 de código abierto?
La intención declarada de NVIDIA son los pesos abiertos, y el primer proyecto de la Coalición Nemotron — el modelo base desarrollado conjuntamente con Mistral — está comprometido a ser de código abierto. Pero «pesos abiertos» no es «código abierto»: Nemotron 3 Ultra se distribuye bajo la licencia OpenMDW-1.1, que es más permisiva que los términos anteriores de NVIDIA, pero sigue sin ser MIT ni Apache 2.0. La licencia específica de Nemotron 4 no ha sido anunciada.
¿Es "al menos 1 billón de parámetros" una especificación real?
Se trata de un objetivo proveniente de empleados, reportado por The Information, no de una especificación confirmada, y el mismo informe dice que la cifra podría cambiar. Incluso con un total de 1 billón, quedaría por detrás de Kimi K3 (2,8 billones) y Qwen3.8-Max (2,4 billones) en tamaño bruto; el número de parámetros activos —que no se ha filtrado— es la cifra que determinará el costo y la velocidad.
¿Debería esperar a Nemotron 4 antes de elegir un modelo?
No. Está a meses de distancia en el mejor de los casos y no está probado. Elige el mejor modelo disponible para la tarea ahora y mantén la capa de enrutamiento flexible; cuando Nemotron 4 realmente se lance, evalúalo de la misma manera que evaluarías cualquier modelo nuevo — parámetros activos, benchmarks independientes, licencia y precio — en lugar de basarte en la cifra total anunciada.
En resumen
La familia es real; los números son estimaciones. NVIDIA ha confirmado que está construyendo Nemotron 4, y la estructura de coalición que lo rodea es la parte más interesante de la historia — pero cada cifra destacada en la filtración, desde el mínimo de un billón hasta el cronograma de finales de otoño y el presupuesto de $28 mil millones, proviene de empleados no identificados y podría cambiar. La frontera de peso abierto ya ha superado la marca del billón de parámetros, liderada por laboratorios chinos, y la respuesta de NVIDIA es un modelo base de consorcio más una promesa. Para un lector que elige modelos hoy, eso significa una cosa: no planifiques a partir de la filtración. Mantén la capa de inferencia flexible, evalúa lo que se lance según sus cifras reales, y deja que el enrutamiento haga aquello para lo que existe — probar lo nuevo sin apostar la ruta de producción en ello.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
