
Vazamento do Nemotron 4: a resposta da NVIDIA à fronteira com 1 trilhão de parâmetros e pesos abertos
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 143 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
O Nemotron 4 ainda não foi lançado, mas deixou de ser um rumor com apenas uma contagem de parâmetros nesta semana. O The Wall Street Journal noticiou em 22 de agosto de 2026, citando pessoas familiarizadas com o assunto, que a NVIDIA está gastando cerca de US$ 6 bilhões para transformar o Nemotron 4 em um dos modelos de IA de pesos abertos mais poderosos do mundo — e que o plano inclui uma licença não exclusiva para a tecnologia de treinamento de modelos da startup de IA Poolside, além da transferência de mais de 100 engenheiros da Poolside para o projeto Nemotron 4. Isso se soma ao vazamento anterior do The Information, de 11 de agosto, de que o principal modelo da família terá "pelo menos 1 trilhão de parâmetros". Combinados, os dois relatórios descrevem a tentativa mais séria até agora da NVIDIA de chegar ao topo da fronteira dos pesos abertos.
Nada aqui foi lançado, e nada disso está confirmado. A NVIDIA reconheceu que está construindo uma família Nemotron 4, mas não confirmou o alvo de parâmetros, o cronograma, o plano de licenciamento e contratação que o WSJ atribui a pessoas familiarizadas com o acordo, nem os detalhes da aliança que o The Information atribui a funcionários não identificados. Trate cada número neste artigo como "relatado", não "especificado". O objetivo de um texto sobre vazamento é separar o pequeno núcleo confirmado do halo maior relatado — e dizer quais partes importam quando a ficha técnica real chegar.
O vazamento de uma linha, detalhado
Primeiro, o nome, porque vai confundir você nos resultados de busca: a NVIDIA já lançou um modelo chamado Nemotron-4-340B em junho de 2024. O novo Nemotron 4 é uma família diferente e maior — a sucessora da linha Nemotron 3 (Nano, Super, Ultra) lançada este ano — reutilizando o nome "Nemotron 4" para a geração seguinte. Este artigo é sobre o novo.
O que The Information realmente noticiou: a NVIDIA está desenvolvendo o Nemotron 4 como uma família de modelos de código aberto voltados para o topo do ranking de pesos abertos, e espera-se que o modelo principal tenha "pelo menos 1 trilhão de parâmetros". A NVIDIA não definiu uma data de lançamento, não iniciou a execução final do treinamento — um processo que os funcionários esperam que leve meses — e definiu apenas os dados de pré-treinamento e a arquitetura; a especificação ainda está em aberto. Dois funcionários disseram que a família pode ficar pronta já no final do outono; outros esperam que seja mais tarde.
O mesmo relatório anexa um orçamento separado: aproximadamente {{1}}US$ 28 bilhões{{/1}} em acordos plurianuais de serviços em nuvem com vigência até o início de 2031, cerca de três vezes o que a NVIDIA divulgou um ano antes, com cerca de {{2}}US$ 7 bilhões{{/2}} chegando no atual ano fiscal. Esse valor cobre compromissos de computação, não o novo acordo divulgado esta semana. O relatório também observa que o artigo de pesquisa da versão anterior listava 570 autores, e o Nemotron 4 envolve mais — um ex-funcionário disse ao The Information que "todos querem participar". Tudo isso não foi divulgado pela NVIDIA.

Esta semana: um acordo de US$ 6 bilhões da Poolside para tornar o Nemotron 4 real
O The Wall Street Journal noticiou esta semana que o plano da NVIDIA para o Nemotron 4 não é apenas um projeto de pesquisa — é uma construção financiada. Segundo o WSJ, citando pessoas familiarizadas com o assunto, a NVIDIA pagará cerca de US$ 6 bilhões por uma licença não exclusiva da "Model Factory" da Poolside, o sistema de treinamento e avaliação por trás dos modelos de codificação Laguna, de pesos abertos, da Poolside, e fará ofertas de emprego a mais de 100 funcionários da Poolside — relatados como 109, a maioria engenheiros — para trabalhar no projeto Nemotron. A Bloomberg, separadamente, informou que a NVIDIA investirá US$ 1 bilhão adicional na Poolside, com uma avaliação pré-money de US$ 12 bilhões, elevando o compromisso total relatado da NVIDIA para aproximadamente US$ 7 bilhões.
Não é uma aquisição. A licença é não exclusiva, os fundadores da Poolside permanecem, e a Poolside continua operando como uma empresa independente; de acordo com as reportagens, a Poolside planeja distribuir o pagamento de US$ 6 bilhões da licença aos seus investidores. A história veio à tona primeiramente pelo Newcomer em 20 de agosto e foi confirmada pela Bloomberg em 21 de agosto e pelo WSJ em 22 de agosto — tudo ainda como "noticiado", nada disso confirmado pela NVIDIA ou pela Poolside.
{{1}}Por que o acordo importa mais do que o número das manchetes: ele dá ao projeto Nemotron 4 uma equipe que de fato já lançou modelos open-weight. A família Laguna da Poolside é uma linha comprovada de codificação open-weight, e a meta relatada — um lançamento do Nemotron em cerca de um ano que possa competir com os modelos de fronteira mais fortes — é o primeiro prazo concreto que alguém atribuiu ao projeto.{{/1}} {{2}}Os relatórios apresentam a medida como a resposta da NVIDIA aos líderes de open-weight na China, notadamente DeepSeek e o Kimi K3 da Moonshot AI, e, no debate entre aberto e fechado, como uma proteção contra os laboratórios fechados dos EUA.{{/2}}
A estrutura também importa. Uma licença não exclusiva significa que a Poolside mantém sua propriedade intelectual e pode licenciar a mesma tecnologia para outros — a NVIDIA está comprando capacidade e talento, não propriedade. Os analistas interpretam isso como um esforço da NVIDIA para manter a camada de modelos commoditizada: se os modelos de pesos abertos continuarem fortes e baratos, a demanda continua fluindo para a camada que a NVIDIA controla — as GPUs. Como disse o CEO da LMArena, Anastasios Angelopoulos, na reportagem anterior: "Não importa qual empresa crie um ótimo modelo de código aberto, a NVIDIA vence."
Por que o número do tamanho é a parte menos interessante
A história óbvia é: "A NVIDIA está indo para trilhões de parâmetros." A menos óbvia é que a fronteira de pesos abertos chegou lá primeiro. A Kimi K3 abriu seus pesos em 27 de julho com 2,8 trilhões de parâmetros no total — cerca de 104 bilhões de ativos por token em uma configuração de mistura de especialistas — e o Qwen3.8 Max da Alibaba, apresentado em 19 de julho, é um modelo de 2,4 trilhões no total com cerca de 95 bilhões de ativos. Diante disso, um carro-chefe Nemotron 4 com "pelo menos 1 trilhão" dobraria o Nemotron 3 Ultra, mas ainda ficaria atrás dos líderes em tamanho, e ambos os líderes são chineses.

Isso torna a contagem total de parâmetros uma lente totalmente equivocada. Em um modelo de mistura de especialistas, o que determina custo e velocidade é a contagem de parâmetros ativos por token, não o total divulgado. Um Nemotron 4 com 1 trilhão no total poderia ter cerca de 100 bilhões de parâmetros ativos — exatamente na faixa do Kimi K3 e do Qwen3.8 Max — ou metade disso. O número que vazar em seguida é o que importa, e ele ainda não vazou.

A outra direção também é digna de nota: o DeepSeek V4-Flash, lançado em 31 de julho sob licença MIT, seguiu o caminho oposto — 284 bilhões no total, posicionado pelo preço em vez da escala, com um custo estimado em cerca de US$ 0,14 por milhão de tokens de entrada. O mercado está recompensando ambos os extremos. Escala não é a estratégia; é uma estratégia.
A posição da NVIDIA explica a jogada. The Information informa que o Nemotron 3 Ultra ocupa o segundo lugar entre os modelos de pesos abertos dos EUA — atrás do Inkling, da Thinking Machines — e fora do nível superior do ranking global de modelos abertos. O Nemotron 4 é a tentativa de voltar à conversa de fronteira, e os próprios executivos da NVIDIA a enquadram como uma jogada de soberania: a VP de IA generativa, Kari Briski, disse que a NVIDIA investe no Nemotron porque "toda empresa e todo país precisam de modelos abertos de fronteira acessíveis para fortalecer a segurança e a proteção, acelerar a inovação e fornecer uma base na qual possam confiar de uma geração para a outra". Jensen Huang tem defendido o mesmo no X, argumentando que os modelos abertos "fortalecem a segurança e a cibersegurança, aceleram a inovação e a difusão e permitem a soberania". A tensão estrutural é real — a NVIDIA supostamente possui cerca de US$ 30 bilhões da OpenAI — mas a aposta é que os modelos abertos expandem o bolo de GPUs em vez de encolhê-lo.
A Coalizão Nemotron é a parte a observar.
Nemotron 4 não é um projeto solo, e o acordo com a Poolside não é a única estrutura em torno dele. Na GTC, em 16 de março de 2026, a NVIDIA anunciou a Coalizão Nemotron — oito membros fundadores: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection AI, Sarvam e Thinking Machines Lab — organizados para reunir pesquisa, dados e computação em prol de "modelos abertos de fronteira". Seu primeiro projeto é um modelo base codesenvolvido pela Mistral AI e pela NVIDIA, treinado no NVIDIA DGX Cloud, que, segundo a coalizão, será de código aberto e servirá de base para a família Nemotron 4.
O The Information acrescenta os detalhes do trabalho: Reflection, Cursor, Thinking Machines e Mistral são colaboradores confirmados; a Prime Intellect contribuiu com 300.000 ambientes de simulação para treinamento; a Cognition discutiu o fornecimento de dados de treinamento de código. O CEO da Prime Intellect, Vincent Weisser, enquadrou a aliança como uma ação coletiva contra o que ele chamou de monopólio de um único modelo "semelhante a um deus". O que isso significa na prática: o Nemotron 4 pode ser lançado como uma base de consórcio que cada membro ajusta para seu próprio produto, em vez de um checkpoint de um único fornecedor. Isso tornaria "modelo NVIDIA de pesos abertos" a categoria errada — a base é o artefato interessante.
O acordo com a Poolside se encaixa ao lado de tudo isso. A coalizão reúne pesquisa e computação; a licença-e-contratação traz uma fábrica de modelos em funcionamento e uma equipe que já lançou pesos abertos. Se os relatórios se confirmarem, a NVIDIA está montando o Nemotron 4 a partir de três fontes ao mesmo tempo — sua própria operação de treinamento, uma base de consórcio e o sistema de produção da Poolside — o que é uma configuração diferente de qualquer lançamento de checkpoint único.
Confirmado, relatado, desconhecido
• Confirmado — a NVIDIA está trabalhando em uma família Nemotron 4 (declaração da empresa). A Coalizão Nemotron existe e está construindo um modelo base aberto com a Mistral AI (NVIDIA, março de 2026).
• Relatado, não confirmado — a meta principal de "pelo menos US$ 1 trilhão" e o cronograma para o final do outono, além do compromisso de nuvem de cerca de US$ 28 bilhões, com cerca de US$ 7 bilhões neste ano fiscal (The Information); o orçamento de construção de cerca de US$ 6 bilhões noticiado pelo WSJ, a licença não exclusiva do "Model Factory" da Poolside e mais de 100 engenheiros da Poolside se juntando ao projeto Nemotron; o investimento de US$ 1 bilhão da NVIDIA na Poolside noticiado pela Bloomberg, com avaliação pré-money de cerca de US$ 12 bilhões; quais membros da coalizão contribuem com o quê.
• Desconhecido — contagem de parâmetros ativos, comprimento do contexto, combinação de modalidades, termos de licença, preço, quais checkpoints são lançados primeiro, se a base co-desenvolvida com a Mistral realmente se torna a fundação da família e se o acordo com a Poolside é estruturado como relatado (nenhuma das empresas comentou).
Linha do tempo e o que assistir
Ainda não há data de lançamento. A execução final de treinamento não começou; funcionários a descrevem como algo que leva meses, e as estimativas variam de "final do outono" (duas fontes) a mais tarde. A reportagem da Poolside acrescenta o primeiro prazo concreto já atribuído ao projeto: de acordo com a cobertura, o objetivo é um lançamento em aproximadamente um ano que possa competir com os modelos de fronteira mais fortes. A NVIDIA manteve a família em movimento nesse meio-tempo: disponibilizou o Nemotron 3.5 Lightning, um agente de trabalho com 31,6B de parâmetros, lançado em 11 de agosto — no mesmo dia em que o relatório do Nemotron 4 foi divulgado — juntamente com o NeMo Switchyard, o software de roteamento de código aberto da própria NVIDIA.
O que assistir, em ordem aproximada de importância:
• Parâmetros ativos — o total é o destaque; a contagem de ativos decide custo e velocidade. Uma MoE de ~1T no total com ~100B ativos muda completamente o cenário em comparação com uma de ~50B.
• A integração da Poolside — se a licença do Model Factory e sua nova equipe realmente remodelam o plano de treinamento e comprimem o cronograma informado, ou se é a aquisição de talentos que mantém o plano de pé.
• Pontuações independentes — não existe avaliação de terceiros para um modelo que não foi treinado. Acompanhe o Artificial Analysis Intelligence Index quando um checkpoint hospedado aparecer.
• Termos de licença — Nemotron 3 Ultra é distribuído sob OpenMDW-1.1, permissivo, mas não MIT ou Apache 2.0. Se o Nemotron 4 segue ou endurece ainda não foi decidido, e para uma empresa que constrói sobre os pesos, isso decide tudo.
• {{1}}Quais tamanhos serão lançados primeiro — a Nemotron 3 chegou como uma família (Nano, Super, Ultra). Espere uma variedade de tamanhos da Nemotron 4, e espere os menores antes do carro-chefe.{{/1}}
A base Mistral — se o modelo base da coalizão realmente se torna o alicerce da família é a questão estrutural por trás de toda a conversa sobre parâmetros.
• Preço — nada é hospedado, então nada é precificado. Quando um parceiro de hospedagem lista o Nemotron 4, o preço de repasse é o que você realmente pagará.
O que isso significa para sua camada de inferência
Você não pode chamar o Nemotron 4 hoje — ninguém pode — e os relatórios da Poolside, por mais dramáticos que sejam, não mudam isso. A questão prática continua sendo quanto da sua stack deve mudar para acomodar um modelo cuja ficha técnica ainda está em movimento. A resposta é a mesma para qualquer modelo de fronteira ainda não lançado: mantenha a camada de inferência agnóstica em relação ao modelo. Se você rotear por uma única API que atende mais de 200 modelos, uma nova família Nemotron é uma mudança de configuração, não uma reescrita. O OrcaRouter repassa o preço de tabela do provedor com margem de 0%, então qualquer valor que um host eventualmente cobre pelo Nemotron 4 é exatamente o que você paga, e um corte de preço do fornecedor chega no mesmo dia em que é feito. O failover automático é a ferramenta para um primeiro lançamento não comprovado: direcione o tráfego inicial para o novo modelo, volte para uma alternativa estável quando ele travar ou apresentar erros, e promova-o para produção somente depois que ele conquistar suas cargas de trabalho. Nada disso exige apostar um caminho de produção em um vazamento — que é exatamente a postura correta quando a ficha técnica é tão provisória.
Perguntas Frequentes
Quando o Nemotron 4 será lançado?
Nenhuma data foi definida. Funcionários disseram ao The Information que a execução final do treinamento ainda não começou e levará meses; dois disseram que o final do outono de 2026 é possível, e outros esperam mais tarde. A reportagem desta semana acrescenta uma meta relatada de lançamento competitivo em nível de fronteira dentro de aproximadamente um ano, mas ainda sem data firme. Trate ambos como estimativas internas do projeto, não como um roteiro.
O Nemotron 4 será de código aberto?
A intenção declarada da NVIDIA é {{1}}pesos abertos{{/1}}, e o primeiro projeto da Coalizão Nemotron — o modelo base codesenvolvido com a Mistral — tem o compromisso de ser {{2}}de código aberto{{/2}}. Mas {{3}}"pesos abertos"{{/3}} não é "código aberto": o Nemotron 3 Ultra é distribuído sob a licença {{4}}OpenMDW-1.1{{/4}}, que é mais permissiva que os termos antigos da NVIDIA, mas ainda não é MIT ou Apache 2.0. A licença específica do Nemotron 4 não foi anunciada.
O acordo relatado de US$ 6 bilhões da Poolside está confirmado?
Não. O WSJ noticiou a licença de ~US$ 6 bilhões e a incorporação de mais de 100 engenheiros da Poolside ao projeto Nemotron em 22 de agosto, citando pessoas familiarizadas com o assunto; a Bloomberg noticiou o investimento adicional de US$ 1 bilhão. A Newcomer reportou pela primeira vez em 20 de agosto. Nem a NVIDIA nem a Poolside confirmaram qualquer coisa. A licença é relatada como não exclusiva, e a Poolside permaneceria como empresa independente.
"Pelo menos 1 trilhão de parâmetros" é uma especificação real?
É uma meta proveniente de funcionários, reportada pelo The Information, não uma especificação confirmada, e o mesmo relatório diz que o número pode mudar. Mesmo com 1 trilhão no total, ficaria atrás do Kimi K3 (2,8T) e do Qwen3.8 Max (2,4T) em tamanho bruto; a contagem de parâmetros ativos — que não vazou — é o número que determinará custo e velocidade.
Devo esperar pelo Nemotron 4 antes de escolher um modelo?
Não. Ainda está a meses de distância, na melhor das hipóteses, e não foi comprovado. Escolha o melhor modelo disponível para a tarefa agora e mantenha a camada de roteamento flexível; quando o Nemotron 4 for de fato lançado, avalie-o da mesma forma que avaliaria qualquer novo modelo — parâmetros ativos, benchmarks independentes, licença e preço — em vez do total divulgado ou do tamanho do orçamento relatado.
Conclusão
{{1}}A família é real; os números são estimativas.{{/1}} {{2}}Esta semana a história mudou de forma: Nemotron 4 não é mais apenas um vazamento de parâmetros, é um projeto financiado.{{/2}} {{3}}A NVIDIA, segundo relatos, está gastando cerca de US$ 6 bilhões, licenciando a Model Factory da Poolside, contratando mais de 100 dos seus engenheiros e investindo mais US$ 1 bilhão na empresa{{/3}} — {{4}}tudo para criar um carro-chefe de pesos abertos que possa estar à altura do DeepSeek e do Kimi K3.{{/4}} {{5}}Cada um desses números foi divulgado pela imprensa, nenhum foi confirmado, e nada foi lançado.{{/5}} {{6}}A fronteira de pesos abertos já passou da marca do trilhão de parâmetros, e a resposta da NVIDIA é um modelo-base de consórcio, uma Model Factory licenciada e uma promessa.{{/6}} {{7}}Para quem está escolhendo modelos hoje, isso ainda significa uma coisa: não planeje em torno do vazamento.{{/7}} {{8}}Mantenha a camada de inferência flexível, avalie o que for lançado com base nos seus números reais e deixe o roteamento fazer o que o roteamento faz — experimentar a novidade sem apostar o caminho de produção nela.{{/8}}
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
