NOTÍCIA

NVIDIA prepara Nemotron 4 com 1 trilhão de parâmetros

NVIDIA trabalha em uma nova família de modelos de código aberto com pelo menos 1 trilhão de parâmetros. A informação veio do site The Information.

NVIDIA prepara Nemotron 4 com 1 trilhão de parâmetros
Imagem: Redação iMasters

NVIDIA trabalha em uma nova família de modelos de código abertoOpen source71 conteúdosComo o Open Source Está Liberando o Poder da Automação para TodosDev (Back & Front) · out 2025Código aberto: programadores criam software da NASA sem saberDev (Back & Front) · abr 2021N8N: O que é a ferramenta open source que está revolucionando a automação em TI?Dev (Back & Front) · dez 2025Ver tudo em Dev (Back & Front) com pelo menos 1 trilhão de parâmetros. A informação veio do site The Information e foi confirmada por pessoas ligadas ao projeto. O nome provável é Nemotron 4. Até agora, a empresa não comentou o assunto.

Para quem escreve código, a notícia tem peso. Afinal, um modelo aberto desse porte muda o cálculo de custo, de infraestrutura e de dependência de API.

NVIDIA quer disputar espaço com os modelos chineses

A fabricante de chips quer que a nova geração rivalize com os maiores modelos abertos do mundo. Os sistemas chineses estão no topo dessa lista. Além disso, eles ganharam tração conforme o custo dos modelos fechados subiu.

Existe um segundo motivo. Modelos abertos operam com menos travas de uso em cibersegurançaSegurança171 conteúdosCibersegurança no Brasil: 6 passos para sair da estagnaçãoDevSecOps · jul 2025O papel do CISO para transformar a cibersegurança em uma alavanca de reputação para as empresasDevSecOps · mar 2024Itaipu Parquetec e Exército Brasileiro realizam exercício de cibersegurança em BrasíliaDev (Back & Front) · set 2025Ver tudo em DevSecOps . Por isso, ganharam espaço depois dos ataques envolvendo IAs que escaparam de ambientes de teste. No caso da Hugging Face, por exemplo, a escolha para conter a invasão foi um modelo chinês. As travas de segurança das opções americanas impediram a reação.

NVIDIA amplia o ecossistema além das GPUs

A empresa ficou conhecida pelos chips que sustentam boa parte da IAInteligência artificial440 conteúdosUX e IA: Transformando Experiências Digitais com Inteligência ArtificialProduto & UX · jan 2025MCP: O que é e por que você vai ouvir falar disso em breve?AI · jul 2025IA generativa e a urgência de reconstruir nossa relação com a verdadeAI · jun 2025Ver tudo em AI atual. Agora, ela quer ocupar também a camada de software. A família Nemotron faz parte dessa estratégia.

Em outras palavras, o hardware deixa de ser o único produto. Assim, a companhia se posiciona como uma das poucas fornecedoras americanas de modelos abertos de grande porte.

Nemotron 4 deve estrear até dezembro

Segundo as fontes, o desenvolvimento está nas etapas finais. O treinamento ainda continua em andamento. Mesmo assim, o lançamento segue previsto para 2026.

A janela mais provável fica no último trimestre. Ou seja, entre outubro e dezembro. Nenhuma data oficial foi divulgada até agora.

NVIDIA lança o Nemotron 3.5 Lightning enquanto isso

A empresa anunciou no dia 11 a versão mais recente da família. O Nemotron 3.5 Lightning mira agentes especializados e tarefas de alta velocidade.

Os números divulgados falam em geração de tokens quatro vezes mais rápida. Além disso, o tempo de conclusão cai 30% frente a sistemas abertos da mesma categoria. O modelo roda em PCs com hardware da fabricante, em data centers e na nuvem.

Nemo Switchyard entra na jogada do roteamento

Junto com o Lightning, veio a biblioteca Nemo Switchyard. Ela direciona cada tarefa para o modelo mais adequado, de forma automática.

Para times de engenharia, isso resolve uma dor conhecida. Roteamento entre modelos costuma virar código caseiro cheio de regras. Portanto, uma camada pronta e aberta economiza manutenção.

O que 1 trilhão de parâmetros exige da sua infraestrutura

Rodar um modelo desse tamanho localmente exige muita memória. Na prática, a maioria dos times vai consumir o Nemotron 4 via API ou via nuvem. Ainda assim, os pesos abertos abrem três caminhos concretos.

Primeiro, ajuste fino com dados próprios sem enviar nada para fora. Depois, auditoria do comportamento do modelo em cenários sensíveis. Por fim, previsibilidade de custo, já que o preço vira uma conta de computação.

NVIDIA no radar: como se preparar antes do lançamento

Vale começar pelo básico. Teste o Nemotron 3.5 Lightning nas tarefas que hoje consomem mais tokens. Assim, você mede a diferença real de latência e de custo.

Depois, desenhe sua aplicação com troca de modelo por configuração. Dessa forma, a chegada do Nemotron 4 vira uma linha de ajuste no seu projeto.

Enquanto o mercado discute parâmetros, a conta que importa continua sendo a sua. Portanto, meça antes de migrar.

Acompanhe nosso perfil no Instagram!

Matérias especiais e reportagens conduzidas internamente pela Redação iMasters. Acompanhe no Twitter @imasters e no Instagram/Threads @portalimasters

Ver perfil
IMMMaturidade MarTech3,5 · Em desenvolvimento
Como você classificaria hoje o nível de maturidade tecnológica da área de marketing da sua empresa?