NVIDIA apresentou o Nemotron 3, um modelo de 120 bilhões de parâmetros, que pode operar com desempenho equivalente a modelos de 12 bilhões. A demonstração ocorreu durante a GTC 2026, em San Jose, nos EUA, com a empresa destacando que o modelo pode ser utilizado gratuitamente.
Segundo a empresa, é possível rodar um modelo quase do tamanho do Llama 70B em uma GPU doméstica, com triplo de velocidade, sem depender de data center. O engenheiro Corey testou o Nemotron 3 em uma RTX 4000, confirmando o desempenho. Também houve menção a uma versão nano para menos memória.
O Nemotron 3 é integrada ao NemoClaw, um runtime de código aberto para agentes OpenClaw que rodam de forma segura em hardware próprio. A proposta é viabilizar agentes autônomos que executam tarefas, não apenas respondem a perguntas.
Painel Open Model Super Panel
No painel, moderated por Jensen Huang, foram apresentadas novas perspectivas sobre agentes abertos, com participação de representantes da Perplexity, LangChain, Thinky e Cursor. Destaques incluíram a ideia de que o foco passa de modelos para sistemas, com a “engenharia de harness” ganhando importância.
Outros pontos discutidos envolvem a construção de um ecossistema com agentes, ferramentas e políticas que ampliem a confiabilidade e a personalização. A visão é de que aberturas e soluções proprietárias podem coexistir para acelerar aplicações empresariais.
Seção de conteúdos complementares aponta caminhos para executar o Nemotron 3 em diferentes ambientes, além de guias do NemoClaw e do OpenClaw. A cobertura completa está disponível nos materiais da equipe da Neuron sobre o evento e as inovações apresentadas.
Entre na conversa da comunidade