A Nvidia estaria desenvolvendo uma nova família de modelos Nemotron com versões de até 1 trilhão de parâmetros. O projeto, chamado Nemotron 4, poderá ser apresentado até o fim do outono no hemisfério norte e deverá incluir modelos com pesos abertos.
A iniciativa amplia a presença da companhia além da venda de processadores, redes e sistemas completos para centros de dados. Um modelo de grande porte permitiria oferecer aos clientes uma plataforma de inteligência artificial otimizada para operar em sua própria infraestrutura.
O número de parâmetros indica a escala do sistema, mas não determina sozinho sua qualidade. Arquitetura, dados de treinamento e métodos de aperfeiçoamento podem fazer modelos menores superarem versões maiores em tarefas específicas.
O Nemotron 4 poderá usar uma arquitetura de mistura de especialistas, na qual apenas partes do modelo são ativadas para cada solicitação. Essa técnica distribui conhecimentos entre conjuntos especializados e reduz o custo de processamento em comparação com a ativação simultânea de todos os parâmetros.
A estratégia de modelos abertos também favorece o negócio de hardware da Nvidia. Empresas e governos podem adaptar o sistema para atendimento, engenharia, administração de saúde ou pesquisa jurídica e executá-lo em ambientes próprios, gerando demanda por servidores durante treinamento, personalização e uso.
O movimento ocorre enquanto modelos chineses com pesos acessíveis e custos menores ganham espaço. A competição aumenta a pressão para que empresas americanas ofereçam alternativas que possam ser baixadas, modificadas e implantadas sem depender exclusivamente de interfaces fechadas.
Imagem gerada por IA.


