Nvidia ha pubblicato Nemotron 3.5 Lightning, un modello linguistico a pesi aperti progettato per l'esecuzione di agenti IA ad alte prestazioni su hardware locale e data center. Rilasciato sotto licenza OpenMDW 1.1, il sistema adotta un'architettura Mixture-of-Experts (MoE) da 30B di parametri totali, di cui soltanto 3B attivi per ciascun token generato, ottimizzato per compiti quali la revisione del codice, il monitoraggio degli allarmi di sicurezza, la gestione dei ticket commerciali e l'interazione con tool esterni. Ma se la variante 3.5 Lightning risponde alla domanda di efficienza distribuita, le indiscrezioni raccolte da The Information confermano che la casa di Santa Clara sta spingendo sull'acceleratore per la nuova generazione: Nemotron 4.

Il flagship della famiglia dovrebbe contare almeno 1 trilione (1T) di parametri, superando nettamente i 550B di parametri dell'attuale Nemotron 3 Ultra e posizionandosi come una delle architetture a pesi aperti pi� imponenti mai realizzate. Attualmente in fase avanzata di addestramento, il modello da 1T potrebbe fare il suo debutto gi� verso la fine dell'autunno 2026, sebbene Nvidia non abbia ancora confermato ufficialmente n� il conteggio definitivo dei parametri n� le tempistiche esatte di lancio.