Nemotron
La famiglia di modelli linguistici open-weight di Nvidia, ottimizzati per la velocità e l'efficienza piuttosto che per la massima intelligenza.
Nemotron è la linea di modelli linguistici di Nvidia, rilasciata con pesi aperti in modo che chiunque possa scaricarli ed eseguirli. La strategia dietro di loro è insolita per un’azienda di chip: invece di inseguire i punteggi di riferimento più alti, Nvidia costruisce modelli che eseguono molti piccoli passi in modo rapido ed economico, che è esattamente ciò di cui ha bisogno un agente di intelligenza artificiale che lavora con un compito lungo.
I ricercatori di Nvidia hanno sostenuto in pubblico che i modelli con meno di 10 miliardi di parametri possono gestire la maggior parte dei carichi di lavoro degli agenti così come modelli molte volte più grandi, a una piccola frazione del costo. Nemotron 3.5 Lightning, rilasciato nell’agosto 2026, è l’esempio più chiaro finora: corrisponde a un modello quattro volte più grande in termini di punteggi di intelligenza producendo quasi 670 token al secondo, il più veloce nel suo gruppo di confronto.