Nemotron
La famille de modèles à langage ouvert de Nvidia, optimisée pour la vitesse et l'efficacité plutôt que pour une intelligence maximale.
Nemotron est la propre gamme de modèles de langage de Nvidia, publiée avec des poids ouverts afin que tout le monde puisse les télécharger et les exécuter. La stratégie qui les sous-tend est inhabituelle pour un fabricant de puces : au lieu de rechercher les scores de référence les plus élevés, Nvidia construit des modèles qui effectuent de nombreuses petites étapes très rapidement et à moindre coût, ce qui est exactement ce dont un agent d’IA travaillant sur une longue tâche a besoin.
Les chercheurs de Nvidia ont soutenu publiquement que les modèles comportant moins de 10 milliards de paramètres pouvaient gérer la plupart des charges de travail des agents ainsi que des modèles plusieurs fois plus importants, pour une petite fraction du coût. Nemotron 3.5 Lightning, sorti en août 2026, en est l’exemple le plus clair à ce jour : il correspond à un modèle quatre fois plus grand en termes d’intelligence tout en produisant près de 670 jetons par seconde, le plus rapide de son groupe de comparaison.