Nemotron
La familia de modelos de lenguaje abierto de Nvidia, optimizados para la velocidad y la eficiencia en lugar de la máxima inteligencia.
Nemotron es la línea propia de modelos de lenguaje de Nvidia, lanzada con pesos abiertos para que cualquiera pueda descargarlos y ejecutarlos. La estrategia detrás de ellos es inusual para una empresa de chips: en lugar de perseguir los puntajes de referencia más altos, Nvidia construye modelos que realizan muchos pasos pequeños de manera muy rápida y económica, que es exactamente lo que necesita un agente de IA que trabaja en una tarea larga.
Los investigadores de Nvidia han argumentado en público que los modelos con 10 mil millones de parámetros pueden manejar la mayoría de las cargas de trabajo de los agentes tan bien como modelos muchas veces mayores, a una pequeña fracción del costo. Nemotron 3.5 Lightning, lanzado en agosto de 2026, es el ejemplo más claro hasta el momento: iguala a un modelo cuatro veces su tamaño en puntuaciones de inteligencia y produce cerca de 670 tokens por segundo, el más rápido de su grupo de comparación.