Nemotron
Nvidias Familie offener Sprachmodelle, die eher auf Geschwindigkeit und Effizienz als auf maximale Intelligenz ausgelegt sind.
Nemotron ist Nvidias eigene Reihe von Sprachmodellen, die mit offenen Gewichten veröffentlicht werden, sodass jeder sie herunterladen und ausführen kann. Die dahinter stehende Strategie ist für ein Chipunternehmen ungewöhnlich: Anstatt den höchsten Benchmark-Ergebnissen nachzujagen, baut Nvidia Modelle, die viele kleine Schritte sehr schnell und kostengünstig erledigen. Genau das braucht ein KI-Agent, der eine lange Aufgabe abarbeitet.
Nvidia-Forscher haben öffentlich argumentiert, dass Modelle mit weniger als 10 Milliarden Parametern die meisten Agenten-Arbeitslasten genauso gut bewältigen können wie Modelle, die um ein Vielfaches größer sind, und das zu einem kleinen Bruchteil der Kosten. Nemotron 3.5 Lightning, das im August 2026 veröffentlicht wurde, ist das bislang deutlichste Beispiel: Es entspricht einem Modell, das viermal so groß ist wie sein Intelligenzwert, und produziert gleichzeitig fast 670 Token pro Sekunde, das schnellste in seiner Vergleichsgruppe.