← Glossar Modell
GPT-Red
Ein internes OpenAI-Modell, das die eigenen Systeme angreift und nach Sicherheitslücken sucht.
GPT-Red wurde von OpenAI eigens darauf trainiert, andere Systeme des Unternehmens auf Schwachstellen zu prüfen. Es verhält sich wie ein automatisierter Angreifer, damit Probleme behoben werden können, bevor echte Angreifer sie entdecken. Berichten zufolge findet es Fehler häufiger als menschliche Fachleute.
Das Modell ist ein eindrückliches Beispiel dafür, wie KI zu Verteidigungszwecken gegen KI eingesetzt wird. Zugleich zeigt es, warum Sicherheit immer wichtiger wird, sobald Modelle im Auftrag von Menschen handeln.
Erwähnt in