← Glossario Modello
GPT-Red
Un modello interno di OpenAI creato per attaccare i propri sistemi e trovarne le falle.
OpenAI ha addestrato GPT-Red per sondare i propri sistemi alla ricerca di debolezze. Agisce come un aggressore automatico affinché i problemi vengano individuati e risolti prima di un vero attacco. Secondo le informazioni disponibili, trova difetti più spesso degli esperti umani.
È un esempio notevole di IA rivolta contro se stessa a scopo difensivo e del motivo per cui la sicurezza diventa centrale quando i modelli iniziano ad agire per conto delle persone.
Citato in