← Glossaire Modèle
GPT-Red
Un modèle interne d’OpenAI conçu pour attaquer ses propres systèmes et découvrir leurs failles.
OpenAI a entraîné GPT-Red spécifiquement pour rechercher les faiblesses de ses autres systèmes. Il agit comme un attaquant automatisé afin que les problèmes soient repérés et corrigés avant que de vrais adversaires ne les trouvent. Selon certaines informations, il détecterait davantage de failles que les experts humains.
C’est un exemple frappant d’IA employée contre elle-même à des fins défensives, et une illustration de l’importance croissante de la sécurité à mesure que les modèles agissent pour le compte des personnes.
Mentionné dans