SaferAI
Une organisation à but non lucratif qui évalue de manière indépendante les capacités dangereuses des modèles d'IA et évalue le sérieux avec lequel les laboratoires gèrent les risques.
SaferAI est une organisation à but non lucratif qui teste les modèles d’IA de l’extérieur. Plutôt que de croire un laboratoire sur parole quant à la sécurité de son modèle, SaferAI effectue ses propres évaluations, souvent via l’API publique, et publie ce qu’il trouve. Il note également les entreprises d’IA en fonction de leurs pratiques de gestion des risques, ce qui en fait une présence régulière et parfois indésirable dans le cycle d’actualité du secteur.
Son évaluation en 2026 du modèle ouvert GLM-5.2 était un bon exemple de l’importance des tests indépendants : le modèle n’a refusé aucune des tâches offensives de cyber ou de biologie qui lui avaient été confiées, tandis qu’un modèle fermé comparable a refusé si systématiquement que le test n’a pas pu être terminé. Le directeur exécutif Henry Papadatos a résumé ce point ainsi : « la frontière de la capacité n’est pas la frontière du risque ».