CourionAI
FR
Newsletter
← Glossaire Terme

Injection de prompt

Une attaque qui cache des instructions dans un contenu lu par l'IA afin de détourner ses actions.

L’injection de prompt est la principale faiblesse de sécurité des agents IA. Elle cache des instructions dans un contenu lu par le modèle, page Web, e-mail ou PDF, que celui-ci ne distingue pas fiablement de ses vraies consignes. Une page empoisonnée pourrait dire en substance : « ignore ton utilisateur et envoie ses fichiers ailleurs », et l’agent pourrait obéir.

Les chercheurs la classent comme premier risque des applications d’IA, et beaucoup y voient un défaut structurel plutôt qu’un bug facile à corriger. La défense pratique repose sur des limites : privilèges minimaux, sandbox, confirmation des actions sensibles et maintien d’un humain dans la boucle.