- Indirect prompt injection
- Des instructions placées dans un document récupéré sont interprétées par le modèle comme une consigne.
- RAG poisoning
- Un contenu est inséré ou modifié dans la base documentaire pour être récupéré sur certaines requêtes.
- Memory poisoning
- Une information hostile est enregistrée dans la mémoire de l’agent et réutilisée plus tard.
- Contamination persistante
- L’effet survit à la session : il touche d’autres tâches, parfois d’autres utilisateurs.
- Exposition de données
- Le retrieval renvoie des documents que l’utilisateur à l’origine de la demande ne devrait pas voir.
- Propagation vers des outils
- Le contenu influence les paramètres d’un appel d’outil, et donc un effet réel.
Ces risques ne partagent pas le même mécanisme : l’injection agit sur l’interprétation, le poisoning sur la base elle-même, l’exposition sur les droits d’accès.