Glossaire
Prompt injection
Une prompt injection consiste à fournir au modèle des instructions ou du contenu destinés à détourner son comportement par rapport à l'intention prévue du système.Définition Sécurité Agentique
Directe et indirecte
OWASP distingue la prompt injection directe, formulée par l'utilisateur, et la prompt injection indirecte, qui provient de contenus externes traités par le modèle, comme des documents ou des sites web.[1]
Exemple
Un agent résume les pièces jointes des e-mails entrants. Un PDF contient un paragraphe invisible demandant de transférer la conversation à une adresse externe. Si l'agent dispose d'un outil d'envoi, le texte du document peut influencer une action réelle.
Pourquoi ce terme compte en sécurité agentique
Lorsque le modèle peut déclencher des fonctions ou des outils, l'impact d'une injection peut s'étendre à ces fonctions. OWASP indique également qu'il n'existe pas de mécanisme de prévention infaillible opérant uniquement à l'intérieur du modèle.[1]
Cela ne signifie pas que le risque ne peut pas être réduit. Plusieurs mesures se combinent : filtrage des entrées, séparation des contenus non fiables, limitation des outils exposés, moindre privilège, autorisation externe des actions sensibles, validation humaine ciblée et contrôles runtime.
Le placement de ces contrôles est traité dans Prompt injection : protéger aussi l'action qui vient après.
Termes liés
- GlossaireTool poisoning
- GlossaireMemory poisoning
- GlossaireAgent IA
Sources
Sources vérifiées le
- [1]
Framework
OWASP GenAI Security Project
LLM01:2025 Prompt Injection (lien externe, nouvel onglet)
Fiche OWASP sur l'injection de prompt directe et indirecte, ses impacts et les mesures d'atténuation recommandées.
Vérifié le