Glossaire

Prompt injection

Une prompt injection consiste à fournir au modèle des instructions ou du contenu destinés à détourner son comportement par rapport à l'intention prévue du système.Définition Sécurité Agentique

Par Sécurité AgentiqueMis à jour le

Directe et indirecte

OWASP distingue la prompt injection directe, formulée par l'utilisateur, et la prompt injection indirecte, qui provient de contenus externes traités par le modèle, comme des documents ou des sites web.[1]

Exemple

Un agent résume les pièces jointes des e-mails entrants. Un PDF contient un paragraphe invisible demandant de transférer la conversation à une adresse externe. Si l'agent dispose d'un outil d'envoi, le texte du document peut influencer une action réelle.

Pourquoi ce terme compte en sécurité agentique

Lorsque le modèle peut déclencher des fonctions ou des outils, l'impact d'une injection peut s'étendre à ces fonctions. OWASP indique également qu'il n'existe pas de mécanisme de prévention infaillible opérant uniquement à l'intérieur du modèle.[1]

Cela ne signifie pas que le risque ne peut pas être réduit. Plusieurs mesures se combinent : filtrage des entrées, séparation des contenus non fiables, limitation des outils exposés, moindre privilège, autorisation externe des actions sensibles, validation humaine ciblée et contrôles runtime.

Le placement de ces contrôles est traité dans Prompt injection : protéger aussi l'action qui vient après.

Termes liés

Sources

Sources vérifiées le

  1. [1]

    Framework

    OWASP GenAI Security Project

    LLM01:2025 Prompt Injection (lien externe, nouvel onglet)

    Fiche OWASP sur l'injection de prompt directe et indirecte, ses impacts et les mesures d'atténuation recommandées.

    Vérifié le

Contenus associés