Skip to content

Prompt injection: c'est quoi, et comment s'en défendre

L'injection de prompt n'a pas de correctif. Ce qu'elle est, les attaques réelles, et comment cadrer vos agents IA pour limiter les dégâts.

L'injection de prompt est le bug que l'on ne peut pas corriger. Si un modèle lit un texte que vous ne contrôlez pas, et que ce modèle peut ensuite agir (appeler un outil, envoyer un message, ouvrir une pull request, interroger une base), celui qui a écrit ce texte a une chance de le piloter. Aucune désinfection des entrées ne referme la faille, parce que la faille, c'est le produit : le modèle est conçu pour suivre des instructions en langage naturel, et il n'a aucun moyen fiable de distinguer vos phrases de celles d'une page web récupérée trente secondes plus tôt.