Qu’est-ce qu’une injection de prompt ?
Une injection de prompt tente de faire suivre à une IA des instructions qu’elle ne devrait pas considérer comme autorisées. Ces instructions peuvent apparaître dans une demande, un document, une page ou un résultat d’outil. L’attaque cherche à détourner la tâche, à obtenir des informations ou à provoquer une action. Le contenu consulté devient ainsi un moyen d’influencer le comportement.
Le risque est particulièrement important lorsque l’IA utilise des outils. Une mauvaise réponse textuelle et une opération sur une application n’ont pas les mêmes conséquences. Les permissions doivent limiter ce que le système peut faire même si le modèle se laisse influencer.