Glossaire de sécurité Xygeni
Glossaire de la sécurité du développement et de la livraison de logiciels

Qu'est-ce que l'injection rapide ?

Si l'on vous a demandé ce qu'est l'injection de prompt et que vous n'avez obtenu qu'une réponse partielle, voici un résumé : il s'agit d'une technique d'attaque consistant à insérer du texte malveillant ou manipulateur dans les données d'entrée traitées par un modèle d'IA, le trompant ainsi pour qu'il ignore ses instructions initiales et suive celles de l'attaquant. C'est là le cœur du concept d'injection de prompt : il ne s'agit pas d'un bug dans le code, mais d'une attaque qui détourne les instructions du modèle en utilisant un langage courant plutôt qu'un code d'exploitation traditionnel.

Définition de l'injection rapide, en termes simples #

Décomposer le sens de l'injection rapide mot à mot aide à le mémoriser :

  • Prompt : les instructions et le contexte fournis à un modèle d'IA, qu'ils soient saisis directement par un utilisateur ou extraits automatiquement d'un document, d'une page Web ou d'une réponse d'API.
  • Injection: L'insertion d'un élément qui n'était pas censé s'y trouver, une technique empruntée à la même logique que l'injection SQL, où une entrée non fiable est traitée comme une commande plutôt que comme de simples données.

Ainsi, lorsqu'on demande ce qu'est l'injection de prompts, la réponse la plus simple est la suivante : c'est ce qui se produit lorsqu'un modèle d'IA ne parvient pas à faire la différence entre les instructions qui lui ont été données par son développeur et les instructions cachées dans le contenu qu'il traite.

Qu'est-ce que cela inclut réellement ? #

La plupart des cas concrets se répartissent dans ces grandes catégories :

  • Injection directe rapide: l'attaquant saisit directement l'instruction malveillante dans le chat ou le champ de saisie, demandant ouvertement au modèle d'ignorer ses règles précédentes (« ignorer toutes les instructions précédentes et… »).
  • Injection rapide indirecte: l'instruction malveillante est dissimulée dans un contenu que le modèle lit ultérieurement, comme une page web, un PDF, un e-mail ou un commentaire de code, et elle ne s'active que lorsque le modèle traite ce contenu, en l'absence d'attaquant à ce moment-là.
  • Injection de type jailbreak: une variante spécifique d'injection qui utilise le jeu de rôle, le cadrage hypothétique ou des techniques de codage pour contourner la sécurité d'un modèle guardrails plus précisément, plutôt que de détourner sa tâche.

Injection rapide vs. Jailbreak : quelle est la différence ? #

Une question fréquente concernant l'injection rapide est celle de sa différence avec le jailbreak. Les deux techniques se recoupent, mais ne sont pas identiques. Le jailbreak consiste spécifiquement à contourner les mesures de sécurité d'un appareil. contenu guardrails, L'injection de prompt consiste à amener le modèle à dire ou à générer quelque chose qu'il a été entraîné à refuser. Ce procédé est plus large : il s'agit de détourner les instructions ou la tâche du modèle, ce qui peut ou non impliquer la sécurité. guardrails Absolument pas. Une injection indirecte dissimulée dans un ticket d'assistance, qui demande discrètement à un agent du service client d'envoyer les données d'un utilisateur par e-mail à une adresse externe, ne cherche pas à pirater quoi que ce soit ; elle redirige simplement la tâche elle-même.

Où l'injection de prompt apparaît réellement #

Une fois que vous comprenez la signification de l'injection rapide, il devient plus facile de repérer où réside le risque dans les systèmes réels :

Serveurs MCP et assistants de codage IA – Un commentaire malveillant, un fichier README ou une charge utile de résultat d'outil peut rediriger ce qu'un agent fait à l'intérieur du code source ou du terminal d'un développeur, différemment selon le langage de programmation sur lequel il est construit, mais l'idée de base (éditeur + outils de construction + débogueur, en un seul endroit) reste la même.

Chatbots et agents de support – un utilisateur colle du texte injecté pour que le bot révèle son invite système ou effectue des actions non intentionnelles.

Génération augmentée par récupération (RAG) pipelines – Un document corrompu dans la base de connaissances contient des instructions qui s'activent lorsqu'elles sont récupérées.

Agents IA autonomes – Un agent qui navigue sur le Web, lit des courriels ou utilise des outils d'appel peut récupérer des instructions injectées à partir de n'importe quel contenu qu'il consulte, puis agir en conséquence avec de véritables autorisations.

Pourquoi la signification de l'injection de prompt est importante au-delà d'un simple « tour de passe-passe » #

Il est facile de considérer cela comme une simple curiosité, un moyen astucieux de faire dire des bêtises à un chatbot. Mais dès lors que les modèles d'IA sont intégrés à des agents capables d'envoyer des courriels, d'exécuter du code, d'interroger des bases de données ou d'installer des paquets, l'injection de requêtes cesse d'être une simple curiosité de fenêtre de chat et devient un véritable problème de sécurité : quiconque contrôle le contenu lu par un modèle peut, dans certaines conditions, contrôler ses actions ultérieures. C'est pourquoi cette injection figure désormais comme une catégorie à part entière. Top 10 de l'OWASP pour les candidatures au LLMet pourquoi la compréhension de ce qu'est l'injection rapide est désormais considérée comme une connaissance de base pour quiconque conçoit ou sécurise des systèmes basés sur l'IA, et non plus comme une simple curiosité pour les équipes d'attaque.

Si vous abordez ce sujet spécifiquement sous l'angle de la sécurité des applications et du DevSecOps, c'est-à-dire la manière dont le risque d'injection rapide se manifeste dans les agents d'IA, les serveurs MCP et le code généré par l'IA plutôt que simplement la signification du terme, nous l'avons traité plus en détail ici : Sécurité de la chaîne d'approvisionnement en IA.

QFP #

Qu'est-ce que l'injection rapide, en une phrase ?

Il s'agit d'une attaque où des instructions malveillantes sont dissimulées dans les données d'entrée ou le contenu traités par un modèle d'IA, amenant ainsi le modèle à suivre les instructions de l'attaquant au lieu de ses instructions originales.

Que signifie le terme « injection rapide » en lui-même ?

Elle combine « prompt » (les instructions et le contexte donnés à un modèle d'IA) avec « injection » (l'insertion de commandes non autorisées dans quelque chose qui ne devrait contenir que des données), la même idée de base que celle des attaques plus anciennes comme l'injection SQL.

Est-ce la même chose que le jailbreak ?

Non. Le jailbreak vise spécifiquement la sécurité d'un modèle. guardrails pour l'amener à produire du contenu non autorisé. L'injection de prompts est plus large : elle détourne la tâche ou les instructions du modèle, ce qui peut n'avoir aucun lien avec les filtres de sécurité.

L'injection de prompt peut-elle se produire sans qu'un attaquant humain n'ait à saisir quoi que ce soit au clavier ?

Oui. C'est ce qu'on appelle l'injection indirecte d'instructions : l'instruction malveillante est dissimulée dans un document, une page web ou un fichier qu'un modèle ou un agent lit ultérieurement, et elle se déclenche automatiquement dès que ce contenu est traité.

L'injection de prompts nécessite-t-elle une vulnérabilité de codage ?

Non. Cette faille exploite la façon dont un modèle interprète le langage naturel, et non une vulnérabilité du code applicatif. C'est précisément ce qui la rend difficile à corriger avec les outils de sécurité traditionnels.

Commencez gratuit

Commencez gratuitement.
Aucune carte de crédit requise.

Commencez en un clic :

Ces informations seront enregistrées en toute sécurité conformément à la Conditions d’utilisation et Politique de confidentialité

Capture d'écran de l'application