La prompt injection est une attaque qui manipule les instructions textuelles d'un modèle de langage pour contourner ses règles : lui faire ignorer ses consignes de sécurité ou révéler des informations internes. Contrairement aux attaques classiques, elle exploite la logique linguistique du modèle, ce qui impose des défenses spécifiques.
En pratique chez Gensai
Gensai sécurise ses systèmes en structurant les prompts, en filtrant les entrées et en limitant strictement les droits d'accès et les actions autorisées des agents.
Dans le même thème
Aller plus loin que la définition ?
Passer du concept au projet : Gensai conçoit des solutions IA sur mesure, souveraines et conformes au RGPD.