← Lexique IA

Prompt injection

Souveraineté & sécurité

La prompt injection est une attaque qui manipule les instructions textuelles d'un modèle de langage pour contourner ses règles : lui faire ignorer ses consignes de sécurité ou révéler des informations internes. Contrairement aux attaques classiques, elle exploite la logique linguistique du modèle, ce qui impose des défenses spécifiques.

En pratique chez Gensai

Gensai sécurise ses systèmes en structurant les prompts, en filtrant les entrées et en limitant strictement les droits d'accès et les actions autorisées des agents.