Loading...
Spotlighting et marquage des données(SDM)
Une famille de transformations peu coûteuses qui rendent le texte externe non fiable clairement distinguable des instructions de confiance. Le délimitage entoure le contenu externe de frontières uniques, le datamarking insère un token spécial dans chaque espace du segment non fiable, et un encodage tel que base64 le sépare davantage du canal d'instructions. C'est une première ligne de défense économique contre l'injection de prompt indirecte, mais elle se dégrade face aux attaques adaptatives : elle doit donc être associée à des défenses en couches.
In 30 seconds
- What
- Entoure le texte externe non fiable de délimiteurs uniques, insère des jetons spéciaux à la place des espaces, ou l'encode en base64 afin de le distinguer visuellement des instructions de confiance.
- When to use
- Traitement de contenus externes (pages web, fichiers téléversés par les utilisateurs, réponses d'API) susceptibles de contenir des tentatives d'injection cachées visant le modèle.
- Watch out
- Des attaquants adaptatifs peuvent apprendre vos marqueurs et les contourner : considérez ce mécanisme comme une première couche seulement, pas comme une défense complète.
Loading technique guide…