"Novel Universal Bypass for All Major LLMs” par HiddenLayer
Des chercheurs de HiddenLayer ont découvert une technique innovante de contournement des garde-fous et des mécanismes d’alignement de tous les grands modèles de langage (LLM) actuels, comme ceux développés par OpenAI, Google, Microsoft, Anthropic ou Meta. Cette méthode, baptisée « Policy Puppetry », repose sur une forme avancée de « prompt injection » qui utilise de faux fichiers de configuration (au format XML, JSON ou INI) combinés à des jeux de rôle pour tromper les modèles et les amener à produire des contenus normalement interdits.
Ce qui rend cette attaque particulièrement...
- Dernière mise à jour le .
Iterate Adaline pour optimiser les prompts
Expérimentez et affinez en toute simplicité. Les outils d'itération d'Adaline vous maintiennent dans le flux, vous permettant de modifier rapidement vos prompts.
Source
- Dernière mise à jour le .
