PuzzleMask : technique d'injection de prompt en prose pour contourner les gardiens LLM
🔍 Contexte Publié le 10 septembre 2026 par Check Point Research, cet article présente PuzzleMask, une nouvelle technique d’attaque ciblant les pipelines LLM à double étage (gatekeeper → target model). La recherche démontre comment des payloads malveillants peuvent être dissimulés dans de la prose ordinaire en anglais, sans recours à des encodages exotiques (Base64, emojis, formatage invisible). ⚙️ Mécanisme de l’attaque La technique repose sur un wrapper en prose soigneusement construit qui encapsule un payload interdit. Le principe exploite la différence de capacités entre : ...