PuzzleMask : technique d'injection de prompt en prose pour contourner les gardiens LLM
đ Contexte PubliĂ© le 10 septembre 2026 par Check Point Research, cet article prĂ©sente PuzzleMask, une nouvelle technique dâattaque ciblant les pipelines LLM Ă double Ă©tage (gatekeeper â target model). La recherche dĂ©montre comment des payloads malveillants peuvent ĂȘtre dissimulĂ©s dans de la prose ordinaire en anglais, sans recours Ă des encodages exotiques (Base64, emojis, formatage invisible). âïž MĂ©canisme de lâattaque La technique repose sur un wrapper en prose soigneusement construit qui encapsule un payload interdit. Le principe exploite la diffĂ©rence de capacitĂ©s entre : ...