1 paper · 1 filter
Mohamed Afane, Abhishek Satyam, Ke Chen +3
Backdoor attacks create significant security threats to language models by embedding hidden triggers that manipulate model behavior during inference, presenting critical risks for…