1 paper
Mohamed Afane, Abhishek Satyam, Ke Chen +3
Backdoor attacks create significant security threats to language models by embedding hidden triggers that manipulate model behavior during inference, presenting critical risks for…