1 paper · 1 filter
Weiyang Guo, Jing Li, Wenya Wang +4
The proliferation of jailbreak attacks against large language models (LLMs) highlights the need for robust security measures. However, in multi-round dialogues, malicious intention…