1 paper · 1 filter
Mingyu Yu, Wei Wang, Yanjie Wei +3
Recent advancements in adversarial jailbreak attacks have exposed critical vulnerabilities in Large Language Models (LLMs), enabling the circumvention of alignment safeguards throu…