1 paper
Weikai Lu, Ziqian Zeng, Jianwei Wang +4
Jailbreaking attacks can enable Large Language Models (LLMs) to bypass the safeguard and generate harmful content. Existing jailbreaking defense methods have failed to address the…