1 paper · 1 filter
Yu Peng, Zewen Long, Fangming Dong +3
The advent of large language models (LLMs) has spurred the development of numerous jailbreak techniques aimed at circumventing their security defenses against malicious attacks. An…