1 paper · 1 filter
Weixiong Zheng, Peijian Zeng, Yiwei Li +5
Large language models (LLMs) excel in various tasks but remain vulnerable to jailbreak attacks, where adversaries manipulate prompts to generate harmful outputs. Examining jailbrea…