1 paper
Xi Wang, Songlei Jian, Shasha Li +9
Large language models (LLMs) generate human-aligned content under certain safety constraints. However, the current known technique ``jailbreak prompt'' can circumvent safety-aligne…