1 paper
Linbao Li, Yannan Liu, Daojing He +1
Safety alignment in large language models (LLMs) is increasingly compromised by jailbreak attacks, which can manipulate these models to generate harmful or unintended content. Inve…