1 paper
Zhenhong Zhou, Haiyang Yu, Xinghua Zhang +3
Large language models (LLMs) rely on safety alignment to avoid responding to malicious user inputs. Unfortunately, jailbreak can circumvent safety guardrails, resulting in LLMs gen…