1 paper
Chao Huang, Zefeng Zhang, Juewei Yue +3
Current safety alignment for large language models(LLMs) continues to present vulnerabilities, given that adversarial prompting can effectively bypass their safety measures.Our inv…