1 paper
Xiaoning Dong, Wenbo Hu, Wei Xu +1
Large language models (LLMs) have made significant advancements across various tasks, but their safety alignment remain a major concern. Exploring jailbreak prompts can expose LLMs…