1 paper · 1 filter
Xingang Guo, Fangxu Yu, Huan Zhang +2
Jailbreaks on large language models (LLMs) have recently received increasing attention. For a comprehensive assessment of LLM safety, it is essential to consider jailbreaks with di…