1 paper · 1 filter
Leon Zhou, Junfeng Yang, Chengzhi Mao
Large Language Models (LLMs) are increasingly used in a variety of important applications, yet their safety and reliability remain as major concerns. Various adversarial and jailbr…