1 paper
Xuanyu Yin, Yilin Jiang, Jun Zhou +3
As large language models (LLMs) are increasingly deployed in user-facing systems, black-box jailbreak defense has become an important practical problem. Existing defenses often rel…