1 paper · 1 filter
Linghan Huang, Haolin Jin, Zhaoge Bi +6
Large language models (LLMs) have seen widespread applications across various domains, yet remain vulnerable to adversarial prompt injections. While most existing research on jailb…