1 paper · 1 filter
Yelim Ahn, Jaejin Lee
As large language models (LLMs) are increasingly deployed across diverse domains, ensuring their safety has become a critical concern. In response, studies on jailbreak attacks hav…