1 paper · 1 filter
Xin Wei Chia, Swee Liang Wong, Jonathan Pan
Large Language Models (LLMs) have demonstrated remarkable capabilities across various tasks, yet they remain vulnerable to adversarial manipulations such as jailbreaking via prompt…