1 paper
Ching-Chia Kao, Chia-Mu Yu, Chun-Shien Lu +1
Large Language Models (LLMs) are increasingly adopted in high-stakes scenarios, yet their safety mechanisms often remain fragile. Simple jailbreak prompts or even benign fine-tunin…