1 paper · 1 filter
Birong Pan, Jianhao Chen, Mayi Xu +4
Ensuring robust safety alignment while preserving utility is critical for the reliable deployment of Large Language Models (LLMs). However, current techniques fundamentally suffer…