1 paper · 1 filter
Jianwei Li, Jung-Eun Kim
As large language models (LLMs) are overwhelmingly more and more integrated into various applications, ensuring they generate safe responses is a pressing need. Previous studies on…