1 paper · 1 filter
Tianqi Du, Zeming Wei, Quan Chen +2
The rapid advancement of large language models (LLMs) has demonstrated milestone success in a variety of tasks, yet their potential for generating harmful content has raised signif…