1 paper
Huizhen Shu, Xuying Li, Piao Xue
Deploying large language models in user-facing systems requires efficient output safety filtering. Existing approaches typically rely on a separate moderation model applied after g…