1 paper
Urchade Zaratiana, Mary Newhauser, George Hurn-Maloney +1
Ensuring safe, policy-compliant outputs from large language models requires real-time content moderation that can scale across multiple safety dimensions. However, state-of-the-art…