5 citations · 8 across the 2 of their papers we have counts for
2 papers
cs.CL2024★ 3 cited
ShieldGemma: Generative AI Content Moderation Based on Gemma
Wenjun Zeng, Yuchi Liu, Ryan Mullins +9
We present ShieldGemma, a comprehensive suite of LLM-based safety content moderation models built upon Gemma2. These models provide robust, state-of-the-art predictions of safety r…
cs.LG2023★ 5 cited
Safety and Fairness for Content Moderation in Generative Models
Susan Hao, Piyush Kumar, Sarah Laszlo +3
With significant advances in generative AI, new technologies are rapidly being deployed with generative components. Generative models are typically trained on large datasets, resul…