1 paper · 1 filter
Olivia Sturman, Aparna Joshi, Bhaktipriya Radharapu +2
Increasing use of large language models (LLMs) demand performant guardrails to ensure the safety of inputs and outputs of LLMs. When these safeguards are trained on imbalanced data…