1 paper · 1 filter
Jaymari Chua, Chen Wang, Lina Yao
Generalizable alignment is a core challenge for deploying Large Language Models (LLMs) safely in real-world NLP applications. Current alignment methods, including Reinforcement Lea…