1 paper · 1 filter
Nirmal Patel, Fei Wang, Inderjit S. Dhillon
The alignment of Large Language Models (LLMs) utilizes Reinforcement Learning from AI Feedback (RLAIF) for non-verifiable domains such as long-form question answering and open-ende…