1 paper · 1 filter
Antoine Scheid, Etienne Boursier, Alain Durmus +4
Reinforcement Learning from Human Feedback (RLHF) has become a popular approach to align language models (LMs) with human preferences. This method involves collecting a large datas…