1 paper · 1 filter
Dongxu Liu, Bing Xu, Yinzhuo Chen +4
Reinforcement Learning from Human Feedback (RLHF) has been proven to be an effective method for preference alignment of large language models (LLMs) and is widely used in the post-…