1 paper
Erhan Xu, Kai Ye, Hongyi Zhou +3
This paper studies reinforcement learning from human feedback (RLHF) for aligning large language models with human preferences. While RLHF has demonstrated promising results, many…