1 paper
Yuhao Du, Zhuo Li, Pengyu Cheng +4
Reinforcement Learning from Human Feedback (RLHF) is crucial for aligning Large Language Models (LLMs) with human values. However, RLHF has been continuously challenged by its high…