1 paper
Chunjin Jian, Xinhua Zhu
Reinforcement Learning from Human Feedback (RLHF) plays a crucial role in aligning large language models (LLMs) with human values and preferences. However, the quality and stabilit…