1 paper
Wenxuan Zhou, Shujian Zhang, Lingxiao Zhao +1
Reinforcement learning from human feedback (RLHF) has been crucial in aligning large language models (LLMs) with human values. Traditionally, RLHF involves generating responses to…