1 paper
Shugang Hao, Lingjie Duan
Reinforcement learning from human feedback (RLHF) has become an essential step in fine-tuning large language models (LLMs) to align them with human preferences. However, human labe…