1 paper · 1 filter
Zonglin Yang, Zhexuan Gu, Houduo Qi +1
Reinforcement learning from human feedback (RLHF) is an essential technique for ensuring that large language models (LLMs) are aligned with human values and preferences during the…