1 paper · 1 filter
Meng Cao, Shuyuan Zhang, Xiao-Wen Chang +1
Reinforcement Learning from Human Feedback (RLHF) is a widely used technique for aligning Large Language Models (LLMs) with human preferences, yet it often suffers from sparse rewa…