1 paper · 1 filter
Taywon Min, Haeone Lee, Yongchan Kwon +1
In Reinforcement Learning from Human Feedback (RLHF), it is crucial to learn suitable reward models from human feedback to align large language models (LLMs) with human intentions.…