1 paper · 1 filter
Han Qi, Haochen Yang, Qiaosheng Zhang +1
We study the problem of reinforcement learning from human feedback (RLHF), a critical problem in training large language models, from a theoretical perspective. Our main contributi…