1 paper
Li Jiang, Yusen Wu, Junwu Xiong +6
Preference datasets are essential for incorporating human preferences into pre-trained language models, playing a key role in the success of Reinforcement Learning from Human Feedb…