1 paper
Yifan Wang, Jinyi Mu, Mayank Jobanputra +5
Preference modeling plays a central role in reinforcement learning from human feedback (RLHF), enabling large language models (LLMs) to align with human values. However, most exist…