1 paper · 1 filter
Qiyuan Chen, Hongsen Huang, Qian Shao +6
Large Language Models (LLMs) require high quality preference datasets to align with human preferences. However, conventional methods for constructing such datasets face significant…