1 paper
Christian Moya, Alex Semendinger, Guang Lin +1
Preference learning methods like Direct Preference Optimization (DPO) are known to induce reliance on spurious correlations, leading to sycophancy and length bias in today's langua…