1 paper · 1 filter
Ali Aouad, Aymane El Gadarri, Vivek F. Farias
Traditional LLM alignment methods are vulnerable to heterogeneity in human preferences. Fitting a naïve probabilistic model to pairwise comparison data (say over prompt-completion…