1 citations · 1 across the 9 of their papers we have counts for
1 paper · 2 filters
Chengbing Wang, Yang Zhang, Wenjie Wang +4
Preference alignment has enabled large language models (LLMs) to better reflect human expectations, but current methods mostly optimize for population-level preferences, overlookin…