2 citations · 2 across the 2 of their papers we have counts for
1 paper · 1 filter
Wenda Xu, Jiachen Li, William Yang Wang +1
Direct alignment from preferences (DAP) has emerged as a promising paradigm for aligning large language models (LLMs) to human desiderata from pre-collected, offline preference dat…