1 paper · 1 filter
Xize Liang, Chao Chen, Shuang Qiu +6
Preference alignment is pivotal for empowering large language models (LLMs) to generate helpful and harmless responses. However, the performance of preference alignment is highly s…