1 paper
Jiacong Zhou, Xianyun Wang, Min Zhang +1
Aligning large language models with human preferences is essential for improving interaction quality and safety by ensuring outputs better reflect human values. A promising strateg…