1 paper
Daren Yao, Jinsong Yuan, Ruike Chen
Small large language models (LLMs) often face difficulties in aligning output to human preferences, particularly when operating under severe performance gaps. In this work, we prop…