1 paper
Yanggan Gu, Junzhuo Li, Sirui Huang +3
Aligning small language models (SLMs) with human values typically involves distilling preference knowledge from large language models (LLMs). However, existing distillation methods…