1 paper · 1 filter
Guangya Hao, Yitong Shang, Yunbo Long +2
Self-distillation bootstraps large language models (LLMs) by training on their own generations. However, existing methods either rely on external signals to curate self-generated o…