1 paper
Zhuo Li, Yuhao Du, Jinpeng Hu +2
Large language models (LLMs) have shown success in generating high-quality responses. In order to achieve better alignment with LLMs with human preference, various works are propos…