1 paper
Jiahuan Li, Yiqing Cao, Shujian Huang +1
Having been trained on massive pretraining data, large language models have shown excellent performance on many knowledge-intensive tasks. However, pretraining data tends to contai…