1 paper
Minghang Deng, Zhong Zhang, Junming Shao
Large-scale pre-trained models (PTMs) such as BERT and GPT have achieved great success in diverse fields. The typical paradigm is to pre-train a big deep learning model on large-sc…