1 paper
Junjie Deng, Hanru Shi, Xinhe Yu +3
Pre-trained language models are trained on large-scale unsupervised data, and they can fine-turn the model only on small-scale labeled datasets, and achieve good results. Multiling…