1 paper
Tongtong Liu, Fangxiang Feng, Xiaojie Wang
Multimodal pre-training models, such as LXMERT, have achieved excellent results in downstream tasks. However, current pre-trained models require large amounts of training data and…