1 paper
Sinuo Wang, Yutong Xie, Yuyuan Liu +1
Vision-Language Pre-training (VLP) is drawing increasing interest for its ability to minimize manual annotation requirements while enhancing semantic understanding in downstream ta…