1 paper
Sheng Yan, Yang Liu, Haoqiang Wang +3
Cross-modal retrieval of image-text and video-text is a prominent research area in computer vision and natural language processing. However, there has been insufficient attention g…