1 paper
Yang Yang, Wenjuan Xi, Luping Zhou +1
Vision-language retrieval aims to search for similar instances in one modality based on queries from another modality. The primary objective is to learn cross-modal matching repres…