2 papers
cs.CV2025
Leveraging Modality Tags for Enhanced Cross-Modal Video Retrieval
Adriano Fragomeni, Dima Damen, Michael Wray
Video retrieval requires aligning visual content with corresponding natural language descriptions. In this paper, we introduce Modality Auxiliary Concepts for Video Retrieval (MAC-…
cs.CV2025
Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review
Adriano Fragomeni, Dima Damen, Michael Wray
Text-to-Video (T2V) retrieval aims to identify the most relevant item from a gallery of videos based on a user's text query. Traditional methods rely solely on aligning video and t…