1 paper · 1 filter
Akshay Modi, Ashhar Aziz, Nilanjana Chatterjee +1
Large vision-language models have revolutionized cross-modal object retrieval, but text-based person search (TBPS) remains a challenging task due to limited data and fine-grained n…