1 paper
Li Zhang, Haoxiang Gao, Zhihao Zhang +2
Referring Video Object Segmentation (RVOS) aims to segment target objects in video sequences based on natural language descriptions. While recent advances in Multi-modal Large Lang…