1 paper
Dingwei Zhang, Dong Zhang, Jinhui Tang
Recently, query-based methods have achieved remarkable performance in Referring Video Object Segmentation (RVOS) by using textual static object queries to drive cross-modal alignme…