1 paper · 1 filter
Jiajun Chen, Jiacheng Lin, Guojin Zhong +4
Audio-guided Video Object Segmentation (A-VOS) and Referring Video Object Segmentation (R-VOS) are two highly related tasks that both aim to segment specific objects from video seq…