1 paper
Guanghui Li, Mingqi Gao, Heng Liu +2
Referring video object segmentation (RVOS), as a supervised learning task, relies on sufficient annotated data for a given scene. However, in more realistic scenarios, only minimal…