1 paper
Shengkai Chen, Yifang Yin, Jinming Cao +3
Audio-visual segmentation aims to separate sounding objects from videos by predicting pixel-level masks based on audio signals. Existing methods primarily concentrate on closed-set…