2 papers
cs.SD2024
Target Speech Extraction with Pre-trained AV-HuBERT and Mask-And-Recover Strategy
Wenxuan Wu, Xueyuan Chen, Xixin Wu +2
Audio-visual target speech extraction (AV-TSE) is one of the enabling technologies in robotics and many audio-visual applications. One of the challenges of AV-TSE is how to effecti…
cs.CV2024
MetaSeg: Content-Aware Meta-Net for Omni-Supervised Semantic Segmentation
Shenwang Jiang, Jianan Li, Ying Wang +4
Noisy labels, inevitably existing in pseudo segmentation labels generated from weak object-level annotations, severely hampers model optimization for semantic segmentation. Previou…