1 paper
Jinjie Fu, Hang Chen, Wu Guo +3
Audio-Visual speech recognition systems often degrade in real-world scenarios due to signal corruption and distribution shifts. To address this, we propose a unified uncertainty-mo…