3 papers
eess.SP2026
Audio-visual Contrastive Alignment for Diffusion-based Visual-conditioned Speech Enhancement
Colombe Mboungou, Mostafa Sadeghi, Jean-Eudes Ayilo +1
Audio-visual speech enhancement (AVSE) exploits visual cues such as lip movements to recover speech in noisy environments. Recent work introduced diffusion-based unsupervised AVSE,…
cs.SD2025
Posterior Transition Modeling for Unsupervised Diffusion-Based Speech Enhancement
Mostafa Sadeghi, Jean-Eudes Ayilo, Romain Serizel +1
We explore unsupervised speech enhancement using diffusion models as expressive generative priors for clean speech. Existing approaches guide the reverse diffusion process using no…
cs.SD2024
Diffusion-based Unsupervised Audio-visual Speech Enhancement
Jean-Eudes Ayilo, Mostafa Sadeghi, Romain Serizel +1
This paper proposes a new unsupervised audio-visual speech enhancement (AVSE) approach that combines a diffusion-based audio-visual speech generative model with a non-negative matr…