3 papers
cs.SD2025
Posterior Transition Modeling for Unsupervised Diffusion-Based Speech Enhancement
Mostafa Sadeghi, Jean-Eudes Ayilo, Romain Serizel +1
We explore unsupervised speech enhancement using diffusion models as expressive generative priors for clean speech. Existing approaches guide the reverse diffusion process using no…
cs.SD2022
Fast and efficient speech enhancement with variational autoencoders
Mostafa Sadeghi, Romain Serizel
Unsupervised speech enhancement based on variational autoencoders has shown promising performance compared with the commonly used supervised methods. This approach involves the use…
cs.CV2022
Audio-visual speech enhancement with a deep Kalman filter generative model
Ali Golmakani, Mostafa Sadeghi, Romain Serizel
Deep latent variable generative models based on variational autoencoder (VAE) have shown promising performance for audiovisual speech enhancement (AVSE). The underlying idea is to…