collaborators

5 papers

cs.AI2026

The Impact of VAE Design on Latent Pose Representations for Diffusion-based Sign Language Production

Guilhem Fauré, Mostafa Sadeghi, Sam Bigeard +1

Latent diffusion approaches to sign language production (SLP) rely on an initial stage that learns an encoding of sign pose sequences, enabling generative modeling in the resulting…

eess.SP2026

Audio-visual Contrastive Alignment for Diffusion-based Visual-conditioned Speech Enhancement

Colombe Mboungou, Mostafa Sadeghi, Jean-Eudes Ayilo +1

Audio-visual speech enhancement (AVSE) exploits visual cues such as lip movements to recover speech in noisy environments. Recent work introduced diffusion-based unsupervised AVSE,…

cs.SD2026

Diffusion-based Frameworks for Unsupervised Speech Enhancement

Jean-Eudes Ayilo, Mostafa Sadeghi, Romain Serizel +1

This paper addresses unsupervised diffusion-based single-channel speech enhancement (SE). Prior work in this direction combines a score-based diffusion model trained on clean speec…

cs.SD2025

Posterior Transition Modeling for Unsupervised Diffusion-Based Speech Enhancement

Mostafa Sadeghi, Jean-Eudes Ayilo, Romain Serizel +1

We explore unsupervised speech enhancement using diffusion models as expressive generative priors for clean speech. Existing approaches guide the reverse diffusion process using no…

cs.SD2025

Diffusion-based Unsupervised Audio-visual Speech Enhancement

Jean-Eudes Ayilo, Mostafa Sadeghi, Romain Serizel +1

This paper proposes a new unsupervised audio-visual speech enhancement (AVSE) approach that combines a diffusion-based audio-visual speech generative model with a non-negative matr…