collaborators

5 papers

cs.SD2025

GLA-Grad++: An Improved Griffin-Lim Guided Diffusion Model for Speech Synthesis

Teysir Baoueb, Xiaoyu Bie, Mathieu Fontaine +1

Recent advances in diffusion models have positioned them as powerful generative frameworks for speech synthesis, demonstrating substantial improvements in audio quality and stabili…

cs.SD2025

Harmonic-Percussive Disentangled Neural Audio Codec for Bandwidth Extension

Benoît Giniès, Xiaoyu Bie, Olivier Fercoq +1

Bandwidth extension, the task of reconstructing the high-frequency components of an audio signal from its low-pass counterpart, is a long-standing problem in audio processing. Whil…

cs.SD2025

Soft Disentanglement in Frequency Bands for Neural Audio Codecs

Benoit Ginies, Xiaoyu Bie, Olivier Fercoq +1

In neural-based audio feature extraction, ensuring that representations capture disentangled information is crucial for model interpretability. However, existing disentanglement me…

cs.SD2025

Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models

Teysir Baoueb, Xiaoyu Bie, Xi Wang +1

Breakthroughs in text-to-music generation models are transforming the creative landscape, equipping musicians with innovative tools for composition and experimentation like never b…

cs.SD2025

Learning Source Disentanglement in Neural Audio Codec

Xiaoyu Bie, Xubo Liu, Gaël Richard

Neural audio codecs have significantly advanced audio compression by efficiently converting continuous audio signals into discrete tokens. These codecs preserve high-quality sound…