2 papers
cs.SD2025
SmoothSinger: A Conditional Diffusion Model for Singing Voice Synthesis with Multi-Resolution Architecture
Kehan Sui, Jinxu Xiang, Fang Jin
Singing voice synthesis (SVS) aims to generate expressive and high-quality vocals from musical scores, requiring precise modeling of pitch, duration, and articulation. While diffus…
cs.SD2024
RDSinger: Reference-based Diffusion Network for Singing Voice Synthesis
Kehan Sui, Jinxu Xiang, Fang Jin
Singing voice synthesis (SVS) aims to produce high-fidelity singing audio from music scores, requiring a detailed understanding of notes, pitch, and duration, unlike text-to-speech…