1 paper · 1 filter
Zijing Zhao, Kai Wang, Hao Huang +3
To explore the potential advantages of utilizing spatial cues from images for generating stereo singing voices with room reverberation, we introduce VS-Singer, a vision-guided mode…