2 citations · 2 across the 2 of their papers we have counts for
2 papers
cs.SD2024★ 2 cited
RAVSS: Robust Audio-Visual Speech Separation in Multi-Speaker Scenarios with Missing Visual Cues
Tianrui Pan, Jie Liu, Bohan Wang +2
While existing Audio-Visual Speech Separation (AVSS) methods primarily concentrate on the audio-visual fusion strategy for two-speaker separation, they demonstrate a severe perform…
eess.AS2023
ALO-VC: Any-to-any Low-latency One-shot Voice Conversion
Bohan Wang, Damien Ronssin, Milos Cernak
This paper presents ALO-VC, a non-parallel low-latency one-shot phonetic posteriorgrams (PPGs) based voice conversion method. ALO-VC enables any-to-any voice conversion using only…