7 citations · 9 across the 3 of their papers we have counts for
3 papers
cs.SD2022
SRTNet: Time Domain Speech Enhancement Via Stochastic Refinement
Zhibin Qiu, Mengfan Fu, Yinfeng Yu +3
Diffusion model, as a new generative model which is very popular in image generation and audio synthesis, is rarely used in speech enhancement. In this paper, we use the diffusion…
cs.SD2022★ 2 cited
Pay Self-Attention to Audio-Visual Navigation
Yinfeng Yu, Lele Cao, Fuchun Sun +2
Audio-visual embodied navigation, as a hot research topic, aims training a robot to reach an audio target using egocentric visual (from the sensors mounted on the robot) and audio…
cs.SD2022★ 7 cited
Sound Adversarial Audio-Visual Navigation
Yinfeng Yu, Wenbing Huang, Fuchun Sun +3
Audio-visual navigation task requires an agent to find a sound source in a realistic, unmapped 3D environment by utilizing egocentric audio-visual observations. Existing audio-visu…