3 papers
cs.SD2024
An audio-quality-based multi-strategy approach for target speaker extraction in the MISP 2023 Challenge
Runduo Han, Xiaopeng Yan, Weiming Xu +6
This paper describes our audio-quality-based multi-strategy approach for the audio-visual target speaker extraction (AVTSE) task in the Multi-modal Information based Speech Process…
cs.SD2023
MBTFNet: Multi-Band Temporal-Frequency Neural Network For Singing Voice Enhancement
Weiming Xu, Zhouxuan Chen, Zhili Tan +5
A typical neural speech enhancement (SE) approach mainly handles speech and noise mixtures, which is not optimal for singing voice enhancement scenarios. Music source separation (M…
eess.AS2023
Two-stage Neural Network for ICASSP 2023 Speech Signal Improvement Challenge
Mingshuai Liu, Shubo Lv, Zihan Zhang +6
In ICASSP 2023 speech signal improvement challenge, we developed a dual-stage neural model which improves speech signal quality induced by different distortions in a stage-wise div…