3 papers
cs.SD2024
Complex Image-Generative Diffusion Transformer for Audio Denoising
Junhui Li, Pu Wang, Jialu Li +1
The audio denoising technique has captured widespread attention in the deep neural network field. Recently, the audio denoising problem has been converted into an image generation…
cs.SD2023
DCHT: Deep Complex Hybrid Transformer for Speech Enhancement
Jialu Li, Junhui Li, Pu Wang +1
Most of the current deep learning-based approaches for speech enhancement only operate in the spectrogram or waveform domain. Although a cross-domain transformer combining waveform…
cs.SD2023
DPATD: Dual-Phase Audio Transformer for Denoising
Junhui Li, Pu Wang, Jialu Li +2
Recent high-performance transformer-based speech enhancement models demonstrate that time domain methods could achieve similar performance as time-frequency domain methods. However…