3 papers
cs.SD2023
DCHT: Deep Complex Hybrid Transformer for Speech Enhancement
Jialu Li, Junhui Li, Pu Wang +1
Most of the current deep learning-based approaches for speech enhancement only operate in the spectrogram or waveform domain. Although a cross-domain transformer combining waveform…
cs.SD2023
DPATD: Dual-Phase Audio Transformer for Denoising
Junhui Li, Pu Wang, Jialu Li +2
Recent high-performance transformer-based speech enhancement models demonstrate that time domain methods could achieve similar performance as time-frequency domain methods. However…
cs.SD2023
Complex Image Generation SwinTransformer Network for Audio Denoising
Youshan Zhang, Jialu Li
Achieving high-performance audio denoising is still a challenging task in real-world applications. Existing time-frequency methods often ignore the quality of generated frequency d…