4 papers
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
Hao Shi, Xugang Lu, Kazuki Shimada +1
Diffusion-based speech enhancement (SE) models need to incorporate correct prior knowledge as reliable conditions to generate accurate predictions. However, providing reliable cond…
Bridging The Multi-Modality Gaps of Audio, Visual and Linguistic for Speech Enhancement
Meng-Ping Lin, Jen-Cheng Hou, Chia-Wei Chen +4
Speech enhancement (SE) aims to improve the quality and intelligibility of speech in noisy environments. Recent studies have shown that incorporating visual cues in audio signal pr…
Linguistic Knowledge Transfer Learning for Speech Enhancement
Kuo-Hsuan Hung, Xugang Lu, Szu-Wei Fu +4
Linguistic knowledge plays a crucial role in spoken language comprehension. It provides essential semantic and syntactic context for speech perception in noisy environments. Howeve…
MECG-E: Mamba-based ECG Enhancer for Baseline Wander Removal
Kuo-Hsuan Hung, Kuan-Chen Wang, Kai-Chun Liu +4
Electrocardiogram (ECG) is an important non-invasive method for diagnosing cardiovascular disease. However, ECG signals are susceptible to noise contamination, such as electrical i…