activity
20242026
collaborators
Showing eess.ASShow all

5 papers · 1 filter

eess.AS2026

Adapting Where It Matters: Depth-Aware Adaptation for Efficient Multilingual Speech Recognition in Low-Resource Languages

Yang Xiao, Eun-Jung Holden, Ting Dang

Recent speech foundation models excel at multilingual automatic speech recognition (ASR) for high-resource languages, but adapting them to low-resource languages remains challengin…

eess.AS2025

Continual Learning for Acoustic Event Classification

Yang Xiao

Continuously learning new classes without catastrophic forgetting is a challenging problem for on-device acoustic event classification given the restrictions on computation resourc…

eess.AS2025

AFT: An Exemplar-Free Class Incremental Learning Method for Environmental Sound Classification

Xinyi Chen, Xi Chen, Zhenyu Weng +1

As sounds carry rich information, environmental sound classification (ESC) is crucial for numerous applications such as rare wild animals detection. However, our world constantly c…

eess.AS2025

LPGNet: A Lightweight Network with Parallel Attention and Gated Fusion for Multimodal Emotion Recognition

Zhining He, Yang Xiao

Emotion recognition in conversations (ERC) aims to predict the emotional state of each utterance by using multiple input types, such as text and audio. While Transformer-based mode…

eess.AS2025

Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling

Wenmiao Gao, Yang Xiao

Pre-training methods have achieved significant performance improvements in sound event localization and detection (SELD) tasks, but existing Transformer-based models suffer from hi…