4 papers · 1 filter
Finding My Voice: Generative Reconstruction of Disordered Speech for Automated Clinical Evaluation
Karen Rosero, Eunjung Yeo, David R. Mortensen +3
We present ChiReSSD, a speech reconstruction framework that preserves children speaker's identity while suppressing mispronunciations. Unlike prior approaches trained on healthy ad…
FedMLAC: Mutual Learning Driven Heterogeneous Federated Audio Classification
Jun Bai, Rajib Rana, Di Wu +5
Federated Learning (FL) offers a privacy-preserving framework for training audio classification (AC) models across decentralized clients without sharing raw data. However, Federate…
Mouth Articulation-Based Anchoring for Improved Cross-Corpus Speech Emotion Recognition
Shreya G. Upadhyay, Ali N. Salman, Carlos Busso +1
Cross-corpus speech emotion recognition (SER) plays a vital role in numerous practical applications. Traditional approaches to cross-corpus emotion transfer often concentrate on ad…
emoDARTS: Joint Optimisation of CNN & Sequential Neural Network Architectures for Superior Speech Emotion Recognition
Thejan Rajapakshe, Rajib Rana, Sara Khalifa +3
Speech Emotion Recognition (SER) is crucial for enabling computers to understand the emotions conveyed in human communication. With recent advancements in Deep Learning (DL), the p…