1 paper · 1 filter
Jiacheng Shi, Hongfei Du, Y. Alicia Hong +1
Large audio-language models (LALMs) exhibit strong zero-shot performance across speech tasks but struggle with speech emotion recognition (SER) due to weak paralinguistic modeling…