2 papers
cs.SD2026
When Noise Lowers The Loss: Rethinking Likelihood-Based Evaluation in Music Large Language Models
Xiaosha Li, Chun Liu, Ziyu Wang
The rise of music large language models (LLMs) demands robust methods of evaluating output quality, especially in distinguishing high-quality compositions from "garbage music". Cur…
cs.MM2024
VCEMO: Multi-Modal Emotion Recognition for Chinese Voiceprints
Jinghua Tang, Liyun Zhang, Yu Lu +6
Emotion recognition can enhance humanized machine responses to user commands, while voiceprint-based perception systems can be easily integrated into commonly used devices like sma…