2 papers
cs.CV2026
Multimodal Fusion via Self-Consistent Task-Gradient Fields
Jiayu Xiong, Jing Wang, Jun Xue +4
Multimodal learning aims to preserve as much task-related information as possible from different inputs. However, current fusion designs often distort the feedback loop to feature…
cs.MM2025
Cross-Space Synergy: A Unified Framework for Multimodal Emotion Recognition in Conversation
Xiaosen Lyu, Jiayu Xiong, Yuren Chen +3
Multimodal Emotion Recognition in Conversation (MERC) aims to predict speakers' emotions by integrating textual, acoustic, and visual cues. Existing approaches either struggle to c…