Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
eMotions: A Large-Scale Dataset and Audio-Visual Fusion Network for Emotion Analysis in Short-form Videos
Xuecheng Wu, Dingkang Yang, Danlei Huang +9
Short-form videos (SVs) have become a vital part of our online routine for acquiring and sharing information. Their multimodal complexity poses new challenges for video analysis, h…
cs.CV2025
CalFuse: Multi-Modal Continual Learning via Feature Calibration and Parameter Fusion
Juncen Guo, Siao Liu, Xiaoguang Zhu +8
With the proliferation of multi-modal data in large-scale visual recognition systems, enabling models to continuously acquire knowledge from evolving data streams while preserving…