1 paper · 1 filter
Hanyu Xuan, Mengqi Zhang, Junjun Mao +5
Inspired by human multi-modal perception, Audio-Visual Multi-Modal Learning (AVMML) integrates auditory and visual information to leverage complementary cross-modal cues, enabling…