2 papers
cs.MM2026
A First Exploration of Neuromorphic OT-CFM for Multi-Speaker VSR
Lin Chen, Jingping Fang, Hairui Liu +5
Visual Speech Recognition (VSR) tasks in complex multi-speaker scenarios are severely hindered by rapid head motions, occlusions, and subtle lip articulations. Traditional RGB-base…
cs.MM2026
Can We Hear from Events? Generating Speech from Event Camera
Jingping Fang, Lin Chen, Chenyang Xu +3
Traditional RGB-based speech generation faces Temporal Granularity Mismatch since fixed camera exposure times inevitably blur the high-frequency articulatory transients essential f…