1 paper
Lin Chen, Jingping Fang, Hairui Liu +5
Visual Speech Recognition (VSR) tasks in complex multi-speaker scenarios are severely hindered by rapid head motions, occlusions, and subtle lip articulations. Traditional RGB-base…