1 paper
Fei Qin, Bowen Zhang, Chao Fan +2
Visual speech recognition (VSR) recovers speech from lip movements when audio is noisy or unavailable. Its multi-stage inference pipeline spans video decoding, mouth-region extract…