1 paper
Chang Sun, Dongliang Xie, Wanpeng Xie +2
Visual speech recognition (VSR) aims to transcribe spoken content from silent lip-motion videos and is particularly challenging in Mandarin due to severe viseme ambiguity and perva…