1 paper
Jingping Fang, Lin Chen, Chenyang Xu +3
Traditional RGB-based speech generation faces Temporal Granularity Mismatch since fixed camera exposure times inevitably blur the high-frequency articulatory transients essential f…