1 paper
Sicheng Xu, Guojun Chen, Yu-Xiao Guo +6
We introduce VASA, a framework for generating lifelike talking faces with appealing visual affective skills (VAS) given a single static image and a speech audio clip. Our premiere…