1 paper
Liu He, Yizhi Song, Hejun Huang +4
Text-to-video generation has been dominated by diffusion-based or autoregressive models. These novel models provide plausible versatility, but are criticized for improper physical…