1 paper
Junhao Chen, Zheqi Lv, Keting Yin +6
Recent advances in diffusion models and Transformer architectures have led to significant progress in text-to-video generation. However, these models often suffer from semantic err…