1 paper
Zhengyang Sun, Yu Chen, Xin Zhou +4
Text-to-video diffusion models have enabled open-ended video synthesis, but often struggle with generating the correct number of objects specified in a prompt. We introduce NUMINA…