1 paper
Hequan Wang, Xuean Chen, Jiaxu Zhang +2
Text-to-motion generation requires modeling both global action structure and fine-grained motion dynamics from natural language. Existing approaches typically rely on either contin…