1 paper
Chuhao Jin, Haosen Li, Bingzi Zhang +7
Recent advances in large language models (LLMs) have enabled breakthroughs in many multimodal generation tasks, but a significant performance gap still exists in text-to-motion gen…