papers
Publications (8)
cs.CV2026
SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture
Haiwen Diao, Penghao Wu, Hanming Deng +55
cs.CV2024
WHAC: World-grounded Humans and Cameras
Wanqi Yin, Zhongang Cai, Ruisi Wang +9
cs.CV2025
Holistic Evaluation of Multimodal LLMs on Spatial Intelligence
Zhongang Cai, Yubo Wang, Qingping Sun +21
cs.CV2026
Scaling Spatial Intelligence with Multimodal Foundation Models
Zhongang Cai, Ruisi Wang, Chenyang Gu +26
cs.CV2023
SynBody: Synthetic Dataset with Layered Human Models for 3D Human Perception and Modeling
Zhitao Yang, Zhongang Cai, Haiyi Mei +12
cs.CV2024
Duolando: Follower GPT with Off-Policy Reinforcement Learning for Dance Accompaniment
Li Siyao, Tianpei Gu, Zhitao Yang +5
cs.CV2023
Digital Life Project: Autonomous 3D Characters with Social Intelligence
Zhongang Cai, Jianping Jiang, Zhongfei Qing +20
cs.CV2023
Story-to-Motion: Synthesizing Infinite and Controllable Character Animation from Long Text
Zhongfei Qing, Zhongang Cai, Zhitao Yang +1