collaborators

5 papers

cs.RO2026

WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time

Yusen Feng, Bingchen Han, Jiangran Lyu +13

Steering robot foundation models (RFMs) toward new task variants or user-preferred behaviors remains challenging, often requiring additional robot demonstrations, task-specific fin…

cs.RO2026

LDA-1B: Scaling Latent Dynamics Action Model via Universal Embodied Data Ingestion

Jiangran Lyu, Kai Liu, Xuheng Zhang +20

Recent robot foundation models largely rely on large-scale behavior cloning, which imitates expert actions but discards transferable dynamics knowledge embedded in heterogeneous em…

cs.RO2026

MuGen: Multi-Skill Generative Locomotion Controller for Humanoid Robots

Yusen Feng, Xiang Wang, Heyuan Yao +7

This paper presents MuGen, a data-driven framework for learning and deploying multi-skill locomotion on humanoid robots. MuGen enables a robot to perform expressive motions like hu…

cs.CV2026

Generator-Refiner-Examiner: A Tri-Module Data Augmentation Framework for 3D Human Avatar Learning from Monocular Videos

Gangjian Zhang, Jian Shu, Sicheng Yu +3

This paper addresses the challenge of reconstructing photorealistic and animatable 3D human avatars from monocular videos. While existing methods rely on combining per-subject opti…

cs.RO2026

ProAct: A Dual-System Framework for Proactive Embodied Social Agents

Zeyi Zhang, Zixi Kang, Ruijie Zhao +3

Embodied social agents have recently advanced in generating synchronized speech and gestures. However, most interactive systems remain fundamentally reactive, responding only to cu…