2 papers
cs.CV2025
MultiMotion: Multi Subject Video Motion Transfer via Video Diffusion Transformer
Penghui Liu, Jiangshan Wang, Yutong Shen +3
Multi-object video motion transfer poses significant challenges for Diffusion Transformer (DiT) architectures due to inherent motion entanglement and lack of object-level control.…
cs.RO2025
DETACH: Cross-domain Learning for Long-Horizon Tasks via Mixture of Disentangled Experts
Yutong Shen, Hangxu Liu, Lei Zhang +4
Long-Horizon (LH) tasks in Human-Scene Interaction (HSI) are complex multi-step tasks that require continuous planning, sequential decision-making, and extended execution across do…