8 papers
Superman: Unifying Skeleton and Vision for Human Motion Perception and Generation
Xinshun Wang, Peiming Li, Ziyi Wang +5
Human motion analysis tasks, such as temporal 3D pose estimation, motion prediction, and motion in-betweening, play an essential role in computer vision. However, current paradigms…
CORE: Common Outcome Regularities from Action-Free Visual Demonstrations for Robot Manipulation
Juyi Sheng, Jincheng Li, Mingxin Tan +1
Robot imitation learning often relies on costly robot demonstrations, while abundant action-free visual demonstrations, such as human videos, are difficult to use because they lack…
Eval-Actions: Fine-Grained Execution Quality Evaluation for Robotic Manipulation
Mengyuan Liu, Juyi Sheng, Peiming Li +4
Although Vision--Action (VA) and Vision--Language--Action (VLA) policies have advanced robotic manipulation, their evaluation remains dominated by binary success rates, which obscu…
Lens Privacy Sealing: A New Benchmark and Method for Physical Privacy-Preserving Action Recognition
Mengyuan Liu, Ziyi Wang, Peiming Li +1
RGB camera-based surveillance systems enable human action recognition for public safety and healthcare, yet raise serious privacy concerns. Existing methods rely on post-capture al…
NeRF-VIO: Map-Based Visual-Inertial Odometry with Initialization Leveraging Neural Radiance Fields
Yanyu Zhang, Dongming Wang, Jie Xu +3
A prior map serves as a foundational reference for localization in context-aware applications such as augmented reality (AR). Providing valuable contextual information about the en…
MP1: MeanFlow Tames Policy Learning in 1-step for Robotic Manipulation
Juyi Sheng, Ziyi Wang, Peiming Li +1
In robot manipulation, robot learning has become a prevailing approach. However, generative models within this field face a fundamental trade-off between the slow, iterative sampli…