collaborators

6 papers

cs.RO2026

Contact-Constrained Lower-Limb Joint-Offset Calibration for Humanoid Robots

Kaixiang Lu, Haiyu Lan, Chunxiao Qiao +5

Accurate joint encoder offsets are essential for kinematic consistency in humanoid lower limbs, yet existing calibration methods typically require external motion-capture systems o…

cs.RO2026

FOCUS: Foot Observation Confidence for Robust Humanoid Proprioceptive Odometry

Kaixin Feng, Angsong Li, Shaopeng Zhang +5

Foot forward kinematics (FK) is widely used to improve proprioceptive legged odometry by providing reliable velocity constraints during foot support. Existing contact-aided estimat…

cs.RO2026

OVIP-SG: Open-Vocabulary Instance-Preserving Scene Graphs for Mapping and Retrieval of Small, Fine-Grained Objects

Tianjing Hao, Haiyu Lan, Angsong Li +6

Integrating open-vocabulary perception into object-level 3D scene graphs is a double-edged sword. While vision-language detectors recover long-tail categories and small, fine-grain…

cs.RO2026

TemporalFlow-VLA: Learning Physically Grounded Execution History for Long-Horizon Robot Manipulation

Jiarui Yang, Yehao Lu, Yuning Su +9

Vision-language-action (VLA) models leverage pretrained vision-language representations for robot control, yet simply adding historical frames does not reliably capture recent phys…

cs.CV2026

V-Link: Recovering Lost Visual Representations in Action DiT for Vision-Language-Action Models

Yehao Lu, Jiarui Yang, Yuning Su +10

Vision-language-action (VLA) models provide a scalable path toward generalist robotic manipulation by integrating visual perception, language understanding, and continuous action c…

cs.RO2026

Multi-View Unified Camera Fields: Geometry-Shaped Action-Facing Representations for RGB-Only Multi-Camera VLA Policies

Jiarui Yang, Yehao Lu, Yuning Su +9

Vision-Language-Action (VLA) models have shown strong generalization in robotic manipulation, yet complex contact-rich tasks often benefit from multi-camera observations that joint…