4 papers
TFTrack: A Template-Free Framework for Efficient 3D Point Cloud Tracking
Zhaofeng Hu, Sifan Zhou, Jiahao Nie +3
LiDAR-based 3D Single Object Tracking (3D SOT) is critical for robotic perception and navigation and aims to localize dynamic objects across frames in sparse point clouds. Existing…
AnySlot: Goal-Conditioned Vision-Language-Action Policies for Zero-Shot Slot-Level Placement
Zhaofeng Hu, Sifan Zhou, Qinbo Zhang +4
Vision-Language-Action (VLA) policies have emerged as a versatile paradigm for generalist robotic manipulation. However, precise object placement under compositional language remai…
Manipulation Planning for Construction Activities with Repetitive Tasks
Wangyi Liu, Dasharadhan Mahalingam, Fanru Gao +2
In this paper, we study the problem of manipulation skill acquisition for performing construction activities consisting of repetitive tasks (e.g., building a wall or installing cei…
Sample-Efficient Robot Skill Learning for Construction Tasks: Benchmarking Hierarchical Reinforcement Learning and Vision-Language-Action VLA Model
Zhaofeng Hu, Hongrui Yu, Vaidhyanathan Chandramouli +1
This study evaluates two leading approaches for teaching construction robots new skills to understand their applicability for construction automation: a Vision-Language-Action (VLA…