2 papers
cs.RO2026
ELAN4D: Embodiment-Centric 4D Supervision for Vision-Language-Action Models via Plug-and-Play Adaptation
Zeyuan He, Bowen Yang, Zhirui Fang +9
Vision-Language-Action (VLA) models have shown promise for robotic manipulation, yet most existing policies operate reactively by directly regressing actions from current observati…
cs.RO2026
TGM-VLA: Task-Guided Mixup for Sampling-Efficient and Robust Robotic Manipulation
Fanqi Pu, Lei Jiang, Wenming Yang
The performance of robotic imitation learning is fundamentally limited by data quality and training strategies. Prevalent sampling strategies on RLBench suffer from severe keyframe…