Showing cs.ROShow all
2 papers · 1 filter
cs.RO2026
Simple-to-Complex Structured Demonstrations for Vision-Language-Action Learning
Xinchuan Qiu, Yi Yu
Vision-Language-Action (VLA) models have demonstrated strong capabilities in robotic manipulation by integrating visual perception, language understanding, and robot action generat…
cs.RO2026
Benchmarking Vision-Language-Action Models on SO-101: Failure and Recovery Analysis
Yi Yu, Xinchuan Qiu
Vision-Language-Action (VLA) models have demonstrated strong generalization in robotic manipulation, yet existing evaluations are primarily conducted in simulation or on expensive…