1 paper · 1 filter
Jiahong Chen, Jing Wang, Long Chen +2
Vision-language-action (VLA) models have significantly advanced robotic manipulation by integrating vision-language models (VLMs), and action decoders into a unified architecture.…