1 paper · 1 filter
Zebin Yang, Yijiahao Qi, Tong Xie +3
Vision-Language-Action (VLA) models have shown remarkable success in robotic tasks like manipulation by fusing a language model's reasoning with a vision model's 3D understanding.…