1 paper
Yuzhe Huang, Pei Lin, Wanlin Li +5
Vision-Language-Action (VLA) models have recently emerged as powerful generalists for robotic manipulation. However, due to their predominant reliance on visual modalities, they fu…