1 paper
Kaidi Zhang, Heng Zhang, Zhengtong Xu +7
Vision-Language-Action (VLA) models have demonstrated significant advantages in robotic manipulation. However, their reliance on vision and language often leads to suboptimal perfo…