1 paper · 1 filter
Fan Zhang, Seongbin Park, Baharan Mirzasoleiman +2
Vision-Language-Action (VLA) models demonstrate strong perfor-1 mance on language-conditioned robotic manipulation within their training dis-2 tribution, yet their generalization c…