1 paper
Ziyue Zhu, Shangyang Wu, Shuai Zhao +5
Vision-Language-Action (VLA) models are formulated to ground instructions in visual context and generate action sequences for robotic manipulation. Despite recent progress, VLA mod…