1 paper
Zhehao Dong, Xiaofeng Wang, Zheng Zhu +12
The generalization of vision-language-action (VLA) models heavily relies on diverse training data. However, acquiring large-scale data for robot manipulation across varied object a…