1 paper
Yue Peng, Yongzhe Zhao, Artur Habuda +5
Vision-language-action (VLA) models have made rapid progress in generalist robot manipulation by harnessing semantic knowledge from pretrained vision-language backbones, but their…