1 paper
Xinyu Guo, Bin Xie, Wei Chai +4
Large-scale pretraining has made Vision-Language-Action (VLA) models promising foundations for generalist robot manipulation, yet adapting them to downstream tasks remains necessar…