1 paper
Jiawen Yu, Hairuo Liu, Qiaojun Yu +9
Vision-Language-Action (VLA) models have advanced general-purpose robotic manipulation by leveraging pretrained visual and linguistic representations. However, they struggle with c…