1 paper
Zhuohao Li, Yinghao Li, Jian-Jian Jiang +6
Vision-Language-Action (VLA) models have advanced robotic manipulation by combining vision, language, and proprioception to predict actions. However, previous methods fuse proprioc…