1 paper
Zheng Xiong, Kang Li, Zilin Wang +3
Built upon language and vision foundation models with strong generalization ability and trained on large-scale robotic data, Vision-Language-Action (VLA) models have recently emerg…