1 paper
Chuanke Pang, Junyi Huang, Zhijun Zhao +3
Pre-trained Vision-Language-Action (VLA) models provide useful semantic and spatial priors, yet their parallel-gripper action interfaces do not specify how those priors should be r…