1 paper
Jiacheng Li, Yize Guo, Jiabin Guo +2
Vision-language-action models have shown strong promise for robot manipulation, yet raw language is primarily needed to specify task intent rather than to be repeatedly processed d…