1 paper
Jiasong Xiao, Yutao She, Kai Li +2
Vision-language-action (VLA) models integrate visual observations and language instructions to predict robot actions, demonstrating promising generalization in manipulation tasks.…