1 paper
Yanchuan Tang, Taowen Wang, Yuefei Chen +3
Vision-Language-Action (VLA) models enable general-purpose robotic policies by mapping visual observations and language instructions to low-level actions, but they often lack relia…