1 paper
Huajian Zeng, Lingyun Chen, Jiaqi Yang +4
Recent vision-language-action (VLA) models can generate plausible end-effector motions, yet they often fail in long-horizon, contact-rich tasks because the underlying hand-object i…