1 paper
Yuqing Jiang, Zijian Zhang, Weitao Zhou +8
Vision-Language-Action (VLA) policies have advanced language-conditioned robotic manipulation, yet action-imitation objectives provide only weak supervision for metric 3D structure…