1 paper
Zihao Xin, Wentong Li, Yixuan Jiang +4
Vision-and-Language Navigation (VLN) requires agents to follow long-horizon instructions and navigate complex 3D environments. However, existing approaches face two major challenge…