1 paper · 1 filter
Lixuan He, Haoyu Dong, Zhenxing Chen +3
Vision-and-Language Navigation (VLN) in large-scale urban environments requires embodied agents to ground linguistic instructions in complex scenes and recall relevant experiences…