1 paper
Shizhe Chen, Pierre-Louis Guhur, Makarand Tapaswi +2
In vision-and-language navigation (VLN), an embodied agent is required to navigate in realistic 3D environments following natural language instructions. One major bottleneck for ex…