1 paper
Jiangyang Li, Cong Wan, SongLin Dong +4
Vision-and-Language Navigation (VLN) requires agents to navigate photo-realistic environments following natural language instructions. Current methods predominantly rely on imitati…