1 paper
Muyi Bao, Yuxin Cai, Hang Xu +7
Vision-language models (VLMs) have become a common foundation for vision-and-language navigation in continuous environments (VLN-CE). Yet most VLM-based methods cast navigation as…