1 paper
Xiaoran Xu, Yupeng Wu, Tianyu Xue +4
Training-free ObjectNav agents increasingly use vision-language models (VLMs), yet typically discard acquired scene knowledge after each request. We study cross-episode ObjectNav,…