2 papers
cs.AI2025
Landmark-Guided Knowledge for Vision-and-Language Navigation
Dongsheng Yang, Meiling Zhu, Yinfeng Yu
Vision-and-language navigation is one of the core tasks in embodied intelligence, requiring an agent to autonomously navigate in an unfamiliar environment based on natural language…
cs.CV2025
Dynamic Multi-Target Fusion for Efficient Audio-Visual Navigation
Yinfeng Yu, Hailong Zhang, Meiling Zhu
Audiovisual embodied navigation enables robots to locate audio sources by dynamically integrating visual observations from onboard sensors with the auditory signals emitted by the…