error correction 1imitation learning 1on-policy off-policy integration 1reinforcement learning 1trajectory sampling 1vision-and-language navigation 1
From the 1 of 3 linked papers with an AI index.
3 papers
cs.RO2026
Joint On-and-Off Policy Learning for Vision-and-Language Navigation
Qingrong He, Lin Zhao, Kevin Zheng +1
The paper presents JOP-VLN, a three-stage training framework that combines off‑policy imitation learning with on‑policy reinforcement learning to improve navigation and error recov…
cs.RO2026
BAT-Nav: Budget-Aware Arbitration and Termination for Long-Horizon Semantic Navigation
Xi Lin, Kangyi Wu, Jiayi Li +3
Long-horizon semantic navigation asks a robot to localize multiple open-vocabulary targets under a finite action budget. This setting exposes an execution failure that is largely h…
eess.SY2026
Associative Memory System via Threshold Linear Networks
Qin He, Jing Shuang Li
Humans learn and form memories in stochastic environments. Auto-associative memory systems model these processes by storing patterns and later recovering them from corrupted versio…