1 paper
Geonyeong Ko, Giung Lee, Changjoo Nam
Vision-based navigation models, particularly foundation models, generate viable trajectories from RGB observations alone. However, even state-of-the-art transformer- and diffusion-…