4 papers
SpaceMind: A Modular and Self-Evolving Embodied Vision-Language Agent Framework for Autonomous On-orbit Servicing
Aodi Wu, Haodong Han, Xubo Luo +3
Autonomous on-orbit servicing demands embodied agents that perceive through visual sensors, reason about 3D spatial situations, and execute multi-phase tasks over extended horizons…
SpaceSense-Bench: A Large-Scale Multi-Modal Benchmark for Spacecraft Perception and Pose Estimation
Aodi Wu, Jianhong Zuo, Zeyuan Zhao +3
Autonomous space operations such as on-orbit servicing and active debris removal demand robust part-level semantic understanding and precise relative navigation of target spacecraf…
StepNav: Structured Trajectory Priors for Efficient and Multimodal Visual Navigation
Xubo Luo, Aodi Wu, Haodong Han +4
Visual navigation is fundamental to autonomous systems, yet generating reliable trajectories in cluttered and uncertain environments remains a core challenge. Recent generative mod…
Learning to Anchor Visual Odometry: KAN-Based Pose Regression for Planetary Landing
Xubo Luo, Zhaojin Li, Xue Wan +2
Accurate and real-time 6-DoF localization is mission-critical for autonomous lunar landing, yet existing approaches remain limited: visual odometry (VO) drifts unboundedly, while m…