3 papers
cs.RO2026
AnchorVLA: Bridging Discrete Decisions and Continuous Trajectories for Vision-Language-Action Planning
Qi Liu, Yabei Li, Hongsong Wang +2
Autonomous driving planning requires translating navigation intent, traffic rules, dynamic interactions, and language instructions into executable continuous trajectories. Vision-L…
cs.CV2025
HQ-OV3D: A High Box Quality Open-World 3D Detection Framework based on Diffision Model
Qi Liu, Yabei Li, Hongsong Wang +1
Traditional closed-set 3D detection frameworks fail to meet the demands of open-world applications like autonomous driving. Existing open-vocabulary 3D detection methods typically…
cs.CV2025
VLM-3D:End-to-End Vision-Language Models for Open-World 3D Perception
Fuhao Chang, Shuxin Li, Yabei Li +1
Open-set perception in complex traffic environments poses a critical challenge for autonomous driving systems, particularly in identifying previously unseen object categories, whic…