2 papers
cs.CV2025
Enhanced Spatiotemporal Consistency for Image-to-LiDAR Data Pretraining
Xiang Xu, Lingdong Kong, Hui Shuai +5
LiDAR representation learning has emerged as a promising approach to reducing reliance on costly and labor-intensive human annotations. While existing methods primarily focus on sp…
cs.CV2025
LargeAD: Large-Scale Cross-Sensor Data Pretraining for Autonomous Driving
Lingdong Kong, Xiang Xu, Youquan Liu +6
Recent advancements in vision foundation models (VFMs) have revolutionized visual perception in 2D, yet their potential for 3D scene understanding, particularly in autonomous drivi…