papers
Publications (15)
cs.CV2025
Enhancing End-to-End Autonomous Driving with Latent World Model
Yingyan Li, Lue Fan, Jiawei He +4
cs.CV2025
End-to-End Driving with Online Trajectory Evaluation via BEV World Model
Yingyan Li, Yuqi Wang, Yang Liu +3
cs.CV2025
DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving
Yingyan Li, Shuyao Shang, Weisong Liu +10
cs.RO2025
DriveDPO: Policy Learning via Safety DPO For End-to-End Autonomous Driving
Shuyao Shang, Yuntao Chen, Yuqi Wang +2
cs.IR2022
B-PROP: Bootstrapped Pre-training with Representative Words Prediction for Ad-hoc Retrieval
Xinyu Ma, Jiafeng Guo, Ruqing Zhang +3
cs.CV2021
WenLan: Bridging Vision and Language by Large-Scale Multi-Modal Pre-Training
Yuqi Huo, Manli Zhang, Guangzhen Liu +32
cs.CV2026
Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
Jinghui Lu, Jiayi Guan, Zhijian Huang +47
cs.CV2025
Unified Vision-Language-Action Model
Yuqi Wang, Xinghang Li, Wenxuan Wang +5
cs.CV2022
Densely Constrained Depth Estimator for Monocular 3D Object Detection
Yingyan Li, Yuntao Chen, Jiawei He +1
cs.RO2026
Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories
Xiaomi Robotics Team, Jun Guo, Piaopiao Jin +31
cs.CV2025
TC-Light: Temporally Coherent Generative Rendering for Realistic World Transfer
Yang Liu, Chuanchen Luo, Zimo Tang +6
cs.CV2026
DriveFuture: Future-Aware Latent World Models for Autonomous Driving
Yufeng Hong, Xiaotian Zhou, Yingyan Li +6
cs.CV2024
Fully Sparse Fusion for 3D Object Detection
Yingyan Li, Lue Fan, Yang Liu +4
cs.CL2025
Training Report of TeleChat3-MoE
Xinzhang Liu, Chao Wang, Zhihao Yang +51
cs.CV2026
DynVLA: Learning World Dynamics for Action Reasoning in Autonomous Driving
Shuyao Shang, Bing Zhan, Yunfei Yan +9