6 papers
SNM-VFI: Symmetric Nonlinear Motion-Guided Generative Video Frame Interpolation
Jisoo Jeong, Hong Cai, Jamie Menjay Lin +5
We propose Symmetric Nonlinear Motion-guided Generative Video Frame Interpolation (SNM-VFI), a training-free framework for motion-controllable generative video frame interpolation…
CLEAR: Closed-Loop Reinforcement Learning at Scale for End-to-End Autonomous Driving
Yunxiao Shi, Hong Cai, Mohammad Ghavamzadeh +1
End-to-end autonomous driving (E2E-AD) aims to directly map raw sensor information to driving actions. Recently, with the rapid advancement of multi-modal large language models (ML…
Generative Scenario Rollouts for End-to-End Autonomous Driving
Rajeev Yasarla, Deepti Hegde, Shizhong Han +10
Vision-Language-Action (VLA) models are emerging as highly effective planning models for end-to-end autonomous driving systems. However, current works mostly rely on imitation lear…
ODG: Occupancy Prediction Using Dual Gaussians
Yunxiao Shi, Yinhao Zhu, Shizhong Han +4
Occupancy prediction infers fine-grained 3D geometry and semantics from camera images of the surrounding environment, making it a critical perception task for autonomous driving. E…
BePo: Dual Representation for 3D Occupancy Prediction
Yunxiao Shi, Hong Cai, Jisoo Jeong +4
3D occupancy infers fine-grained 3D geometry and semantics which is critical for autonomous driving. Most existing approaches carry high compute costs, requiring dense 3D feature v…
H3O: Hyper-Efficient 3D Occupancy Prediction with Heterogeneous Supervision
Yunxiao Shi, Hong Cai, Amin Ansari +1
3D occupancy prediction has recently emerged as a new paradigm for holistic 3D scene understanding and provides valuable information for downstream planning in autonomous driving.…