128 citations · 260 across the 44 of their papers we have counts for
4 papers · 1 filter
RedLight-VLA: Models for traffic-rule grounding and behavioral emphasis in driving policies
Bala Murali Manoghar Sai Sudhakar, Sourab Bapu Sridhar, Sandipan Das +5
Behavior-cloned Vision-Language-Action (VLA) driving policies struggle with rare rule-governed maneuvers at signalized intersections. Braking and launching examples contribute litt…
Sparse3DTrack: Monocular 3D Object Tracking Using Sparse Supervision
Nikhil Gosala, B. Ravi Kiran, Senthil Yogamani +1
Monocular 3D object tracking aims to estimate temporally consistent 3D object poses across video frames, enabling autonomous agents to reason about scene dynamics. However, existin…
BEVCar: Camera-Radar Fusion for BEV Map and Object Segmentation
Jonas Schramm, Niclas Vödisch, Kürsat Petek +4
Semantic scene segmentation from a bird's-eye-view (BEV) perspective plays a crucial role in facilitating planning and decision-making for mobile robots. Although recent vision-onl…
Multi-camera Bird's Eye View Perception for Autonomous Driving
David Unger, Nikhil Gosala, Varun Ravi Kumar +3
Most automated driving systems comprise a diverse sensor set, including several cameras, Radars, and LiDARs, ensuring a complete 360°coverage in near and far regions. Unlike Radar…