1 paper · 1 filter
Pou-Chun Kung, Aryaman Rao, Utkrisht Sahai +4
Vision-language models (VLMs) are emerging as a key component of embodied intelligence, with growing applications in auto-labeling and end-to-end autonomous driving. However, exist…