1 paper · 1 filter
Utkarsh Bajpai, Julius Rückin, Cyrill Stachniss +1
Mobile robots exploring indoor environments increasingly rely on vision-language models to perceive high-level semantic cues in camera images, such as object categories. Such model…