1 paper · 1 filter
Yazhe Wan, Changjae Oh
Open-vocabulary object detection aims to recognize objects from an open set of categories, which leverages vision-language models (VLMs) pre-trained on large-scale image-text data.…