1 paper · 1 filter
Haruki Sakajo, Hiroshi Takato, Hiroshi Tsutsui +3
Large-scale Vision Language Models (LVLMs) exhibit advanced capabilities in tasks that require visual information, including object detection. These capabilities have promising app…