4 papers
Does it Really Count? Assessing Semantic Grounding in Text-Guided Class-Agnostic Counting
Giacomo Pacini, Luca Ciampi, Nicola Messina +3
Open-world text-guided class-agnostic counting (CAC) has emerged as a flexible paradigm for counting arbitrary object classes by using natural language prompts. However, current ev…
One Patch to Caption Them All: A Unified Zero-Shot Captioning Framework
Lorenzo Bianchi, Giacomo Pacini, Fabio Carrara +3
Zero-shot captioners are recently proposed models that utilize common-space vision-language representations to caption images without relying on paired image-text data. To caption…
CountingDINO: A Training-free Pipeline for Class-Agnostic Counting using Unsupervised Backbones
Giacomo Pacini, Lorenzo Bianchi, Luca Ciampi +3
Class-agnostic counting (CAC) aims to estimate the number of objects in images without being restricted to predefined categories. However, while current exemplar-based CAC methods…
Maybe you are looking for CroQS: Cross-modal Query Suggestion for Text-to-Image Retrieval
Giacomo Pacini, Fabio Carrara, Nicola Messina +3
Query suggestion, a technique widely adopted in information retrieval, enhances system interactivity and the browsing experience of document collections. In cross-modal retrieval,…