2 papers
cs.IR2026
FiCo-ITR: bridging fine-grained and coarse-grained image-text retrieval for comparative performance analysis
Mikel Williams-Lekuona, Georgina Cosma
In the field of Image-Text Retrieval (ITR), recent advancements have leveraged large-scale Vision-Language Pretraining (VLP) for Fine-Grained (FG) instance-level retrieval, achievi…
cs.IR2026
Image Complexity-Aware Adaptive Retrieval for Efficient Vision-Language Models
Mikel Williams-Lekuona, Georgina Cosma
Vision transformers in vision-language models typically use the same amount of compute for every image, regardless of whether it is simple or complex. We propose ICAR (Image Comple…