2 citations · 2 across the 4 of their papers we have counts for
Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
Efficient Few-Shot Continual Learning in Vision-Language Models
Aristeidis Panos, Rahaf Aljundi, Daniel Olmeda Reino +1
Vision-language models (VLMs) excel in tasks such as visual question answering and image captioning. However, VLMs are often limited by their use of pretrained image encoders, like…
cs.CV2024
Imperfect Vision Encoders: Efficient and Robust Tuning for Vision-Language Models
Aristeidis Panos, Rahaf Aljundi, Daniel Olmeda Reino +1
Vision language models (VLMs) demonstrate impressive capabilities in visual question answering and image captioning, acting as a crucial link between visual and language models. Ho…