Showing cs.CVShow all
3 papers · 1 filter
cs.CV2024
Targeted Visual Prompting for Medical Visual Question Answering
Sergio Tascon-Morales, Pablo Márquez-Neila, Raphael Sznitman
With growing interest in recent years, medical visual question answering (Med-VQA) has rapidly evolved, with multimodal large language models (MLLMs) emerging as an alternative to…
cs.CV2023
Localized Questions in Medical Visual Question Answering
Sergio Tascon-Morales, Pablo Márquez-Neila, Raphael Sznitman
Visual Question Answering (VQA) models aim to answer natural language questions about given images. Due to its ability to ask questions that differ from those used when training th…
cs.CV2023
Logical Implications for Visual Question Answering Consistency
Sergio Tascon-Morales, Pablo Márquez-Neila, Raphael Sznitman
Despite considerable recent progress in Visual Question Answering (VQA) models, inconsistent or contradictory answers continue to cast doubt on their true reasoning capabilities. H…