From the 1 of 61 linked papers with an AI index.
40 papers · 1 filter
On the Robustness of Temporal Vision-Language Models for Surgical Endoscopy Videos
Darakshan Rashid, Raza Imam, Ufaq Khan +9
Temporal vision-language models (TVLMs) offer a reusable, prompt-based interface for surgical video understanding, yet, their robustness under clinically realistic acquisition arti…
Hierarchy-Aware and Anatomy-Guided Learning for Lung Ultrasound Video Classification
Alya Almsouti, Lotfi Mecharbat, Noha Aboukhater +5
Lung ultrasound (LUS) is a bedside tool for assessing pulmonary edema in patients at risk due to heart failure or impaired kidney function. However, automated LUS analysis remains…
Can Experts Adapt Without Training? On Test-Time Modality Generalization in MVLMs
Raza Imam, Darakshan Rashid, Yutong Xie +3
Medical vision-language models (MVLMs) promise broad zero-shot generalization, yet their reliability collapses when confronted with unseen modalities and domains, precisely where c…
An Empirical Analysis of Continual Learning for Heterogeneous Medical Visual Question Answering
Mai A. Shaaban, Tausifa Jan Saleem, Alaa Mohamed +3
The paper systematically evaluates continual learning methods for medical visual question answering across a range of heterogeneous clinical tasks, examining catastrophic forgettin…
EchoSonar-R: A Multi-View Reasoning-Enabled Model for Disease Classification and Report Generation in Echocardiography
Darya Taratynova, Ahmed Aly, Numan Saeed +1
Echocardiography is the most widely used non-invasive cardiac imaging modality, providing essential information for cardiovascular diagnosis. Interpreting an echocardiogram require…
From Point Estimates to Distributions: GMM Pooling for MIL in Preterm Birth Prediction
Hussain Alasmawi, Numan Saeed, Soha Said +1
Preterm birth (PTB) prediction can enable targeted surveillance and timely intervention, yet most ultrasound-based models use a single selected transvaginal ultrasound (TVUS) frame…