3 papers
cs.HC2026
EyeAgent: An Agentic AI System for Multimodal Clinical Decision Support in Ophthalmology
Danli Shi, Xiaolan Chen, Bingjie Yan +24
Artificial intelligence has shown promise in medical imaging, yet most existing systems lack flexibility, interpretability, and adaptability - challenges especially pronounced in o…
cs.CV2025
Benchmarking Large Multimodal Models for Ophthalmic Visual Question Answering with OphthalWeChat
Pusheng Xu, Xia Gong, Xiaolan Chen +7
Purpose: To develop a bilingual multimodal visual question answering (VQA) benchmark for evaluating VLMs in ophthalmology. Methods: Ophthalmic image posts and associated captions p…
eess.IV2025
Efficient Bilinear Attention-based Fusion for Medical Visual Question Answering
Zhilin Zhang, Jie Wang, Zhanghao Qin +2
Medical Visual Question Answering (MedVQA) has attracted growing interest at the intersection of medical image understanding and natural language processing for clinical applicatio…