Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output
Yanyuan Chen, Dexuan Xu, Yu Huang +6
Currently, medical vision language models are widely used in medical vision question answering tasks. However, existing models are confronted with two issues: for input, the model…
cs.CV2025
DEFNet: Multitasks-based Deep Evidential Fusion Network for Blind Image Quality Assessment
Yiwei Lou, Yuanpeng He, Rongchao Zhang +3
Blind image quality assessment (BIQA) methods often incorporate auxiliary tasks to improve performance. However, existing approaches face limitations due to insufficient integratio…