activity
20242026
collaborators

9 papers

cs.CV2026

MedPixel: A Unified Pixel-Language Model for Medical Reasoning and Segmentation

Haoyu Yang, Meixing Shi, Zengjie Chen +5

Reliable medical image understanding requires models to connect clinical language and visual reasoning with pixel-level grounding. Yet medical vision-language models often lack pre…

cs.CV2026

EliSeg: Verified Target Construction for Report-Grounded Abnormality Segmentation

Chengyi Peng, Haoyu Yang, Meixing Shi +2

Radiology reports describe clinical observations but do not specify executable segmentation targets. They may contain present, negated, prior,uncertain, or irrelevant findings, whi…

cs.CV2026

IBISAgent: Reinforcing Pixel-Level Visual Reasoning in MLLMs for Universal Biomedical Object Referring and Segmentation

Yankai Jiang, Qiaoru Li, Binlu Xu +6

Recent research on medical MLLMs has gradually shifted its focus from image-level understanding to fine-grained, pixel-level comprehension. Although segmentation serves as the foun…

eess.IV2026

A Synthetic Data-Driven Radiology Foundation Model for Pan-tumor Clinical Diagnosis

Wenhui Lei, Hanyu Chen, Zitian Zhang +13

AI-assisted imaging made substantial advances in tumor diagnosis and management. However, a major barrier to developing robust oncology foundation models is the scarcity of large-s…

cs.CV2025

TK-Mamba: Marrying KAN With Mamba for Text-Driven 3D Medical Image Segmentation

Haoyu Yang, Yutong Guan, Meixing Shi +8

3D medical image segmentation is important for clinical diagnosis and treatment but faces challenges from high-dimensional data and complex spatial dependencies. Traditional single…

cs.CV2025

ROFI: A Deep Learning-Based Ophthalmic Sign-Preserving and Reversible Patient Face Anonymizer

Yuan Tian, Min Zhou, Yitong Chen +19

Patient face images provide a convenient mean for evaluating eye diseases, while also raising privacy concerns. Here, we introduce ROFI, a deep learning-based privacy protection fr…