8 papers
TAVR-VLM: Risk-Conditioned Causal Grounding for Hallucination-Resistant Report Generation
Zhixiang Lu, Xiwei Liu, Sifan Song +5
Transcatheter Aortic Valve Replacement (TAVR) planning requires meticulous multimodal reasoning. However, adapting Multimodal Large Language Models (MLLMs) to this high-stakes doma…
CHIPS: Efficient CLIP Adaptation via Curvature-aware Hybrid Influence-based Data Selection
Xinlin Zhuang, Yichen Li, Xiwei Liu +11
Adapting CLIP to vertical domains is typically approached by novel fine-tuning strategies or by continual pre-training (CPT) on large domain-specific datasets. Yet, data itself rem…
DeLo: Dual Decomposed Low-Rank Experts Collaboration for Continual Missing Modality Learning
Xiwei Liu, Yulong Li, Feilong Tang +1
Adapting Large Multimodal Models (LMMs) to real-world scenarios poses the dual challenges of learning from sequential data streams while handling frequent modality incompleteness,…
ClinCoT: Clinical-Aware Visual Chain-of-Thought for Medical Vision Language Models
Xiwei Liu, Yulong Li, Xinlin Zhuang +5
Medical Vision-Language Models have shown promising potential in clinical decision support, yet they remain prone to factual hallucinations due to insufficient grounding in localiz…
DoAtlas-1: A Causal Compilation Paradigm for Clinical AI
Yulong Li, Jianxu Chen, Xiwei Liu +9
Medical foundation models generate narrative explanations but cannot quantify intervention effects, detect evidence conflicts, or validate literature claims, limiting clinical audi…
Path-Guided Flow Matching for Dataset Distillation
Xuhui Li, Zhengquan Luo, Xiwei Liu +2
Dataset distillation compresses large datasets into compact synthetic sets with comparable performance in training models. Despite recent progress on diffusion-based distillation,…