papers
Publications (14)
cs.CV2025
ReactDiff: Latent Diffusion for Facial Reaction Generation
Jiaming Li, Sheng Wang, Xin Wang +4
cs.CV2025
Med-LEGO: Editing and Adapting toward Generalist Medical Image Diagnosis
Yitao Zhu, Yuan Yin, Jiaming Li +5
cs.CV2024
MeLo: Low-rank Adaptation is Better than Fine-tuning for Medical Image Diagnosis
Yitao Zhu, Zhenrong Shen, Zihao Zhao +5
cs.CV2026
IHF-Harmony: Multi-Modality Magnetic Resonance Images Harmonization using Invertible Hierarchy Flow Model
Pengli Zhu, Yitao Zhu, Haowen Pang +1
cs.CV2025
MITracker: Multi-View Integration for Visual Object Tracking
Mengjie Xu, Yitao Zhu, Haotian Jiang +8
cs.CV2024
MUC: Mixture of Uncalibrated Cameras for Robust 3D Human Body Reconstruction
Yitao Zhu, Sheng Wang, Mengjie Xu +5
cs.CE2014
Optimization of Vehicle Dynamics based on Multibody Models using Adjoint Sensitivity Analysis
Yitao Zhu, Corina Sandu, Daniel Dopico +1
cs.CV2025
VisionCAD: An Integration-Free Radiology Copilot Framework
Jiaming Li, Junlei Wu, Sheng Wang +7
cs.CV2025
UniCAD: Efficient and Extendable Architecture for Multi-Task Computer-Aided Diagnosis System
Yitao Zhu, Yuan Yin, Zhenrong Shen +5
cs.CL2023
DoctorGLM: Fine-tuning your Chinese Doctor is not a Herculean Task
Honglin Xiong, Sheng Wang, Yitao Zhu +5
nlin.CD2014
Dynamic Response Optimization of Complex Multibody Systems in a Penalty Formulation using Adjoint Sensitivity
Yitao Zhu, Daniel Dopico, Corina Sandu +1
eess.IV2024
Inter-slice Super-resolution of Magnetic Resonance Images by Pre-training and Self-supervised Fine-tuning
Xin Wang, Zhiyun Song, Yitao Zhu +4
cs.CV2024
ChatCAD+: Towards a Universal and Reliable Interactive CAD using LLMs
Zihao Zhao, Sheng Wang, Jinchen Gu +6
cs.CV2026
MedARC: Training-Free Adaptive Redundancy Compression of Visual Tokens for 3D Medical Vision-Language Models
Yitao Zhu, Mengjun Liu, Yingji Fu +2
MedARC is a training-free method that compresses redundant visual tokens in 3D medical images for vision‑language models by scoring token importance with multiple cues and merging…
#3d medical imaging#vision-language models#token compression#adaptive redundancy