NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (14)

cs.CV2025

ReactDiff: Latent Diffusion for Facial Reaction Generation

Jiaming Li, Sheng Wang, Xin Wang +4

cs.CV2025

Med-LEGO: Editing and Adapting toward Generalist Medical Image Diagnosis

Yitao Zhu, Yuan Yin, Jiaming Li +5

cs.CV2024

MeLo: Low-rank Adaptation is Better than Fine-tuning for Medical Image Diagnosis

Yitao Zhu, Zhenrong Shen, Zihao Zhao +5

cs.CV2026

IHF-Harmony: Multi-Modality Magnetic Resonance Images Harmonization using Invertible Hierarchy Flow Model

Pengli Zhu, Yitao Zhu, Haowen Pang +1

cs.CV2025

MITracker: Multi-View Integration for Visual Object Tracking

Mengjie Xu, Yitao Zhu, Haotian Jiang +8

cs.CV2024

MUC: Mixture of Uncalibrated Cameras for Robust 3D Human Body Reconstruction

Yitao Zhu, Sheng Wang, Mengjie Xu +5

cs.CE2014

Optimization of Vehicle Dynamics based on Multibody Models using Adjoint Sensitivity Analysis

Yitao Zhu, Corina Sandu, Daniel Dopico +1

cs.CV2025

VisionCAD: An Integration-Free Radiology Copilot Framework

Jiaming Li, Junlei Wu, Sheng Wang +7

cs.CV2025

UniCAD: Efficient and Extendable Architecture for Multi-Task Computer-Aided Diagnosis System

Yitao Zhu, Yuan Yin, Zhenrong Shen +5

cs.CL2023

DoctorGLM: Fine-tuning your Chinese Doctor is not a Herculean Task

Honglin Xiong, Sheng Wang, Yitao Zhu +5

nlin.CD2014

Dynamic Response Optimization of Complex Multibody Systems in a Penalty Formulation using Adjoint Sensitivity

Yitao Zhu, Daniel Dopico, Corina Sandu +1

eess.IV2024

Inter-slice Super-resolution of Magnetic Resonance Images by Pre-training and Self-supervised Fine-tuning

Xin Wang, Zhiyun Song, Yitao Zhu +4

cs.CV2024

ChatCAD+: Towards a Universal and Reliable Interactive CAD using LLMs

Zihao Zhao, Sheng Wang, Jinchen Gu +6

cs.CV2026

MedARC: Training-Free Adaptive Redundancy Compression of Visual Tokens for 3D Medical Vision-Language Models

Yitao Zhu, Mengjun Liu, Yingji Fu +2

MedARC is a training-free method that compresses redundant visual tokens in 3D medical images for vision‑language models by scoring token importance with multiple cues and merging…

#3d medical imaging#vision-language models#token compression#adaptive redundancy