6 papers · 1 filter
PatchGen: Learning Soft Intra-Image Predictive Subsets for Visual Generalization
Zhaorui Tan, Weimiao Yu, Xi Yang
Visual classifiers are expected to generalize under data shifts, target shifts, and their combinations, yet most existing methods focus on domain invariance while failing to addres…
Pareto-Guided Optimization for Uncertainty-Aware Medical Image Segmentation
Jinming Zhang, Youpeng Yang, Xi Yang +5
Uncertainty in medical image segmentation is inherently non-uniform, with boundary regions exhibiting substantially higher ambiguity than interior areas. Conventional training trea…
Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification
Zhaorui Tan, Tan Pan, Kaizhu Huang +8
LayerNorm is pivotal in Vision Transformers (ViTs), yet its fine-tuning dynamics under data scarcity and domain shifts remain underexplored. This paper shows that shifts in LayerNo…
Towards a Universal 3D Medical Multi-modality Generalization via Learning Personalized Invariant Representation
Zhaorui Tan, Xi Yang, Tan Pan +8
Variations in medical imaging modalities and individual anatomical differences pose challenges to cross-modality generalization in multi-modal tasks. Existing methods often concent…
Consistency Diffusion Models for Single-Image 3D Reconstruction with Priors
Chenru Jiang, Chengrui Zhang, Xi Yang +4
This paper delves into the study of 3D point cloud reconstruction from a single image. Our objective is to develop the Consistency Diffusion Model, exploring synergistic 2D and 3D…
Interpret Your Decision: Logical Reasoning Regularization for Generalization in Visual Classification
Zhaorui Tan, Xi Yang, Qiufeng Wang +2
Vision models excel in image classification but struggle to generalize to unseen data, such as classifying images from unseen domains or discovering novel categories. In this paper…