3 papers
cs.CV2026
Majorization-Guided Test-Time Adaptation for Vision-Language Models under Modality-Specific Shift
Lixian Chen, Yanhui Chen, Mingxuan Huang +2
Vision--language models can face asymmetric visual and textual shifts at deployment. These shifts expose a multimodal failure mode in which an unreliable branch remains overconfide…
cs.CV2026
MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models
Yang Shi, Yifeng Xie, Minzhe Guo +6
Recent advances in Vision-Language Models (VLMs) have improved performance in multi-modal learning, raising the question of whether these models truly understand the content they p…
cs.CV2025
PC-UNet: An Enforcing Poisson Statistics U-Net for Positron Emission Tomography Denoising
Yang Shi, Jingchao Wang, Liangsi Lu +9
Positron Emission Tomography (PET) is crucial in medicine, but its clinical use is limited due to high signal-to-noise ratio doses increasing radiation exposure. Lowering doses inc…