3 papers
cs.CV2026
VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment
Tengjiao Yin, Jinglei Shi, Heng Guo +1
Video diffusion models lack explicit geometric supervision during training, leading to inconsistency artifacts such as object deformation, spatial drift, and depth violations in ge…
eess.IV2025
PGAD: Prototype-Guided Adaptive Distillation for Multi-Modal Learning in AD Diagnosis
Yanfei Li, Teng Yin, Wenyi Shang +3
Missing modalities pose a major issue in Alzheimer's Disease (AD) diagnosis, as many subjects lack full imaging data due to cost and clinical constraints. While multi-modal learnin…
eess.IV2025
Dual encoding feature filtering generalized attention UNET for retinal vessel segmentation
Md Tauhidul Islam, Wu Da-Wen, Tang Qing-Qing +6
Retinal blood vessel segmentation is crucial for diagnosing ocular and cardiovascular diseases. Although the introduction of U-Net in 2015 by Olaf Ronneberger significantly advance…