3 papers
cs.CV2026
VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment
Tengjiao Yin, Jinglei Shi, Heng Guo +1
Video diffusion models lack explicit geometric supervision during training, leading to inconsistency artifacts such as object deformation, spatial drift, and depth violations in ge…
eess.IV2025
Dual encoding feature filtering generalized attention UNET for retinal vessel segmentation
Md Tauhidul Islam, Wu Da-Wen, Tang Qing-Qing +6
Retinal blood vessel segmentation is crucial for diagnosing ocular and cardiovascular diseases. Although the introduction of U-Net in 2015 by Olaf Ronneberger significantly advance…
eess.IV2025
PGAD: Prototype-Guided Adaptive Distillation for Multi-Modal Learning in AD Diagnosis
Yanfei Li, Teng Yin, Wenyi Shang +3
Missing modalities pose a major issue in Alzheimer's Disease (AD) diagnosis, as many subjects lack full imaging data due to cost and clinical constraints. While multi-modal learnin…