2 papers
cs.CV2026
DiffST: Spatiotemporal-Aware Diffusion for Real-World Space-Time Video Super-Resolution
Zheng Chen, Ruofan Yang, Jin Han +5
Diffusion-based models have shown strong performance in video super-resolution (VSR) and video frame interpolation (VFI). However, their role in the coupled space-time video super-…
cs.CV2025
PaMi-VDPO: Mitigating Video Hallucinations by Prompt-Aware Multi-Instance Video Preference Learning
Xinpeng Ding, Kui Zhang, Jianhua Han +3
Direct Preference Optimization (DPO) helps reduce hallucinations in Video Multimodal Large Language Models (VLLMs), but its reliance on offline preference data limits adaptability…