2 papers
cs.CV2026
Coarse-to-Fine Hierarchical Alignment for UAV-based Human Detection using Diffusion Models
Wenda Li, Meng Wu, Liangzhao Chen +3
Training object detectors demands extensive, task-specific annotations, yet this requirement becomes impractical in UAV-based human detection due to constantly shifting target dist…
cs.CV2025
Generative Spatiotemporal Data Augmentation
Jinfan Zhou, Lixin Luo, Sungmin Eum +2
We explore spatiotemporal data augmentation using video foundation models to diversify both camera viewpoints and scene dynamics. Unlike existing approaches based on simple geometr…