3 papers
cs.CV2025
PolyFootNet: Extracting Polygonal Building Footprints in Off-Nadir Remote Sensing Images
Kai Li, Yupeng Deng, Jingbo Chen +6
Extracting polygonal building footprints from off-nadir imagery is crucial for diverse applications. Current deep-learning-based extraction approaches predominantly rely on semanti…
cs.CV2025
Prompt-Driven Building Footprint Extraction in Aerial Images with Offset-Building Model
Kai Li, Yupeng Deng, Yunlong Kong +5
More accurate extraction of invisible building footprints from very-high-resolution (VHR) aerial images relies on roof segmentation and roof-to-footprint offset extraction. Existin…
cs.CV2025
SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion
Junxian Ma, Shiwen Wang, Jian Yang +6
Recent advances in diffusion models have led to significant progress in audio-driven lip synchronization. However, existing methods typically rely on constrained audio-visual align…