4 papers
Beyond Appearance: Geometric Cues for Robust Video Instance Segmentation
Quanzhu Niu, Yikang Zhou, Shihao Chen +2
Video Instance Segmentation (VIS) fundamentally struggles with pervasive challenges including object occlusions, motion blur, and appearance variations during temporal association.…
VectorLLM: Human-like Extraction of Structured Building Contours vis Multimodal LLMs
Tao Zhang, Shiqing Wei, Shihao Chen +3
Automatically extracting vectorized building contours from remote sensing imagery is crucial for urban planning, population estimation, and disaster assessment. Current state-of-th…
P2PFormer: A Primitive-to-polygon Method for Regular Building Contour Extraction from Remote Sensing Images
Tao Zhang, Shiqing Wei, Yikang Zhou +3
Extracting building contours from remote sensing imagery is a significant challenge due to buildings' complex and diverse shapes, occlusions, and noise. Existing methods often stru…
Point Cloud Mamba: Point Cloud Learning via State Space Model
Tao Zhang, Haobo Yuan, Lu Qi +5
Recently, state space models have exhibited strong global modeling capabilities and linear computational complexity in contrast to transformers. This research focuses on applying s…