2 papers
cs.CV2023
CN-Celeb-AV: A Multi-Genre Audio-Visual Dataset for Person Recognition
Lantian Li, Xiaolou Li, Haoyu Jiang +3
Audio-visual person recognition (AVPR) has received extensive attention. However, most datasets used for AVPR research so far are collected in constrained environments, and thus ca…
cs.CV2022
Swin Transformer coupling CNNs Makes Strong Contextual Encoders for VHR Image Road Extraction
Tao Chen, Yiran Liu, Haoyu Jiang +1
Accurately segmenting roads is challenging due to substantial intra-class variations, indistinct inter-class distinctions, and occlusions caused by shadows, trees, and buildings. T…