3 papers
cs.CV2026
Focal-RegionFace: Generating Fine-Grained Multi-attribute Descriptions for Arbitrarily Selected Face Focal Regions
Kaiwen Zheng, Junchen Fu, Songpei Xu +4
In this paper, we introduce an underexplored problem in facial analysis: generating and recognizing multi-attribute natural language descriptions, containing facial action units (A…
cs.CV2024
HpEIS: Learning Hand Pose Embeddings for Multimedia Interactive Systems
Songpei Xu, Xuri Ge, Chaitanya Kaul +1
We present a novel Hand-pose Embedding Interactive System (HpEIS) as a virtual sensor, which maps users' flexible hand poses to a two-dimensional visual space using a Variational A…
cs.CV2022
Cross-modal Semantic Enhanced Interaction for Image-Sentence Retrieval
Xuri Ge, Fuhai Chen, Songpei Xu +2
Image-sentence retrieval has attracted extensive research attention in multimedia and computer vision due to its promising application. The key issue lies in jointly learning the v…