2 papers
cs.CV2024
Two-stream Multi-level Dynamic Point Transformer for Two-person Interaction Recognition
Yao Liu, Gangfeng Cui, Jiahui Luo +2
As a fundamental aspect of human life, two-person interactions contain meaningful information about people's activities, relationships, and social settings. Human action recognitio…
cs.CV2024
SSMG: Spatial-Semantic Map Guided Diffusion Model for Free-form Layout-to-Image Generation
Chengyou Jia, Minnan Luo, Zhuohang Dang +4
Despite significant progress in Text-to-Image (T2I) generative models, even lengthy and complex text descriptions still struggle to convey detailed controls. In contrast, Layout-to…