2 papers
cs.CV2025
SignDiff: Diffusion Model for American Sign Language Production
Sen Fang, Chunyu Sui, Yanghao Zhou +4
In this paper, we propose a dual-condition diffusion pre-training model named SignDiff that can generate human sign language speakers from a skeleton pose. SignDiff has a novel Fra…
cs.CV2024
High-Quality Visually-Guided Sound Separation from Diverse Categories
Chao Huang, Susan Liang, Yapeng Tian +2
We propose DAVIS, a Diffusion-based Audio-VIsual Separation framework that solves the audio-visual sound source separation task through generative learning. Existing methods typica…