3 papers
cs.CV2025
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
Yihong Lin, Zhaoxin Fan, Xianjia Wu +6
Speech-driven talking head generation is a critical yet challenging task with applications in augmented reality and virtual human modeling. While recent approaches using autoregres…
eess.IV2025
Enhancing Weakly Supervised 3D Medical Image Segmentation through Probabilistic-aware Learning
Runmin Jiang, Zhaoxin Fan, Junhao Wu +5
3D medical image segmentation is a challenging task with crucial implications for disease diagnosis and treatment planning. Recent advances in deep learning have significantly enha…
cs.CV2025
Lipschitz-Driven Noise Robustness in VQ-AE for High-Frequency Texture Repair in ID-Specific Talking Heads
Jian Yang, Xukun Wang, Wentao Wang +7
Audio-driven IDentity-specific Talking Head Generation (ID-specific THG) has shown increasing promise for applications in filmmaking and virtual reality. Existing approaches are ge…