2 papers
cs.GR2025
TRiMM: Transformer-Based Rich Motion Matching for Real-Time multi-modal Interaction in Digital Humans
Yueqian Guo, Tianzhao Li, Xin Lyu +7
Large Language Model (LLM)-driven digital humans have sparked a series of recent studies on co-speech gesture generation systems. However, existing approaches struggle with real-ti…
cs.SD2024
DiM-Gestor: Co-Speech Gesture Generation with Adaptive Layer Normalization Mamba-2
Fan Zhang, Siyuan Zhao, Naye Ji +12
Speech-driven gesture generation using transformer-based generative models represents a rapidly advancing area within virtual human creation. However, existing models face signific…