3 papers
cs.SD2026
MG-Former: A Transformer-Based Framework for Music-Driven 3D Conducting Gesture Generation
Ke Qiu, Yawen Qin, Tianzhi Jia +3
Generating expressive conducting gestures from music is a challenging cross-modal motion synthesis problem: the output must follow long-range musical structure, preserve beat-level…
cs.CV2026
BiTDiff: Fine-Grained 3D Conducting Motion Generation via BiMamba-Transformer Diffusion
Tianzhi Jia, Kaixing Yang, Xiaole Yang +4
3D conducting motion generation aims to synthesize fine-grained conductor motions from music, with broad potential in music education, virtual performance, digital human animation,…
cs.CV2024
CLIP Model for Images to Textual Prompts Based on Top-k Neighbors
Xin Zhang, YeMing Cai, Tianzhi Jia
Text-to-image synthesis, a subfield of multimodal generation, has gained significant attention in recent years. We propose a cost-effective approach for image-to-prompt generation…