3 papers
cs.CV2026
MIME: Multimodal Interactive Motion Encoder
Addison Zucek, Prerit Gupta, Kamila Kuatova +1
Text-motion representation learning has advanced rapidly, with growing interest in multi person interactions for animation, AR/VR, and embodied AI. These settings require represent…
cs.CV2026
Unified Multi-Modal Interactive & Reactive 3D Motion Generation via Rectified Flow
Prerit Gupta, Shourya Verma, Ananth Grama +1
Generating realistic, context-aware two-person motion conditioned on diverse modalities remains a fundamental challenge for graphics, animation and embodied AI systems. Real-world…
cs.GR2025
MDD: A Dataset for Text-and-Music Conditioned Duet Dance Generation
Prerit Gupta, Jason Alexander Fotso-Puepi, Zhengyuan Li +2
We introduce Multimodal DuetDance (MDD), a diverse multimodal benchmark dataset designed for text-controlled and music-conditioned 3D duet dance motion generation. Our dataset comp…