2 papers
cs.RO2026
Potential-Guided Flow Matching for Vision-Language-Action Policy Improvement
Yunpeng Mei, Jiakai He, Hongjie Cao +12
Large vision-language-action (VLA) policies are increasingly trained as conditional generative models over action chunks. Yet deployment produces mixed-quality experience-successfu…
cs.GR2025
Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation
Zikai Huang, Yihan Zhou, Xuemiao Xu +4
Singing-driven 3D head animation is a challenging yet promising task with applications in virtual avatars, entertainment, and education. Unlike speech, singing involves richer emot…