Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
AVControl: Efficient Framework for Training Audio-Visual Controls
Matan Ben-Yosef, Tavi Halperin, Naomi Ken Korem +6
Controlling video and audio generation requires diverse modalities, from depth and pose to camera trajectories and audio transformations, yet existing approaches either train a sin…
cs.CV2025
EVA: An Embodied World Model for Future Video Anticipation
Xiaowei Chi, Chun-Kai Fan, Hengyuan Zhang +8
Video generation models have made significant progress in simulating future states, showcasing their potential as world simulators in embodied scenarios. However, existing models o…