1 paper · 1 filter
Hanan Gani, Tejal Kulkarni, Madhoolika Chodavarapu +2
Pretrained video generative models are promising backbones for visuomotor control, but their imagined futures often drift from task intent and are not reliably action-conditional.…