1 paper · 1 filter
Linhan Wang, Zijian An, Mingyuan Zhang +7
Video generative models provide rich physical priors for robot learning, yet existing world-action models (WAMs) face a fundamental trade-off: synchronous video generation at contr…