1 paper
Jianjie Fang, Xvyuan Liu, Ziyou Wang +9
World models are becoming core infrastructure for embodied intelligence, with action-conditioned video generation providing controllable predictions of how scenes evolve after agen…