11 citations · 34 across the 13 of their papers we have counts for
1 paper · 2 filters
Yucheng Zhou, Wei Tao, Yiwen Guo +1
World models and multimodal large language models (MLLMs) provide complementary capabilities for predicting future outcomes from static visual observations. World models can genera…