4 citations · 8 across the 10 of their papers we have counts for
1 paper · 1 filter
Yucheng Zhou, Wei Tao, Yiwen Guo +1
World models and multimodal large language models (MLLMs) provide complementary capabilities for predicting future outcomes from static visual observations. World models can genera…