1 citations · 1 across the 4 of their papers we have counts for
1 paper · 1 filter
Yucheng Zhou, Wei Tao, Yiwen Guo +1
World models and multimodal large language models (MLLMs) provide complementary capabilities for predicting future outcomes from static visual observations. World models can genera…