1 paper · 1 filter
Vahid Balazadeh, Mohammadmehdi Ataei, Hyunmin Cheong +2
Physical reasoning remains a significant challenge for Vision-Language Models (VLMs). This limitation arises from an inability to translate learned knowledge into predictions about…