1 paper
Mingjia Wang, Taiting Lu, Ziwei Dong +25
Recent vision-language models (VLMs) show strong capabilities in robotic perception and spatial reasoning, yet their ability to reason about complex mechanical assemblies remains u…