1 paper
Mahtab Bigverdi, Linjie Li, Weikai Huang +9
Vision language models (VLMs) excel at many tasks but still struggle with spatial reasoning when critical information is not directly observable. Many such problems require imagina…