1 paper
Seyyed Saeid Cheshmi, Hahnemann Ortiz, James Mooney +1
Vision-language models (VLMs) have demonstrated strong reasoning abilities in literal multimodal tasks such as visual mathematics and science question answering. However, figurativ…