1 paper · 1 filter
Bahey Tharwat, Giorgos Kordopatis-Zilos, Pavel Suma +2
Multimodal Large Language Models (MLLMs) have demonstrated strong cross-modal reasoning capabilities, yet their potential for vision-only tasks remains underexplored. We investigat…