1 paper · 1 filter
Sina Malakouti, Aysan Aghazadeh, Ashmit Khandelwal +1
Vision language models (VLMs) have shown strong zero-shot generalization across various tasks, especially when integrated with large language models (LLMs). However, their ability…