1 paper · 1 filter
Prabhjot Singh, Bhushan Pawar, Madhu Reddiboina +1
Current multilingual evaluations for Vision-Language Models (VLMs) assume a one-to-one mapping between language and orthography, overlooking billions of users of multi-script langu…