1 paper
George Ibrahim, Rita Ramos, Yova Kementchedjhieva
Multilingual vision-language models have made significant strides in image captioning, yet they still lag behind their English counterparts due to limited multilingual training dat…